Claude Haiku 5.5 против GPT-6 Luna Pro: Модель против Режима

Источник: OrcaRouter•

Claude Haiku 5.5 против GPT-6 Luna Pro: Модель против Режима

Одинаковый прайс $0.10/$0.50, разные пороги: Claude Haiku 5.5 против GPT-6 Luna Pro, где pro — это режим, а не модель.

Одна сторона этого сравнения — модель, а другая — настройка. Claude Haiku 5.5 стала общедоступной 7 октября 2026 года по цене $0.10 за миллион входных токенов и $0.50 за миллион выходных на Claude API, Amazon Bedrock, Google Cloud, Microsoft Foundry и Claude Platform на AWS. GPT-6 Luna Pro вовсе не является моделью: чтобы получить к ней доступ, нужно вызвать GPT-6 Luna (доступную с 22 сентября 2026 года по тем же ценам $0.10 и $0.50), установив параметр reasoning.mode в значение pro вместо standard. Идентификатора gpt-6-luna-pro на странице моделей OpenAI нет. Таким образом, честная постановка вопроса в этом противостоянии звучит не как «какая модель победит», а как «что лучше потратить по десять центов за миллион входных токенов»: маленькая модель с регулятором усилий или более крупная модель, запущенная в режиме, который выполняет больше работы и выставляет счет за токены, которые вам не показывают. Для коротких задач с высоким объемом ответов обычно подходит первый вариант. Для сложных и нечастых задач — второй, но число, которое определяет выбор, OpenAI не опубликовала.

Что такое «pro» с технической точки зрения

В руководстве по рассуждениям OpenAI указано, что модели GPT-5.6 и GPT-6 поддерживают два режима в Responses API: standard (по умолчанию) и pro, которые выбираются с помощью reasoning.mode. Этот режим управляется отдельно от параметра reasoning.effort: режим определяет, сколько работы модель выполняет перед тем, как выдать ответ, а усилие задает объем рассуждений внутри выбранного режима. Документированные значения усилий для GPT-6 Luna: none, low, medium (по умолчанию), high, xhigh и max, и любое из них можно комбинировать с режимом pro.

В отношении тарификации руководство дает четкие и немного контринтуитивные пояснения. В режиме Pro все затраты модели на подготовку окончательного ответа суммируются, и эти токены тарифицируются «по стандартным тарифным ставкам выбранной модели». В тарифной сетке нет надбавки за режим pro. Затраты отражаются в виде объема, поскольку режим pro «выполняет больше работы модели, чем стандартный режим, увеличивая использование токенов и стоимость», причем токены рассуждений тарифицируются как выходные токены, но отображаются в объекте использования только в поле output_tokens_details.reasoning_tokens. Если вы не читаете это поле, увеличение незаметно до тех пор, пока не придет счет.

Из этого вытекают два сравнения, которые стоит разделять. По сравнению с GPT-6 Luna в стандартном режиме, режим pro представляет собой ту же модель с неизвестным множителем потребления токенов. По сравнению с Claude Haiku 5.5, это также другая модель совсем другого масштаба — 1 050 000 токенов контекста против 1 млн, предел входных данных в 922 000 токенов и ограничение по базе знаний от 18 мая 2026 года, находящаяся на уровне, который в собственной документации Anthropic позиционирует чуть выше Haiku для сложных агентских задач. Эти два отличия действуют одинаково в отношении стоимости и противоположным образом в отношении возможностей, именно поэтому их нельзя просто прочитать по прейскуранту.

Тарифные сетки лицом к лицу

Обе модели тарифицируются по двум уровням, причем пороги находятся в разных местах, что важнее базовой ставки, так как сами базовые ставки идентичны.

• Ввод — Claude Haiku 5.5: $0.10 за миллион до 100 000 токенов, $0.50 выше этого порога. GPT-6 Luna: $0.10 до 272 000 токенов, $0.20 выше.

• Вывод — Claude Haiku 5.5: $0.50 за миллион до 100 000 токенов, $2.50 выше. GPT-6 Luna: $0.50 до 272 000 токенов, $0.75 выше.

• Кэширование — Claude Haiku 5.5: чтение кэша $0.01 и запись $0.125 ниже черты, $0.05 и $0.625 выше нее. GPT-6 Luna: чтение кэша $0.01 и запись $0.125 ниже 272 000 токенов, $0.02 и $0.25 выше.

• Контекст и вывод — 1 млн токенов и 128 000 максимальных выходных токенов для Claude Haiku 5.5; 1 050 000 токенов с ограничением на вход в 922 000 токенов и 128 000 максимальных выходных для GPT-6 Luna.

• Мышление (Thinking) — адаптивное у обеих. У Claude Haiku 5.5 по умолчанию установлено среднее усилие (medium); у GPT-6 Luna по умолчанию установлено среднее усилие и стандартный режим, а режим pro доступен как дополнительная опция поверх них.

• Скидки на пакетную обработку и кэширование — Claude Haiku 5.5 дает скидку 50% в Message Batches API; GPT-6 Luna дает скидку 50% на Batch и Flex, удваивает цену в режиме Fast и добавляет 10% надбавку за региональную обработку.

Единственный параметр, который устроен иначе — это токенизатор. В документации Anthropic отмечается, что Claude Haiku 5.5 использует более новый токенизатор, общий с Claude 4.7 и более поздними версиями, поэтому тот же текст занимает примерно на 30% больше токенов, чем в Claude Haiku 4.5. Это не меняет ставку; это меняет то, как быстро запрос достигает порога в 100 000 токенов, и это реальная разница в стоимости, которую не отображает ни один прейскурант. Запрос на 90 000 токенов измеряется как примерно 117 000 и оплачивается по тарифу $0.50 за миллион входных токенов вместо $0.10, что в пять раз превышает ставку для запроса, который визуально выглядит так, будто он с комфортом укладывается под черту.

Во сколько обходится режим pro в единственных доступных единицах измерения

Поскольку множитель не опубликован, полезно указать стоимость каждого дополнительного токена, а также оценить вероятные диапазоны при больших объемах.

• При цене GPT-6 Luna в $0.50 за миллион выходных токенов каждые дополнительные 10 000 выходных токенов на задачу обходятся в $0.005. При выполнении 100 000 задач в день этот прирост составляет миллиард дополнительных токенов — около $500 в день или $15 000 в месяц для модели, чья базовая цена составляет десять центов за миллион входных.

• Для масштаба: GPT-6 Luna при максимальном усилии уже расходует 140 миллионов выходных токенов при запуске Intelligence Index против медианы в 100 миллионов, что оценщик описывает как несколько многословно. Таблица запуска Anthropic, запущенная на собственной инфраструктуре компании, ставит GPT-6 Luna на уровень 16.4% в Terminal-Bench 4.0 и 42.4% в FrontierCode 1.1 против 39.2% и 46.4% у Claude Haiku 5.5 — данные предоставлены вендором, получены на наборе тестов одного вендора для модели конкурента.

• В независимых рейтингах расстановка сил выглядит иначе. Artificial Analysis оценивает Claude Haiku 5.5 с максимальным усилием (Max) в 43 балла по шкале Intelligence Index v4.3.2 (второе место из 182), а GPT-6 Luna (Max) — в 38 баллов (восьмое место из 182). Оба числа получены в стандартном режиме с максимальным усилием. Независимая оценка GPT-6 Luna в режиме pro отсутствует: на ее странице нет упоминаний pro, и Artificial Analysis его не указывает.

Структурная проблема режима pro заключается в их взаимодействии с последними двумя пунктами. Вся выгода GPT-6 Luna в стоимости по сравнению с Claude Haiku 5.5 проистекает из эффективности токенов — 140 миллионов выходных токенов против 440 миллионов для того же тестового пакета при одинаковых тарифах, именно поэтому один и тот же тест стоит $0.07 за задачу с одной стороны и $0.21 с другой. Режим Pro по определению является режимом, который генерирует больше токенов. Включение этого режима означает отключение того фактора, который делал модель дешевой в данном сравнении, а множитель, показывающий, насколько именно возрастает стоимость, не опубликован. Это не довод в пользу того, что режим pro плох — в сложных задачах больше работы обычно означает лучшее качество, — это довод в том, что режим pro конкурирует по возможностям, а не по цене, и оценивать его следует в сравнении со средним классом моделей, рядом с которым он стоит по цене, а не с дешевым классом, внутри которого он физически находится.

В чем каждая из них действительно побеждает

Если свести всё к самому решению, то разделение выглядит четким, хотя ни одна из сторон не лишена оговорок.

Claude Haiku 5.5 удерживает позиции в бюджетном сегменте. Модель работает быстрее в обоих важных аспектах: 241,9 выходных токена в секунду по измерениям Artificial Analysis против 123,0 у GPT-6 Luna, а время до первого токена в замере Index составляет 295 секунд (это обусловлено тем, как долго модель думает перед ответом в режиме максимальной интенсивности, а не сетевыми задержками). Ее тарифная сетка переходит во второй уровень при 100 000 токенах, а токенизатор увеличивает промпты примерно на 30%, поэтому рабочие нагрузки с длинными промптами обходятся дороже указанных цен в обоих случаях. Взамен она предлагает превосходство в интеллекте на пять пунктов в независимом рейтинге и регулятор интенсивности (от низкого до максимального) — самый полезный инструмент контроля затрат, который вендоры предложили в этих релизах. Фиксация уровня интенсивности позволяет пожертвовать частью этого пятипунктового превосходства ради получения стоимости одной задачи, близкой к показателям GPT-6 Luna.

GPT-6 Luna Pro доминирует в сложном сегменте, однако итоговый счет остается непредсказуемым. Базовая модель дешевле в расчете на токен при превышении порога в 272 000 входных токенов по сравнению с Claude Haiku 5.5 после 100 000 токенов (в 2,5 раза для входа и в 3,3 раза для выхода), а ее первый уровень распространяется в восемь раз дальше по контекстному окну. Стандартный режим заметно дешевле в расчете на выполненную задачу. Режим Pro меняет это соотношение на больший объем работы за тот же ответ при тех же тарифах, а превосходит ли он Claude Haiku 5.5 в режиме максимальной интенсивности или модель среднего уровня на конкретной задаче — вопрос, на который не отвечает ни одна опубликованная цифра. Единственный способ узнать это — запустить задачу в обоих режимах и проанализировать поле токенов рассуждения.

Пробуем любую из них без ставок

Неудобная часть этого сравнения заключается в том, что ее важнейший показатель — реальная стоимость режима pro — может быть получен только путем прогона вашего собственного трафика, а эффективная стоимость меньшей модели зависит от того, где ваши промпты окажутся относительно отметки в 100 000 токенов после повторной токенизации. Оба аспекта представляют собой задачу измерения, и оба обходятся дешевле на общей эндпоинт-точке, чем при работе через два клиентских приложения вендоров.

GPT-6 Luna уже доступна в каталоге OrcaRouter по прейскуранту провайдера без наценки (0%), поэтому базовый показатель в стандартном режиме для этого сравнения можно вызывать с помощью одного ключа, а изменение цен вендором отражается с нашей стороны в тот же день, а не в следующем расчетном периоде. Claude Haiku 5.5 пока отсутствует в каталоге; те уровни Anthropic, которые мы маршрутизируем сегодня — это Claude Haiku 4.5, Claude Sonnet 5.5 и Claude Opus 5.5, что превращает тест эскалации с дешевого уровня на средний в правило маршрутизации, а не в изменение кода. Автоматическое переключение при сбое позволяет модели возрастом в два дня обрабатывать производственный трафик, пока вы все еще проводите ее измерения: провайдер, у которого начинаются сбои, исключается из маршрута, а не приводит к падению запроса, что и отличает пилотный проект, который можно запустить на этой неделе, от миграции, которую необходимо планировать.

Что ставит точку в вопросе

Три вещи в порядке их влияния на изменение итогового ответа. Публикация OpenAI мультипликатора токенов для режима pro или отдельного префикса с собственной ценовой линией превратила бы главную неизвестную в простую арифметику. Повторный запуск GPT-6 Luna в режиме pro с сопоставимой интенсивностью силами Artificial Analysis сделал бы это с независимой стороны. И второй независимый запуск Claude Haiku 5.5 на среднем уровне интенсивности, а не максимальном, показал бы реальную стоимость модели при ее настройках по умолчанию (в конфигурации, которую будут использовать большинство пользователей) — цифра в $0,21 за задачу получена в режиме максимальной интенсивности, которая не является стандартной.

До тех пор точное резюме остается ограниченным. Claude Haiku 5.5 — это модель, которую можно вызывать, оценивать и тестировать уже сегодня, и для объемов, под которые создан ее уровень, это более дешевый вариант с документированным способом еще больше снизить затраты. GPT-6 Luna Pro представляет собой конфигурацию модели, доступную для вызова; проблема заключается не в ее тарифной сетке, а в том, что потребление токенов не проверено аудитом, а все ее преимущества сводятся к задачам, настолько сложным, что увеличение расхода токенов является самой целью. Покупайте ее для таких задач, измеряйте показатели перед началом работы и не используйте на высоконагруженных маршрутах до тех пор, пока кто-нибудь не опубликует мультипликатор.

О чём эта статья

Ещё в разделе «AI и машинное обучение»

Все →

Ещё от OrcaRouter