GPT-6.1 Sol Pro против GPT-6 Sol Pro: те же тарифы, одна строка разницы

Источник: OrcaRouter

GPT-6.1 Sol Pro против GPT-6 Sol Pro: те же тарифы, одна строка разницы

Источник: OrcaRouter

Режим Pro для двух соседних снепшотов Sol: одинаковые заголовки, одна различающаяся строка кеша и почему пробел в доказательствах важнее, чем семь дней разницы.

•Обновлено: 29 сентября 2026 г.

Две недели разделяют релизы и почти ничего не разделяет счета, поэтому сравнение между GPT-6.1 Sol Pro и GPT-6 Sol Pro получается коротким и необычайно точным. Оба имени сводятся к одному и тому же — базовой модели плюс reasoning.mode, установленному в значение pro в Responses API, поэтому ни у одного нет собственного идентификатора, собственной тарифной сетки или собственной наценки. GPT-6.1 Sol Pro — это GPT-6.1 Sol, выпущенная 29 сентября 2026 года и работающая в режиме pro. GPT-6 Sol Pro — это GPT-6 Sol, выпущенная 22 сентября 2026 года и работающая в том же режиме. Обе модели предоставляют 1 050 000 токенов контекста и 128 000 токенов максимального вывода, обе стоят $2,00 за миллион входных токенов и $10,00 за миллион выходных токенов, и обе оценивают дополнительную работу режима по тем же стандартным тарифам. На самом деле различаются лишь одна строка счетчика, одна ступень лестницы усилий и объем независимых доказательств, стоящих за каждой из конфигураций.

Оба названия обозначают одно и то же для одного и того же переключателя

Начните с механизма, поскольку именно из-за него в этом сравнении так мало строк. OpenAI продавала Pro как продукт в эпоху GPT-5 — gpt-5-pro, gpt-5.2-pro, gpt-5.4-pro, gpt-5.5-pro, o1-pro, o3-pro, — каждая со своим идентификатором и собственной премиальной тарификацией (до $150,00 за входные и $600,00 за выходные токены на миллион для o1-pro). Затем механизм изменился, а терминология осталась прежней. Pro стала параметром, который задается для флагманской модели и оплачивается по ее собственным тарифам, о чем прямо говорится на странице устаревания OpenAI: когда эти старые счетчики будут выведены из эксплуатации в октябре и декабре 2026 года, рекомендуемой заменой станет gpt-5.6-sol с параметром reasoning.mode: pro — модель плюс режим, а не продукт-преемник.

Публичная схема API вендора это подтверждает. Поиск идентификаторов эпохи GPT-6 выдает четыре варианта: gpt-6-astra, gpt-6-sol, gpt-6-luna и gpt-6.1-sol. Среди них нет вариантов pro, и они также отсутствуют в прейскуранте. То, что появилось в каталогах третьих сторон спустя считаные часы после запуска версии 6.1, — это про-версии для всего семейства (6.1 Sol Pro, 6 Sol Pro, 6 Luna Pro, 5.6 Sol Pro), каждая из которых цитирует прайс-лист своей базовой модели. Это просто строка каталога, украшенная новым именем, а не поставка продукта вендором, и именно поэтому объектами данного сравнения выступают режим для двух разных базовых моделей, а не два отдельных развертывания.

В чем реальные различия между двумя конфигурациями

Вот все параметры, которые их разделяют, по одному на каждую строку:

• Во что превращается имя — gpt-6.1-sol с reasoning.mode: "pro" против gpt-6-sol с reasoning.mode: "pro"; ни вендор, ни каталог не публикуют идентификатор -pro ни для одной из них • Дата выпуска базовой модели — 29 сентября 2026 года против 22 сентября 2026 года, с разницей в семь дней • Цена входных токенов — $2,00 за миллион токенов для обеих, поэтому дополнительный объем ввода в режиме pro стоит одинаково за единицу в любой версии • Цена выходных токенов — $10,00 за миллион токенов для обеих, и по этой ставке тарифицируются дополнительные токены рассуждений режима, поскольку режим pro изменяет объем, а не цену • Кешированный ввод — $0,10 за миллион для 6.1 Sol против $0,20 для 6 Sol; единственная опубликованная строка, по которой тарифы двух моделей расходятся • Запись в кеш — $2,50 за миллион токенов для обеих • Перерасчет стоимости длинных промптов — при превышении 272 000 входных токенов весь запрос пересчитывается по коэффициенту 2× для ввода и кеша и 1,5× для вывода для обеих моделей, что устанавливает для 6.1 Sol цены в $4,00 за ввод, $0,20 за кеш, $5,00 за запись в кеш и $15,00 за вывод на миллион токенов по сравнению с $4,00, $0,40, $5,00 и $15,00 для 6 Sol — скидка на кеш сохраняется после перерасчета • Ограничения контекста и вывода — 1 050 000 токенов контекста и 128 000 токенов максимального вывода для обеих • Лестница усилий рассуждений — low, medium (по умолчанию), high, xhigh и max на 6.1 Sol, причем none и minimal не поддерживаются; та же лестница на 6 Sol, где режим none по-прежнему доступен • Документированный порог знаний — 30 апреля 2026 года для версии 6.1; мы не проверяли этот параметр для 6 Sol на прочитанных страницах, поэтому эту строку следует считать неопределенной, а не различием • Независимая оценка — опубликованная страница третьей стороны для GPT-6 Sol, полное отсутствие данных для GPT-6.1 Sol и отсутствие оценки про-конфигурации для обеих моделей

Прочтите этот список, и логика решения станет очевидной. Одна строка представляет собой реальное опубликованное различие — стоимость кешированного ввода, которая снижается вдвое. Другая строка — это возможность, которую вы теряете, а не приобретаете: невозможность объединить режим с уровнем усилий none в новой версии, что важно для тех, кто использует эту комбинацию для снижения задержки в задачах маршрутизации. Все остальное идентично, включая правило перерасчета, которое применяется к любому запросу размером более 272 000 токенов.

Пробел в доказательствах, если говорить прямо

Здесь сравнение перестает быть симметричным. У GPT-6 Sol есть реальный сторонний тест: независимая таблица лидеров, используемая этим блогом в качестве внешнего эталона, оценивает ее в 47,5 балла по своему индексу интеллекта (12-е место в выборке из 145 моделей), а наши собственные маршрутизаторы демонстрируют измеренные показатели производительности для стандартной конфигурации: медианную задержку около 1,24 секунды, примерно 65 токенов в секунду и уровень ошибок 0,16% при объеме трафика около 167 миллионов токенов. У GPT-6.1 Sol ничего этого нет. Страница таблицы для версии 6.1 возвращает ошибку 404, и эта строка отсутствует в живом рейтинге, поэтому все публикуемые сегодня баллы для нее исходят исключительно от вендора.

Здесь следует сделать два предостережения, и оба они предостерегают от избыточной интерпретации того, что у нас есть. Показатель измеренной задержки относится к стандартной конфигурации; режим pro выполняет больше работы с моделью перед возвратом окончательного ответа, поэтому он по определению работает медленнее, и это значение не переносится на про-запуск. Кроме того, ни одна сторонняя таблица лидеров не публикует отдельную оценку про-конфигурации ни для одной модели из этого семейства — таблица измеряет ту конфигурацию, которую измеряет, не выделяя режим отдельно. Таким образом, объективное состояние дел представляет собой измеренную модель 6 Sol в стандартном режиме против описанной вендором версии 6.1, причем режим pro с обеих сторон опирается исключительно на описание самого вендора.

Три случая и что должен делать каждый из них

• Вы уже используете про-режим в GPT-6 Sol, и он оправдывает себя. Оставайтесь пока на gpt-6-sol и сохраняйте ту нагрузку, при которой вы его замерили. В тарифе 6.1 ставка за кэшированный ввод снижена вдвое, что при повторном использовании префикса дает реальную экономию на объемах, однако сам этот режим документирован с использованием идентификатора 6.1 только в одном месте — в разобранном примере руководства по рассуждениям — и нигде на странице самой этой модели. Дождитесь появления документации вендора по каждой модели, прежде чем переносить уже проверенный путь • Вы никогда не тестировали про-режим. Начните с тарифа 6.1 в стандартном режиме, а затем запустите параллельно про-ветку с тем же уровнем reasoning.effort. Вы получите более дешевую линию кэша для той ветки, которую оставите, более свежий снимок и замер множителя режима на вашем собственном трафике, а не чужие ожидания • В вашем трафике преобладает стабильный префикс — инструкции, схемы инструментов, длинный системный промпт. Это тот самый случай, когда тариф 6.1 выигрывает по цене еще до каких-либо замер, поскольку единственная различающаяся опубликованная строка — это то, за что вы платите чаще всего. Произведите расчеты для объема вашего собственного префикса: при $0.10 против $0.20 за миллион кэшированных токенов экономия масштабируется в зависимости от того, какая доля вашего ввода повторяется

Ни один из этих трех вариантов не решается бенчмарком, и в этом суть. Режим идентичен с обеих сторон, базовая ставка идентична с обеих сторон, а решение сводится к стоимости кэша, ограничению уровня усилий и тому, нужно ли вам чье-то чужое число, прежде чем вы сделаете шаг.

Запуск обеих конфигураций с использованием одного ключа

Практическая причина проводить это сравнение, а не рассуждать о нем, заключается в том, что две ветки отличаются строкой модели и одним параметром, поэтому эксперимент не требует практически никаких затрат на развертывание. OrcaRouter маршрутизирует openai/gpt-6-sol по собственным прейскурантным ценам OpenAI без каких-либо наценок: $2.00 за ввод, $0.20 за кэш, $10.00 за вывод, причем тариф 272K опубликован по цене $4.00 и $15.00, и применяет правило вендора о пересмотре цен в исходном виде, а не заменяет его собственным правилом. Поскольку к прайсу вендора не добавляется никакой наценки, изменение тарифа или стоимости кэша отображается на маршруте в день публикации OpenAI без необходимости пересмотра второго контракта. Ни тариф 6.1, ни его про-версия сегодня на этих маршрутах отсутствуют — мы проверили публичный каталог 30 сентября 2026 года, и запросы к openai/gpt-6.1-sol и openai/gpt-6.1-sol-pro возвращают ошибку «модель не найдена», — поэтому ветка, которую вы можете вызвать прямо сейчас, это 6 Sol в стандартном или про-режиме, на том же эндпоинте и с тем же ключом, которые вы будете использовать для более нового тарифа, когда он появится.

Запустите тест из трех веток на ваших собственных сложных запросах, удерживая параметр reasoning.effort постоянным, чтобы за раз менялась только одна переменная: gpt-6-sol в стандартном режиме, gpt-6-sol с включенным про-режимом и — как только она станет доступна для маршрутизации — gpt-6.1-sol с тем же уровнем усилий. Считывайте общее количество выставленных к оплате токенов из объекта usage, а не из тела ответа, поскольку дополнительные рассуждения режима попадают в поле, которое текст ответа никогда не показывает. Про-запуск в сравнении со стандартным двойником дает вам множитель для вашего трафика, который не совпадет ни с чьим чужим. Сохранение третьей ветки в качестве регрессионного теста после принятия решения требует изменения одной строки, а правило маршрутизации, которое отправляет действительно сложные запросы на про-конфигурацию, в то время как основной объем остается стандартным, представляет собой строку в DSL маршрутизации, а не переархитектуру — именно эта версия данного решения переживает следующее обновление модели.

Суть в двух словах

Если отбросить названия, перед нами одна конфигурация на двух соседних снимках с разницей в семь дней, разделяющая единый прайс-лист вплоть до порога пересмотра цен. Более новый снимок сокращает вдвое ставку за кэшированный ввод и отказывается от усилий: none; более старый сохраняет эту ступень и поставляется со сторонней оценкой, зафиксированной историей задержек и про-режимом, который вендор документирует на странице модели, а не только в примере из руководства. Если ваш трафик повторно использует стабильный префикс на объемах, тариф 6.1 является более дешевым вариантом по умолчанию, и об этом следует заявлять в отношении кэша, а не базовой ставки. Если ваш путь в про-режиме уже измерен и работает, нет никаких опубликованных данных, оправдывающих его смену на этой неделе. В любом случае, рассматривайте оба названия из каталога как один переключатель для двух базовых моделей, потому что это единственная трактовка, которая выдерживает взгляд на собственный прайс-лист вендора.

Ветка, которую вы можете вызвать сегодня, — это 6 Sol (стандартная или про), и она указана в публичном каталоге по прейскурантной цене OpenAI без каких-либо наценок, на одном эндпоинте и с одним ключом.

Ещё в разделе «AI и машинное обучение»

Все →

Ещё от OrcaRouter