GPT-6.1 Sol и GPT-6 Astra представляют собой средний и флагманский уровни одного семейства, выпущенные с разницей в четыре недели — Sol 29 сентября 2026 года, Astra 3 сентября 2026 года. До этой недели сравнение между ними строилось исключительно на собственных цифрах OpenAI. Теперь это не так. Специалисты из Artificial Analysis оценили обе модели с максимальным уровнем рассуждений на одной и той же версии индекса, и результатом стал разрыв в 0,84 балла в пользу Astra при разнице в стоимости за один прогон оценки в 4,5 раза в пользу GPT-6.1 Sol. В официальных прейскурантах соотношение еще более разительное: Astra дороже GPT-6.1 Sol в 5 раз по входящим и выходящим токенам и в 10 раз по кэшированному вводу. Настоящая статья призвана ответить на вопрос, в каких случаях эта переплата дает ощутимый результат, а в каких является просто платой за имя.
Что представляют собой обе модели и что измеряла экспертная комиссия
Обе модели принимают текст и изображения на входе и выдают текст на выходе, имеют контекстное окно в 1 050 000 токенов и максимум 128 000 токенов на выходе. Обе предлагают пятиуровневую шкалу усилий — низкий (low), средний (medium), высокий (high), очень высокий (xhigh) и максимальный (max), отказавшись от настройки none, которую все еще поддерживает GPT-6 Sol. Ни одна из моделей не поддерживает тонкую настройку (fine-tuning). Значимые различия отражены в ценовых таблицах: Astra представляет собой флагманский сегмент, GPT-6.1 Sol — обновление находящегося под ним уровня, а позиционирование новой модели от самой OpenAI звучит так: «производительность, близкая к Astra, для сложных задач по более низкой цене».
Artificial Analysis оценивает это утверждение с помощью своего Индекса интеллекта (Intelligence Index) — десяти тестов в версии v4.3.2, одинаковой для обеих моделей, фиксируя дату выпуска каждой из них. Обе модели оцениваются в конфигурации с максимальным уровнем усилий, указанной в заголовке страницы модели. Ниже приведено это сравнение, а также расчет затрат, который не входит в сам индекс.
• GPT-6.1 Sol — выпущена 29.09.2026, Индекс интеллекта 51.8 при максимальных усилиях, $2.00 за ввод / $0.10 за кэш / $2.50 за запись в кэш / $10.00 за вывод на миллион токенов. • GPT-6 Astra — выпущена 03.09.2026, Индекс интеллекта 52.7 при максимальных усилиях, $10.00 за ввод / $1.00 за кэш / $12.50 за запись в кэш / $50.00 за миллион токенов. • Ни то, ни другое — принимает настройку усилий none; обе модели пересчитывают стоимость всего запроса по коэффициенту 2× для входящих токенов и ставок кэша и 1,5× для вывода, как только объем ввода превышает 272 000 токенов. Уровень длинного контекста для Astra стоит $20.00 за ввод / $2.00 за кэш / $75.00 за вывод; для GPT-6.1 Sol — $4.00 / $0.20 / $15.00. • Обе модели — поддерживают веб-поиск, поиск по файлам, генерацию изображений, интерпретатор кода, хостинговую оболочку, применение патчей, навыки, компьютерное управление, протокол MCP и поиск инструментов через Responses API.
0,84 балла индекса, в 4,5 раза дороже по счету за оценку
Два показателя расположены рядом на доске, и вместе они составляют суть всего спора. GPT-6 Astra при максимальных усилиях набирает 52,7 балла. GPT-6.1 Sol при максимальных усилиях набирает 51,8 балла. Рядом с каждым результатом доска публикует стоимость запуска лежащего в его основе индекса: $3,26 за задачу для Astra, $0,72 для GPT-6.1 Sol. Если прочитать это как одно предложение — 0,84 балла за в 4,5 раза большие деньги, — это самый важный для принятия решений показатель, который любая из компаний опубликовала об этих двух моделях.
Обе модели также публикуют оценки для каждого пункта шкалы усилий, что позволяет проводить сравнение при равных затратах, а не при равных настройках:
• максимальное усилие (max) — GPT-6.1 Sol: 51,8 при $0,72 за запуск против GPT-6 Astra: 52,7 при $3,26. • очень высокое (xhigh) — 51,0 при $0,39 против 52,4 при $2,31. • высокое (high) — 50,2 при $0,32 против 50,9 при $1,73. • среднее (medium) — 47,8 при $0,21 против 49,6 при $1,54. • низкое (low) — 42,1 при $0,13 против 45,8 при $0,82.
Если сопоставить уровни между моделями, обнаруживается факт, который ни один из производителей не афиширует: собственный разброс Astra между высоким и максимальным уровнями усилий составляет 1,8 балла индекса, что более чем в два раза превышает весь разрыв между Astra на максимуме и GPT-6.1 Sol на максимуме. Другими словами, выбор Astra вместо GPT-6.1 Sol приносит меньше прироста баллов, чем выбор максимальных усилий Astra вместо ее высоких усилий — причем второй вариант обходится лишь в малую долю от стоимости первого. Любой, чья рабочая нагрузка действительно чувствительна к этим 1,8 баллам, должен проверить настройку усилий, прежде чем проверять столбец модели.
В чем премия Astra все еще имеет ценность
Итоговый сводный показатель близок, но отдельные оценки — нет. При оценке построчно при максимальных усилиях GPT-6 Astra удерживает преимущество в шести тестах из десяти, причем побеждает именно в тех, которые связаны с активными действиями, а не с простыми ответами.
• AutomationBench-AA, многошаговые рабочие процессы с использованием различных инструментов — 0,685 для Astra против 0,649 для GPT-6.1 Sol. Astra впереди на 3,6 балла. • Terminal-Bench 4.0, работа в терминале в реальных средах — 0,591 против 0,561. Astra впереди на 3,0 балла. • SciCode — 0,565 против 0,542. Astra впереди на 2,3 балла. • Humanity's Last Exam — 0,547 против 0,529. Astra впереди на 1,8 балла. • AA-Omniscience — 43,4 против 41,5, при этом на том же наборе уровень галлюцинаций Astra составляет 0,513 против 0,543 у GPT-6.1 Sol. Astra не только точнее, но и чаще готова признать, что чего-то не знает. • AA-Briefcase v1.1, профессиональные результаты работы — Elo 1568,9 против 1564,2. Astra впереди на 4,7 балла.
Эта закономерность достаточно устойчива для планирования: когда задача требует от модели удерживать длинную цепочку последовательных действий (управлять терминалом, запускать многоинструментальный рабочий процесс, создавать документ), преимущество Astra реально и воспроизводимо в различных тестах. Когда задача сводится к вопросу на знание, на который нужно ответить за один шаг, это преимущество в значительной степени исчезает.
В чем побеждает более дешевая модель, включая кэширование
GPT-6.1 Sol вовсе не является просто немного ухудшенной версией Astra. В тестах, которые поощряют чтение и рассуждение над большими объемами материалов, она лидирует, а в прейскуранте ее превосходство выражено цифрами, которых индекс никогда не видит.
• GDPval-AA, профессиональная работа с оценкой экспертов — Elo 1575,1 для GPT-6.1 Sol против 1541,9 для Astra. Преимущество в 33 балла у модели, которая стоит в пять раз дешевле, и самая крупная самостоятельная победа в этом ряду. • AA-LCR v1.1, рассуждения на основе длинного контекста — 0,830 против 0,807. Лидирует GPT-6.1 Sol. • GDP.pdf — абсолютная ничья на уровне 0,310, как и CritPt с результатом 0,317. • Кэшированный ввод — $0,10 за миллион токенов против $1,00 у Astra. Именно этот показатель определяет экономику агентов, хотя он никак не отражен в индексе. • Скорость вывода — 66,8 токенов в секунду против 56,95 в том же оценочном прогоне, при этом было потрачено 67,2 миллиона выходных токенов против 60,0 миллионов у Astra. Ни одна из моделей не является сверхбыстрой, но GPT-6.1 Sol работает быстрее.
Месяц работы агента по обоим прейскурантам
Возьмем рабочую нагрузку, предполагающую отправку стабильного префикса: 40 миллионов входящих токенов в месяц, из которых 85% обслуживаются из кэша, плюс 4 миллиона исходящих токенов. По тарифам GPT-6.1 Sol это составит $3,40 за чтение из кэша, $12,00 за некэшированный ввод и $40,00 за вывод — всего $55,40 в месяц. По тарифам GPT-6 Astra тот же объем трафика обойдется в $34,00 за кэшированное чтение, $60,00 за некэшированный ввод и $200,00 за вывод — всего $294,00. Нагрузка идентична, но счет больше в 5,3 раза.
Два порога меняют эту арифметику, и оба стоит рассчитать до принятия решения о миграции, а не после. Первый — это 272 000 входных токенов в одном запросе: при их превышении стоимость всего запроса пересчитывается по удвоенным тарифам для входа и кэша и в 1,5 раза для выхода, что поднимает цены для GPT-6.1 Sol до $4,00 / $0,20 / $15,00, а для Astra — до $20,00 / $2,00 / $75,00. Второй — сама лестница уровней усилий (effort ladder): снижение уровня GPT-6.1 Sol с max до xhigh сокращает стоимость индексного прогона с $0,72 до $0,39 при потере 0,8 балла, а снижение Astra с max до high уменьшает ее с $3,26 до $1,73 при потере 1,8 балла. В цикле агента с интенсивным использованием кэша настройка уровня усилий является более мощным рычагом управления затратами, чем выбор модели в таблице, что противоположно тому, как эти две модели обычно сравнивают.
Что запускать и к чему у вас есть реальный доступ
Судя по имеющимся данным, разделение выглядит четче, чем следует из маркетинговых материалов. Направляйте работу, которая должна выдерживать длинную цепочку действий (сеансы терминала, автоматизацию с большим количеством инструментов, подготовку документов, где галлюцинация даже одного абзаца обходится дорого), в GPT-6 Astra, и подумайте о ее запуске на уровне high вместо max, если только вы не измерили, что дополнительные 1,8 балла действительно важны для ваших задач. Все, что связано с большими объемами знаний, кэшированием или в основном чтением, направляйте в GPT-6.1 Sol: она лучше справляется с оценкой профессиональной работы, лучше рассуждает в условиях длинного контекста, работает быстрее и обходится в пять-десять раз дешевле по статьям, которые доминируют в реальном счете.
То, к чему у вас есть доступ сегодня — самая честная часть. OrcaRouter предоставляет GPT-6 Astra по собственным прайс-листам OpenAI — по тарифам $10,00 за вход, $50,00 за выход, $1,00 за чтение из кэша и $12,50 за запись в кэш, с точным применением правила пересчета для 272K, как его публикует поставщик, — наряду с GPT-6 Sol и GPT-6 Luna. Он не обслуживает GPT-6.1 Sol: публичный каталог возвращает ошибку "модель не найдена" для openai/gpt-6.1-sol, и мы не собираемся описывать модель, которую не можем маршрутизировать. Поскольку цены поставщика передаются без наценки, в день появления этой модели она будет стоить по тарифам OpenAI на нашей стороне без этапа пересчета цен; сегодня же рабочая половина этого сравнения представляет собой флагман за единым ключом API с доступным языком маршрутизации DSL, если вы хотите объединить дешевую и дорогую модели в один вызов, а не выбирать между ними для каждого запроса.
Единственное, за чем стоит следить — это строка, отсутствующая в данном сравнении. Ни цифры поставщика, ни независимый индекс не подскажут вам, как ваш собственный трафик поведет себя на этих двух ступенях, и единственный недорогой способ узнать это — прогнать один и тот же набор задач через обе модели, используя отказоустойчивость в качестве страховки. Это эксперимент с использованием одного ключа, когда доступны обе половины, и полуэксперимент, пока это не так.











