Попробуйте Jev на Vercel AI Gateway
Дайте своему приложению более быстрый способ решать, что делать дальше. Используйте Jev для маршрутизации запросов, пометки контента и оценки приоритетов.
Начать работу
Индекс производства AI Gateway — сентябрь 2026 г.
Каждый месяц AI Gateway маршрутизирует десятки триллионов токенов между производственными приложениями и лабораториями ИИ. Этот трафик дает нам представление о том, как на самом деле выглядит использование ИИ на современном предприятии, и мы публикуем его здесь ежемесячно. Ознакомьтесь с отчетами Индекса производства за июнь, июль и август.
Скопировать ссылку на заголовок Сводка за сентябрь 2026 г.
В сентябрьском индексе представлены данные AI Gateway, собранные по август 2026 года.
- Модели с открытыми весами впервые обработали большинство токенов шлюза, увеличившись с 7% в декабре до 56% в августе.
Модели с открытыми весами впервые обработали большинство токенов шлюза, увеличившись с 7% в декабре до 56% в августе.
- Средний токен стоит менее половины того, что стоил пять месяцев назад. Цена за токен упала на 23,2% в августе, что стало третьим ежемесячным снижением подряд, а медианная команда заплатила на 7,6% меньше.
Средний токен стоит менее половины того, что стоил пять месяцев назад. Цена за токен упала на 23,2% в августе, что стало третьим ежемесячным снижением подряд, а медианная команда заплатила на 7,6% меньше.
- Fable 5, самая мощная модель Anthropic, потеряла две трети своей доли расходов на шлюз за один месяц. Opus 5, при вдвое меньшей цене, утроила свою долю. Anthropic сохранила 64% всех расходов.
Fable 5, самая мощная модель Anthropic, потеряла две трети своей доли расходов на шлюз за один месяц. Opus 5, при вдвое меньшей цене, утроила свою долю. Anthropic сохранила 64% всех расходов.
- Gemini 3 Flash потеряла 95% своей доли токенов шлюза с мая, и более трех четвертей потерянного объема перешло к моделям из других лабораторий.
Gemini 3 Flash потеряла 95% своей доли токенов шлюза с мая, и более трех четвертей потерянного объема перешло к моделям из других лабораторий.
Скопировать ссылку на заголовок Последние обновления индекса
Ежемесячный отчет охватывает данные по август. Мы добавляем сюда примечательные события между выпусками.
- 17 сентября: OpenAI запустила Astra 3 сентября, и она заняла треть расходов OpenAI в течение двух дней и вдвое превысила долю Fable 5.1 в расходах на шлюз. Astra заняла 7,7% всех расходов на шлюз за первые двенадцать дней, в то время как Fable 5.1, запущенная двумя днями ранее по той же цене, заняла 3,7%.
17 сентября: OpenAI запустила Astra 3 сентября, и она заняла треть расходов OpenAI в течение двух дней и вдвое превысила долю Fable 5.1 в расходах на шлюз. Astra заняла 7,7% всех расходов на шлюз за первые двенадцать дней, в то время как Fable 5.1, запущенная двумя днями ранее по той же цене, заняла 3,7%.
- 18 сентября: Jev теперь является самой быстрорастущей моделью в истории AI Gateway. В течение первых 24 часов ее использовали почти 13% платных команд, что в 2 раза больше, чем семейство GPT-5.6, и более чем в 6 раз больше, чем Fable 5.1.
18 сентября: Jev теперь является самой быстрорастущей моделью в истории AI Gateway. В течение первых 24 часов ее использовали почти 13% платных команд, что в 2 раза больше, чем семейство GPT-5.6, и более чем в 6 раз больше, чем Fable 5.1.
Скопировать ссылку на заголовок Модели с открытыми весами впервые занимают большую часть объема токенов
В августе модели с открытыми весами обработали 56% всех токенов на AI Gateway, что стало первым месяцем, когда они заняли большую часть объема.
В декабре 2025 года они обрабатывали менее одного из десяти токенов, а всего восемь месяцев спустя они обработали больше токенов, чем все модели с закрытыми весами вместе взятые.
Хотя передовые модели сохранили большую часть расходов, доля моделей с открытыми весами в долларовом выражении растет. По мере того как модели с открытыми весами становятся более функциональными, клиенты переносят на них все больше производственных нагрузок.
Рост внедрения моделей с открытыми весами помог снизить среднюю цену за токен по всему шлюзу на 23,2% в августе, что стало третьим ежемесячным снижением подряд и самым резким с апреля. Среди команд, обрабатывавших более десяти миллионов токенов в оба месяца, медианная команда платила на 7,6% меньше за токен, что более чем вдвое превышает снижение на 2,9% в июле.
Теперь команды могут получать больше выводов при том же бюджете и использовать передовые модели только для тех задач, которые оправдывают надбавку.
Скопировать ссылку на заголовок Плато передовых моделей, поскольку расходы на Fable переходят к Opus 5
Производственные нагрузки, оправдывающие использование передовой модели, не всегда требуют самой дорогой. Им нужна та, которая достаточно хороша.
Fable — самая мощная модель, которую продает Anthropic. Opus — это уровень ниже, и он стоит примерно половину цены Fable за токен. Когда экспортный контроль США в отношении Fable 5 был снят и доступ к ней был восстановлен 1 июля, ее доля в расходах на шлюз подскочила до 13,2%. В конце того же месяца появилась Opus 5.
В августе доля Fable 5 в расходах на шлюз упала до 4,9%, а доля Opus 5 выросла до 22,5%. Девять из десяти команд, использовавших Fable, сократили ее использование, и больше из них перенесли свои рабочие нагрузки на Opus 5, чем на любую другую модель. Дополнительные возможности Fable не стоили двойной цены.
Команды ушли от Fable, самой дорогой и мощной модели Anthropic, но лаборатория сохранила львиную долю расходов на шлюз, потому что эти рабочие нагрузки перешли на Opus 5, а не в другую лабораторию.
Anthropic забирала не менее 61 цента с каждого доллара, потраченного через AI Gateway, каждый месяц с декабря, а в августе — 64 цента. Ее модели занимали первые два места по расходам каждый месяц с декабря, даже несмотря на то, что модели на этих местах менялись.
Скопировать ссылку на заголовок Лояльность клиентов зависит от профиля модели, а не от лаборатории
Лояльность к лаборатории зависит не от бренда, а от профиля модели, и побеждает последовательность.
Когда новая модель сохраняет то, что пользователи ценили в ее предшественнице, лаборатория удерживает своих клиентов. Когда этого не происходит, клиенты удовлетворяют потребность через других провайдеров.
Когда была запущена Claude Opus 5, она получила почти вдвое больше, чем потеряла Fable, потому что она справлялась с теми же рабочими нагрузками за полцены. И в течение пяти дней после запуска Z.ai GLM-5.3-Flash, она обрабатывала в три раза больше ежедневного объема, чем GLM-5.2.
Google с трудом удерживала клиентов со своими новыми моделями. Поскольку новые предложения не давали относительного преимущества в возможностях или цене, большинство рабочих нагрузок Gemini 3 Flash перешло к OpenAI, Anthropic и DeepSeek.
Около половины объема, ушедшего от Gemini 3 Flash, перешло к более дешевым моделям, во главе с GPT-5.6 Luna, которая стоит менее половины за токен. Большая часть оставшейся половины перешла к более дорогим моделям, во главе с Claude Opus 5 и Sonnet 5, которые стоят примерно в девять и три раза дороже, чем Gemini 3 Flash соответственно.
Переход к более подходящим моделям означал, что за тот же период доля Google в объеме токенов шлюза упала с 30% до 5%, при этом на долю Gemini 3 Flash пришлось 22 из 25 потерянных процентных пунктов.
Скопировать ссылку на заголовок Специальный отчет: Astra заняла треть расходов OpenAI в течение 48 часов и обогнала Fable 5.1 при запуске в соотношении два к одному
GPT-6 Astra была запущена на AI Gateway 3 сентября по той же цене, что и Fable 5.1, и в два с половиной раза дороже, чем GPT-5.6 Sol. Два дня спустя на нее приходился каждый третий доллар, потраченный на модели OpenAI через шлюз. Ее доля расходов сохранилась, колеблясь между 28% и 39% с тех пор.
В линейке моделей OpenAI на долю Astra и Sol пришлось 27% токенов OpenAI, однако они составили 71% расходов в период с 4 по 16 сентября. Luna и Nano обработали более чем в два раза больше токенов при затратах, составляющих примерно одну девятую часть от этой суммы.
Anthropic запустила Fable 5.1 1 сентября, за два дня до Astra. За первые двенадцать дней работы каждой модели на шлюзе Astra заняла 7,7% от всех расходов шлюза, что более чем в два раза превышает долю Fable 5.1, составившую 3,7%, и использовалась в два раза большим количеством команд.
Более дешевые модели OpenAI обеспечивают основной объем, в то время как раннее лидерство Astra по сравнению с Fable показывает, что компания также способна привлекать команды в самом высоком ценовом сегменте. Вместе они позволяют OpenAI конкурировать с другими передовыми лабораториями как по масштабу, так и по премиальным расходам.
Следите за обновлениями в отчете следующего месяца.
Скопировать ссылку на заголовок Также в данных за август
- Модель Nano Banana от Google впервые заняла лидирующую позицию по расходам на изображения с показателем 50% против 44% у GPT Image, даже несмотря на то, что GPT Image вернула себе лидерство по количеству созданных изображений — 46% против 39%.
Модель Nano Banana от Google впервые заняла лидирующую позицию по расходам на изображения с показателем 50% против 44% у GPT Image, даже несмотря на то, что GPT Image вернула себе лидерство по количеству созданных изображений — 46% против 39%.
- Модель Veo от Google поднялась на второе место по расходам на видео с показателем 20%, увеличившись с 15% в июле. Seedance осталась на первом месте как по количеству созданных видео, так и по расходам на видео.
Модель Veo от Google поднялась на второе место по расходам на видео с показателем 20%, увеличившись с 15% в июле. Seedance осталась на первом месте как по количеству созданных видео, так и по расходам на видео.
- Доля видео, созданных с помощью Grok Imagine от xAI, сократилась более чем вдвое с июня: с 42% до 31% и до 19%.
Доля видео, созданных с помощью Grok Imagine от xAI, сократилась более чем вдвое с июня: с 42% до 31% и до 19%.
Скопировать ссылку на заголовок Предыдущие отчеты AI Gateway Production Index
Скопировать ссылку на заголовок Об этом отчете
В этом отчете используется анонимизированный совокупный трафик, проходящий через Vercel AI Gateway по август 2026 года.
Несколько примечаний об измерениях:
- Объем токенов включает входные, выходные, логические, кэшированные входные токены и токены создания кэша.
Объем токенов включает входные, выходные, логические, кэшированные входные токены и токены создания кэша.
- Расходы оцениваются на основе опубликованных прейскурантов лабораторий; фактические счета могут отличаться. Средняя цена за токен рассчитывается как оценочные расходы, деленные на объем токенов.
Расходы оцениваются на основе опубликованных прейскурантов лабораторий; фактические счета могут отличаться. Средняя цена за токен рассчитывается как оценочные расходы, деленные на объем токенов.
- Утверждения о перемещении объемов сравнивают изменения внутри одних и тех же команд. Они не отслеживают отдельные токены между моделями.
Утверждения о перемещении объемов сравнивают изменения внутри одних и тех же команд. Они не отслеживают отдельные токены между моделями.
- Классификация моделей с открытыми весами соответствует текущему списку моделей AI Gateway, который шире, чем определение, использовавшееся в предыдущих отчетах.
Классификация моделей с открытыми весами соответствует текущему списку моделей AI Gateway, который шире, чем определение, использовавшееся в предыдущих отчетах.
- Все цифры основаны на самых последних доступных данных; данные за предыдущие месяцы могут быть пересмотрены по мере обновления методологии.
Все цифры основаны на самых последних доступных данных; данные за предыдущие месяцы могут быть пересмотрены по мере обновления методологии.









