Dev48
ЯЗЫК
  • О нас
  • Услуги
  • Индустрии
  • Технологии
  • Статьи
  • Контакты
Забронировать звонок
    Главная/Статьи/Pochemu vash schet ne sovpadaet s vashimi raschetami
Dev48

© 2026 · All rights reserved.

Почему ваш счет не совпадает с вашими расчетами

Источник: Unbiased

Почему ваш счет не совпадает с вашими расчетами

Источник: Unbiased

Five measured reasons rate-card arithmetic misses your invoice: verbosity, the tokenizer change, cache misses, retry doubling, and fee stacking.

25 сентября 2026 г.

Блог

Вы умножили количество токенов на тариф из прайс-листа и получили число. В счете указана другая сумма. Вот пять причин этого расхождения, каждая из которых измерена, а не взята с потолка, в порядке их влияния на ваши расходы.

От команды Unbiased AI · опубликовано 25 августа 2026 г. · все показатели измерены нами и датированы; тарифы проверены 25 августа 2026 г.

96%

разница в счетах между двумя моделями с одинаковым прайс-листом, измеренная на идентичных промптах

2.6x

насколько эффективно кэширование в нашей сессии агента: $0.59 с ним, $1.54 без него

78x

соотношение прочитанных токенов к записанным в нашей сессии агента. В счете учитывается контекст, а не только ответы

Арифметический расчет по прайс-листу упускает пять измеримых факторов: модели выдают разное количество токенов за одну и ту же работу, токенизатор изменился между поколениями моделей, поэтому токены несопоставимы, кэшированные запросы тарифицируются по сниженной ставке, неудачные дешевые запуски оплачиваются дважды, а платформенные комиссии применяются к другой базе, отличной от количества токенов.

Разрыв 1: одна и та же работа — это не одно и то же количество токенов

Две модели могут иметь одинаковый прайс-лист, но приводить к разным счетам, потому что вы платите за токен, а модели обладают разной «многословностью». В нашем тесте из шести задач Opus 5 и Opus 4.8 имели тариф $5 за входные и $25 за выходные токены на миллион, но стоимость теста составила $0.2243 для одной и $0.1146 для другой: разница в 96%, которую не покажет ни одна страница с ценами.

Это поддается измерению, и мы ежемесячно публикуем это как Индекс многословности (Verbosity Index). Если вы меняете модели с одинаковым прайс-листом, а сумма счета меняется — обычно причина именно в этом.

Символов на выходной токен

Claude Haiku 4.53.409

Claude Opus 4.82.294

Claude Fable 5.12.292

Claude Fable 52.191

Claude Sonnet 52.047

Claude Opus 52.034

Более высокое значение означает, что каждый оплачиваемый токен содержит больше текста, поэтому один и тот же ответ стоит меньше токенов. Выделенная модель — та, что все еще использует предыдущий токенизатор. Измерено на том же наборе из шести задач, 25.08.2026.

Разрыв 2: изменилась сама единица измерения

Этот фактор появился недавно, и почти никто не учел его в ценообразовании. В документации Anthropic указано, что Claude 4.7 и более поздние модели используют новый токенизатор, который выдает «примерно на 30% больше токенов для того же текста». Мы измерили этот эффект на нашем наборе задач: 3.409 символа на оплачиваемый токен в предыдущем токенизаторе против 2.172 в новом, или на 57.0% больше текста на токен в старом поколении.

Воспринимайте это не как техническую сноску, а как заявление о биллинге. Если вы построили модель затрат на версии до 4.7 и перешли на текущую, тот же текст теперь стоит больше токенов при той же цене за токен. Ваша таблица была верна, но единица измерения под ней изменилась.

Приведенная выше диаграмма — это измерение по каждой модели. Именно поэтому мы теперь публикуем индекс символов наряду с индексом токенов.

Разрыв 3: чтение из кэша стоит иначе

Кэшированный ввод тарифицируется примерно в одну десятую от базовой ставки ввода на большинстве моделей, а Fable 5.1 идет еще дальше — 0.025x, что составляет $0.25 за миллион против $10 базовой ставки. Любой расчет, который оценивает весь ввод по базовой ставке, сильно завышает стоимость хорошо кэшируемой рабочей нагрузки и занижает стоимость нагрузки с высокой динамикой.

Наша опубликованная сессия агента служит доказательством: пять вызовов API для исправления одной ошибки стоили $0.5887 с кэшированием и $1.54 без него. Разница в 2.6 раза зависит исключительно от того, стабилен ли ваш префикс промпта, и это самый важный рычаг в счете агента.

Разрыв 4: сбои оплачиваются дважды

Математика прайс-листа предполагает, что каждый вызов успешен. Дешевые уровни чаще дают сбои при сложной работе, а неудачный дешевый запуск не бесплатен: это стоимость дешевого запуска плюс стоимость дорогой повторной попытки, плюс время на проверку. При 15% уровне отказов модель массового сегмента с механизмом эскалации может стоить дороже за выполненную задачу, чем передовая модель, которую вы пытались избежать.

Нужно моделировать стоимость завершенной задачи, а не стоимость вызова. Если вы не знаете свой уровень отказов по типам задач, это то, что нужно измерить в первую очередь перед любой оптимизацией.

Разрыв 5: комиссии применяются к разной базе

Если вы работаете через шлюз, комиссия часто взимается не с токенов. OpenRouter берет 5.5% при покупке кредитов с минимумом в $0.80, поэтому небольшое пополнение счета дает эффективную ставку значительно выше 5.5%. Requesty делает наценку 5% на токены. Portkey берет фиксированные $49 в месяц, а токены оплачиваются напрямую. Три разные базы, три разных поведения при масштабировании.

Опубликованные результаты тестов Pareto 26.9 находятся в карточке модели. Измеренные затраты на задачи и составной балл для этого релиза не публиковались.

Краткая версия

Цена за токен — это лишь вводная часть вашего счета, а не прогноз его итоговой суммы. Пять указанных выше разрывов можно измерить за один день на вашем собственном трафике: замерьте три основные задачи на выбранных моделях, проверьте коэффициент попаданий в кэш и определите уровень отказов по типам задач. Все остальное — это арифметика с числами, которые у вас теперь есть.

Ответы на вопросы

Чаще всего это многословность: ваша модель выдает больше выходных токенов, чем вы предполагали. Затем поведение кэша, повторные попытки при сбоях дешевых вызовов и платформенные комиссии, применяемые к кредитам, а не к токенам. Все пять факторов измеримы на вашем трафике.

Нет. В нашем тесте две модели с одинаковым прайс-листом $5/$25 различались на 96% в сумме счета за идентичные промпты исключительно из-за количества токенов.

Да. Anthropic заявляет о примерно 30% большем количестве токенов для того же текста в Claude 4.7 и более новых моделях. Мы измерили 3.409 символа на токен в предыдущем токенизаторе против 2.172 в новом. Биллинг идет по токенам, поэтому один и тот же текст стоит дороже.

Кэширование, если ваша рабочая нагрузка повторно использует контекст: наша измеренная сессия агента стоила в 2.6 раза дороже без него, и это вопрос настройки, а не смены платформы. Затем — подбор подходящего уровня для рутинного трафика и пакетная обработка всего, что может подождать.

Сравните любые две модели

Список тарифов и датированные измерения конкурентов: цены и измеренные счета. Измеренные затраты на задачи для Pareto 26.9 не опубликованы. Многословность: Выпуск 2.

← Все статьи