Если вы ищете окно контекста в миллион токенов по низкой цене за токен, то MiniMax-M3.1-Flash-Preview и DeepSeek V4 Flash — это два имени, которые постоянно всплывают, и они на самом деле не являются одним и тем же продуктом. DeepSeek V4 Flash — это устаревшая модель, чей идентификатор всё ещё работает, живя внутри прайс-листа поставщика, который можно прочитать до цента. MiniMax-M3.1-Flash-Preview — это живой превью без опубликованной цены вообще. Поэтому приведённое ниже сравнение отчасти является сравнением спецификаций, а отчасти демонстрацией того, как эти два поставщика по-разному решают продавать один и тот же сегмент.
Оба аспекта этого вопроса заслуживают точного изложения, потому что числа, которые решают его, разбросаны по странице цен поставщика, документации поставщика и нашему каталогу, и одно из самых часто повторяемых утверждений о DeepSeek V4 Flash — его цена — это то, что DeepSeek с тех пор заменила.
На чём действительно совпадают две спецификации
Основные спецификации достаточно близки, чтобы не быть решающим фактором, за одним исключением, о котором никто не рекламирует.
• Окно контекста — 1 000 000 токенов для MiniMax-M3.1-Flash-Preview против 1 048 576 для DeepSeek V4 Flash: номинально идентично, разница в 48 576 токенов• Максимальный вывод — не опубликован для MiniMax-M3.1-Flash-Preview; 384 000 токенов для DeepSeek V4 Flash, что необычно для этой цены и является числом, которое должно решить многое при покупке• Входные модальности — текст, изображение и видео для MiniMax-M3.1-Flash-Preview; только текст для DeepSeek V4 Flash• Управление мышлением — лестница усилий от низкого до максимального, постоянное мышление включено, для MiniMax-M3.1-Flash-Preview; мышление или отсутствие мышления в DeepSeek V4 Flash, причем отсутствие мышления — это реальный вариант• Поддержка протоколов — совместимость с Anthropic, совместимость с OpenAI и конечные точки OpenAI Responses для MiniMax-M3.1-Flash-Preview; те же три плюс завершение чата с префиксом в DeepSeek V4 Flash• Веса — нет весов для MiniMax-M3.1-Flash-Preview; веса V4 Flash от DeepSeek были опубликованы, хотя сама модель была заменена• Цена — не опубликована для MiniMax-M3.1-Flash-Preview; опубликована и низка для DeepSeek V4 Flash
Прочитайте этот список дважды, потому что потолок вывода — это тихий элемент. Миллион токенов контекста с 384 000 токенов вывода — это действительно длинное окно генерации в один проход. Миллион токенов контекста с неизвестным потолком вывода — это обещание о чтении, а не о записи. Если ваша нагрузка — это «прочитать репозиторий, сгенерировать план миграции», то второе число определяет, подходит ли задача для одного вызова.
На чём измеряется каждый из них
Это наименее удобный раздел сравнения, и он короткий.
У DeepSeek V4 Flash есть рекорд бенчмарка, и он независимый. Artificial Analysis оценивает его в 34,3 по Индексу интеллекта — 42-е место из 145 моделей по этому индексу — с 69,1 по Индексу кодирования и 90,8% по GPQA Diamond. Цифра 95,0 на τ²-Bench, с которой начинается наша запись в каталоге, — это та же цифра, которая была в стартовых материалах DeepSeek, поэтому это цифра поставщика, а не проверенная независимой компанией. Его воспроизведение длинного контекста составляет 79,7%, а его терминальная цифра на v2.1 harness — 78,7%. Это реальные, сопоставимые измерения известной модели.
У MiniMax-M3.1-Flash-Preview их нет. MiniMax не опубликовал таблицу оценки вместе с релизом, и у третьей стороны её тоже нет — модель вообще не появляется в индексе Artificial Analysis. Это не пробел в наших исследованиях; это текущее состояние публичного реестра, и это означает, что любое утверждение о качестве новой модели на данный момент является прилагательным поставщика. Любой, кто сегодня дает вам таблицу бенчмарков MiniMax-M3.1-Flash-Preview, либо цитирует старый MiniMax-M3, либо придумывает её.
DeepSeek V4 Flash не продаётся по цене, которую вы помните
Вот ловушка. Цифра, которая широко цитируется для DeepSeek V4 Flash — 0,14 доллара за миллион входных токенов и 0,28 доллара за миллион выходных токенов — была картой, которую модель несла до 10 сентября 2026 года. В этот день DeepSeek выпустила DeepSeek-V4.1-Flash, отменив V4 Flash и эксперимент V4-Flash-Vision-Exp, и снизила цены. Идентификатор deepseek-v4-flash всё ещё работает, но документация DeepSeek гласит, что он временно перенаправляется на V4.1 Flash и выставляется к оплате по цене Flash. Иными словами, вы всё ещё можете ввести старое название модели; вы не вызываете старую модель.
Таким образом, реальная карта для сравнения — это текущая, за 1 млн токенов — и не пиковая половина её дешевле:
• Вход с пропуском кэша — 0,15 доллара в непиковое время, 0,30 доллара в пиковое время• Вход с попаданием в кэш — 0,003 доллара в непиковое время, 0,006 доллара в пиковое время• Вывод — 0,60 доллара в непиковое время, 1,20 доллара в пиковое время• Пиковые окна — 01:00–04:00 и 06:00–10:00 UTC, понедельник-пятница, за исключением китайских государственных праздников; всё остальное, включая полные выходные, — непиковое время
В отличие от этого, у MiniMax-M3.1-Flash-Preview нет цены за токен любого типа. Его стоимость — это то, что стоит ваше место в плане токенов — 22, 55 или 132 доллара в месяц для Plus, Max и Ultra — сгорает через общий пул квот при каждой модели по прайсу pay-as-you-go, при этом поставщик оставляет за собой право изменять состав этого пула. Для фиксированного ежемесячного бюджета с предсказуемым объёмом это может быть отличной ценностью. Для проекта, который нуждается в атрибуции стоимости за вызов, это непрозрачность, замаскированная под подписку.
Причина, по которой это важно больше, чем обычно, на стороне DeepSeek, — это пекинский мультипликатор. Команда в Европе или Азии, работающая в течение рабочего дня, находится в пиковом окне для значительной части своего трафика и платит вдвое больше за это привилегию, что превращает основную ставку ввода 0,15 доллара в 0,30 доллара именно в те часы, когда большинство продуктов заняты. Бюджет из непикового столбца, если только ваш трафик действительно работает ночью по UTC.
Где MiniMax M3.1 Flash Preview — это неправильный выбор
Три случая, и первые два легко пропустить, потому что они документированы, а не вычтены.
Потолок вывода неизвестен. Если ваша задача заканчивается длинной генерацией — полным описанием, переписыванием транскрипта, аннотированным отчётом — вы выбираете бюджет вывода, который не можете увидеть. DeepSeek V4 Flash публикует 384 000. Эта асимметрия благоприятствует старой модели для всего, что много пишет.
Мышление не может быть выключено. Отправьте thinking: {"type": "disabled"} в MiniMax-M3.1-Flash-Preview и вы получите HTTP 400: модель требует адаптивного мышления. В DeepSeek V4 Flash существует режим без мышления, и это поддерживаемый переключатель. Для высокопроизводительной классификации, маршрутизации или короткого структурированного извлечения модель, которая всегда сначала размышляет, платит задержкой и токенами, которых вы не просили — и единственный рычаг, который у вас есть, — это снижение усилий до низкого уровня, а не удаление рассуждений.
Его нельзя вызвать по модели pay-as-you-go. Документация поставщика однозначна: MiniMax-M3.1-Flash-Preview доступен только через Token Plan и MiniMax Code прямо сейчас, и ключ подписки не взаимозаменяем с ключом API pay-as-you-go. Если у вас уже есть место, это изменение в одну строку. Если у вас его нет, оценка этой модели означает покупку подписки.
Где число DeepSeek — это неправильный выбор
Отражённое изображение таково, что DeepSeek V4 Flash является только текстовым и уже устарел. Он никогда не принимал изображения — для этого требовалась отдельная экспериментальная сборка, которая теперь была снята с эксплуатации вместе с ним — и идентификатор модели теперь указывает на другие веса, чем подразумевает название. Канал, привязанный к deepseek-v4-flash для воспроизводимости, опирается на перенаправление, которое DeepSeek описывает как временное.
MiniMax-M3.1-Flash-Preview принимает текст, изображение и видео нативно, и это текущая лучшая текстовая модель поставщика. Ввод видео по цене Flash не распространён в этой категории.
Обе оговорки указывают в одном направлении для любого, кто работает с производственным трафиком: идентификатор на счёте и модель, которая отвечала, не гарантированы как одно и то же вечно, а слой маршрутизации обрабатывает это, а не открывает.
Как решить это за один послеобеденный час
Начните с конца задачи, а не с начала.
Если работа — генерация длинного текста, то есть что заканчивается написанием десятков тысяч токенов, DeepSeek V4 Flash — единственная из двух, которая публикует потолок, достаточный, чтобы это обещать, и его тарифный лист достаточно мал, чтобы коэффициент пиковости был выносим. Оцените стоимость при пике, а не в внепиковое время, и рассматривайте устаревший идентификатор как миграцию, которую вы ещё не сделали, а не как стабильный контракт.
Если работа — чтение и рассуждение над мультимодальными входами при фиксированном ежемесячном бюджете — записи экрана, отсканированные документы, обзор видео — MiniMax-M3.1-Flash-Preview является более способной формой, и внутри места Token Plan это самый дешёвый способ получить видео вход при этой длине контекста. Примите, что вы покупаете неизмеренную модель, и ограничьте радиус взрыва: держите важную нагрузку на что‑то с опубликованным тарифным листом, а предварительный просмотр обрабатывает исследовательскую часть.
Если обе описания подходят вашему конвейеру, это проблема маршрутизации, а не выбора модели, и именно для этого мы существуем. DeepSeek V4 Flash на OrcaRouter стоит по тарифу поставщика с 0% надбавкой — его каталог показывает 0,22 доллара за миллион входных токенов и 0,66 доллара за миллион выходных, что является пиковой колонкой текущей карты Flash, передаваемой напрямую — рядом с MiniMax-M3 и MiniMax M2.7 в той же ценовой категории на том же ключе. Один конечный пункт достигает более 200 моделей с автоматическим переключением отказа за ним, так что нагрузка может перемещаться между ценовыми диапазонами без второй интеграции. MiniMax-M3.1-Flash-Preview не находится в нашем каталоге; доступ к нему означает Token Plan поставщика и его продукт кодирования.
Однострочное резюме: DeepSeek V4 Flash — известная величина с опубликованным потолком вывода, читаемым тарифным листом и тихим наследником, отвечающим своему названию; MiniMax-M3.1-Flash-Preview — более новая, мультимодальная, неизмеренная, которая стоит подписки для пробного использования. Ни один из них не является причиной выбрать другого — это просто факты, которые вы не получите из сравнения цены за токен, которое цитирует карту, которую DeepSeek снял в сентябре.










