Мини-превью MiniMax-M3.1-Flash стало доступным 27 сентября 2026 года, и то, как это произошло, является самой интересной частью истории. Это не модель оплаты по мере использования. Производитель поместил свою новейшую текстовую модель за тем же ключом подписки Token Plan, который уже охватывает MiniMax-M3, MiniMax M2.7 и вариант M2.7-highspeed, поэтому, если у вас есть место, нет необходимости получать новый ключ или подписывать второй контракт. Также на сегодняшний день нет цены за токен, карточки модели, опубликованного эталона или какого-либо способа отключить мышление модели.
Это сочетание — беспроблемный доступ в паре с полностью неопубликованной экономикой — достаточно необычно, чтобы его стоило разобрать, прежде чем кто-то подключит к нему производственный конвейер. Остальная часть этого текста — это то, что действительно говорится в документации производителя, что он явно не говорит, и одна строка кода, которая скажет вам в течение минуты, подходит ли эта модель для вашего способа работы.
Что именно появилось 27 сентября?
В документации разработчика MiniMax теперь есть постоянная заметка, повторяющаяся на каждой странице текстовой модели: MiniMax-M3.1-Flash-Preview доступен только через Token Plan и MiniMax Code на данный момент. Модель появляется первой в собственной таблице моделей производителя, выше MiniMax-M3, и описывается как передовая мультимодальная кодирующая модель с окном контекста 1M и настраиваемой глубиной мышления.
• Окно контекста — 1 000 000 токенов, тот же предел, что и у MiniMax-M3• Входные модальности — текст, изображение и видео, возвращающие текст• Глубина мышления — параметр настройки, принимающий значения low, medium, high, xhigh и max, по умолчанию max, если параметр опущен• Поддержка протокола — тот же идентификатор модели работает через совместимый с Anthropic эндпоинт MiniMax, его совместимый с OpenAI эндпоинт и его эндпоинт OpenAI Responses• Доступность — только Token Plan и MiniMax Code; не доступно по модели оплаты по мере использования• Цена — нет опубликованной цены за токен нигде• Веса — нет; два самых последних публичных репозитория организации MiniMaxAI остаются MiniMax-Music3 и MiniMax-H3• Независимые эталоны — нет; у модели нет записи в индексе моделей Artificial Analysis
Компания объявила об этом в тот же день на своей странице MiniMaxAgent, представив это как инструмент для повседневной разработки, а не для передовой работы: быстро и надежно, от быстрого исправления ошибок до полной работы с функциями. Это краткое описание уровня Flash, а не флагманского уровня. Сторонние репортажи от PANews и KuCoin описали это теми же терминами и отметили, что разработчики заметили модель в выборщике MiniMax Code до того, как компания подтвердила это.
Какой ключ вы используете, имеет значение больше, чем обычно?
Это та часть, которая сбивает людей с толку. MiniMax использует два отдельных типа учетных данных, и M3.1-Flash-Preview реагирует только на один из них. Ключ подписки Token Plan получается из раздела Billing > Token Plan и охватывает использование подписки и приобретенные кредиты. Ключ API оплаты по мере использования охватывает модели с ценой за токен. Документация производителя четко указывает, что эти два ключа не взаимозаменяемы и что ключ подписки может существовать до того, как к нему будет привязан любой платный ресурс — в этом случае это действительный ключ без ничего за ним.
Таким образом, практический тест заключается не в том, «есть ли у меня ключ API MiniMax», а в том, «есть ли у меня место в Token Plan». Существующие места покрыты. В документации отмечается, что ключ подписки становится пригодным для использования, когда ему назначается место или доступ к кредитам, и что переполнение кредитов списывается автоматически, как только квота подписки исчерпана.
Также есть несоответствие в документации, о котором стоит знать, потому что оно сбивает с толку любого, кто прочитает страницу с ценами первым. Сноска о покрытии на странице цен Token Plan по-прежнему перечисляет подходящую линейку как M3, M2.7, изображение и речь, с исключением H3 — она не была обновлена, чтобы включить M3.1-Flash-Preview. Страницы моделей говорят наоборот: что M3.1-Flash-Preview доступен только через Token Plan и ничего больше. Обе страницы являются действующими страницами производителя на сегодняшний день. Только ключ в ваших руках решает это.
400, которые говорят вам, какого типа эта модель
Каждая модель серии MiniMax M думает перед тем, как ответить, но M3.1-Flash-Preview — первая, которая отказывается остановиться. Отправьте thinking: {"type": "disabled"} или reasoning_effort: "none" и API вернет HTTP 400 со следующим сообщением:
модель "MiniMax-M3.1-Flash-Preview" требует адаптивного мышления; thinking.type="disabled" (включая reasoning.effort=none) не разрешено (2013)
Собственные рекомендации производителя заключаются в том, чтобы снизить усилие, а не пытаться отключить мышление, и лестница — это рычаг задержки: рутинная редакция при низком уровне и изменение репозитория при xhigh — это одна и та же модель, совершающая разные сделки. Два дополнительных подробности специфичны для этой модели. Параметр reasoning_effort документирован как эффективный только для MiniMax-M3.1-Flash-Preview — это не общее управление серией M. И переключатель вывода reasoning_split, который отделяет мышление в поле reasoning_content, в настоящее время не может быть установлен в false для этой модели.
Куда попадает текст мышления, зависит от протокола: совместимый с Anthropic эндпоинт возвращает его как блок содержимого мышления, совместимый с OpenAI эндпоинт возвращает его в reasoning_content, а эндпоинт Responses возвращает его как элемент вывода reasoning. Если вы парсили теги <think> из вывода MiniMax-M3, эта работа больше не нужна для новой модели — и для перемежающихся разговоров с использованием инструментов полный ответ, включая блок мышления, должен быть добавлен обратно в историю сообщений, иначе цепочка reasoning прерывается.
MiniMax Code проводит промоакцию check-in с 28 сентября по 7 октября в UTC+8, удваивая бесплатные кредиты, предоставляемые за ежедневный вход, и открывая ее как для новых, так и для существующих пользователей. Сообщаемые кредиты применяются ко всем поддерживаемым моделям, при этом M3.1-Flash-Preview и видео-модели H3 названы в качестве примеров. Кроме того, компания заявила, что квоты Token Plan сбрасываются для всех пользователей при запуске и что дальнейшие сбросы запланированы во время мероприятия, при этом право на участие отображается в приложении.
Рассматривайте эти два утверждения как заявления производителя, переданные через репортажи о запуске — это рекламные условия с привязанными датами, а не поведение продукта, и те же репортажи отмечают, что объявление не указывало количество кредитов за check-in или точные правила для пропущенных дней. Стабильная экономика проще для описания: Token Plan указан по цене 22 доллара в месяц для Plus, 55 долларов для Max и 132 доллара для Ultra, с 5-часовым скользящим и еженедельным окном квот, размер которых установлен производителем примерно в три-четыре, четыре-пять и шесть-семь одновременных агентов соответственно. Приобретенные кредиты стоят 1000 кредитов за доллар и списываются по каждой модели по цене оплаты по мере использования, указанной в списке.
Четыре вещи, которых у этой модели все еще нет
Ничто из нижеперечисленного не является критикой модели; каждая из них — это дыра, которую команде нужно планировать, и все четыре из них проверяемы сегодня.
• Нет цены. Для M3.1-Flash-Preview нет цены за токен на любой странице MiniMax, поэтому его нельзя сравнить с ценой M3 в 0,30 доллара за миллион входных токенов и 1,20 доллара за миллион выходных токенов или с чем-либо ещё в плане стоимости за токен.• Нет эталонов. MiniMax не опубликовал таблицу оценки с этим релизом. Как и никто другой: модель отсутствует в индексе Artificial Analysis, поэтому её столбец действительно пуст, а не просто ранний.• Нет весов. MiniMax-M3 был выпущен с открытыми весами; у M3.1-Flash-Preview нет репозитория и скачиваемого чекпоинта.• Нет независимой оценки. Нет данных о скорости вывода, задержке или ошибочности от какой-либо третьей стороны, а также нет данных от нашей собственной телеметрии маршрутизации, потому что модель не находится в нашем каталоге.
В отличие от запуска M3 в июне 2026 года, который был представлен с архитектурной запиской, таблицей эталонов и прайс-листом в первый день, это преднамеренно тихий релиз. Вероятное толкование — и это толкование, а не заявленный план — заключается в том, что MiniMax хочет реального использования внутри своего собственного продукта, прежде чем решит, сколько будет стоить модель и будет ли она открыта.
Что было правильно в утекшем превью-ноте
За четыре дня до запуска в публичном репозитории партнёра появился превью-документ, описывающий MiniMax M3.1 с разреженным вниманием, квантизацией внимания Q8KV4, маршрутизированными экспертами NVFP4, головой спекулятивного декодирования DSpark и новым полем reasoning_effort, принимающим значения от max до low. В то время мы описали это как непроверенное, потому что так и было: не было весов, не было карточки модели, не было страницы с ценами и не было API-идентификатора модели.
Одно из этих пяти утверждений теперь подтверждено собственной документацией поставщика, и это поле reasoning_effort — включая лестницу max-to-low, которая точно соответствует предоставленным значениям. Остальные четыре утверждения остаются непроверенными. Опубликованное описание MiniMax M3.1-Flash-Preview говорит только о том, что это передовая мультимодальная кодирующая модель с контекстным окном 1M и настраиваемой глубиной мышления; оно не описывает схему внимания, квантизацию или голову декодирования. Любой, кто повторяет утверждения о разреженном внимании и NVFP4 как об утверждённой спецификации, повторяет транскрипцию третьей стороны, что именно и не было подтверждено релизом.
Если вы хотите попробовать это, не рискуя своей пайплайной
Неудобная часть превью только с Token-Plan заключается в том, что естественный способ оценить новую модель — вызвать её из вашего существующего стека и измерить — это то, что вы не можете сделать чисто. Нет цены за токен для модели, с которой можно сравнить, нет опубликованного профиля задержки и нет истории аварийного переключения внутри собственного продукта поставщика, если превью пошатнётся.
Именно для этого и создаётся слой маршрутизации. Всё, что вы можете вызвать сегодня, находится за одним совместимым с OpenAI эндпоинтом и одним API-ключом, и модели, соседствующие с этой, уже там: MiniMax-M3 по тарифу поставщика 0,30 доллара за миллион входных токенов и 1,20 доллара за миллион выходных токенов, MiniMax M2.7 по той же цене со строкой из 200 000 токенов и открытыми весами, а также уровни DeepSeek и Qwen Flash в том же ценовом диапазоне. Цены с нашей стороны — это прайс-лист поставщика, переданный с наценкой 0%, поэтому когда поставщик снижает тариф, он попадает сюда в тот же день, а не в ходе цикла пересмотра условий. Автоматическое аварийное переключение означает, что зависимость превью-класса может находиться рядом с производственным путём, а не под ним, и когда MiniMax опубликует прайс-лист и эндпоинт для MiniMax-M3.1-Flash-Preview, вопрос станет записью в таблице маршрутизации, а не миграционным проектом. MiniMax-M3.1-Flash-Preview сам по себе не находится в нашем каталоге, и способ добраться до него сегодня — это собственный Token Plan поставщика и его кодирующий продукт.
Честное резюме для команды, читающей это в день запуска: модель работает, бесплатна в пределах маржи, если вы уже платите за место в Token Plan, и полностью не имеет цены и оценки по своим собственным условиям. Попробуйте её внутри MiniMax Code, сохраните пайплайн, от которого вы зависите, на модели с прайс-листом и репутацией, и следите за двумя вещами, которые превратят это из любопытства в решение — опубликованная цена и первые независимые оценки.










