Передовое программирование, контекст 1 млн токенов и нативная мультимодальность. Создавайте агентов с долгосрочным планированием на SambaCloud
TL;DR
- MiniMax M3 работает быстрее всех на SambaCloud, где он уже доступен разработчикам, создающим агентов с долгосрочным планированием и большим контекстом.
- В бенчмарках по программированию и агентским задачам MiniMax M3 набирает 59,0% в SWE-Bench Pro, 66,0% в Terminal-Bench 2.1 и 74,2% в MCP Atlas, что делает его одной из самых мощных моделей с открытыми весами.
- MiniMax M3 представляет технологию MiniMax Sparse Attention (MSA), обеспечивающую контекстное окно в 1 млн токенов с префиллом, который более чем в 9 раз быстрее, и декодированием, которое более чем в 15 раз быстрее, чем у предыдущего поколения.
- В ходе внутренних испытаний MiniMax модель MiniMax M3 автономно работала около 24 часов над оптимизацией ядра FP8 GEMM CUDA, повысив пиковую загрузку оборудования с 7,6% до 71,3% (ускорение в 9,4 раза) без какого-либо вмешательства человека.
- MiniMax M3 является нативно мультимодальной моделью, обученной на тексте, изображениях и видео с самого первого этапа, поэтому она может читать графики, формулы, скриншоты и управлять настольным компьютером.
MiniMax M3 — это преемник MiniMax M2.7 и самая мощная модель компании на сегодняшний день. Она создана для агентских рабочих процессов с долгосрочным планированием, сложной разработки программного обеспечения и мультимодальных задач, которые ранее были исключительной прерогативой закрытых передовых моделей. Она достигает 59,0% в SWE-Bench Pro, 66,0% в Terminal-Bench 2.1 и 74,2% в MCP Atlas, что делает её одним из самых сильных вариантов с открытыми весами для программирования и агентских систем.
MiniMax M3 (M3) — это новейшая передовая модель от MiniMax, которая работает быстрее всего на SambaCloud.
Примечание: Если вы используете MiniMax M2.7, пожалуйста, немедленно переходите на MiniMax M3.
Почему стоит использовать MiniMax M3?
MiniMax M3 знаменует собой качественный скачок по сравнению с серией M2, став первой и единственной моделью с открытыми весами, объединившей возможности, которые ранее были стандартом только для закрытых передовых моделей. Ключевые улучшения включают:
Контекст 1 млн токенов через MSA
M3 представляет MiniMax Sparse Attention (MSA) — новую архитектуру внимания, которая делает контекст по-настоящему масштабируемым измерением. При контексте в 1 млн токенов вычислительные затраты на токен снижаются до 1/20 от уровня предыдущего поколения, при этом префилл происходит более чем в 9 раз быстрее, а декодирование — более чем в 15 раз быстрее, сохраняя при этом эффективность полного внимания для подавляющего большинства задач. Целые репозитории, научные статьи и логи работы агентов за несколько дней теперь помещаются в одно контекстное окно.
Передовая разработка программного обеспечения
Производительность промышленного уровня в SWE-Bench Pro (59,0%), Terminal-Bench 2.1 (66,0%), SWE-fficiency (34,8%) и KernelBench Hard (28,8%). MiniMax обучила M3 с помощью интерактивного симулятора пользователя, который имитирует реальное сотрудничество разработчиков — уточнение требований, корректировка решений и итерации в несколько этапов — поэтому модель работает как активный соавтор, а не просто пассивный исполнитель инструкций.
Автономия с долгосрочным планированием
Во внутренних тестах MiniMax модель M3 автономно работала около 24 часов, оптимизируя ядро FP8 GEMM CUDA — 147 отправленных результатов в бенчмарках и 1959 вызовов инструментов — повысив пиковую загрузку оборудования с 7,6% до 71,3% (ускорение в 9,4 раза) без какого-либо вмешательства человека. Она также самостоятельно воспроизвела основные эксперименты статьи, получившей награду ICLR 2025, за 12-часовой цикл работы, создав 18 коммитов и 23 экспериментальных графика.
Нативная мультимодальность
M3 была обучена на смешанных данных из текста, изображений и видео с самого начала, а не добавлена позже. Она понимает графики, формулы и скриншоты, а также может управлять настольным компьютером, открывая возможности для агентов, использующих компьютер, и сквозных рабочих процессов в приложениях, файлах и системах.
Агентская офисная и профессиональная работа
Высокие результаты в реальных офисных задачах, включая поиск, работу с офисными пакетами и оркестрацию инструментов (74,2% в MCP Atlas), с развивающимися возможностями в рабочих процессах финансового сектора.
MiniMax M3 конкурирует с лучшими закрытыми передовыми моделями в сложных задачах программирования и агентской работы, оставаясь при этом моделью с открытыми весами и значительно более высокой экономической эффективностью. Для команд, запускающих в продакшене агентские рабочие процессы с долгосрочным планированием и большим контекстом, M3 на сегодняшний день занимает наиболее привлекательный квадрант по соотношению стоимости и интеллекта.
Быстрый старт с SambaCloud
Всего с помощью нескольких строк на Python вы можете вызвать MiniMax M3 для анализа всей кодовой базы, планирования исправления и итерации собственного решения — того же цикла с долгосрочным планированием, который она использует для автономной оптимизации ядер и воспроизведения научных исследований.
Ознакомьтесь с SambaCloud и изучите MiniMax M3 в песочнице или создайте API-ключ и интегрируйте её в своё агентское приложение уже сегодня.
MiniMax M3 выводит передовое программирование, контекст 1 млн токенов и нативную мультимодальность в продакшен. SambaNova обеспечивает её самую быструю работу.










