За последние несколько месяцев тысячи разработчиков начали использовать Mercury для создания приложений голосовой связи в реальном времени, конвейеров поиска и извлечения данных, а также ИИ-агентов для написания кода. По мере масштабирования наших мощностей мы продолжали совершенствовать саму модель.
Сегодня мы делаем работу с Mercury еще проще.
Каждый новый ключ API Inception теперь включает 100 миллионов бесплатных токенов. Этого достаточно, чтобы протестировать Mercury в сравнении с вашим текущим стеком на реальных рабочих нагрузках.
Мы увеличили лимиты для бесплатного тарифа в 10 раз, чтобы вы могли запускать трафик, близкий к производственному, не сталкиваясь с ограничениями.
С момента запуска мы продолжали улучшать Mercury 2 для рабочих нагрузок:
- Сокращение времени до получения первого токена
Сокращение времени до получения первого токена
- Снижение сквозной задержки
Снижение сквозной задержки
- Более надежный вызов инструментов
Более надежный вызов инструментов
Эти улучшения особенно заметны в голосовых приложениях реального времени, системах поиска, агентах для написания кода и многоагентных рабочих процессах, где задержка накапливается при каждом вызове модели.
Сегодня десятки ИИ-компаний и предприятий используют Mercury 2 в своей работе.
Mercury 2 уже доступен на Baseten в рамках запуска Baseten for Model Labs. Если ваша команда уже работает там, вы можете добавить Mercury 2 в свой стек без подключения нового провайдера.
По вопросам корпоративных лимитов, более жестких требований к задержке, соглашений об уровне обслуживания (SLA) или помощи в настройке конкретной рабочей нагрузки обращайтесь по адресу hello@inceptionlabs.ai. Отвечаем в течение часа.










