За последние несколько месяцев тысячи разработчиков начали использовать Mercury для создания приложений голосовой связи в реальном времени, конвейеров поиска и извлечения данных, а также вспомогательных агентов для написания кода с помощью ИИ. По мере масштабирования мощностей мы продолжали совершенствовать саму модель.
Сегодня мы делаем работу с Mercury еще проще.
Каждый новый ключ API Inception теперь включает 100 миллионов бесплатных токенов. Этого достаточно, чтобы протестировать Mercury в сравнении с вашим текущим стеком на реальных рабочих нагрузках.
Мы увеличили лимиты скорости для бесплатного тарифа в 10 раз, чтобы вы могли запускать трафик, близкий к производственному, не сталкиваясь с ограничениями.
С момента запуска мы продолжали улучшать Mercury 2 для рабочих нагрузок:
- Сокращение времени до получения первого токена
Сокращение времени до получения первого токена
- Снижение сквозной задержки
Снижение сквозной задержки
- Более надежный вызов инструментов
Более надежный вызов инструментов
Эти улучшения особенно заметны в приложениях голосовой связи в реальном времени, системах поиска, агентах для написания кода и многоагентных рабочих процессах, где задержка накапливается при каждом вызове модели.
Сегодня десятки ИИ-ориентированных компаний и предприятий используют Mercury 2 в своей работе.
Mercury 2 уже доступен на Baseten в рамках запуска Baseten для Model Labs. Если ваша команда уже работает там, вы можете добавить Mercury 2 в свой стек без подключения нового провайдера.
По вопросам корпоративных лимитов скорости, более жестких требований к задержке, соглашений об уровне обслуживания (SLA) или помощи в настройке конкретной рабочей нагрузки обращайтесь по адресу hello@inceptionlabs.ai. Ответ в течение часа.









