Мы рады сообщить, что Groq станет одним из первых пользователей NVIDIA Groq 3 LPX, что позволит ускорить генерацию токенов для NVIDIA Vera Rubin NVL72, которые будут развернуты в нашем специализированном облаке для ИИ-вывода. Groq сотрудничает с Dell Technologies для развертывания NVIDIA Groq 3 LPX.
Для Groq это знаменует собой новую главу в развитии облака для ИИ-вывода, расширяя его возможности с помощью NVIDIA Groq 3 LPX и Vera Rubin NVL72 для предоставления отзывчивых ИИ-решений крупного масштаба разработчикам и предприятиям по всему миру.
Выдающаяся производительность
Исключительные показатели производительности, опубликованные сегодня NVIDIA, являются самым наглядным подтверждением возможностей платформы Vera Rubin. NVIDIA Groq 3 LPX расширяет возможности вывода Vera Rubin NVL72 за счет значительного увеличения скорости генерации токенов, обеспечивая премиальный пользовательский опыт для рабочих нагрузок с большим объемом контекста, что позволяет агентам быстрее приносить пользу.
Ключевые моменты включают:
- Высочайшая производительность: 3400 выходных токенов в секунду при работе с Gemma 4 31B со 100 тыс. токенов контекста (агентная модель с открытым исходным кодом) согласно бенчмаркам Artificial Analysis.
- Агентные задачи, такие как написание кода, выполняются за минуты, а не часы.
- В 4 раза более высокая интерактивность для чувствительных к задержкам агентных ИИ-нагрузок по сравнению с ближайшей альтернативной платформой.
Что это значит для клиентов Groq
Groq — единственная команда с практическим опытом эксплуатации LPU в промышленном масштабе. Более шести миллионов разработчиков, компаний из списка Fortune 500 и тысячи компаний, работающих в сфере ИИ, создают свои решения на базе GroqCloud, генерируя триллионы токенов каждую неделю в дата-центрах Северной Америки, Европы, Ближнего Востока и Азиатско-Тихоокеанского региона. В августе Groq стала партнером NVIDIA Cloud Partner для проектирования, развертывания и эксплуатации ускоренных вычислений в соответствии с эталонной архитектурой и операционными стандартами NVIDIA.
Вместе с интегрированной инфраструктурой и глобальными возможностями цепочки поставок Dell Technologies, глобальная платформа, API и корпоративные сервисы Groq предоставят клиентам это новое поколение инфраструктуры для вывода.
Когда Groq введет в эксплуатацию мощности NVIDIA Groq 3 LPX, они будут работать на инфраструктуре, уже оптимизированной для высоконагруженных задач вывода. Для предприятий и ИИ-компаний, создающих агентов нового поколения, Groq предоставит один из самых быстрых путей к использованию NVIDIA Groq 3 LPX в реальных рабочих нагрузках.
«Мы гордимся тем, что стали одними из первых, кто выводит NVIDIA Groq 3 LPX на рынок, предоставляя клиентам доступ к новому классу ускорителей интерактивного ИИ-вывода», — сказал Синклер Шуллер, технический директор Groq. «Наши клиенты ожидают, что Groq будет находиться на переднем крае производительности ИИ, и эта платформа представляет собой значительный шаг вперед для рабочих нагрузок следующего поколения. Вместе с Dell Technologies мы рады развернуть NVIDIA Groq 3 LPX и Vera Rubin NVL72 в широком масштабе и сделать эту возможность доступной для всех».
«Мы гордимся тем, что стали одними из первых, кто выводит NVIDIA Groq 3 LPX на рынок, предоставляя клиентам доступ к новому классу ускорителей интерактивного ИИ-вывода», — сказал Синклер Шуллер, технический директор Groq. «Наши клиенты ожидают, что Groq будет находиться на переднем крае производительности ИИ, и эта платформа представляет собой значительный шаг вперед для рабочих нагрузок следующего поколения. Вместе с Dell Technologies мы рады развернуть NVIDIA Groq 3 LPX и Vera Rubin NVL72 в широком масштабе и сделать эту возможность доступной для всех».
«Агентный ИИ требует больше токенов, большей отзывчивости и масштабируемой экономической эффективности», — сказал Дион Харрис, старший директор по решениям для высокопроизводительных вычислений и ИИ-фабрик в NVIDIA. «NVIDIA Vera Rubin и Groq 3 LPX специально созданы для обеспечения низкой задержки и высокой пропускной способности, необходимых для таких нагрузок. Глубокая экспертиза Groq в эксплуатации LPU через свое глобальное облако для ИИ-вывода позволит предоставить интерактивный ИИ-вывод разработчикам, создающим агентные приложения нового поколения».
«Агентный ИИ требует больше токенов, большей отзывчивости и масштабируемой экономической эффективности», — сказал Дион Харрис, старший директор по решениям для высокопроизводительных вычислений и ИИ-фабрик в NVIDIA. «NVIDIA Vera Rubin и Groq 3 LPX специально созданы для обеспечения низкой задержки и высокой пропускной способности, необходимых для таких нагрузок. Глубокая экспертиза Groq в эксплуатации LPU через свое глобальное облако для ИИ-вывода позволит предоставить интерактивный ИИ-вывод разработчикам, создающим агентные приложения нового поколения».
«Облако для вывода Groq требует инфраструктуры, созданной для скорости и масштабируемости, и именно это предлагает Dell Technologies», — сказал Арункумар Нараянан, старший вице-президент по вычислительным системам и сетям Dell Technologies. «Мы помогаем запустить NVIDIA Groq 3 LPX и Vera Rubin NVL72 в широком масштабе, превращая передовую производительность в готовую к развертыванию инфраструктуру, которую клиенты могут использовать уже сегодня».
«Облако для вывода Groq требует инфраструктуры, созданной для скорости и масштабируемости, и именно это предлагает Dell Technologies», — сказал Арункумар Нараянан, старший вице-президент по вычислительным системам и сетям Dell Technologies. «Мы помогаем запустить NVIDIA Groq 3 LPX и Vera Rubin NVL72 в широком масштабе, превращая передовую производительность в готовую к развертыванию инфраструктуру, которую клиенты могут использовать уже сегодня».
Контакт для СМИ
pr-media@groq.com










