Nvidia начала коммерческое внедрение Groq 3 LPX — специализированного ускорителя инференса, который должен решить одну из главных проблем современных ИИ-агентов: они умеют выполнять сложные задачи, но зачастую делают это слишком медленно. По данным The Wall Street Journal, успех технологии Groq может заметно повлиять на то, насколько удобными корпоративные AI-агенты окажутся в реальной работе. Главное отличие нового направления Nvidia — акцент не на обучении нейросетей, где компания уже много лет доминирует благодаря GPU, а на инференсе. Так называют непосредственную работу уже обученной модели: генерацию ответа, анализ документов, написание кода, поиск информации или выполнение последовательности действий.
Именно здесь скорость становится особенно важной. Обычный чат-бот генерирует один ответ, тогда как ИИ-агент способен сделать сотни или даже тысячи промежуточных запросов к модели, прежде чем завершит задачу. Поэтому даже небольшая задержка на каждом этапе быстро превращается в минуты ожидания. Nvidia утверждает, что Groq 3 LPX способен существенно сократить это время. В тесте Artificial Analysis ускоритель показал около 3400 выходных токенов в секунду при работе с моделью Gemma 4 31B и контекстом размером 100000 токенов. Компания заявляет, что в некоторых чувствительных к задержкам задачах система обеспечивает примерно в четыре раза более высокую отзывчивость, чем ближайшая альтернативная платформа.
Читайте также
Биткоин приблизился к $65000: нефть и инфляция вернули спрос на риск
Groq 3 LPX будет работать совместно с платформой Nvidia Vera Rubin NVL72. Такая схема позволяет разделять разные части нагрузки: мощные GPU подходят для тяжёлых вычислений и обработки больших объёмов данных, а специализированные LPU Groq — для максимально быстрой последовательной генерации. «Инференс — двигатель роста искусственного интеллекта», — заявил глава Nvidia Дженсен Хуанг, представляя новую систему. Технология появилась у Nvidia после необычной сделки с Groq, заключённой в декабре 2025 года. Её стоимость оценивается примерно в $20 млрд, однако речь не идёт о классическом поглощении компании. Nvidia получила неисключительную лицензию на технологии Groq, а основатель стартапа Джонатан Росс, президент Санни Мадра и часть команды перешли в Nvidia. Сама Groq сохранила статус независимой компании, а GroqCloud продолжил работу.
Первым крупным облачным провайдером, который планирует внедрить Groq 3 LPX, станет Nebius. В дальнейшем технологию собирается использовать и сама Groq в собственной инфраструктуре. Для рынка это важный сигнал. Несколько лет гонка искусственного интеллекта вращалась прежде всего вокруг того, кто сможет обучить более мощную модель. Теперь начинается следующая фаза: кто сможет заставить эти модели работать быстрее, дешевле и практически без задержек. Если ИИ-агенты действительно должны заменить часть рутинной работы человека — искать информацию, программировать, работать с корпоративными системами и самостоятельно выполнять многоэтапные задачи, — скорость ответа может стать почти такой же важной характеристикой, как интеллект самой модели.





