Дыон Харрыс, старшы дырэктар NVIDIA, сказаў, што першыя стэкі Groq 3 LPX будуць размешчаны на платформе пастаўшчыка воблачных паслуг Nebius. У спалучэнні з Vера ЦП і Rубіна GPU яны ўтвараюць поўны гетерогенный кластар вылічэнняў, які павінен пачаць прапаноўваць паслугі ў другой палове 2026 года.
Кожны стэк LPX ўключае 256 Апаратных адзінак апрацоўкі мовы Groq 3, або LPU. Сістэма выкарыстоўвае вялікія аб’ёмы SRAM на чыпе, каб знізіць накладныя выдаткі, звязаныя з доступам да знешняй памяці, і аптымізавана для нагрузак на інферэнцыю, якія патрабуюць доўгіх кантэкстных вокнаў і хуткіх часоў адказу, уключаючы агентаў ШІ і праграмаванне з падтрымкай ШІ. Паводле афіцыйных вынікаў бенчмаркінгу, стэк выдае 3,400 токенаў у секунду падчас працы з мадэллю Gemma 4 31B з кантэкстным вокнам у 100,000 токенаў, што дае яму відавочнае перавагу ў нагрузках з высокай адчувальнасцю да затрымкі.
NVIDIA і Groq дасягнулі дамовы на суму 20 мільярдаў долараў у снежні 2025 года. Згодна з дамовай, NVIDIA забяспечыла ліцэнзіі на тэхналогію архітэктуры чыпаў Groq і ўвяла заснавальнікаў Groq і асноўны інжынерны персанал у кампанію. Гэта была найбольшая тэхналагічная здзелка ў гісторыі NVIDIA. Groq застаўся незалежнай кампаніяй, а яго існуючыя воблачныя бізнесы працягвалі працаваць. Да дамовы Groq ужо здолеў прыцягнуць значную ўвагу ў галіне за сваю тэхналогію LPU з нізкай затрымкай, якая выкарыстоўвалася з адкрытымі буйнымі мадэлямі мовы.
Платформа Вера Рубіна выкарыстоўвае раздысцыплінаваную, гетерогенную архітэктуру інферэнцыі. GPU Rubin апрацоўваюць аперацыі запаўнення мадэлі і вялікія масівы кантэксту, у той час як сістэмы Groq 3 LPX сканцэнтраваны на хуткай генерацыі токенаў падчас стадыі дэкадацыі. CPU Vera выконваюць агульныя задачы, такія як выклікі інструментаў і выкананне кода. Гэта падзел нагрузак дазваляе розным працэсарам падтрымліваць поўны працэс працы агента ШІ ў адпаведнасці з іх адпаведнымі моцнымі бакамі.
Арганізацыя вытворчых працэсаў паўсюды таксама адлюстроўвае адрозненні ў ланцужках паставак. LPU серыі Groq вырабляюцца Samsung, у той час як асноўныя GPU NVIDIA выпускаюцца з выкарыстаннем магутнасцей вытворчасці TSMC.






























































































