Абярыце краіну або рэгіён.

NVIDIA пачынае масавую вытворчасць стэкаў Groq 3 LPX пасля тэхналагічнай дамовы на суму 20 мільярдаў долараў

У панядзелак, 24 жніўня, NVIDIA аб’явіла, што сістэма стэка Groq 3 LPX увайшла ў масавую вытворчасць, адзначаючы камерцыйнае развертыванне тэхналогіі, атрыманага праз мінулую тэхналагічную перадачу на суму 20 мільярдаў долараў. Сістэма, распрацаваная для даўгавечнай інферэнцыі агентаў ШІ з нізкай затрымкай, стане часткай платформы Вера Рубіна і вырашыць абмежаванні прадукцыйнасці GPU падчас генерацыі токенаў.

Дыон Харрыс, старшы дырэктар NVIDIA, сказаў, што першыя стэкі Groq 3 LPX будуць размешчаны на платформе пастаўшчыка воблачных паслуг Nebius. У спалучэнні з Vера ЦП і Rубіна GPU яны ўтвараюць поўны гетерогенный кластар вылічэнняў, які павінен пачаць прапаноўваць паслугі ў другой палове 2026 года.

Кожны стэк LPX ўключае 256 Апаратных адзінак апрацоўкі мовы Groq 3, або LPU. Сістэма выкарыстоўвае вялікія аб’ёмы SRAM на чыпе, каб знізіць накладныя выдаткі, звязаныя з доступам да знешняй памяці, і аптымізавана для нагрузак на інферэнцыю, якія патрабуюць доўгіх кантэкстных вокнаў і хуткіх часоў адказу, уключаючы агентаў ШІ і праграмаванне з падтрымкай ШІ. Паводле афіцыйных вынікаў бенчмаркінгу, стэк выдае 3,400 токенаў у секунду падчас працы з мадэллю Gemma 4 31B з кантэкстным вокнам у 100,000 токенаў, што дае яму відавочнае перавагу ў нагрузках з высокай адчувальнасцю да затрымкі.

NVIDIA і Groq дасягнулі дамовы на суму 20 мільярдаў долараў у снежні 2025 года. Згодна з дамовай, NVIDIA забяспечыла ліцэнзіі на тэхналогію архітэктуры чыпаў Groq і ўвяла заснавальнікаў Groq і асноўны інжынерны персанал у кампанію. Гэта была найбольшая тэхналагічная здзелка ў гісторыі NVIDIA. Groq застаўся незалежнай кампаніяй, а яго існуючыя воблачныя бізнесы працягвалі працаваць. Да дамовы Groq ужо здолеў прыцягнуць значную ўвагу ў галіне за сваю тэхналогію LPU з нізкай затрымкай, якая выкарыстоўвалася з адкрытымі буйнымі мадэлямі мовы.

Платформа Вера Рубіна выкарыстоўвае раздысцыплінаваную, гетерогенную архітэктуру інферэнцыі. GPU Rubin апрацоўваюць аперацыі запаўнення мадэлі і вялікія масівы кантэксту, у той час як сістэмы Groq 3 LPX сканцэнтраваны на хуткай генерацыі токенаў падчас стадыі дэкадацыі. CPU Vera выконваюць агульныя задачы, такія як выклікі інструментаў і выкананне кода. Гэта падзел нагрузак дазваляе розным працэсарам падтрымліваць поўны працэс працы агента ШІ ў адпаведнасці з іх адпаведнымі моцнымі бакамі.

Арганізацыя вытворчых працэсаў паўсюды таксама адлюстроўвае адрозненні ў ланцужках паставак. LPU серыі Groq вырабляюцца Samsung, у той час як асноўныя GPU NVIDIA выпускаюцца з выкарыстаннем магутнасцей вытворчасці TSMC.