Абярыце краіну або рэгіён.

Cerebras прадстаўляе сістэму выводу CS-4, накіраваную на рынак серверных графічных працэсараў Nvidia

CS-4 Inference System

AI вытворца чыпаў Cerebras Systems прадставіў CS-4, новую сістэму AI ў фармаце шафы, накіраваную на рынак серверных графічных працэсараў Nvidia і вобласці высвятлення буйных мовных мадэляў. Паводле слоў кампаніі, CS-4 можа генераваць токены на хуткасці да 30 разоў большай, чым у звычайных сервероў GPU, калі ўсе рэсурсы сістэмы выдзелены адному карыстачу.

Варта адзначыць, што гэтая лічба заснавана на ўнутраным тэставанні Cerebras і вымярае хуткасць генерацыі тэксту, калі адзін карыстач мае эксклюзіўны доступ да вылічальных рэсурсаў сістэмы. Гэта не адлюстроўвае агульную прапускную здольнасць сістэмы пры абслугоўванні некалькіх карыстачоў адначасова.

На мерапрыемстве ў Сан-Францыска Cerebras заявіла, што CS-4 уключае тры працэсары WSE-3 Turbo з вялікімі вуглавымі плітамі. Паводле слоў кампаніі, кожны працэсар інтэгруе прыкладна 4 трыльёны транзістараў, што робіць яго адным з найбольшых адкрытых махавічных працэсараў AI на сённяшні дзень. У адрозненне ад мультыпрацэсарных архітэктур, якія звычайна выкарыстоўваюцца Nvidia і AMD, Cerebras выкарыстоўвае маналітны дызайн поўнай вуглавой пліты, які скарачае шляхі перадачы дадзеных на чыпе.

CS-4 распрацаваны для высвятлення AI, а не для навучання мадэляў. Яго архітэктура памяці выкарыстоўвае стацыянарную памяць з выпадковым доступам, або SRAM, замест дынамічнай памяці з выпадковым доступам або DRAM, якая звычайна выкарыстоўваецца ў прамысловасці. SRAM забяспечвае значна больш хуткія хуткасці чытання і запісу, чым DRAM, але яго больш складаная структура і вышэйшая кошт за адзінку ёмістасці, звычайна, робяць яго цяжкім для інтэграцыі ў працэсары з абмежаванай плошчай кропкі. WSE-3 Turbo прыкладна памерам з талерку для абеду, забяспечваючы дастаткова фізічнага месца для ўключэння SRAM непасрэдна на працэсары.

Cerebras выводзіць хуткую генерацыю тэксту як асноўную канкурэнтную перавагу CS-4. Кампанія заявіла, што яе працэсар з вялікімі вуглавымі плітамі можа захоўваць усе значэнні параметраў, неабходныя AI-мадэлі, непасрэдна на чыпе, адкідаючы неабходнасць атрымаць дадзеныя з знешніх памятных чыпаў і знізіўшы затрымку, звязаную з перамяшчэннем дадзеных.

Паводле слоў Cerebras, узоры CS-4 ў цяперашні час даступныя абмежаванай колькасці кліентаў, а шырэйшая даступнасць запланавана на больш позні час трэцяга квартала гэтага года.