Az Cerebras bejelentette az CS-4 mesterséges intelligencia-gyorsítót, amely jelentős előrelépést jelent az iparágban a teljesítmény és a méretezhetőség terén. Az új rendszer, amely az 5 nanométeres WSE-3 chippel működik, kétszeres teljesítményt nyújt az előző CS-3 modellhez képest, miközben a hardver architektúra és a memória változatlan maradt.[^1]
Az CS-4 egy rack-scale megoldás, amelyet teljes szerverállványként lehet integrálni adatközpontokba. A rendszer egyedi moduláris “Backpack”-dizájnt alkalmaz, amely megkönnyíti és felgyorsítja a telepítést. Az új modell három wafer-rel rendelkezik rackenként, szemben az előző kettővel, így jelentősen nőtt az elérhető számítási kapacitás.
Az CS-4 akár 4 400 token másodpercenkénti feldolgozására képes felhasználónként, amely a vállalat szerint akár 30-szor gyorsabb, mint az Nvidia-GPU-alapú rendszerek.[^1] A memória kapacitás továbbra is 44 GB waferenként, de a magasabb órajel és a hatékonyabb hűtés révén sikerült megduplázni az előző generáció sebességét.
Az Cerebras új rendszere támogatja a diszaggregált inferencia-modellt, amelyben partnerei – például az AMD és az AWS Trainium – is szerepet kapnak. A hardver már bizonyított az iparágban, többek között az OpenAI is használja valós idejű kódgeneráló rendszerekhez, mint az Codex Spark.[^1]
Bár a hálózati fejlesztések szerényebbek, a SemiAnalysis elemzői szerint az architektúra főként a számítási teljesítményben és a rugalmasságban jelent előrelépést.[^1] További részletek az Hot Chips konferencián várhatók.
Az Cerebras CS-4 bemutatkozása új szintre emeli a mesterséges intelligencia-gyorsítók piacát, különösen azok számára, akik nagy léptékű MI-modelleket futtatnak. Az innovatív tervezés, a moduláris felépítés és az iparági partnerek bevonása hozzájárulhat az AI-technológia további fejlődéséhez és elterjedéséhez.
[^1]: THE DECODER (2026-08-24). “Cerebras stellt CS-4 vor: Doppelte Leistung, gleicher Chip”. Közzétéve [2026. 08. 24.].