Cerebras zaprezentował akcelerator CS-4, który dzięki lepszemu chłodzeniu i zasilaniu podwaja wydajność WSE-3 i osiąga 4400 tokenów/s na użytkownika.

Źródło zdjęcia: The Decoder
Firma Cerebras zaprezentowała nowy akcelerator AI oznaczony CS-4, który jej dyrektor generalny Andrew Feldman określa jako najszybszy system w branży. Jak podaje the-decoder, CS-4 to produkt klasy rack-scale, czyli całościowa szafa serwerowa trafiająca do centrów danych jako jedna, zintegrowana jednostka – z jednostkami obliczeniowymi, zasilaniem i chłodzeniem w komplecie.
Co istotne, nowy system wciąż opiera się na tym samym chipie WSE-3, wykonanym w procesie 5nm, co poprzednia generacja CS-3. Cerebras nie zmieniło więc krzemu, a mimo to podwoiło wydajność.
Kluczem do skoku wydajnościowego w CS-4 nie jest nowy proces produkcyjny chipa, lecz optymalizacja całego systemu wokół istniejącego już WSE-3. Cerebras zwiększyło zegar taktowania poprzez dostarczenie większej ilości energii i wdrożenie skuteczniejszego chłodzenia. Efektem jest podwojenie wydajności względem CS-3 przy zachowaniu tej samej architektury krzemowej.
Zmienił się natomiast układ fizyczny szafy serwerowej – teraz pomieszczono w niej trzy wafle krzemowe, o jeden więcej niż w poprzedniej generacji. To przełożyło się na deklarowaną przepustowość do 4400 tokenów na sekundę na jednego użytkownika. Według Cerebras jest to wynik nawet trzydziestokrotnie wyższy niż w porównywalnych konfiguracjach opartych na kartach graficznych Nvidii, choć pojemność pamięci na wafel pozostała bez zmian – 44 GB.
Nowością architektoniczną jest system „Backpack” – modułowa konstrukcja, która ma umożliwić szybszy montaż całych jednostek rack-scale. Cerebras stawia też na disaggregated inference, czyli rozproszone wnioskowanie realizowane w partnerstwie z AMD oraz AWS Trainium. To podejście pozwala rozdzielać obciążenia obliczeniowe pomiędzy różne platformy sprzętowe, co może zwiększyć elastyczność wdrożeń w centrach danych.
Analitycy z SemiAnalysis, cytowani w materiale, oceniają jednak, że korzyści z warstwy sieciowej tego rozwiązania są raczej niewielkie. Więcej szczegółów technicznych ma się pojawić podczas konferencji Hot Chips, gdzie Cerebras planuje zaprezentować dodatkowe dane na temat nowego systemu.
Sprzęt Cerebras jest już wykorzystywany przez OpenAI w projekcie Codex Spark, co wskazuje, że firma znalazła sobie miejsce w infrastrukturze dużych dostawców modeli AI jako alternatywa dla klasycznych rozwiązań opartych na GPU. Deklarowana wydajność CS-4 – jeśli potwierdzą ją niezależne testy – może wzmocnić pozycję Cerebras jako gracza specjalizującego się w bardzo szybkim wnioskowaniu (inference) dla dużych modeli językowych, w segmencie, w którym dotychczas dominowała Nvidia. Rozwój infrastruktury tego typu wpisuje się w szerszy trend rosnącego zapotrzebowania na moc obliczeniową, napędzany przez coraz bardziej wymagające zastosowania agentowe i inferencyjne w branży AI.
Cerebras nie podało jeszcze pełnej specyfikacji technicznej ani terminu komercyjnej dostępności CS-4 – szczegóły mają zostać ujawnione podczas nadchodzącej konferencji Hot Chips.

Testy TechCrunch wykazały, że Claude Opus 4.6 od Anthropic łatwo omija zakaz treści seksualnie eksplicytnych, mimo deklarowanych zasad bezpieczeństwa firmy.

Roczny wskaźnik przychodów Anthropic przekroczył 65 mld dolarów, wyprzedzając wzrost OpenAI. Firma szykuje rekordowe IPO o wycenie 2 bilionów dolarów.

Nowe badanie ekonomiczne pokazuje, że AI w nauce zwiększa koszt alternatywny czasu badaczy, prowadząc częściej do gorszych, a nie lepszych publikacji.