Mercek360 gündemi taradı - AI dünyasında yeni başlıklarApple Vision Pro 2 tanıtıldı - Daha hafif, daha güçlüNVIDIA Blackwell Ultra - Yapay zeka performansı yükseliyorTürk AI startup'ı 50M$ yatırım aldıRust 2.0 yolda - Bellek güvenliği yeni seviyede
Mercek360
Ana SayfaCihazlar & Donanım

Cerebras CS-4 ve WSE-3T: Yapay Zeka Çip Pazarında Hız ve Güç Dengelerini Değiştiren Hamle

Ozan Tankuş19 Ağustos 20260
Cerebras CS-4 ve WSE-3T: Yapay Zeka Çip Pazarında Hız ve Güç Dengelerini Değiştiren Hamle

📌 Öne Çıkan Gelişmeler

  • Cerebras, yeni nesil Wafer Scale Engine (WSE-3T) ve Nexus raf sistemlerini duyurarak yapay zeka çıkarımında (inference) sınırları zorluyor.
  • WSE-3T, aynı silikon tabanını kullanmasına rağmen güç iletimindeki devrimsel yenilikler sayesinde önceki nesle kıyasla performansı ikiye katlıyor.
  • AWS ve AMD ile yapılan stratejik ortaklıklar, işlem yüklerinin optimize edilerek sistem verimliliğinin maksimum seviyeye çıkarılmasını sağlıyor.

Yapay zeka dünyasında çip savaşları tüm hızıyla sürerken, donanım mimarileri de sınırları zorlamaya devam ediyor. Sektörün dikkat çeken oyuncularından Cerebras, yapay zeka çıkarım süreçlerindeki en büyük darboğaz olan bellek bant genişliği sorununa kökten bir çözüm getirme iddiasıyla sahneye çıktı. Akşam yemeği tabağı büyüklüğündeki devasa yapay zeka hızlandırıcılarıyla tanınan şirket, yeni nesil CS-4 raf sistemlerini ve WSE-3T (Turbo) işlemcilerini resmen tanıttı. Bu hamle, yalnızca ham işlem gücünü artırmakla kalmıyor, aynı zamanda watt başına düşen verimliliği on kat artırma hedefini de beraberinde getiriyor.

WSE-3T ve Turbo Mimarisi: Silikonu Sınırlarına Kadar Zorlamak

Cerebras’ın tanıttığı yeni WSE-3T işlemcisindeki "T" harfi tesadüfen seçilmemiş; aksine sistemin karakterini özetleyen "Turbo" kelimesini temsil ediyor. İlk bakışta teknik özellik kağıdına bakıldığında, bu yonganın tamamen yeni bir silikon olmadığını, TSMC'nin 5nm süreciyle üretilen 46.225 milimetrekarelik aynı wafer alanını, 4 trilyon transistörü ve 900.000 çekirdeği koruduğunu görüyoruz. Peki, performans nasıl iki katına çıktı?

Cerebras mühendisleri, bu devasa yapının saat hızlarını ve güç iletim mekanizmalarını yeniden tasarlayarak mevcut silikondan maksimum verimi almayı başarmış durumda. Önceki nesil WSE-3 mimarisinde yaklaşık 1.4 GHz seviyelerinde çalışan saat hızlarının, Turbo varyantı ile birlikte 2.8 GHz seviyelerine çıkarıldığı tahmin ediliyor. Bu dramatik frekans artışı, çipin saniyede üretebildiği token sayısını (token generation) doğrudan ikiye katlayarak dil modellerinin tepki süresini, yani kullanıcı deneyimini radikal bir şekilde iyileştiriyor.

Devasa Bellek Bant Genişliği ve Yeni Nesil Çıkarım Paradigması

WSE-3T; 250 petaFLOPS yapay zeka hesaplama gücü, 44 GB dahili SRAM ve saniyede 43.2 petabayt (PB/s) gibi akıl almaz bir bellek bant genişliği sunuyor. Her ne kadar bu rakamlar ilk bakışta geleneksel GPU mimarilerini fersah fersah geride bırakmış gibi görünse de, bu performansın büyük kısmının "sparsity" (seyreklik) optimizasyonlarına dayandığını not etmek gerekiyor. Geleneksel LLM çıkarım süreçlerinde seyreklik her zaman doğrudan avantaj sağlamasa da, çipin sunduğu ham bant genişliği endüstride eşsiz bir konuma sahip.

Ancak bu noktada en stratejik değişim, Cerebras'ın çıkarım iş yüklerini ele alma biçiminde gerçekleşiyor. Şirket artık tüm süreci tek başına sırtlamak yerine, Amazon Web Services (AWS) ve AMD ile güçlerini birleştiriyor. İstihbarat işleme ve komut (prompt) işleme gibi yoğun hesaplama gerektiren aşamalar AWS Trainium ve AMD Instinct GPU'larına devredilirken, Cerebras yongaları adeta dev bir "decode accelerator" (kod çözme hızlandırıcı) olarak konumlandırılıyor. Bu disaggregate (ayrıştırılmış) mimari sayesinde, trilyonlarca parametreye sahip devasa modeller binlerce geleneksel karta ihtiyaç duyulmadan, çok daha az sayıdaki Cerebras ünitesiyle çalıştırılabiliyor.

CS-4 Raf Sistemleri ile Modüler Ölçeklenebilirlik

Yalnızca çip seviyesinde değil, sistem mimarisinde de büyük yenilikler var. Cerebras, CS-4 ile monolitik sistem tasarımından uzaklaşarak modüler bir raf ölçekli (rack-scale) mimariye geçiş yapıyor. Tıpkı Nvidia'nın NVL72 veya AMD'nin Helios sistemlerinde olduğu gibi, CS-4 de hesaplama, güç dağıtımı ve kablolama katmanlarını birbirinden ayırarak veri merkezlerinde kurulum, bakım ve yükseltme süreçlerini kolaylaştırıyor.

Sistem bünyesinde kullanılan ve "backpack" (sırt çantası) adı verilen özel form faktörleri, tüm kontrol elektroniğini tek bir modülde topluyor. Bir CS-4 rafı, bu modüllerden üç tanesine kadar ev sahipliği yapabiliyor. Rafın ön kısmında ise devasa enerji ihtiyacını karşılayan güç rafları yer alıyor. Çipin fiziksel boyutları düşünüldüğünde standart OCP (Open Compute Project) tasarımlarına birebir uymak imkansız olsa da, termal yönetim ve güç iletimindeki verimlilik artışı, bu yoğun sistemlerin veri merkezlerinde güvenle barındırılabilmesini sağlıyor.

💡 Mercek360 Sektörel Değerlendirmesi

Cerebras'ın WSE-3T ve CS-4 sistemleriyle attığı bu adım, yapay zeka donanım pazarında katılaşmış rekabet kalıplarını sarsacak nitelikte. Şirket, tamamen yeni bir silikon üretim teknolojisine yatırım yapmak yerine, mevcut wafer ölçekli mimarisinden saniyedeki hızı ve güç verimliliğini optimize ederek ticarileşme sürecini hızlandırmanın akıllıca bir yolunu buldu. Özellikle bulut devleriyle (AWS gibi) kurulan entegre ekosistem ortaklıkları, donanımın veri merkezlerindeki entegrasyon bariyerlerini minimuma indiriyor.

Önümüzdeki dönemde, büyük dil modellerinin (LLM) maliyetlerini düşürmek ve çıkarım hızlarını milisaniye seviyelerine çekmek isteyen bulut sağlayıcıları için Cerebras çözümleri cazip bir alternatif haline gelecektir. SRAM kapasitesinin artırılmasından ziyade mevcut silikonun saat hızlarının ve güç iletiminin zorlanması, şirketin WSE-4 nesline geçişte daha radikal kapasite artışları yapacağının da bir sinyali olarak okunabilir. Yapay zeka altyapılarında hız ve verimlilik artık lüks değil, endüstriyel bir zorunluluk ve Cerebras bu yarışta ben de varım diyor.

cerebrasyapay-zekadonanimyapay-zeka-cikarimiveri-merkezi