AMD ve Cerebras, AI çıkarım süreçlerini iki farklı donanım mimarisi arasında bölen bir platform geliştiriyor. AMD'nin Helios raf altyapısında yer alan EPYC işlemcileri ve Instinct MI400 serisi akseleratörler, büyük bağlam penceresi ve prompt işleme gibi hesaplama yoğun görevleri üstleniyor. Cerebras'ın Wafer-Scale Engine (WSE) çipleri ise bellek bant genişliği gerektiren ve gecikmeye duyarlı token üretme aşamasını üstleniyor.
Bu ayrıştırılmış yapı, her bir bileşenin kendi için en uygun görevi yapmasını sağlayarak, saniyede başına daha fazla token üretme ve enerji verimliliği açısından %500'e varan bir iyileşme hedefliyor. Platform, Nvidia'nın CPX kavramına benzer bir yaklaşımı takip ediyor ancak görev dağılımını tersine çeviriyor: Nvidia'nın tasarımı hesaplama yoğun kısmı için özel GPU'lar kullanırken, AMD-Cerebras entegrasyonu bu kısmı EPYC ve Instinct ile yapıyor.
Cerebras, Helios sistemlerini kendi veri merkezlerine entegre ederek, birlikte çalışacak bir bulut hizmeti sunmayı planlıyor. Bu çözüm, 2026'nın ikinci yarısında Cerebras Cloud üzerinden ilk kez müşterilere sunulacak.
