Sasar Nvidia! Cerebras (CBRS.US) meluncurkan sistem "akselerator AI tercepat" CS-4, klaim kecepatan inferensi 30 kali lebih tinggi daripada solusi GPU
Cerebras meluncurkan sistem CS-4 dan menyebutnya sebagai akselerator AI tercepat di industri.
Aplikasi Keuangan Zhihong memperoleh informasi bahwa perusahaan chip AI, Cerebras Systems (CBRS.US), secara resmi meluncurkan sistem AI tingkat rak generasi terbaru, Cerebras CS-4, dalam konferensi SUPERNOVA di San Francisco, dan menyebutnya sebagai "akselerator AI tercepat di industri." Sistem ini menargetkan jalur inferensi AI dan secara langsung bersaing dengan produk server GPU dari Nvidia (NVDA.US). CS-4 diperkirakan akan mulai dikirim pada kuartal ini (kuartal ketiga 2026) dan saat ini sedang diuji sampel oleh sejumlah kecil pelanggan.
Spesifikasi Teknis: Tiga prosesor wafer-level menghasilkan kinerja 750 PFLOPs
CS-4 adalah produk pertama dari arsitektur platform rak generasi baru Nexus milik Cerebras, yang didukung oleh tiga prosesor wafer-level terbaru, Wafer Scale Engine 3 Turbo (WSE-3T). WSE-3T adalah prosesor AI terbesar hingga saat ini, dengan masing-masing chip mengintegrasikan 4 triliun transistor dan 900 ribu inti yang dioptimalkan untuk AI, mencakup area silikon seluas 46.225 milimeter persegi, dan dilengkapi dengan SRAM 44GB di dalamnya.
Sistem CS-4 menyediakan 750 PFLOPs kinerja AI, lebar pita memori 129,6 PB per detik, dan throughput I/O 7,2 Tbps per detik. Dibandingkan dengan generasi sebelumnya, CS-3, CS-4 memiliki kecepatan dua kali lebih cepat dan throughput per watt sepuluh kali lipat lebih baik, sehingga secara signifikan meningkatkan efisiensi ekonomi pusat data. Dibandingkan WSE-3 generasi sebelumnya, WSE-3T menggandakan kinerja AI per wafer dari 125 PFLOPS menjadi 250 PFLOPS, serta lebar pita memori dari 21,6 PB/s menjadi 43,2 PB/s. Konsumsi daya per chip juga melonjak dari 15 kilowatt menjadi sekitar 33 kilowatt.
Dari sisi desain arsitektur, CS-4 mengadopsi arsitektur platform Nexus modular, yang memisahkan komputasi, daya, dan I/O menjadi komponen independen. Modul konversi daya dipindahkan dari jarak sekitar 50 milimeter dari prosesor di papan GPU tradisional, menjadi sekitar 0,5 milimeter, hampir menghilangkan kehilangan daya di tingkat papan. Desain "backpack" yang dapat dicabut mengintegrasikan konversi daya, pendinginan cair, dan kontrol elektronik menjadi satu, sehingga waktu pemasangan dipersingkat dari beberapa hari menjadi beberapa jam.
Terobosan Performa: Lebih dari 4.400 Token per Detik per Pengguna dalam Pengujian GPT-OSS-120B
Cerebras menyatakan bahwa CS-4 menetapkan standar industri baru dalam kecepatan inferensi. Dalam pengujian langsung terhadap model GPT-OSS-120B, CS-4 dapat menghasilkan lebih dari 4.400 token per detik per pengguna, hingga 30 kali lebih tinggi daripada solusi GPU. Sistem ini juga mampu mendukung model dengan lebih dari 50 triliun parameter.
Sean Lie, CTO merangkap salah satu pendiri Cerebras, mengatakan, "30 kali lebih cepat bukan hanya membuat respons terasa lebih lancar, tetapi juga memberi sistem agen kecerdasan ruang lebih dari satu orde besaran untuk melakukan inferensi, validasi, atau pemanggilan alat dalam waktu nyata yang sama." CEO Cerebras, Andrew Feldman, menambahkan, "Secara historis, inferensi cepat berarti menggunakan model yang lebih kecil dan kurang mumpuni. CS-4 menghadirkan kecepatan terdepan industri pada model-model frontier terbesar, secara fundamental mengubah paradigma tersebut."
Dari segi efisiensi energi, CS-4 meningkatkan throughput per watt hingga 10 kali dibandingkan CS-3, sehingga meningkatkan efisiensi ekonomi pusat data secara signifikan. CEO Cerebras, Andrew Feldman, menegaskan bahwa token cepat lebih bernilai daripada token lambat, dan CS-4 dapat menyediakan token kualitas dan jumlah yang lebih tinggi dalam anggaran daya yang sama, "secara fundamental mengubah paradigma."
CS-4 juga dirancang dengan mengurangi jumlah komponen hingga 50%, sehingga memudahkan dan mempercepat pemasangan oleh pelanggan. Dalam arsitektur sistem, platform Nexus yang baru memisahkan komputasi, daya, dan I/O menjadi modul-modul—konversi daya diperkecil dari jarak sekitar 50 milimeter dari prosesor di papan GPU tradisional menjadi sekitar 0,5 milimeter, secara signifikan mengurangi konsumsi daya di tingkat papan serta memungkinkan frekuensi operasi yang lebih tinggi. Desain "backpack" yang dapat dicabut mengintegrasikan konversi daya, pendinginan cair, dan kontrol elektronik ke dalam satu unit independen, sehingga waktu pemasangan dipersingkat dari beberapa hari menjadi beberapa jam.
Perlu dicatat, sistem wafer-level Cerebras menggunakan Static Random Access Memory (SRAM), bukan DRAM yang lazim digunakan. SRAM jauh lebih cepat daripada DRAM, namun lebih besar serta lebih mahal—wafer sebesar piring makan milik Cerebras menyediakan ruang fisik yang dibutuhkan untuk memanfaatkan SRAM. Pada saat yang sama, desain chip tunggal memungkinkan jarak transfer data jauh lebih pendek dibandingkan sistem multi-chip milik Nvidia atau AMD.
Kolaborasi Ekosistem: Bermitra dengan AMD Helios, Targetkan Peningkatan Efisiensi 5 Kali Lipat
Subsistem I/O yang dapat diprogram pada CS-4 mendukung standar RoCE v2 RDMA berbasis Ethernet dan dapat terintegrasi dengan sistem heterogen. Cerebras telah bermitra dengan AMD (AMD.US) untuk mengembangkan arsitektur ini, menggabungkan solusi rak tingkat Helios milik AMD dengan WSE, sehingga menghasilkan jumlah token per watt per detik lima kali lipat lebih banyak dibandingkan konfigurasi murni Cerebras. AWS Trainium juga disebut sebagai mitra.
Pendiri dan CEO SemiAnalysis, Dylan Patel, berkomentar bahwa peningkatan kemampuan pemasangan dan jaringan CS-4 memungkinkannya untuk meningkatkan model ke skala yang lebih besar, menciptakan "pabrik token besar-besaran."
Latar Belakang Pasar: Harga Saham Turun 35% dari Titik Tertinggi Setelah IPO, CS-4 Jadi Titik Balik Penting
Cerebras melantai di Nasdaq pada 14 Mei 2026 dengan harga 185 dolar AS per saham, harga pembukaan hari pertama sebesar 350 dolar AS, dan harga penutupan sebesar 311,07 dolar AS—naik 68%. Namun, harga saham terus menurun dan pada hari Selasa berada di kisaran 220 dolar AS, turun sekitar 35% dari titik tertingginya.
Laporan keuangan kuartal kedua perusahaan campur aduk: pendapatan inti 209,9 juta dolar AS, naik 103% yoy; tetapi kerugian per saham sebesar 2,98 dolar AS, sedangkan pada periode yang sama tahun lalu mencatat laba 1,91 dolar AS. Panduan perusahaan untuk pertumbuhan pendapatan inti tiga kali lipat pada 2027 dan prospek Q3 yang di atas ekspektasi belum sepenuhnya meyakinkan investor. Namun, kewajiban pemenuhan kontrak yang tersisa mencapai 25,4 miliar dolar AS, memberikan visibilitas pendapatan yang kuat di masa depan.
Signifikansi Industri: Lanskap Pasar Inferensi AI Akan Mengalami Transformasi
Peluncuran CS-4 bertepatan dengan lonjakan permintaan inferensi AI di pasar. Seiring model-model besar berpindah dari fase pelatihan ke penyebaran massal, efisiensi inferensi menjadi aspek inti daya saing infrastruktur AI. Jika keunggulan kecepatan 30 kali lipat yang diklaim Cerebras ini dapat dibuktikan dalam uji tolok ukur independen, hal tersebut bisa mengubah keputusan pengadaan operator pusat data skala besar.
Peluncuran Cerebras CS-4 menandai bahwa persaingan chip AI kini bergerak cepat dari pelatihan model ke pasar inferensi. Apakah sistem ini bisa benar-benar menggoyahkan dominasi Nvidia di bidang inferensi AI akan sangat bergantung pada apakah performa yang diklaim dapat dibuktikan secara independen—dan apakah CS-4 dapat diproduksi serta dikirim dalam skala besar dan waktu yang cukup cepat untuk memenuhi permintaan pusat data skala besar yang makin mendesak untuk generasi token berkecepatan tinggi.
Layanan cloud inferensi milik Cerebras berhasil tumbuh 287% yoy pada kuartal kedua, mencapai pendapatan inti cloud sebesar 127,7 juta dolar AS. Peluncuran CS-4 menandai transisi Cerebras menuju model bisnis dari menjual perangkat keras ke menyewakan kemampuan inferensi AI masuk ke tahap baru.
Disclaimer: Konten pada artikel ini hanya merefleksikan opini penulis dan tidak mewakili platform ini dengan kapasitas apa pun. Artikel ini tidak dimaksudkan sebagai referensi untuk membuat keputusan investasi.
Kamu mungkin juga menyukai
Departemen Keuangan AS Ambil Langkah Darurat untuk Menstabilkan Pasar Obligasi! Skala Repo Obligasi AS Jangka Panjang Setidaknya Berlipat Ganda, Imbal Hasil Obligasi AS Menurun di Seluruh Lini
Departemen Keuangan Amerika Serikat pada hari Rabu menyatakan akan setidaknya menggandakan skala "operasi repo dukungan likuiditas" untuk obligasi dengan jangka waktu antara 10 hingga 30 tahun.

Pusat data AI memicu permintaan tinggi untuk chip manajemen daya! Pendapatan Q3 Analog Devices (ADI.US) mencetak rekor, proyeksi Q4 melebihi ekspektasi
Karena permintaan chip yang didorong oleh kecerdasan buatan, kinerja Analog Devices melebihi ekspektasi.

Strategi "membalikkan kerugian" CEO baru terus membuahkan hasil! Pendapatan Q2 Target (TGT.US) melampaui ekspektasi, pengembalian tarif membantu lonjakan laba, panduan tahunan kembali dinaikkan
Seiring dengan langkah-langkah CEO baru, Fiddelke, yang mulai membuahkan hasil dan membalikkan tren negatif, Target kembali menaikkan proyeksi kinerja tahunan.

Prospek Saham AS | Tiga indeks utama berjangka bergerak bervariasi, saham Moderna melonjak sebelum pembukaan, risalah rapat Federal Reserve bulan Juli dan lelang obligasi pemerintah AS bertenor 20 tahun akan dirilis malam ini
Pada tanggal 19 Agustus (Rabu) sebelum pembukaan pasar saham AS, tiga indeks berjangka utama saham AS bergerak variatif.

