Chip AMD MI450 versi kustom Meta mengalami penurunan separuh daya komputasi dan pengurangan besar pada memori, SemiAnalysis: Ini adalah kesedihan budaya perusahaan Meta
Miliaran dolar terbuang sia-sia! Meta mengalami kegagalan "katastrofik" dalam infrastruktur AI: memaksa AMD untuk memangkas chip terkuatnya, dan akuisisi senilai 2,5 miliar dolar menjadi kacau balau. Institusi mengkritik, budaya kinerja jangka pendek dan penyesuaian berlebihan sedang membunuh kolaborasi perangkat lunak dan perangkat keras. Krisis organisasi yang mendalam ini membuat Meta menanggung kerugian besar.
Sederet keputusan keliru Meta di bidang infrastruktur AI kini mengungkap masalah budaya organisasi yang mendalam dengan biaya miliaran dolar.
Menurut pengungkapan terbaru dari lembaga riset chip SemiAnalysis, Meta meminta AMD membuat versi custom chip MI450X dengan spesifikasi yang drastis dikurangi—unit komputasi dipotong setengah, jumlah tumpukan memori HBM dari 12 lapis menjadi 8 lapis, dan kapasitas memori menyusut hampir dua pertiga. SemiAnalysis langsung menyebut keputusan ini sebagai ‘katastrofik’ dan secara terbuka menyerukan AMD untuk melewati tim infrastruktur Meta dan langsung bernegosiasi dengan laboratorium super-inteligensi Meta, TBD Lab, agar membeli MI450X versi standar.
Kejadian ini bukanlah kasus tunggal. SemiAnalysis menyoroti, mulai dari akuisisi Rivos senilai lebih dari 2,5 miliar dolar, server custom H100 Grand Teton, hingga skema custom GB200 Ariel, pola keputusan tim infrastruktur Meta menunjukkan ciri khas over-engineering, kurangnya desain kolaboratif perangkat lunak dan perangkat keras, serta prioritas politik jangka pendek yang mengalahkan rasionalitas teknis jangka panjang. "Tim infrastruktur Meta membutuhkan reset budaya," tulis SemiAnalysis.

Chip Terkuat AMD ‘Dipotong’, Performa GenAI Terganggu Parah
AMD MI450X adalah salah satu GPU dengan spesifikasi engineering silikon paling agresif di pasar saat ini: menggunakan proses 2 nanometer, teknologi kemasan hybrid bonding, tumpukan memori HBM4 12 lapis, serta masker CoWoS terbesar di pasar, mewakili puncak kepadatan penyimpanan dan kemasan. 
Namun menurut SemiAnalysis, versi custom yang dipesan Meta akan memangkas luas silikon komputasi setengah, tumpukan HBM dari 12-Hi menjadi 8-Hi, yang berarti dua indikator kunci—daya komputasi dan bandwidth memori—dikompresi sekaligus. Tim infrastruktur Meta beralasan konfigurasi ini ditujukan untuk beban kerja sistem rekomendasi (RecSys), agar rasio komputasi CPU dan GPU meningkat.
Masalahnya, keputusan ini dibuat sebelum TBD Lab didirikan, yang merupakan tim riset inti model AI Meta dan tidak tertarik sama sekali pada chip ini. SemiAnalysis menegaskan, dibandingkan dengan Vera Rubin dari Nvidia, MI450 versi dikurangi tersebut tidak menarik bagi TBD Lab, "TBD lebih condong ke Rubin." Ini berarti volume pengiriman AMD ke Meta akan terdampak serius karena keputusan ini.
SemiAnalysis dalam laporannya secara tidak biasa langsung menyerukan kepada AMD: "AMD harus keluar dan bekerja sama langsung dengan tim TBD, memastikan mereka mendapatkan MI450 versi normal, bukan versi potongan yang tidak berharga untuk GenAI."
Akuisisi Rivos: Lebih dari 2,5 Miliar Dolar Berakhir Kacau
Kasus keliru lain dari tim infrastruktur Meta ialah akuisisi Rivos tahun 2024 senilai lebih dari 2,5 miliar dolar.
Menurut SemiAnalysis, sedikit orang di departemen chip internal Meta benar-benar memahami logika strategis akuisisi ini, dan para pengusung keputusan awal kini memilih diam. Pandangan umum: Meta memiliki banyak dana, trend chip custom semakin panas, dan sebelumnya sudah mengizinkan hak cipta intelektual (IP) Rivos, sehingga manajemen merasa lebih baik memilikinya secara keseluruhan.
Namun, struktur transaksi sudah menanam waktu bom. Tim pendiri Rivos bersikeras seluruh tim dijual sekaligus, Meta terpaksa membeli seluruh perusahaan, lalu memberhentikan banyak bagian yang tidak dibutuhkan. Laporan mengutip mantan staf chip Meta mengatakan, akuisisi dipimpin Yee Jiun Song, kepala chipset Meta, dan menghadapi perlawanan internal, namun setelah transaksi selesai minatnya menurun. Manajer tim chip yang ada memandang insinyur Rivos sebagai "tenaga kerja gratis", masing-masing memasukkan ke tim mereka, membuat struktur tim lama runtuh cepat.
Dari sisi teknis, nilai inti akuisisi—IP GPU arsitektur SIMT milik Rivos—menghilang seiring dibatalkannya proyek chip "Olympus" yang tadinya akan menggunakan teknologi itu. Proyek pengganti "Phoebe" diprediksi paling cepat tape out tahun 2028, tapi SemiAnalysis mengatakan, internal tidak optimistis proyek itu bisa terwujud.
Perpindahan staf juga mengkhawatirkan. Menurut SemiAnalysis, sekitar 30% staf Rivos keluar pada gelombang PHK terakhir, co-founder Mark Hayter telah pergi, dan beberapa mantan staf Rivos setelah RSU pertama diberikan pada Mei tahun ini pindah ke Nuvacore, startup chip milik Gerard Williams. SemiAnalysis juga mengungkap CEO sekaligus co-founder Rivos Puneet Kumar kemungkinan akan keluar dalam satu-dua tahun setelah saham Meta-nya cair.
Grand Teton dan Ariel: Biaya Desain Terulang
Kecenderungan custom berlebihan Meta bukan hal baru. Server custom H100, Grand Teton, menambah satu tray switch di atas server HGX standar, dengan empat Broadcom PCIe switch, 16 SSD, dan delapan NIC untuk memberikan lebih banyak storage langsung ke tiap server, guna menyimpan checkpoint training.
Sayangnya, saat diproduksi, tim model ternyata jauh lebih sedikit menggunakan storage itu, sehingga desain ini akhirnya ditinggalkan. SemiAnalysis menyoroti ini sebagai contoh klasik kurangnya kolaborasi desain antara tim hardware dan software Meta—tim infrastruktur membayar biaya material dan konsumsi daya lebih tinggi untuk fitur yang tidak banyak digunakan, sekaligus menambah ketergantungan pada Broadcom, bertentangan dengan upaya Meta mengurangi ketergantungan pada perangkat jaringan Nvidia.
Pada era Blackwell, skema custom Meta "Ariel" masih menggunakan pola serupa. Spesifikasi standar GB200 ialah setiap CPU Grace dipasangkan dua GPU B200, sementara Ariel mengubahnya menjadi satu CPU satu GPU, jumlah GPU dipotong setengah. Alasannya tetap demi meningkatkan proporsi CPU untuk beban kerja RecSys.

Menurut perhitungan SemiAnalysis, total biaya kepemilikan (TCO) skema Ariel NVL36x2 lebih tinggi 14% daripada GB200 NVL72 standar, dan ekstra CPU serta DRAM justru tidak dibutuhkan oleh tim model AI. Karena memakai koneksi antar-rack untuk menambah jumlah GPU yang dikurangi, muncullah masalah latensi dan keandalan jaringan. Sementara itu, backplane NVL72 yang awalnya dinilai tidak stabil kini semakin matang, dan penilaian Meta akan risiko teknologi ini terbukti salah.
SemiAnalysis mengatakan, server GB300 Meta sudah kembali ke spesifikasi standar—ini merupakan penolakan terhadap skema Ariel.
Akar Budaya: Penilaian Jangka Pendek Mengalahkan Strategi Jangka Panjang
SemiAnalysis menyimpulkan masalah tersebut berasal dari budaya organisasi tim infrastruktur Meta.
Badan ini menyoroti, siklus penilaian kinerja Meta tiap enam bulan selalu mengeliminasi 10%–15% karyawan terbawah, membuat tim lebih mengejar hasil yang cepat terlihat daripada pengembangan teknologi jangka panjang. Sebagian manajer gemar mendorong proyek berdampak tinggi dan cepat selesai, berganti fokus segera setelah selesai; cara ini dikenal internal sebagai ‘window washing’. Selain itu, sangat jarang ada yang menantang keputusan atasannya secara terbuka, sehingga kesalahan susah dikoreksi segera.
Tim rantai pasok punya pengaruh terbatas dalam keputusan engineering, memperparah masalah yang dibahas. SemiAnalysis menyebut, beberapa penyedia telah menurunkan prioritas Meta untuk proyek baru karena perubahan arah yang terlalu sering, dan beralih mengutamakan kebutuhan Amazon atau Google.
SemiAnalysis membandingkan fenomena ini dengan ekspansi Reality Labs milik Meta—sebelum PHK massal, milyaran dolar dialokasikan untuk tim engineering besar dan proyek R&D. Kini, saat Meta mulai menjual kapasitas komputasi ke klien eksternal, harga budaya internal ini akan semakin terlihat langsung di pasar.
Disclaimer: Konten pada artikel ini hanya merefleksikan opini penulis dan tidak mewakili platform ini dengan kapasitas apa pun. Artikel ini tidak dimaksudkan sebagai referensi untuk membuat keputusan investasi.
Kamu mungkin juga menyukai
Masih lebih menguntungkan daripada DRAM, apakah SanDisk benar-benar sebaik itu?

Nvidia investasi 1,5 miliar dolar AS untuk membeli saham SB Energy, mengamankan 8GW daya komputasi AI, OpenAI akan menjadi satu-satunya penyewa
Nvidia sedang memperluas batas persaingan dari GPU dan server ke tanah, listrik, dan konstruksi pusat data AI. Perusahaan bekerja sama dengan SB Energy untuk mengembangkan pusat data AI berskala besar 8GW di Ohio, serta berinvestasi sebesar 1,5 miliar dolar untuk memberikan dukungan kredit dalam pembiayaan infrastruktur. OpenAI menjadi satu-satunya penyewa. Langkah ini menunjukkan bahwa Nvidia tidak hanya sebagai pemasok chip, tetapi juga menjadi pengelola infrastruktur AI dengan mengamankan sumber daya LPS terlebih dahulu untuk menjamin permintaan GPU multi-generasi di masa depan.
Meta (META.US) dan BlackRock (BLK.US) menghadapi "lubang hitam asuransi" pada pusat data senilai 14 miliar dolar AS: hanya 3,2% yang tercakup, pihak pemberi pinjaman bisa menanggung risiko miliaran dolar AS.
Menurut laporan, Meta dan BlackRock menginvestasikan 14 miliar dolar AS untuk membangun pusat data di Texas namun menghadapi risiko asuransi.


