Lewati ke konten utama
SlashJournalSlashJournal
Beranda
SeriGlosariumTentangKontak
SlashJournalSlashJournal

Catatan produksi tentang sistem terdistribusi, rekayasa antarmuka, dan keputusan teknis yang layak dipahami.

Baca

TulisanSeriGlosariumTentang

Dukungan & legal

KontakDaftar menjadi penulisPrivasiKetentuanCookie
© 2026 SlashJournalRSS feed
Beranda/Kecerdasan Buatan & Opini Tech/Berita & Rumor Tech/Otak di Balik Grok 4.5 Cabut! xAI Kehilangan Pakar Reinforcement Learning
Kecerdasan Buatan & Opini TechSeri: Berita & Rumor Tech · Bagian 54

Otak di Balik Grok 4.5 Cabut! xAI Kehilangan Pakar Reinforcement Learning

xAI (atau SpaceXAI) baru aja ditinggal oleh peneliti intinya, Dinghuai Zhang. Zhang adalah sosok krusial yang ngurusin kestabilan Reinforcement Learning (RL) dan Scaling skala masif buat Grok 4.5. Dia ngebongkar budaya kerja xAI yang intens, penuh war room larut malam buat debug sistem yang hancur.

C

Choirul Humam

Penulis & Arsitek

30 Agustus 20262 mnt baca
Otak di Balik Grok 4.5 Cabut! xAI Kehilangan Pakar Reinforcement Learning

Sumber visual:

Dokumentasi / Foto Sendiri

xAI (atau SpaceXAI) baru saja kehilangan seorang peneliti kunci. Dinghuai Zhang telah resmi meninggalkan perusahaan tersebut.

Zhang memiliki latar belakang akademis yang kuat di bidang model generatif, metode probabilistik, dan Reinforcement Learning (RL). Rekam jejaknya sangat mengesankan: Gelar Sarjana Sains (B.Sc.) di bidang Matematika dari Universitas Peking. Menempuh studi doktoral (PhD) di Mila di bawah bimbingan Yoshua Bengio. Memiliki pengalaman kerja di Apple MLR dan Meta FAIR.

Sebelum bergabung dengan xAI, ia menjabat sebagai Peneliti Senior di Microsoft Research New England.

Tantangan Ekstrem bagi xAI

Di xAI, fokus utama Zhang adalah pada stabilitas RL, efisiensi penskalaan, dan pelaksanaan "eksekusi besar-besaran" (big runs) khususnya untuk pemrograman RL berskala masif. Tugas ini sangat menantang karena melibatkan peningkatan kemampuan pemrograman, penalaran, dan agen AI melalui RL setelah tahap pra-pelatihan (pre-training).

Ruang Kemitraan SlashJournal

Dalam perlombaan pengembangan model mutakhir (frontier model) saat ini, bagian tersulitnya adalah mencegah kegagalan sistem yang melibatkan ratusan ribu GPU setelah berhari-hari atau berminggu-minggu beroperasi, serta menghindari penurunan kualitas pelatihan secara tiba-tiba. Grok 4.5 diluncurkan dengan kemampuan pemrograman dan agen yang canggih (terdepan di kelasnya), dan Zhang adalah sosok yang memimpin pelaksanaan proses berskala besar tersebut, dengan menerapkan perubahan algoritmik untuk memastikan stabilitas RL.

Catatan Arsitektur

Penelitian Self-Evolving (Berkembang Mandiri): Tahun lalu, Zhang juga berpartisipasi dalam penelitian mengenai "Self-Evolving Curriculum" (Kurikulum yang Berkembang Mandiri), sebuah eksplorasi tentang bagaimana model besar dapat menyesuaikan kurikulumnya sendiri secara dinamis selama proses RL untuk meningkatkan kemampuan matematika, penalaran, dan perencanaan.

Budaya "War Room" yang Intens Zhang menyebut tahun lalu sebagai "periode yang sangat intens." Ia menggambarkan budaya kerja timnya: bergerak dengan kecepatan tinggi, langsung turun tangan saat terjadi kerusakan, dan menjalani sesi debugging hingga larut malam di sebuah "war room" tempat tim bekerja bersama sampai sistem kembali beroperasi normal.

Diagram Arsitektur (Mermaid)
Merender diagram arsitektur...

Zhang belum mengungkapkan ke mana ia akan melangkah selanjutnya, namun kemungkinan besar ia akan mengambil jeda sejenak untuk saat ini.

Kata Kunci:#dinghuai zhang xai#grok 4.5 rl#reinforcement learning stability#spacexai resign#ai war room#coding rl bigrun

Sumber

  1. [1]X @Dinghuangzhang
Ruang Kemitraan SlashJournal

Apresiasi & Reaksi Pembaca

Klik untuk memberikan apresiasi
Bab SebelumnyaIroni Media: AI OpenAI Sukses Nge-Hack Hugging Face, Jurnalis Malah Sibuk Ngurusin Makan Malam Sam Altman!

Catatan Mingguan

Bawa naskah baru ke inbox Anda.

Satu email berkala saat naskah baru terbit. Tanpa spam, tanpa promosi kosong.

Fokus minat:

Diskusi & Catatan Teknis (0)

Login diperlukan
Masuk untuk mengirim catatan arsitektur
Markdown format didukung
Kasir AI. Tanpa Langganan.

Daftar Isi

Tantangan Ekstrem bagi xAI
C

Choirul Humam

Penulis & Arsitek

Menulis panduan arsitektur perangkat lunak dengan fokus pada keandalan sistem dan kesederhanaan desain.

Profil Lengkap →

Indeks bacaan

Eksplorasi berikutnya

Lanjutkan dari konteks tulisan ini, pembahasan terbaru, atau naskah yang paling banyak dibaca.

Rekomendasi

  1. Kecerdasan Buatan & Opini TechIroni Media: AI OpenAI Sukses Nge-Hack Hugging Face, Jurnalis Malah Sibuk Ngurusin Makan Malam Sam Altman!30 Agustus 2026
  2. Kecerdasan Buatan & Keamanan SiberOpenAI Rem Darurat! AI "Astra" Kabur dari Sandbox dan Hack Hugging Face30 Agustus 2026
  3. Pemrograman & Strategi BisnisDrama OpenAI vs Cursor: Akses Diputus Gara-Gara Elon Musk, Sam Altman Kena PTSD?30 Agustus 2026

Sedang trending

  1. Kecerdasan Buatan & KeamananMembongkar Rahasia Watermark Claude: Bagaimana Anthropic Menyisipkan Jejak Gaib di Teks AI?25 Agustus 2026
  2. Keamanan Siber & Industri GamePetaka Data Rockstar: Hacker Bobol GTA VI Demi Protes "Kiamat Kaset Fisik"24 Agustus 2026
  3. Hardware & AI InfrastructureApple Menggila! Mac Studio M5 Ultra Tembus 512GB RAM, Solusi "Ternak" LLM Lokal25 Agustus 2026

Terpopuler

  1. 01Strategi Bisnis & AISejarah Baru: Model AI Terkuat Anthropic (Fable 5) Mulai Ditinggalkan Perusahaan. Kenapa?24 Agustus 2026
  2. 02Strategi Bisnis & AIElon Musk Ngaku Kalah dari Anthropic, Langsung "Bakar" $60 Miliar Buat Beli Cursor!25 Agustus 2026
  3. 03Karir & Industri TechAndrew Ng Peringatkan Developer: Ngoding Pakai AI Tanpa Paham "Fundamental" Itu Bahaya!30 Agustus 2026