Lewati ke konten utama
SlashJournalSlashJournal
Beranda
SeriGlosariumTentangKontak
SlashJournalSlashJournal

Catatan produksi tentang sistem terdistribusi, rekayasa antarmuka, dan keputusan teknis yang layak dipahami.

Baca

TulisanSeriGlosariumTentang

Dukungan & legal

KontakDaftar menjadi penulisPrivasiKetentuanCookie
© 2026 SlashJournalRSS feed

Topik

#reinforcement learning stability

1 tulisan

Tulisan yang membahas istilah dan persoalan terkait.

Otak di Balik Grok 4.5 Cabut! xAI Kehilangan Pakar Reinforcement Learning
Kecerdasan Buatan & Opini Tech·30 Agustus 2026·2 mnt baca

Otak di Balik Grok 4.5 Cabut! xAI Kehilangan Pakar Reinforcement Learning

xAI (atau SpaceXAI) baru aja ditinggal oleh peneliti intinya, Dinghuai Zhang. Zhang adalah sosok krusial yang ngurusin kestabilan Reinforcement Learning (RL) dan Scaling skala masif buat Grok 4.5. Dia ngebongkar budaya kerja xAI yang intens, penuh war room larut malam buat debug sistem yang hancur.