Lewati ke konten utama
SlashJournalSlashJournal
Beranda
SeriGlosariumTentangKontak
SlashJournalSlashJournal

Catatan produksi tentang sistem terdistribusi, rekayasa antarmuka, dan keputusan teknis yang layak dipahami.

Baca

TulisanSeriGlosariumTentang

Dukungan & legal

KontakDaftar menjadi penulisPrivasiKetentuanCookie
© 2026 SlashJournalRSS feed
Beranda/Kecerdasan Buatan & Pemrograman/Analisis Industri Tech/Ox-Alpha Buka Topeng! Resmi Rilis Sebagai GLM-5.3-Flash dengan Harga "Merusak Pasar"
Kecerdasan Buatan & PemrogramanSeri: Analisis Industri Tech · Bagian 31

Ox-Alpha Buka Topeng! Resmi Rilis Sebagai GLM-5.3-Flash dengan Harga "Merusak Pasar"

Ingat monster siluman Ox-Alpha yang viral kemarin? Zhipu (Z.AI) resmi mengonfirmasi bahwa itu adalah GLM-5.3-Flash! Model ini punya kemampuan koding setara Claude Opus 4.8, tapi harganya cuma 1/40-nya. Yang paling gila: jutaan token itu diproses pakai chip lokal buatan Tiongkok, bukan NVIDIA!

C

Choirul Humam

Penulis & Arsitek

26 Agustus 20264 mnt baca9 pembaca
Ox-Alpha Buka Topeng! Resmi Rilis Sebagai GLM-5.3-Flash dengan Harga "Merusak Pasar"

Sumber visual: zhipu media

Misteri monster siluman yang bikin heboh OpenCode beberapa hari terakhir akhirnya terpecahkan. Zhipu (Z.AI) resmi melepas topeng "Ox-Alpha" dan memperkenalkannya kepada dunia sebagai GLM-5.3-Flash.

Kalau kemarin kita masih menerka-nerka seberapa buas model ini, data rilis resminya justru bikin kita, para developer, makin mindblown. Ini bukan sekadar model pintar biasa, melainkan deklarasi perang harga (price war) paling brutal yang pernah terjadi di industri Large Language Model (LLM).

Banting Harga: DeepSeek V4 Kelihatan Mahal

Dulu, DeepSeek V4-Flash adalah dewa penolong buat startup kere yang butuh API murah. Tapi dengan rilisnya GLM-5.3-Flash, harga DeepSeek mendadak terasa mencekik.

Zhipu mematok harga API mereka di angka yang sangat nggak masuk akal: 0.4 Yuan (sekitar Rp 900) per juta token Input dan 1.4 Yuan (Rp 3.100) per juta token Output.

Mari kita simulasikan penderitaan dompet developer saat menjalankan Agent AI yang rakus prompt (misal: baca log error panjang, nulis ulang code):

1
2
3
4
- Input: 3 Yuan / 1 Juta Token
- Output: 9 Yuan / 1 Juta Token
// Skenario Agent memproses 4 Juta Input + 1 Juta Output:
Total Biaya = (4 * 3) + (1 * 9) = 21 Yuan (Sekitar Rp 46.000 per task)
DEEPSEEK V4-FLASH • 4 barisGunakan Shift+Scroll untuk scroll horizontal

Dengan budget yang sama, lu bisa ngejalanin Agent GLM hampir 7 kali lipat lebih sering dibanding DeepSeek. Bahkan Zhipu ngeklaim kalau kemampuan coding-nya nyaris setara dengan Claude Opus 4.8, tapi dengan harga cuma seperempat puluh (1/40) dari mahakarya Anthropic tersebut!

Rahasia Dapur: Arsitektur Cerdas & Chip Lokal

Ox-Alpha Buka Topeng! Resmi Rilis Sebagai GLM-5.3-Flash dengan Harga "Merusak Pasar"
Zhipu Arsitektur Glm 5.3 Flash

Sumber: Zhipu Media

Kemarin kita sempet berasumsi kalau hype 42 Triliun token Ox-Alpha ini dibayarin sama daya komputasi NVIDIA. Ternyata, kita salah besar.

Zhipu dengan bangga ngasih tahu fakta yang paling menakutkan bagi dominasi teknologi AS: Seluruh lalu lintas masif Ox-Alpha kemarin 100% berjalan di atas chip AI buatan dalam negeri (Tiongkok).

Kok bisa chip lokal yang konon teknologinya tertinggal itu ngangkat model 320 Miliar Parameter? Kuncinya ada di optimasi arsitektur brutal:

Komponen OptimasiPenjelasan SederhanaDampak ke Performa
Hybrid AttentionGabungan Linear (buat state modeling) dan Sparse Attention (buat indeks global).Beban compute turun 3x lipat, irit memori untuk Context Window 1 Juta Token.
IndexPoolMemadatkan vektor key biar nggak rakus RAM/VRAM.Ukuran KV Cache turun drastis hingga 4,4x lipat dibanding GLM-5.3 biasa.
Engine KhususMesin inferensi khusus chip lokal hasil optimasi berbasis SGLang (W8A8, Layer Split).Biaya per-token dan kecepatannya akhirnya setara GPU NVIDIA mainstream.

Multimodal Sejati buat Frontend Dev

GLM-5.3-Flash bukan cuma pinter ngoding teks. Ini adalah model multimodal sejati pertama di seri GLM-5.

Artinya, dia bisa bertindak sebagai Visual Coder. Lu nggak perlu lagi nerjemahin masalah bug CSS jadi teks panjang lebar. Kasih aja screenshot UI lu yang berantakan, atau hasil render game 3D lu yang glitch, dan biarkan model ini mengoreksinya sendiri. Zhipu mendesain model ini untuk punya "Self-Visual Judgment", jadi AI-nya bisa ngerjain tugas frontend layaknya manusia yang ngelihat hasil kerjanya di browser.

Tips Kinerja & Best Practice

Rilis Malam Ini: Buat lu yang nggak sabar, Zhipu sudah merilis bobot model (weights) GLM-5.3-Flash secara publik di HuggingFace. Untuk deployment lokal, lu bisa langsung pakai framework andalan kayak vLLM atau SGLang.

Perang AI sekarang udah nggak sekadar pamer skor Benchmark. Fokus utamanya udah beralih ke: Siapa yang bisa ngasih otak paling pinter dengan harga nyaris semurah biaya listrik?

Kalau performa coding-nya beneran se-ngeri Claude Opus 4.8, kayaknya bulan depan tagihan AWS/Anthropic kita bakal dipotong habis-habisan, nih. Lu siap pindah haluan ke open-source ini?

Kata Kunci:#deepseek v4 flash#glm 5.3 flash#ox alpha zhipu ai#harga api ai murah#claude opus 4.8#chip ai china#open source ai model

Apresiasi & Reaksi Pembaca

Klik untuk memberikan apresiasi
Bab SebelumnyaValuasi "Halu" Anthropic: Mau IPO $2 Triliun Berbekal Mimpi Gantikan Semua Pekerjaan Manusia

Catatan Mingguan

Bawa naskah baru ke inbox Anda.

Satu email berkala saat naskah baru terbit. Tanpa spam, tanpa promosi kosong.

Fokus minat:

Diskusi & Catatan Teknis (0)

Login diperlukan
Masuk untuk mengirim catatan arsitektur
Markdown format didukung

Daftar Isi

Banting Harga: DeepSeek V4 Kelihatan MahalRahasia Dapur: Arsitektur Cerdas & Chip LokalMultimodal Sejati buat Frontend Dev
C

Choirul Humam

Penulis & Arsitek

Menulis panduan arsitektur perangkat lunak dengan fokus pada keandalan sistem dan kesederhanaan desain.

Profil Lengkap →
Ruang iklan manual SlashJournal
Pasang Iklan Terkurasi

Indeks bacaan

Eksplorasi berikutnya

Lanjutkan dari konteks tulisan ini, pembahasan terbaru, atau naskah yang paling banyak dibaca.

Rekomendasi

  1. Strategi Bisnis & AIValuasi "Halu" Anthropic: Mau IPO $2 Triliun Berbekal Mimpi Gantikan Semua Pekerjaan Manusia26 Agustus 2026
  2. Kecerdasan BuatanAlibaba Menggila! Bocorkan Arsitektur Qwen4 Lewat Rilis Qwen3.8-Flash-Next25 Agustus 2026
  3. Kecerdasan Buatan & KeamananMembongkar Rahasia Watermark Claude: Bagaimana Anthropic Menyisipkan Jejak Gaib di Teks AI?25 Agustus 2026

Sedang trending

  1. Keamanan Siber & Industri GamePetaka Data Rockstar: Hacker Bobol GTA VI Demi Protes "Kiamat Kaset Fisik"149 pembaca
  2. Hardware & AI InfrastructureApple Menggila! Mac Studio M5 Ultra Tembus 512GB RAM, Solusi "Ternak" LLM Lokal68 pembaca
  3. Strategi Bisnis & AISejarah Baru: Model AI Terkuat Anthropic (Fable 5) Mulai Ditinggalkan Perusahaan. Kenapa?66 pembaca

Terpopuler

  1. 01Strategi Bisnis & AIElon Musk Ngaku Kalah dari Anthropic, Langsung "Bakar" $60 Miliar Buat Beli Cursor!41 pembaca
  2. 02Kecerdasan BuatanMisteri Ox Alpha: Model AI 'Gratis' Super Canggih yang Muncul Tiba-tiba. Siapa Pembuatnya?26 pembaca
  3. 03Keamanan Siber & AIAwas RCE! Celah Kritis Skor 9.8 Ditemukan di DeepSeek Harness (DSH)25 pembaca
#
linear attention