Lewati ke konten utama
SlashJournalSlashJournal
Beranda
SeriGlosariumTentangKontak
SlashJournalSlashJournal

Catatan produksi tentang sistem terdistribusi, rekayasa antarmuka, dan keputusan teknis yang layak dipahami.

Baca

TulisanSeriGlosariumTentang

Dukungan & legal

KontakDaftar menjadi penulisPrivasiKetentuanCookie
© 2026 SlashJournalRSS feed
Beranda/Kecerdasan Buatan/Analisis Industri Tech/Alibaba Menggila! Bocorkan Arsitektur Qwen4 Lewat Rilis Qwen3.8-Flash-Next
Kecerdasan BuatanSeri: Analisis Industri Tech · Bagian 24

Alibaba Menggila! Bocorkan Arsitektur Qwen4 Lewat Rilis Qwen3.8-Flash-Next

Belum sebulan rilis model 2,4 Triliun parameter, Alibaba udah ngegas lagi. Mereka merilis Qwen3.8-Flash-Next sebagai "bocoran" arsitektur Qwen4 (MoE Multimodal) biar komunitas developer bisa nyicil persiapan sebelum model rajanya beneran rilis!

C

Choirul Humam

Penulis & Arsitek

25 Agustus 20264 mnt baca12 pembaca
Alibaba Menggila! Bocorkan Arsitektur Qwen4 Lewat Rilis Qwen3.8-Flash-Next

Sumber visual: Dokumentasi / Foto Sendiri

Gila, ritme kerja tim engineer di Alibaba bener-bener di luar nalar. Agustus 2026 ini belum juga kelar, tapi mereka udah ngerilis lini model AI yang bikin kompetitor lain kelihatan kayak lagi jalan santai.

Awal bulan, mereka nge- drop Qwen3.8-Max (monster 2,4 Triliun parameter). Dua minggu kemudian, versi open-weight-nya dilepas. Selang beberapa hari, versi Apache-2.0 gratisannya rilis. Dan malam ini, 26 Agustus 2026 pukul 23:00 waktu Beijing, mereka siap menekan tombol deploy untuk sebuah model yang sebenarnya adalah "kuda troya": Qwen3.8-Flash-Next.

Kenapa saya bilang kuda troya? Karena Alibaba terang-terangan ngaku kalau model ini hanyalah Technology Preview. Mereka sengaja membocorkan arsitektur generasi terbaru (Qwen4) lebih awal, jauh sebelum model flagship-nya sendiri punya nama!

Taktik Genius: "Nih Otaknya, Bikin Dulu Infrastrukturnya!"

Strategi Alibaba ini sebenarnya murni marketing yang dibalut komitmen teknis.

Mereka tahu, tiap kali ada model arsitektur baru, komunitas developer (pembuat runtime, quantization kayak GGUF/AWQ, sampai platform deployment) butuh waktu berminggu-minggu buat nyesuaiin codebase mereka. Daripada ngerilis flagship Qwen4 tapi ekosistemnya belum siap, mending lempar dulu arsitekturnya sekarang lewat Qwen3.8-Flash-Next.

Kalau kita bedah jeroannya, ada dua pilar utama penyangga Qwen4 yang dipamerkan di sini:

Fitur ArsitekturPenjelasan SederhanaDampak ke Developer
GDN (Gated Delta Network)Pengganti arsitektur Transformer biasa. Pakai sistem linear-attention di mana cache memori nggak bakal membengkak meski teks yang dimasukkan panjang banget.Context window raksasa (sampai jutaan token) bakal jauh lebih murah dan ringan diproses di RAM/VRAM.
QSA (Qwen Sparse Attention)Mekanisme Attention baru yang masih dirahasiakan detail teknisnya.(Masih Menunggu) Biasanya bikin retrieval data spesifik jadi lebih tajam tanpa ngabisin memori.
Developer examining architecture

Cara Menyikapi Model "Prematur"

Namanya juga versi preview, Qwen3.8-Flash-Next ini datang dengan banyak tanda tanya. Rumor di Reddit sih bilang ukurannya sekitar 125B (Total) / 6B (Aktif) parameter MoE (Mixture of Experts). Tapi, sampai lisensinya beneran rilis, kita belum tahu apakah ini boleh dipakai komersial atau cuma buat bahan riset.

Sebagai developer, jangan buru-buru me-replace API Production kamu pakai model ini. Trik amannya adalah menggunakan pola A/B Testing Routing.

Daripada nekat, mending belokkan 10% traffic request aplikasi kamu ke model baru ini untuk ngetes seberapa pintar dia nulis kode atau ngerjain tugas agentic, sementara 90% sisanya tetap jalan di model stabil lama.

1
2
3
4
5
6
7
8
9
10
11
12
13
14
15
16
17
18
19
20
21
22
23
24
25
26
import { AIProvider } from "your-ai-router-sdk";
 
async function generateAgentResponse(prompt) {
// Lempar dadu, 10% peluang pakai model eksperimental Qwen4 Preview
const useNextGen = Math.random() < 0.1;
if (useNextGen) {
try {
console.log("Routing ke Qwen3.8-Flash-Next (Arsitektur Qwen4)...");
return await AIProvider.chat({
model: "qwen/qwen3.8-flash-next",
messages: prompt,
timeout: 5000 // Pasang fallback ketat kalau servernya ngelag
});
} catch (e) {
console.warn("Model Preview Gagal, Fallback ke Stable!");
}
}
 
// 90% traffic (atau fallback) pakai model andalan lama
console.log("Routing ke Qwen3.8-Max (Stable)...");
return await AIProvider.chat({
model: "qwen/qwen3.8-max",
messages: prompt
});
}
NODE.JS • 26 barisGunakan Shift+Scroll untuk scroll horizontal
Diagram Arsitektur (Mermaid)
Merender diagram arsitektur...
Tips Kinerja & Best Practice

Patokan Harga: Saat ini, Qwen3.8-Max mematok harga API sekitar $2.00 per juta token input dan $6.00 per juta token output. Pantau terus harga Qwen3.8-Flash-Next nanti malam; itu adalah standar harga baru yang harus bisa mereka tekan untuk generasi selanjutnya.

Malam ini, jam 23:00 WIB (sama dengan waktu Beijing), mata seluruh pelaku industri AI akan tertuju ke ModelScope. Apakah klaim multimodal dan kemampuan koding agentic-nya beneran jago, atau ini sekadar "nge-gass" demi pamer ke investor?

Satu hal yang pasti, keputusan Alibaba ngelepas arsitektur sedini ini adalah langkah 'gigachad' yang bikin pesaing mereka ketar-ketir. Kamu sendiri, bakal begadang buat ngetes weights-nya nanti malam nggak?

Kata Kunci:#qwen4 architecture#qwen3.8-flash-next#alibaba ai model#gated delta network#qwen sparse attention#ai open weights,#moe multimodal ai

Apresiasi & Reaksi Pembaca

Klik untuk memberikan apresiasi
Bab SebelumnyaMembongkar Rahasia Watermark Claude: Bagaimana Anthropic Menyisipkan Jejak Gaib di Teks AI?Bab SelanjutnyaValuasi "Halu" Anthropic: Mau IPO $2 Triliun Berbekal Mimpi Gantikan Semua Pekerjaan Manusia

Catatan Mingguan

Bawa naskah baru ke inbox Anda.

Satu email berkala saat naskah baru terbit. Tanpa spam, tanpa promosi kosong.

Fokus minat:

Diskusi & Catatan Teknis (0)

Login diperlukan
Masuk untuk mengirim catatan arsitektur
Markdown format didukung

Daftar Isi

Taktik Genius: "Nih Otaknya, Bikin Dulu Infrastrukturnya!"Cara Menyikapi Model "Prematur"
C

Choirul Humam

Penulis & Arsitek

Menulis panduan arsitektur perangkat lunak dengan fokus pada keandalan sistem dan kesederhanaan desain.

Profil Lengkap →
Ruang iklan manual SlashJournal
Pasang Iklan Terkurasi

Indeks bacaan

Eksplorasi berikutnya

Lanjutkan dari konteks tulisan ini, pembahasan terbaru, atau naskah yang paling banyak dibaca.

Rekomendasi

  1. Strategi Bisnis & AIValuasi "Halu" Anthropic: Mau IPO $2 Triliun Berbekal Mimpi Gantikan Semua Pekerjaan Manusia26 Agustus 2026
  2. Kecerdasan Buatan & KeamananMembongkar Rahasia Watermark Claude: Bagaimana Anthropic Menyisipkan Jejak Gaib di Teks AI?25 Agustus 2026
  3. Strategi Bisnis & AISejarah Baru: Model AI Terkuat Anthropic (Fable 5) Mulai Ditinggalkan Perusahaan. Kenapa?24 Agustus 2026

Sedang trending

  1. Keamanan Siber & Industri GamePetaka Data Rockstar: Hacker Bobol GTA VI Demi Protes "Kiamat Kaset Fisik"149 pembaca
  2. Hardware & AI InfrastructureApple Menggila! Mac Studio M5 Ultra Tembus 512GB RAM, Solusi "Ternak" LLM Lokal49 pembaca
  3. Strategi Bisnis & AIElon Musk Ngaku Kalah dari Anthropic, Langsung "Bakar" $60 Miliar Buat Beli Cursor!34 pembaca

Terpopuler

  1. 01Kecerdasan BuatanMisteri Ox Alpha: Model AI 'Gratis' Super Canggih yang Muncul Tiba-tiba. Siapa Pembuatnya?26 pembaca
  2. 02Keamanan Siber & AIAwas RCE! Celah Kritis Skor 9.8 Ditemukan di DeepSeek Harness (DSH)25 pembaca
  3. 03Hardware & AI InfrastructurePerplexity Rilis "Portable Computer": Agen AI Lokal Anti-Ngelag, Bebas Tagihan Token API!20 pembaca
#
qwen api