SinyalAI
Model & Rilis

Empat Model Frontier Meluncur dalam 72 Jam: Rekap September 2026

Anthropic, Google, Meta, dan OpenAI melepas model baru dalam tiga hari pertama September. Ini rekap lengkapnya — plus tren arsitektur yang diam-diam lebih penting dari semua peluncuran itu.

Tiga hari yang padat

September 2026 dibuka dengan cara yang belum pernah terjadi: empat model frontier meluncur dalam 72 jam. Bagi Anda yang tidak mengikuti setiap pengumuman, ini rekap yang sudah disaring.

TanggalLabModelCatatan utama
| 1
| 2
| 2
| 2
| 3
| 3

Enam hari, tujuh rilis besar. Dan itu belum menghitung Z.ai GLM-5.3, Tencent Hy4, dan DeepSeek V4-Pro dari akhir Agustus.

Yang paling relevan untuk dompet Anda: perang harga

Ini bagian yang paling berdampak praktis, dan paling sedikit diberitakan.

Anthropic membatalkan kenaikan harga. Sonnet 5 seharusnya naik dari $2/$10 menjadi $3/$15 pada 1 September. Pada 11 Agustus, kenaikan itu dibatalkan permanen. Lalu pada 1 September, harga cache read Fable 5.1 dipotong 75% — dari $1,00 menjadi $0,25 per juta token. Penghematan efektifnya sekitar 25% untuk pemakaian khas, dan sampai 45% untuk workload agentik yang banyak membaca konteks berulang.

Google memakai harga perkenalan — dan ada tanggal kedaluwarsanya. Gemini 3.8 Flash diluncurkan di $0,75 input / $3,75 output per juta token (token thinking sudah termasuk), berlaku sampai 31 Desember 2026. Mulai 1 Januari 2027, harganya naik dua kali lipat menjadi $1,50/$7,50, dan tier caching ikut naik dari $0,075 ke $0,15.

⚠️ Peringatan anggaran: kalau Anda membangun produk di atas harga perkenalan Gemini 3.8 Flash, model keuangan Anda untuk 2027 salah sebesar 2×. Hitung ulang sekarang, atau siapkan rute trafik volume tinggi ke model lain sebelum Januari.

OpenAI justru memotong lebih dulu. Pada 30 Juli, GPT-5.6 Luna dipangkas 80% (dari $1/$6 menjadi $0,20/$1,20) dan Terra turun 20% menjadi $2/$12. Akibatnya lucu: GPT-5.4 sekarang lebih mahal daripada penerusnya sendiri.

Yang melawan arus: DeepSeek. Pada 13 Agustus, V4-Pro-0813 menaikkan harga hingga 14 kali lipat menjadi $1,32/$3,96 — padahal semua orang sedang memotong. Tetap saja, angka itu masih sekitar 7× lebih murah daripada pesaing Barat.

Promo yang akan berakhir: Z.ai GLM-5.3-Flash diskon 50% menjadi $0,075/$0,25, berakhir 9 September 2026 pukul 24:00 UTC+8. Kalau Anda sempat mempertimbangkannya, waktunya tinggal hitungan jam.

Lima tren arsitektur yang lebih penting dari semua peluncuran

Peluncuran datang dan pergi. Lima pola ini yang akan menentukan bentuk stack AI tahun depan.

1. Model berkemampuan siber dengan akses bertingkat. Tiga dari empat langkah frontier bulan ini mengirim model umum bersamaan dengan varian keamanan yang digembok: Anthropic Mythos 5.1 (bobot identik dengan Fable 5.1, pengaman dilepas untuk defender yang terseleksi), Google Gemini 3.8 Flash Cyber (mitigasi siber dilonggarkan, akses lewat program Fairwind, mencetak 47,2% pass@1 di CWE-Bench), dan OpenAI Astra. Ini sekarang pola industri, bukan kebetulan.

2. Post-training scaling. Kenaikan kemampuan tidak lagi datang dari model basis baru, melainkan dari lingkungan reinforcement learning. GLM-5.3 adalah contoh paling bersih: arsitekturnya tidak berubah drastis, lingkungannya yang diperkaya.

3. MoE dengan sparsity ekstrem. Qwen3.8 mengaktifkan hanya sekitar 3–10% parameter — 2,4 triliun total, 95 miliar aktif. Tencent Hy4 serupa: 770 miliar total, 49 miliar aktif. Konsekuensinya, angka "jumlah parameter" makin tidak berguna sebagai perbandingan.

4. Linear & hybrid attention. Qwen3.8-27B memakai Gated DeltaNet untuk penskalaan konteks O(n). Ini serangan langsung terhadap biaya kuadratik attention yang selama ini membatasi panjang konteks.

5. Diffusion decoding. Mercury 2 mencapai 1.009 token per detik. Kalau decoding difusi matang, asumsi "AI itu lambat" gugur total — dan itu mengubah desain produk secara mendasar.

Yang bocor dan akan datang

  • Gemini 4 Pro: checkpoint internal pertama sudah dirilis. Rilis publik diperkirakan Oktober 2026.
  • September ini juga: Gemini 4 Flash-Lite dan NB2Lite (Nano Banana 2 Lite) diperbarui.
  • 29 September 2026: OpenAI DevDay di San Francisco — agenda utamanya perluasan rilis Astra dan evaluasi keselamatan lanjutan.

Cara menyikapi semua ini

Jangan mencoba mengikuti semuanya. Pilih berdasarkan tiga pertanyaan:

  1. Apakah harga efektifnya turun untuk pola pemakaian saya? (Anthropic ya, kalau Anda agentik. Google ya, tapi hanya sampai Desember.)
  2. Apakah kemampuannya menyelesaikan tugas yang selama ini gagal? (Computer use → Astra. Vulnerability discovery → varian Cyber, kalau Anda lolos seleksi.)
  3. Apakah ada risiko terkunci harga yang akan berubah? (Gemini 3.8 Flash ya, Januari 2027.)

Kalau ketiganya "tidak", tetap di model yang sudah Anda kuasai. Biaya berpindah — menulis ulang prompt, menguji ulang, melatih ulang tim — hampir selalu lebih mahal daripada selisih harga API.

#Claude Fable 5.1#Gemini 3.8 Flash#Muse Spark 1.3#Qwen3.8#Harga API

Kontak redaksi

Koreksi fakta, usulan topik, atau rilis yang layak kami liput? Kirim ke alamat di samping. Setiap koreksi kami publikasikan beserta tanggal perbaikannya.