Lima model AI dalam sepuluh hari September 2026
September 2026 menjadi bulan paling padat untuk pelancaran model AI. Ini ringkasan apa yang keluar, berapa harganya, dan angka mana yang benar-benar penting untuk pengguna biasa dan pembangun kecil.
Ada bulan yang berlalu tanpa berita besar. September 2026 bukan salah satunya. Dalam tempoh sepuluh hari sahaja, lima model peringkat hadapan dilancarkan oleh lima syarikat berbeza, dan pada masa yang sama berlaku penurunan harga, pembatalan promosi serta perubahan pada syarat keselamatan. Bagi pengguna biasa, semua ini kedengaran jauh. Hakikatnya ia menentukan berapa yang anda bayar tidak lama lagi, dan jenis kerja apa yang boleh diamanahkan kepada mesin.
Lima pelancaran dalam sepuluh hari
- 1 September 2026 — Anthropic mengeluarkan Claude Fable 5.1 dan pasangannya Mythos 5.1. Kedua-duanya menggunakan berat model yang sama, tetapi berbeza pada syarat keselamatan: Fable 5.1 tersedia untuk semua, Mythos 5.1 kekal di belakang program pengesahan.
- 1 hingga 3 September 2026 — OpenAI mengumumkan GPT-6 Astra pada 1 September dan melepaskannya pada 3 September, memulakan generasi GPT-6. Syarikat itu memanggilnya model paling pintar dan paling sejajar yang pernah ia keluarkan.
- 2 September 2026 — Google DeepMind mengeluarkan Gemini 3.8 Flash, model Flash ketiga dalam tempoh tiga minggu, dengan konteks sehingga 1 juta token.
- 2 September 2026 — Meta mengeluarkan Muse Spark 1.3, yang kemudian menjadi model paling murah dalam kelompok hadapan pada kadar sekitar AS$0.10 bagi setiap juta token.
- 10 September 2026 — DeepSeek menutup pusingan dengan V4.1-Flash, model terbuka berlesen MIT berukuran 552 bilion parameter, dengan 8 bilion parameter aktif semasa fasa prabacaan dan 16 bilion semasa penjanaan. Saiz cache memori utamanya dipotong kepada seperempat berbanding versi sebelumnya.
Harga kini lebih penting daripada keupayaan
Inilah bahagian yang paling mudah terlepas pandang. Menurut pemantauan harga yang dikumpulkan ThursdAI, jurang kecerdasan antara model terbaik mengecil kepada lingkungan 1.6 mata pada indeks penilaian, sementara jurang harga melebar luas: Fable 5.1 pada AS$11.90 bagi setiap juta token, manakala Muse Spark 1.3 pada kadar biasa AS$1.25 input dan AS$4.25 output. Angka AS$0.10 yang sering dipetik itu bukan kadar biasa — ia kadar "Contributor", dan syaratnya adalah gesaan serta jawapan anda masuk ke dalam saluran latihan Meta. Angka murah yang tidak disebut syaratnya itu bukan angka yang semua orang dapat. Apabila kualiti hampir sama, keputusan yang menentukan kos bukan lagi soalan model mana yang terbaik, tetapi model mana yang cukup baik untuk kerja tertentu.
Dua kejadian bulan ini menunjukkan mengapa tarikh dalam senarai harga perlu dicatat. Anthropic memotong kos bacaan cache sebanyak 75 peratus, daripada AS$1.00 kepada AS$0.25 bagi setiap juta token, pada 1 September 2026 — penjimatan terbesar bulan itu bagi kerja yang berulang. Sebaliknya, Google menetapkan kadar promosi Gemini 3.8 Flash pada AS$0.75 untuk input dan AS$3.75 untuk output, dan kadar itu berakhir pada 31 Disember 2026 sebelum berganda. Ada juga promosi yang benar-benar tamat bulan ini: diskaun GLM-5.3-Flash berakhir pada 9 September 2026.
Angka yang jarang disebut: lapisan keselamatan
Semakin kuat sesebuah model, semakin besar juga keupayaannya dalam bidang berbahaya. Empat daripada lima pelancaran bulan itu membawa tahap keupayaan siber dengan akses terhad. OpenAI menyatakan GPT-6 Astra adalah model pertama yang melepasi ambang perlindungan siber kritikalnya, dan dalam kad sistemnya melaporkan 86 daripada 226 tugasan penilaian siber yang melibatkan kelemahan sebenar, sifar percubaan menyerang di luar kotak pasir, dan penurunan kepada 2 peratus pada penanda aras keselamatan penggunaan komputer dalamannya berbanding 22 peratus bagi model sebelumnya. Syarikat itu juga mengakui bahawa alasan bertulis Astra lebih sukar dipantau daripada model sebelum ini.
Anthropic, dalam laporan ancamannya yang diterbitkan 10 September 2026, menambah satu lagi trend yang berkaitan: penyulingan haram. Ia menggambarkan usaha berskala industri untuk mengekstrak keupayaan sesuatu model secara senyap dan menyalinnya di tempat lain tanpa kebenaran. Bagi pembangun kecil, ini peringatan bahawa kos murah kadangkala datang daripada sesuatu yang dibina di atas kerja orang lain tanpa izin.
Apa maksudnya kepada pembangun kecil di Malaysia
Kalau anda membina aplikasi atau sistem untuk perniagaan kecil, tiga perkara berubah bulan ini. Pertama, kos untuk menambah ciri AI seperti rumusan atau jawapan automatik turun dengan mendadak, terutamanya untuk kerja yang banyak berulang dengan teks yang sama. Kedua, pilihan model menjadi lebih luas daripada kemampuan pasukan kecil untuk mengujinya; lebih baik anda pilih dua, uji dengan 20 contoh kerja sebenar, dan putuskan berdasarkan hasil. Ketiga, tahap usaha model kini boleh dilaraskan — perbezaan kos antara mod usaha rendah dan tinggi bagi satu model dilaporkan sehingga 2.4 kali, lebih besar daripada jurang antara kebanyakan model pertengahan.
Satu lagi angka yang patut direnungkan: OpenAI menyatakan bahawa penyelidikan dalamannya kini berjalan pada 3.1 hari kerja agen bagi setiap hari kerja manusia, dan penyelidik median menggunakan lebih daripada AS$600 sehari dalam bentuk penggunaan model pada harga API. Itu bukan lagi belanjawan jabatan kecil, dan ia menjelaskan mengapa jurang antara syarikat besar dan pembangun individu masih wujud walaupun harga turun.
Cara memilih tanpa terperangkap hype
- Tetapkan kerja dahulu, model kemudian. Kalau kerja itu menjawab soalan pelanggan yang berulang, model murah sudah memadai.
- Uji dengan 20 contoh sebenar daripada kerja anda, bukan dengan soalan demo. Cara ini mendedahkan kesilapan yang tidak kelihatan dalam siaran berita pelancaran.
- Catat kadar promosi dan tarikh tamatnya dalam satu fail. Kadar yang berakhir pada 31 Disember 2026 itu akan berubah menjadi dua kali ganda.
- Simpan kebolehan menukar model. Kalau sistem anda bergantung pada satu pembekal sahaja, kenaikan harga bermakna kenaikan kos tanpa pilihan.
- Semak syarat penggunaan sebelum meletakkan data pelanggan ke dalam mana-mana alat.
Baca juga di laman ini
- Aplikasi yang kami bina Contoh sebenar aplikasi kecil yang berjalan tanpa bergantung pada alat AI berbayar.
- ColdFusion/Lucee masih relevan Pilihan teknologi untuk sistem kecil yang perlu berjalan lama dan murah.
- Perkhidmatan kami Kalau anda mahu ciri AI dimasukkan ke dalam sistem sedia ada dengan kos terkawal.
- Harga buat sistem tempahan: apa yang menentukan Cara kos projek dikira, supaya keputusan teknologi dibuat atas angka.
Sumber yang disemak
Maklumat dalam tulisan ini disemak dengan sumber di bawah. Bila keadaan berubah (harga, waktu, terma), sumber inilah yang paling tepat — bukan halaman ini.