Berita AI minggu ini: harga token jatuh separuh, dan apa maksudnya untuk pengguna di Malaysia
Pada 22 September 2026, Anthropic dan OpenAI memotong harga API pada hari yang sama. Pos ini mengumpulkan angka sebenar, menerangkan kenapa kadar cache lebih penting daripada kadar muka, dan menandakan tarikh 31 Disember 2026 yang boleh menaikkan bil anda semula.
Ada minggu yang berlalu tanpa berita besar. Minggu 22 hingga 26 September 2026 bukan minggu seperti itu: dua syarikat terbesar dalam pasaran model bahasa memotong harga API pada hari yang sama, dan satu lagi melancarkan model suara dengan lebih 2,000 suara siap pakai. Bagi pembaca yang tidak membina perisian, berita sebegini selalu kelihatan jauh. Pada hakikatnya ia menentukan harga alat yang anda bayar setiap bulan, mutu jawapan chatbot yang anda gunakan di pejabat, dan sama ada perkhidmatan suara atau terjemahan dalam bahasa Melayu menjadi lebih murah atau lebih mahal tahun depan. Pos ini mengumpulkan angka daripada empat pengumuman pada minggu itu, kemudian menerangkannya satu per satu.
22 September 2026: dua potong harga pada hari yang sama
Anthropic membuka hari itu dengan Claude Opus 5.5, model pertama dalam keluarga Claude 5.5 yang dikeluarkan pada 22 September 2026. Harga API-nya ialah AS$4 bagi setiap sejuta token input dan AS$20 bagi setiap sejuta token output, iaitu 20% lebih murah daripada Opus 5. Bahagian yang lebih penting ialah bacaan cache: AS$0.20 bagi setiap sejuta token, turun 60% berbanding Opus 5. Anthropic menyatakan model ini menelan kos 40% lebih rendah pada beban kerja biasa dan menjana output lebih 30% pantas. Ia diuji oleh dua kumpulan luar sebelum pelancaran, iaitu METR dan Frontier Design. Bagi pelanggan langganan, had penggunaan lima jam untuk pelan Pro, Max, Team dan Enterprise dinaikkan, dan setiap pengguna menerima satu set semula had yang boleh disimpan dan digunakan apabila diperlukan. Model ini tersedia di Amazon Web Services, Google Cloud dan Microsoft Azure.
Beberapa jam kemudian, OpenAI mengumumkan GPT-6 Sol dan GPT-6 Luna sebagai pengganti terus bagi barisan GPT-5.6. GPT-6 Sol ditetapkan pada AS$2 input dan AS$10 output, turun daripada AS$4 dan AS$20. GPT-6 Luna berada pada AS$0.10 input dan AS$0.50 output, turun daripada AS$0.20 dan AS$1.20, manakala input cache Luna kini AS$0.01 bagi setiap sejuta token. Laporan The New Stack menyebut kedua-dua potongan itu sebagai kira-kira 50%. Ada satu butiran kecil yang mudah terlepas: pada hari pelancaran, kedua-dua model itu belum dimasukkan ke dalam ChatGPT, dan OpenAI merancang melancarkannya secara berperingkat. Jika anda membuka aplikasi pada 22 September dan tidak melihat apa-apa perubahan, itu bukan tanda pelancaran gagal.
Pelancaran itu juga membawa dua butiran yang berguna untuk perancangan. Anthropic menyatakan ia adalah keluaran pertama sejak syarikat itu menyeru supaya rentak pembangunan model diperlahankan selari dengan kerja keselamatan, dan Claude Sonnet 5.5 serta Claude Haiku 5.5 akan menyusul dalam beberapa minggu dengan penambahbaikan yang sama pada harga, kelajuan dan keselamatan. Bagi organisasi yang mahu memakai Opus 5.5 untuk kerja biologi atau keselamatan siber, akses kini melalui program pengesahan berasingan, iaitu Life Sciences Verification dan Cyber Verification, yang bermakna bukan semua akaun boleh menggunakannya untuk kerja sensitif itu.
Harga cache: angka yang jarang muncul dalam iklan
Jika anda hanya membaca dua angka pada halaman harga, iaitu input dan output, anda akan tersalah anggar bil. Kerja ejen, seperti chatbot yang membaca dokumen yang sama berulang kali atau alat yang menyemak kod, menghantar semula sebahagian besar teks yang sama pada setiap langkah. Sebab itu pembacaan cache menjadi bahagian terbesar kos kerja sebegitu. Ambil contoh paling mudah: 10 juta token input pada kadar biasa AS$4 berharga AS$40. Jumlah yang sama pada kadar bacaan cache AS$0.20 berharga AS$2. Jurang itu berulang pada setiap model: input cache GPT-6 Sol ialah AS$0.20, dan Luna AS$0.01. Harga muka yang dipetik media bukan angka yang benar-benar keluar daripada akaun anda.
23 September: 2,000 suara siap pakai dalam satu model
Sehari selepas itu, Google memperkenalkan Gemini 3.8 Flash TTS dan Gemini 3.8 Flash-Lite TTS. Perpustakaan suara siap pakai diperluas daripada 30 kepada lebih 2,000 pilihan, dan model Flash TTS menyokong 130 bahasa. Pada penanda aras Voice Design milik Hume AI, model ini menduduki tempat pertama dengan skor 71.4, serta mendahului dalam pemodelan loghat dengan 60.8. Google juga memasukkan penanda air pada audio yang dijana, dan pengguna boleh mencipta suara baharu atau meniru suara sedia ada melalui gesaan bahasa semula jadi. Bagi peniaga di Malaysia, kesan praktikalnya jelas: suara menu panggilan telefon, bacaan artikel dan video pendek boleh dihasilkan tanpa bilik rakaman. Tetapi kemudahan yang sama juga menjadikan suara tiruan lebih murah untuk dibuat.
Butiran daripada pelancaran 2 September menjelaskan corak yang sama pada Google. Gemini 3.8 Flash tersedia secara terbuka pada harga pengenalan, tetapi varian Gemini 3.8 Flash Cyber yang dibina untuk mengesan kelemahan dan menampalkan pembaikan secara automatik hanya diberikan kepada pertahanan yang dipercayai melalui program Fairwind. Maksudnya mudah: keupayaan tertinggi dalam bidang sensitif tidak lagi dijual kepada sesiapa sahaja yang membayar, dan semakan latar belakang organisasi menjadi sebahagian daripada kos mendapatkan akses.
31 Disember 2026: tarikh yang patut ditandakan dalam kalendar
Tidak semua penurunan harga kekal. Google menulis dalam nota kaki halaman pelancaran Gemini 3.8 Flash bahawa harga pengenalan AS$0.75 input dan AS$3.75 output luput pada 31 Disember 2026. Mulai 1 Januari 2027, kadar yang dikenakan ialah AS$1.50 input dan AS$7.50 output, iaitu dua kali ganda. Projek yang berjalan pada Disember boleh berubah kos secara mendadak pada Januari tanpa satu baris kod pun diubah. Sebagai perbandingan, potongan OpenAI pada 22 September dilaporkan sebagai kekal, bukan promosi bermusim. Perbezaan antara harga pengenalan dan harga baharu menentukan sama ada anda perlu mengehadkan penggunaan, menukar model, atau menambah peruntukan dalam bajet suku pertama 2027.
Apa maksudnya kepada peniaga dan pembaca di Malaysia
Angka daripada MIDA memberi konteks tempatan. Malaysia merekodkan RM385.7 bilion pelaburan berkaitan pusat data dari 2021 hingga separuh pertama 2026, dan pada 14 September 2026 agensi itu mengumpulkan pemain industri di Data Centre Nexus 2026 untuk membincangkan cara kapasiti itu memberi nilai kepada perusahaan kecil dan rakyat. Harga token yang turun di luar negara sepatutnya menurunkan kos perkhidmatan AI tempatan yang berjalan di atas komputasi yang sama.
- Bagi pembina chatbot dan alat terjemahan: semak semula bajet bulanan. Model murah seperti GPT-6 Luna pada AS$0.10 input mengubah kiraan untuk jumlah trafik yang sama.
- Bagi pembeli aplikasi AI: harga langganan tidak turun sendiri apabila harga API jatuh. Tanya penjual model mana yang dipakai dan berapa had penggunaan yang disertakan.
- Bagi kerja yang banyak mengulang dokumen: kos sebenar datang daripada bacaan cache. Minta penjelasan tentang angka cache, bukan hanya angka output.
- Bagi projek yang akan berjalan melepasi Disember 2026: catat dalam bajet bahawa kadar Gemini Flash untuk projek itu akan dua kali ganda mulai 1 Januari 2027.
Apa yang belum jelas
Tiga perkara tidak boleh disahkan daripada pengumuman sahaja. Angka prestasi dalam semua pengumuman itu datang daripada ujian yang dijalankan oleh syarikat pelancar sendiri; pos ini tidak menjalankan ujian bebas. Tiada pengumuman harga langganan khusus untuk Malaysia dalam tempoh ini, jadi semak halaman rasmi sebelum mengubah apa-apa. Kadar dalam dolar juga tidak mengambil kira cukai, caj kad dan susut nilai ringgit, yang semuanya menjejaskan bil sebenar peniaga kecil. Untuk kejelasan: pos ini tidak menggunakan atau menguji mana-mana model dalam senarai untuk tujuan perbandingan, dan semua angka diambil seperti yang dilaporkan.
Cara mengira bil anda sendiri dalam lima minit
# anggaran kasar kos bulanan API dalam AS$
# formula: (juta token input x kadar input) + (juta token output x kadar output)
# contoh 10 juta token input + 2 juta token output:
# GPT-6 Luna : 10 x 0.10 + 2 x 0.50 = 2.00
# GPT-6 Sol : 10 x 2.00 + 2 x 10.00 = 40.00
# Opus 5.5 : 10 x 4.00 + 2 x 20.00 = 80.00
# Tukar model, tukar jumlah penggunaan, ulang kiraan. Itu sahaja caranya.
Kesimpulan yang boleh dipegang: minggu itu memberi dua berita harga dan satu berita keupayaan. Kos token menjadi lebih murah, tetapi tarikh luput dan kadar cache menentukan sama ada penjimatan itu sampai ke poket anda. Baca tiga angka setiap kali, iaitu kadar muka, kadar cache dan tarikh tamat promosi, kemudian kira dengan jumlah penggunaan anda sendiri.
Baca juga di laman ini
- Lima model AI dalam sepuluh hari September 2026 Kronologi pelancaran model dan pergerakan harga bulan lepas
- Alat AI percuma lawan berbayar: apa beza sebenarnya untuk peniaga kecil Cara membandingkan kos alat AI sebelum melanggan
- Suara tiruan di hujung talian: empat langkah sahkan sebelum wang keluar Risiko suara yang ditiru dan cara mengesahkan panggilan
- AI untuk perniagaan kecil: lapan kerja yang boleh diserahkan Kerja harian yang sesuai diamanahkan kepada alat AI
Sumber yang disemak
Maklumat dalam tulisan ini disemak dengan sumber di bawah. Bila keadaan berubah (harga, waktu, terma), sumber inilah yang paling tepat — bukan halaman ini.
- Anthropic - Introducing Claude Opus 5.5 (22 September 2026)
- The New Stack - OpenAI releases GPT-6 Sol and Luna, cuts token prices in half (22 September 2026)
- Google Blog - Gemini 3.8 text-to-speech says hello (23 September 2026)
- Google Blog - Introducing Gemini 3.8 Flash and 3.8 Flash Cyber, nota kaki harga pengenalan (2 September 2026)
- TechCrunch - Anthropic releases Opus 5.5 with lower prices and Fable-level performance (22 September 2026)
- MIDA - Data Centre Nexus 2026: RM385.7 bilion pelaburan pusat data (14 September 2026)
Dapat tulisan baharu terus ke e-mel
Sekali sekala sahaja: panduan web, berita AI, dan tempat menarik di Kelantan. Tiada iklan, dan e-mel encik tidak dikongsi dengan sesiapa.