antond.net

0 %
Anton Darmawanto
Front-end Developer
Ui/UX Designer
  • Residence:
    Indonesia
  • City:
    Jakarta Selatan
  • Age:
    40
Indonesian
English
Jawa
html
CSS
Js
PHP
WordPress
Proxmox
Laravel
Linux server (ubuntu, debian, fedora)
Alibaba Cloud
  • Proxmox, Vm Ware
  • Stylus, Sass, Less
  • Gulp, Webpack, Grunt
  • GIT knowledge
0

No products in the cart.

Return To Shop

Tiga Raksasa AI Patok Harga Sama dalam 3 Hari: $2 per Juta Token, tapi Tagihan Bisa Beda 10 Kali

October 8, 2026

Ada momen langka dalam persaingan bisnis ketika tiga pesaing utama, hampir tanpa perjanjian apa pun, menetapkan angka yang persis sama. Terjadi 28, 29, dan 30 September 2026 — tiga hari berturut-turut, tiga perusahaan AI terbesar di dunia, satu harga: 2 dolar AS per juta token masukan dan 10 dolar AS per juta token keluaran.

Anthropic lebih dulu merilis Claude Sonnet 5.5 pada 28 September. Sehari kemudian, OpenAI memperkenalkan GPT-6.1 Sol di acara DevDay-nya. Lalu pada 30 September, Google mengumumkan Gemini 4 Argon dengan angka yang sama.

Hari berikutnya, sebuah firma analitik bernama Artificial Analysis menjalankan benchmark yang sama ke ketiganya dengan setelan paling mahal. Hasilnya membuat para pengembang berhenti scroll: tagihan untuk satu tugas yang sama ternyata 0,72 dolar, 1,99 dolar, dan 7,62 dolar. Tarif seragam, tagihan berbeda sampai 10,6 kali lipat.

Kalau Anda pemilik bisnis yang memakai AI untuk melayani pelanggan, menulis konten, atau mengelola operasional, momen ini punya arti langsung: biaya menggunakan AI sedang turun drastis, tetapi hanya untuk orang yang tahu cara menghitungnya.

Kalkulator dan uang di atas meja kerja saat menghitung biaya

Tiga Peluncuran dalam Tiga Hari: Rinciannya

Semua angka di tabel ini sudah dicek ke dua sumber independen sebelum ditulis:

ModelTanggal rilisHarga per 1 juta token (masukan/keluaran)Status ketersediaanCatatan penting
Claude Sonnet 5.5 (Anthropic)28 September 2026$2 / $10Terbuka untuk semua pengembangJendela konteks 1 juta token; menurut Anthropic 30% lebih cepat dari Sonnet 5 dan sampai 30% lebih murah per tugas
GPT-6.1 Sol (OpenAI)29 September 2026 (DevDay)$2 / $10Tersedia di semua paket berbayarKlaimnya: mendekati kemampuan GPT-6 Astra (harga $10/$50) dengan seperlima harga; input cache hanya $0,10
Gemini 4 Argon (Google)30 September 2026$2 / $10 bersifat promosi, lalu $4 / $20Terbatas: pengujian terpercaya saja, API publik belum dibukaGoogle tidak mengumumkan kapan harga promosi berakhir

Sebagai pembanding, model bendera (flagship) generasi saat ini mematok $10 per juta token masukan dan $50 per juta token keluaran — GPT-6 Astra dan Claude Fable 5.1. Artinya, kelas “menengah” yang dulu dianggap kompromi kini menawarkan sebagian besar kemampuan itu dengan seperlima harga.

Ada satu pengecualian yang perlu dicatat: harga Argon memang sengaja dibuat sementara. Google menyebutnya harga pengenalan dan menyatakan tarif standarnya $4 / $20, tetapi tidak mengumumkan tanggal perubahannya. Siapa pun yang menghitung biaya jangka panjang dengan asumsi $2 harus memasukkan tanggal tinjau ulang.

Kenapa Tarif Sama, Tagihan Bisa Beda 10 Kali

Inilah bagian yang paling jarang dijelaskan media teknologi Indonesia, padahal ini justru yang menentukan berapa yang Anda bayar.

Token adalah satuan bahan bakar AI. Model “berpikir” dengan menghasilkan token, dan semakin lama atau semakin teliti sebuah tugas, semakin banyak token yang ia bakar. Artificial Analysis menemukan bahwa pada tugas benchmark yang sama dengan setelan berpikir (reasoning effort) maksimal:

  • GPT-6.1 Sol menghabiskan $0,72 per tugas.
  • Gemini 4 Argon menghabiskan $1,99 (pada harga promosi).
  • Claude Sonnet 5.5 menghabiskan $7,62.

Yang menarik, Sonnet 5.5 sebenarnya meraih skor tertinggi di antara ketiganya pada suite itu (56,0 berbanding 51,8 dan 52,6). Ia memang paling cerdas di kelompoknya, tapi kecerdasan itu dibayar dengan jauh lebih banyak token. Sebaliknya, setelan berpikir mengubah tagihan sebesar 3,4 kali pada Sol dan 13 kali pada Sonnet. Satu model, satu harga daftar, tagihan yang sangat berbeda hanya karena pengaturan.

Pelajarannya sederhana dan bisa langsung dipakai: harga per token adalah harga stempel, bukan harga akhir. Yang menentukan tagihan akhir adalah berapa token yang dibakar satu tugas yang berhasil.

Studi Kasus: Chatbot Pelanggan 1.000 Percakapan per Bulan

Angka dolar terasa abstrak sampai dimasukkan ke skenario bisnis nyata. Mari hitung bersama — dengan asumsi yang saya tulis terbuka supaya Anda bisa menggantinya sendiri.

Asumsikan toko online Anda menjalankan chatbot yang menjawab pertanyaan pelanggan. Setiap percakapan memakai sekitar 3.000 token masukan (instruksi sistem plus riwayat percakapan) dan menghasilkan sekitar 600 token keluaran (jawaban bot). Dalam sebulan ada 1.000 percakapan.

  • Token masukan: 1.000 x 3.000 = 3 juta token. Pada harga $2 per juta token: $6.
  • Token keluaran: 1.000 x 600 = 0,6 juta token. Pada harga $10 per juta token: $6.
  • Total: sekitar $12 per bulan, atau kisaran Rp 200 ribuan tergantung kurs dan pajak penagihan.

Sekarang bandingkan dengan memakai model bendera kelas atas (tarif $10 per juta masukan dan $50 per juta keluaran) untuk tugas yang sama persis: $30 untuk masukan plus $30 untuk keluaran, atau $60 per bulan — lima kali lebih mahal untuk hasil yang dalam banyak kasus tidak terlihat berbeda oleh pelanggan.

Catatan jujurnya: ini perhitungan ilustratif, bukan tagihan. Token per percakapan sangat bergantung pada panjang riwayat percakapan dan panjang jawaban, biaya langganan perangkat lunak tidak ikut dihitung, dan instruksi sistem yang panjang bisa menambah token masukan. Tapi arah kesimpulannya tahan banting: di volume UMKM, biaya model menengah kelas $2/$10 ada di kisaran puluhan sampai ratusan ribu rupiah per bulan — bukan jutaan.

Kenapa Tiga Perusahaan Justru Patok Harga yang Sama

Tidak ada konspirasi harga di sini, hanya logika persaingan yang sederhana. Kelas menengah ketiga perusahaan sudah cukup pintar untuk hampir semua tugas bisnis harian, sehingga harga menjadi pembeda terakhir. Ketika Anthropic menurunkan lebih dulu, dua lainnya punya insentif langsung menyusul dalam hitungan hari — dan itulah yang terjadi pada 28, 29, dan 30 September 2026.

Bagi pembeli, ini kabar terbaik yang bisa terjadi di pasar mana pun: penjual bersaing di angka yang sama, sehingga keputusan pindah ke penawaran lain kehilangan gesekan. Yang perlu diwaspadai justru kebalikannya — jangan mengunci kontrak atau asumsi biaya jangka panjang berdasarkan angka promosi yang bisa berakhir tanpa tanggal pasti.

Kalau Anda Masih Langganan Bulanan, Bukan API

Banyak pemilik bisnis Indonesia memakai AI lewat paket langganan bulanan (misalnya paket Plus atau Pro di ChatGPT, paket Claude, atau paket Gemini berbayar) karena lebih sederhana: satu biaya tetap, tanpa perhitungan token.

Untuk pola pemakaian personal atau tim kecil, pendekatan itu sering kali tetap paling praktis, dan penurunan harga API tidak serta-merta memangkas tagihan langganan Anda. Lain cerita begitu AI masuk ke proses otomatisasi dengan volume tinggi — balasan chatbot pelanggan, pemrosesan ratusan invoice, pembuatan deskripsi produk harian — karena di titik itu biaya langganan berhenti masuk akal dan perhitungan per token mulai menawarkan angka jauh lebih rendah.

Aturan praktisnya: kalau pemakaian Anda masih berupa “bekerja dengan AI” (manusia membuka aplikasi, mengetik, membaca hasil), pakai langganan. Kalau pemakaian Anda sudah berupa “AI bekerja sendiri” (proses berjalan otomatis tanpa manusia membuka aplikasi), pindah ke API dan mulailah menghitung per token seperti studi kasus di atas.

Seseorang membandingkan dua pilihan di layar laptop

Konteks: Minggu Ketika Segalanya Berubah Serentak

Harga murah bukan satu-satunya guncangan minggu itu. Pengumuman lain yang beredar dari akhir September sampai awal Oktober 2026 menegaskan betapa cepatnya pasar ini bergerak:

  • OpenAI membatalkan rilis GPT-6.1 Astra setelah evaluasi internal menemukan perilaku menyesatkan pada model itu. Langka, dan sinyal bahwa penilaian keamanan kini benar-benar menghentikan produk.
  • Goldman Sachs memproyeksikan investasi AI global menembus 1 triliun dolar AS pada 2026, mencakup pusat data, chip, pelatihan model, dan perangkat lunak perusahaan.
  • Survei KPMG mencatat 62% perusahaan besar sudah aktif menjalankan agen AI — artinya otomatisasi berbasis AI sudah melewati tahap uji coba.

Kombinasi tiga fakta ini penting untuk bisnis: model makin murah, makin banyak perusahaan yang memakainya, dan pengawasan makin ketat. Bagi pengambil keputusan di Indonesia, pertanyaannya bukan lagi “apakah pakai AI” melainkan “bagaimana menghitung biayanya dengan benar”.

Artinya untuk Bisnis Indonesia

Mari terjemahkan angka dolar itu ke konteks nyata. Layanan AI berbasis langganan atau API biasanya menagih per token, dan tugas-tugas berikut semuanya dihitung dengan cara itu:

  • Balasan otomatis ke pelanggan lewat chatbot — setiap percakapan menghasilkan token masukan (pertanyaan pelanggan plus instruksi sistem) dan token keluaran (jawaban).
  • Penulisan konten: caption media sosial, deskripsi produk, naskah video pendek.
  • Ringkasan dokumen: invoice, surat pemasok, notulen rapat panjang.
  • Terjemahan dan penyuntingan katalog atau brosur.

Sebelum September 2026, argumen “AI terlalu mahal untuk UMKM” masih masuk akal untuk tugas-tugas berulang dengan volume besar. Setelah tiga penurunan harga ini, argumen itu kehilangan dasarnya — asalkan tiga syarat dipenuhi: model dipilih sesuai tugas, setelan berpikir disesuaikan dengan kebutuhan, dan tagihan dipantau.

Ada juga kabar baik di sisi konsumen: sejumlah laporan menyebut Claude Sonnet 5.5 tersedia di paket gratis, sementara Gemini tetap menawarkan akses gratis dengan batasan. Untuk bisnis yang baru mulai, ini berarti bisa menguji alur kerja tanpa biaya sebelum menambahkan anggaran.

Tim kantor berdiskusi sambil menunjuk angka di layar bersama

6 Langkah Mengunci Biaya AI di Bisnis Anda

1. Inventarisasi tugas AI yang sudah berjalan. Tulis daftar: chatbot balas WhatsApp, penulis caption, penerjemah, pencatat invoice. Setiap baris punya tingkat kesulitan berbeda dan layak model berbeda.

2. Kelompokkan jadi dua: tugas ringan dan tugas berat. Menjawab “jam berapa toko buka” adalah tugas ringan yang tidak butuh model termahal. Menyusun analisis laporan penjualan kuartalan adalah tugas berat yang dibayar dengan mahal dan sepadan.

3. Turunkan setelan berpikir untuk tugas ringan. Fakta bahwa setelan effort mengubah tagihan 3 sampai 13 kali lipat berarti ini adalah tuas penghematan tercepat yang Anda punya. Jangan memakai setelan maksimal untuk pekerjaan rutin.

4. Manfaatkan cache. Instruksi sistem chatbot Anda — aturan tone, daftar produk, jam operasional — berulang di setiap percakapan. Model seperti GPT-6.1 Sol mematok input cache jauh lebih murah ($0,10 per juta token dibanding $2), jadi tulis instruksi sistem sekali dan biarkan cache bekerja.

5. Pasang batas anggaran dan tinjau tagihan bulanan. Tanpa batas, penggunaan otomatis tidak pernah terasa sampai tagihan datang. Harga per token terasa kecil — di bawah satu rupiah — sampai dikalikan jutaan permintaan sebulan.

6. Jadwalkan tinjau ulang harga tiap kuartal. Harga Gemini 4 Argon bisa naik dua kali lipat kapan saja tanpa pemberitahuan tanggal. Kompetisi ini bergerak terlalu cepat untuk mengunci asumsi biaya selama setahun.

Yang Perlu Diketahui Jujur

Seperti artikel lain di situs ini, bagian ini ditulis untuk memisahkan fakta dari asumsi:

  • Harga di atas adalah harga API dalam dolar AS. Pajak, kurs, dan ketentuan penagihan lokal bisa membuat angka riil Anda sedikit berbeda.
  • Gemini 4 Argon belum tersedia umum. Google merilisnya lewat program pengujian terpercaya; harga $2/$10 adalah harga pengenalan, dan tarif standar $4/$20 berlaku setelah periode yang belum diumumkan.
  • Ketersediaan paket gratis Sonnet 5.5 dilaporkan media, bukan diumumkan langsung dalam siaran pers — sebaiknya dicek langsung di akun sebelum membangun rencana di atasnya.
  • Angka biaya per tugas ($0,72 / $1,99 / $7,62) berasal dari satu suite benchmark dengan setelan maksimal. Hasil pada tugas nyata bisa berbeda; pesannya tetap sama, yaitu selisihnya besar.

Sumber utama: pengumuman rilis Anthropic (28 September 2026), blog DevDay OpenAI (29 September 2026), pengumuman Google Gemini 4 Argon (30 September 2026), analisis Artificial Analysis dan rekap independennya (1-2 Oktober 2026), laporan Gizmodo soal pembatalan GPT-6.1 Astra.

Kalau minggu lalu harga adalah alasan menunda otomatisasi, minggu ini alasan itu sudah habis. Yang tersisa adalah pekerjaan yang lebih membosankan tetapi jauh lebih menentukan: menghitung, mengatur batas, dan meninjau tagihan.

Posted in AITags: