Pertanyaan yang hampir selalu muncul: kalau bot kami melayani ribuan percakapan sebulan, biayanya berapa? Jawabannya lebih bergantung pada rancangan sistem daripada pada model yang dipilih.
Rentang harganya sangat lebar
Per pertengahan 2026, harga API model bahasa membentang dari sekitar $0,03 per juta token input untuk model paling ringan sampai puluhan dolar per juta token output untuk model penalaran kelas atas — selisih ratusan kali lipat. Di kelas hemat ada banyak pilihan yang untuk banyak tugas sudah lebih dari cukup.
Satu hal yang konsisten di semua penyedia: token output berharga dua sampai enam kali lipat token input. Ini punya konsekuensi desain yang langsung terasa.
Kenapa termurah per token bukan termurah per pekerjaan
- Pengulangan. Model murah yang salah lalu harus diulang dua kali bisa lebih mahal daripada model bagus yang benar sekali jalan — dan itu belum menghitung biaya pelanggan yang kecewa.
- Konteks yang menumpuk. Riwayat percakapan panjang dikirim ulang di tiap giliran. Tanpa peringkasan, biaya per pesan naik sepanjang percakapan.
- Panjang jawaban. Karena output jauh lebih mahal, membatasi verbositas sering menurunkan tagihan lebih banyak daripada berpindah model.
- Alur multi-langkah. Satu percakapan bisa memicu banyak panggilan model. Yang perlu dihitung biayanya adalah alurnya, bukan satu panggilan.
Yang sering lebih besar dari biaya model
Dalam banyak proyek, tagihan model bukan pos terbesar. Yang lebih sering dominan adalah biaya kanal — dan mulai 1 Oktober 2026 pos itu bertambah, karena service message WhatsApp jadi berbayar — serta hosting, pemantauan, dan waktu orang yang mengawasi sistem di masa awal.
Karena itu perkiraan biaya yang hanya menghitung token biasanya meleset. Hitung seluruh alurnya.