🌐 ID

🧮 Kalkulator Biaya Token AI

Hitung biaya token untuk GPT, Claude, Gemini, dan API LLM utama lainnya. Masukkan jumlah token secara langsung atau tempelkan teks untuk memperkirakannya, lalu cek perkiraan biaya bulanan.

Simulasi penggunaan bulanan

Dalam mode tempel, atau dalam mode langsung saat input/output dikosongkan, simulasi mengasumsikan pembagian 70% input / 30% output per permintaan. Jika token input dan output diisi dalam mode langsung, angka per permintaan yang tepat itu akan digunakan sebagai gantinya.

Perkiraan biaya (per permintaan)
Biaya input Biaya output Total biaya
Biaya input jika dicache (referensi)

Caching di dunia nyata berlaku untuk system prompt atau konteks yang diulang, bukan untuk input baru sepenuhnya pada setiap panggilan.

Sumber:
Simulasi penggunaan bulanan
Biaya per hari Biaya per bulan (×30) Biaya per tahun (×365)
PANDUAN

Pelajari lebih lanjut

01

1. Mengapa memperkirakan biaya API LLM sebelum skala

Menghitung biaya yang diharapkan sebelum menghubungkan API LLM ke fitur atau produk baru membantu mencegah basis pengguna yang terus tumbuh berubah menjadi tagihan yang sulit dikelola. Ini bahkan lebih penting untuk layanan dengan prompt panjang atau percakapan multi-turn - satu permintaan mungkin terlihat murah, tetapi angkanya cepat berubah saat dikalikan dengan volume harian atau bulanan. Kalkulator ini menampilkan biaya per permintaan sekaligus simulasi bulanan agar Anda mendapat gambaran anggaran sebelum melakukan skala.

02

2. Bagaimana token berbeda dari kata dan karakter

Token adalah unit terkecil yang diproses model untuk teks, dan tidak memiliki pemetaan 1:1 dengan kata atau karakter. Aturan praktis yang umum untuk bahasa Inggris adalah sekitar 4 karakter per token, tetapi itu hanya perkiraan - jumlah sebenarnya bergantung pada tokenizer tiap model (misalnya bergaya BPE). Bahasa CJK (Korea, Jepang, Tiongkok) khususnya cenderung menggunakan lebih banyak token per karakter dibanding bahasa Inggris, karena satu karakter sering dipecah menjadi beberapa token subword - jadi jumlah karakter yang sama bisa jauh lebih mahal daripada teks Inggris dengan panjang setara.

03

3. Mengapa harga input dan output berbeda

Sebagian besar penyedia mematok token output (yang dihasilkan) beberapa kali lebih mahal daripada token input (prompt), dan setiap model dalam dataset ini mengikuti pola itu. Input bisa diproses (diencode) sekaligus, sedangkan output harus dihasilkan (didekode) satu token demi satu token - komputasi dan latensi per token lebih besar. Karena itu, menjaga respons tetap singkat adalah cara yang sangat efektif untuk menekan biaya.

04

4. Apa itu prompt caching

Prompt caching (context caching) memungkinkan penyedia menyimpan system prompt, konteks panjang, atau dokumen di sisi server, lalu mengenakan tarif jauh lebih rendah saat konten yang sama muncul lagi pada permintaan berikutnya. Ini paling berguna pada skenario percakapan, ketika system prompt atau riwayat chat dikirim ulang di setiap giliran. Fitur ini tidak berlaku ketika setiap permintaan mengirim teks yang benar-benar baru, jadi angka "jika dicache" di kalkulator ini adalah skenario referensi, bukan jaminan.

05

5. Cara mengurangi biaya token di produksi

(1) Jaga prompt tetap sesingkat yang benar-benar dibutuhkan tugasnya - sertakan hanya konteks yang perlu. (2) Manfaatkan prompt caching untuk system prompt atau konteks yang berulang di berbagai permintaan. (3) Arahkan tugas sederhana seperti klasifikasi atau ringkasan ke model yang lebih murah dan lebih kecil, bukan model unggulan Anda. (4) Gabungkan beberapa permintaan sekaligus untuk memanfaatkan diskon batch atau optimasi throughput. Empat tuas ini saja sudah bisa memangkas biaya operasional nyata secara berarti.

06

6. Keterbatasan kalkulator ini

Kalkulator ini memperkirakan biaya dari tarif API daftar harga publik yang diumumkan tiap penyedia. Ini tidak memperhitungkan diskon volume, perjanjian enterprise, provisioned throughput, kredit gratis, perbedaan harga regional, atau perlambatan efektif akibat rate limit. Jumlah tagihan aktual dapat berbeda berdasarkan ketentuan kontrak Anda - gunakan ini sebagai titik awal untuk penyusunan anggaran, lalu konfirmasi angka akhirnya langsung ke penyedia.

Pertanyaan umum

Seberapa akurat perkiraan teks ke token?
~4 karakter per token adalah aturan praktis kasar berdasarkan teks bahasa Inggris. Tokenizer aktual berbeda tiap model, dan teks non-Inggris (Korea, Jepang, Tiongkok, dll.) bisa menyimpang lebih jauh dari perkiraan ini. Untuk hitungan yang presisi, jalankan teks melalui tokenizer resmi dari penyedia model.
Mengapa output lebih mahal daripada input?
Menghasilkan token satu per satu (decoding) membutuhkan komputasi lebih besar dibanding memproses input sekaligus (encoding), sehingga sebagian besar penyedia mematok token output beberapa kali lebih tinggi daripada token input.
Apakah ini mencakup token gambar atau audio?
Tidak - kalkulator ini hanya menangani token teks. Input gambar, audio, dan video sering dikenai skema harga terpisah yang berada di luar cakupan di sini.
Seberapa sering harga ini diperbarui?
Secara manual, per tanggal yang ditampilkan di field as_of pada file data. Harga penyedia dapat berubah tanpa pemberitahuan, jadi selalu konfirmasi angka terbaru di halaman harga resmi penyedia sebelum memfinalkan anggaran.