Ini hanya estimasi. Token asli bergantung pada tokenizer tiap model. Untuk keputusan biaya API yang presisi, cocokkan dengan alat resmi penyedia model.
Untuk apa angka token ini?
Model AI membaca teks sebagai token, bukan persis sebagai kata. Jika input terlalu panjang, sebagian konteks bisa terpotong atau biaya API meningkat. Estimasi ini membantu kamu memecah dokumen sebelum dikirim ke AI.
Tips memakai teks panjang
Hapus bagian yang tidak relevan, bagi dokumen per topik, dan tulis tujuan dengan jelas. Untuk struktur instruksi, buka panduan prompt.
Kenapa teks bahasa Indonesia sering makan token lebih banyak
Bahasa Indonesia punya banyak imbuhan. Satu kata seperti memperbaikinya terlihat ringkas di layar, tapi tokenizer biasanya memecahnya menjadi beberapa potongan, karena pola me-, per-, -i, dan -nya jarang muncul utuh di kamus model yang mayoritas dilatih dengan teks Inggris. Akibatnya paragraf yang kelihatan pendek bisa menghabiskan token lebih banyak daripada dugaanmu.
Hal serupa terjadi pada kata serapan dan istilah teknis yang ditulis dengan ejaan Indonesia. Semakin jauh sebuah kata dari pola bahasa Inggris, semakin besar kemungkinan ia dipecah. Angka perkiraan di atas sudah memperhitungkan kecenderungan ini secara kasar, tapi untuk kebutuhan penagihan tetap pakai penghitung resmi dari model yang kamu pakai.
Setelah tahu angkanya, apa langkah berikutnya
Bandingkan perkiraan token dengan batas konteks model yang kamu pakai. Kalau angkanya sudah mendekati batas, jangan berasumsi seluruh teks terbaca. Ada dua jalan keluar: potong teks menjadi bagian yang masuk akal lalu kirim bergantian, atau bersihkan dulu bagian yang tidak perlu. Daftar isi, header berulang, tanda tangan email, dan lampiran yang tidak relevan biasanya yang pertama bisa dibuang.
Untuk dokumen panjang, urutan ini membantu: tulis dulu satu kalimat tentang apa yang ingin kamu ketahui, baru tempel bagian yang benar-benar berhubungan dengan pertanyaan itu. Memilih sendiri bagian yang tepat biasanya lebih murah dan lebih akurat daripada berharap model menemukannya di tengah teks panjang.
Pertanyaan yang sering muncul
Seberapa akurat perkiraan ini?
Cukup untuk memperkirakan panjang, tidak cukup untuk menghitung biaya. Setiap model memakai tokenizer berbeda, jadi selisih sepuluh sampai dua puluh persen dari angka resmi masih wajar. Kalau butuh angka pasti, pakai alat resmi dari penyedia model.
Teks yang saya tempel dikirim ke server?
Tidak. Perhitungan berjalan sepenuhnya di browser kamu, teksnya tidak dikirim ke mana pun dan tidak disimpan. Meski begitu, tetap berhati-hati dengan data pribadi orang lain dan dokumen internal kantor.
Jawaban dari AI ikut dihitung?
Dalam penagihan, input dan output dihitung terpisah. Angka di sini hanya memperkirakan teks yang kamu tempel, yaitu bagian input. Kalau kamu meminta jawaban panjang, total pemakaian akan lebih besar dari angka ini.