Biaya Penggunaan AI: Akan Turun atau Naik?

Biaya AI

Soal biaya AI, manajemen selalu menanyakan hal yang sama: tahun depan berapa? Jawabannya tidak sederhana. Harga per token jelas turun dalam dua tahun terakhir. Meski begitu, di banyak perusahaan tagihan AI terus naik. Artikel ini menjelaskan mengapa biaya naik meski harga turun, serta tiga alasan mengapa harga per token justru bisa naik.

Harga per token sedang turun.
Namun tagihan tetap naik.

Pertama, faktanya: harga memang sudah turun.

Penurunan harga benar-benar terjadi. Dalam setahun terakhir, penyedia AI besar berulang kali menurunkan harga. Penyebabnya adalah peningkatan efisiensi inferensi. Margin kotor salah satu perusahaan AI besar membaik dari minus 94% pada 2024 menjadi sekitar 60% pada 2026. Yang penting di sini adalah perbaikan ini bukan berasal dari kenaikan harga. Margin naik karena pekerjaan yang sama kini membutuhkan lebih sedikit sumber daya komputasi.

-94% → sekitar 60%Margin kotor perusahaan AI besar (2024→2026)
sekitar 7,6 kaliPendapatan tahunan perusahaan tersebut (7 bulan terakhir)
Tidak diumumkanJumlah token dalam paket bulanan

Namun tagihan terus bertambah.

Biaya naik meski harga turun karena pertumbuhan pemakaian melampaui penurunan harga. Pendapatan tahunan perusahaan yang sama tumbuh sekitar 7,6 kali dalam tujuh bulan. Tumbuh sebesar itu sambil menurunkan harga berarti industri mengonsumsi lebih banyak token lagi. Di dalam perusahaan pun sama: penggunanya bertambah, pekerjaan yang diserahkan bertambah, dan waktu pemakaian per orang memanjang. Jika harga turun setengah tetapi konsumsi naik tiga kali lipat, tagihan tetap naik.

Semakin pintar, semakin besar konsumsi per tugas.

Inilah bagian yang sering terlewat. Setiap generasi AI makin pintar, tetapi kecerdasan itu muncul sebagai konsumsi token tambahan. Meski daftar harga tidak berubah, Anda membayar lebih ketika satu pekerjaan membutuhkan lebih banyak token. Berikut tiga perubahan yang sudah terjadi.

Teks yang sama kini dihitung sebagai lebih banyak tokenCara menghitungSaat generasi model berganti, cara penghitungan token pun bisa berubah. Pada satu pergantian generasi, masukan yang persis sama mulai dihitung sebagai 1 hingga 1,35 kali jumlah token sebelumnya. Harga per token tidak berubah, tetapi tagihan naik.
Berpikir lebih dalam memakan lebih banyakToken berpikirModel terbaru memiliki tahap berpikir sebelum menjawab. Kedalamannya bisa diatur, tetapi makin dalam berpikir makin banyak token berpikir yang terpakai. Makin menuntut akurasi, makin mahal setiap permintaan.
Konsumsi per gambar menjadi sekitar 3 kali lipatMasukan gambarSejak gambar resolusi tinggi didukung, satu gambar naik dari sekitar 1.600 token menjadi hingga sekitar 4.784 token. Akurasi meningkat, tetapi biaya memproses jumlah gambar yang sama menjadi hampir tiga kali lipat.

Singkatnya, biaya adalah harga dikali konsumsi, dan hanya yang pertama yang turun dalam dua tahun terakhir. Yang kedua bertambah seiring model makin pintar. Melihat pengumuman penurunan harga lalu merasa aman masih terlalu dini.

Paket bulanan hanyalah kondisi hari ini.

Paket bulanan memiliki sisi harga perkenalan, sampai AI mengakar dalam pekerjaan. Ada tiga fakta yang perlu dipahami.

Jatah token yang termasuk tidak diumumkanPrasyaratTidak ada penyedia besar yang mengumumkan berapa token yang termasuk dalam paket. Yang diberikan hanya pengali. Anggaran tahun depan tidak bisa disusun di atas jatah yang tidak diumumkan.
Batas dan harga sudah pernah berubahRiwayat perubahanBatas pemakaian pernah dinaikkan dan harga pernah diturunkan, berkali-kali. Fakta bahwa keduanya pernah berubah berarti keduanya bisa berubah lagi. Arahnya ditentukan oleh penyedia.
Kelebihan di atas batas kembali ke harga daftarBiaya marginalPaket tetap menurunkan harga rata-rata, tetapi pemakaian di atas batas dihitung per pemakaian. Harga token berikutnya tidak pernah menjadi lebih murah, sebanyak apa pun Anda memakainya.

Selain itu, penyedia besar sedang menuju pencatatan saham, fase dengan tekanan kuat untuk menunjukkan profitabilitas. Ke arah mana harga bergerak bukan pengguna yang menentukan.

Harga tidak bisa Anda pilih. Konsumsi bisa.

Dengan semua itu, langkah yang tersisa bagi perusahaan jelas. Harga ditentukan pihak lain. Yang bisa Anda tentukan hanyalah berapa token yang dikonsumsi.Dan jika konsumsi diturunkan, naik atau turunnya harga jadi kurang berpengaruh. Anda tidak perlu bertaruh pada kenaikan, atau menunggu penurunan.

Tiga cara realistis menurunkan konsumsi1. Jangan membaca ulang materi yang sama — simpan hasil penelusuran sebagai ringkasan, lalu orang atau AI berikutnya cukup membaca ringkasan itu.2. Gunakan server AI internal — pekerjaan rutin seperti merapikan, mengklasifikasi, dan meringkas bisa dijalankan pada model milik sendiri, tanpa biaya per pemakaian dari luar.3. Simpan konteks berulang dalam cache — bagian yang selalu Anda kirim sama setiap kali menjadi jauh lebih murah dengan cache.

Kami mewujudkan gagasan ini menjadi sistem yang benar-benar kami pakai di internal: AI tim membagikan hasil penelusuran sebagai ringkasan, memangkas token yang selama ini terpakai untuk membaca ulang. Namanya SmartOptimizer. Karena ringkasan dirapikan di server AI yang dipasang di dalam perusahaan kami, proses perapiannya sendiri tidak menimbulkan biaya eksternal. Token yang dihemat dapat dilihat dalam angka, per bulan dan per proyek.

Tidak ada yang bisa memastikan ke mana arah biaya AI. Satu-satunya kepastian adalah perusahaan yang mengurangi pembacaan ulang lebih diuntungkan ke arah mana pun.

Catatan: angka dalam artikel ini adalah perkiraan per Agustus 2026, berdasarkan pengungkapan publik dan pemberitaan. Harga dan ketentuan dapat berubah. Silakan periksa informasi resmi masing-masing penyedia.

Tag:

🌐 Bahasa Indonesia