Model & Harga
Apa arti akhiran :free, bagaimana penggunaan ditagih, dan mengapa sebuah model terkadang menghilang.
Halaman Model mencantumkan setiap model dengan jendela konteks, harga per token, endpoint yang didukung, dan filter kemampuan seperti pemanggilan alat dan input gambar. Setiap model memiliki halamannya sendiri dengan contoh kode siap salin-tempel. Tidak setiap model gratis mendukung pemanggilan alat atau visi, jadi periksa lencana kemampuan sebelum menyambungkannya ke agen pengodean.

Rankings menunjukkan model gratis mana yang benar-benar andal berdasarkan hasil uji komunitas, dan Status memantau kesehatan penyedia secara langsung.
Baru di sini? Mendapatkan kunci dan mengirim permintaan pertama hanya butuh semenit di Panduan cepat
Model gratis membawa akhiran :free, misalnya gpt-oss-120b:free
Model :free hanya diarahkan ke penyedia upstream gratis dan tidak pernah menyentuh saldo Anda. Nama dasar yang sama tanpa akhiran adalah versi berbayar: stabil, tanpa batas, dan ditagih per token. Keduanya bisa berdampingan, jadi beralih dari gratis ke berbayar adalah perubahan satu string.
Model gratis memiliki dua lapis batasan. Penyedia upstream membatasi kumpulan gratis mereka, dan di atas itu kami menambahkan batas kami sendiri per pengguna dan per model, agar satu pengguna berat tidak menghabiskan kumpulan bersama. Harapkan respons 429 pada jam sibuk, dan gunakan model berbayar saat Anda membutuhkan keandalan.
Batas pasti, header, dan panduan coba ulang terdokumentasi di Kesalahan & Batas Laju
Setiap model dirutekan lewat satu atau beberapa grup penyedia, masing-masing dengan harganya; tabel Group Pricing di halaman model mencantumkan semuanya. Ketersediaan tinggi menghasilkan diskon otomatis, dan failover ke grup lain bisa menggeser harga efektif.

Untuk mengunci model ke grup tertentu beserta tarifnya, lihat Penyematan Grup
Sebagian besar model menagih per token, dengan harga input dan output terpisah. Beberapa model (kebanyakan gambar dan video) justru menagih harga tetap per panggilan. Apa yang Anda lihat di halaman model adalah apa yang Anda bayar: tanpa langganan, tanpa biaya tersembunyi, saldo Anda hanya berkurang per permintaan.
Halaman Harga memiliki opsi isi ulang saat ini; setiap halaman model menampilkan harga per token secara langsung.
Untuk model yang mendukung caching prompt (Claude dan lainnya), prefiks prompt yang berulang ditagih dengan tarif input tercache yang lebih rendah, sementara menulis entri cache baru sedikit lebih mahal daripada token input biasa (sekitar 1,25x).
Caching bersifat otomatis. Beban kerja dengan prompt sistem yang panjang dan stabil (agen, preset RP) paling diuntungkan, tanpa perlu konfigurasi.
Permintaan otomatis beralih ke grup penyedia berikutnya saat satu grup mencapai batas atau tumbang. Model baru hilang dari katalog jika semua kanal yang melayaninya mati.
Model yang hilang saat beban tinggi itu wajar, bukan gangguan: ia kembali sendiri begitu satu kanal pulih, biasanya dalam hitungan menit.
Kunci yang menyematkan grup penyedia hanya failover di dalam grup sematannya, lihat Penyematan Grup
Agar diberi tahu begitu ia kembali, pantau di Notifikasi