Anggar kos LLM API anda sebelum membuat komitmen
Pilih model, masukkan volum token bulanan, dan tetapkan kadar hit cache. Kalkulator menggunakan pengganda sebenar yang kami terbitkan pada asas 0.4 CNY setiap 1M token, tanpa perlu daftar.
Bagaimana kalkulator ini berbeza daripada meneka
Kebanyakan anggaran kos dibuat sekadar agak-agak. Yang ini berjalan atas pengganda setiap model yang sama seperti yang dicaj oleh gateway sebenarnya.
| Kalkulator ini | Anggaran kasar | |
|---|---|---|
| Sumber kadar | Pengganda setiap model yang diterbitkan secara langsung | Ingatan atau satu catatan blog |
| Pemodelan cache | Kadar hit cache boleh laras dari lantai 0.1x | Biasanya diabaikan |
| Mata wang | CNY, sepadan dengan cara anda dicaj | Campuran USD/CNY |
| Liputan model | Setiap model teks yang dihalakan gateway | Satu atau dua model |
Untuk siapa ini
Berguna jika anda
- Mahukan anggaran kos yang boleh dipertahankan sebelum memindahkan trafik ke sesuatu model
- Perlu membandingkan model 0.5x dengan model terkehadapan pada volum yang sama
- Mahu melihat bagaimana kadar hit cache lebih tinggi menurunkan kadar berkesan anda
- Sedang membelanjawankan perbelanjaan LLM bulanan dalam CNY
Kurang berguna jika anda
- Perlukan angka dalam USD, kalkulator ini berfungsi dalam CNY
- Mengecaj setiap imej atau setiap panggilan dan bukan setiap token (baris itu dikecualikan)
- Mahukan sebut harga yang dijamin, penggunaan sebenar bergantung pada prompt dan output anda
- Perlukan harga asli pembekal untuk model yang tidak dihalakan oleh gateway
Cara membaca keputusan
Pengiraannya mudah dan telus, tetapi anggaran tetap anggaran.
- Kos = kadar berkesan × volum token anda. Kadar berkesan menggabungkan kadar biasa dan kadar cache mengikut peratus hit cache anda.
- Kadar cache menggunakan lantai 0.1x pengganda model yang didokumenkan; penjimatan cache sebenar bergantung pada penggunaan semula prompt anda.
- Bilangan token anda yang anggarkan sendiri, input campur output. Penggunaan sebenar berbeza mengikut panjang prompt dan respons.
- Model setiap imej dan setiap panggilan dikecualikan kerana ia tidak dicaj setiap token.
Peraturan di sebalik angka
Tiada apa-apa yang disembunyikan di sini. Kadar setiap model ialah penggandanya didarab dengan asas.
Ini ialah anggaran berdasarkan kadar yang diterbitkan dan input anda, bukan sebut harga. Kos sebenar bergantung pada penggunaan token sebenar dan kelakuan cache dalam beban kerja anda.
Anggaran sahaja, berdasarkan pengganda yang diterbitkan dan input anda. Model setiap imej dan setiap panggilan dikecualikan.
Kalkulator harga — Soalan Lazim
Dari mana datangnya kadar?
Daripada pengganda setiap model yang diterbitkan gateway, dikenakan pada asas 0.4 CNY setiap 1M token. Peraturan yang sama seperti yang disenaraikan halaman harga.
Apakah fungsi kadar hit cache?
Input cache dicaj dari lantai 0.1x pengganda model. Menaikkan peratus hit cache menurunkan kadar berkesan gabungan anda.
Adakah keputusan ini harga yang dijamin?
Tidak. Ia anggaran. Kos sebenar anda bergantung pada bilangan token input dan output sebenar dan berapa banyak input yang dicache.
Mengapa semuanya dalam CNY?
Kerana pengebilan dan kredit prabayar dinilaikan dalam CNY. Kalkulator sepadan dengan cara anda sebenarnya dicaj.
Berpuas hati dengan anggaran?
Beli kunci dan mula, kredit prabayar, tanpa tamat tempoh.