Pilih Flash atau Pro berdasarkan pekerjaan yang perlu diuji
Gunakan katalog live sebagai sumber ID model yang benar-benar dapat dipanggil. Untuk pekerjaan singkat dan berulang, jadikan Flash salah satu kandidat evaluasi. Untuk pekerjaan yang membutuhkan jawaban lebih panjang atau lebih terlibat, bandingkan Pro dengan input representatif yang sama.
Ini pilihan workload, bukan jaminan kemampuan. Ukur kualitas, latensi, campuran token, dan kasus gagal yang relevan dengan produk Anda sebelum mengarahkan traffic.
Token input dan output punya harga berbeda
Satu call mengirim token input dan menerima token output. Penyedia biasanya menetapkan harga berbeda per satu juta token untuk masing-masing arah, jadi keduanya harus dihitung.
Context panjang dengan jawaban singkat dominan di input. Prompt singkat yang menghasilkan kode panjang bisa dominan di output. Hitung keduanya, bukan hanya panjang jawaban.
Gunakan harga jual live
EidosStack mempublikasikan harga jual IDR dari kartu harga aktif. Kartu dikunci sebelum request berjalan sehingga perubahan harga tidak mengubah request yang sedang diproses.
Ketersediaan tetap best-effort karena supply upstream dapat berubah. Periksa katalog live dan gunakan budget per key untuk membatasi biaya.
Contoh request minimal
Gunakan ID model persis seperti yang tampil di katalog live. Contoh ini hanya menunjukkan bentuk request. Atur batas output dan uji respons dengan prompt representatif Anda sebelum dipakai di produksi.
POST /chat/completions
Authorization: Bearer $EIDOSSTACK_API_KEY
Content-Type: application/json
{
"model": "deepseek-v4-pro",
"messages": [{ "role": "user", "content": "Ringkas teks ini." }],
"max_tokens": 500
}