Skip to main content

Isi Permintaan

string
wajib
ID model yang akan digunakan. Lihat Models untuk opsi yang tersedia.
array
wajib
Daftar pesan yang membentuk percakapan.Setiap objek pesan berisi:
  • role (string): system, user, atau assistant
  • content (string | array): Konten pesan
Ketika content adalah array, TokenLab mendukung blok multimodal terstruktur untuk model yang kompatibel:
  • text: { "type": "text", "text": "..." }
  • gambar: { "type": "image_url", "image_url": { "url": "https://..." } }
  • video: { "type": "video_url", "video_url": { "url": "https://..." } }
  • audio: { "type": "audio_url", "audio_url": { "url": "https://..." } }
Untuk lalu lintas produksi multimodal, utamakan URL publik https. TokenLab akan menerjemahkan blok media ini ke bentuk permintaan spesifik provider yang diperlukan oleh model fisik yang diarahkan.
number
default:"1"
Temperatur sampling antara 0 dan 2. Nilai yang lebih tinggi membuat keluaran lebih acak.
integer
Jumlah maksimum token yang akan dihasilkan.
boolean
default:"false"
Jika true, delta pesan parsial akan dikirim sebagai event SSE.
object
Opsi untuk streaming. Setel include_usage: true untuk menerima pemakaian token dalam potongan stream.
number
default:"1"
Parameter nucleus sampling. Kami menyarankan mengubah ini atau temperature, bukan keduanya.
number
default:"0"
Angka antara -2.0 dan 2.0. Nilai positif memberi penalti pada token yang berulang.
number
default:"0"
Angka antara -2.0 dan 2.0. Nilai positif memberi penalti pada token yang sudah ada di teks.
string | array
Hingga 4 urutan di mana API akan berhenti menghasilkan token.
array
Daftar tools yang mungkin dipanggil model (pemanggilan fungsi).
string | object
Mengontrol bagaimana model menggunakan tools. Opsi: auto, none, required, atau objek tool tertentu.
boolean
default:"true"
Menentukan apakah pemanggilan fungsi paralel diaktifkan. Setel ke false untuk memanggil fungsi secara berurutan.
integer
Token maksimum untuk penyelesaian. Alternatif untuk max_tokens, berguna untuk keluarga model terbaru yang mendukung reasoning.
string
Tingkat usaha reasoning untuk model yang mendukung reasoning. Opsi: low, medium, high.
integer
Seed acak untuk sampling deterministik.
integer
default:"1"
Jumlah penyelesaian yang akan dihasilkan (1-128).
boolean
Apakah akan mengembalikan log probabilitas.
integer
Jumlah top log probabilitas yang dikembalikan (0-20). Memerlukan logprobs: true.
integer
Parameter sampling Top-K (untuk model Anthropic/Gemini).
object
Spesifikasi format respons. Gunakan {"type": "json_object"} untuk mode JSON. Perlakukan {"type": "json_schema", "json_schema": {...}} sebagai jalur best-effort yang bergantung pada model yang dipilih dan perilaku routing.
object
Mengubah kemungkinan token tertentu muncul. Pemetaan ID token (sebagai string) ke nilai bias dari -100 sampai 100.
string
Identifier unik yang merepresentasikan pengguna akhir Anda untuk pemantauan penyalahgunaan.

Respons

string
Pengidentifikasi unik untuk penyelesaian.
string
Selalu chat.completion.
integer
Timestamp Unix saat penyelesaian dibuat.
string
Model yang digunakan untuk penyelesaian.
array
Daftar pilihan penyelesaian.Setiap pilihan berisi:
  • index (integer): Indeks pilihan
  • message (object): Pesan yang dihasilkan
  • finish_reason (string): Alasan model berhenti (stop, length, tool_calls)
object
Statistik penggunaan token.
  • prompt_tokens (integer): Token dalam prompt
  • completion_tokens (integer): Token dalam penyelesaian
  • total_tokens (integer): Total token yang digunakan

Contoh Multimodal