LLM
Create embeddings
POST
Membuat vektor embedding dari input teks atau media. Permintaan yang hanya berisi teks mengembalikan satu vektor per input, berguna untuk retrieval, pencarian semantik, clustering, klasifikasi, dan RAG. Permintaan yang berisi media (gambar, audio, atau video sebagai base64 data URI) menggabungkan semua input menjadi satu vektor lintas-modal — embed setiap aset dalam permintaannya masing-masing jika Anda membutuhkan satu vektor per aset. Kompatibel dengan format OpenAI Embeddings API. Streaming tidak didukung pada endpoint ini.
Autentikasi
Bearer token. Gunakan kunci API Anda sebagai bearer token di header Authorization.Format:
Bearer <SUNRA_KEY>Permintaan
Endpoint ini menerima sebuah objek.ID model embedding yang akan digunakan, mis.
google/gemini-embedding-2. Lihat halaman model untuk model embedding yang tersedia.Input yang akan di-embed, sebagai satu string atau array string. Input yang hanya berupa teks di-embed secara independen, mengembalikan satu vektor per input dalam urutan input. Input media diberikan sebagai base64 data URI (
data:image/png;base64,…, data:audio/mpeg;base64,…, data:video/mp4;base64,…) dan dapat dicampur dengan teks — tetapi setiap permintaan yang berisi media mengembalikan satu vektor gabungan untuk seluruh input sekaligus. Batasan (upstream): maksimal 6 gambar per permintaan, video hingga 120 detik, dan anggaran gabungan 8.192 token di seluruh modalitas (token teks; setiap gambar dihitung 258 token, audio 25 token/detik, video 66 token/detik).Jumlah dimensi untuk embedding output. Hanya didukung oleh model dengan dimensi output fleksibel (Matryoshka Representation Learning). Untuk
google/gemini-embedding-2 nilai default-nya adalah 3072, dan nilai dari 128 hingga 3072 didukung. Nilai yang lebih kecil memotong vektor sambil mempertahankan sebagian besar kualitas semantik.Format embedding yang dikembalikan. Antara
float (default) atau base64.Respons
Selalu
list.Daftar objek embedding, satu per input, dalam urutan input.
Model yang digunakan untuk membuat embedding.
Penggunaan token untuk permintaan ini. Embedding hanya ditagih berdasarkan token input, dengan tarif spesifik per modalitas (lihat halaman model untuk harga). Permintaan media menyertakan jumlah token per modalitas.