Saltar para o conteúdo principal
POST
Cria vetores de embedding a partir de entradas de texto ou mídia. Requisições somente de texto retornam um vetor por entrada, útil para recuperação de informação, busca semântica, clustering, classificação e RAG. Requisições contendo mídia (imagens, áudio ou vídeo como data URIs base64) fundem todas as entradas em um único vetor cross-modal — envie cada ativo em sua própria requisição quando precisar de um vetor por ativo. Compatível com o formato da API OpenAI Embeddings. Streaming não é suportado neste endpoint.

Autenticação

Authorization
string
obrigatório
Token Bearer. Use sua chave de API como token Bearer no cabeçalho Authorization.Formato: Bearer <SUNRA_KEY>

Requisição

Este endpoint espera um objeto.
model
string
obrigatório
ID do modelo de embedding a ser usado, por exemplo google/gemini-embedding-2. Consulte a página de modelos para ver os modelos de embedding disponíveis.
input
string | string[]
obrigatório
Entradas a serem convertidas em embedding, como uma única string ou um array de strings. Entradas somente de texto são processadas de forma independente, retornando um vetor por entrada na ordem das entradas. Entradas de mídia são passadas como data URIs base64 (data:image/png;base64,…, data:audio/mpeg;base64,…, data:video/mp4;base64,…) e podem ser misturadas com texto — mas qualquer requisição contendo mídia retorna um único vetor fundido para todas as entradas combinadas. Limites (do upstream): no máximo 6 imagens por requisição, vídeo de até 120 segundos e um orçamento combinado de 8.192 tokens em todas as modalidades (tokens de texto; cada imagem conta 258 tokens, áudio 25 tokens/segundo, vídeo 66 tokens/segundo).
dimensions
integer
O número de dimensões dos embeddings de saída. Suportado apenas por modelos com dimensões de saída flexíveis (Matryoshka Representation Learning). Para google/gemini-embedding-2, o padrão é 3072, e valores de 128 a 3072 são suportados. Valores menores truncam o vetor preservando a maior parte da qualidade semântica.
encoding_format
string
O formato dos embeddings retornados. Pode ser float (padrão) ou base64.

Resposta

object
string
Sempre list.
data
object[]
Uma lista de objetos de embedding, um por entrada, na ordem das entradas.
model
string
O modelo usado para criar os embeddings.
usage
object
Uso de tokens da requisição. Embeddings são cobrados apenas pelos tokens de entrada, com tarifas específicas por modalidade (consulte a página do modelo para ver os preços). Requisições com mídia incluem contagens de tokens por modalidade.