Skip to main content
POST
Envoie une requête pour obtenir une réponse du modèle pour la conversation de chat donnée. Prend en charge les modes streaming et non-streaming. Compatible avec le format de l’API OpenAI Chat Completions.

Authentification

string
requis
Jeton Bearer. Utilisez votre clé API comme jeton Bearer dans l’en-tête Authorization.Format : Bearer <SUNRA_KEY>

Requête

Cet endpoint attend un objet.
object[]
requis
Liste des messages pour la conversation.
string
requis
Le modèle à utiliser pour la complétion. Parcourez les modèles disponibles sur sunra.ai/models.
boolean
défaut:false
Si défini sur true, des deltas de messages partiels seront envoyés sous forme d’événements server-sent (SSE).
integer
Le nombre maximum de tokens à générer dans la complétion. La longueur totale des tokens d’entrée et des tokens générés est limitée par la longueur de contexte du modèle.
number
défaut:1
Température d’échantillonnage entre 0 et 2. Des valeurs plus élevées comme 0.8 rendent la sortie plus aléatoire, des valeurs plus basses comme 0.2 la rendent plus ciblée et déterministe.
number
défaut:1
Paramètre d’échantillonnage par noyau (0-1). Une alternative à l’échantillonnage par température où le modèle considère les tokens avec une masse de probabilité top_p.
number
défaut:0
Nombre entre -2.0 et 2.0. Les valeurs positives pénalisent les nouveaux tokens en fonction de leur fréquence existante dans le texte jusqu’à présent, diminuant la probabilité que le modèle répète la même ligne mot pour mot.
number
défaut:0
Nombre entre -2.0 et 2.0. Les valeurs positives pénalisent les nouveaux tokens en fonction de leur apparition dans le texte jusqu’à présent, augmentant la probabilité que le modèle aborde de nouveaux sujets.
string | string[]
Jusqu’à 4 séquences où l’API cessera de générer des tokens supplémentaires.
integer
défaut:1
Le nombre de choix de complétion de chat à générer pour chaque message d’entrée.
boolean
défaut:false
Indique s’il faut retourner les log-probabilités des tokens de sortie. Si vrai, retourne les log-probabilités de chaque token de sortie retourné dans le contenu du message.
integer
Un entier entre 0 et 20 spécifiant le nombre de tokens les plus probables à retourner à chaque position de token. logprobs doit être défini sur true si ce paramètre est utilisé.
object
Un objet spécifiant le format que le modèle doit produire.
integer
Si spécifié, le système fera un effort optimal pour échantillonner de manière déterministe, de sorte que les requêtes répétées avec le même seed et les mêmes paramètres devraient retourner le même résultat.
object[]
Une liste d’outils que le modèle peut appeler. Actuellement, seules les fonctions sont prises en charge comme outil.
string | object
Contrôle quel outil (le cas échéant) est appelé par le modèle. none signifie que le modèle n’appellera aucun outil. auto signifie que le modèle peut choisir entre générer un message ou appeler des outils. required signifie que le modèle doit appeler un ou plusieurs outils. Peut également spécifier une fonction particulière via {"type": "function", "function": {"name": "my_function"}}.
boolean
défaut:true
Indique s’il faut activer l’appel de fonctions en parallèle lors de l’utilisation d’outils.
string
Un identifiant unique représentant votre utilisateur final, qui peut aider à surveiller et détecter les abus.

Réponse

Réponse de complétion de chat réussie.
string
Un identifiant unique pour la complétion de chat.
string
Le type d’objet. Toujours chat.completion.
integer
L’horodatage Unix (en secondes) de la création de la complétion de chat.
string
Le modèle utilisé pour la complétion de chat.
object[]
Une liste de choix de complétion de chat. Peut contenir plus d’un élément si n est supérieur à 1.
object
Statistiques d’utilisation pour la requête de complétion.
string | null
Cette empreinte représente la configuration backend avec laquelle le modèle s’exécute. Peut être utilisée avec le paramètre seed pour comprendre quand des modifications du backend ont été effectuées.