Skip to main content
POST
Sendet eine Anfrage für eine Modellantwort für die gegebene Chat-Konversation. Unterstützt sowohl Streaming- als auch Nicht-Streaming-Modi. Kompatibel mit dem OpenAI Chat Completions API-Format.

Authentifizierung

string
erforderlich
Bearer-Token. Verwenden Sie Ihren API-Schlüssel als Bearer-Token im Authorization-Header.Format: Bearer <SUNRA_KEY>

Anfrage

Dieser Endpunkt erwartet ein JSON-Objekt.
string
erforderlich
Das Modell, das für die Vervollständigung verwendet werden soll. Verfügbare Modelle finden Sie unter sunra.ai/models.
object[]
erforderlich
Liste der Nachrichten für die Konversation.
boolean
Standard:false
Wenn auf true gesetzt, werden partielle Nachrichtendeltas als Server-Sent Events (SSE) gesendet.
integer
Die maximale Anzahl der zu generierenden Tokens in der Vervollständigung.
number
Sampling-Temperatur zwischen 0 und 2. Höhere Werte wie 0.8 machen die Ausgabe zufälliger, niedrigere Werte wie 0.2 machen sie fokussierter und deterministischer.
number
Nucleus-Sampling-Parameter (0-1). Eine Alternative zum Temperatur-Sampling, bei der das Modell die Tokens mit der top_p-Wahrscheinlichkeitsmasse berücksichtigt.
number
Zahl zwischen -2.0 und 2.0. Positive Werte bestrafen neue Tokens basierend auf ihrer bestehenden Häufigkeit im bisherigen Text und verringern die Wahrscheinlichkeit, dass das Modell dieselbe Zeile wörtlich wiederholt.
number
Zahl zwischen -2.0 und 2.0. Positive Werte bestrafen neue Tokens basierend darauf, ob sie im bisherigen Text vorkommen, und erhöhen die Wahrscheinlichkeit, dass das Modell über neue Themen spricht.
string | string[]
Bis zu 4 Sequenzen, bei denen die API die weitere Token-Generierung stoppt.

Antwort

Erfolgreiche Chat-Vervollständigungs-Antwort.
string
Eindeutiger Vervollständigungs-Bezeichner.
string
Objekttyp. Immer chat.completion.
integer
Unix-Zeitstempel der Erstellung.
string
Das für die Vervollständigung verwendete Modell.
object[]
Liste der Vervollständigungsoptionen.
object
Token-Nutzungsstatistiken.