Chat Completions
Chat-Nachrichten senden und Antworten erhalten
POST /v1/chat/completions
Sendet Chat-Nachrichten an ein Modell und erhält eine Antwort.
Anfrage
{
"model": "gpt-5.4",
"messages": [
{ "role": "system", "content": "Du bist ein hilfreicher Assistent." },
{ "role": "user", "content": "Hallo!" }
],
"temperature": 0.7,
"top_p": 1,
"max_tokens": 1024,
"stream": false,
"tools": [
{
"type": "function",
"function": {
"name": "get_weather",
"description": "Wetter für einen Ort abrufen",
"parameters": {
"type": "object",
"properties": {
"location": { "type": "string" }
},
"required": ["location"]
},
"strict": false
}
}
]
}| Parameter | Typ | Pflicht | Beschreibung |
|---|---|---|---|
model | string | Ja | Modell-ID (z.B. gpt-5.4) |
messages | array | Ja | Array von Nachrichten mit role und content |
temperature | number | Nein | Kreativität der Antwort (0–2, Standard: 1) |
top_p | number | Nein | Nucleus-Sampling (0–1) |
max_tokens | number | Nein | Maximale Anzahl der generierten Tokens |
stream | boolean | Nein | Streaming über SSE aktivieren (Standard: false) |
tools | array | Nein | Verfügbare Funktionen für Tool-Aufrufe (OpenAI-Format) |
Antwort
{
"model": "gpt-5.4",
"choices": [
{
"message": {
"role": "assistant",
"content": "Hallo! Wie kann ich dir helfen?"
}
}
],
"usage": {
"prompt_tokens": 20,
"completion_tokens": 10,
"total_tokens": 30
}
}Streaming
Bei stream: true werden die Antworten als Server-Sent Events geliefert. Jedes Event enthält ein Chunk-Objekt mit dem generierten Text.
Fehlercodes
| Code | Beschreibung |
|---|---|
400 | Ungültige Anfrage |
402 | Unzureichendes Guthaben |
503 | Anbieter nicht konfiguriert |