Layermod

Chat Completions

Chat-Nachrichten senden und Antworten erhalten

POST /v1/chat/completions

Sendet Chat-Nachrichten an ein Modell und erhält eine Antwort.

Anfrage

Request Body
{
  "model": "gpt-5.4",
  "messages": [
    { "role": "system", "content": "Du bist ein hilfreicher Assistent." },
    { "role": "user", "content": "Hallo!" }
  ],
  "temperature": 0.7,
  "top_p": 1,
  "max_tokens": 1024,
  "stream": false,
  "tools": [
    {
      "type": "function",
      "function": {
        "name": "get_weather",
        "description": "Wetter für einen Ort abrufen",
        "parameters": {
          "type": "object",
          "properties": {
            "location": { "type": "string" }
          },
          "required": ["location"]
        },
        "strict": false
      }
    }
  ]
}
ParameterTypPflichtBeschreibung
modelstringJaModell-ID (z.B. gpt-5.4)
messagesarrayJaArray von Nachrichten mit role und content
temperaturenumberNeinKreativität der Antwort (0–2, Standard: 1)
top_pnumberNeinNucleus-Sampling (0–1)
max_tokensnumberNeinMaximale Anzahl der generierten Tokens
streambooleanNeinStreaming über SSE aktivieren (Standard: false)
toolsarrayNeinVerfügbare Funktionen für Tool-Aufrufe (OpenAI-Format)

Antwort

200 OK
{
  "model": "gpt-5.4",
  "choices": [
    {
      "message": {
        "role": "assistant",
        "content": "Hallo! Wie kann ich dir helfen?"
      }
    }
  ],
  "usage": {
    "prompt_tokens": 20,
    "completion_tokens": 10,
    "total_tokens": 30
  }
}

Streaming

Bei stream: true werden die Antworten als Server-Sent Events geliefert. Jedes Event enthält ein Chunk-Objekt mit dem generierten Text.

Fehlercodes

CodeBeschreibung
400Ungültige Anfrage
402Unzureichendes Guthaben
503Anbieter nicht konfiguriert

On this page