FutureWay AI

Inferenz-API

Chat-Completion erzeugen

Erzeugt eine Antwort des Modells auf eine Nachrichtenfolge — mit Streaming, Werkzeugaufrufen und strukturierter Ausgabe wie bei OpenAI.

POSThttps://api.futureway.ai/v1/chat/completions

Authentifizierung

Header
Authorization: Bearer $FUTUREWAY_API_KEY
Scope
inferenceInferenz-API: Chat-Completions, Embeddings, Modellliste.
Key-Arten
persönlich · Service
Format
OpenAI-kompatibel
Streaming
ja — stream: true liefert Server-Sent Events

Details zu Keys und Scopes unter Authentifizierung.

Parameter

NameTypPflichtBeschreibung
modelstringjaModell-Alias, z. B. futureway-smart.
messagesarrayjaDie Konversation in Reihenfolge; mindestens eine Nachricht.
messages[].rolestringsystem | user | assistant | tooljaWer spricht.
messages[].contentstringjaText der Nachricht; Bilder als Content-Parts wie bei OpenAI, wenn das Modell Bilder kann.
streambooleanneinAntwort als Server-Sent Events, sobald Tokens entstehen.
temperaturenumberneinZufälligkeit 0–2; Standard des Modells, wenn weggelassen.
max_tokensintegerneinObergrenze für die Antwortlänge.
toolsarrayneinWerkzeugdefinitionen im OpenAI-Function-Format.
tool_choicestringneinauto, none oder ein bestimmtes Werkzeug.
response_formatobjectneinStrukturierte Ausgabe, z. B. { "type": "json_object" }.

Beispiel-Anfrage

curl https://api.futureway.ai/v1/chat/completions \
  -H "Authorization: Bearer $FUTUREWAY_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
  "model": "futureway-smart",
  "messages": [
    {
      "role": "user",
      "content": "Was ist die Hauptstadt von Frankreich?"
    }
  ]
}'

Antwort

200

{
  "id": "chatcmpl-8f3c…",
  "object": "chat.completion",
  "created": 1757750400,
  "model": "futureway-smart",
  "choices": [
    {
      "index": 0,
      "message": {
        "role": "assistant",
        "content": "Die Hauptstadt von Frankreich ist Paris."
      },
      "finish_reason": "stop"
    }
  ],
  "usage": {
    "prompt_tokens": 14,
    "completion_tokens": 9,
    "total_tokens": 23
  }
}

Fehler

StatusCodeBeschreibung
401unauthorizedKein, ungültiger oder widerrufener API-Key.
400invalid_request_errorAnfrage ungültig (fehlende Pflichtfelder, unbekannter Parameter, Body zu groß).
404model_not_foundUnbekannte Modell-ID oder ein Modell, das dieser Key nicht ansprechen darf.
429rate_limit_errorZu viele Anfragen im Zeitfenster; retry-after nennt die Wartezeit.
429budget_exceededDas Nutzungskontingent der Organisation ist aufgebraucht — kein Retry hilft, bis das Fenster zurückgesetzt ist.
503service_unavailableDas Modell ist vorübergehend nicht erreichbar — mit Backoff wiederholen.

Formate und Umgang mit Fehlern unter Fehler.

Diese Website nutzt keine Cookies und erstellt keine Nutzerprofile — darum gibt es hier auch keinen Cookie-Banner. Die anonyme Reichweitenmessung läuft auf unseren eigenen Servern in Deutschland, ohne Analyse-Dienst.

Mehr erfahren
POST /v1/chat/completions — Chat-Completion erzeugen | FutureWay AI