Inferenz-API
Chat-Completion erzeugen
Erzeugt eine Antwort des Modells auf eine Nachrichtenfolge — mit Streaming, Werkzeugaufrufen und strukturierter Ausgabe wie bei OpenAI.
POSThttps://api.futureway.ai/v1/chat/completions
Authentifizierung
- Header
Authorization: Bearer $FUTUREWAY_API_KEY- Scope
- inferenceInferenz-API: Chat-Completions, Embeddings, Modellliste.
- Key-Arten
- persönlich · Service
- Format
- OpenAI-kompatibel
- Streaming
- ja — stream: true liefert Server-Sent Events
Details zu Keys und Scopes unter Authentifizierung.
Parameter
| Name | Typ | Pflicht | Beschreibung |
|---|---|---|---|
| model | string | ja | Modell-Alias, z. B. futureway-smart. |
| messages | array | ja | Die Konversation in Reihenfolge; mindestens eine Nachricht. |
| messages[].role | stringsystem | user | assistant | tool | ja | Wer spricht. |
| messages[].content | string | ja | Text der Nachricht; Bilder als Content-Parts wie bei OpenAI, wenn das Modell Bilder kann. |
| stream | boolean | nein | Antwort als Server-Sent Events, sobald Tokens entstehen. |
| temperature | number | nein | Zufälligkeit 0–2; Standard des Modells, wenn weggelassen. |
| max_tokens | integer | nein | Obergrenze für die Antwortlänge. |
| tools | array | nein | Werkzeugdefinitionen im OpenAI-Function-Format. |
| tool_choice | string | nein | auto, none oder ein bestimmtes Werkzeug. |
| response_format | object | nein | Strukturierte Ausgabe, z. B. { "type": "json_object" }. |
Beispiel-Anfrage
curl https://api.futureway.ai/v1/chat/completions \
-H "Authorization: Bearer $FUTUREWAY_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "futureway-smart",
"messages": [
{
"role": "user",
"content": "Was ist die Hauptstadt von Frankreich?"
}
]
}'Antwort
200
{
"id": "chatcmpl-8f3c…",
"object": "chat.completion",
"created": 1757750400,
"model": "futureway-smart",
"choices": [
{
"index": 0,
"message": {
"role": "assistant",
"content": "Die Hauptstadt von Frankreich ist Paris."
},
"finish_reason": "stop"
}
],
"usage": {
"prompt_tokens": 14,
"completion_tokens": 9,
"total_tokens": 23
}
}Fehler
| Status | Code | Beschreibung |
|---|---|---|
| 401 | unauthorized | Kein, ungültiger oder widerrufener API-Key. |
| 400 | invalid_request_error | Anfrage ungültig (fehlende Pflichtfelder, unbekannter Parameter, Body zu groß). |
| 404 | model_not_found | Unbekannte Modell-ID oder ein Modell, das dieser Key nicht ansprechen darf. |
| 429 | rate_limit_error | Zu viele Anfragen im Zeitfenster; retry-after nennt die Wartezeit. |
| 429 | budget_exceeded | Das Nutzungskontingent der Organisation ist aufgebraucht — kein Retry hilft, bis das Fenster zurückgesetzt ist. |
| 503 | service_unavailable | Das Modell ist vorübergehend nicht erreichbar — mit Backoff wiederholen. |
Formate und Umgang mit Fehlern unter Fehler.