Inferenz-API
Embeddings berechnen
Berechnet Vektor-Embeddings für Text, etwa für eigene Suche oder RAG.
POSThttps://api.futureway.ai/v1/embeddings
Authentifizierung
- Header
Authorization: Bearer $FUTUREWAY_API_KEY- Scope
- inferenceInferenz-API: Chat-Completions, Embeddings, Modellliste.
- Key-Arten
- persönlich · Service
- Format
- OpenAI-kompatibel
Details zu Keys und Scopes unter Authentifizierung.
Parameter
| Name | Typ | Pflicht | Beschreibung |
|---|---|---|---|
| model | string | ja | Embedding-Alias, z. B. futureway-embed. |
| input | string | ja | Der einzubettende Text. |
Beispiel-Anfrage
curl https://api.futureway.ai/v1/embeddings \
-H "Authorization: Bearer $FUTUREWAY_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "futureway-embed",
"input": "Dein Text hier."
}'Antwort
200
{
"object": "list",
"data": [
{
"object": "embedding",
"index": 0,
"embedding": [
0.0123,
-0.0456,
"…"
]
}
],
"model": "futureway-embed",
"usage": {
"prompt_tokens": 4,
"total_tokens": 4
}
}Fehler
| Status | Code | Beschreibung |
|---|---|---|
| 401 | unauthorized | Kein, ungültiger oder widerrufener API-Key. |
| 400 | invalid_request_error | Anfrage ungültig (fehlende Pflichtfelder, unbekannter Parameter, Body zu groß). |
| 404 | model_not_found | Unbekannte Modell-ID oder ein Modell, das dieser Key nicht ansprechen darf. |
| 429 | rate_limit_error | Zu viele Anfragen im Zeitfenster; retry-after nennt die Wartezeit. |
| 429 | budget_exceeded | Das Nutzungskontingent der Organisation ist aufgebraucht — kein Retry hilft, bis das Fenster zurückgesetzt ist. |
| 503 | service_unavailable | Das Modell ist vorübergehend nicht erreichbar — mit Backoff wiederholen. |
Formate und Umgang mit Fehlern unter Fehler.