Eine OpenAI-kompatible API. Auf europäischen Modellen.
Basis-URL und Key austauschen — Ihr Code bleibt. Das Chat-Completions-Format ist der De-facto-Standard, also laufen vorhandene SDKs, CLI-Werkzeuge und Editor-Integrationen unverändert weiter, nur eben gegen EU-Infrastruktur.
In drei Schritten zum ersten Call
Kein Onboarding-Ticket, kein Vertrieb dazwischen: Key erstellen, Basis-URL setzen, losschicken.
Basis-URL und OpenAI-Kompatibilität
Ein Endpunkt, ein Standardformat. Was Sie heute gegen OpenAI schreiben, läuft hier weiter.
Basis-URL
https://api.futureway.ai/v1Weitere Pfade hängen die Clients selbst an: /chat/completions, /embeddings und /models.
Endpunkte
Drei Endpunkte — mehr braucht es nicht.
| Endpunkt | Wofür |
|---|---|
| POST /v1/chat/completions | Antworten erzeugen — am Stück oder gestreamt, je nach Modell mit Tool-Calling und Bildeingabe. |
| POST /v1/embeddings | Text in Vektoren umwandeln, etwa für eigene Suche, Klassifikation und Ähnlichkeitsvergleiche. |
| GET /v1/models | Auflisten, welche Modell-Aliase Ihr Key aufrufen darf. |
Das ist die vollständige v1-Oberfläche. Audio-Transkription gehört bewusst nicht dazu: Sie läuft in der Plattform, nicht über Kunden-Keys.
Modell-Aliase
Sie rufen stabile Produkt-Aliase auf statt roher Modell-IDs.
| Alias | Modell | Verarbeitung | Kontext | Fähigkeiten |
|---|---|---|---|---|
| futureway-fastChat | Mistral Small 3.2 24B Instruct | Paris, FR 🇪🇺 | 128.000 Tokens | BilderTools |
| futureway-smartChat | Mistral Medium 3.5 128B | Paris, FR 🇪🇺 | 180.000 Tokens | BilderTools |
| futureway-bigthinkChat | Qwen3.5 397B A17B | Paris, FR 🇪🇺 | 250.000 Tokens | BilderTools |
| futureway-embedEmbedding | Qwen3 Embedding 8B (1024 dim) | Paris, FR 🇪🇺 | — | — |
Warum Aliase statt Modellnamen?
Modelle werden abgelöst, Aliase bleiben. Tauschen wir ein Modell gegen ein besseres, zeigt derselbe Alias auf das neue — Ihre Integration bricht nicht, und Sie müssen keine Modell-ID im Code nachziehen. Welches Modell aktuell hinter einem Alias steht, sehen Sie in der Tabelle oben und jederzeit über /v1/models.
Beispiel-Code
Dieselben Aufrufe in drei Sprachen — kopieren, Key setzen, ausführen.
Chat Completions
curl https://api.futureway.ai/v1/chat/completions \
-H "Authorization: Bearer $FUTUREWAY_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "futureway-smart",
"messages": [
{ "role": "user", "content": "Was ist die Hauptstadt von Frankreich?" }
]
}'Embeddings
curl https://api.futureway.ai/v1/embeddings \
-H "Authorization: Bearer $FUTUREWAY_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "futureway-embed",
"input": "Dein Text hier."
}'Modelle auflisten
curl https://api.futureway.ai/v1/models \
-H "Authorization: Bearer $FUTUREWAY_API_KEY"FUTUREWAY_API_KEY ist eine Umgebungsvariable, kein Beispiel-Key: Legen Sie Ihren eigenen Key dort ab, statt ihn in den Quellcode zu schreiben.
Fehlercodes
Zwei Antworten, die Sie im Betrieb tatsächlich sehen — und was jeweils zu tun ist. Beachten Sie, dass 429 zwei verschiedene Ursachen hat.
| Code | Bedeutung | Zu tun |
|---|---|---|
| 401 | Der Key fehlt, ist ungültig oder wurde widerrufen. | Den Authorization-Header prüfen; falls der Key widerrufen wurde, in der Key-Verwaltung einen neuen erstellen. |
| 429 | Das Nutzungskontingent Ihrer Organisation ist aufgebraucht. Der Fehlertext lautet „budget_exceeded“ — daran unterscheiden Sie diesen Fall vom Rate-Limit. | Warten Sie auf die nächste Abrechnungsperiode oder heben Sie das Kontingent an. Ein erneuter Versuch hilft hier nicht: Bis zum Zurücksetzen nehmen die Keys keine Anfragen mehr an. |
| 429 | Zu viele Anfragen in kurzer Zeit. Ohne „budget_exceeded“ im Fehlertext ist es das Rate-Limit. | Kurz warten und mit exponentiellem Backoff erneut senden. 429 deckt auch kurzfristige Lastspitzen am Gateway ab, nicht nur Ihr eigenes Limit. |
Rate-Limits
Betriebsgrenzen, kein Funktionsunterschied zwischen den Stufen: Sie schützen das Gateway vor Lastspitzen. Stand heute gilt:
- 60 Anfragen pro Minute im Standard.
- 300 Anfragen pro Minute auf der Stufe Ultra.
Diese Werte können wir anpassen, wenn der Betrieb es erfordert — sie sind kein zugesichertes Leistungsmerkmal. Wenn Sie dauerhaft mehr brauchen, sprechen Sie uns an.
KI-Verarbeitung zu 100 % in der EU
Jeder Aufruf über diese API wird auf europäischer Infrastruktur verarbeitet — die Modelle hinter den Aliasen laufen in Paris, Frankreich. Kein Umweg über US-Rechenzentren, auch nicht im Hintergrund.
Welche Subprozessoren im Einzelnen beteiligt sind, steht vollständig im Auftragsverarbeitungsvertrag und in den Einstellungen der Plattform.
Mehr zur EU-SouveränitätBereit, Ihre KI-Infrastruktur nach Europa zu holen?
In wenigen Minuten startklar — 14 Tage kostenlos testen, ohne Kreditkarte.
Wir starten in Kürze — sichern Sie sich einen der ersten Plätze.

