LLM-API-Anbieter im Vergleich — günstiger und europäischer als gedacht
Die Bridge ist provider-agnostisch: ein OpenAI-kompatibler Endpunkt, der Provider dahinter ist eine Base-URL. Und weil Saklam eine Flatrate ist, verdienen wir am Token-Verbrauch nichts — diese Liste ist deshalb das, was sie sein soll: neutral.
Stand: 17.08.2026. Alle Preise stammen aus den öffentlichen Preislisten der Anbieter (pro 1 Mio. Token, Input → Output), ohne Gewähr — Token-Preise ändern sich schnell, prüft vor einer Entscheidung immer die verlinkte Original-Preisliste.
Erst die Einordnung: Was kostet euer Workload wirklich?
Rechenbeispiel für ein kleines Team: 3 Nutzer, je 20 Anfragen pro Arbeitstag (typische Anfrage: ~3.000 Token Input, ~800 Token Output, 21 Arbeitstage) — zusammen rund 4,8 Mio. Token im Monat:
| Modell | Monatskosten (ganzes Team) |
|---|---|
| Claude Fable 5 (teuerstes Flaggschiff) | ~88 $ |
| GPT-5.6-sol (OpenAI-Flaggschiff) | ~49 $ |
| Claude Sonnet 5 | ~18 $ |
| GPT-5-mini | ~3 $ |
| gpt-oss-120b bei einem EU-Hoster | ~1–2 € |
Bei interaktiver Nutzung sind Token-Kosten also selten das echte Problem — selbst das teuerste Modell der Welt kostet für dieses Team unter 30 $ pro Kopf. Interessant wird die Modellwahl, sobald Agenten und Automationen laufen und das Volumen um den Faktor 10–100 steigt. Genau dann zahlt sich aus, dass der Provider nur eine Base-URL ist.
EU-Anbieter: Hosting in Deutschland und Frankreich
Offene Spitzenmodelle (Llama, Qwen, gpt-oss, Mistral) gibt es aus europäischen Rechenzentren — oft 10–50× günstiger als die Flaggschiffe, mit AVV und ohne Training auf euren Daten:
| Anbieter | Hosting | Beispielpreise (1M Token) | Datenschutz | Anmerkung |
|---|---|---|---|---|
| IONOS AI Model Hub | 🇩🇪 Deutschland | gpt-oss-120b 0,15 € → 0,65 € · Mistral Small 24B 0,10 € → 0,30 € · Llama 3.3 70B 0,65 € → 0,65 € | AVV, kein Training mit Kundendaten, BSI-C5-Testat | Einziger Anbieter mit DE-Hosting + C5 + öffentlicher Preisliste |
| OVHcloud AI Endpoints | 🇫🇷 Frankreich | gpt-oss-120b 0,08 € → 0,40 € · Llama 3.3 70B 0,67 € → 0,67 € | Zero Data Retention (nur Abrechnungsdaten) | Günstigster verifizierter EU-Preis; Verarbeitungsregion vertraglich bestätigen lassen |
| T-Systems AI Foundation Services | 🇩🇪 T-Cloud (Open-Source-Modelle) | Einheitspreis 0,20 € → 0,65 € über alle Shared-Pläne | EU Data Sovereignty, ISO 27001 | Nur die T-Cloud-Modelle wählen — GPT/Claude/Gemini laufen dort über Azure/GCP |
| Scaleway Generative APIs | 🇫🇷 Frankreich | gpt-oss-120b 0,15 € → 0,60 € · Qwen3.5-397B 0,60 € → 3,60 € | DSGVO-Doku vorhanden; AVV-Details anfragen | Breitester EU-Modellkatalog (inkl. GLM, DeepSeek-Modelle) |
| Mistral La Plateforme | 🇫🇷 Frankreich (EU-Entity) | Mistral Small 4: 0,15 $ → 0,60 $ · Mistral Large 3: 0,50 $ → 1,50 $ | Kein Training auf API-Daten; Standard 30 Tage Abuse-Retention, Zero Data Retention nur im Scale-Plan | Einziger EU-Anbieter mit eigenem Frontier-Modell |
| STACKIT AI Model Serving | 🇩🇪 Deutschland | Preise auf Anfrage (keine öffentliche Liste) | BSI C5 Typ 2, SOC 2, kein US CLOUD Act | Schwarz Gruppe; höchste Zertifizierungstiefe im Feld |
Zur Referenz: die großen US-Anbieter
| Anbieter | Modell | Preis (1M Token) |
|---|---|---|
| OpenAI | GPT-5.6-sol | 5,00 $ → 30,00 $ |
| GPT-5-mini | 0,25 $ → 2,00 $ | |
| Anthropic | Claude Fable 5 | 10,00 $ → 50,00 $ |
| Claude Sonnet 5 | 2,00 $ → 10,00 $ | |
| Claude Haiku 4.5 | 1,00 $ → 5,00 $ | |
| Google Gemini | Gemini 2.5 Flash-Lite | 0,10 $ → 0,40 $ |
Dazu zwei Hebel, die viele übersehen: Prompt-Caching (wiederholter Kontext kostet bei OpenAI und Anthropic nur ~10 % des Input-Preises) und Batch-Verarbeitung (–50 % auf alles, wenn es nicht interaktiv sein muss).
US-Spezialisten wie Together AI, Fireworks oder Groq hosten offene Modelle noch günstiger — für europäische Unternehmen gilt dort aber: Verarbeitung meist in den USA, Standardvertragsklauseln und Transfer-Folgenabschätzung nötig, EU-Region teils nicht garantierbar.
Worauf ihr bei der Auswahl achten solltet
- OpenAI-Kompatibilität — dann ist der Wechsel eine Base-URL, kein Projekt.
- AVV/DPA öffentlich verfügbar — nicht erst im Enterprise-Vertrieb.
- Kein Training mit euren Daten — als explizite Zusage, nicht als Schweigen.
- Retention — Zero Data Retention ist der Goldstandard; 30-Tage-Abuse-Logging ist verbreitet und sollte bewusst akzeptiert werden.
- Verarbeitungsregion — „EU-Anbieter" heißt nicht automatisch „EU-Verarbeitung", im Zweifel vertraglich fixieren.
Zwei Konstellationen sehen wir kritisch: die DeepSeek-Plattform direkt (Verarbeitung und Speicherung laut eigener Privacy Policy in China, Trainingsnutzung per Opt-out) — die DeepSeek-Modelle selbst sind über EU-Hoster problemlos nutzbar — und Aggregatoren wie OpenRouter für sensible Daten (zusätzlicher Auftragsverarbeiter, Routing-Ziel pro Anfrage nicht deterministisch).
Der Wechsel selbst: eine Zeile
Die Bridge sitzt vor eurem Provider und maskiert personenbezogene Daten, bevor sie das Haus verlassen. Welcher Provider dahinter antwortet, entscheidet ihr in der .env der Bridge — Anthropic, OpenAI, Azure OpenAI, Google, AWS Bedrock und Mistral direkt per API-Key, jeder OpenAI-kompatible Endpunkt (auch die EU-Hoster oben oder euer eigenes vLLM/Ollama) per Base-URL:
# .env der Bridge — Provider wechseln, ohne die Anwendungen anzufassen
MISTRAL_API_KEY=… # z. B. Mistral direkt
# oder ein OpenAI-kompatibler Endpunkt:
OLLAMA_API_BASE=https://euer-eu-endpunkt.example/v1
Eure Anwendungen zeigen weiterhin auf die Bridge — an ihnen ändert sich beim Provider-Wechsel nichts. Zum Bridge-Setup-Guide →