LLM-API-Anbieter im Vergleich — günstiger und europäischer als gedacht

Die Bridge ist provider-agnostisch: ein OpenAI-kompatibler Endpunkt, der Provider dahinter ist eine Base-URL. Und weil Saklam eine Flatrate ist, verdienen wir am Token-Verbrauch nichts — diese Liste ist deshalb das, was sie sein soll: neutral.

Stand: 17.08.2026. Alle Preise stammen aus den öffentlichen Preislisten der Anbieter (pro 1 Mio. Token, Input → Output), ohne Gewähr — Token-Preise ändern sich schnell, prüft vor einer Entscheidung immer die verlinkte Original-Preisliste.


Erst die Einordnung: Was kostet euer Workload wirklich?

Rechenbeispiel für ein kleines Team: 3 Nutzer, je 20 Anfragen pro Arbeitstag (typische Anfrage: ~3.000 Token Input, ~800 Token Output, 21 Arbeitstage) — zusammen rund 4,8 Mio. Token im Monat:

Modell Monatskosten (ganzes Team)
Claude Fable 5 (teuerstes Flaggschiff) ~88 $
GPT-5.6-sol (OpenAI-Flaggschiff) ~49 $
Claude Sonnet 5 ~18 $
GPT-5-mini ~3 $
gpt-oss-120b bei einem EU-Hoster ~1–2 €

Bei interaktiver Nutzung sind Token-Kosten also selten das echte Problem — selbst das teuerste Modell der Welt kostet für dieses Team unter 30 $ pro Kopf. Interessant wird die Modellwahl, sobald Agenten und Automationen laufen und das Volumen um den Faktor 10–100 steigt. Genau dann zahlt sich aus, dass der Provider nur eine Base-URL ist.


EU-Anbieter: Hosting in Deutschland und Frankreich

Offene Spitzenmodelle (Llama, Qwen, gpt-oss, Mistral) gibt es aus europäischen Rechenzentren — oft 10–50× günstiger als die Flaggschiffe, mit AVV und ohne Training auf euren Daten:

Anbieter Hosting Beispielpreise (1M Token) Datenschutz Anmerkung
IONOS AI Model Hub 🇩🇪 Deutschland gpt-oss-120b 0,15 € → 0,65 € · Mistral Small 24B 0,10 € → 0,30 € · Llama 3.3 70B 0,65 € → 0,65 € AVV, kein Training mit Kundendaten, BSI-C5-Testat Einziger Anbieter mit DE-Hosting + C5 + öffentlicher Preisliste
OVHcloud AI Endpoints 🇫🇷 Frankreich gpt-oss-120b 0,08 € → 0,40 € · Llama 3.3 70B 0,67 € → 0,67 € Zero Data Retention (nur Abrechnungsdaten) Günstigster verifizierter EU-Preis; Verarbeitungsregion vertraglich bestätigen lassen
T-Systems AI Foundation Services 🇩🇪 T-Cloud (Open-Source-Modelle) Einheitspreis 0,20 € → 0,65 € über alle Shared-Pläne EU Data Sovereignty, ISO 27001 Nur die T-Cloud-Modelle wählen — GPT/Claude/Gemini laufen dort über Azure/GCP
Scaleway Generative APIs 🇫🇷 Frankreich gpt-oss-120b 0,15 € → 0,60 € · Qwen3.5-397B 0,60 € → 3,60 € DSGVO-Doku vorhanden; AVV-Details anfragen Breitester EU-Modellkatalog (inkl. GLM, DeepSeek-Modelle)
Mistral La Plateforme 🇫🇷 Frankreich (EU-Entity) Mistral Small 4: 0,15 $ → 0,60 $ · Mistral Large 3: 0,50 $ → 1,50 $ Kein Training auf API-Daten; Standard 30 Tage Abuse-Retention, Zero Data Retention nur im Scale-Plan Einziger EU-Anbieter mit eigenem Frontier-Modell
STACKIT AI Model Serving 🇩🇪 Deutschland Preise auf Anfrage (keine öffentliche Liste) BSI C5 Typ 2, SOC 2, kein US CLOUD Act Schwarz Gruppe; höchste Zertifizierungstiefe im Feld

Zur Referenz: die großen US-Anbieter

Anbieter Modell Preis (1M Token)
OpenAI GPT-5.6-sol 5,00 $ → 30,00 $
GPT-5-mini 0,25 $ → 2,00 $
Anthropic Claude Fable 5 10,00 $ → 50,00 $
Claude Sonnet 5 2,00 $ → 10,00 $
Claude Haiku 4.5 1,00 $ → 5,00 $
Google Gemini Gemini 2.5 Flash-Lite 0,10 $ → 0,40 $

Dazu zwei Hebel, die viele übersehen: Prompt-Caching (wiederholter Kontext kostet bei OpenAI und Anthropic nur ~10 % des Input-Preises) und Batch-Verarbeitung (–50 % auf alles, wenn es nicht interaktiv sein muss).

US-Spezialisten wie Together AI, Fireworks oder Groq hosten offene Modelle noch günstiger — für europäische Unternehmen gilt dort aber: Verarbeitung meist in den USA, Standardvertragsklauseln und Transfer-Folgenabschätzung nötig, EU-Region teils nicht garantierbar.


Worauf ihr bei der Auswahl achten solltet

  1. OpenAI-Kompatibilität — dann ist der Wechsel eine Base-URL, kein Projekt.
  2. AVV/DPA öffentlich verfügbar — nicht erst im Enterprise-Vertrieb.
  3. Kein Training mit euren Daten — als explizite Zusage, nicht als Schweigen.
  4. Retention — Zero Data Retention ist der Goldstandard; 30-Tage-Abuse-Logging ist verbreitet und sollte bewusst akzeptiert werden.
  5. Verarbeitungsregion — „EU-Anbieter" heißt nicht automatisch „EU-Verarbeitung", im Zweifel vertraglich fixieren.

Zwei Konstellationen sehen wir kritisch: die DeepSeek-Plattform direkt (Verarbeitung und Speicherung laut eigener Privacy Policy in China, Trainingsnutzung per Opt-out) — die DeepSeek-Modelle selbst sind über EU-Hoster problemlos nutzbar — und Aggregatoren wie OpenRouter für sensible Daten (zusätzlicher Auftragsverarbeiter, Routing-Ziel pro Anfrage nicht deterministisch).


Der Wechsel selbst: eine Zeile

Die Bridge sitzt vor eurem Provider und maskiert personenbezogene Daten, bevor sie das Haus verlassen. Welcher Provider dahinter antwortet, entscheidet ihr in der .env der Bridge — Anthropic, OpenAI, Azure OpenAI, Google, AWS Bedrock und Mistral direkt per API-Key, jeder OpenAI-kompatible Endpunkt (auch die EU-Hoster oben oder euer eigenes vLLM/Ollama) per Base-URL:

# .env der Bridge — Provider wechseln, ohne die Anwendungen anzufassen
MISTRAL_API_KEY=…                                  # z. B. Mistral direkt
# oder ein OpenAI-kompatibler Endpunkt:
OLLAMA_API_BASE=https://euer-eu-endpunkt.example/v1

Eure Anwendungen zeigen weiterhin auf die Bridge — an ihnen ändert sich beim Provider-Wechsel nichts. Zum Bridge-Setup-Guide →