Anbieter & Regionen
Start › 3 · Anbieter & Regionen
Anbieter & Regionen – wer baut was, und wo sitzt es
Der Stammbaum beantwortet, ob ein Modell offen oder geschlossen ist. Diese Seite beantwortet die zweite Frage: wo sitzt der Anbieter – und was das für Kosten, Datenschutz und Verfügbarkeit bedeutet. Drei Regionen prägen den Markt.
Regionen im Vergleich
Drei Achsen entscheiden die Wahl: Spitzenleistung, Kosten und Datensouveränität. Jede Region hat ein klares Profil – mit ebenso klaren Kompromissen.
USA
Höchste Leistung, reifstes Ökosystem – dafür US-Server und Cloud Act.
+ Führend bei Modellqualität und Werkzeugen, riesiges Ökosystem.
– Daten auf US-Servern, Zugriff über den Cloud Act möglich.
China
Günstig, offen lizenziert, selbst hostbar – die Cloud ist bei sensiblen Daten heikel.
+ Sehr günstig, offene Lizenzen, im eigenen Haus betreibbar.
– Chinesische Cloud problematisch bei sensiblen Daten (*souverän nur selbst gehostet).
Europa
Souveränität, DSGVO und Spezialisierung – aber kein Basismodell auf Top-Niveau.
+ Erleichtert die DSGVO-Pflichten, Datensouveränität, starke Spezial-Lösungen.
– Noch kein Basismodell auf absolutem Top-Niveau.
Die Anbieter im Einzelnen
Neunzehn Anbieter, nach Region sortiert. Jeder Steckbrief lässt sich aufklappen und zeigt Stärken, Grenzen, das beste Einsatzszenario sowie Kosten und Hardware-Bedarf.
USA — 8 Anbieter
Höchste Leistung, reifstes Ökosystem — die Daten liegen auf US-Servern.
Claude — Referenz für Coding, Agenten & verlässliche Analyse
Stärken
- Stärkstes Modell für Programmierung, langes Nachdenken und mehrstufige Agenten-Abläufe
- Sehr zuverlässig bei langen, komplexen Dokumenten (bis ~1 Mio. Token Kontext), geringe Halluzinationsneigung
- Starker Sicherheits- und Steuerbarkeitsfokus — beliebt in regulierten Branchen
Grenzen
- Kein eigenes Bild- oder Videomodell (Bilder nur als Eingabe)
- Premium-Preise bei den Top-Modellen; keine offenen Gewichte
Am besten für: Software-Entwicklung, Coding-Agenten, anspruchsvolle Dokumenten- und Vertragsanalyse.
- Abo
- Free · Pro ~20 € · Max ab ~100 € · Team ab ~25 €/Sitz
- Token
- Opus ~5 / 25 € · Sonnet ~3 / 15 € · Haiku ~1 / 5 € je 1 Mio. Token
- Hardware
- Nur Cloud
ChatGPT / GPT — Der Allrounder mit dem größten Ökosystem
Stärken
- Breiteste Alltagstauglichkeit: Text, Bild, Sprache, Websuche und Datenanalyse in einer Oberfläche
- Sehr großes Kontextfenster und starkes Reasoning; unzählige Integrationen
- Niedrige Einstiegshürde für Teams — eine Plattform für alles
Grenzen
- Modelle und Verhalten ändern sich häufig — Planungsaufwand für Firmen mit Stabilitätsanspruch
- Bei hochspezialisierten Coding-Aufgaben teils hinter Claude
Am besten für: Allrounder für Büro, Marketing, Kundenservice und Datenanalyse.
- Abo
- Free · Go ~8 € · Plus ~23 € · Pro ~229 € · Business ~25 €/Nutzer
- Token
- Flaggschiff ~5 / 30 € · Mini ~0,75 / 4,50 € · Nano ~0,20 / 1,25 € je 1 Mio. Token
- Hardware
- Nur Cloud
Gemini — Multimodal-Spezialist, tief im Google-Ökosystem
Stärken
- Exzellent bei sehr langen Kontexten und echter Multimodalität (Text, Bild, Audio, Video nativ)
- Tiefe Integration in Workspace, Search und Android — Docs/Gmail/Sheets direkt nutzbar
- Starke Reasoning-Werte bei günstigen Token-Preisen
Grenzen
- Unübersichtliche Produkt- und Namenslandschaft (viele Varianten)
- Datenschutz bei tiefer Google-Kopplung für manche EU-Kunden heikel
Am besten für: Google-Ökosystem; Auswertung großer, gemischter Medien (Video, PDF, Audio) am Stück.
- Abo
- Free · AI Plus ~8 € · AI Pro ~22 € · AI Ultra ~250 € · in Workspace ab ~7 €/Nutzer
- Token
- Pro ~1,25–2 / 10–12 € · Flash ~0,30 / 2,50 € je 1 Mio. Token
- Hardware
- Nur Cloud
Grok — Echtzeit-Wissen aus X, aggressiv günstig
Stärken
- Direkter Draht zu Echtzeit-Daten von X — gut für aktuelle Ereignisse und Stimmungsbilder
- Günstig und schnell, mit starken Reasoning-Fortschritten
- Weniger restriktive Moderation (je nach Sicht Vor- oder Nachteil)
Grenzen
- Enge Bindung an X und das Musk-Umfeld — für konservative Unternehmen reputativ heikel
- Weniger geprüfte Enterprise- und Compliance-Historie
Am besten für: Echtzeit-Monitoring von Social/News, Trend- und Stimmungsanalysen.
- Abo
- Über X Premium bzw. eigenes Abo
- Token
- Aggressiv niedrig positioniert
- Hardware
- Nur Cloud
Llama — Der Standard für offenen Eigenbetrieb
Stärken
- Größtes offenes Ökosystem — meiste Tools, Anleitungen und Feintuning-Rezepte
- Volle Datenhoheit, kostenlos betreibbar, kommerziell nutzbar
- Sehr lange Kontexte in der Scout-Variante
Grenzen
- Jüngste Llama-4-Benchmarks blieben hinter Erwartungen; größtes Modell verzögert
- Lizenz nicht vollständig frei (Auflagen ab bestimmter Firmengröße)
Am besten für: Eigene, datensouveräne KI-Plattform mit breiter Tool-Unterstützung (Chatbots, RAG).
- Abo
- Kostenlos — Kosten = eigene Hardware/Cloud-GPU
- Token
- Keine API-Gebühr · Dritt-Hoster ~0,10–1 € je 1 Mio. Token
- Hardware
- Stufe 2–3+ · kleine Varianten Stufe 1
Midjourney — Führend bei künstlerischer Bildästhetik
Stärken
- Bilder sehen ohne Fachwissen „schön“ aus — führend bei Ästhetik
- 2026 auch Video-Generierung; konsistente Charaktere und Stile
- Sehr aktive Community mit Style-Referenzen
Grenzen
- Kein Self-Hosting, primär über Web/Discord
- Schwächer bei exakter Textwiedergabe im Bild und technischen Vorgaben
Am besten für: Marketing-Visuals, Moodboards, Konzeptkunst, Social-Media-Bilder mit Wow-Faktor.
- Abo
- Ab ~10 €/Monat, gestaffelt bis ~120 €
- Token
- Nach Abo / GPU-Minuten
- Hardware
- Nur Cloud
Google Veo — Text-zu-Video mit nativem Ton
Stärken
- Führende Text-zu-Video-Qualität mit nativem Ton (Sprache, Effekte, Musik mitgeneriert)
- Gute Konsistenz, Kamerasteuerung und Google-Integration
- Realistische Bewegung und Physik
Grenzen
- Rechenintensiv und teuer, Clips zeitlich begrenzt; kein Self-Hosting
- Inhaltsfilter/Wasserzeichen; feine kreative Kontrolle noch begrenzt
Am besten für: Werbeclips, Social-Video, Storyboards, Erklärvideos mit Ton.
- Abo
- Über Gemini-Abos / Google-Produkte
- Token
- Rechenintensiv, nach Clip
- Hardware
- Nur Cloud
Perplexity — Belegte Antworten in Echtzeit aus dem Web
Stärken
- Antworten mit Quellenangaben in Echtzeit — nachprüfbar, gut gegen Halluzinationen
- „Deep Research“ erstellt eigenständig strukturierte Berichte; Comet als KI-Browser
- Nutzt im Hintergrund mehrere Top-Modelle
Grenzen
- Kein eigenes Grundlagenmodell → abhängig von Drittmodellen und Web-Qualität
- Für tiefe Textproduktion oder Coding weniger geeignet
Am besten für: Markt- und Wettbewerbsrecherche, Faktenchecks, schnelle belegte Antworten.
- Abo
- Free · Pro 20 € · Max 200 € · Enterprise ab 40 €/Sitz
- Token
- Im Abo enthalten
- Hardware
- Nur Cloud
China — 6 Anbieter
Preisbrecher mit offenen Lizenzen — stark im Eigenbetrieb, heikel in der Cloud.
DeepSeek — Preisbrecher mit Spitzen-Reasoning
Stärken
- Spitzen-Reasoning und Coding zu einem Bruchteil westlicher Kosten
- Sehr freie MIT-Lizenz, offene Gewichte — volle Kontrolle
- Großes Kontextfenster (bis ~1 Mio. Token)
Grenzen
- Herkunft China → Compliance- und Datenschutz-Prüfung auch bei Eigenhosting
- Top-Modelle nur im Cluster lauffähig; Zensur-/Bias-Themen beachten
Am besten für: Kostengünstige, selbstgehostete Reasoning- und Coding-Backends; Massenverarbeitung.
- Abo
- API sehr günstig · selbst hostbar
- Token
- ~0,14 / 0,28 € je 1 Mio. Token (Flash-Variante)
- Hardware
- Top-Modell Stufe 3+ · Destillate (7–32B) Stufe 1–2
Qwen — Breiteste Familie — für jede Hardware eine Größe
Stärken
- Von 0,6 bis 235 Mrd. Parametern — passende Größe für jede Hardware
- Sehr stark mehrsprachig und beim Coding; Schnell- und Denk-Modus
- Offene, gut dokumentierte Gewichte — ideal fürs Feintuning
Grenzen
- Herkunft China → gleiche Compliance- und Zensur-Überlegungen
- Neuestes Flaggschiff (Max) nur per API, nicht herunterladbar
Am besten für: Wenn man eine Größe passend zur vorhandenen Hardware braucht — vom kleinen Chatbot bis zum Coding-Server.
- Abo
- Kleine Modelle offen & gratis · Flaggschiff per API
- Token
- Flaggschiff ~0,78 / 3,90 € je 1 Mio. Token
- Hardware
- ≤32B Stufe 1 · 235B Stufe 3+
GLM — Coding-Spezialist, günstig & offen
Stärken
- Sehr starkes Coding- und Agenten-Modell, auf Augenhöhe mit Top-Open-Modellen
- MIT-Lizenz, Gewichte sofort verfügbar — freie kommerzielle Nutzung
- Großes Kontextfenster
Grenzen
- Aktuelles Flaggschiff (mehrere hundert Mrd.) real nur im Cluster hostbar
- China-Herkunft → Compliance-Prüfung nötig
Am besten für: Günstige Alternative für Coding; selbstgehostetes Coding-Backend (mit Cluster).
- Abo
- API günstig · ältere 9B/32B offen
- Token
- ~0,43 / 1,75 € je 1 Mio. Token
- Hardware
- Flaggschiff Stufe 3+ · 9–32B Stufe 1–2
Kimi — Langer-Kontext- & Agenten-Champion
Stärken
- Führend bei sehr langem Kontext und agentischen Coding-Aufgaben
- Offene Gewichte trotz Riesengröße — bemerkenswert für Forschung
- Sehr großes Modell, nahe an westlichen Top-Modellen
Grenzen
- Mit Billionen Parametern praktisch nicht selbst hostbar — nur via API/Cluster
- Sehr jung, wenig Enterprise-Historie; China-Compliance
Am besten für: Anspruchsvolle Langkontext- und Coding-Agenten über die Kimi-API.
- Abo
- API · Eigenbetrieb nur im Rechenzentrum
- Token
- ~0,38 / 1,90 € je 1 Mio. Token
- Hardware
- Nur Stufe 3+ / Rechenzentrum
Doubao — Consumer-Assistent für den Massenmarkt
Stärken
- Riesige Nutzerbasis in China, sehr günstig
- Stark in Alltags- und Consumer-Szenarien
Grenzen
- Primär auf den chinesischen Markt zugeschnitten
- Datenschutz/Compliance außerhalb Chinas heikel
Am besten für: Consumer-Apps und Alltagsassistenz im chinesischen Markt.
- Abo
- Günstig im chinesischen Ökosystem
- Token
- Sehr günstig
- Hardware
- Nur Cloud
Ernie — Modell im Suchökosystem
Stärken
- Tief in Baidus Such- und Cloud-Ökosystem integriert
- Breite Verfügbarkeit im chinesischen Markt
Grenzen
- Außerhalb Chinas kaum relevant
- Datenschutz/Compliance-Fragen bei chinesischer Cloud
Am besten für: Such- und Unternehmensanwendungen im chinesischen Markt.
- Abo
- Im Baidu-Ökosystem
- Token
- Günstig
- Hardware
- Nur Cloud
Europa — 5 Anbieter
Souveränität und DSGVO, dazu starke Spezialisten für Sprache, Bild und Stimme.
Mistral — Europas Frontier-Anbieter, EU-Hosting
Stärken
- EU-Anbieter (Frankreich) — attraktiv für DSGVO und europäische Souveränität
- Volle Palette inkl. sehr effizienter kleiner Modelle für günstigen Eigenbetrieb
- Offene Gewichte bei vielen Modellen; gute Balance aus Qualität, Tempo und Preis
Grenzen
- Absolute Spitzenleistung der Flaggschiffe etwas hinter US-/China-Top-Modellen
- Gemischtes Lizenzmodell (manche offen, manche kommerziell) — vorab prüfen
Am besten für: EU-Firmen mit Datenschutz-Priorität; günstige, selbstgehostete Assistenz „made in Europe“.
- Abo
- Kleine Modelle offen & gratis · Flaggschiffe per API
- Token
- Small ~0,15 / 0,60 € · Medium ~1,50 / 7,50 € je 1 Mio. Token
- Hardware
- Small/Ministral Stufe 1 · Medium Stufe 2–3 · Large Stufe 3+
Aleph Alpha — Souveräne On-Premise-KI aus Deutschland
Stärken
- Deutscher Anbieter, Fokus auf souveräne On-Prem-KI — Daten bleiben im Haus/EU
- Ausrichtung auf Nachvollziehbarkeit und Regulatorik (öffentlicher Sektor)
- Verlässlicher Partner für kritische Infrastruktur
Grenzen
- Roh-Modellleistung unter globalen Frontier-Modellen — man zahlt für Souveränität
- Kleineres Ökosystem, weniger Community-Tools
Am besten für: Öffentliche Verwaltung, Verteidigung, kritische Industrie in DE/EU mit voller Datenhoheit.
- Abo
- On-Premise-/Enterprise-Lizenz (individuell)
- Token
- Nach Lizenz / eigenem Betrieb
- Hardware
- On-Prem, Stufe 1–3 je nach Variante
Flux — Fotorealismus & Text im Bild — teils offen
Stärken
- Deutsches Team; Spitzen-Fotorealismus und exzellente Textwiedergabe im Bild
- Offene, selbst-hostbare Varianten — volle Kontrolle, in Pipelines integrierbar
- Sehr schnell und gut steuerbar
Grenzen
- Weniger „Kunst-Automatik“ als Midjourney — braucht mehr Prompt-Sorgfalt
- Top-Qualität (Pro) läuft über API, nicht offen
Am besten für: Produkt- und Werbebilder mit Text und Fotorealismus; selbstgehostete Bild-Pipelines.
- Abo
- Offene Variante gratis · Pro über API
- Token
- Selbst gehostet oder API
- Hardware
- Stufe 1 (24 GB) für offene Varianten
DeepL — Führend bei Übersetzungsqualität, Hosting in der EU
Stärken
- Sehr hohe Übersetzungsqualität und Natürlichkeit für Geschäftstexte (v. a. Deutsch/EU)
- Deutscher Anbieter mit EU-Hosting und Auftragsverarbeitungsvertrag; Enterprise-Optionen (Terminologie, Formalität)
- „Write“-Funktion zum Verbessern und Umschreiben von Texten
Grenzen
- Enger Fokus (Übersetzen/Schreiben) — kein Allround-Assistent
- Bei kreativen oder sehr fachlichen Inhalten teils menschliches Lektorat nötig
Am besten für: Professionelle Übersetzung von Verträgen, Doku, Website und Korrespondenz.
- Abo
- Free · Pro ab ~8–9 €/Monat · API nach Zeichen
- Token
- Nach Zeichen / Abo
- Hardware
- Nur Cloud
ElevenLabs — Sehr realistische KI-Stimmen, breite Sprachauswahl
Stärken
- Sehr realistische, ausdrucksstarke KI-Stimmen; 70+ Sprachen
- Stimm-Klonen und Dubbing in hoher Qualität
- Komplettes Audio-Ökosystem (Text-to-Speech, Spracherkennung, Voice-Agents)
Grenzen
- Missbrauchs- und Rechte-Risiko beim Stimm-Klonen (Einwilligung beachten)
- Kosten skalieren mit Audio-Minuten; kein Self-Hosting
Am besten für: Voiceover, Hörbücher, mehrsprachiges Dubbing, Telefon- und Sprachassistenten.
- Abo
- Free · ab ~5 €/Monat, gestaffelt nach Audio-Minuten
- Token
- Nach Audio-Minuten
- Hardware
- Nur Cloud
Bestes Modell pro Einsatzgebiet
Es gibt kein „bestes“ Modell – nur das beste für die jeweilige Aufgabe. Der farbige Punkt zeigt die Herkunftsregion des empfohlenen Anbieters. Welches Setup für deine Lage passt, klärt die Entscheidungshilfe.
| Einsatzgebiet | Empfehlung | Günstige oder offene Alternative |
|---|---|---|
| Programmieren | Codex Claude Code | GLM als günstige Alternative China |
| Nuanciertes Schreiben | Claude | — |
| Recherche mit Websuche | ChatGPT Perplexity | — |
| Lange Dokumente | Gemini Kimi | Kimi – langer Kontext, offene Gewichte |
| Bilder | Midjourney | Flux als offene Option Europa |
| Video | Google Veo | — |
| Stimmen | ElevenLabs | — |
| Übersetzung | DeepL | — |
| Datenschutz & Souveränität | Mistral Aleph Alpha | selbst gehostet: Qwen / GLM / Mistral |
| Günstige Massenverarbeitung | DeepSeek | Preisbrecher, selbst hostbar |
Was kostet die Nutzung? Token-Preise
Über die API zahlt man nach Token. Die Spanne ist enorm: Die günstigsten Modelle kosten pro Antwort ein Hundertstel der Premium-Klasse. Sortiert von günstig nach teuer, je 1 Mio. Token (Eingabe / Ausgabe).
| Modell | Region | Eingabe | Ausgabe | Ausgabe-Preis relativ | Typ |
|---|---|---|---|---|---|
| Ministral (8B) | Europa | 0,15 € | 0,15 € | offen | |
| DeepSeek (Flash) | China | 0,14 € | 0,28 € | offen | |
| Mistral Small | Europa | 0,15 € | 0,60 € | offen | |
| GPT Nano | USA | 0,20 € | 1,25 € | API | |
| GLM | China | 0,43 € | 1,75 € | offen | |
| Kimi | China | 0,38 € | 1,90 € | offen | |
| Gemini Flash | USA | 0,30 € | 2,50 € | API | |
| Qwen (Max) | China | 0,78 € | 3,90 € | API | |
| GPT Mini | USA | 0,75 € | 4,50 € | API | |
| Claude Haiku | USA | 1,00 € | 5,00 € | API | |
| Mistral Medium | Europa | 1,50 € | 7,50 € | API | |
| Gemini Pro | USA | 2,00 € | 12,00 € | API | |
| Claude Sonnet | USA | 3,00 € | 15,00 € | API | |
| Claude Opus | USA | 5,00 € | 25,00 € | API | |
| GPT Flaggschiff | USA | 5,00 € | 30,00 € | API |
Abo-Modelle – was passt zu wem?
Neben der API gibt es für die meisten Chat-Assistenten feste Monats-Abos. Die Namen wiederholen sich – hier, was Pro, Max, Team und Enterprise bedeuten und für welchen Zweck sich welche Stufe eignet.
Free
Kostenlos zum Ausprobieren, mit Nachrichten- und Funktions-Grenzen. Für Gelegenheitsnutzung.
Pro / Professional
Einzel-Abo für intensive Nutzung: voller Modellzugriff, hohe Grenzen. Meist um 20 € im Monat.
Max / Ultra
Premium-Einzel-Abo: ein Vielfaches der Pro-Grenzen, bevorzugter Zugriff. Etwa 100–250 €.
Team / Business
Pro Nutzer und Monat, ab zwei Nutzern: zentrale Verwaltung, SSO und die Zusage, dass eure Daten nicht fürs Training verwendet werden.
Enterprise
Für Großunternehmen, Preis auf Anfrage: volle Sicherheit und Compliance (SSO, Audit-Protokolle), zugesicherte Datenverträge.
ChatGPT · OpenAI
| Free | 0 € | Ausprobieren, Gelegenheit |
|---|---|---|
| Plus | ~23 € | Standard für regelmäßige Nutzung |
| Pro | ~229 € | Vielnutzer, Entwicklung, Forschung |
| Business | ~25 €/Nutzer | Kleine und mittlere Teams (ab 2) |
| Enterprise | auf Anfrage | Großunternehmen |
Claude · Anthropic
| Free | 0 € | Ausprobieren |
|---|---|---|
| Pro | ~20 € | Regelmäßige Nutzung, Entwicklung |
| Max | ~100–200 € | Power-Nutzung (5× / 20× Grenzen) |
| Team | ab ~25 €/Sitz | Kleine Teams (ab 2) |
| Enterprise | auf Anfrage | Großunternehmen |
Gemini · Google
| Free | 0 € | Gelegenheit im Google-Umfeld |
|---|---|---|
| AI Pro | ~22 € | Regelmäßige Nutzung |
| AI Ultra | ~250 € | Profis, höchste Grenzen |
| Workspace | ab ~7 €/Nutzer | Firmen (Büro und KI aus einer Hand) |
Perplexity
| Free | 0 € | Belegte Antworten testen |
|---|---|---|
| Pro | ~20 € | Regelmäßige Recherche |
| Max | ~200 € | Intensive Einzelnutzung |
| Enterprise | ab ~40 €/Sitz | Teams und Firmen |
In Deutschland bereits im Einsatz
Europa hat kein Basismodell auf absolutem Spitzenniveau – produktiv im Einsatz ist KI hierzulande trotzdem längst, von der Behörde über die Klinik bis zur Fertigungslinie. Vier Segmente mit je einem Beispiel.
Verwaltung
F13 · Baden-WürttembergF13 ist die bundesweit erste KI-Assistenz im produktiven Behördeneinsatz, gemeinsam mit dem Fraunhofer-Institut entwickelt. Sie fasst Akten zusammen und erstellt Vermerke – und entlastet Mitarbeitende von Routinearbeit.
Medizin & Forschung
Radiologie & BioNTechKI in der Radiologie unterstützt die Früherkennung auf Bildgebung, etwa in der Krebsdiagnostik. BioNTech beschleunigt mit KI die Wirkstoffentwicklung – von der Analyse bis zum Kandidatenmolekül.
Fahrzeug & Produktion
Mercedes-Benz & BMWMercedes-Benz setzt auf einen KI-Sprachassistenten im Fahrzeug und KI-gestützte Qualitätskontrolle in der Produktion. BMW nutzt KI-Bilderkennung direkt an der Fertigungslinie.
Predictive Maintenance
Siemens & BoschSiemens und Bosch setzen auf Predictive Maintenance: KI sagt Maschinenausfälle voraus, bevor sie eintreten. Das spart Millionen an Stillstandzeiten und hält Wertschöpfungsketten am Laufen.