Zum Inhalt springen

Modelle

Start2 · Modelle & Anbieter

Modelle & Anbieter – die „Denk-Dateien“ und wer sie baut

Ein Modell ist das konkrete Ergebnis eines Trainings – eine (riesige) Datei mit Gewichten. Die wichtigste Trennlinie der ganzen Branche: geschlossene Modelle (nur per Cloud-API nutzbar) vs. offene Modelle (herunterladbar, lokal betreibbar, anpassbar).

Große Sprachmodelle (LLMs · Foundation Models) GESCHLOSSEN (proprietär) nur per Cloud-API · kein Download · meist Spitzenqualität OFFEN (Open Weight) herunterladbar · lokal betreibbar · anpassbar (LoRA) OpenAI GPT-Reihe Produkt: ChatGPT Anthropic Claude-Reihe Produkt: Claude (App) Google Gemini-Reihe Produkt: Gemini (App) Meta: Llama Pionier der offenen Modelle („local LLaMA“) Alibaba: Qwen stark bei Code & mehrsprachig GPT-OSS OpenAIs offene Reihe Community-Feintunings (via LoRA / Fine-Tuning) Hermes · Dolphin · Vicuna · tausende Varianten … veröffentlicht & geteilt auf Hugging Face weitere: xAI (Grok) · Mistral Large · Amazon (Nova) … Mistral & DeepSeek spielen auf beiden Seiten (offen + closed) Merke: „ChatGPT“, „Claude“ & „Gemini“ sind Produkte/Apps — die Modelle darunter heißen GPT-x, Claude x, Gemini x Ein Produkt kann mehrere Modelle anbieten und wechselt sie im Hintergrund aus
Schaubild 5: Die Modell-Landschaft als Stammbaum: geschlossen (links, nur per Cloud) vs. offen (rechts, herunterladbar). Aus den offenen Basismodellen entstehen per LoRA/Fine-Tuning tausende Varianten wie Hermes.

LLM Large Language Model Großes Sprachmodell

Ein per Deep Learning trainiertes Programm, das Sprache vorhersagt: Es errät bei jeder Anfrage das wahrscheinlichste nächste Token (Schaubild 4). Aus diesem simplen Prinzip entsteht die Fähigkeit zu schreiben, erklären, programmieren, argumentieren.

LLM — Large Language Model — Das große Sprachmodell: Kern der ganzen Landkarte

ChatGPT · Claude · Gemini Die großen Assistenten-Produkte

Die drei bekanntesten KI-Assistenten – wichtig ist die Trennung Produkt vs. Modell: ChatGPT (OpenAI) ist die App rund um die GPT-Modelle, Claude (Anthropic) die App rund um die Claude-Modelle, Gemini (Google) die App rund um die Gemini-Modelle.

Analogie: Produkt = das Auto mit Ausstattung (Chat-Oberfläche, Websuche, Dateianalyse). Modell = der Motor darin, der regelmäßig gegen einen neueren getauscht wird.
ChatGPT · Claude · Gemini — die großen Anbieter im Vergleich — Produkte, Stärken, Schwächen, Preise & Alternativen (Stand Mitte 2026)

Offen vs. Geschlossen Open Weight vs. Proprietary Die Grundsatzentscheidung

Offene Modelle kannst du herunterladen, lokal betreiben, verändern und feinabstimmen. Geschlossene nutzt du nur über die Cloud-API des Anbieters – meist stärker, aber du gibst Daten und Kontrolle ab.

Offen — Vorteile
  • Datenschutz & volle Kontrolle
  • Keine laufenden Token-Kosten
  • Anpassbar (LoRA), offline nutzbar
Offen — Nachteile
  • Eigene Hardware & Betrieb nötig
  • Spitzenleistung oft bei closed
  • Kein Anbieter-Support
Offen vs. Geschlossen (Open Weight vs. Proprietär) — Die Grundsatzentscheidung der Modellwahl

LoRA & Fine-Tuning Low-Rank Adaptation Sparsame Feinabstimmung

Wege, ein fertiges Modell anzupassen: Fine-Tuning trainiert es mit eigenen Daten weiter; LoRA macht das extrem sparsam – statt Milliarden Parameter anzufassen, lernt es nur einen kleinen „Aufsatz“ (Adapter, oft nur wenige MB).

Analogie: Nicht das Buch neu schreiben, sondern Klebezettel mit Korrekturen einlegen – klein, austauschbar, günstig.
LoRA & Fine-Tuning — Ein fertiges Modell auf deine Bedürfnisse trimmen

LLaMA & „local LLaMA“ Metas offene Modellfamilie

Metas Modellreihe, die die Open-Weight-Bewegung 2023 richtig losgetreten hat. „local LLaMA“ steht inzwischen fast synonym für „KI lokal betreiben“ – auch dank der gleichnamigen Community (r/LocalLLaMA).

LLaMA & „local LLaMA“ — Metas Modellfamilie — und die Bewegung, die sie auslöste

Qwen-Modelle Alibabas offene Modellfamilie

Eine der stärksten offenen Reihen – beliebt für Programmierung, Mehrsprachigkeit und lokalen Betrieb. Viele Größen und Spezialvarianten: Qwen-Coder (Code), Qwen-VL (Bilder), große MoE-Varianten.

Qwen-Modelle — Alibabas offene Familie — oft die Leistungsspitze der Open-Weight-Welt

GPT-OSS OpenAIs offene Gewichte

OpenAIs 2025 veröffentlichte offene Modelle – die ersten seit GPT-2. Zwei Größen: gpt-oss-20b (läuft ab ~16 GB Speicher auf gutem Consumer-Gerät) und gpt-oss-120b (~80 GB, Workstation/Server). Lizenz: Apache 2.0.

GPT-OSS — OpenAIs offene Modelle — 20b für den PC, 120b für die Workstation

Hermes Bekanntes Community-Feintuning

Kein eigenes Basismodell, sondern eine „veredelte“ Variante: Nous Research nimmt offene Modelle (Llama, Qwen) und trimmt sie per Fine-Tuning auf präzises Anweisung-Befolgen und sauberen Werkzeug-Aufruf – nützlich für Agenten.

Hermes (Nous Research) — Das bekannteste Community-Feintuning — Basis-Modelle, veredelt
Merksatz: Produkt (ChatGPT, Claude-App) ≠ Modell (GPT-x, Claude x) ≠ Feintuning (Hermes). Und: Fakten ändern → RAG; Verhalten ändern → LoRA; alles lokal & privat → offene Modelle.