Zum Inhalt springen
News

Was ein großes Kontextfenster wirklich bringt

Mehr Token im Kontext heißt nicht automatisch bessere Antworten. Entscheidend bleibt, was in diesem Fenster steht.

Das Kontextfenster ist der Arbeitsspeicher eines Sprachmodells: alles, was es für eine Antwort gleichzeitig ansehen kann — Systemanweisung, Verlauf, angehängte Dokumente und die Antwort selbst. Gemessen wird es in Token, nicht in Zeichen oder Seiten.

Große Fenster nehmen einem echte Arbeit ab. Ein ganzes Handbuch passt hinein, ohne dass man es vorher zerschneiden und über eine Suche wieder einsammeln muss. Das spart eine ganze Schicht Technik — und die Fehler, die diese Schicht macht.

Wo die Grenze trotzdem liegt

Ein volles Fenster ist kein gutes Fenster. Drei Dinge bleiben:

  • Relevanz schlägt Menge. Was hineingehört, entscheidet weiter die Auswahl.
  • Kosten und Zeit wachsen mit jedem Token — auch mit dem unnützen.
  • Aufmerksamkeit ist ungleich verteilt. Anfang und Ende eines langen Kontexts wirken stärker als die Mitte.

Unsere Einordnung

Wir nutzen große Fenster dort, wo sie eine Retrieval-Schicht überflüssig machen — und schneiden trotzdem zu, was nicht gebraucht wird. Wiederkehrende Teile lassen sich zwischenspeichern, statt sie bei jeder Anfrage neu zu bezahlen. Das Fenster ist ein Werkzeug, kein Zielwert.

Quellen

Passt in die KI-Landkarte

Die Zusammenhänge hinter dieser Meldung stehen ausführlich im Kapitel Modelle.

Zu Modelle
  • modelle
  • kontext
  • grundlagen
Alle News