tokenfeldKI-Nachrichten — ein Ereignis, alle Belege

Erklärt

Was ist ein Token?

Ein Token ist das Stück Text, in das ein Sprachmodell alles zerlegt, bevor es rechnet. Meist ist es kürzer als ein Wort und länger als ein Buchstabe — eine Silbe, eine Endung, ein Satzzeichen. Modelle sehen keine Wörter und keine Buchstaben. Sie sehen Tokens.

Am schnellsten versteht man es, wenn man zusieht. Dasselbe Wortpaar, einmal deutsch, einmal englisch, zerlegt von der Kodierung o200k_base:

deutschKünstliche␣Intelligenz6 Tokens
englischartificial␣intelligence3 Tokens

Zwei Wörter mit derselben Bedeutung, fast gleich lang — und das deutsche kostet doppelt so viel. Der Grund ist keine Absicht: Die Zerlegung wird auf einem Textbestand gelernt, in dem Englisch überwiegt. Häufige englische Wörter bekommen ein eigenes Token, deutsche Zusammensetzungen zerfallen in Bruchstücke — K, ünst,liche.

Was Deutsch kostet

Zehn Begriffspaare, jeweils dieselbe Bedeutung. Gemessen, nicht geschätzt:

deutschTok.englischTok.
Künstliche Intelligenz6artificial intelligence3
Sprachmodell3language model2
Datenschutz2data protection2
Rechenleistung3computing power3
Bilderzeugung4image generation2
Verschlüsselung4encryption2
Nutzungsbedingungen4terms of use3
Bundesausbildungsförderungsgesetz8federal education support act5
Geschwindigkeitsbegrenzung6speed limit2
Wahrscheinlichkeitsverteilung6probability distribution3

Faktor 1,7 — derselbe Gedanke kostet auf Deutsch etwa siebzig Prozent mehr Tokens. Wer ein Modell auf Deutsch nutzt, zahlt mehr, wartet länger und stößt früher an die Grenze des Kontextfensters.

Wo ich mich fast vermessen hätte

Der erste Versuch nahm nicht Begriffspaare, sondern den ganzen Bestand dieser Seite — 28 deutsche gegen 172 englische Schlagzeilen. Ergebnis: Deutsch schnitt besser ab — 4.03 Zeichen je Token gegen 3.67. Das Gegenteil der Wahrheit.

Der Fehler steckt im Vergleich, nicht in der Messung: Die deutschen Schlagzeilen waren im Schnitt deutlich länger und behandelten andere Themen. Wer zwei Haufen misst, die sich in mehr als einer Sache unterscheiden, misst nicht das, was er glaubt. Erst derselbe Gedanke in zwei Sprachen ergibt einen Vergleich.

Was das praktisch heißt

Alle Zahlen mit o200k_base (GPT-4o/5-Familie), tiktoken erhoben, am 2026-08-14 gegen den echten Bestand dieser Seite. Reproduzierbar: werkzeug/token-messung.py.