Menu
Coddy logo textTech

Tokens in anderen Sprachen

Teil des Abschnitts Grundlagen der AI Prompts-Journey von Coddy. Lektion 11 von 23.

Die meisten KI-Modelle wurden hauptsächlich mit englischen Texten trainiert. Das hat eine überraschende Folge: Für dieselbe Bedeutung benötigen nicht-englische Sprachen oft mehr Tokens.

Das Wort hello im Englischen ist typischerweise ein Token. Seine Entsprechungen in anderen Sprachen können jedoch anders aufgeteilt sein:

SpracheWortUngefähre Anzahl an Tokens
Englischhello1
Spanischhola1
Japanischこんにちは3-5
Arabischمرحبا2-4
Russischпривет2-3

Sprachen mit nicht-lateinischen Schriftsystemen wie Chinesisch, Japanisch, Koreanisch, Arabisch oder Hindi benötigen tendenziell deutlich mehr Tokens. Ein Satz, der im Englischen 10 Tokens umfasst, kann im Japanischen 20 oder 30 Tokens erfordern.

Das ist aus praktischen Gründen wichtig. Wenn du in einer nicht englischsprachigen Sprache arbeitest, erreichst du schneller die Grenzen des Kontextfensters, Antworten können mehr kosten und die Generierung kann etwas länger dauern. Das bedeutet nicht, dass die KI diese Sprachen schlechter beherrscht. Sie verarbeitet sie auf Token-Ebene lediglich weniger effizient.

Probier es selbst

Diese Lektion enthält keine Programmieraufgabe.

quiz iconTeste dich selbst

Diese Lektion enthält ein kurzes Quiz. Starte die Lektion, um es zu beantworten und deinen Fortschritt zu speichern.

Alle Lektionen in Grundlagen