Pyucation
← Zurück zu allen Fragen

Was ist ein Token bei einem Sprachmodell?

Ein Token ist die kleinste Texteinheit, mit der ein Sprachmodell rechnet, oft ein Wortteil, ein ganzes Wort oder ein Satzzeichen. Bevor ein Modell einen Text verarbeitet, wird er in solche Tokens zerlegt (Tokenisierung). Die Anzahl der Tokens bestimmt unter anderem, wie viel Text ein Modell gleichzeitig lesen kann und was die Nutzung kostet, da viele Anbieter pro Token abrechnen.

Das erfährst du in der Folge zusätzlich:

  • Der Tokenizer von OpenAI zum Ausprobieren
  • Weitere Buzzwords: Context Window, Parameter, Fine-Tuning

Mehr dazu in Folge 18: LLM-Buzzwords entschlüsselt - Welche Bedeutung haben diese Begriffe? →