Pyucation
← Zurück zu allen Fragen

Was ist Mixture of Experts (MoE) bei KI-Modellen?

Mixture of Experts ist eine Architektur, bei der ein Sprachmodell aus vielen kleinen Teilnetzen, den sogenannten Experten, besteht. Ein Router entscheidet pro Token, welche wenigen Experten aktiviert werden, statt das gesamte Modell zu nutzen. Dadurch besitzt das Modell zwar sehr viele Parameter insgesamt, verwendet für jede einzelne Berechnung aber nur einen Bruchteil davon und spart so Rechenkosten.

Das erfährst du in der Folge zusätzlich:

  • Unterschied zwischen Gesamtparametern und aktiven Parametern
  • Warum Load Balancing zwischen den Experten ein zentrales Problem ist

Mehr dazu in Folge 54: Mixture of Experts (MoE) einfach erklärt: Wie moderne KI-Modelle Rechenkosten sparen →