Beam Search ist eine Decoding-Strategie, die mehrere Fortsetzungen parallel verfolgt (die 'Beams') und am Ende die insgesamt wahrscheinlichste Sequenz wählt.
Greedy entscheidet bei jedem Token endgültig und kann so die insgesamt beste Formulierung verpassen. Beam Search verfolgt stattdessen die k aussichtsreichsten Teilsätze gleichzeitig, setzt jeden fort und behält erneut die besten k — bis am Ende die beste Gesamtsequenz feststeht.
Mehr Beams (größeres k) finden tendenziell flüssigere Ergebnisse, kosten aber entsprechend mehr Rechenzeit.
Beam Search war lange Standard bei Übersetzung und Zusammenfassung, wo es eine 'richtige' Zielsequenz gibt. Bei kreativen, offenen Texten nutzt man heute eher Sampling, weil Beam Search dort zu glatt und vorhersehbar wirken kann.