Baidu hat ein neues OCR-Modell vorgestellt, das ein fundamentales Problem der bisherigen Texterkennung löst: Während frühere Systeme maximal zehn Dokumentseiten auf einmal verarbeiten konnten, schafft Unlimited OCR jetzt dutzende Seiten in einem Durchgang. Das Geheimnis liegt in einem umgearbeiteten Aufmerksamkeitsmechanismus, der verhindert, dass der Speicherverbrauch mit jeder neuen Seite exponentiell steigt. Im führenden Benchmark rangiert das Modell bereits an der Spitze – ein beachtlicher Fortschritt für praktische Anwendungen wie automatisierte Buchdigitalisierung und Massenverarbeitung von Dokumenten.