H company stellte NeoMME mit Modellgrößen von 260 und 800 Millionen Parametern vor. Die technische Arbeit wurde am 31. August 2026 bei arXiv eingereicht, die Ankündigung folgte am 3. September. Es handelt sich um einen nicht begutachteten Preprint.
Ein gemeinsamer bidirektionaler Transformer verarbeitet Text und Bilder. Die Retriever-Variante sucht Seiten als Bilder und kann deren Anordnung nutzen. Die Gewichte stehen unter Apache 2.0; das Basismodell allein ist kein fertiges Suchsystem.
Mögliche Anwendungen sehen wir in technischen Archiven: Eine Zeichnung und ihre benachbarte Beschriftung können gemeinsam zur passenden Seite führen. Ein Mensch oder ein nachgelagertes System sollte die gefundene Seite weiterhin prüfen.
Vor dem Einsatz sind Tests mit den tatsächlichen Sprachen, Scans und Tabellen erforderlich. Ein kleinerer Suchindex verkleinert weder die Originaldokumente noch garantiert er richtige Antworten.
Optimistische redaktionelle Schätzung: Ein kleiner Pilot ist innerhalb von 1–3 Monaten denkbar. Verlässlicher Betrieb mit großen Archiven hängt von Datenqualität, Hardware und Zugriffskontrollen ab.

Eröffnen Sie die Diskussion mit dem ersten Kommentar.