Laufende Forschung
Hime
Eine lokal laufende Übersetzungs-Pipeline für lange literarische Texte aus dem Japanischen ins Englische. Statt eines großen Cloud-Modells arbeiten mehrere kleine, feinabgestimmte lokale Modelle nacheinander an jedem Absatz.
Entwerfen, zusammenführen, Feinschliff, prüfen. Pro Absatz, auf einer Maschine.
- Status
- laufende Forschung
- Hardware
- eine Consumer-GPU
- Modelle
- feinabgestimmte Adapter
- Kontext
- durch Retrieval angereichert
- i/o
- EPUB rein · EPUB raus
- Netzwerk
- vollständig offline
Die Pipeline
- Vorverarbeitung Morphologische Tokenisierung, Glossar-Abfrage, Rückgriff auf frühere Passagen desselben Werks: Jeder Absatz kommt mit seinem eigenen Kontext an.
- Entwurf Mehrere Modelle übersetzen parallel, darunter ein deterministischer Wörterbuchpfad, der ohne Modell arbeitet.
- Zusammenführen Ein Konsens-Modell verbindet die stärksten Teile der Entwürfe.
- Feinschliff Ein eigenes Modell arbeitet an Ton, Rhythmus und Register.
- Prüfung Ein Gremium aus Leser-Personas, jede auf einen anderen Fehlertyp ausgerichtet. Ein Aggregator gibt eines von drei Urteilen zurück: annehmen, erneuter Feinschliff, oder verwerfen und neu ab dem Entwurf. Der erneute Feinschliff läuft höchstens zweimal, ein vollständiger Neuanlauf höchstens einmal.
eine Consumer-GPU · feinabgestimmte Adapter · Kontext durch Retrieval · EPUB rein / EPUB raus · vollständig offline
Aktueller Stand
Die feinabgestimmten Modelle schlagen ihr eigenes Basismodell noch nicht zuverlässig.
Das letzte supervidierte Fine-Tuning fiel gegenüber dem vorherigen ab. Die Obergrenze scheint im Basismodell und in den Trainingsdaten zu liegen, nicht im Adapter; deshalb ist der nächste Schritt fortgesetztes Pretraining statt weiteres Fine-Tuning.
Hime läuft auf einer einzelnen Consumer-GPU, vollständig offline. Die Konsistenz über hunderte Seiten entsteht durch den absatzweisen Rückgriff auf Glossare und frühere Passagen, damit Namen und Register über ein langes Werk stabil bleiben.
Was funktioniert, ist der Auswertungsaufbau: eine leckfreie Bewertungsumgebung mit fünf Integritätsprüfungen und einer Sonde über 41 linguistische Achsen.
Ein früheres positives Ergebnis ließ sich auf ein Leck im Antwortschlüssel zurückführen und wurde zurückgezogen. Eine Zahl, die eine Prüfung nicht übersteht, ist weniger wert als keine Zahl.