Last updated: 2026-04-13
Kürzlich ging ein Tweet in der Entwickler-Community viral. @cat88tw teilte seinen Versuch, mit Claude Code einen EPUB-Übersetzer zu bauen, und beschrieb unverblümt, wie viel schwieriger es war als erwartet. Der Tweet erreichte 1.671 Aufrufe — nicht weil die Idee ungewöhnlich war, sondern weil jeder Entwickler, der dasselbe versucht hat, zustimmend nickte.
Die Grundidee klingt einfach. EPUBs sind nur HTML und CSS in einer ZIP-Datei verpackt. Moderne KI-Modelle übersetzen hervorragend. Man verbindet beides und ist an einem Wochenende fertig.
Nur dass man es eben nicht ist. An einem Wochenende erhält man einen Prototyp mit kaputtem Layout, verstümmelten Kapiteln und fehlenden Bildern. Einen zuverlässigen EPUB-Übersetzer zu bauen — einen, der mit echten Büchern funktioniert — ist eine echte ingenieurtechnische Herausforderung.
Eine EPUB-Datei ist ein ZIP-Archiv mit XHTML-Dateien, CSS-Stylesheets, Bildern, Schriften, Metadaten und einem Navigationssystem. Die Standards EPUB 2 und EPUB 3 definieren die Organisation, aber Verlage interpretieren den Standard sehr unterschiedlich.
Manche Bücher teilen den Inhalt in eine Datei pro Kapitel auf. Andere packen alles in eine einzige monolithische XHTML-Datei. Das Inhaltsverzeichnis kann eine NCX-Datei sein, ein Navigation Document oder beides. CSS kann inline oder extern referenziert sein. Schriften können eingebettet sein oder auf Systemschriften vertrauen.
Ihr Übersetzer muss all diese Varianten korrekt verarbeiten. Sobald Sie Annahmen treffen — „Kapitel sind immer separate Dateien" — werden Sie ein echtes Buch finden, das diese Annahme bricht.
Die OPF-Manifestdatei listet jede Ressource und die Lesereihenfolge auf. Wenn Ihr Übersetzer Dateien hinzufügt oder entfernt, ohne das Manifest zu aktualisieren, wird das EPUB ungültig.
Hier scheitern die meisten DIY-Projekte. Den Text zu übersetzen ist der einfache Teil. Die Formatierung danach intakt zu halten, ist der eigentliche Albtraum.
Sie müssen den übersetzbaren Text extrahieren und dabei die HTML-Tags erhalten, dann den übersetzten Text den richtigen Tags zuordnen — obwohl Wortstellung, Satzstruktur und Textlänge in der Zielsprache völlig anders sind. Hyperlink-Referenzen dürfen nicht übersetzt werden. HTML-Entities dürfen nicht beschädigt werden.
Wenn Sie rohes HTML an ein Sprachmodell senden, wird es häufig Tags zerstören, Attributwerte ändern oder schließende Tags weglassen. Wenn Sie zuerst das HTML entfernen und Klartext übersetzen, geht die gesamte Formatierung unwiederbringlich verloren.
Multiplizieren Sie das mit jedem Formatierungsmuster im Buch: Fußnoten, Hochstellungen, Initialen, Zitate, Gedichte mit Zeilenumbrüchen, mathematische Notation und Tabellen mit verbundenen Zellen.
Ein typisches Buch enthält 60.000 bis 100.000 Wörter. Kein aktuelles Sprachmodell kann ein ganzes Buch in einem einzigen API-Aufruf verarbeiten. Sie müssen das Buch in Abschnitte aufteilen.
Aber die Aufteilung bringt eigene Probleme:
Professionelle Übersetzungstools pflegen Glossare und überlappende Kontextfenster zwischen Abschnitten.
Übersetzung verändert die Textlänge. Ein 20-Wort-Satz auf Englisch kann 35 Wörter auf Deutsch oder 12 Zeichen auf Chinesisch ergeben. Das hat kaskadierende Auswirkungen auf das Layout:
Sobald Sie Unterstützung für Chinesisch, Japanisch, Koreanisch oder Arabisch hinzufügen, verdoppelt sich die Komplexität.
CJK-Herausforderungen:
RTL-Herausforderungen:
Ein gültiges EPUB zu erzeugen, das auf allen Lese-Apps korrekt angezeigt wird, ist überraschend schwierig. E-Book-Reader sind keine Webbrowser — jeder implementiert eine andere Teilmenge des EPUB-Standards mit eigenen Eigenheiten.
Apple Books rendert EPUB-3-Funktionen, die Kindle ignoriert. Kobos CSS-Verarbeitung unterscheidet sich von Google Play Books. Ältere Kindle-Geräte erfordern eine MOBI-Konvertierung. Cross-Reader-Tests sind zeitaufwändig und decken plattformspezifische Bugs auf.
Die Übersetzung eines 300-Seiten-Buchs kann über 200 API-Aufrufe erfordern. Jeder Aufruf kann fehlschlagen. Ihr Übersetzer braucht Retry-Logik, Fortschrittsverfolgung, Ausgabevalidierung und Kostenschätzung.
Jede der obigen Herausforderungen ist lösbar. Aber sie alle gleichzeitig zu lösen — und gelöst zu halten, während sich Standards weiterentwickeln und APIs ändern — ist eine Vollzeitbeschäftigung.
Genau deshalb gibt es EPUBTranslator. Statt Wochen mit dem Aufbau und Debugging einer eigenen Pipeline zu verbringen, laden Sie eine Datei hoch, wählen eine Sprache und erhalten ein korrekt formatiertes übersetztes EPUB zurück. Das Tool bewältigt die gesamte oben beschriebene Komplexität: Strukturanalyse, Formaterhaltung, Abschnittsverwaltung, CSS-Anpassung, CJK- und RTL-Unterstützung, Validierung und Fehlerwiederherstellung.
Wenn Sie ein Entwickler sind, der Herausforderungen liebt, ist der Bau eines EPUB-Übersetzers ein großartiges Lernprojekt. Aber wenn Ihr Ziel ist, ein Buch in einer anderen Sprache zu lesen, spart Ihnen ein spezialisiertes Tool erheblich Zeit. Der Entwickler hinter dem viralen Tweet hat das auf die harte Tour gelernt — Sie müssen denselben Fehler nicht wiederholen.