Nur fehlende Zeilen in CSV oder Excel mit KI übersetzen

Nur fehlende Zeilen in CSV oder Excel mit KI übersetzen

7. September 2026

Sie betrachten eine Datei, bei der ein Teil der Arbeit bereits erledigt ist. Vierhundert Zeilen haben einen deutschen Titel. Dreitausendsechshundert nicht. Jemand hat zu einem bestimmten Zeitpunkt die erste Charge übersetzt, und dann ist der Katalog gewachsen.

Die gängigen Tools verlangen immer die gesamte Datei. Die Frage ist also nicht, wie man sie übersetzt. Die Frage ist, wie man nur den fehlenden Teil übersetzt und nur für diesen Teil bezahlt.

Wie eine teilweise übersetzte Datei tatsächlich aussieht

Hier ist die Problemstellung, klein genug, um sie auf einen Blick zu erfassen.

Eine Datei, in der zwei von vier Zeilen bereits einen deutschen Titel haben. Nur die zwei leeren Zellen sind relevant, der Rest bleibt identisch.

Skalieren Sie das auf viertausend Zeilen, und die zwei Ergebnisse sind nicht mehr vergleichbar. Entweder Sie bezahlen für 4.000 Zeilen und prüfen eine Differenzansicht über alle Zeilen, oder Sie bezahlen für 3.600 und prüfen 3.600. Bei der zweiten Variante bleibt die Formulierung, die Ihre Kollegin bereits geprüft hat, exakt so, wie sie sie hinterlassen hat.

Die fünf Dateitypen, bei denen dies passiert

Das ist kein Sonderfall. Es ist der Normalzustand jeder Datei, die mehr als einmal bearbeitet wurde.

Seit dem letzten Mal hinzugefügte Zeilen. Der Katalog ist um 200 Produkte gewachsen. Die anderen 3.800 sind fertig und geprüft. Dies ist mit großem Abstand der häufigste Fall, und er wiederholt sich jeden Monat.

Eine Sprache wurde zu einer Datei hinzugefügt, die bereits drei hat. Ihre Tabelle hat Spalten für Französisch, Deutsch und Spanisch. Italienisch wurde letzte Woche beschlossen und die entsprechende Spalte ist leer oder gar nicht vorhanden. Sie möchten Italienisch übersetzt haben, während die anderen drei Sprachen unangetastet bleiben.

Eine Übergabe, die jemand anderes begonnen hat. Ein Freelancer hat das erste Drittel geschafft, bevor das Projekt ins Stocken geriet. Sie wissen nicht genau, wo er aufgehört hat, und Sie möchten das nicht herausfinden, indem Sie für die Überschneidung bezahlen.**

Eine Datei, in der ein vorheriges Tool die Quelle als Platzhalter in das Ziel eingefügt hat. Das passiert jedem, weil die Datei fertig aussieht. In einem XLIFF- oder PO-Export hat jeder Eintrag ein Zielsegment, und viele Tools füllen dieses mit einer Kopie des Quelltextes, damit die Struktur valide bleibt. Man öffnet die Datei und jedes Ziel ist befüllt. Fast keines davon ist jedoch übersetzt.

Zeilen, die bewusst unverändert gelassen wurden. Interne SKU-Beschreibungen, ein rechtlicher Absatz, den Ihr Anwalt nur in einer Sprache abgesegnet hat, oder drei Produkte, die eingestellt werden. Das sind keine Lücken. Das sind Entscheidungen, und ein Tool, das diese voreilig auffüllt, beschädigt die Datei.

Diese letzten beiden Punkte sind der Grund, warum “leere Felder übersetzen” keine einfache Checkbox ist. Was als fehlend gilt, wissen nur Sie, daher muss der Mechanismus eine Anweisung in Form eines Satzes entgegennehmen und nicht nur eine Einstellung.

Warum das sonst niemand so macht

Die Neuübersetzung der gesamten Datei bedeutet doppelte Kosten für bereits fertige Teile. Die Übersetzung von Lücken bepreist und prüft nur die fehlenden Zeilen.

Ein maschineller Übersetzer hat kein Konzept von Umfang. DeepL und Google Translate nehmen Text auf und geben Text aus. Es gibt keine Möglichkeit zu sagen: “nicht diese Zeile”, da eine Zeile für sie kein erkennbares Objekt ist. Sie können die Datei vor dem Senden selbst filtern und das Ergebnis hinterher wieder zusammenfügen, was jedoch eine mühsame Tabellenkalkulation ist, die Sie nun selbst verwalten und jeden Monat wiederholen müssen. Zudem gibt es eine Erfahrung aus der Praxis, unabhängig von Tests: Teams kamen zu uns, weil maschinelle Übersetzungen bei ihren echten Inhalten und ihrer spezifischen Terminologie nicht mehr die Qualitätsstandards erreichten, die sie für eine Veröffentlichung benötigen.

Ein allgemeiner Assistent kann sich eine Regel eine Zeit lang merken. Kopieren Sie 50 Zeilen in ChatGPT oder Claude mit der Anweisung “nur die leeren deutschen Zellen ausfüllen”, und es wird funktionieren. Das Problem tritt bei großen Mengen auf, und zwar schleichend: Irgendwann nach den ersten Abschnitten erhält eine Zeile, die bereits eine Übersetzung hatte, eine neue. Das finden Sie bei der Prüfung vielleicht, oder eben nicht. Es gibt einen ausführlichen Vergleich dazu, aber die kurze Fassung ist: Eine Regel, der man vertrauen muss, kann nicht überprüft werden, eine durch Code implementierte Regel hingegen schon.

Eine Agentur wird genau das tun, was Sie verlangen. Die Kosten liegen hier nicht im Wortpreis, sondern in der Vorbereitung: das Extrahieren der fehlenden Zeilen, die Erklärung, welche Spalten unberührt bleiben sollen, das Warten und das spätere Zusammenführen des Ergebnisses in Ihre eigene Datei. Diese Arbeit ist keine Spracharbeit, und die versteckten Kosten bestehen darin, dass Sie all das beim nächsten Update wiederholen müssen.

Die Anweisung wird zu Code, weshalb sie auch bei Zeile 18.000 noch greift

Diesen Teil ist es wert zu verstehen, da er erklärt, warum eine Umfang-Regel hier anders funktioniert.

Ihr Satz wird nicht einfach als Hinweis an ein Übersetzungsmodell weitergegeben. AI Glot liest die Struktur Ihrer Datei und wandelt Ihre Anweisung in ein kleines Programm um, das die Datei durchläuft und eine Liste genau der Textstellen erstellt, die im Umfang enthalten sind. Diese Liste wird dann übersetzt. Die Regel wird durch Code einmal pro Datensatz ausgewertet, sodass Datensatz 18.000 denselben Test durchläuft wie Datensatz 1. Es gibt kein Abweichen, da es nichts gibt, was abweichen könnte.

Dieses Programm durchläuft eine Reihe von Prüfungen, bevor Credits verbraucht werden:

  • Es darf Ihre Datei nicht verändern. Das Dokument wird vor und nach dem Programmablauf verglichen, und jede Modifikation wird sofort abgelehnt. Ihr Upload wird niemals verändert, und jede Entscheidung über den Umfang gilt nur für die Ausgabedatei.
  • Es darf keinen Text erfinden. Jeder ausgewählte Textabschnitt muss Wort für Wort in Ihrer Datei existieren. Es kann keine Zelle im Vorbeigehen paraphrasieren.
  • Jedes Ziel muss ein echter, beschreibbarer Slot sein. Eine Regel, die auf eine nicht existierende Spalte verweist, schlägt also bereits in der Planungsphase fehl, anstatt eine fehlerhafte Datei zu produzieren.
  • Wenn Ihre Regel überhaupt nichts findet, schlägt die Planung fehl und benachrichtigt Sie. Das klingt unfreundlich, ist aber extrem nützlich: So erfahren Sie kostenlos, dass die Datei, von der Sie dachten, sie sei erst halb fertig, eigentlich schon abgeschlossen ist.

“Noch fehlend” bedeutet vier verschiedene Dinge

Hier kommt die Nuance ins Spiel, die darüber entscheidet, ob Ihr Satz funktioniert. Eine Lücke ist in jedem Format ein anderes Objekt, daher ändert sich der Test, den Ihre Anweisung beschreiben muss, je nachdem, welche Datei vorliegt.

Ein einfacher Satz über das Fehlende und die vier verschiedenen Tests, die daraus entstehen, je nach Format Ihrer Datei.

In einer Tabellenkalkulation ist eine Lücke eine leere Zelle. Ob die Datei als CSV-Export oder als Excel-Arbeitsmappe vorliegt, der Test ist derselbe: Diese Zeile hat einen englischen Titel und nichts in der deutschen Spalte, also ist diese Zeile im Umfang enthalten. Sagen Sie: “nur die Zeilen, in denen die deutsche Spalte noch leer ist”.

In einer zweisprachigen Datei ist eine Lücke ein Ziel, das noch dem Quelltext entspricht. XLIFF und PO ordnen jedem Eintrag einen Übersetzungs-Slot zu, und dieser Slot ist normalerweise mit einer Kopie der Quelle vorbefüllt. Daher ist “Leere” der falsche Test; richtig ist ein Vergleich: “übersetze nur die Einheiten, bei denen das Ziel noch denselben Text enthält wie die Quelle”. Dank dieses einen Satzes ist ein WordPress-Export mit 228 Einheiten, bei dem 217 Ziele noch das ursprüngliche Französisch enthalten, ein normaler Auftrag und keine Diskussion darüber, ob die Datei fertig ist.

In einem Key-Tree ist eine Lücke ein Key, der nicht vorhanden ist. In JSON oder YAML existiert die deutsche Übersetzung eines Strings entweder als benachbarter Key oder nicht. Ein fehlender Key kann erstellt werden, solange das übergeordnete Objekt existiert. Ein leerer Wert zählt ebenfalls, daher deckt “nur dort, wo der de-Key fehlt oder leer ist” beides ab.

In einer einsprachigen Datei gibt es innerhalb der Datei nichts, womit man vergleichen könnte, und das ist die ehrliche Grenze. Eine Android strings.xml, eine iOS .strings, eine Java .properties, eine .NET RESX und eine SRT-Untertiteldatei enthalten alle genau einen Wert pro Key. Es gibt keine Quellspalte direkt daneben. Daher kann “bereits übersetzt” nicht mechanisch geprüft werden, da die Datei dies nicht dokumentiert. Was funktioniert, ist alles, was die Datei tatsächlich anzeigt: ein leerer Wert oder eine Markierung, die Sie selbst gesetzt haben, wie ein TODO-Präfix. Wenn Ihr einziges Signal ist, dass ein Wert “nach Englisch aussieht”, kann keine Regel das zuverlässig ausdrücken. In diesem Fall ist es besser, die Datei vor dem Upload aufzuteilen.

Wo der Satz für den Umfang platziert wird und wo er stillschweigend nichts bewirkt

Wenn Sie dies falsch machen, bezahlen Sie für die Übersetzung der gesamten Datei. Es gibt zwei Stellen, an denen Sie eine Anweisung schreiben können, und diese sind nicht austauschbar.

Die Plananweisung bestimmt, welcher Text übersetzt wird. Die Batch-Anweisungen bestimmen, wie jeder String geschrieben wird. Scope an der falschen Stelle bewirkt nichts.

Die Plan-Anweisung ist das, was Sie eingeben, bevor Sie einen Plan sehen. Sie wird mit der Struktur Ihrer Datei abgeglichen und bildet die Grundlage für den Plan. Hier wird der Umfang (Scope) festgelegt.

Die Batch-Anweisungen werden in die Übersetzung übernommen und bei jedem einzelnen String angewendet. In diesem Moment ist nur ein einziger String sichtbar, sodass eine Regel nur Dinge beschreiben kann, die innerhalb dieses Strings sichtbar sind: Behalten Sie einen Platzhalter bei, lassen Sie eine URL im Text unberührt, übersetzen Sie niemals einen Produktnamen, verwenden Sie ein informelles Register.

Und hier passiert der Fehler: Schreiben Sie “nur die leeren Zellen übersetzen” in die Batch-Anweisungen, und es passiert nichts, und Sie werden nicht gewarnt. In diesem Moment gibt es keine Zellen mehr. Es gibt einen String, der bereits ausgewählt wurde und gerade übersetzt wird, weil die Entscheidung über den Umfang zuvor durch eine Anweisung getroffen wurde, die den Umfang nie erwähnt hat. Die Datei kommt vollständig übersetzt zurück, und die Rechnung spiegelt dies wider.

In den Batch-Anweisungen geschrieben Warum es nichts bewirkt Wo es hingehört
“Nur die leeren Zellen übersetzen.” Es sind keine Zellen sichtbar, sondern ein einzelner String. Die Plan-Anweisung
“Überspringe die erste Spalte.” Eine Spalte ist Teil der Dateistruktur. Die Plan-Anweisung
“Nur die seit März hinzugefügten Zeilen.” Gleiches gilt hier. Die Plan-Anweisung
“Lassen Sie die SKU-Spalte unberührt.” Gleiches gilt hier. Beschreiben Sie stattdessen den Inhalt: “Lassen Sie alphanumerische Produktcodes unübersetzt”. Beides, entsprechend umformuliert

Die einfachste Eselsbrücke: Der Plan entscheidet, was übersetzt wird, die Batch-Anweisungen entscheiden, wie es klingt.

Den Satz formulieren

Klares Englisch, ein oder zwei Zeilen, wobei Quellsprache und Zielsprache explizit genannt werden. Folgende Formulierungen funktionieren wie geschrieben:

Only the rows where the German column is still empty. Source is English.
Only translate the units where the target is identical to the source,
it is a placeholder. Leave every unit that already differs.
Fill the empty Italian column from the English one. Do not touch the
French, German or Spanish columns.
Translate the description and the SEO title into Dutch where the Dutch
version is missing. Leave the handle and the SKU alone.
Instructions for this batchOptional
On top of your glossaryApply
Sie beschreiben den Auftrag auf Englisch. AI Glot erstellt daraus einen Plan, den Sie prüfen und korrigieren können, bevor der Prozess startet.

Zwei Gewohnheiten, die sich auszahlen: Nennen Sie die Quellsprache explizit, anstatt sie automatisch erkennen zu lassen, da die automatische Erkennung genau dort am unzuverlässigsten ist, wo es am meisten kostet: bei kurzen Strings und Dateien, die bereits einige übersetzte Werte enthalten, was auf jede Datei in diesem Artikel zutrifft. Und nennen Sie die Spalten oder Keys, die unberührt bleiben sollen, selbst wenn Ihre Umfang-Regel sie bereits ausschließt. Das kostet nur einen Nebensatz und verhindert eine ganze Kategorie von Missverständnissen.

Wenn dieselben Begriffe immer wieder gleich übersetzt werden sollen, wie im letzten Batch, tragen Sie diese einmal in ein Workspace-Glossar ein. Die Zeilen, die Sie jetzt ausfüllen, stimmen dann mit den Zeilen überein, die jemand im März ausgefüllt hat. Das ist die andere Hälfte, um eine teilweise übersetzte Datei korrekt fertigzustellen.

Den Umfang bestätigen, bevor Sie dafür bezahlen

Sie müssen sich nie darauf verlassen, dass Ihre Anweisung funktioniert hat, weil Sie zuerst den Plan lesen.

Der Plan liefert gemessene Zahlen, also die tatsächliche Anzahl an Elementen und Wörtern in Ihrer Datei, nicht eine Schätzung basierend auf der Dateigröße. Er bietet drei Möglichkeiten zur Prüfung: eine Vorschau, wie Ihre Datei danach aussehen wird, eine Tabelle mit den exakten Textstellen, die gesendet werden, und eine Zusammenfassung in einfacher Sprache dessen, was verstanden wurde. In der Element-Tabelle wird ein falscher Umfang offensichtlich, da eine Zeile, von der Sie dachten, sie würde ausgeschlossen, entweder in dieser Liste steht oder eben nicht.

Wenn etwas falsch ist, schreiben Sie das in einem Satz, und es wird neu geplant. Das Erstellen des Batches und die Planung sind kostenlos und können beliebig oft wiederholt werden. Nur die Genehmigung verbraucht Credits, und die Anzahl entspricht der gemessenen Wortzahl dessen, was im Umfang enthalten ist. Der teure Fehler in diesem gesamten Artikel, also für die Neuübersetzung von bereits erledigter Arbeit zu bezahlen, kann also nur passieren, wenn Sie einen Plan genehmigen, der genau das vorsieht.

Diese Reihenfolge ist wichtiger, als es scheint. Ein Tool, bei dem der Umfang eine Vermutung ist, erfordert Vertrauen. Ein Tool, bei dem der Umfang ein Plan ist, den man liest, ist ein Tool, bei dem Fehler nichts kosten.

Zwei weitere nützliche Informationen

Sie können verlangen, dass nur die bearbeiteten Datensätze zurückgegeben werden. Wenn Sie für einen Reviewer nur eine kleine Datei anstatt des gesamten Katalogs benötigen, geben Sie dies an, und die Ausgabe enthält nur die Datensätze, die eine Übersetzung erhalten haben. Dies funktioniert für CSV, Excel, JSON, YAML, PO, XLIFF, SRT und ZIP-Archive dieser Formate. Bei App-Ressourcendateien wird dies bewusst verweigert, da eine App jeden Key sucht, den sie erwartet, und eine unvollständige strings.xml eher zu einem Absturz führt als zu einer kleineren Datei.

Eine Regel, die über die gesamte Datei hinweg zählen muss, wird nicht funktionieren. Bei großen Dateien läuft das Programm zur Auswahl des Umfangs über aufeinanderfolgende Fenster von Zeilen, anstatt alles auf einmal zu sehen. Positionsbasierte Regeln funktionieren, da das Programm rechnen kann: jede zweite Zeile, die ersten 500 Zeilen. Eine Regel, die eine laufende Summe benötigt, wie “die ersten 200 Zeilen, die noch leer sind”, funktioniert nicht, da kein einzelner Durchgang weiß, wie viele frühere Fenster bereits übereingestimmt haben. Fordern Sie entweder alle leeren Zeilen oder einen festen Zeilenbereich an, beides funktioniert problemlos.

Der ehrliche Umfang all dessen

Nutzen Sie es für den Teil, der wirklich repetitiv ist: die 200 Zeilen, die diesen Monat aufgetaucht sind, die vierte Sprache, der man letzte Woche zugestimmt hat, die zweitausend Einheiten, bei denen ein früheres Tool den Quelltext stehen gelassen hat. Diese Arbeit ist manuell mühsam, und es ist jeden Monat die gleiche Arbeit.

Nutzen Sie die Review-Zeit dann für das Ergebnis, nicht für das Filtern der Datei. Viele Teams nutzen dies als ersten Durchgang und lassen einen Reviewer drüberschauen. Das ist eine sinnvolle Nutzung eines Experten und eine weitaus bessere Verwendung eines Nachmittags, als eine Kopie einer Tabellenkalkulation zu erstellen, in der einige Zeilen gelöscht wurden.

Wenn Sie noch keinen dieser Prozesse vollständig durchlaufen haben, beginnen Sie mit dem gesamten Ablauf statt mit dem Umfang: Es gibt eine Anleitung zum Übersetzen einer CSV-Datei und eine zum Übersetzen eines Excel-Arbeitsmappes. Der oben genannte Satz zum Umfang lässt sich in beiden Fällen unverändert übernehmen.

Engagieren Sie für Ihre Homepage einen Übersetzer. Für die 3.600 Zeilen, die noch leer sind, sollten Sie nicht für die 400 bezahlen, die es nicht sind.

10.000 Wörter kostenlos bei Anmeldung

Bereit für die Übersetzung Ihrer großen Dateien?