Kurz gesagt
Auf dieser Seite
Definition
Ein Fuzzy Match, auf Deutsch unscharfer Treffer, ist ein bereits übersetztes Segment aus dem Übersetzungsspeicher, das einem neuen Satz ähnelt, ohne mit ihm übereinzustimmen. Das Übersetzungssystem schlägt die gespeicherte Fassung vor und gibt die Ähnlichkeit als Prozentwert an. Je höher der Wert, desto weniger muss angepasst werden.
Segment heißt dabei meist Satz, je nach Dateiformat auch eine Überschrift, eine Tabellenzelle oder ein Listenpunkt. Beim Vorbereiten einer Übersetzung vergleicht das System jedes Segment des neuen Textes mit dem gesamten Speicher und ordnet es einer Kategorie zu. Aus dieser Auswertung entstehen zwei Dinge auf einmal: die Vorbelegung für die Übersetzerin und die Kalkulation für Ihr Angebot.
Die Einteilung ist Branchenkonvention, die genauen Grenzen legt jedes Übersetzungssystem selbst fest. Diese Staffel ist die verbreitetste.
| Kategorie | Was sie bedeutet | Üblicher Umgang |
|---|---|---|
| Kontext-Match (oft 101 oder 102 Prozent) | Segment und Umgebung stimmen überein, also auch der Satz davor und danach | Wird in der Regel übernommen und nur stichprobenweise geprüft |
| 100 Prozent | Das Segment steht wortgleich im Speicher, das Umfeld kann abweichen | Prüfung, ob die gespeicherte Fassung an dieser Stelle passt |
| 95 bis 99 Prozent | Eine Kleinigkeit weicht ab, oft eine Zahl, ein Name oder ein Tag | Schnelle Anpassung, aber genau hier entstehen die meisten Flüchtigkeitsfehler |
| 85 bis 94 Prozent | Der Satz ist erkennbar verwandt, einzelne Wörter fehlen oder sind ersetzt | Bearbeitung nötig, der Vorschlag spart trotzdem Zeit |
| 75 bis 84 Prozent | Ähnliche Struktur, deutlich abweichender Inhalt | Grenzbereich, häufig ist Neuübersetzung schneller |
| Unter 75 Prozent (No Match) | Kein verwertbarer Treffer | Wird wie ein neuer Satz behandelt |
| Wiederholung | Das Segment kommt im selben Auftrag mehrfach vor | Einmal übersetzt, danach automatisch eingesetzt |
In der Auswertung tauchen die Kategorien als Wortzahlen auf: so viele Wörter in Wiederholungen, so viele in 100-Prozent-Treffern, so viele neu. Genau diese Aufstellung steht später im Angebot.
Das System vergleicht Zeichen- und Wortfolgen, nicht Inhalte. Es zählt, wie viel geändert werden müsste, um aus dem gespeicherten Segment das neue zu machen. Abzüge gibt es zusätzlich für abweichende Formatierung, unterschiedliche Tags oder Zahlen.
Das erklärt die wichtigste Eigenheit des Verfahrens: Ein Satz kann zu 97 Prozent übereinstimmen und das Gegenteil bedeuten.
| Rolle | Satz | Einordnung |
|---|---|---|
| Ausgangssatz im Speicher | Die Maschine darf nur mit geschlossener Schutzhaube betrieben werden. | Grundlage des Vergleichs |
| Neuer Satz | Die Maschine darf nicht mit geschlossener Schutzhaube betrieben werden. | Hoher Fuzzy Match, gegenteilige Bedeutung |
| Neuer Satz | Die Anlage darf nur mit geschlossener Schutzhaube betrieben werden. | Hoher Fuzzy Match, ein Fachbegriff geändert |
| Neuer Satz | Die Maschine darf nur mit geschlossener Schutzhaube und aktivierter Absaugung betrieben werden. | Mittlerer Match, Inhalt erweitert |
Deshalb gilt in sicherheitsrelevanten Texten: Hohe Treffer werden nicht überflogen, sondern gelesen. Mehr dazu im Eintrag Konsistenz.
Fuzzy Matches sind kein technisches Detail, sondern der Grund, warum zwei Angebote über denselben Text unterschiedlich ausfallen können. Fünf Punkte, die daraus folgen.
Vor jedem Angebot analysiert das Übersetzungssystem den Text gegen Ihren Speicher und zählt, wie viele Wörter in welche Kategorie fallen. Hohe Matches und Wiederholungen werden geringer berechnet als neue Segmente. Die Staffel steht auf der Preisseite.
Je größer und gepflegter das Translation Memory, desto höher die Matchquote beim nächsten Auftrag. Bei Folgeauflagen, Produktvarianten und jährlich wiederkehrenden Dokumenten macht das den größten Teil der Ersparnis aus, nicht der Wortpreis.
Wer dieselbe Warnung immer gleich formuliert, erzeugt Wiederholungen statt vierzehn Varianten desselben Satzes. Das senkt die Kosten in jeder Zielsprache gleichzeitig.
Auch ein 100-Prozent-Treffer wird gelesen, weil derselbe Satz an anderer Stelle anders wirken kann. Wer Matches ungeprüft übernimmt, spart an der Stelle, an der Fehler unbemerkt in Folgeauflagen wandern.
Das Translation Memory sollte Ihnen gehören und exportierbar sein. Sonst verlieren Sie bei einem Anbieterwechsel genau den Bestand, der Ihre Preise senkt.
Wie die Staffel bei tolingo aussieht, steht auf der Preisseite, die Technik dahinter auf der Seite zum Translation Memory.
Vier Begriffe stehen in derselben Auswertung und meinen Verschiedenes.
| Begriff | Bedeutung |
|---|---|
| Fuzzy Match | Ähnliches Segment aus dem Speicher, Ähnlichkeit in Prozent |
| Wiederholung | Identisches Segment innerhalb desselben Auftrags, unabhängig vom Speicher |
| Kontext-Match | Identisches Segment, bei dem auch die Nachbarsegmente übereinstimmen |
| Konkordanzsuche | Manuelle Suche nach einem Wort oder einer Wendung im Speicher, keine automatische Vorbelegung |
| Maschineller Vorschlag | Vorschlag aus einem Übersetzungsmodell, nicht aus Ihrem Speicher. Wird getrennt ausgewiesen und anders geprüft |
Hohe Matches sparen Zeit und sind gleichzeitig die Stelle, an der am häufigsten etwas übersehen wird.
| Fehlerquelle | Was dahintersteckt |
|---|---|
| Ähnlichkeit ist nicht Bedeutung | Der Prozentwert misst, wie viele Zeichen und Wörter übereinstimmen. Ein eingefügtes „nicht“ kostet wenige Prozentpunkte und dreht den Satz um. |
| Zahlen, Einheiten und Namen | Genau diese Unterschiede erzeugen hohe Matches und werden beim schnellen Durchsehen übersehen. |
| Alte Fehler vervielfachen sich | Was einmal falsch im Speicher steht, wird bei jedem ähnlichen Satz wieder vorgeschlagen. Deshalb gehören Korrekturen aus dem Markt zurück in den Speicher. |
| Formatierung senkt den Wert | Unterschiedliche Tags, Sonderzeichen oder Zeilenumbrüche im Ausgangsdokument drücken den Prozentwert, obwohl der Text gleich ist. |
| Segmentierung entscheidet mit | Wie ein System Sätze trennt, bestimmt, was überhaupt verglichen wird. Andere Segmentierung, andere Matchquote. |
Dass ein Segment im Translation Memory zu etwa 85 Prozent mit dem neuen Satz übereinstimmt. Der Vorschlag ist brauchbar, muss aber angepasst werden. Wie der Wert genau berechnet wird, unterscheidet sich je nach Übersetzungssystem.
Üblich ist eine Untergrenze bei etwa 75 Prozent. Darunter dauert das Anpassen länger als eine Neuübersetzung, deshalb werden solche Segmente wie neue Sätze behandelt.
Weil er geprüft wird. Derselbe Satz kann an anderer Stelle eine andere Bedeutung oder einen anderen Bezug haben, etwa bei Überschriften, Tabellenzellen oder Zwischentiteln.
Durch einen gepflegten Speicher, einheitlich formulierte Ausgangstexte, eine feste Terminologie und saubere Dateiformate ohne überflüssige Formatierung im Satz.
Ja. Der Speicher wird zuerst abgefragt, erst danach kommt die maschinelle Vorübersetzung für die Segmente ohne Treffer. Beides wird im Angebot getrennt ausgewiesen.
Bei tolingo Ihnen. Sie können den Speicher exportieren und mitnehmen. Das ist auch der Grund, warum sich der Aufbau über Jahre lohnt.
Translation Memory
Aus wiederkehrenden Texten wird ein Preisvorteil
Wir bauen Ihren Übersetzungsspeicher auf, pflegen ihn über alle Aufträge hinweg und weisen die Match-Kategorien in jedem Angebot getrennt aus. Der Speicher gehört Ihnen und ist exportierbar. Mehr zum Translation Memory und zur Fachübersetzung nach ISO 17100.