Skip to content

Lexikon · Sprachdienstleistungen

Fuzzy Match: Definition, Match-Raten und Preise

Was ein Fuzzy Match ist, wie die Prozentwerte im Translation Memory entstehen, welche Match-Kategorien es gibt und warum sie den Preis bestimmen.

  • Aktualisiert am

Kurz gesagt

  1. Ein Fuzzy Match ist ein Segment aus dem Übersetzungsspeicher, das einem neuen Satz ähnelt, ohne mit ihm identisch zu sein. Die Ähnlichkeit wird in Prozent angegeben.
  2. Üblich sind Kategorien von 100 Prozent abwärts bis zu einer Untergrenze bei etwa 75 Prozent. Darunter gilt ein Segment als neu.
  3. Match-Raten bestimmen den Preis: Wiederholungen und hohe Treffer werden geringer berechnet als neue Segmente.
  4. Der Prozentwert misst Zeichenähnlichkeit, nicht Bedeutung. Ein eingefügtes „nicht“ kostet wenige Prozentpunkte und dreht den Satz um.
  5. Wie hoch die Quote ausfällt, hängt vom Zustand Ihres Speichers ab, nicht vom Zufall.

Was ist ein Fuzzy Match?

Definition

Ein Fuzzy Match, auf Deutsch unscharfer Treffer, ist ein bereits übersetztes Segment aus dem Übersetzungsspeicher, das einem neuen Satz ähnelt, ohne mit ihm übereinzustimmen. Das Übersetzungssystem schlägt die gespeicherte Fassung vor und gibt die Ähnlichkeit als Prozentwert an. Je höher der Wert, desto weniger muss angepasst werden.

Segment heißt dabei meist Satz, je nach Dateiformat auch eine Überschrift, eine Tabellenzelle oder ein Listenpunkt. Beim Vorbereiten einer Übersetzung vergleicht das System jedes Segment des neuen Textes mit dem gesamten Speicher und ordnet es einer Kategorie zu. Aus dieser Auswertung entstehen zwei Dinge auf einmal: die Vorbelegung für die Übersetzerin und die Kalkulation für Ihr Angebot.

Die Match-Kategorien

Die Einteilung ist Branchenkonvention, die genauen Grenzen legt jedes Übersetzungssystem selbst fest. Diese Staffel ist die verbreitetste.

Kategorie Was sie bedeutet Üblicher Umgang
Kontext-Match (oft 101 oder 102 Prozent) Segment und Umgebung stimmen überein, also auch der Satz davor und danach Wird in der Regel übernommen und nur stichprobenweise geprüft
100 Prozent Das Segment steht wortgleich im Speicher, das Umfeld kann abweichen Prüfung, ob die gespeicherte Fassung an dieser Stelle passt
95 bis 99 Prozent Eine Kleinigkeit weicht ab, oft eine Zahl, ein Name oder ein Tag Schnelle Anpassung, aber genau hier entstehen die meisten Flüchtigkeitsfehler
85 bis 94 Prozent Der Satz ist erkennbar verwandt, einzelne Wörter fehlen oder sind ersetzt Bearbeitung nötig, der Vorschlag spart trotzdem Zeit
75 bis 84 Prozent Ähnliche Struktur, deutlich abweichender Inhalt Grenzbereich, häufig ist Neuübersetzung schneller
Unter 75 Prozent (No Match) Kein verwertbarer Treffer Wird wie ein neuer Satz behandelt
Wiederholung Das Segment kommt im selben Auftrag mehrfach vor Einmal übersetzt, danach automatisch eingesetzt

In der Auswertung tauchen die Kategorien als Wortzahlen auf: so viele Wörter in Wiederholungen, so viele in 100-Prozent-Treffern, so viele neu. Genau diese Aufstellung steht später im Angebot.

Wie der Prozentwert entsteht

Das System vergleicht Zeichen- und Wortfolgen, nicht Inhalte. Es zählt, wie viel geändert werden müsste, um aus dem gespeicherten Segment das neue zu machen. Abzüge gibt es zusätzlich für abweichende Formatierung, unterschiedliche Tags oder Zahlen.

Das erklärt die wichtigste Eigenheit des Verfahrens: Ein Satz kann zu 97 Prozent übereinstimmen und das Gegenteil bedeuten.

Rolle Satz Einordnung
Ausgangssatz im Speicher Die Maschine darf nur mit geschlossener Schutzhaube betrieben werden. Grundlage des Vergleichs
Neuer Satz Die Maschine darf nicht mit geschlossener Schutzhaube betrieben werden. Hoher Fuzzy Match, gegenteilige Bedeutung
Neuer Satz Die Anlage darf nur mit geschlossener Schutzhaube betrieben werden. Hoher Fuzzy Match, ein Fachbegriff geändert
Neuer Satz Die Maschine darf nur mit geschlossener Schutzhaube und aktivierter Absaugung betrieben werden. Mittlerer Match, Inhalt erweitert

Deshalb gilt in sicherheitsrelevanten Texten: Hohe Treffer werden nicht überflogen, sondern gelesen. Mehr dazu im Eintrag Konsistenz.

Was das für Unternehmen bedeutet

Fuzzy Matches sind kein technisches Detail, sondern der Grund, warum zwei Angebote über denselben Text unterschiedlich ausfallen können. Fünf Punkte, die daraus folgen.

Match-Raten bestimmen den Preis

Vor jedem Angebot analysiert das Übersetzungssystem den Text gegen Ihren Speicher und zählt, wie viele Wörter in welche Kategorie fallen. Hohe Matches und Wiederholungen werden geringer berechnet als neue Segmente. Die Staffel steht auf der Preisseite.

Ihr Speicher ist ein Vermögenswert

Je größer und gepflegter das Translation Memory, desto höher die Matchquote beim nächsten Auftrag. Bei Folgeauflagen, Produktvarianten und jährlich wiederkehrenden Dokumenten macht das den größten Teil der Ersparnis aus, nicht der Wortpreis.

Konsistente Ausgangstexte zahlen sich doppelt aus

Wer dieselbe Warnung immer gleich formuliert, erzeugt Wiederholungen statt vierzehn Varianten desselben Satzes. Das senkt die Kosten in jeder Zielsprache gleichzeitig.

Rabatt heißt nicht kein Aufwand

Auch ein 100-Prozent-Treffer wird gelesen, weil derselbe Satz an anderer Stelle anders wirken kann. Wer Matches ungeprüft übernimmt, spart an der Stelle, an der Fehler unbemerkt in Folgeauflagen wandern.

Klären Sie, wem der Speicher gehört

Das Translation Memory sollte Ihnen gehören und exportierbar sein. Sonst verlieren Sie bei einem Anbieterwechsel genau den Bestand, der Ihre Preise senkt.

Wie die Staffel bei tolingo aussieht, steht auf der Preisseite, die Technik dahinter auf der Seite zum Translation Memory.

Nicht zu verwechseln

Vier Begriffe stehen in derselben Auswertung und meinen Verschiedenes.

Begriff Bedeutung
Fuzzy Match Ähnliches Segment aus dem Speicher, Ähnlichkeit in Prozent
Wiederholung Identisches Segment innerhalb desselben Auftrags, unabhängig vom Speicher
Kontext-Match Identisches Segment, bei dem auch die Nachbarsegmente übereinstimmen
Konkordanzsuche Manuelle Suche nach einem Wort oder einer Wendung im Speicher, keine automatische Vorbelegung
Maschineller Vorschlag Vorschlag aus einem Übersetzungsmodell, nicht aus Ihrem Speicher. Wird getrennt ausgewiesen und anders geprüft

Fehlerquellen

Hohe Matches sparen Zeit und sind gleichzeitig die Stelle, an der am häufigsten etwas übersehen wird.

Fehlerquelle Was dahintersteckt
Ähnlichkeit ist nicht Bedeutung Der Prozentwert misst, wie viele Zeichen und Wörter übereinstimmen. Ein eingefügtes „nicht“ kostet wenige Prozentpunkte und dreht den Satz um.
Zahlen, Einheiten und Namen Genau diese Unterschiede erzeugen hohe Matches und werden beim schnellen Durchsehen übersehen.
Alte Fehler vervielfachen sich Was einmal falsch im Speicher steht, wird bei jedem ähnlichen Satz wieder vorgeschlagen. Deshalb gehören Korrekturen aus dem Markt zurück in den Speicher.
Formatierung senkt den Wert Unterschiedliche Tags, Sonderzeichen oder Zeilenumbrüche im Ausgangsdokument drücken den Prozentwert, obwohl der Text gleich ist.
Segmentierung entscheidet mit Wie ein System Sätze trennt, bestimmt, was überhaupt verglichen wird. Andere Segmentierung, andere Matchquote.

Häufige Fragen

Was bedeutet ein Fuzzy Match von 85 Prozent?

Dass ein Segment im Translation Memory zu etwa 85 Prozent mit dem neuen Satz übereinstimmt. Der Vorschlag ist brauchbar, muss aber angepasst werden. Wie der Wert genau berechnet wird, unterscheidet sich je nach Übersetzungssystem.

Ab welchem Wert lohnt sich ein Fuzzy Match?

Üblich ist eine Untergrenze bei etwa 75 Prozent. Darunter dauert das Anpassen länger als eine Neuübersetzung, deshalb werden solche Segmente wie neue Sätze behandelt.

Warum kostet ein 100-Prozent-Treffer trotzdem etwas?

Weil er geprüft wird. Derselbe Satz kann an anderer Stelle eine andere Bedeutung oder einen anderen Bezug haben, etwa bei Überschriften, Tabellenzellen oder Zwischentiteln.

Wie erhöhe ich die Matchquote?

Durch einen gepflegten Speicher, einheitlich formulierte Ausgangstexte, eine feste Terminologie und saubere Dateiformate ohne überflüssige Formatierung im Satz.

Gilt das auch bei maschineller Übersetzung?

Ja. Der Speicher wird zuerst abgefragt, erst danach kommt die maschinelle Vorübersetzung für die Segmente ohne Treffer. Beides wird im Angebot getrennt ausgewiesen.

Wem gehört das Translation Memory?

Bei tolingo Ihnen. Sie können den Speicher exportieren und mitnehmen. Das ist auch der Grund, warum sich der Aufbau über Jahre lohnt.

Weiterlesen

Alle Begriffe im tolingo Lexikon

Verfasst von der tolingo Fachredaktion

Zuletzt geprüft am 25. September 2026

Die Fachredaktion von tolingo schreibt über Sprache im Unternehmen. Was hier steht, stammt aus der täglichen Arbeit an Übersetzungsprojekten, abgestimmt mit Projektleitung, Terminologie und Qualitätssicherung. tolingo übersetzt seit 2007 aus Hamburg in über 220 Sprachen, zertifiziert nach ISO 17100, ISO 18587, ISO 9001 und ISO 27001.

Weitere Begriffe aus dem Lexikon