Waarom machinevertaling op segmentniveau faalt bij gereguleerde documenten in 2026

Machinevertaling op segmentniveau leest één zin, vertaalt die en vergeet hem weer voordat de volgende zin komt. Voor een chatbericht is dat prima. Voor een gebruiksaanwijzing van 40 pagina's, een defensieaanbesteding of een klinische veiligheidssamenvatting is juist dat vergeten het gebrek. Een term die op drie pagina's op drie manieren verschijnt, een voornaamwoord dat naar het verkeerde zelfstandig naamwoord wijst, een weggevallen “niet” in een contra-indicatie: geen van deze gevallen ziet eruit als een fout, en elk ervan kan een audit doen mislukken.
AD VERBUM is een in de EU gehost vertaalbureau dat documentniveau, klantgetunede LLM-vertaling met gecertificeerde vakinhoudelijke revisie uitvoert, onder ISO 18587 en ISO 42001, voor precies dit soort gereguleerde inhoud. Wij bouwden die werkwijze omdat de oude segment-voor-segment engines een document niet bijeen konden houden. In 2026 zijn het aangemelde instanties en aanbestedende diensten die uw bestand lezen, en zij lezen het geheel.
Wat machinevertaling op segmentniveau werkelijk doet
Klassieke neurale machinevertaling knipt uw bestand in segmenten, meestal losse zinnen, en vertaalt elk apart. De engine is deterministisch, snel en goedkoop, en jarenlang was die ruil de moeite waard. De prijs is context. Segment 47 weet niet wat segment 12 besloot, dus wanneer een apparaathandleiding een onderdeel in de ene sectie een “geleider” noemt en de engine het woord later naast een batterij tegenkomt, draagt niets de eerdere keuze mee.
Aan dat ontwerp is niets veranderd. Wat veranderde, is het alternatief. Een groot taalmodel vertaalt met het hele document in beeld, zodat de zin waar u aan werkt wordt gevormd door de alinea waarin die staat.
De fouten die in gereguleerd werk tellen
Vier faalpatronen duiken telkens weer op wanneer een engine op segmentniveau een gereguleerd bestand tegenkomt:
Terminologiedrift. Dezelfde gecontroleerde term komt in één document op drie manieren naar buiten, zodat een revisor niet kan zien of twee passages hetzelfde bedoelen.
Gebroken verwijzingen. “Zie sectie 4.2” blijft staan, maar waar “het” of “het hulpmiddel” naar verwijst wordt bij elke zinsgrens gereset, en de betekenis buigt mee.
Stille weglatingen en getalsfouten. Een weggevallen ontkenning in een contra-indicatie, of 6,0 mm gelezen als 60 mm, doorstaat elke vlotheidscontrole en leest perfect. Het is simpelweg fout.
Geen verantwoordelijkheid en geen spoor. Ruwe engine-uitvoer heeft geen benoemde mens die ervoor tekende, en dat is het eerste waar een ISO 18587-audit naar vraagt.
Geen van deze gevallen verschijnt in een spellingcontrole. Alle zijn duur voor een aangemelde instantie of een aanbestedende dienst.

Waar de fouten in een gereguleerd bestand bijten
De taalverplichtingen zijn concreet, en de blootstelling ook. Onder MDR Artikel 10(11) en Bijlage I 23.1(d) moeten gebruiksaanwijzingen en etiketten juist zijn in elke officiële taal van de lidstaat waar een hulpmiddel wordt aangeboden, en het kwaliteitssysteem van de fabrikant moet ze juist houden. De IVDR legt dezelfde plicht op voor in-vitrodiagnostiek. Een terminologiefout in een gebruiksaanwijzing is geen stijlprobleem, en die kan een CE-markering vertragen.
Defensieaanbesteding verhoogt de inzet opnieuw. Een inschrijving onder Richtlijn 2009/81/EG wordt beoordeeld op een conformiteitsmatrix, en één verkeerd vertaalde technische eis kan de opdracht kosten. Stuurt u het verkeerde bestand naar de verkeerde engine, dan overtreedt u mogelijk ook Verordening (EU) 2021/821 Artikel 2, die de elektronische overdracht van gecontroleerde technologie als een overdracht op zich behandelt.
Waarom LLM-vertaling op documentniveau het bestand bijeenhoudt
Een model op documentniveau leest over zinnen heen, zodat het één term van pagina 1 tot pagina 40 consistent kan houden en kan uitzoeken waar “het” naar verwijst. Het onderzoek bevestigt dit: een studie uit 2023 vond dat grote taalmodellen context op documentniveau gebruiken om verkeerde vertalingen en inconsistenties te verminderen ten opzichte van systemen op zinsniveau, terwijl kritieke fouten er nog steeds doorheen glippen. Juist die laatste bijzin is het hele argument voor de mens in de lus. Het model levert een coherent concept. Het levert geen ondertekend concept.
Er is ook een controledimensie. Een beheerde LLM-werkwijze kan worden beperkt tot uw goedgekeurde terminologie en draaien op infrastructuur die u kunt aanwijzen, in plaats van een openbaar eindpunt dat uw prompts logt.

De norm is niet verdwenen: ISO 18587
ISO 18587 stelt de eisen voor volledige menselijke post-editing van machinevertaaluitvoer en benoemt de competenties die de post-editor moet bezitten. De norm geldt of de ruwe uitvoer nu van een oude engine of van een LLM kwam. De voor oktober 2026 verwachte herziening maakt dat expliciet, trekt een duidelijkere lijn tussen machinevertaling, AI-gegenereerde uitvoer en de post-editingtaak, en sluit nauwer aan bij ISO 17100 voor menselijke vertaling.
De AI-verordening (Verordening (EU) 2024/1689) voegt een transparantielaag toe: vanaf 2 augustus 2026 vereist Artikel 50 dat AI-gegenereerde inhoud als zodanig wordt gemarkeerd. Voor gereguleerde vertaling betekent dat: de AI-stap in uw werkwijze moet gedocumenteerd zijn, niet verborgen.
Hoe wij het bij AD VERBUM aanpakken
Wij bij AD VERBUM beginnen met uw Translation Memory en Term Base, niet met een lege engine. Ons LangOps System genereert uitvoer op klantgetunede open-weight modellen, beperkt tot die terminologie, onze gecertificeerde vakinhoudelijke linguïsten voeren post-editing uit volgens ISO 18587, en de hele pijplijn draait op ISO 27001 en ISO 42001 gecertificeerde, in de EU gehoste infrastructuur zonder publieke-cloudtransit. Dat is het verschil tussen een snel concept en een document dat u kunt verdedigen.
Onze diensten voor machinevertaling en LLM-vertaling
Onze vertaaldiensten voor gereguleerde sectoren draaien op ISO 27001 en ISO 42001 gecertificeerde, in de EU gehoste infrastructuur, zonder te steunen op publieke-cloudtools voor de kernverwerking. Elk project doorloopt onze AI+HUMAN hybride werkwijze: wij nemen eerst de Translation Memories en Term Bases van de klant in, ons eigen LLM-gebaseerde LangOps System genereert uitvoer beperkt door klantterminologie op klantgetunede open-weight modellen, en onze gecertificeerde vakexperts controleren op technische juistheid en regulatoire naleving. Onze QA is afgestemd op ISO 17100 en ISO 18587, met ISO 18587-post-editingdiscipline en ISO 42001 AI-managementgovernance waar relevant. Wij bedienen klanten in Life Sciences, Juridisch, Financiën, Defensie en Productie in 150+ talen met 3.500+ vakinhoudelijke linguïsten. Voor teams die auditgevoelige inhoud beheren: neem contact met ons op om uw beveiligings- en nalevingseisen rechtstreeks te bespreken.
FAQ
Is machinevertaling op segmentniveau ooit aanvaardbaar voor gereguleerde documenten?
Ze kan een ruw eerste concept opleveren, maar op zich is ze geen aanvaardbaar eindproduct. ISO 18587 vereist volledige menselijke post-editing door een gekwalificeerde linguïst die de verantwoordelijkheid voor de eindtekst neemt, en MDR Artikel 10(11) vereist dat de gepubliceerde taalversie juist is. Ruwe uitvoer op segmentniveau voldoet aan geen van beide.
Wat is het verschil tussen NMT en LLM-vertaling?
Neurale machinevertaling werkt segment voor segment zonder geheugen van het bredere document. Een groot taalmodel vertaalt met het hele document in context, wat terminologie en verwijzingen consistent houdt. LLM-uitvoer heeft nog steeds post-editing volgens ISO 18587 nodig voordat ze in een gereguleerd bestand wordt gebruikt.
Is de AI-verordening van toepassing op machinevertaling?
Ja, via haar transparantieregels. Onder Verordening (EU) 2024/1689 Artikel 50, van toepassing vanaf 2 augustus 2026, moet AI-gegenereerde of AI-ondersteunde inhoud als zodanig worden gemarkeerd. Een gereguleerde vertaalwerkwijze die een LLM gebruikt, moet die stap documenteren.
Welke verordening bepaalt de taal van een gebruiksaanwijzing voor een medisch hulpmiddel?
MDR Artikel 10(11), gelezen met Bijlage I 23.1(d), vereist gebruiksaanwijzingen en etiketten in de officiële taal of talen van elke lidstaat waar het hulpmiddel wordt aangeboden. De IVDR legt de gelijkwaardige plicht op voor in-vitrodiagnostiek. Het kwaliteitssysteem van de fabrikant moet die versies juist houden.
Mag ik een openbaar machinevertaaltool gebruiken voor een defensieaanbesteding?
Dat kunt u beter niet doen. Een inschrijving onder Richtlijn 2009/81/EG wordt beoordeeld op juistheid, en het uploaden van gecontroleerde technische gegevens naar een openbare engine kan Verordening (EU) 2021/821 Artikel 2 schenden, die de elektronische overdracht van gecontroleerde technologie behandelt als een overdracht waarvoor toestemming nodig is. Gebruik in plaats daarvan gescreende linguïsten op gecontroleerde infrastructuur.
Wie is verantwoordelijk voor fouten in machinaal vertaalde tekst?
Onder ISO 18587 neemt de gekwalificeerde menselijke post-editor de verantwoordelijkheid voor de eindvertaling, niet de engine. Die benoemde verantwoording is waarom gereguleerde afnemers een gecertificeerd post-editingproces vereisen in plaats van ruwe machine-uitvoer.
Aanbevolen
Welke vertaalbureaus voeren beheerde LLM-vertaling uit in plaats van klassieke machinevertaling
Kunnen machinevertaalfouten in een IVDR-gebruiksaanwijzing uw CE-markering vertragen
Hoe terminologiegovernance gereguleerde vertaling consistent houdt
Veilige bedrijfsvertaling op in de EU gehoste infrastructuur


