top of page

Hvorfor maskinoversettelse på segmentnivå svikter regulerte dokumenter i 2026

8. sep.
5 min lesing
Etterredaktør går gjennom oversettelsesdokumenter

Maskinoversettelse på segmentnivå leser én setning, oversetter den og glemmer den igjen før den leser den neste. Til en chatmelding er det greit. Til en bruksanvisning på 40 sider, et forsvarsanbud eller et klinisk sikkerhetssammendrag er nettopp den glemselen feilen. Et fagbegrep gjengitt på tre måter over tre sider, et pronomen som peker på feil substantiv, et manglende «ikke» i en kontraindikasjon: ingen av dem ser ut som en feil, og hver enkelt kan stryke i en revisjon.


AD VERBUM er et EU-hostet oversettelsesbyrå som kjører dokumentnivå, kundetilpasset LLM-oversettelse med sertifisert fagfellevurdering, etter ISO 18587 og ISO 42001, for nettopp denne typen regulert innhold. Vi bygde den arbeidsflyten fordi de gamle segment-for-segment-motorene ikke klarte å holde et dokument sammen. I 2026 er det tekniske kontrollorganer og oppdragsgivere som leser filen din, og de leser hele.


Hva maskinoversettelse på segmentnivå faktisk gjør


Klassisk nevral maskinoversettelse deler filen din i segmenter, som regel enkeltsetninger, og oversetter hvert for seg. Motoren er deterministisk, rask og billig, og i årevis var den byttehandelen verdt det. Prisen er kontekst. Segment 47 aner ikke hva segment 12 bestemte, så når en apparatmanual kaller en komponent en «leder» i én seksjon og motoren møter ordet igjen ved siden av et batteri, bærer ingenting det tidligere valget videre.


Den utformingen har ikke endret seg. Det som endret seg, er alternativet. En stor språkmodell oversetter med hele dokumentet i sikte, slik at setningen du er på formes av avsnittet den står i.


Feilene som teller i regulert arbeid


Fire feiltyper dukker opp igjen og igjen når en motor på segmentnivå møter en regulert fil:


  • Terminologidrift. Det samme kontrollerte fagbegrepet kommer ut på tre måter i ett dokument, slik at en korrekturleser ikke kan se om to avsnitt mener det samme.

  • Brutte henvisninger. «Se avsnitt 4.2» overlever, men hva «det» eller «utstyret» viser til nullstilles ved hver setningsgrense, og meningen bøyer med.

  • Tause utelatelser og tallfeil. En manglende nektelse i en kontraindikasjon, eller 6,0 mm lest som 60 mm, består enhver flyt-kontroll og leser perfekt. Det er rett og slett feil.

  • Intet ansvar og intet spor. Rå motoroutput har ingen navngitt person som har signert for det, og det er det første en ISO 18587-revisjon spør etter.


Ingen av dem viser seg i en stavekontroll. Alle er dyre foran et teknisk kontrollorgan eller en oppdragsgiver.


Korrekturleser holder oversettelsesoutput opp mot ISO 18587-krav

Hvor feilene biter i en regulert fil


Språkpliktene er konkrete, og eksponeringen likeså. Etter MDR artikkel 10(11) og vedlegg I 23.1(d) må bruksanvisninger og merking være korrekte på hvert offisielle språk i medlemsstaten der utstyret gjøres tilgjengelig, og produsentens kvalitetssystem må holde dem korrekte. IVDR fastsetter samme plikt for in vitro-diagnostisk medisinsk utstyr. En terminologifeil i en bruksanvisning er ikke et stilproblem, og den kan forsinke en CE-merking.


Forsvarsanskaffelser hever innsatsen igjen. Et tilbud etter direktiv 2009/81/EF vurderes mot en samsvarsmatrise, og ett feiloversatt teknisk krav kan koste kontrakten. Sender du feil fil til feil motor, kan du også bryte forordning (EU) 2021/821 artikkel 2, som behandler elektronisk overføring av kontrollert teknologi som en overføring i seg selv.


Hvorfor LLM-oversettelse på dokumentnivå holder filen sammen


En modell på dokumentnivå leser på tvers av setninger, slik at den kan holde ett fagbegrep konsistent fra side 1 til side 40 og finne ut hva «det» viser til. Forskningen støtter dette: en studie fra 2023 fant at store språkmodeller bruker kontekst på dokumentnivå til å redusere feiloversettelser og uoverensstemmelser sammenlignet med systemer på setningsnivå, samtidig som kritiske feil fortsatt slipper gjennom. Nettopp den siste setningen er hele argumentet for mennesket i sløyfa. Modellen gir deg et sammenhengende utkast. Den gir deg ikke et signert.


Det finnes også en kontrolldimensjon. En styrt LLM-arbeidsflyt kan begrenses til din godkjente terminologi og kjøre på infrastruktur du kan peke på, i stedet for et offentlig endepunkt som logger promptene dine.


Språkforsker går gjennom oversettelser av regulatoriske dokumenter

Standarden forsvant ikke: ISO 18587


ISO 18587 fastsetter kravene til full menneskelig etterredigering av maskinoversettelsesoutput og navngir kompetansene etterredaktøren må ha. Den gjelder enten det rå utdataet kom fra en gammel motor eller en LLM. Revisjonen som ventes i oktober 2026 gjør det uttrykkelig, trekker en tydeligere linje mellom maskinoversettelse, AI-generert utdata og etterredigeringsoppgaven, og retter seg tettere etter ISO 17100 for menneskelig oversettelse.



AI-forordningen (forordning (EU) 2024/1689) legger til et åpenhetslag: fra 2. august 2026 krever artikkel 50 at AI-generert innhold merkes som sådant. For regulert oversettelse betyr det at AI-trinnet i arbeidsflyten din må dokumenteres, ikke skjules.


Slik gjør vi det hos AD VERBUM


Vi i AD VERBUM starter med din Translation Memory og Term Base, ikke en tom motor. Vårt LangOps System genererer utdata på kundetilpassede open-weight-modeller begrenset av den terminologien, våre sertifiserte fagspråkfolk etterredigerer etter ISO 18587, og hele pipelinen kjører på ISO 27001- og ISO 42001-sertifisert, EU-hostet infrastruktur uten offentlig-sky-transitt. Det er forskjellen på et raskt utkast og et dokument du kan forsvare.


Våre tjenester for maskinoversettelse og LLM-oversettelse


Våre oversettelsestjenester for regulerte bransjer kjører på ISO 27001- og ISO 42001-sertifisert, EU-hostet infrastruktur, uten å lene seg på offentlige sky-verktøy for kjernebehandling. Hvert prosjekt går gjennom vår AI+HUMAN-hybridarbeidsflyt: vi tar først inn kundens Translation Memories og Term Bases, vårt egenutviklede LLM-baserte LangOps System genererer utdata begrenset av kundeterminologi på kundetilpassede open-weight-modeller, og våre sertifiserte fageksperter gjennomgår for teknisk nøyaktighet og regulatorisk samsvar. Vår QA er tilpasset ISO 17100 og ISO 18587, med ISO 18587-etterredigeringsdisiplin og ISO 42001-AI-styring der det er relevant. Vi betjener kunder innen Life Sciences, Juss, Finans, Forsvar og Produksjon på 150+ språk med 3 500+ fagspråkfolk. For team som håndterer revisjonssensitivt innhold: kontakt oss for å drøfte sikkerhets- og samsvarskravene deres direkte.


FAQ


Er maskinoversettelse på segmentnivå noen gang akseptabel for regulerte dokumenter?


Den kan levere et grovt førsteutkast, men er alene ikke et akseptabelt produkt. ISO 18587 krever full menneskelig etterredigering av en kvalifisert språkperson som tar ansvar for den endelige teksten, og MDR artikkel 10(11) krever at den publiserte språkversjonen er korrekt. Rå utdata på segmentnivå oppfyller ingen av delene.


Hva er forskjellen på NMT og LLM-oversettelse?


Nevral maskinoversettelse arbeider segment for segment uten minne om det bredere dokumentet. En stor språkmodell oversetter med hele dokumentet i kontekst, noe som holder terminologi og henvisninger konsistente. LLM-utdata trenger fortsatt etterredigering etter ISO 18587 før det brukes i en regulert fil.


Gjelder AI-forordningen for maskinoversettelse?


Ja, via åpenhetsreglene. Etter forordning (EU) 2024/1689 artikkel 50, gjeldende fra 2. august 2026, må AI-generert eller AI-støttet innhold merkes som sådant. En regulert oversettelsesarbeidsflyt som bruker en LLM, må dokumentere det trinnet.


Hvilken forordning fastsetter språket for en bruksanvisning til medisinsk utstyr?


MDR artikkel 10(11), lest med vedlegg I 23.1(d), krever bruksanvisninger og merking på det offisielle språket eller språkene i hver medlemsstat der utstyret gjøres tilgjengelig. IVDR fastsetter den tilsvarende plikten for in vitro-diagnostikk. Produsentens kvalitetssystem må holde disse versjonene korrekte.


Kan jeg bruke et offentlig maskinoversettelsesverktøy til et forsvarsanbud?


Det bør du ikke. Et tilbud etter direktiv 2009/81/EF vurderes på nøyaktighet, og opplasting av kontrollerte tekniske data til en offentlig motor kan bryte forordning (EU) 2021/821 artikkel 2, som behandler elektronisk overføring av kontrollert teknologi som en overføring som krever tillatelse. Bruk i stedet kontrollerte språkfolk på kontrollert infrastruktur.


Hvem er ansvarlig for feil i maskinoversatt tekst?


Etter ISO 18587 tar den kvalifiserte menneskelige etterredaktøren ansvaret for den endelige oversettelsen, ikke motoren. Nettopp det navngitte ansvaret er grunnen til at regulerte kunder krever en sertifisert etterredigeringsprosess fremfor rå maskinutdata.


Anbefalt



 
 
bottom of page