top of page

Miksi segmenttitason konekäännös epäonnistuu säännellyissä asiakirjoissa vuonna 2026

8.9.
4 min käytetty lukemiseen
Jälkieditoija tarkastaa käännösasiakirjoja

Segmenttitason konekäännös lukee yhden lauseen, kääntää sen ja unohtaa sen taas ennen kuin lukee seuraavan. Chat-viestissä se on ihan hyvä. 40-sivuisessa käyttöohjeessa, puolustushankinnan tarjouksessa tai kliinisessä turvallisuustiivistelmässä juuri tuo unohtaminen on vika. Termi kolmella eri tavalla kolmella sivulla, pronomini joka osoittaa väärään substantiiviin, puuttuva ”ei” kontraindikaatiossa: mikään näistä ei näytä virheeltä, ja jokainen niistä voi kaataa auditoinnin.


AD VERBUM on EU:ssa isännöity käännöstoimisto, joka ajaa asiakirjatason, asiakaskohtaisesti viritettyä LLM-käännöstä sertifioidulla asiantuntijatarkistuksella, ISO 18587:n ja ISO 42001:n mukaan, juuri tällaiselle säännellylle sisällölle. Rakensimme tämän työnkulun, koska vanhat segmentti segmentiltä toimivat moottorit eivät pystyneet pitämään asiakirjaa koossa. Vuonna 2026 tiedostoasi lukevat ilmoitetut laitokset ja hankintaviranomaiset, ja he lukevat sen kokonaan.


Mitä segmenttitason konekäännös oikeasti tekee


Klassinen neuroverkkokonekäännös pilkkoo tiedostosi segmentteihin, yleensä yksittäisiin lauseisiin, ja kääntää kunkin erikseen. Moottori on deterministinen, nopea ja halpa, ja vuosia se vaihtokauppa kannatti. Hinta on konteksti. Segmentti 47 ei tiedä, mitä segmentti 12 päätti, joten kun laitteen käsikirja kutsuu osaa ”johtimeksi” yhdessä kohdassa ja moottori kohtaa sanan taas akun vieressä, mikään ei kanna aiempaa valintaa eteenpäin.


Tämä rakenne ei ole muuttunut. Muuttunut on vaihtoehto. Suuri kielimalli kääntää koko asiakirja näkyvissä, joten lause, jossa olet, muotoutuu sen kappaleen mukaan, jossa se on.


Virheet, joilla on merkitystä säännellyssä työssä


Neljä virhetyyppiä nousee esiin yhä uudelleen, kun segmenttitason moottori kohtaa säännellyn tiedoston:


  • Terminologian ajautuminen. Sama valvottu termi tulee ulos kolmella tavalla yhdessä asiakirjassa, joten tarkastaja ei voi tietää, tarkoittavatko kaksi kohtaa samaa.

  • Rikkinäiset viittaukset. ”Katso kohta 4.2” säilyy, mutta se, mihin ”se” tai ”laite” viittaa, nollautuu jokaisella lauserajalla, ja merkitys taipuu mukana.

  • Hiljaiset poisjätöt ja numerovirheet. Puuttuva kielto kontraindikaatiossa tai 6,0 mm luettuna 60 mm läpäisee jokaisen sujuvuustarkistuksen ja lukeutuu täydellisesti. Se on yksinkertaisesti väärin.

  • Ei vastuuta eikä jälkeä. Raa'alla moottorin tuotoksella ei ole nimettyä ihmistä, joka olisi allekirjoittanut sen, ja se on ensimmäinen asia, jota ISO 18587 -auditointi kysyy.


Mikään näistä ei näy oikolukutarkistuksessa. Kaikki ovat kalliita ilmoitetun laitoksen tai hankintaviranomaisen edessä.


Tarkastaja vertaa käännöstuotosta ISO 18587 -vaatimuksiin

Missä virheet purevat säännellyssä tiedostossa


Kielivelvoitteet ovat täsmällisiä, ja niin on vastuukin. MDR:n 10 artiklan 11 kohdan ja liitteen I kohdan 23.1(d) mukaan käyttöohjeiden ja merkintöjen on oltava oikein jokaisen jäsenvaltion virallisella kielellä, jossa laite asetetaan saataville, ja valmistajan laatujärjestelmän on pidettävä ne oikeina. IVDR asettaa saman velvoitteen in vitro -diagnostiikkalaitteille. Terminologiavirhe käyttöohjeessa ei ole tyyliongelma, ja se voi viivästyttää CE-merkintää.


Puolustushankinnat nostavat panosta jälleen. Direktiivin 2009/81/EY mukaista tarjousta arvioidaan vaatimustenmukaisuusmatriisilla, ja yksi väärin käännetty tekninen vaatimus voi maksaa sopimuksen. Jos lähetät väärän tiedoston väärään moottoriin, saatat myös rikkoa asetuksen (EU) 2021/821 2 artiklaa, joka käsittelee valvotun teknologian sähköistä siirtoa siirtona sinänsä.


Miksi asiakirjatason LLM-käännös pitää tiedoston koossa


Asiakirjatason malli lukee lauseiden yli, joten se voi pitää yhden termin johdonmukaisena sivulta 1 sivulle 40 ja päätellä, mihin ”se” viittaa. Tutkimus tukee tätä: vuoden 2023 tutkimus havaitsi, että suuret kielimallit käyttävät asiakirjatason kontekstia vähentääkseen käännösvirheitä ja epäjohdonmukaisuuksia lausetason järjestelmiin verrattuna, samalla kun kriittisiä virheitä yhä pääsee läpi. Juuri tuo viimeinen lause on koko peruste ihmiselle silmukassa. Malli antaa sinulle johdonmukaisen luonnoksen. Se ei anna sinulle allekirjoitettua.


Mukana on myös valvontaulottuvuus. Hallittu LLM-työnkulku voidaan rajata hyväksyttyyn terminologiaasi ja ajaa infrastruktuurilla, jonka voit osoittaa, eikä julkisella päätepisteellä, joka lokittaa kehotteesi.


Kielitieteilijä tarkastaa sääntelyasiakirjojen käännöksiä

Standardi ei kadonnut: ISO 18587


ISO 18587 asettaa vaatimukset konekäännöstuotoksen täydelliselle inhimilliselle jälkieditoinnille ja nimeää pätevyydet, jotka jälkieditoijalla on oltava. Se pätee riippumatta siitä, tuliko raakatuotos vanhasta moottorista vai LLM:stä. Lokakuulle 2026 odotettu revisio tekee sen selväksi, vetää selkeämmän rajan konekäännöksen, tekoälyn tuottaman tuotoksen ja jälkieditointitehtävän välille ja lähentää ISO 17100:aa inhimillisen käännöksen osalta.



Tekoälyasetus (asetus (EU) 2024/1689) lisää läpinäkyvyyskerroksen: 2. elokuuta 2026 alkaen 50 artikla edellyttää, että tekoälyn tuottama sisältö merkitään sellaiseksi. Säännellyssä käännöksessä se tarkoittaa, että työnkulkusi tekoälyvaihe on dokumentoitava, ei piilotettava.


Näin teemme sen AD VERBUMilla


Me AD VERBUMilla aloitamme käännösmuististasi ja termikannastasi, emme tyhjästä moottorista. LangOps System -järjestelmämme tuottaa tuotoksen asiakaskohtaisesti viritetyillä open-weight-malleilla tuohon terminologiaan rajattuna, sertifioidut asiantuntijakielenkääntäjämme jälkieditoivat ISO 18587:n mukaan, ja koko putki toimii ISO 27001- ja ISO 42001-sertifioidulla, EU:ssa isännöidyllä infrastruktuurilla ilman julkisen pilven kauttakulkua. Se on ero nopean luonnoksen ja puolustettavissa olevan asiakirjan välillä.


Konekäännös- ja LLM-käännöspalvelumme


Säänneltyjen alojen käännöspalvelumme toimivat ISO 27001- ja ISO 42001-sertifioidulla, EU:ssa isännöidyllä infrastruktuurilla, ilman julkisen pilven työkaluja ydinkäsittelyssä. Jokainen projekti kulkee AI+HUMAN-hybridityönkulkumme läpi: otamme ensin sisään asiakkaan käännösmuistit ja termikannat, oma LLM-pohjainen LangOps System -järjestelmämme tuottaa tuotoksen asiakasterminologiaan rajattuna asiakaskohtaisesti viritetyillä open-weight-malleilla, ja sertifioidut asiantuntijamme tarkistavat teknisen tarkkuuden ja sääntelyvaatimusten mukaisuuden. QA:mme on linjattu ISO 17100:aan ja ISO 18587:ään, ISO 18587 -jälkieditointikurilla ja ISO 42001 -tekoälynhallinnalla tarpeen mukaan. Palvelemme Life Sciences-, oikeus-, rahoitus-, puolustus- ja valmistusalan asiakkaita yli 150 kielellä yli 3 500 asiantuntijakielenkääntäjän voimin. Auditointiherkkää sisältöä hallitseville tiimeille: ota meihin yhteyttä keskustellaksesi turvallisuus- ja vaatimustenmukaisuustarpeistasi suoraan.


FAQ


Onko segmenttitason konekäännös koskaan hyväksyttävää säännellyille asiakirjoille?


Se voi tuottaa karkean ensiluonnoksen, mutta yksinään se ei ole hyväksyttävä toimitus. ISO 18587 vaatii täyden inhimillisen jälkieditoinnin pätevältä kielenkääntäjältä, joka ottaa vastuun lopullisesta tekstistä, ja MDR:n 10 artiklan 11 kohta vaatii, että julkaistu kieliversio on oikein. Raaka segmenttitason tuotos ei täytä kumpaakaan.


Mikä on NMT:n ja LLM-käännöksen ero?


Neuroverkkokonekäännös toimii segmentti segmentiltä ilman muistia laajemmasta asiakirjasta. Suuri kielimalli kääntää koko asiakirja kontekstissa, mikä pitää terminologian ja viittaukset johdonmukaisina. LLM-tuotos tarvitsee silti jälkieditoinnin ISO 18587:n mukaan ennen kuin sitä käytetään säännellyssä tiedostossa.


Sovelletaanko tekoälyasetusta konekäännökseen?


Kyllä, sen läpinäkyvyyssääntöjen kautta. Asetuksen (EU) 2024/1689 50 artiklan mukaan, jota sovelletaan 2. elokuuta 2026 alkaen, tekoälyn tuottama tai tekoälyavusteinen sisältö on merkittävä sellaiseksi. Säännellyn käännöstyönkulun, joka käyttää LLM:ää, on dokumentoitava tuo vaihe.


Mikä asetus määrää lääkinnällisen laitteen käyttöohjeen kielen?


MDR:n 10 artiklan 11 kohta luettuna liitteen I kohdan 23.1(d) kanssa edellyttää käyttöohjeita ja merkintöjä jokaisen sen jäsenvaltion virallisella kielellä tai kielillä, jossa laite asetetaan saataville. IVDR asettaa vastaavan velvoitteen in vitro -diagnostiikalle. Valmistajan laatujärjestelmän on pidettävä nämä versiot oikeina.


Voinko käyttää julkista konekäännöstyökalua puolustushankinnan tarjouksessa?


Ei kannata. Direktiivin 2009/81/EY mukaista tarjousta arvioidaan tarkkuuden perusteella, ja valvottujen teknisten tietojen lataaminen julkiseen moottoriin voi rikkoa asetuksen (EU) 2021/821 2 artiklaa, joka käsittelee valvotun teknologian sähköistä siirtoa luvanvaraisena siirtona. Käytä sen sijaan taustatarkistettuja kielenkääntäjiä valvotulla infrastruktuurilla.


Kuka on vastuussa konekäännetyn tekstin virheistä?


ISO 18587:n mukaan pätevä inhimillinen jälkieditoija ottaa vastuun lopullisesta käännöksestä, ei moottori. Juuri tuo nimetty vastuu on syy siihen, miksi säännellyt ostajat vaativat sertifioidun jälkieditointiprosessin raa'an konetuotoksen sijaan.


Suositukset



 
 
bottom of page