Computervertaling

Computervertaling (in het Engels: machine translation of MT) is een deelgebied van de computationele taalkunde waar het gebruik van software wordt onderzocht om tekst of spraak van de ene taal naar de andere te vertalen.

Op het basisniveau vervangt een computervertaler woorden in de ene taal letterlijk door woorden in een andere taal, maar dat alleen levert zelden een goede vertaling op omdat er herkenning nodig is van hele zinnen en hun dichtstbijzijnde tegenhangers in de doeltaal. Niet alle woorden in de ene taal hebben vergelijkbare woorden in een andere taal, en veel woorden hebben meer dan één betekenis. Deze problematiek wordt soms aangeduid met de kreet The vodka is good but the meat is rotten.

Het oplossen van dit probleem met corpusstatistische en neurale technieken is een snel groeiend gebied dat leidt tot betere vertalingen, het omgaan met verschillen in taalkundige typologie, het vertalen van idiomen en het isoleren van anomalieën.

Huidige automatische vertaalsoftware kan vaak worden aangepast per domein of beroep (zoals weerberichten), waardoor de uitvoer wordt verbeterd door het aantal toegestane substituties te beperken. Deze techniek is vooral effectief in domeinen waar formele of formulaire taal wordt gebruikt. Hieruit volgt dat machinevertalingen van overheids- en juridische documenten gemakkelijker bruikbare uitvoer opleveren dan machinevertalingen van conversaties of minder gestandaardiseerde tekst.

Verbeterde uitvoerkwaliteit kan ook worden bereikt door menselijke tussenkomst: sommige systemen kunnen bijvoorbeeld nauwkeuriger vertalen als de gebruiker ondubbelzinnig heeft vastgesteld welke woorden in de tekst eigennamen zijn. Met behulp van deze technieken is computervertaling nuttig gebleken als hulpmiddel voor menselijke vertalers, en kan het in een zeer beperkt aantal gevallen zelfs uitvoer produceren die als zodanig kan worden gebruikt.

Over de vooruitgang en het potentieel van machinevertaling is in de loop van de geschiedenis veel gediscussieerd. Sinds de jaren 1950 hebben een aantal geleerden vraagtekens gezet bij de mogelijkheid om volautomatische machinevertalingen van hoge kwaliteit te maken.

Voorbeelden van computervertalingspakketten zijn Apertium, BabelFish, Bing Translator, DeepL Translator en Google Translate.

Content Disclaimer

Informasi ini disarikan dari Wikipedia dan disajikan kembali untuk tujuan edukasi. Konten tersedia di bawah lisensi CC BY-SA 3.0. Kami tidak bertanggung jawab atas ketidakakuratan data yang bersumber dari kontribusi publik tersebut.

  1. The information displayed on this website is sourced in part or in whole from Wikipedia and has been adapted for the purpose of restating it. We strive to provide accurate and relevant information, however:
  2. There is no guarantee of absolute accuracy. Wikipedia is an open, collaborative project that can be edited by anyone, so information is subject to change.
  3. It is not intended to constitute professional advice. The content displayed is for informational and educational purposes only. For important decisions (e.g., medical, legal, or financial), please consult a professional.
  4. Content copyright. Wikipedia is licensed under the Creative Commons Attribution-ShareAlike License (CC BY-SA). This means that content may be reused with appropriate attribution and shared under a similar license.
  5. Responsible use. Any risk arising from the use of information from this website is entirely the responsibility of the user.