CodeKitHub
Tekstværktøjer

Konverter forenklet ⇄ traditionel kinesisk

Senest opdateret:

Konverter mellem forenklet og traditionel kinesisk med den regionale standard, der rent faktisk betyder noget — Taiwan, Hongkong eller generel traditionel. Mange simple konvertere laver en en-til-en tegnudskiftning og overser ordforrådsforskellene mellem regioner (fastlandets "软件" over for Taiwans "軟體" for "software"). Kører helt i din browser.

Hvad er dette værktøj?

Forenklet og traditionel kinesisk er ikke bare "flere eller færre streger." Traditionel kinesisk deler sig selv op i regionale standarder — Taiwan og Hongkong bruger forskellige tegn og forskelligt hverdagsordforråd for det samme begreb. En converter, der kun udskifter tegn ét til ét, overser disse forskelle på ordniveau og producerer tekst, som en læser fra Taiwan eller Hongkong straks genkender som maskinelt konverteret.

Dette værktøj bruger open source-motoren OpenCC — samme konverteringsteknologi, som store kinesisksprogede sider som Wikipedia bruger — med valgbare regionale standarder, der udfører reel sproglig konvertering frem for ren tegn-mapping.

Hvorfor bruge det?

  • Standarder for Taiwan, Hongkong og generel traditionel — ikke bare et vagt "konverter til traditionel".
  • Bruger en moden open source-motor, der håndterer regionale forskelle på ordniveau, ikke kun tegnudskiftning.
  • Tovejs: forenklet → traditionel og traditionel → forenklet.
  • Gratis, ingen tegnbegrænsning, ingen upload — konverteringen kører lokalt i din browser.
  • Håndterer hele tekstafsnit i ét hug — ingen grund til at konvertere sætning for sætning.

Sådan bruger du det

  1. Indsæt kinesisk tekst i inputfeltet.
  2. Vælg den ønskede traditionelle standard (Taiwan/Hongkong/generel) — bruges også som kildestandard ved konvertering til forenklet.
  3. Klik på "Forenklet → Traditionel" eller "Traditionel → Forenklet".
  4. Klik på Kopiér for at bruge resultatet.

Eksempel

Input

这台电脑的软件需要更新

Output

Taiwan-standard: 這台電腦的軟體需要更新

Bemærk at "软件" korrekt konverteres til Taiwan-standardens "軟體", ikke en bogstavelig tegn-for-tegn "軟件".

Samme betydning, forskellige hverdagsord

Dette er hovedgrunden til, at rene tegn-mapping-konvertere fejler: de tre regioner skriver ikke bare det samme ord med forskellige tegnformer — de bruger ofte reelt forskellige ord for det samme hverdagsbegreb, den slags forskel ingen simpel substitutionstabel kan opfange.

BegrebFastlandet (forenklet)TaiwanHongkong
Software软件軟體軟件
Taxi出租车計程車的士
Internet网络網路網絡
Video视频影片影片/視頻
Print (udsagnsord)打印列印打印

Almindelige anvendelser

  • Lokalisering af app- eller webstedstekst til markederne Taiwan eller Hongkong, hvor brug af fastlandsordforråd i traditionelle tegn tydeligt fremstår forkert for lokale brugere.
  • Forberedelse af undertekster eller marketingtekst, der skal skifte mellem forenklet (fastlandspublikum) og en bestemt traditionel standard.
  • Konvertering af historiske eller udenlandske kinesisksprogede dokumenter (som ofte er i traditionel skrift) til forenklet for fastlandslæsere.
  • At tjekke om eksisterende traditionelt indhold allerede matcher en målregions konventioner, ved at konvertere og sammenligne.

Hvorfor OpenCC håndterer dette bedre end en opslagstabel

OpenCC (Open Chinese Convert) arbejder ud fra kuraterede konverteringsordbøger, der specifikt er bygget til at fange forskelle på ord- og frase-niveau, ikke kun tegnformer — den genkender, at 软件 som helt ord skal blive til 軟體 i Taiwan-standard output, i stedet for mekanisk at udskifte hvert tegns traditionelle form (hvilket forkert ville give 軟件, en form Hongkong faktisk bruger, men Taiwan ikke gør). Denne ordbevidste tilgang er også grunden til, at det samme projekt bruges af store referencesider: kinesisk Wikipedia bruger OpenCC-baseret konvertering, så læsere kan se enhver artikel i deres foretrukne regionale variant, hvilket kræver præcis denne slags nøjagtighed i stor skala på tværs af millioner af artikler.

Ulempen er, at intet ordbogsbaseret system, uanset hvor stort, dækker ethvert muligt udtryk — helt ny slang, meget teknisk fagsprog eller navne, der endnu ikke er kommet i almindelig brug, kan falde tilbage til en mere bogstavelig tegn-for-tegn-konvertering. Det er usædvanligt for almindelig hverdagstekst, men værd at stikprøvekontrollere for specialiseret eller banebrydende ordforråd.

Ofte stillede spørgsmål

Er traditionel-til-forenklet bare det omvendte af forenklet-til-traditionel?

Ikke helt. Forenklet-til-traditionel skal løse tilfælde, hvor ét forenklet tegn afbildes til flere traditionelle tegn afhængigt af konteksten (f.eks. forenklet 发 → 發 eller 髮). Traditionel-til-forenklet er sammenlignelsevis mere direkte. Dette værktøjs motor håndterer de almindelige tvetydige tilfælde, selvom sjældne eller stærkt kontekstafhængige termer stadig er værd at tjekke manuelt.

Hvad er forskellen på Taiwan- og Hongkong-standarderne?

Tegnsættene er stort set ens, men hverdagsordforråd og nogle tegnformer adskiller sig (f.eks. taxi: 計程車 i Taiwan mod 的士 i Hongkong). De tre valgbare standarder findes, så output matcher, hvordan dine målgruppelæsere rent faktisk taler.

Hvorfor føles output fra simple konvertere nogle gange forkert?

Det er som regel en naiv tegn-mapping-implementering, der udskifter tegnformer uden at håndtere ordforrådsforskelle, hvilket giver traditionel tekst med de forkerte regionale ordvalg — noget en indfødt læser straks genkender som en bogstavelig maskinkonvertering.

Hvor meget tekst kan den håndtere?

Ingen fast tegngrænse — konverteringen kører helt i din browser, så hele artikler eller dokumenter konverteres i ét hug.

Bliver min tekst uploadet til en server?

Nej. Når konverteringsmotoren er indlæst, kører den helt i din browser — tekstindholdet sendes aldrig nogen steder hen.

Relaterede værktøjer