Kategorier
Kultur Språk

Svenskan i kontinuerligt och naturligt förfall

En och var håller förmodligen med DN-tidningens Sachar när denne i en litania beklagar sig över förfallet av ärans och hjältarnas språk i opåkallade anglicismer, som att uttrycka «gå för det!» (go for it!) eller att en händelse har «tagit plats» (taken place).

Det rör sig då om omedelbar ersättning av begrepp för vilka vi redan har adekvata konstruktioner, och således inte om lånord, av vilka det förstås kryllar i språket. Det är ändå en naturlig funktion av att det svenska folk är statt i kulturell underkastelse och därmed för jämnan knarkar amerikanska teveserier.

Även jag konsumerar visserligen mycket engländskt, men balanserar dock med romanskt, annat germanskt samt inte minst japanskt och kinesiskt. Det ger balans och en bättre förståelse för både det egna tungomålet och andras.

Troligen är det också en generationsfråga, då jag i unga år var lika frälst i det amerikanska som många är nu. Man blir mer konservativ med åldern, som Sachar, och retar sig därför gärna på begrepp som «sale», det som ju förr hette «rea» på franskt manér (réalisation), och uschliga importer som «black friday».

Men så där har vi alltid hållit på, eftersom vi är ett pyttelitet folk med ett udda germanskt språk utan större betydelse. Vi är av nöden anpassningsbara och benägna att underkasta oss de större kulturerna, tidigare plattyskan, senare franskan och nu engelskan.

Svenskan är ju inget annat än plattyska i tolv dialekter, som Strindberg uttryckte saken, och lån från lågländerna under hanseatisk tid år således av betydligt mer voluminös art än nutidens vimsiga anglicismer. Det mesta är ändå modeuttryck som aldrig blir bestående, slang som är övergående – «gå för det!» försvinner, medan «det är upp till dig» redan är etablerat, eftersom det passar in i språkdräkten.

Sachar är dock konservativ i överdrift när han hävdar att man inte kan «spendera en vecka på Mallorca», eftersom den formen är belagd sedan åtminstone 1700-tal (Som iag kommer så sent fram, så har iag ei mycken tid, at spendera på brefs skrifvande).

Han har dessutom helt fel när han påstår att «kalamitet» på svenska betyder «bagatell» snarare än en «katastrof». Ordet betyder just «missöde, olycka» och har överhuvudtaget ingen vedertagen betydelse i den riktning Sachar hävdar.

Han bevisar därmed själv hur språk förändras genom okunskap och osäkerhet om ords egentliga betydelse och användningsområden, ett fenomen man kan notera närmast dagligen, även i den professionella kår som har att handha språket, exempelvis i medier – här har jag särskilt med statstelevisionen en oplockad gås.

Sachar noterar att spanjorer utan problem kan läsa medeltida dokument, och att spanskan därmed är mer stabil än svenskan. Det beror på att spanskan är vulgärlatinets arvtagare och en stagdad kultur utan större friktioner med andra kulturområden, medan svenskan har varit stadd i kontinuerlig förändring under hela sin existens, för övrigt på samma sätt som engelskan.

Svenskan är dock relativt stabil sedan yngre nysvensk tid under 1700-talet, och man behöver inte alls vara «expert» för att förstå äldre nysvenska (1500-tal). Fornsvenskan bereder mer problem, eftersom man där stöter på en helt annan prosodi, andra vokalljud och en komplex grammatisk morfologi. På motsvarande vis förstår spanjorer i allmänhet inte latin på vare sig klassisk eller vulgär form.

Språk förändras även utan sådan kulturell friktion, exempelvis kinesiskan, som ursprungligen inte var ett tonspråk men numera är det. Det går bra att läsa Konfucius i originalskrift, eftersom tecknen inte representerar ljud, men ingen skulle kunna förstå den gamle filosofens talade kinesiska.

Det är fråga om naturligt «förfall», en ständig förändring av språk medelst friktion och interna processer, inte minst förändringar över generationer då en ny kull alltid bidrar med smärre modifikationer av den förhandenvarande kulturen, även i fråga om ljud och uttal – numera uttalar många «läkare» och «lärare» med samma slags «ä».

Åt detta kan man faktiskt inte göra så mycket, annat än att medvetet verka för att bevara språket, som spanjorerna eller för den delen islänningarna, som ju i princip talar vårt forna mål från vikingatiden. Den svenska modellen tycks dock vara mer laissez-faire, att låta utvecklingen ha sin gång och att bara nedteckna förändringar snarare än att motverka dem.

Eller för att uttrycka det annorlunda: till vilken punkt i tiden skulle herr Sachar vilja förlägga den rena och oföränderliga svenskan? Oavsett vilken man väljer kvarstår faktum att svenskan befinner sig i kontinuerligt och naturligt «förfall», som en rasande och aldrig vilande utveckling från den tidigaste urgermanskan för 3000 år sedan (även det en godtycklig punkt i tiden).

Varför kan vi inte alla helt enkelt prata urindoeuropeiska, om vi nu ska dra saken till sin spets? Givet att det är upphovet till inte bara vår sena germanska dräkt utan framförallt till de klassiska språken latin, grekiska och sanskrit, måste det ha varit det renaste och mest obesudlade idiom som någonsin har existerat?

Eller så var det bara ett språk i mängden, med dess egenheter och särdrag, och som har utvecklats på samma sätt som andra språk, i en aldrig avstannande process, i ett evigt skiftande kvitter av föränderliga ljud och ord.

Exempel på hur engelskan har förändrats under 700 år, och varför amerikansk engelska låter som 1700-talets brittiska engelska. Samma processer har kännetecknat svenska och andra språk, och är helt naturliga.
Kategorier
Asien Hongkong Kina Kultur Politik Språk

Fukhing gin

Lillbritannien har visserligen inget systembolag eller annat alkohol­mono­pol, men man har åtminstone en branschorganisation som har samma funktion som i för­myndar­staten, det vill säga att förorda «ansvarsfullt» drickande, motverka supande med mera.

Man har vidare till uppgift att självreglera marknaden med avseende på namn, etikettering och så vidare, på samma sätt som det statliga monopolet i Sverige emellanåt får för sig att porta vissa alkoholhaltiga drycker, exempelvis midsommarölet Ängöl med en etikett av högst oskyldigt midsommarfirande.

Den brittiska gruppen har på senare tid blivit uppmärksammad för att man har tagit strid mot Fok Hing Gin, en ginsort med ursprung i Hongkong. Anmälaren menar att namnet är avsett att chockera, och att namnet leder tankarna till en viss engelsk svordom.

Den misstanken kunde ju ha fog för sig, då bolaget i fråga hade en annons med texten FOK THE HATERS. More than just a funny name, we actually taste FOK HING good samt snutten More than just a FOK HING name.

Icke desto mindre är namnet inte påhittat, utan en referens till Fuk Hing Lane (福興里), en gata i Tongluowan (铜锣湾) i Hongkong. Därstädes pratar man kantonesiska, och fuk (福, lycka) hörs i var och varannan mening. Det är ändå en tidigare brittisk kronkoloni, så den eventuella problematiken kring detta torde inte vara ny.

福興氈 (Fūkhīng zīn) på kantonesiska.

Det egentliga namnet 福興氈 (Fūkhīng zīn) består av komponenterna 福 (fū, lycka), 興 (hīng, blomstra, vara populär) samt 氈 (zīn, filt, matta) som här har en ljudhärmande funktion för gin. På förenklad form och mandarin är motsvarande namn 福兴毡 (Fúxīng zhān).

Bolaget bakom spriten hade ändå bemödat sig om att ändra fuk till fok för att mildra ordets karaktär, utan att det hjälpte. Branschgruppen valde således att fälla, med motivering att varumärket kan vara förargelseväckande för vissa grupper. För oss andra är det förstås stor humor, och för bolaget ger det fantastisk reklam.

In conclusion, the Panel noted that the strength of the profanity, in combination with the company’s accompanying marketing materials, where the name was used in such a way that was clearly alluding to profanity, meant that the packaging was likely to cause serious and widespread offence. Accordingly, the Panel concluded that the packaging was in breach of Code rule 3.3.

Det här är dock inget problem i Sverige, eftersom det statliga monopolet med sitt «fantastiska» utbud inte saluför ett endaste varumärke från Hongkong, och i övrigt bara har ett fåtal produkter från Kina, mestadels som beställningsvara.

Fuk Hing Lane (福興里), Hongkong. Bild: Lok shesa, CC SA 4.0.
Kategorier
Asien Kina Kultur Språk Vetenskap

Transeurasiska språk

Ordet kommun är inlånat från franskans commune, som i sin tur stammar från latinets commūnis. Vidare bakåt finner man commoinis i äldre latin, *kommoinis i uritaliskan och slutligen *ḱom-moy-ni-s i urindoeuropeiskan. Asterisken betyder att det är rekonstruerade former.

Men från *ḱom-moy-ni-s kan man gå i andra riktningen, varvid man finner urgermanskans *gamainiz, urvästgermanskans *gamainī, fornsaxiskans gimeni, medellågtyskans gemēn, som slutligen blir ordet gemen i svenskan.

Två låneord, kommun och gemen, har alltså samma ursprung (och betydelse), men har funnit sin väg till svenskan på olika sätt. Så där kan man hålla på med tusentals ord, och därmed demonstrera att germanska, romanska, keltiska, hellenska, armeniska, albanska, indoiranska och en del andra språk har samma ursprung i ett urindoeuropeiskt generatorspråk som talades i trakterna kring dagens Ukraïna för runt fem tusen år sedan.

Den utvecklingen har inte varit linjär, utan har präglats av förgreningar och cirkulära lån av det slag som visades ovan. Indoeuropéerna erövrade Europa i omgångar under lång tid, med ett språk i ständig förändring. Samma process som har gett spanska, italienska och franska från latin har präglat samtliga indoeuropeiska språk, och det är således materia i ständig rörelse och växelverkan.

Teorin om den indoeuropeiska språkfamiljen är numera ett par hundra år gammal, och har sina rötter i 1500-talets upptäcktstid. De europeiska språkens släktskap har man förstås känt till i princip längre än så, men senare har man även fogat sanskrit till samma gren som latin och grekiska, och på den vägen slagit fast ett betydligt bredare släktskap, omfattande iranska och indiska språk.

Till yttermera visso finns ett genetiskt släktskap som med hög precision korrelerar med det språkliga. Svenskar är närmare släkt med tyskar (fixeringsindex eller Fst ≈ 0.001) än med fransoser (Fst ≈ 0.002), ryssar (Fst ≈ 0.003) eller italienare och greker (Fst ≈ 0.007). Släktskapet med indiska och iranska indoeuropéer är mer avlägset, med Fst ≈ 0.04, och det gäller även distansen i språkligt släktskap.

För att sätta detta tal i perspektiv skiljer vi oss från östasiater med Fst ≈ 0.110 och från subsahariska folk med Fst ≈ 0.153. Vi är alltså synnerligen nära släkt i Europa, även om vi ändå har märkbara morfologiska skillnader. Exempelvis italienare och greker har ett större arv från Anatolien än svenska germaner, vilket ger dem ett särpräglat utseende.

Germanska langobarder erövrade ju Rom, varför man förvisso finner en hel del blondiner i Italien, och än mer så i det av germanska franker erövrade Gallien, eller Frankrike som vi säger numera. Men en «äkta» italienare, eller en grek, skiljer man lätt från en svensk, tysk eller annan german.

På samma sätt kan man diskriminera mellan kineser, koreaner och japaner, även om det är svårare på grund av en monoton pigmentering. Européer förmår i regel inte se skillnad på grund av ovana, men jag kan personligen med ganska hög träffsäkerhet avgöra huruvida en östasiatisk kvinna är kines, japansk, koreansk eller för den delen sibirisk.

Ändå är östasiater mer genetiskt närstående på gruppnivå än européer, med Fst ≈ 0.003 mellan kineser och koreaner respektive koreaner och japaner. Kineser kan i sin tur indelas i en nordlig respektive sydlig komponent, varvid sydkineser skiljer sig marginellt från vietnameser, Fst ≈ 0.0024. Nord- och sydkineser skiljer sig inbördes med Fst ≈ 0.0014, men går ändå ganska lätt att skilja åt – sydkineser har exempelvis oftare rundare ögon.

Nå, frågan är då huruvida detta nära genetiska släktskap korrelerar med ett språkligt, på samma sätt som i Europa, Persien och Indien? Svaret är nej, och man räknar av hävd koreanska respektive japanska som språkliga isolat, medan mandarin och andra kinesiska språk hör till den sinotibetanska familjen.

Både japanska och koreanska har visserligen en mycket hög andel kinesiska lånord, givet att kinesiska är Östasiens motsvarighet till latin, men de mest grundläggande av ord har inget som helst släktskap med kinesiskan. På samma sätt finner man inget inbördes släktskap mellan japanska och koreanska med avseende på sådan grundvokabulär, samtidigt som man har klart olika fonetik i samtliga språk.

Exempelvis räkneorden 1, 2, 3, 4 är i koreanskan hana, tul, set, net och i japanskan ichi, ni, san, yon, alternativt hito, futa, mi, yon. Motsvarande för mandarin är yi, er, san, si. Både japanskan och koreanskan har inlånade kinesiska termer även för räkneord, men de infödda varianterna är helt enkelt väsensskilda, oavsett hur långt tillbaka man går.

Den indoeuropeiska situationen är här att räkneorden mestadels har samma ursprung i alla språk, exempelvis urindoeuropeiskans *dwóh₁ → duo, due, two, två och så vidare. Fyra kanske inte låter som quattro, men har ändå samma ursprung i *kʷetwóres → urgermanska *fedwōr. Om vi räknar på urindoeuropeiska känner vi oss ganska hemmastadda: *óynos, *dwóh₁, *tréyes, *kʷetwóres, *pénkʷe, *swéḱs, *septḿ̥, *oḱtṓw, *h₁néwn̥, *déḱm̥.

Den östasiatiska motsvarigheten är alltså sådan att man inte finner släktskap av det slaget för annat än ett fåtal ord, som skulle kunna vara tillfälligheter eller lån. Ändå är den grammatiska strukturen mellan japanska och koreanska slående lik, med SOV-ordning, agglutination, bruk av partiklar och så vidare. Grammatiska egenskaper inlånas inte i lika hög utsträckning som ord, och om det funnes inslag av sådan konvergens vore det rimligare att kinesiskan hade utövat ett sådant inflytande.

För personer som känner och studerar dessa språk finns därför ändå en gnagande misstanke om avlägset släktskap, även om det mer är en diffus känsla än något man enkelt kan leda i bevis. Skolor finns förvisso, särskilt den som förfäktar hypotesen om transeurasiska eller altaiska språk, som omfattar mongoliska, türkiska och tungusiska språk samt även de japoniska och koreanska språken i utvidgad mening. Exempelvis koreansk fonetik har slående likheter med türkisk.

De flesta lingvister avfärdar numera hypotesen, nämligen på grund av bristen på kognat och en del andra omständigheter, men det finns ändå en klick som idogt förespråkar den altaiska modellen. Man menar att släktskapet ligger djupare förborgat i historien än i det indoeuropeiska fallet, och att det därför är svårare att avtäcka.

Transeurasiska språk i dag samt förmodat urhem. (Robbeets, M., Bouckaert, R., Conte, M. et al. Triangulation supports agricultural spread of the Transeurasian languages. Nature (2021). https://doi.org/10.1038/s41586-021-04108-8, CC-BY 4.0)

En ny studie i Nature förnyar ambitionen genom att kombinera lingvistik med arkeologi och genetik för att söka leda i bevis släktskapet. Man förlägger därvid ett urtranseurasiskt språk till -9000 eller runt år sju tusen före vår tid, vilket är nära nog dubbelt så gammalt som urindoeuropeiskan.

Man följer hirsets väg i regionen genom arkeologiska studier, vilket ger tiden -7000 för uppkomsten av en urjaponisk-urkoreansk familj. Genetiska studier ger att Koreahalvön befolkades av jōmon vid -4000, det vill säga samma folkslag som fanns på Japan vid tiden. Omvänt migrerade folkslaget yayoi från Korea till Japan från -1000, vilket gav upphov till en ny slags kultur, samtidigt som jōmon försvann från Korea.

Ett urtranseurasiskt språk förläggs geografiskt till trakterna av Mongoliet och Manchuriet, varvid förfäder till koreaner ska ha lagt under sig halvön norrifrån, och därvid vidare ha intagit de japanska öarna. De japoniska språken ska således ha existerat på fastlandet innan de migrerade till Japan, vilket är ungefär samma sak som att de keltiska språken numera inte finns på det europeiska fastlandet utan på de brittiska öarna.

Här kan man föreställa sig att blandning sker med lokala språk, vilket då tar språket i en ny riktning och avlägsnar det mer från sitt tidiga arv. Man kan på samma sätt förstå att kinesiskan, eller dess rötter, inte hade inflytande på annat sätt än genom lånord på grund av väsensskild grammatik och annan struktur.

Kinas tidiga kulturer (särskilt Yangshao) har således bidragit med gener, teknik, kultur, odling och lånord, men har inte påverkat grunden i de japoniska och koreanska språken. Det innebär också att folkslag inte har kuvats till underkastelse, utan har kunnat behålla sin särprägel, till skillnad från i Europa, där indoeuropéerna gjorde rent hus.

Däremot har det uppenbarligen skett massiva folkvandringar, varvid förfäder till dagens koreaner och japaner har drivits från Manchuriet ned mot Koreahalvön och vidare mot Japan. Türkarna har rört sig i den andra riktningen, åt norr och väster, och har en betydligt mer nomadisk komponent än de jordbrukande urjapanerna och urkoreanerna.

Expansion av koreanska och japanska från ett altaiskt urhem i Manchuriet. (Robbeets, M., Bouckaert, R., Conte, M. et al. Triangulation supports agricultural spread of the Transeurasian languages. Nature (2021). https://doi.org/10.1038/s41586-021-04108-8, CC-BY 4.0)

Den lingvistiska delen av analysen söker sammanställa en swadeshlista för ett stort antal altaiska språk genom tiderna, det vill säga grundläggande basord som antas vara svårare att påverka genom inlån och kulturell påverkan, här för termer relaterade till jordbruk, tamdjur med mera, det vill säga centrala begrepp för dessa tidiga kulturer.

Ett exempel är ordet för (jordbruks)fält, vilket man ger en urtranseurasisk (UTE) rot *pata. Motsvarande etymologiska härledning är då för urjapanska *pata → hata + *ka (plats) → hatake (はたけ, 畑), som är det moderna japanska ordet för fält.

För koreanska har vi på samma sätt urkoreanska *patʌ → MK pàth → K bat (밭). För türkiska anger man *(p)ata med bortfall av p → ata med flera termer, som dock har skiftat betydelse till ö i de flesta språk.

Ett annat exempel rör alkohol, det vill säga att fermentera, blomma med mera, vilket man ger en rot *saga-. För urjapanska har man då *saka-, vilket småningom leder till japanskans sake (さけ, 酒). Urkoreanskan anges ha *sak-, vilket leder till koreanskans sseokda (썩다), det vill säga att ruttna.

För koreanskan anger man alternativet *su(k)u-, med vidare härledning till sul (술), som betyder just alkohol. Liknande härledningar har man för turkiska, mongoliska med flera familjer.

Ordet för en vävd slags stråmatta betecknar man *mosi på UTE, med härledning *mosi → mushiro (むしろ, 蓆) på japanska. Motsvarande för koreanska är *mosi → mosi (모시). Samtidigt är en enklare japansk härledning mushi (むし, 苧) för själva växten som nyttjas, ett ord som av vissa anses vara ett koreanskt lån.

Studien har ett omfattande material för den som vill fördjupa sig i sådan spännande etymologi, men det är alltjämt småpotatis i jämförelse med det rika materialet för indoeuropeiska språk. Samtidigt kommer man nog inte så mycket längre med enbart lingvistiska metoder, varför de arkeologiska och genetiska får allt mer betydelse för att indirekt bevisa eller förkasta saken. Hypotesen har nog dock stärkts en gnutta, tror jag.

Kategorier
Kultur Språk

Svår bok

Diskussionen är väl inte ny, utan återkommer med intermittenta mellanrum, nämligen huruvida barn bara bör läsa barn- och ungdomsböcker eller emellanåt mer utmanande stoff. Konsensus brukar mynna ut i att det egentligen inte spelar någon roll vad man läser, utan att man insuper någon form av längre sammanhängande text.

En nyans på temat, åtminstone i denna vända, är att man inte bör avstå från att förse sina telningar med «svåra böcker», för att själva utmaningen är utvecklande, till skillnad från mer lättläst text, som väl är att anse som ren underhållning. Exempel som framförs är Steinbeck och Molière, som ändå får räknas som svårsmält materia för tioåringar.

Inte så att all vuxenlitteratur är svårtillgänglig för barn, men mycket av det stoff som avhandlas är av sådan art som barn ännu inte har någon erfarenhet av och därför upplever som tråkigt. Om man kan relatera till handlingen, som exempelvis i William Goldings Flugornas herre, suger man lättare åt sig innehållet.

Med «svår» kan förstås dels stoffet och dess abstraktion, men även språket som sådant. Det senare är ett övergående fenomen, men barn har ändå ett mindre ordförråd. För den senare åkomman hjälper det förstås att tynga ned barnen med svårare texter, för att det är en läroprocess som utökar såväl vokabulär och grammatik som förmåga att tillgodogöra sig mer raffinerade historier.

Tyvärr fanns ingen i min omgivning som förstod detta, utan jag fick utmana mig själv i tidiga år, faktiskt främst med fackböcker om rymd och vetenskap. Det skönlitterära intresset vaknade på allvar först i gymnasiet, och resulterade i några år av rena dammsugarfasonerna – jag tog mig för att sträckläsa samlingar av Strindberg och Lagerlöf på någon vecka, ett tempo som numera inte medges.

Redan då divergerade jag mot läsning på andra språk, främst engelska och tyska, ett intresse som därefter har fortsatt i perioder. Dels för att språk i sig intresserar mig, men även för att det ger nya utmaningar när gamla har upphört. Att läsa på andra tungomål ger ett mervärde, samtidigt som det vidgar förståelsen att läsa verk i original.

Samtidigt gäller samma förutsättningar som när man först introduceras i litteraturen som barn, nämligen att man har handikapp av ett fattigare ordförråd och att det därför, åtminstone i förstone, är viktigare att man läser än vad. Pippi Långstrump läste jag inte som barn, men väl som vuxen när jag vill befästa och utveckla grundläggande kunskaper i främmande språk.

Det visar sig vara en utmärkt idé i allmänhet att läsa samma verk parallellt på ett flertal språk, för att det ger en gemensam ram som underlättar inlärning, men också för att det ger en djupare förståelse för själva stoffet när det uttrycks på vitt skilda sätt.

Tillfredsställelsen när man småningom ganska ledigt kan plocka en roman på ett främmande språk är djup, och på samma sätt förhåller det sig således med barn som tar sig igenom en «svår bok», det vill säga Cervantes snarare än Rowlings. Härvidlag är Don Quijote de la Mancha på spanska faktiskt en riktigt «svår bok».

Den skara som förfäktar att man måste utmana har således rätt, för det duger inte att hålla sig i en komfortzon med Harry Potter, eller för den delen «deckare» för vuxna. Det är lika intellektuellt fattigt som att fastna i missbruk av teveserier, fördummande underhållning som inte ger några nya insikter och kunskaper. Hjärnan fordrar ett kontinuerligt intag av kulturella fibrer, ett behov av kraftigt tuggmotstånd som inte upphör efter barndomen, utan fortsätter livet igenom.

Kategorier
Asien Japan Kina Korea Kultur Språk Taiwan Teknik

Skriva tecken på dator

Frågan ställs med jämna mellanrum, nämligen hur man hanterar kinesiska, japanska och andra skriftsystem på en dator eller telefon. Det är kanske inte banalt eller trivialt, men ändå infinner sig hos mig varje gång en viss förvåning över att det inte hör till allmängodset.

En del föreställer sig alltjämt att det finns något slags kinesiskt tangentbord som inrymmer tiotusentals tecken, medan den enkla sanningen är att man nyttjar samma slag som du och jag. Med undantag för Taiwan, där man av geopolitiska skäl vägrade följa Folkrepublikens utveckling och istället anammade ett eget ickekommunistiskt fonetiskt alfabet kallat zhuyin fuhao (注音符号) eller bopomofo (ㄅㄆㄇㄈ) efter de inledande tecknen, som därför präglar tangentborden därstädes.

På fastlandet och i den övriga mandarintalande sfären nyttjar man istället pinyin (拼音) som grund, en modern (1958) romanisering som är avsevärt mer ljudriktig än tidigare system. Varje kinesiskt tecken kan således representeras med det latinska alfabetet, som till exempel 海 (hai, hav), 北 (bei, norr) och 水 (shui, vatten).

Uttalet, minus toner, följer i stort den romaniserade skriften, men det finns en del undantag och förenklingar som är värda att notera. Ett är att u egentligen är ü efter x, j, q och y, som i 去 (qu = qü, åka, gå), 许 (xu = xü, tillåta), 鱼 (yu = yü = ü, fisk) och 剧 (ju = jü, drama). Efter n anges ü explicit, som i 女 (nü, kvinna), eftersom n även kan följas av u, som i 怒 (nu, raseri) – för ü används emellertid den lediga bokstaven v i praktiken vid inmatning: 女 = nü = nv.

Ett annat undantag är att y och w inte alltid uttalas självständigt, utan är ett slags funktionella halvvokaler. I det tidigare exemplet har vi 鱼 (yu = yü = ü, fisk), som alltså uttalas som ü eller svenskt y. Men i sammansättning föreligger palatalisering, eller muljering, så att det inledande y antar ett svenskt j-liknande ljud: 鲨鱼 (shayu = shayü, haj). För exempelvis provinsen 云南 (Yunnan = Yünnan) förekommer vanligen palataliseringen självständigt i initialen, vilket motiverar bruket.

Alla är numera bekanta med staden Wuhan, som dock i en kinesisk kontext mest är känd av andra skäl, exempelvis för revolutionen 1911. Uttalet är emellertid inte som i statstelevisionen, utan vi har 武汉 (Wuhan = Uhan), det vill säga Oo-han. Att w ändå används beror på att det blir den bästa approximationen när u följs av en annan vokal, som i 我 (wo = uo, jag) eller 为 (wei = uei, för).

Ett ytterligare undantag är att -ian egentligen är -ien (-iän) i standarduttal, som i 天津 (Tianjin = Tienjin) och 鞭炮 (bianpao = bienpao, smällare), och att -uan egentligen är -uen (uän), som i 美元 (meiyuan = meiyuen, amerikansk dollar). I samma härad ligger kortformer för -ui = -uei, som i 水 (shui = shuei, vatten) och 桂 (Gui = Guei), och i kombination med föregående har vi således 瑞典 (Ruidian = Rueidien, Sverige). Lokalt uttal varierar, och kan ligga ortografiskt närmare pinyin. Pinyin är således utformat för att ha kortast möjliga form.

Kandidatfönster för sha i pinyin.

Med pinyin som grund kan man enkelt rendera tecken på skärm, nämligen genom att knappa in motsvarande romanisering för ett tecken eller ord, varvid man får ett antal förslag i ett kandidatfönster. De flesta stavelser i pinyin har nämligen ett antal motsvarigheter i tecken, som till exempel 傻 (sha, dum), 杀 (sha, döda), 鲨 (sha, haj). Det gäller även sammansatta ord, som 上海 (Shanghai) och 伤害 (shanghai, såra) – det är här tonerna kommer till sin rätt.

Kandidatfönster för shanghai i pinyin.

De första inmatningsmetoderna under 1980-talet var givetvis primitiva, men har sedermera raffinerats. Numera förekommer således prediktion på samma sätt som hos en sökmaskin, och metoden kan algoritmiskt välja rätt tecken och teckenkombinationer beroende av kontext. I Kina har man därtill AI-prediktion per molntjänst, vilket ytterligare raffinerar intelligensen i systemet. Metoden har vidare minne för användarens val av tecken.

Man skriver således inte enstaka tecken eller ord, utan hela eller delar av meningar i pinyin, för att erhålla bästa förslag per kontext. Man kan vid behov stega sig fram mellan olika delar av en mening för att korrigera enskilda tecken eller ord. Till yttermera visso behöver man inte alls skriva ut hela ord, utan det räcker med initialer, som gcd för 共产党 (gongchandang, kommunistpartiet), eller med «suddig pinyin» i allmänhet.

Prediktion vid kinesisk inmatning. gcdsrmdxz ger 共产党是人民的选择 (gongchandang shi renmin de xuanze, kommunistpartiet är folkets val).

En hel mening kan formas sålunda: gcdsrmdxz renderas som 共产党是人民的选择 (gongchandang shi renmin de xuanze, kommunistpartiet är folkets val). Av detta förstår vi att kinesiska på dator kan skrivas mycket snabbare än västerländska språk, vilket får sägas vara en oväntad utveckling.

Prediktion vid kinesisk inmatning med pinyin. Den fixar inte mullvad (鼹鼠, yanshu) i meningen, men väl att pappa har fem söner (爸爸有五个儿子, baba you wuge erzi).

En komplikation tycks vara att man alltjämt använder traditionella tecken på sina håll, till exempel i Hongkong och Taiwan, men det finns för det ändamålet parallella inmatningsmetoder för respektive tradition, och båda medger i övrigt bruk av såväl förenklade som traditionella tecken. Tecken som tecken, liksom.

Rendering på japanska nyttjar samma principer och har ungefär samma förutsättningar som kinesiska i övrigt. Tangentbord i Japan kan visserligen ha en särskild layout med alfabetet hiragana som komplement till den sedvanliga latinska utformningen, men det går alldeles utmärkt att nyttja så kallad rōmaji (ローマ字) med latinska bokstäver direkt – det är för övrigt den vanligaste metoden.

Japanska är något mer komplicerat än kinesiska, eftersom man utöver tecken har två hjälpalfabet i hiragana och katakana. Men även här löser intelligent prediktion problemet smärtfritt.

Japansk inmatning i praktiken.
Texten ovan kommer från denna mangasnutt.

Även för japanska förekommer ett antal olika romaniseringar, men Hepburn är sedan länge den vanligast förekommande.Till skillnad från tidiga kinesiska romaniseringar är det förhållandevis ljudriktigt. Man har till exempel 彼女 (かのじょ, kanojo, hon), 切符 (きっぷ, kippu, biljett) och 日本 (にほん, Nihon, Japan).

Systemet väljer automatiskt mellan kanji (kinesiska tecken) och de två alfabeten, men man kan förstås överpröva beslutet vid behov. I själva verket kan man skriva med enbart hiragana eller katakana, men det underlättar inte läsningen – tecknen ger texten stadga.

Prediktion vid japansk inmatning. Förstahandsvalet 空き (suki, vara hungrig) ges av den tidigare existensen av お腹 (おなか, onaka, mage).

Kontexten bestämmer vidare vilka kanji som väljs, till exempel för すき (suki), som kan betyda 好き (suki, gilla), eller 空き (suki, vara hungrig, vara tom). Förekomsten av ordet お腹 (おなか, onaka, mage) i meningen ger då det naturliga valet 空き (suki, vara hungrig) i prediktionen.

Såväl kinesiska som japanska skrivs numera vanligen horisontellt från vänster till höger, men de flesta ordbehandlare medger traditionell vertikal skrift från höger till vänster, vanligen uppifrån och ned. Det påverkar inte inmatningen, utan är en fråga om typografi och grafisk utformning.

Vertikal rendering av japanska och kinesiska.

Koreanskan använder det inhemska alfabetet hangeul (한글), men eftersom det skrivs i termer av stavelseblock minner det en del om metoderna för kinesiska och japanska. Det beror i sin tur på att koreanska ursprungligen nyttjade kinesiska tecken i skrift, och att man därefter har behållit blockstrukturen – inte mindre än sextio procent av koreanska ord har nämligen kinesiskt ursprung.

Ett kinesiskt tecken som 山 (shan, berg) skrivs på koreanska således som 산 (san) snarare än löpande ㅅㅏㄴ som i västerländsk skrift. Därvid preciserar man fonetiken och gör renderingen betydligt mer kompakt. Av de tjugofyra bokstäverna kan man forma inte mindre än 11 172 stavelseblock, vilket gör att koreanska för en utomstående kan misstas för en logografisk teckenskrift.

Koreanska är en alfabetisk skrift, men med bevarad stavelsestruktur.

Koreanskan lider på samma sätt som kinesiskan av ett stort antal homonymer, det vill säga ord som uttalas likadant men har olika innebörd och rendering i tecken. I koreanskan är det dessutom fråga om homografer, i så måtto att de renderas identiskt med hangeul – därför får man emellanåt precisera med hanja (한자), det vill säga kinesiska tecken.

Tidigare nyttjade man likt japanskan en blandskrift, men numera använder man enbart hangeul, främst av historiska och politiska skäl – det koreanska språket trängdes undan under den japanska ockupationen. Koreanskan är som ett resultat mer svårläst än japanska och kinesiska, trots ett genialt alfabet.

Tidningen Joseon Ilbo (조선일보) använder hanja i logotypen (朝鮮日報), men även i artikeln (野, 야, ya, fält, opposition).

Även inmatning av koreanska är något mer komplicerat, eftersom man måste förhålla sig till stavelseblockens struktur, med allt vad det innebär i form av tomma platshållare. Vill man rendera namnet 李 (zh: Li, jp: Ri, ko: I) kan man således inte nöja sig med ㅣ, utan måste skriva 이, där ㅇ markerar en tyst platshållare.

Systemet hanterar i övrigt automatiskt strukturen i blocken, och även för koreanskan finns ett antal olika system för inmatning. Man kan använda en latiniserad variant om man vill, men det går avgjort fortare med en särskild koreansk layout som skiljer ut vokaler och konsonanter i vardera halvan.

Koreansk tangentlayout (Mac OS). Översta raden är ordprediktioner för aktuell text.