
Mandarijn, Kantonees, Sjanghainees en Hokkien worden doorgaans dialecten van het Chinees genoemd. Toch kunnen de verschillen ertussen groter zijn dan die tussen verschillende officieel erkende Europese talen. Wie begrijpt waarom dat zo is, ontdekt iets fascinerends over de manier waarop we talen definiëren.
De meeste mensen beschouwen Chinees als één taal die in verschillende regionale dialecten wordt gesproken. Mandarijn is de officiële standaard op het Chinese vasteland, terwijl Kantonees, Sjanghainees, Hokkien, Hakka en andere variëteiten doorgaans worden beschreven als regionale vormen van dezelfde taal.
Maar er is een interessante complicatie: veel Chinese ‘dialecten’ zijn onderling niet verstaanbaar.
Een spreker van het Mandarijn kan over het algemeen een gesprek dat volledig in het Kantonees, Sjanghainees of Hokkien wordt gevoerd niet begrijpen zonder eerdere blootstelling aan die taal of studie ervan. Deze variëteiten verschillen aanzienlijk in uitspraak en woordenschat, evenals in sommige aspecten van de grammatica.
Kijk nu eens naar de talen van het voormalige Joegoslavië. Servisch, Kroatisch, Bosnisch en Montenegrijns worden erkend als afzonderlijke nationale standaardtalen. Toch kunnen hun sprekers elkaar doorgaans zonder veel moeite begrijpen.
Dit levert een fascinerend contrast op. Sommige officieel erkende talen lijken buitengewoon sterk op elkaar, terwijl sommige variëteiten die traditioneel als dialecten worden geclassificeerd enorm van elkaar verschillen.
Wat maakt iets dan precies tot een taal in plaats van een dialect?
Bij het antwoord spelen meer factoren een rol dan alleen woordenschat en grammatica. Ook geschiedenis, culturele identiteit, onderwijs en taalstandaardisering zijn belangrijk. Het erkennen van taalkundige verschillen betekent niet dat gemeenschappen afzonderlijke nationale of politieke identiteiten moeten hebben. Taalclassificatie en nationale identiteit zijn verwante, maar fundamenteel verschillende kwesties.
Chinees is een diverse familie van verwante talen
Chinees behoort tot de Sino-Tibetaanse taalfamilie. De variëteiten ervan vormen de Sinitische tak, die taalkundigen doorgaans in verschillende hoofdgroepen verdelen.
Afhankelijk van het classificatiesysteem telt het Chinees ongeveer zeven tot tien hoofdgroepen, met binnen elke groep talrijke regionale variëteiten.
| Groep | Bekende variëteiten | Belangrijkste regio’s |
|---|---|---|
| Mandarijn | Standaardmandarijn, Sichuanees | Noord- en Zuidwest-China |
| Wu | Sjanghainees, Suzhounees | Shanghai, Zhejiang |
| Yue | Kantonees, Taishanees | Guangdong, Hongkong |
| Min | Hokkien, Teochew, Fuzhounees | Fujian, Taiwan |
| Hakka | Hakka-variëteiten | Guangdong, Fujian, Jiangxi |
| Xiang | Hunanees | Hunan |
| Gan | Gan-variëteiten | Jiangxi |
| Jin | Jin-variëteiten | Shanxi |
| Huizhou | Hui-variëteiten | Zuid-Anhui |
| Pinghua | Pinghua-variëteiten | Guangxi |
Er bestaat geen algemene overeenstemming over de precieze classificatie. Zo wordt Jin soms bij het Mandarijn ingedeeld, terwijl Min verschillende sterk uiteenlopende variëteiten omvat.
Zelfs het behoren tot dezelfde groep garandeert geen onderlinge verstaanbaarheid. Hokkien en Fuzhounees behoren beide tot het Min-Chinees, maar hun sprekers kunnen elkaar doorgaans niet begrijpen zonder eerdere blootstelling aan de andere taal.
Ook sommige naburige gemeenschappen in Zuid-China spreken variëteiten die voor buitenstaanders, waaronder sprekers van andere Chinese variëteiten, moeilijk te begrijpen kunnen zijn.
Encyclopaedia Britannica beschrijft Chinees als een verzameling variëteiten die in het dagelijks taalgebruik dialecten worden genoemd, maar door wetenschappers meestal als afzonderlijke talen worden geclassificeerd. De encyclopedie vergelijkt de verschillen ertussen met die tussen moderne Romaanse talen, zoals Spaans, Italiaans en Frans.
Chinees beschrijven als een groep verwante talen is dus geen ongebruikelijke taalkundige opvatting. Het is een gevestigde manier om de diversiteit ervan te begrijpen.
Wat onderscheidt een taal van een dialect?
Een van de nuttigste begrippen in de taalkunde is onderlinge verstaanbaarheid: het vermogen van sprekers van verschillende variëteiten om elkaar zonder voorafgaande studie te begrijpen.
Neem Amerikaans en Brits Engels. Ze verschillen in uitspraak, woordenschat en sommige grammaticale conventies, maar sprekers kunnen doorgaans zonder moeite met elkaar communiceren. De meeste mensen herkennen ze als variëteiten van het Engels.
Kijk nu naar Spaans en Portugees. Deze talen hebben een gemeenschappelijke voorouder en veel overeenkomsten, maar hun sprekers begrijpen elkaar minder gemakkelijk, vooral bij spontane spraak.
Mandarijn en Kantonees vormen een vergelijkbare situatie. Hoewel beide tot de Chinese taaltraditie behoren, stelt kennis van de ene taal iemand niet automatisch in staat de andere te begrijpen.
Hetzelfde geldt voor Mandarijn en Sjanghainees, of Mandarijn en Hokkien.
Dit zijn niet slechts verschillende accenten. Het zijn afzonderlijke taalsystemen die zich in de loop van eeuwen hebben ontwikkeld, met aanzienlijke verschillen in klanksystemen, woordenschat en bepaalde grammaticale structuren.
Onderlinge verstaanbaarheid is echter geen perfecte maatstaf. Een spreker van het Mandarijn die regelmatig naar Kantonese televisie kijkt, begrijpt mogelijk aanzienlijk meer Kantonees dan iemand die er nooit mee in aanraking is gekomen. Blootstelling, onderwijs en regionaal contact kunnen het begrip sterk beïnvloeden.
Talen kunnen ook dialectcontinua vormen, waarbij naburige variëteiten relatief gemakkelijk te begrijpen zijn, maar verder van elkaar verwijderde variëteiten steeds meer verschillen.
Niettemin biedt onderlinge verstaanbaarheid een nuttig uitgangspunt om te begrijpen waarom veel Chinese variëteiten redelijkerwijs als afzonderlijke talen kunnen worden beschouwd.
Mandarijn en Kantonees verschillen in meer dan alleen uitspraak
Bekijk enkele alledaagse uitdrukkingen om de verschillen tussen Chinese variëteiten te begrijpen.
| Nederlands | Mandarijn | Kantonees |
|---|---|---|
| Ik | 我 (wǒ) | 我 (ngo5) |
| Hij of zij | 他 / 她 (tā) | 佢 (keoi5) |
| Eten | 吃 (chī) | 食 (sik6) |
| Niet | 不 (bù) | 唔 (m4) |
| Zijn | 是 (shì) | 係 (hai6) |
| Wat | 什么 (shénme) | 乜嘢 (mat1 je5) |
| Nu | 现在 (xiànzài) | 而家 (ji4 gaa1) |
Sommige woorden gebruiken dezelfde karakters, maar hebben verschillende uitspraken. Andere gebruiken geheel andere woorden en karakters.
De verschillen worden duidelijker wanneer we volledige zinnen vergelijken.
Nederlands: Wat wil je eten?
Mandarijn: 你想吃什么?
Nǐ xiǎng chī shénme?
Kantonees: 你想食乜嘢?
Nei5 soeng2 sik6 mat1 je5?
Beide zinnen drukken dezelfde betekenis uit en delen elementen van hun grammaticale structuur. Hun woordenschat en uitspraak verschillen echter aanzienlijk.
Het Kantonees gebruikt ook grammaticale partikels, aspectmarkeerders en andere constructies die niet rechtstreeks overeenkomen met het alledaagse gebruik van het Mandarijn.
De twee variëteiten delen een historische basis, maar dat maakt ze niet onderling uitwisselbaar.
De verrassende vergelijking met het voormalige Joegoslavië
Misschien wel de treffendste illustratie van hoe taalclassificatie werkt, komt uit Zuidoost-Europa.
Gedurende een groot deel van de twintigste eeuw waren de Servische, Kroatische, Bosnische en Montenegrijnse taalgemeenschappen verbonden met een gedeelde standaardtaal die doorgaans bekendstond als Servo-Kroatisch.
Na het uiteenvallen van Joegoslavië ontstonden vier afzonderlijke nationale standaardtalen: Servisch, Kroatisch, Bosnisch en Montenegrijns.
Elke taal heeft een eigen officiële status, gestandaardiseerde conventies, literaire tradities en relatie met de nationale identiteit. Er bestaan verschillen in woordenschat, uitspraak, spelling en voorkeursuitdrukkingen. Het Servisch gebruikt bovendien zowel het cyrillische als het Latijnse schrift, terwijl het Kroatisch het Latijnse schrift gebruikt.
Toch kunnen sprekers van deze vier standaardvariëteiten doorgaans zonder vertaling met elkaar communiceren.
Een spreker van het Kroatisch kan meestal naar Servische televisie kijken en begrijpen wat er wordt gezegd. Een spreker van het Bosnisch kan doorgaans met een spreker van het Montenegrijns praten zonder Montenegrijns als vreemde taal te hoeven leren.
De verschillen zijn reëel, maar de onderlinge verstaanbaarheid blijft zeer hoog.
Deze situatie contrasteert met die van Mandarijn en Kantonees, waarvan de sprekers vaak een gemeenschappelijke taal, zoals Standaardmandarijn, moeten gebruiken om met elkaar te communiceren.
| Taalvariëteiten | Gebruikelijke verstaanbaarheid van gesproken taal zonder voorafgaande studie |
|---|---|
| Servisch en Kroatisch | Zeer hoog |
| Kroatisch en Bosnisch | Zeer hoog |
| Servisch en Montenegrijns | Zeer hoog |
| Mandarijn en Kantonees | Laag |
| Mandarijn en Sjanghainees | Laag |
| Mandarijn en Hokkien | Laag |
| Hokkien en Fuzhounees | Laag |
Dit zijn algemene kwalitatieve beschrijvingen, geen nauwkeurige numerieke metingen. Het daadwerkelijke begrip hangt af van onderwijs, blootstelling en de specifieke variëteiten in kwestie.
Niettemin is het centrale contrast duidelijk.
Servisch, Kroatisch, Bosnisch en Montenegrijns worden erkend als afzonderlijke nationale standaardtalen, ondanks hun nauwe taalkundige verwantschap. Mandarijn, Kantonees en Hokkien worden vaak dialecten genoemd, hoewel ze onderling veel minder verstaanbaar zijn.
Dit betekent niet dat de nationale talen van het voormalige Joegoslavië als ongeldig moeten worden beschouwd of dat hun onderlinge verschillen onbelangrijk zijn. Hun afzonderlijke standaarden en identiteiten zijn stevig gevestigd.
De vergelijking laat juist zien dat taalkundige gelijkenis niet de enige factor is die bepaalt of een variëteit als taal wordt erkend.
Dit is niet uniek voor het Chinees
Vergelijkbare situaties komen overal ter wereld voor.
Noors, Zweeds en Deens worden erkend als afzonderlijke talen, maar hun sprekers kunnen elkaar vaak in uiteenlopende mate begrijpen. Vooral Noors en Zweeds lijken in veel opzichten sterk op elkaar, hoewel het begrip varieert naargelang het dialect en de individuele blootstelling.
Hindi en Urdu vormen een ander interessant voorbeeld. Hun alledaagse omgangsvormen kunnen in hoge mate onderling verstaanbaar zijn, terwijl hun formele standaarden verschillen in woordenschat, schrift en literaire tradities.
Het Arabisch kent een situatie die beter vergelijkbaar is met het Chinees. Modern Standaardarabisch biedt in een groot deel van de Arabische wereld een gemeenschappelijke formele schrijftaal, terwijl de alledaagse gesproken variëteiten enorm kunnen verschillen. Marokkaans-Arabisch en Iraaks-Arabisch kunnen bijvoorbeeld voor elkaars sprekers moeilijk te begrijpen zijn zonder eerdere blootstelling.
Het Duits biedt nog een voorbeeld. Sommige Zwitserduitse variëteiten verschillen aanzienlijk van het Standaardduits, maar worden doorgaans binnen de bredere Duitse taaltraditie geplaatst.
Deze voorbeelden laten zien dat er geen universele regel is die bepaalt dat nauw verwante variëteiten altijd als dialecten moeten worden geclassificeerd, of dat sterk uiteenlopende variëteiten altijd als afzonderlijke talen moeten worden erkend.
Soms ontwikkelen nauw verwante variëteiten onafhankelijke nationale standaarden. Soms blijven aanzienlijk verschillende variëteiten onderdeel van een gedeelde taalkundige en culturele identiteit.
Waarom worden Chinese talen nog steeds dialecten genoemd?
Er zijn belangrijke historische, culturele en taalkundige redenen voor deze terminologie.
Ten eerste delen Chineessprekende gemeenschappen een lange literaire en culturele geschiedenis. Hun talen zijn voortgekomen uit verwante historische vormen van het Chinees, en veel gemeenschappen hebben hun onderlinge banden onderhouden via literatuur, onderwijs en culturele uitwisseling.
Ten tweede fungeert Standaardmandarijn als gemeenschappelijke taal op het Chinese vasteland en speelt het ook een centrale rol in het onderwijs en de openbare communicatie in Taiwan. Sprekers van verschillende regionale variëteiten leren vaak Mandarijn en gebruiken het om buiten hun lokale gemeenschappen te communiceren.
Ten derde komt de Chinese term 方言 (fāngyán), die doorgaans als ‘dialect’ wordt vertaald, niet precies overeen met de alledaagse Engelse betekenis van dat woord. De term kan in brede zin verwijzen naar regionale spraakvormen, waaronder variëteiten die onderling onverstaanbaar zijn.
Tot slot worden taalbenamingen gevormd door historische conventies en gedeelde culturele identiteiten. Een gemeenschappelijke identiteit kan aanzienlijke taalkundige diversiteit omvatten, net zoals afzonderlijke identiteiten zich rond nauw verwante talen kunnen ontwikkelen.
De term ‘Chinees dialect’ is dus begrijpelijk binnen zijn historische en culturele context.
Het probleem ontstaat wanneer Engelstalige lezers die term opvatten als een kleine variatie van dezelfde gesproken taal.
Gebruikt niet iedereen dezelfde Chinese karakters?
Een van de redenen waarom Chinese variëteiten meer een eenheid lijken dan ze klinken, is hun gedeelde schrijftraditie.
Een spreker van het Kantonees en een spreker van het Mandarijn kunnen moeite hebben om elkaars spraak te begrijpen, maar beiden kunnen Standaardgeschreven Chinees lezen als ze dat hebben geleerd.
Dat betekent echter niet dat de geschreven standaard elke gesproken variëteit op dezelfde manier rechtstreeks weergeeft.
Standaardgeschreven Chinees is grotendeels gebaseerd op de woordenschat en grammatica van het Mandarijn. Sprekers van andere Chinese variëteiten leren deze geschreven standaard doorgaans via formeel onderwijs, zelfs wanneer die afwijkt van hun alledaagse spreektaal.
Het Kantonees vormt een bijzonder duidelijk voorbeeld.
Nederlands: Hij is niet thuis.
Standaardgeschreven Chinees: 他不在家。
Geschreven Kantonees in omgangstaal: 佢唔喺屋企。
Beide zinnen drukken dezelfde betekenis uit, maar hun woordenschat en grammaticale conventies verschillen.
Iemand die alleen vertrouwd is met Standaardgeschreven Chinees herkent mogelijk niet elke uitdrukking die in geschreven Kantonese omgangstaal wordt gebruikt.
Ook andere Chinese variëteiten hebben een eigen woordenschat en grammaticale structuren, hoewel hun schrijftradities en mate van standaardisering verschillen.
Een gedeeld schrift kan communicatie over taalgrenzen heen vergemakkelijken, maar heft die grenzen niet op.
Het omgekeerde geldt ook. Servisch en Kroatisch kunnen verschillende schrijfconventies gebruiken, terwijl ze in gesproken vorm in hoge mate onderling verstaanbaar blijven.
Schriftsystemen en gesproken talen hangen met elkaar samen, maar zijn niet hetzelfde.
Waarom deze verschillen belangrijk zijn voor vertaling en AI
De verschillen tussen Chinese variëteiten zijn niet louter een academische kwestie. Ze hebben praktische gevolgen voor vertaalsoftware, spraakherkenning, ondertiteling en kunstmatige intelligentie.
Van een spraakherkenningsmodel dat voornamelijk op Mandarijn is getraind, kan niet automatisch worden verwacht dat het Kantonees of Hokkien nauwkeurig begrijpt. Deze talen hebben verschillende klanksystemen, woordenschat en taalkundige conventies.
Evenzo levert het vertalen van tekst naar Standaardgeschreven Chinees niet noodzakelijk de taal op die een spreker van het Kantonees van nature in een alledaags gesprek zou gebruiken.
Een vertaaldienst die ondersteuning voor ‘Chinees’ adverteert, kan daarmee Standaardmandarijn, Standaardgeschreven Chinees, Kantonees of een combinatie daarvan bedoelen. Dit onderscheid is belangrijk, omdat ondersteuning voor de ene taal geen ondersteuning voor de andere garandeert.
Een AI-vertaalsysteem kan bijvoorbeeld taalspecifieke training en evaluatie nodig hebben om natuurlijk Kantonees te produceren in plaats van op Mandarijn gebaseerd geschreven Chinees. Spraakherkenningssystemen moeten ook rekening houden met verschillende uitspraken, woordenschat en soms geheel andere taalkundige structuren.
Deze uitdaging beperkt zich niet tot de bekendste variëteiten.
Hokkien, Hakka, Teochew, Fuzhounees en andere regionale talen hebben aanzienlijke sprekersgemeenschappen, maar krijgen vaak minder aandacht van gangbare taaltechnologie.
Om deze talen te ondersteunen is meer nodig dan ze als variaties op het Mandarijn te behandelen. Dat kan betekenen dat geschikte trainingsgegevens worden verzameld, schrijfconventies worden ontwikkeld, de geproduceerde tekst door moedertaalsprekers wordt beoordeeld en wordt samengewerkt met sprekers die regionale verschillen begrijpen.
Dit is vooral belangrijk voor realtimevertaling, waarbij twee mensen die verschillende talen spreken op een natuurlijke manier moeten kunnen communiceren zonder op een gemeenschappelijke taal terug te vallen.
Het erkennen van taalkundige diversiteit kan de nauwkeurigheid van vertalingen, de toegankelijkheid en het behoud van talen verbeteren. Het helpt technologieontwikkelaars ook om nauwkeuriger te beschrijven welke talen hun producten ondersteunen.
Is Chinees nu één taal of zijn het er meerdere?
Het antwoord hangt af van de manier waarop het woord ‘Chinees’ wordt gebruikt.
Vanuit historisch en cultureel perspectief kan Chinees dienen als overkoepelende term voor talrijke verwante taalvariëteiten die belangrijke literaire en culturele tradities delen.
Vanuit het perspectief van de vergelijkende taalkunde is het vaak informatiever om Chinees te beschrijven als een groep verwante Sinitische talen binnen de Sino-Tibetaanse familie.
Beide beschrijvingen kunnen nuttig zijn, omdat ze verschillende vragen beantwoorden.
Kantonees, Hokkien of Sjanghainees in taalkundige zin een afzonderlijke taal noemen, ontkent niet de band met de Chinese geschiedenis of cultuur. Het impliceert evenmin iets over de nationaliteit of politieke identiteit van de sprekers.
Evenzo vereist het erkennen van Servisch, Kroatisch, Bosnisch en Montenegrijns als afzonderlijke nationale standaardtalen niet dat we hun taalkundige verschillen groter voorstellen dan ze zijn.
Taalclassificatie omvat minstens twee dimensies: hoezeer variëteiten taalkundig van elkaar verschillen, en hoe gemeenschappen zich ermee identificeren, ze standaardiseren en gebruiken.
Deze dimensies vallen niet altijd samen.
Conclusie: een taal is meer dan een taalkundige classificatie
Het onderscheid tussen een taal en een dialect lijkt misschien eenvoudig, maar Chinees en de talen van het voormalige Joegoslavië laten zien hoe ingewikkeld het kan worden.
Servisch, Kroatisch, Bosnisch en Montenegrijns zijn afzonderlijke nationale standaardtalen, ondanks hun hoge onderlinge verstaanbaarheid. Mandarijn, Kantonees, Hokkien en Sjanghainees worden vaak als dialecten beschreven, ondanks grote taalkundige verschillen die gemakkelijke communicatie tussen hun sprekers kunnen verhinderen.
Geen van beide situaties kan uitsluitend op basis van onderlinge verstaanbaarheid worden verklaard.
Geschiedenis, onderwijs, literaire tradities, culturele identiteit en standaardisering beïnvloeden allemaal hoe talen worden geclassificeerd en benoemd.
De belangrijkste les is niet dat sommige officieel erkende talen hun status moeten verliezen, of dat elke regionale Chinese variëteit een bepaald label moet krijgen.
Het is dat taalkundige diversiteit niet altijd overeenkomt met de taalcategorieën die we in het dagelijks leven gebruiken.
Chinees is een bijzonder treffend voorbeeld. Achter één vertrouwde naam gaat een buitengewone verscheidenheid aan verwante talen schuil, waarvan vele even sterk van elkaar verschillen als talen die elders in de wereld afzonderlijk worden erkend.
Inzicht in die diversiteit geeft ons een nauwkeuriger beeld van het Chinees en meer waardering voor de complexiteit van menselijke taal.
Bronnen en verdere lectuur
- Encyclopaedia Britannica: Chinese talen. Overzicht van de taalkundige diversiteit van het Chinees, onderlinge verstaanbaarheid en de belangrijkste Sinitische taalgroepen.
- Jin Liu: Een historisch overzicht van het discours over fangyan in het moderne China. Onderzoek naar Chinese regionale talen, terminologie en de historische ontwikkeling van taalidentiteit.
- Michele Mannoni: Chinese dialecten/dialecten van het Chinees. Academische bespreking van terminologie en het onderscheid tussen dialecten en talen in de Chinese taalkunde.
- Pluricentriciteit in de klas: de Servo-Kroatische taal. Onderzoek naar de verwantschap, verstaanbaarheid en standaardisering van Bosnisch, Kroatisch, Montenegrijns en Servisch.
- Ljubica Djordjević: De juridische status van de talen die uit het Servo-Kroatisch zijn voortgekomen. Analyse van de officiële taalstandaarden die zich na het uiteenvallen van Joegoslavië hebben ontwikkeld.