Dans les articles précédents, nous avons exploré comment le vocabulaire fonctionne différemment selon les familles de langues.

En anglais, les études sur le vocabulaire parlent souvent de familles de mots. Dans les langues européennes, l’apprentissage implique de gérer les formes verbales, le genre, les cas, les composés et la prononciation. En mandarin et en japonais, les systèmes d’écriture ajoutent une couche supplémentaire. En arabe, les racines, les schémas et les dialectes changent complètement la perspective.

Nous arrivons maintenant à un autre groupe de langues fascinant : les langues agglutinantes.

On y trouve par exemple le turc, le hongrois, le finnois et le coréen, même si chacune de ces langues possède sa propre histoire, sa propre structure et ses propres défis d’apprentissage.

Au premier abord, ces langues peuvent sembler intimidantes. Un seul mot peut être très long. Il peut contenir ce que l’anglais exprimerait avec plusieurs mots séparés. Pour les personnes qui les apprennent, cela crée une crainte fréquente :

« Faut-il mémoriser chaque long mot comme un élément de vocabulaire distinct ? »

Heureusement, la réponse est non.

Dans les langues agglutinantes, les mots longs sont souvent construits à partir de plus petits éléments porteurs de sens. Dès que ces éléments commencent à être reconnus, la langue devient beaucoup plus logique.

Que signifie « agglutinant » ?

Le mot agglutinant vient de l’idée de « coller » des éléments ensemble.

Dans les langues agglutinantes, les mots sont souvent formés en ajoutant des suffixes ou d’autres affixes à une racine. Chaque élément ajouté possède généralement un sens grammatical relativement clair. Un mot peut contenir le sens de la racine, ainsi que des informations sur le nombre, la possession, le cas, le temps, la politesse, la direction ou d’autres relations.

Des bases typologiques comme WALS décrivent l’agglutination comme faisant partie d’une échelle plus large de structures morphologiques, aux côtés des modèles isolants, fusionnels et introflexifs. Ces catégories ne sont pas des cases parfaites, car les langues réelles mélangent souvent plusieurs caractéristiques, mais elles restent utiles pour comprendre comment les langues construisent les mots.

Une comparaison simple avec l’anglais peut aider.

L’anglais dit généralement :

in my houses

Une langue agglutinante peut exprimer une partie de ces informations à l’intérieur d’un seul mot :
racine + pluriel + possession + lieu.

Cela ne signifie pas qu’il faut mémoriser séparément toutes les formes complètes possibles. Il faut plutôt comprendre la racine et les suffixes courants.

C’est la clé de l’apprentissage du vocabulaire dans ces langues.

Pourquoi le comptage des mots devient trompeur

En anglais, les formes house, houses et house’s sont faciles à relier. Mais dans les langues agglutinantes, une seule racine nominale ou verbale peut apparaître sous beaucoup plus de formes.

Une note informatique sur les langues agglutinantes donne des exemples finnois construits à partir de talo, « maison », et explique que des langues comme le turc, le finnois, le hongrois et le coréen peuvent produire de nombreuses formes à partir d’une racine donnée grâce à la suffixation.

Pour compter le vocabulaire, cela pose problème.

Si l’on compte chaque forme de surface comme un mot distinct, les langues agglutinantes peuvent sembler incroyablement vastes. Mais ce serait trompeur. Beaucoup de ces formes ne sont pas des éléments de vocabulaire distincts au même titre que des mots sans rapport entre eux. Ce sont des combinaisons d’éléments connus.

Pour l’apprentissage, la vraie question pratique n’est pas :

« Combien de formes de mots différentes ai-je mémorisées ? »

Une meilleure question serait :

« Puis-je reconnaître la racine et comprendre le rôle des suffixes ? »

C’est pourquoi les langues agglutinantes récompensent la reconnaissance des schémas.

Le turc : suffixes clairs et harmonie vocalique

Le turc est l’un des exemples les plus nets d’agglutination.

Les mots turcs sont souvent construits en ajoutant des suffixes à une racine. Ces suffixes peuvent exprimer le pluriel, la possession, le cas, le temps, la personne, la négation et d’autres sens. La description de la structure linguistique des langues turciques par Britannica souligne que les suffixes se combinent pour créer de longs radicaux dérivés, et que de nombreuses langues turciques utilisent l’harmonie vocalique, où les voyelles des suffixes s’adaptent aux voyelles du mot.

Un exemple célèbre pour l’apprentissage est construit à partir de ev, qui signifie « maison » :

  • ev — maison
  • evler — maisons
  • evlerim — mes maisons
  • evlerimde — dans mes maisons
  • evlerimden — de mes maisons

Pour une personne anglophone qui débute, evlerimden peut ressembler à un mot totalement nouveau. En réalité, il est construit à partir de plusieurs éléments :

ev + ler + im + den

maison + pluriel + mes + de

C’est pourquoi le turc peut sembler difficile au début, puis très systématique par la suite. Une fois les suffixes reconnus, beaucoup de mots longs deviennent plus faciles à comprendre.

Le défi ne consiste pas seulement à mémoriser des racines. Il faut aussi développer une reconnaissance rapide des chaînes de suffixes et de l’harmonie vocalique.

Le hongrois : de nombreuses relations à l’intérieur du mot

Le hongrois est également connu pour sa riche suffixation.

Le hongrois exprime souvent des relations que l’anglais exprime avec des prépositions. Au lieu de dire « dans la maison », « depuis la maison » ou « vers la maison », le hongrois attache des terminaisons au nom.

Par exemple, avec ház, « maison » :

  • ház — maison
  • házban — dans la maison
  • házból — de la maison
  • házhoz — vers la maison
  • házam — ma maison
  • házaimban — dans mes maisons

Là encore, il ne faut pas traiter chaque forme comme un mot totalement séparé. La racine porte le sens principal, tandis que les suffixes ajoutent des informations grammaticales.

Le hongrois peut être particulièrement intéressant, car il possède de nombreuses terminaisons proches des cas et un système de suffixes très productif. Au début, l’expérience peut sembler écrasante. Un mot peut apparaître sous des formes assez différentes de l’entrée du dictionnaire.

Mais la logique profonde est similaire :

racine + suffixe + suffixe + suffixe

Plus les terminaisons courantes sont reconnues, plus la langue devient transparente.

C’est aussi pourquoi apprendre le vocabulaire hongrois ne doit pas se limiter à « mot = traduction ». Il faut aussi inclure les formes courantes et les schémas de phrases.

Apprendre ház = maison est utile. Mais apprendre házban, házból, házhoz et házam aide à comprendre le fonctionnement réel du hongrois.

Le finnois : cas, terminaisons et reconnaissance des mots

Le finnois est un autre exemple classique d’une langue où le vocabulaire et la morphologie sont profondément liés.

Le finnois utilise de nombreuses terminaisons de cas et possède une flexion riche. On entend souvent dire que le finnois a beaucoup de cas, ce qui peut sembler effrayant. Mais du point de vue du vocabulaire, l’essentiel n’est pas le nombre de cas en lui-même. Le point clé est que des mots familiers peuvent apparaître avec de nombreuses terminaisons différentes.

Par exemple, talo signifie « maison ». On peut rencontrer des formes comme :

  • talo — maison
  • talossa — dans la maison
  • talosta — de la maison
  • taloon — dans la maison, avec un mouvement vers l’intérieur
  • taloni — ma maison

Une personne qui mémorise uniquement la forme de base ne reconnaîtra pas forcément immédiatement toutes ces formes en lecture ou à l’écoute dans des situations réelles.

Des recherches sur la reconnaissance des mots en finnois ont étudié la manière dont les locuteurs natifs et les personnes apprenant le finnois comme langue seconde traitent les mots finnois morphologiquement complexes. Elles montrent que les noms fléchis transparents et semi-transparents influencent la reconnaissance différemment selon le profil d’apprentissage.

Pour l’apprentissage, cela donne une leçon pratique :

En finnois, l’apprentissage du vocabulaire doit entraîner la reconnaissance conjointe des radicaux et des terminaisons.

Connaître la forme du dictionnaire ne suffit pas. Il faut voir le mot dans de vraies phrases, avec des terminaisons courantes, de nombreuses fois.

Le coréen : suffixes, particules et politesse

Le coréen possède lui aussi de nombreuses caractéristiques agglutinantes, mais son défi d’apprentissage diffère de celui du turc, du hongrois ou du finnois.

Le coréen utilise des particules et des terminaisons verbales pour exprimer les relations grammaticales, le temps, la politesse, le niveau de langue et les nuances sociales. Une étude sur l’accord honorifique en coréen décrit cette langue comme agglutinante, utilisant activement particules et suffixes verbaux pour transmettre des informations grammaticales, tout en permettant l’omission et un ordre flexible selon le contexte.

Par exemple, les verbes coréens apparaissent souvent avec des terminaisons qui indiquent le temps, la politesse et le type de phrase. La forme du dictionnaire n’est qu’un point de départ.

On peut apprendre le radical d’un verbe, mais dans le coréen réel, il apparaîtra avec différentes terminaisons selon la situation :

  • registre familier,
  • registre poli,
  • registre formel,
  • questions,
  • ordres,
  • suggestions,
  • formes honorifiques.

Cela signifie que le vocabulaire coréen ne peut pas être complètement séparé du contexte social.

Connaître un verbe, c’est connaître non seulement son sens, mais aussi la manière dont il apparaît dans la parole naturelle. Une forme utilisée avec un ami proche peut ne pas convenir dans une situation formelle. Une forme utilisée pour parler de soi peut différer d’une forme employée pour parler de quelqu’un d’autre avec respect.

Pour le coréen, l’apprentissage du vocabulaire devrait donc inclure :

  • le radical,
  • les particules courantes,
  • les terminaisons courantes,
  • les niveaux de politesse,
  • les schémas de phrases,
  • et le contexte conversationnel réel.

C’est pourquoi le coréen peut sembler simple sur certains points — par exemple, il n’a pas de genre grammatical comme beaucoup de langues européennes — mais complexe sur d’autres.

Pourquoi les langues agglutinantes peuvent sembler difficiles au début

Les langues agglutinantes semblent souvent difficiles au départ pour trois raisons.

Premièrement, les mots peuvent paraître longs. Au niveau débutant, une forme longue peut être prise pour un mot totalement nouveau.

Deuxièmement, la recherche dans le dictionnaire peut être plus difficile. Si l’on ne sait pas enlever les terminaisons, la racine peut être difficile à trouver.

Troisièmement, la compréhension orale peut représenter un défi. Dans la parole naturelle, les suffixes arrivent rapidement, et il faut reconnaître la racine et les terminaisons presque instantanément.

Mais il y a aussi une bonne nouvelle.

Les langues agglutinantes sont souvent très systématiques. Une fois les blocs de construction courants compris, les progrès peuvent s’accélérer. Au lieu de mémoriser chaque forme séparément, on commence à les décoder.

La langue cesse d’être une liste de longs mots mystérieux et devient un ensemble de schémas réutilisables.

Que signifie « 5 000 mots » ici ?

Dans une langue agglutinante, « 5 000 mots » est une simplification risquée.

S’agit-il de 5 000 racines ?
De 5 000 entrées de dictionnaire ?
De 5 000 formes de surface ?
De 5 000 unités de vocabulaire fréquentes incluant des schémas de suffixes courants ?

Ce n’est pas la même chose.

Une personne qui connaît 3 000 racines et comprend les suffixes courants peut comprendre davantage qu’une autre ayant mémorisé 8 000 formes isolées sans percevoir le système.

Pour le turc, le hongrois, le finnois et le coréen, la vraie force vient de la combinaison entre connaissance du vocabulaire et conscience morphologique.

En d’autres termes :

racines + suffixes + schémas = vocabulaire utilisable

Une meilleure stratégie d’apprentissage

Pour les langues agglutinantes, la meilleure stratégie n’est pas de mémoriser les mots longs comme des éléments isolés.

Une meilleure stratégie consiste à suivre ce chemin :

racine → suffixes courants → formes complètes → contexte de phrase

Par exemple, lors de l’apprentissage d’un nom, n’apprenez pas seulement la forme de base. Apprenez-le avec des formes courantes de lieu, de possession ou de cas.

Lors de l’apprentissage d’un verbe, n’apprenez pas seulement la forme du dictionnaire. Apprenez-le avec les terminaisons courantes de temps, de politesse ou de personne.

En lecture, entraînez-vous à identifier d’abord la racine. Puis observez les suffixes. Demandez-vous ce que chaque partie apporte.

Avec le temps, cela construit une habitude mentale puissante :

Les mots longs cessent de ressembler à des monstres. Ils deviennent des messages structurés.

La vraie leçon

Les langues agglutinantes montrent pourquoi la taille du vocabulaire, à elle seule, peut être trompeuse.

Un mot long n’est pas forcément un mot nouveau. Il peut s’agir d’une racine familière accompagnée de plusieurs terminaisons familières. Comprendre la structure permet de décoder bien plus que ce qu’un simple nombre brut de mots laisse penser.

Cela ne signifie pas que ces langues sont faciles. L’harmonie vocalique du turc, les chaînes de suffixes du hongrois, les formes de cas du finnois et les terminaisons de politesse du coréen demandent toutes de la pratique. Mais elles ne sont pas aléatoires.

Ce sont des systèmes.

Pour l’apprentissage, l’objectif n’est pas seulement de collectionner des mots. L’objectif est de reconnaître comment les mots sont construits.

Dans les langues agglutinantes, l’apprentissage du vocabulaire devient beaucoup plus solide lorsque la structure interne est visible :

racine, suffixe, sens, grammaire et contexte fonctionnant ensemble.

Si vous apprenez le turc, le hongrois, le finnois ou le coréen, ne vous laissez donc pas décourager par les mots longs.

Cherchez la racine.
Cherchez les terminaisons.
Cherchez le schéma.
Puis retrouvez la même structure encore et encore dans de vraies phrases.

C’est ainsi que les mots longs deviennent une langue compréhensible.

Dans le dernier article de cette série, nous rassemblerons tous les éléments et poserons une question pratique : comment les personnes qui apprennent une langue devraient-elles réellement compter le vocabulaire selon les langues ?