Les pièges, langue par langue
Hindi हिन्दी
Le hindi s'écrit en devanagari : une écriture où une voyelle peut s'afficher à gauche de la consonne qu'elle suit en mémoire, où deux consonnes peuvent fusionner en un seul bloc, et où compter les points de code Unicode d'un mot ne dit jamais combien de signes un lecteur y voit réellement.
Les faits de base| Étiquette de langue | hi |
|---|
| Écriture | Deva |
|---|
| Sens | de gauche à droite |
|---|
| Catégories de pluriel | one, other |
|---|
L'écriture
Un point de code Unicode n'est pas un signe affiché
Le devanagari combine consonnes, signes voyelliques (matras) et signe d'annulation de voyelle (virama) en blocs visuels uniques ; un signe voyellique comme ि peut même s'afficher à gauche de la consonne qu'il suit logiquement en mémoire. Le nombre de points de code Unicode d'un mot est donc presque toujours supérieur au nombre de signes qu'un lecteur perçoit. « हिन्दी » (le nom de la langue) compte 6 points de code (ह, ि, न, ्, द, ी) pour 3 blocs visibles. Une troncature naïve à 5 caractères ne donne pas un mot coupé : elle donne « हिन्द », un autre mot réel (l'Inde, comme dans जय हिन्द). Une interface qui doit raccourcir une chaîne doit couper par groupe graphémique (grapheme cluster), jamais par un nombre fixe de points de code.
Source : The Unicode Standard, version 16.0.0, chapitre 12 (Asie du Sud et centrale : le devanagari), vérifiée le 2026-08-19
Le virama fusionne deux consonnes en un seul bloc
Le signe virama (्, U+094D) supprime la voyelle inhérente d'une consonne et la fusionne avec la consonne suivante en un bloc conjoint qui peut ne ressembler à aucune des deux lettres d'origine (क + ् + ष donne le bloc क्ष). Un traitement de texte qui manipule les consonnes une par une, sans traiter ce bloc comme une unité, peut casser le mot : si le virama disparaît ou est mal encodé, la suite de sons se sépare en deux consonnes pleines et cesse d'être le mot d'origine.
Source : The Unicode Standard, version 16.0.0, chapitre 12 (Asie du Sud et centrale : le devanagari), vérifiée le 2026-08-19
Une même lettre, deux suites d'octets possibles
Certaines lettres devanagari existent à la fois sous une forme précomposée (un seul point de code) et sous une forme décomposée (une lettre de base suivie d'un signe combinant), les deux s'affichant à l'identique. C'est le cas des lettres à nukta comme क़ (U+0958), canoniquement équivalente à la séquence क + ़ (U+0915 + U+093C). Pire : Unicode traite ce cas comme une « exclusion de composition » propre à certaines écritures indiennes, ce qui veut dire que la normalisation NFC ne recompose pas automatiquement la séquence décomposée en la lettre unique. Deux chaînes visuellement identiques peuvent donc rester différentes octet pour octet même après une normalisation NFC standard : une comparaison de chaînes (recherche, détection de doublon, mémoire de traduction) doit en tenir compte, au besoin en normalisant aussi en NFD avant de comparer.
Source : Unicode Standard Annex #15 : Unicode Normalization Forms, vérifiée le 2026-08-19
Le nukta note des sons empruntés, pas natifs du sanskrit
Le nukta (un point souscrit) étend l'alphabet devanagari pour noter des sons absents du sanskrit : des sons d'origine perso-arabe présents en ourdou, et certains sons anglais dans les emprunts récents. Le guide de style hindi de Microsoft le rappelle explicitement pour des mots empruntés comme photo, fichier ou résolution. Beaucoup d'utilisateurs l'omettent en frappant au clavier parce qu'il demande une touche en plus ; l'orthographe correcte le conserve.
Source : Microsoft Localization Style Guide : Hindi, vérifiée le 2026-08-19
Chandrabindu contre anusvara
La nasalisation d'une voyelle s'écrit avec le chandrabindu (ँ) quand la voyelle n'a pas de hampe haute, mais beaucoup de polices et de méthodes de saisie le remplacent par le simple anusvara (ं), plus facile à positionner au-dessus d'un signe voyellique haut. Le guide de style hindi de Microsoft demande explicitement d'utiliser le chandrabindu là où il est correct plutôt que cette substitution.
Source : Microsoft Localization Style Guide : Hindi, vérifiée le 2026-08-19
Le devanagari n'a pas de majuscules
Le devanagari est un alphabet unicaméral : contrairement au latin, il n'existe aucune paire majuscule/minuscule. Une feuille de style qui applique un « text-transform: uppercase » ou une convention de titre tout en capitales à du texte hindi ne produit aucun des effets attendus : le hindi ne peut ni crier ni s'atténuer par la casse, et il ne faut jamais compter sur elle pour hiérarchiser visuellement un titre ou un bouton.
Source : Devanagari (article encyclopédique), vérifiée le 2026-08-19
La ponctuation
Danda traditionnel, point latin dans le logiciel
Le devanagari a son propre signe de fin de phrase, le danda (।), et son doublé, le double danda (॥), qui marque traditionnellement la fin d'un vers. Les deux existent toujours et restent la norme en littérature, en poésie et en contexte religieux. Mais dans l'écrit courant, le Standard Unicode le constate lui-même : la virgule et le point empruntés au latin sont désormais librement employés en hindi, le danda étant restreint aux textes plus traditionnels. Les guides de localisation professionnels (celui de Microsoft, entre autres) demandent explicitement le point latin en fin de phrase d'interface. Pour une interface ou une brochure associative, le point correspond à l'usage réel ; le danda reste juste, mais dans un registre différent, pas dans un logiciel.
Justeपासवर्ड सही नहीं है.
À éviterपासवर्ड सही नहीं है।
Source : The Unicode Standard, version 16.0.0, chapitre 12 (Asie du Sud et centrale : le devanagari), vérifiée le 2026-08-19
La virgule est la même qu'en écriture latine ; le danda ne la remplace pas
Le devanagari n'encode pas de virgule qui lui soit propre : le hindi emploie la même virgule que l'écriture latine, même forme et même fonction, même forme, même fonction. Le danda reste un signe de fin de PHRASE, pas un séparateur d'éléments à l'intérieur d'une phrase ; l'utiliser à la place d'une virgule mélange deux rôles différents.
Justeकृपया नाम, ईमेल और संदेश भरें.
À éviterकृपया नाम। ईमेल और संदेश भरें.
Source : The Unicode Standard, version 16.0.0, chapitre 12 (Asie du Sud et centrale : le devanagari), vérifiée le 2026-08-19
Le point se place après le guillemet fermant
À l'inverse d'une habitude venue de l'anglais américain, le guide de style hindi de Microsoft est explicite : le point de fin de phrase se place après le guillemet fermant, jamais avant.
Justeइस सुविधा के बारे में अधिक जानने के लिए, ‘यहाँ क्लिक करें’.
À éviterइस सुविधा के बारे में अधिक जानने के लिए, ‘यहाँ क्लिक करें.’
Source : Microsoft Localization Style Guide : Hindi, vérifiée le 2026-08-19
Le signe pourcentage colle au chiffre
Contrairement à l'espace insécable qui précède souvent le signe pourcentage en français, le hindi ne met aucune espace entre le nombre et le signe %.
Source : Microsoft Localization Style Guide : Hindi, vérifiée le 2026-08-19
Pas d'espace à l'intérieur des parenthèses
Le hindi ne place aucune espace entre une parenthèse et le texte qu'elle contient, ni après la parenthèse ouvrante ni avant la parenthèse fermante.
Source : Microsoft Localization Style Guide : Hindi, vérifiée le 2026-08-19
Éviter le tiret cadratin, préférer la virgule
Le guide de style hindi de Microsoft déconseille explicitement l'usage étendu du tiret cadratin hérité de l'anglais : ce n'est pas un usage correct en hindi. Il recommande de reformuler la phrase avec une virgule, ou de la couper en deux phrases, plutôt que de recopier la ponctuation de la langue source.
Justeचाहे आप PC हों या Mac, Skype आपको हमेशा जोड़े रखता है.
À éviterचाहे आप PC हों या Mac—Skype आपको हमेशा जोड़े रखता है.
Source : Microsoft Localization Style Guide : Hindi, vérifiée le 2026-08-19
Traduire une interface
Ne jamais tronquer par nombre de caractères
Si un libellé doit être raccourci pour tenir dans un bouton, il faut couper au dernier groupe graphémique complet, ou au dernier mot entier, jamais à un nombre fixe de points de code : une matra ou un bloc conjoint coupé au milieu ne se contente pas d'être mal formé, il peut devenir un signe orphelin ou un mot différent.
Source : The Unicode Standard, version 16.0.0, chapitre 12 (Asie du Sud et centrale : le devanagari), vérifiée le 2026-08-19
Le verbe porte le genre : que faire sans connaître celui du lecteur
Les verbes hindi s'accordent en genre avec leur sujet, y compris à la deuxième personne. Une phrase d'interface écrite pour « l'utilisateur » sans savoir s'il s'agit d'un homme ou d'une femme oblige en principe à choisir une forme masculine ou féminine. Le contournement réellement recommandé, y compris par Microsoft pour ses propres produits en hindi, est de reformuler au pluriel générique : utiliser le nom de rôle au pluriel (उपयोगकर्ता... सकते हैं) plutôt qu'un pronom démonstratif genré suivi d'un verbe collé masculin/féminin par une barre. Si la reformulation est impossible, le guide autorise explicitement le pronom pluriel वे/उनका/उनकी/उन्हें pour désigner une seule personne de genre inconnu.
Justeउचित अधिकार प्राप्त उपयोगकर्ता अन्य उपयोगकर्ताओं के पासवर्ड सेट कर सकते हैं.
À éviterयदि उपयोगकर्ता के पास उचित अधिकार हैं, तो वह अन्य उपयोगकर्ताओं के पासवर्ड सेट कर सकता/सकती है.
Source : Microsoft Localization Style Guide : Hindi, vérifiée le 2026-08-19
आप partout, jamais तू ni तुम
Une interface s'adresse à quelqu'un dont on ne connaît ni l'âge ni le rang : आप est le seul registre qui reste correct dans tous les cas, y compris avec un inconnu ou un supérieur. Il commande en outre un accord verbal au pluriel, jamais les formes singulières de तू.
Justeक्या आप जारी रखना चाहेंगे?
À éviterक्या तू जारी रखना चाहेगा?
Source : Hindi-Urdu grammar (article encyclopédique), vérifiée le 2026-08-19
Un emprunt anglais installé se garde ; un néologisme savant peut perdre le lecteur
Les mots techniques anglais entrés dans l'usage courant (कंप्यूटर, पासवर्ड, फ़ाइल, ईमेल) se gardent tels quels : les remplacer par un néologisme sanskrit fabriqué a déjà été tenté à grande échelle et a rarement supplanté l'usage réel. Le cas le plus documenté est दूरभाष (« parole lointaine ») pour téléphone : le mot existe, est grammaticalement irréprochable, et pourtant la plupart des locuteurs disent फ़ोन. Une traduction trop puriste ne devient pas plus élégante, elle devient étrangère à l'usage courant : les mots existent et sont corrects, mais ce ne sont pas ceux que le lecteur emploie pour le lecteur visé.
Justeअपना फ़ोन नंबर डालें
À éviterअपना दूरभाष नंबर डालें
Source : Standard Hindi (article encyclopédique), vérifiée le 2026-08-19
Grouper par lakh et par crore, pas par milliers
Un montant affiché dans une interface doit suivre le motif de groupement indien (première virgule après 3 chiffres depuis la droite, puis toutes les 2 chiffres), pas le groupement international par tranches de 3. Le même nombre s'écrit différemment selon le système, et un montant groupé à l'occidentale devant un lecteur habitué au lakh et au crore se relit avant de se comprendre.
Source : CLDR JSON : données de nombres, de dates et de semaine pour hi et IN, vérifiée le 2026-08-19
Le devanagari a besoin de plus d'interligne que le latin
Les signes voyelliques du devanagari s'empilent au-dessus et au-dessous de la ligne de base, et les blocs de consonnes conjointes forment des empilements plus hauts et plus profonds qu'une lettre latine courante. Un interligne calé sur du texte latin serré coupe visuellement le haut des signes hauts et le bas des signes bas d'une ligne à l'autre. Les exigences de mise en page publiées par le W3C pour le devanagari signalent explicitement la hauteur de ligne comme un point d'attention propre à cette écriture, distinct du latin.
Justeपूर्ण जानकारी नीचे दी गई है.
Source : Devanagari Layout Requirements (W3C Group Draft Note), vérifiée le 2026-08-19
Un message système parle à la voix passive, pas à la première personne
Faire dire « je » à l'ordinateur (« je n'ai pas trouvé le fichier ») sonne faux en hindi et n'est pas la convention retenue par les guides de style de localisation : un message d'erreur ou de statut se tourne à la voix passive ou impersonnelle, quel que soit le tour employé dans la langue source. Cela évite aussi d'avoir à choisir arbitrairement un genre pour un sujet qui n'existe pas vraiment, le programme.
Justeफ़ाइल हटाई नहीं जा सकी.
À éviterमैंने फ़ाइल नहीं हटाई.
Source : Microsoft Localization Style Guide : Hindi, vérifiée le 2026-08-19
Les pluriels
Le cardinal hindi ne connaît que deux catégories. La surprise pour un francophone : la catégorie « one » ne couvre pas seulement 1, elle couvre aussi 0. Un gabarit du type « {n} livres » qui ne prévoit qu'un singulier pour 1 et un pluriel pour tout le reste, y compris 0, accorde donc mal la phrase pour zéro élément.
Les catégories de pluriel et un exemple de chacune| Catégorie | Nombre | Exemple |
|---|
| one | 0 | 0 किताब |
|---|
| one | 1 | 1 किताब |
|---|
| other | 2 | 2 किताबें |
|---|
Les nombres et les dates
Les nombres| Chiffres employés | Les chiffres latins (0-9) par défaut, y compris dans une interface entièrement en hindi : le CLDR d'Unicode déclare « latn » comme système numérique par défaut de la locale hi. Les chiffres devanagari (०-९) existent, restent lus et compris, mais ne s'affichent qu'en système « natif » explicitement demandé : typographie soignée, contexte religieux, ou sanskrit. |
|---|
| Séparateur de milliers | virgule, mais un groupement irrégulier : motif CLDR #,##,##0, la première virgule après 3 chiffres depuis la droite, puis toutes les 2 chiffres ensuite (tranches du lakh et du crore) |
|---|
| Séparateur décimal | point |
|---|
| Pourcentage | collé au chiffre, sans espace : 50% |
|---|
| À savoir | Un montant se lit en lakh (1,00,000 = cent mille) et en crore (1,00,00,000 = dix millions), pas en million. Un même nombre s'écrit 1,23,45,678 en groupement indien (motif CLDR) contre 12,345,678 en groupement international : un outil qui applique le groupement occidental affiche un nombre qu'un lecteur hindiphone doit recompter avant de le comprendre. |
|---|
Les dates| Format court | d/M/yy, par ex. 19/8/26 |
|---|
| Format long | d MMMM y, mois en toutes lettres en devanagari, par ex. 19 अगस्त 2026 |
|---|
| Premier jour de la semaine | dimanche |
|---|
| À savoir | Le format court hindi place le jour avant le mois comme en français, mais avec une année sur 2 chiffres et une barre oblique (19/8/26), pas de tiret ni d'année sur 4 chiffres : ne pas calquer l'ordre mois-jour-année américain, et ne pas supposer une année sur 4 chiffres dans un format court. |
|---|
Les registres
राजभाषा हिन्दी : le hindi très sanskritisé de l'administration
Actes officiels, discours institutionnels, une partie des journaux télévisés et de la presse écrite formelle.
दूरभाष / दूरदर्शन
C'est le choix le plus lourd de conséquence pour un site associatif grand public. Ce registre a été construit en remplaçant systématiquement des emprunts persans, arabes ou anglais par des mots forgés sur des racines sanskrites : दूरभाष (« parole lointaine ») pour téléphone, दूरदर्शन (« vision lointaine ») pour télévision. Ces mots existent, sont corrects, et sont pourtant peu employés dans la vie réelle, où l'on dit फ़ोन et टीवी. Un site qui écrit systématiquement dans ce registre se lit comme un texte de ministère, pas comme une association qui s'adresse au public.
हिन्दुस्तानी / बोलचाल की हिन्दी : le hindi courant, proche de l'ourdou parlé
Conversation quotidienne, cinéma populaire, chansons, presse orale : la plupart des échanges de tous les jours, y compris chez des locuteurs qui écrivent par ailleurs en devanagari.
फ़ोन, टीवी, माफ़ करें
C'est le registre que la majorité des lecteurs comprend le plus vite et reconnaît comme naturel. Pour une association qui s'adresse au grand public, s'en rapprocher (sans tomber dans l'argot) touche davantage de monde qu'un hindi savant.
तू (tū) : à ne jamais utiliser dans une interface
Intimité familiale très proche, très jeunes enfants, une divinité en prière, ou une insulte délibérée envers un inconnu. Grammaticalement singulier.
तू कहाँ जा रहा है?
Employer तू envers une personne dont on ne connaît pas la relation se perçoit comme trop familier, parfois agressif ou méprisant. Un texte d'interface qui l'emploierait choquerait plutôt qu'il ne mettrait à l'aise.
तुम (tum) : familier, entre proches ou pairs
Amis proches, membres de la famille du même âge ou plus jeunes, enfants. Grammaticalement pluriel même pour une seule personne.
तुम कैसे हो?
C'est le registre du proche, pas celui d'un inconnu qui visite un site. L'employer envers un visiteur non identifié sonne présomptueux.
आप (āp) : le seul choix correct pour une interface
Toute personne dont on ne connaît pas le degré de familiarité : un inconnu, un supérieur, un aîné, et par défaut tout visiteur d'un site ou d'une application. Grammaticalement pluriel, jamais réellement impoli.
क्या आप जारी रखना चाहेंगे?
Dans un guide de localisation appliqué à des produits réels, la quasi-totalité des chaînes d'interface adressées à l'utilisateur emploient आप : c'est le seul choix qui reste correct sans savoir qui lit l'écran.
Les faux amis
Ce qu'on croit dire, et ce qu'on dit| En français | Le piège | Ce qui est juste | Pourquoi |
|---|
| formation (un stage de formation professionnelle) | गठन | प्रशिक्षण | गठन désigne la structure, la construction, le fait de former ou de constituer quelque chose (on l'emploie par exemple pour la formation d'un gouvernement), pas un stage qui enseigne une compétence. Le mot correct pour une formation-stage est प्रशिक्षण. |
|---|
| compte (un compte utilisateur) | गणना | खाता | गणना veut dire le comptage, l'action de compter des nombres. Un compte au sens d'un compte utilisateur, bancaire ou de connexion se dit खाता. |
|---|
| membre / adhérent (d'une association) | अनुयायी | सदस्य | अनुयायी veut dire disciple, adepte, celui qui suit une personne ou une doctrine : un sens dévotionnel ou idéologique. Le mot neutre pour un membre d'une association est सदस्य. |
|---|
| subvention (une aide publique ou institutionnelle) | दान | अनुदान | दान désigne le don, l'aumône, l'offrande : un geste personnel ou religieux. Une subvention institutionnelle, versée par une administration ou un bailleur de fonds, se dit अनुदान. |
|---|
| conférence (un exposé, une intervention) | सम्मेलन | व्याख्यान | सम्मेलन désigne un congrès, un grand rassemblement, une assemblée, pas un exposé unique. Une conférence au sens d'un exposé ou d'une intervention se dit व्याख्यान. |
|---|
| cotisation (la cotisation d'un membre) | चंदा | सदस्यता शुल्क | चंदा évoque une collecte ponctuelle ou volontaire, parfois même un euphémisme pour une contribution imposée de façon informelle. La cotisation régulière d'un membre d'association se dit plutôt सदस्यता शुल्क (littéralement « frais d'adhésion ») ; शुल्क seul désigne un droit, un tarif, une redevance. |
|---|
Les sources
- CLDR Language Plural Rules (version 48), Unicode, Inc. (Unicode CLDR), Unicode-3.0, vérifiée le 2026-08-19
- CLDR JSON : données de nombres, de dates et de semaine pour hi et IN, Unicode, Inc. (distribution JSON officielle du CLDR), Unicode-3.0, vérifiée le 2026-08-19
- Unicode Standard Annex #15 : Unicode Normalization Forms, Unicode, Inc., Unicode-3.0, vérifiée le 2026-08-19
- The Unicode Standard, version 16.0.0, chapitre 12 (Asie du Sud et centrale : le devanagari), Unicode, Inc., Unicode-3.0, vérifiée le 2026-08-19
- Devanagari Layout Requirements (W3C Group Draft Note), W3C Internationalization Working Group (éd. Richard Ishida), W3C Document License, vérifiée le 2026-08-19
- Microsoft Localization Style Guide : Hindi, Microsoft Corporation, Contenu Microsoft consulté publiquement, tous droits réservés à l'éditeur, vérifiée le 2026-08-19
- The Oxford Hindi-English Dictionary (R. S. McGregor), via Digital Dictionaries of South Asia, R. S. McGregor, Oxford University Press ; hébergé par The University of Chicago, Digital Dictionaries of South Asia, consultation académique en ligne, vérifiée le 2026-08-19
- Standard Hindi (article encyclopédique), contributeurs de Wikipédia, édition anglaise, CC-BY-SA-4.0, vérifiée le 2026-08-19
- Hindi-Urdu grammar (article encyclopédique), contributeurs de Wikipédia, édition anglaise, CC-BY-SA-4.0, vérifiée le 2026-08-19
- Devanagari (article encyclopédique), contributeurs de Wikipédia, édition anglaise, CC-BY-SA-4.0, vérifiée le 2026-08-19