Globaprom.

Qu'est-ce qu'Unicode ? La norme universelle de codage, expliquée

Unicode est la norme universelle qui attribue à chaque caractère de chaque système d'écriture son propre numéro, pour que le texte reste intact quand il passe d'un système, d'une langue ou d'un appareil à un autre. C'est grâce à elle qu'un nom comme Nguyễn ou Müller survit à un passage en base de données.

Avant Unicode, chaque famille de langues avait son propre codage incompatible, et un texte enregistré dans l'un devenait souvent illisible ouvert dans un autre. Unicode a remplacé cela par une carte unique : un numéro par caractère, de l'alphabet latin à l'arabe, au chinois et aux emoji. Le Consortium Unicode la maintient, et la version 17.0, publiée en 2025, couvre 159 801 caractères répartis sur 172 systèmes d'écriture.

En pratique, les développeurs pensent rarement à Unicode jusqu'à ce que quelque chose casse. Stocker le texte en UTF-8 (le codage Unicode le plus répandu) de bout en bout, du champ de formulaire à la base de données puis au fichier d'export, empêche les noms accentués, les écritures non latines et les symboles monétaires de se transformer en points d'interrogation. Une boutique qui vend dans toute l'Europe gère le ß allemand, le é français et le ł polonais dans le même formulaire de commande sans y penser. Se tromper à un seul endroit, et l'erreur ressurgit bien plus loin : sur une étiquette d'expédition, une facture, ou une recherche qui ne retrouve plus la fiche.

Bien gérer cela fait partie de l'i18n : un produit qui suppose du texte anglais simple ne survivra pas à son premier client nommé José.

Pourquoi c'est important pour le logiciel sur mesure

Chaque produit que nous construisons est prêt pour le multilingue, et la prise en charge d'Unicode en est le socle. Nous traitons le texte en UTF-8 de la base de données à l'interface, si bien que le logiciel est prêt pour n'importe quelle langue, y compris les écritures de droite à gauche, avant même la première commande de traduction.