2 caractères tirés de scripts du monde entier. Chaque actualisation est une constellation différente.
Unicode attribue un numéro unique à chaque caractère de chaque système d'écriture que l'humanité a enregistré. La version 15.1 du standard couvre 149 813 caractères issus de 161 scripts, allant de l'alphabet latin qui compose cette phrase aux hiéroglyphes égyptiens gravés sur les murs des temples il y a quatre mille ans. Chaque caractère occupe une position fixe appelée point de code, écrite sous la forme U+ suivi de quatre à six chiffres hexadécimaux. U+0041 est la lettre majuscule A. U+4E16 est le caractère chinois signifiant « monde ». U+16A0 est la rune Fehu de l'ancien Futhark. Chaque génération sur cette page sélectionne un point de code au hasard, pondéré de manière égale entre les familles de scripts afin que vous découvriez toute la diversité de l'écriture humaine.
Avant Unicode, chaque région utilisait son propre encodage de caractères. Les ordinateurs japonais fonctionnaient avec Shift_JIS. Les systèmes russes utilisaient KOI8-R. Les machines d'Europe occidentale supposaient ISO 8859-1. Un document créé sur un système s'affichait comme un charabia incompréhensible sur un autre. En 1987, Joe Becker et Lee Collins chez Xerox, aux côtés de Mark Davis chez Apple, ont commencé à élaborer un encodage universel unique. Leur principe de conception : un numéro par caractère, quelle que soit la plateforme, le programme ou la langue. Le Consortium Unicode a publié la version 1.0 en 1991 avec 7 129 caractères. Trois décennies plus tard, le standard a été multiplié par vingt et continue de s'étendre à chaque publication annuelle.
Unicode organise ses 1 114 112 points de code possibles en 17 plans de 65 536 positions chacun. Le plan 0, le Plan Multilingue de Base, contient les caractères utilisés dans l'écriture contemporaine : latin, grec, cyrillique, arabe, idéogrammes CJC et hangul. Le plan 1 contient les scripts historiques, la notation musicale, les alphanumériques mathématiques et les symboles de cartes à jouer. Au sein de chaque plan, les caractères se regroupent en blocs nommés : « Grec et copte » (U+0370 à U+03FF), « Tibétain » (U+0F00 à U+0FFF), « Dessin de cadres » (U+2500 à U+257F). Cette page identifie le bloc de chaque caractère généré, transformant chaque découverte en une petite leçon de géographie du paysage Unicode.
Le bloc des idéogrammes unifiés CJC (U+4E00 à U+9FFF) contient 20 992 caractères, ce qui en fait le plus grand bloc contigu de tout Unicode. Ces caractères servent simultanément le chinois, les kanji japonais, les hanja coréens et le chữ Nôm vietnamien. Le processus d'unification, fusionnant les caractères équivalents des standards nationaux en des points de code uniques, a été l'un des défis diplomatiques et techniques les plus complexes de l'histoire de l'encodage des caractères. Un seul idéogramme CJC généré par cet outil peut être lisible par des lecteurs de quatre traditions linguistiques différentes.
Cet outil transforme Unicode d'un concept informatique abstrait en une expérience tangible et visuelle. Demandez à chaque élève de visiter /unicode/5 et de générer cinq caractères. Demandez-leur d'identifier le script auquel appartient chaque caractère en utilisant l'étiquette de bloc fournie. Les élèves rencontreront des systèmes d'écriture qu'ils n'ont jamais vus : éthiopien, géorgien, tibétain, cherokee. Chaque caractère devient un point de départ pour une recherche sur la culture et l'histoire derrière ce script.
Pour un lien avec les mathématiques, discutez de la combinatoire d'Unicode lui-même. Combien de points de code à quatre chiffres hexadécimaux sont possibles ? (65 536, la taille d'un plan.) Pourquoi la plupart des caractères tiennent-ils dans quatre chiffres hexadécimaux ? Le Plan Multilingue de Base a été conçu pour contenir toute l'écriture contemporaine. Combien de plans faudrait-il si chaque être humain ayant jamais vécu avait son propre caractère personnel ? Ces questions relient l'encodage de caractères au dénombrement exponentiel et à la théorie de l'information. L'outil ne nécessite aucun compte, ne collecte aucune donnée d'élève et ne dépose aucun cookie.
Chaque sélection de caractère se déroule dans votre navigateur. Le serveur délivre cette page. Le générateur de nombres aléatoires cryptographiques de votre appareil choisit le point de code. Aucune donnée de sélection n'est jamais transmise, enregistrée ou stockée sur un quelconque serveur. Votre historique de découvertes réside dans le localStorage de votre appareil, sous votre contrôle direct.
Chaque clic révèle un caractère différent. Défiez quelqu'un d'explorer le sien.
Inspiration quotidienne
Œuvres sélectionnées par le jury du A' Design Award, présentées chaque matin.