La norme Unicode a apporté l'ordre au chaos. Sa définition couvre plus de 140 000 caractères, répartis à l'origine dans de nombreux jeux incompatibles qui se trouvent désormais à un clic de distance, ou au pire, à un code. Cela signifie qu'Unicode est une source presque inépuisable de symboles étranges et de représentations mystérieuses. L'exemple le plus récent qui tient la Toile en haleine est ⍼, code U+237C, « Angle droit avec flèche en zigzag vers le bas », ou simplement « angzarr ». L'étudiant Jonathan Chan de l'Université de Colombie-Britannique a décidé de se jeter dans le puits de ses origines, et pour être honnête, je ne crois pas qu'il ait réussi à en sortir…
Unicode et STIX
L'aventure ne commence pas très bien : la section 22.7 sur les symboles techniques de la norme Unicode, dans la catégorie Technique divers ne fait même pas une mention de base du symbole. Les recherches de Jonathan l'ont mené à la Proposition pour coder des symboles mathématiques supplémentaires du 14 mars 2000, où l'on peut apercevoir « angzarr » en pleine solitude, et avec un certain air de mystère…
Cependant, ce n'était pas son point de départ. Les racines de la proposition remontent aux débuts du projet STIX, qui visait à introduire des symboles supplémentaires dans Unicode pour les publications techniques et mathématiques. C'est là que Jonathan a découvert le travail de Barbara Beeton, qui a rassemblé et combiné certaines des premières tables de caractères en juin 1997. En étudiant ces tables, notre ami « angzarr » réapparaît comme D97C, avec une association au rapport technique ISO TR9573. Un tableau ultérieur confirme que « angzarr » fait partie de ce rapport, et lui attribue même un code Unicode temporaire, E248
Archéologie ISO
La version originale de TR9573 (malheureusement derrière un paywall, comme beaucoup de documents ISO) remonte à juillet 1991. Là, « angzarr » est défini comme D97C/55676. Ses éditions ultérieures identifient déjà le symbole comme U+237C, mais Jonathan suggère que cela s'est produit après son entrée formelle dans Unicode
Et il y a encore plus ! La section 13 de TR9573 (où se trouve « angzarr ») sert de remplacement à l'annexe D de l'ISO 8879:1986. Cependant, en analysant ce document, Jonathan a découvert que « angzarr » brille par son absence
En revenant à TR9573, sa section 5 indique que les symboles contiennent « un identifiant de glyphe, enregistré conformément à l'ISO/CEI 10036 ». Heureusement, le registre 10036 est en ligne, et si nous y cherchons 55676…
Un symbole pour 5 dollars
Le plus intéressant est que 10036 décrit les glyphes comme « hérités » de l'AFII. Qu'était-ce que l'AFII ? L'Association for Font Information Interchange, autorité d'enregistrement pour l'ISO 10036. Sous l'AFII, n'importe qui pouvait enregistrer un symbole pour une somme modique (entre 5 et 50 dollars de l'époque), mais l'industrie n'a pas tardé à favoriser l'ISO 10646 (le Universal Coded Character Set) et Unicode. Le Registre international des glyphes de l'AFII devrait avoir plus de précisions sur « angzarr ». Malheureusement, ce document semble perdu.
Un Barbara sauvage apparaît…
Les recherches de Jonathan concluent (pour l'instant) avec une participation de Barbara Beeton elle-même sur Stack Exchange, qui a confirmé que TR9573 précède effectivement l'AFII et le projet STIX, mais n'a rien ajouté de plus sur l'origine ou l'utilisation de « angzarr ». Alors… tout ce que nous avons, c'est un symbole mystérieux avec une description générique, hérité d'une documentation qui remonte au début des années 90, et qui s'est manifesté à un moment donné dans la seconde moitié des années 80. Avez-vous une meilleure idée ? Laissez un commentaire !
Sources : Jonathan Chang, Hackaday, Stack Exchange