Toen Top-Typster Katrien Vandenbulcke in maart van dit jaar als eerste deelneemster de Roemeense tekst overtypte voor de Intersteno-internetwedstrijd 2021, kreeg ze te maken met een vervelend probleem, waardoor haar – volkomen ten onrechte – tientallen extra fouten werden aangerekend.
Het probleem zat bij twee van de accentletters die in het Roemeens worden gebruikt. In mijn eerdere artikel over accenten en vreemde letters gaf ik een overzicht van de accentletters die je bij het overtypen van Roemeense teksten kunt tegenkomen.
De twee letters waarover het gaat, zijn de s-komma en de t-komma (ș, ț), met Unicode-waarden U+0219 en U+021B voor de kleine letters en U+0218 en U+021A voor de hoofdletters. Je treft die letters aan op een modern Roemeens toetsenbord. Maar in heel wat Roemeense teksten zul je twee andere tekens aantreffen, die er heel erg op lijken: de s-cedille en de t-cedille (ş, ţ), met Unicode-waarden U+015F en U+0163 voor de kleine letters en U+015E en U+0162 voor de hoofdletters. Die letters vind je enkel nog op de oudere Roemeense toetsenborden.
Hoewel je in het Roemeens officieel de s en de t met komma moet gebruiken, wordt nog heel vaak de s en t met cedille gebruikt. Dat komt doordat de s en t met komma pas laat opgenomen werden in de Unicode-standaard. Dat gebeurde pas in 1999 (Unicode 3.0), op verzoek van de Roemeense organisatie voor normalisering. Vóór die tijd waren wel de s en t met cedille al deel van Unicode, en op Roemeense schrijfmachine- en computertoetsenborden vond je de letters met cedille.
In Windows 10 kun je kiezen tussen de nieuwe Roemeense toetsenbordlay-out (een qwerty-toetsenbordindeling), die de correcte tekens ș en ț met komma produceert, en de verouderde Roemeense toetsenbordlay-out (een qwertz-indeling), die de tekens ş en ţ met cedille produceert.
Gevolg: in Roemeense teksten zul je de ene keer de letters met komma aantreffen, de andere keer de letters met cedille. De meeste mensen (zelfs de Roemenen) zijn er zich niet van bewust dat dit verschillende tekens zijn, elk met hun eigen plaatsje in de Unicode-standaard.
Welke tekens moet je nu gebruiken bij de internetwedstrijd? Als je even oefent met de trainingsteksten, dan merk je dat daar de s en t met cedille gebruikt worden. Je verwacht dus hetzelfde op de wedstrijd. En daar ging het dit jaar weer verkeerd, zoals Katrien mocht ondervinden, die zich als eerste aan het Roemeens waagde. Katrien had enkele keren geoefend op Roemeens, en had daarbij dezelfde toetsenbordindeling gebruikt die ze ook vorig jaar hanteerde. Alles ging goed... tot Katrien aan de wedstrijd begon. De wedstrijdtekst bleek niet de ş en ţ met cedille, maar de ș en ț met komma te bevatten. Het verschil is moeilijk te zien (tenzij je de letters uitvergroot). Katrien was zich van geen kwaad bewust en typte de Roemeense tekst keurig over. Groot was natuurlijk haar verwondering en teleurstelling toen aan het einde van de test de evaluatie op het scherm verscheen: 61 fouten! Overal waar Katrien een ş of een ţ had getypt, had het programma een fout aangerekend!
Jammer dat de organisatoren zich blijkbaar niet bewust waren van dit probleem, of dat ze er zo weinig aandacht aan schonken, want exact hetzelfde probleem had zich in het verleden nog al eens voorgedaan. Uiteindelijk kwam het allemaal in orde en werd het probleem opgelost – Katrien bleek gelukkig tóch geslaagd –, maar het ware natuurlijk beter als men deze verwarring had vermeden.
Onderstaande afbeelding laat de huidige, moderne Roemeense toetsenbordlay-out zien, een qwerty-indeling die de s en t met komma produceert.
In het verleden werd in Roemenië een andere toetsenbordindeling gebruikt, namelijk onderstaande qwertz-lay-out, die de s en t met cedille produceert.
Ik kon de ellende niet langer aanzien en heb de programmeur van de Taki-software, de Italiaan Marco Olivio, gecontacteerd met een suggestie voor een mogelijke oplossing. Hij heeft beloofd de oplossing tegen volgende keer te implementeren, en ondertussen is dat ook gebeurd, zo heeft hij mij laten weten. Het is de bedoeling dat voortaan in het Roemeens zowel de ș en ț met komma als de ş en ţ met cedille correct gerekend worden, ongeacht wat in de opgave staat en ongeacht wat de deelnemer heeft getypt. En zo hoort het ook volgens een aanbeveling in de Unicode Standard Core Specification, een document dat de algemene principes van de Unicode-standaard beschrijft en richtlijnen bevat voor software-implementaties.
Normaal gezien moet het probleem met het Roemeens voortaan dus verleden tijd zijn. Wie het wil, kan het zelf even uitproberen in de Taki-trainingsmodule. Test het even uit met verschillende toetsenbordindelingen: gebruik de ene keer de s/t-komma en de andere keer de s/t-cedille. Ongeacht welke tekens je typt, dit zou vanaf nu geen aanleiding meer mogen geven tot onterecht aangerekende fouten.
www.intersteno.org/intersteno-internet-contests/training-with-taki-version
www.unicode.org/versions/Unicode13.0.0/UnicodeStandard-13.0.pdf






