Întâlnirea de la sediul IBR

Raport de activitate pentru ziua din data de 25 noiembrie 2003

Scopul întâlnirii: discuție cu privire la revizuirea și promovarea standardului de tastatură românească. Aceasta este a doua întâlnire pe această temă.


Persoanele care au participat la această întâlnire (alfabetic):

  • Adrian Stoian (Microsoft România)
    • (reprezentant pentru sistemul de operare Microsoft Windows)
  • Cristian Secară
  • Dan Matei (cIMeC)
    • (președintele comitetului tehnic CT 177 - Prelucrarea documentului și comunicații asociate)
  • Ioana Vintilă Rădulescu (Academia Română / Institutul de Lingvistică „Iorgu Iordan - Al. Rosetti”)
  • Mihaela Anghelescu (ASRO)
  • Mihail Popazu (IBM România)
  • Mișu Moldovan (Galuna)
    • (reprezentant pentru sistemul de operare Linux)
  • Natalia Lapteș (IBR)
  • Sorin Paliga (Universitatea București / Facultatea de limbi și literaturi străine)
    • (reprezentant pentru sistemul de operare Apple Mac OS)


Discuția a avut ca elemente de referință:


S-au trecut în revistă punctele discutate la etapa 2:

  • confirmat - conceptul de aranjamente multiple de caractere pentru tastatura limbii române, concept similar cu tastaturile altor limbi
  • confirmat - specificarea a două aranjamente distincte de caractere, fiecare urmărind un scop bine definit, scop detaliat la punctele 4.4.1.1. respectiv 4.4.2.1. al documentului de la etapa 1
  • confirmat - prezența în standard a ghilimelelor românești de tip 99 jos / 99 sus (Unicode 201E / 201D)
    • (observație ulterioară datei întâlnirii)
      ghilimelele „ și ” sunt incluse în codarea de pagină ISO-8859-16, Mac Romanian și Windows CP-1250, dar nu sunt incluse în codarea ISO-8859-2;
      categoriile afectate de această limitare pot fi:
      • utilizatorii programelor de e-mail care dintr-un motiv oarecare folosesc codarea de pagină ISO-8859-2
        (părere personală: deși se aplică teoria conform căreia evoluția programelor de e-mail tinde către suport UTF-8, cel puțin pe termen scurt s-ar putea ca utilizatorii să fie derutați de inconsistența acestor caractere între mesajele trimise și cele primite; concluzia ar fi că la acest punct limitarea este destul de importantă; din păcate, [limitarea] trebuie ignorată)
      • utilizatorii sistemului de operare Linux și/sau similare
        (părerea domnului Mișu Moldovan: datorită faptului că evoluția sistemelor de operare tinde către suport Unicode, concluzia ar fi că la acest punct limitarea este puțin importantă)
  • confirmat - includerea în standard a caracterului € (Unicode 20AC)
  • anulat - standardul nu va include caracterul Non-Breaking Space (Unicode 00A0)
  • anulat - standardul nu va include caracterul Non-Breaking Hyphen (Unicode 2011)
  • anulat - se revine la includerea în standard a caracterului En-Dash (Unicode 2013)
    • cu o modificare - fără caracterul Em-Dash (Unicode 2014)
  • anulat - se va permite prezența unor aranjamente de caractere alternative, prezente (deja) în cadrul sistemelor de operare, din motive de compatibilitate cu echipamentele hardware aflate (încă) în utilizare
  • confirmat - conceptul de a veni în sprijinul particularităților lingvistice ale limbii maghiare; se are în vedere situația în care un utilizator are de introdus cuvinte de origine maghiară într-un text predominant românesc, nu posibilitatea de a scrie [fluent] exclusiv în limba maghiară
  • confirmat - specificațiile cu privire la dispunerea geometrică a tastelor și a inscripționării acestora păstrează modelul SR-ISO/CEI-9995:1997
    • cu o modificare - fără caracterul # (Unicode 0023) pe blocul numeric
  • anulat - standardul nu se va ocupa de traducerea inscripționărilor asociate tastelor

Concluziile discuției, etapa 4

Note:
În textul de mai jos se va folosi prescurtarea ÎOOP în locul denumirii complete „Îndreptar Ortografic, Ortoepic și de Punctuație”, editat de Institutul de Lingvistică „Iorgu Iordan - Al. Rosetti” al Academiei Române.
În textul de mai jos se va folosi denumirea din limba engleză a caracterelor, așa cum sunt ele descrise în tabelele de referință ale consorțiului Unicode.

  1. s-a decis ca standardul să nu includă caracterul Non-Breaking Space (Unicode 00A0)
    Argument:
    • datorită imposibilității de a face distincție (vizual) între acest tip de spațiu și spațiul obișnuit, există posibilitatea de confuzie, în special când este vorba de căutarea unui șir în baze de date (atât în baze de date externe, cât și în propriile funcții de căutare ale programelor)
  2. s-a decis ca standardul să nu includă caracterul Non-Breaking Hyphen (Unicode 2011)
    Argumente:
    • acest caracter nu este inclus în nici o codare de pagină pe 8 biți uzuală, lucru care face dificilă și/sau imposibilă folosirea lui în texte care folosesc un astfel de tip de codare
    • acest caracter lipsește din majoritatea covârșitoare a fonturilor; diversele jonglerii tehnice care se fac pentru generarea și/sau afișarea artificială a acestui caracter sunt implementate haotic, chiar și în cadrul unor aplicații cu pretenții în privința suportului Unicode
    • datorită imposibilității de a face distincție (vizual) între acest tip de cratimă (de unire) și cratima de despărțire, există posibilitatea de confuzie, în special când este vorba de căutarea unui șir în baze de date (atât în baze de date externe, cât și în propriile funcții de căutare ale programelor)
  3. s-a decis ca standardul să nu includă caracterul § (Section Sign; Unicode 00A7)
    • (observație ulterioară datei întâlnirii)
      deși asta poate să nu însemne mare lucru, atrag atenția asupra faptului că semnul § este folosit intensiv în cadrul ÎOOP, de la pagina 9 până la pagina 91
    • ar trebui determinat motivul pentru care acest caracter este prezent pe tastaturile altor limbi: engleză internațional, franceză, germană, maghiară, precum și pe tastatura românească originală din Windows și din Mac OS
      (pot face o evaluare statistică a prezenței acestui caracter pe tastaturile limbilor europene, dacă se consideră necesar)
  4. s-a decis ca standardul să nu includă nici un caracter suplimentar specific domeniului tehnic, de genul µ sau °
  5. s-a decis ca standardul să nu includă nici un caracter suplimentar „exotic”, de genul © sau ®
  6. s-a decis ca standardul să includă caracterul – (En-Dash; Unicode 2013)
    • acest caracter este descris explicit în ÎOOP la pagina 81
    • acest caracter a fost recomandat ca și prezență pe tastatură de către consiliul științific al Institutului de Lingvistică
    • (observație ulterioară datei întâlnirii)
      caracterul – este inclus în codarea Mac Romanian și Windows CP-1250, dar nu este inclus nici în codarea ISO-8859-2, nici în codarea ISO-8859-16;
      categoriile afectate de această limitare pot fi:
      • utilizatorii programelor de e-mail care dintr-un motiv oarecare folosesc codarea de pagină ISO
        (părere personală: datorită faptului că (1) evoluția programelor de e-mail tinde către suport UTF-8 și (2) mesajele de tip e-mail au un caracter de comunicare directă, foarte puțin literară, concluzia ar fi că la acest punct limitarea este puțin importantă)
      • utilizatorii sistemului de operare Linux și/sau similare
        (părerea domnului Mișu Moldovan: datorită faptului că evoluția sistemelor de operare tinde către suport Unicode, concluzia ar fi că la acest punct limitarea este puțin importantă)
  7. s-a decis ca standardul să permită compunerea caracterelor cu accent ascuțit (Accute accent; Unicode 00B4)
    • generarea accentului se va face folosind nivelul 3 al unei taste, în regim de „tastă moartă”
    • pentru limba română, accentul ascuțit este plauzibil a fi folosit în dicționare, sau în situațiile în care trebuie precizat sensul unui cuvânt
    • pentru limba maghiară, acesta este singurul compromis acceptabil pentru a putea genera caracterele limbii maghiare fără a comuta tastatura pe aranjamentul de caractere unguresc
    • accentul trebuie să poată fi folosit (cel puțin) de caracterele a, A, e, E, i, I, o, O, u și U
    • deocamdată nu îmi este clar dacă tabelele de referință Unicode conțin sau nu caracterele ă, Ă, â, Â, î și Î cu accent ascuțit
  8. s-a decis ca standardul să permită compunerea caracterelor cu accent ascuțit dublu (Double accute accent; Unicode 02DD)
    • generarea accentului se va face folosind nivelul 3 al unei taste, în regim de „tastă moartă”
    • pentru limba maghiară, acesta este singurul compromis acceptabil pentru a putea genera caracterele limbii maghiare fără a comuta tastatura pe aranjamentul de caractere unguresc
    • accentul trebuie să poată fi folosit (cel puțin) de caracterele o, O, u și U
  9. s-a decis ca standardul să permită compunerea caracterelor cu tremă (Diaeresis; Unicode 00A8)
    • generarea accentului se va face folosind nivelul 3 al unei taste, în regim de „tastă moartă”
    • pentru limba maghiară, acesta este singurul compromis acceptabil pentru a putea genera caracterele limbii maghiare fără a comuta tastatura pe aranjamentul de caractere unguresc
    • accentul trebuie să poată fi folosit (cel puțin) de caracterele a, A, o, O, u și U
  10. s-a decis ca tastele alese pentru generarea celor trei accente descrise mai sus să fie:
    • tasta 8 și asterisc pentru tremă (diaeresis)
    • tasta 9 și paranteză deschisă pentru accentul ascuțit
    • tasta 0 și paranteză închisă pentru accentul ascuțit dublu
    • amplasarea acestor accente pe taste a fost inspirată de aranjamentul de caractere al tastaturii românești originale din Windows; diferența apare la tremă, care la tastatura românească originală din Windows era pe nivelul 3 al tastei minus și underscore
    • amplasarea acestor accente pe tastatură în mod similar cu configurația din Mac OS a fost respinsă, în parte, datorită prezenței semnului € pe tasta pe care – pe tastatura Mac OS – se află accentul ascuțit;
      logica amplasării accentelor pe tastatura Mac OS este următoarea:
      ` pe tasta accent grav și tilda
      ´ pe tasta E; sugerează generarea caracterului é
      ˝ pe tasta U; sugerează generarea caracterului ű
      ¨ pe tasta I; sugerează generarea caracterului ï
      ˜ pe tasta N; sugerează generarea caracterului ñ
      datorită limitărilor impuse de codările de pagină pe 8 biți de tip ISO-8859-2, ISO-8859-16 și Windows CP-1250, accentele ` (Grave accent; Unicode 0060) și ~ (Tilde; Unicode 007E) nu pot fi folosite pentru generarea de caractere compuse [cu aceste accente] atunci când se folosește tastatura românească;
      din același motiv, accentul ¨ nu poate fi folosit pentru generarea caracterului ï atunci când se folosește tastatura românească
  11. s-a decis ca din aranjamentul 2 să se excludă dualitatea prezenței caracterelor românești cu diacritice; poziționările care rămân sunt cele inspirate din cultura Linux, respectiv
    AltGr+a=ă, AltGr+q=â, AltGr+i=î, AltGr+s=ș, AltGr+t=ț
    și
    Shift+AltGr+a=Ă, Shift+AltGr+q=Â, Shift+AltGr+i=Î, Shift+AltGr+s=Ș, Shift+AltGr+t=Ț
  12. s-a decis ca semnul € (Euro sign; Unicode 20AC) să fie prezent exclusiv pe nivelul trei al tastei E
    • (observație ulterioară datei întâlnirii)
      pentru aranjamentul 1, amplasarea semnului € exclusiv pe nivelul trei al tastei E este justificată;
      pentru aranjamentul 2, acest lucru s-ar putea să nu fie suficient; conform definiției enunțate la punctul 4.4.2.1. al documentului de la etapa 1, scopul aranjamentului 2 este „[...] să permită utilizatorilor să folosească tastatura pentru a scrie în limba engleză [...]; având în vedere că o parte a tastaturilor comercializate în România sunt de tipul US English International, care au desenat semnul € pe nivelul trei al tastei 5, s-ar putea să fie necesar ca – cel puțin pentru aranjamentul 2 – caracterul € să poată fi generat și prin folosirea combinației AltGr+5
      (părere personală: ar fi de preferat să existe o coerență între cele două aranjamente de caractere, adică indiferent unde se va decide amplasarea acestui caracter, el să poată fi găsit în același loc)
  13. s-a propus ca aranjamentul 1 să poarte denumirea de
    Română (prescurtat RO) acolo unde meniurile folosesc limba română, sau
    Romanian (prescurtat RO) acolo unde meniurile folosesc limba engleză;
    acesta este aranjamentul principal;
    acesta este aranjamentul care va fi folosit pentru inscripționarea tastaturilor comercializate
  14. s-a propus ca aranjamentul 2 să poarte denumirea de
    Română (aranjament US) (prescurtat RO-US) acolo unde meniurile folosesc limba română, sau
    Romanian (US layout) (prescurtat RO-US) acolo unde meniurile folosesc limba engleză


La finalul discuției s-a schițat o planificare a activității viitoare:

  1. s-a propus ca standardul revizuit să fie disponibil pe internet, în versiune de ciornă, în cadrul acestui sait, pe toată perioada lunii ianuarie
  2. s-a propus mediatizarea acestei acțiuni
  3. s-a propus ca următoarea întâlnire să aibă loc la sfârșitul lunii ianuarie 2004
  4. s-a propus ca finalizarea acestei acțiuni să aibă loc în luna februarie 2004


Conform celor descrise până acum, configurația tastaturii devine: