Кіріспе
ITU T T.51 / ISO/IEC 6937:2001, Ақпараттық технологиялар — Мәтіндік байланыс үшін кодталған графикалық таңбалар жиынтығы — Латын әліпбиі, ASCII-дің көп байттық кеңейтімі, немесе дәлірек айтқанда ISO/IEC 646 IRV. Ол ITU T (бұрынғы CCITT) телематикалық қызметтер үшін T.51 деген атпен бірлесіп әзірленді және алғаш рет 1983 жылы ISO стандарты болды. Белгілі бір байт кодтары диакритикалық белгілері бар әріптер үшін (акценттер) бастапқы байттар ретінде қолданылады. Бастапқы байттың мәні көбінесе әріпте қандай диакритикалық белгі қойылғанын көрсетеді, ал одан кейінгі байт сол диакритикалық белгі қойылған әріптің ASCII мәнін білдіреді. ISO/IEC 6937 стандартты жасаушылар – Хью Макгрегор Росс, Питер Фенвик, Бернард Марти және Лоек Зекендорф. ISO6937/2 латын әліпбиін пайдаланатын қазіргі Еуропа тілдерінде кездесетін 327 таңбаны анықтайды. Кириллица және грек әріптері сияқты латын әліпбиіне жатпайтын Еуропа таңбалары стандартқа кірмейді. Сондай-ақ, латын әліпбиінде қолданылатын кейбір диакритикалық белгілер, мысалы румындық үтір, кіргізілмеген, оның орнына cedilla қолданылған, себебі сол кезде cedilla мен үтір арасында ешқандай айырмашылық жасалмады. IANA осы стандарттың екі (ескі) нұсқасының (сонымен қатар басқару кодтары) таңба жиынтығы атауларын – ISO 6937 2 25 және ISO 6937 2 add деп тіркеді. Бірақ іс жүзінде бұл таңбалар жиынтығы интернетте қолданылмайды.
T.51 / ISO/IEC 6937:2001, Information technology — Coded graphic character set for text communication — Latin alphabet, is a multibyte extension of ASCII, or more precisely ISO/IEC 646 IRV. It was developed in common with ITU T (then CCITT) for telematic services under the name of T.51, and first became an ISO standard in 1983. Certain byte codes are used as lead bytes for letters with diacritics (accents). The value of the lead byte often indicates which diacritic that the letter has, and the follow byte then has the ASCII value for the letter that the diacritic is on. ISO/IEC 6937's architects were Hugh McGregor Ross, Peter Fenwick, Bernard Marti and Loek Zeckendorf. ISO6937/2 defines 327 characters found in modern European languages using the Latin alphabet. Non Latin European characters, such as Cyrillic and Greek, are not included in the standard. Also, some diacritics used with the Latin alphabet like the Romanian comma are not included, using cedilla instead as no distinction between cedilla and comma below was made at the time. IANA has registered the charset names ISO 6937 2 25 and ISO 6937 2 add for two (older) versions of this standard (plus control codes). But in practice this character encoding is unused on the Internet.
Бір байт таңбалар
Бастапқы жиынтық (бірінші жартысы) бастапқыда ISO 646 IRV стандартына сәйкес келді, яғни ISO/IEC 646:1991 қайта қаралуына дейін, яғни көбінесе ASCII стандартына сәйкес келді, бірақ 0x24 коды доллар белгісінің ($) орнына «халықаралық валюта белгісі» (¤) ретінде белгіленді. 1992 жылғы ITU T.51 нұсқасы қолданыстағы CCITT қызметтеріне 0x24 кодын халықаралық валюта белгісі ретінде түсіндіруді жалғастыруға рұқсат береді, бірақ жаңа телекоммуникациялық қолданбалар оны доллар белгісі үшін пайдалануы керек (яғни, қазіргі ISO 646 IRV стандартына сәйкес), ал халықаралық валюта белгісін керісінше, қосымша жиынтық арқылы көрсетуі керек. Бұл Single Shift Two кодын енкодилеуі ISO IR 106 стандартындағы оның орналасуымен сәйкес келеді. ISO/IEC 6937 қосымша жиынтығын G2 жиынтығы ретінде белгілеу үшін ISO/IEC 2022 қашқыш тізбегі ESC R (hex 1B 2E 52) болып табылады. Ескі ISO 6937/2:1983 қосымша жиынтығы 94 кодтар жиынтығы ретінде тіркелді және ESC * l (hex 1B 2A 6C) арқылы G2 ретінде белгіленді.
ETS 300 706 нұсқасы
ETS 300 706 стандартының Әлемдік жүйе телетекстік G2 жиынтығы ISO 6937 стандартына негізделген. Ол T.61 қосымша жиынтығының кеңейтілген жиынтығы және T.51 стандартының 1988 жылғы басылымының бірінші қосымша жиынтығының кеңейтілген жиынтығы болып табылады, бірақ кейбір орындарда T.51 стандартының қазіргі басылымымен қақтығысады. ETS нұсқасындағы диакриттік кодтар қолданыстағы G0 жиынтығындағы, мысалы US ASCII немесе BS дерек көрінісі сияқты таңбалармен байланысу үшін берілген. Бұл нұсқа төмендегі кестеде көрсетілген.