Введение

Международный стандарт для трехбуквенных кодов, идентифицирующих языки. ISO 639-3:2007, «Коды для представления названий языков. Часть 3: Код Alpha-3 для всестороннего охвата языков», — это международный стандарт для языковых кодов в серии ISO 639. Он определяет трехбуквенные коды для идентификации языков. Стандарт был опубликован Международной организацией по стандартизации (ISO) 1 февраля 2007 года. ISO 639-3 расширяет коды ISO 639-2 Alpha-3 с целью охватить все известные естественные языки. Расширенный охват языков был основан главным образом на языковых кодах, используемых в «Этнологе» (тома 10–14), опубликованном SIL International, который в настоящее время является регистрационным органом для ISO 639-3. Он предоставляет максимально полный перечень языков, включая живые и вымершие, древние и искусственные, основные и второстепенные, письменные и неписьменные. ISO 639-3 предназначен для использования в качестве кодов метаданных в широком спектре приложений. Он широко используется в компьютерных и информационных системах, таких как Интернет, где требуется поддержка многих языков. В архивах и других хранилищах информации он используется в системах каталогизации для указания языка ресурса или языка, о котором он. Коды также часто используются в лингвистической литературе и в других областях для компенсации того факта, что названия языков могут быть неясными или неоднозначными. Найти язык: введите код ISO 639-3, чтобы найти соответствующую статью о языке.

Кодовое пространство

Поскольку код состоит из трех букв алфавита, верхняя граница для количества языков, которые могут быть представлены, составляет 26 × 26 × 26 = 17 576. Однако, поскольку в ISO 639-2 определены специальные коды (4), зарезервированный диапазон (520) и коды, начинающиеся только с буквы B (22), 546 кодов не могут быть использованы в части 3. Следовательно, более строгая верхняя граница составляет 17 576 − 546 = 17 030. Эта верхняя граница становится еще более строгой, если вычесть языковые коллекции, определенные в ISO 639-2, и те, которые еще предстоит определить в ISO 639-5.

Коллективные языки

Коллективный языковой код — это идентификатор, представляющий группу отдельных языков, которые ни в каком контексте употребления не рассматриваются как единый язык. Эти коды не отражают точно какой-либо конкретный язык или макроязык. Хотя ISO 639-2 включает трехбуквенные идентификаторы для коллективных языков, эти коды не входят в ISO 639-3. Таким образом, ISO 639-3 не является надмножеством ISO 639-2. ISO 639-5 определяет трехбуквенные коллективные коды для языковых семей и групп, включая коллективные языковые коды из ISO 639-2.

Специальные коды

В ISO 639-2 и ISO 639-3 предусмотрено четыре кода для случаев, когда ни один из конкретных кодов не является подходящим. Они предназначены главным образом для приложений, таких как базы данных, где требуется код ISO независимо от его существования. Код (неклассифицированные языки, первоначально аббревиатура от "прочие") предназначен для языков, которые (пока) не включены в стандарт ISO. Код (многоязычность) предназначен для случаев, когда данные содержат более одного языка, и, например, база данных требует единый код ISO. Код (неопределённый язык) предназначен для случаев, когда язык в данных не был идентифицирован, например, если он был ошибочно обозначен или никогда не имел обозначения. Он не предназначен для случаев, подобных троянскому языку, когда ненаучно зафиксированному языку было присвоено название. Код (отсутствие лингвистического содержания / неприменимо) предназначен для данных, которые вообще не являются языком, например, звуки животных. Кроме того, 520 кодов в диапазоне – зарезервированы для локального использования. Например, Ребекка Беттенкур назначает коды конструируемым языкам, а новые коды присваиваются по запросу. Список лингвистов использует их для вымерших языков. Список лингвистов присвоил одному из них обобщённое значение: , безымянный протоязык. Он используется для предлагаемых промежуточных узлов в генеалогическом древе, не имеющих названия.