La norma ISO 639-3:2007 , Códigos para la representación de nombres de idiomas – Parte 3: Código alfa-3 para una cobertura integral de idiomas , es una norma internacional para códigos de idiomas de la serie ISO 639. Define códigos de tres letras para la identificación de idiomas. La norma fue publicada por la Organización Internacional de Normalización (ISO) el 1 de febrero de 2007. [ 1 ]
A partir de 2023, esta edición de la norma fue retirada oficialmente y reemplazada por la ISO 639:2023. [ 1 ]
La norma ISO 639-3 amplía los códigos alfa-3 de la ISO 639-2 con el objetivo de abarcar todas las lenguas naturales conocidas . La cobertura lingüística ampliada se basó principalmente en los códigos lingüísticos utilizados en el Ethnologue (volúmenes 10-14), publicado por SIL International , que ahora es la autoridad de registro de la ISO 639-3. [ 2 ] Proporciona una enumeración de lenguas lo más completa posible, incluyendo lenguas vivas y extintas, antiguas y construidas, principales y secundarias, escritas y no escritas. [ 1 ] Sin embargo, no incluye lenguas reconstruidas como el protoindoeuropeo . [ 3 ]
La norma ISO 639-3 está diseñada para su uso como códigos de metadatos en una amplia gama de aplicaciones. Se utiliza ampliamente en sistemas informáticos y de información, como Internet, donde es necesario admitir numerosos idiomas. En archivos y otros sistemas de almacenamiento de información, se emplea en sistemas de catalogación para indicar el idioma en el que se encuentra un recurso o del que trata. Estos códigos también se utilizan con frecuencia en la literatura lingüística y otros ámbitos para compensar la posible ambigüedad o oscuridad de los nombres de los idiomas.
Códigos de idioma
La norma ISO 639-3 incluye todos los idiomas de la ISO 639-1 y todos los idiomas individuales de la ISO 639-2 . Las normas ISO 639-1 e ISO 639-2 se centraron en los idiomas principales, los más representados en el conjunto de la literatura mundial. Dado que la ISO 639-2 también incluye colecciones de idiomas y la Parte 3 no, la ISO 639-3 no es un superconjunto de la ISO 639-2. Cuando existen códigos B y T en la ISO 639-2, la ISO 639-3 utiliza los códigos T.
A fecha de 23 de enero de 2023 , el estándar contiene 7.916 entradas. [ 6 ] El inventario de lenguas se basa en varias fuentes, entre ellas: las lenguas individuales contenidas en 639-2, lenguas modernas de Ethnologue , variedades históricas, lenguas antiguas y lenguas artificiales de Linguist List , [ 7 ] así como lenguas recomendadas durante el período anual de comentarios públicos.
Los archivos de datos legibles por máquina son proporcionados por la autoridad de registro. [ 6 ] Los mapeos de ISO 639-1 o ISO 639-2 a ISO 639-3 se pueden hacer utilizando estos archivos de datos.
La norma ISO 639-3 pretende establecer distinciones basadas en criterios que no son del todo objetivos. [ 8 ] No pretende documentar ni proporcionar identificadores para dialectos u otras variaciones sublingüísticas. [ 9 ] Sin embargo, los juicios sobre las distinciones entre lenguas pueden ser subjetivos, especialmente en el caso de variedades lingüísticas sin tradiciones literarias establecidas, uso en la educación o los medios de comunicación, u otros factores que contribuyan a la convencionalización del lenguaje. Por lo tanto, la norma no debe considerarse una declaración autorizada sobre qué lenguas distintas existen en el mundo (sobre lo cual puede haber desacuerdo sustancial en algunos casos), sino simplemente una forma útil de identificar con precisión las diferentes variedades lingüísticas.
Espacio de código
Dado que el código es alfabético de tres letras, un límite superior para el número de idiomas que se pueden representar es 26 × 26 × 26 = 17 576. Como la norma ISO 639-2 define códigos especiales (4), un rango reservado (520) y códigos solo B (22), no se pueden utilizar 546 códigos en la parte 3. Por lo tanto, un límite superior más estricto es 17 576 − 546 = 17 030.
El límite superior se vuelve aún más estricto si se restan las colecciones de lenguajes definidas en 639-2 y las que aún no se han definido en ISO 639-5 .
Nombres de referencia
Los nombres de referencia solo pueden usar un subconjunto de caracteres ASCII. Según la sección 6.4.1 de la norma, solo pueden contener las 26 letras del alfabeto latino básico ISO y diacríticos del siguiente conjunto:
Los nombres de referencia también pueden incluir cualquiera de los cinco signos de puntuación ASCII (espacio, guion, apóstrofo y paréntesis), y dentro de los paréntesis el punto y los diez dígitos.
Los nombres alternativos pueden utilizar la ortografía correcta del idioma, si es latino, o una transliteración al alfabeto latino que contenga caracteres adicionales.
Macrolenguajes
En la norma ISO 639-2 hay 58 lenguajes que, a efectos de la norma, se consideran "macrolenguajes" en la norma ISO 639-3. [ 10 ]
Algunos de estos macrolenguajes no tenían un idioma individual definido por la norma ISO 639-3 en el conjunto de códigos de la norma ISO 639-2, por ejemplo ara(árabe genérico). Otros, como nor(noruego), ya tenían sus dos partes individuales ( nno( nynorsk ), nob( bokmål )) definidas en la norma ISO 639-2.
Eso significa que algunos idiomas (por ejemplo arb, el árabe estándar) que la norma ISO 639-2 consideraba dialectos de un mismo idioma ( ara) ahora, en la norma ISO 639-3, en ciertos contextos, se consideran idiomas individuales.
Se trata de un intento de abordar las variedades que pueden ser lingüísticamente distintas entre sí, pero que sus hablantes tratan como dos formas de la misma lengua, por ejemplo, en los casos de diglosia .
Por ejemplo:
La lista completa está disponible en el sitio web del registrador ISO 639-3. [ 13 ]
Lenguas colectivas
"Un elemento de código de lenguaje colectivo es un identificador que representa un grupo de lenguajes individuales que no se consideran un solo lenguaje en ningún contexto de uso." [ 14 ] Estos códigos no representan con precisión un lenguaje o macrolenguaje en particular.
Si bien la norma ISO 639-2 incluye identificadores de tres letras para lenguas colectivas, estos códigos están excluidos de la norma ISO 639-3. Por lo tanto, la norma ISO 639-3 no es un superconjunto de la norma ISO 639-2.
La norma ISO 639-5 define códigos colectivos de 3 letras para familias y grupos lingüísticos, incluidos los códigos lingüísticos colectivos de la norma ISO 639-2.
Códigos especiales
En las normas ISO 639-2 e ISO 639-3 se reservan cuatro códigos para los casos en que ninguno de los códigos específicos sea apropiado. Estos están destinados principalmente a aplicaciones como bases de datos, donde se requiere un código ISO independientemente de si existe o no.
mis(lenguajes no codificados, originalmente una abreviatura de 'misceláneos') está destinado a los idiomas que no han sido incluidos (todavía) en la norma ISO.mul(varios idiomas) está pensado para casos en los que los datos incluyen más de un idioma y (por ejemplo) la base de datos requiere un único código ISO.und(indeterminado) se utiliza en casos donde no se ha identificado el idioma de los datos, como cuando están mal etiquetados o nunca se han etiquetado. No se utiliza en casos como el de los troyanos , donde se ha asignado un nombre a un idioma no verificado.zxx(sin contenido lingüístico / no aplicable) está destinado a datos que no son un idioma en absoluto, como los cantos de animales. [ 15 ]
Además, 520 códigos en el rango qaa– qtzestán «reservados para uso local». Por ejemplo, Rebecca Bettencourt asigna un código a los lenguajes construidos , y se realizan nuevas asignaciones a petición. [ 16 ]
Procesos de mantenimiento
La tabla de códigos para ISO 639-3 está abierta a cambios. Para proteger la estabilidad del uso existente, los cambios permitidos se limitan a: [ 17 ]
- modificaciones a la información de referencia para una entrada (incluidos nombres o categorizaciones de tipo y alcance),
- adición de nuevas entradas,
- desuso de entradas que sean duplicadas o espurias,
- fusionar una o más entradas en otra entrada, y
- dividir una entrada de idioma existente en varias entradas de idioma nuevas.
El código asignado a un idioma no cambia a menos que también haya un cambio en la denotación. [ 18 ]
Los cambios se realizan según un ciclo anual. Cada solicitud cuenta con un período mínimo de tres meses para revisión pública.
El sitio web de la norma ISO 639-3 contiene páginas que describen los "ámbitos de denotación" [ 19 ] ( tipos languoides ) y los tipos de lenguas [ 20 ] , que explican qué conceptos se pueden codificar y ciertos criterios que deben cumplirse. Por ejemplo, las lenguas construidas se pueden codificar, pero solo si están diseñadas para la comunicación humana y cuentan con un corpus de literatura, lo que impide solicitar invenciones idiosincrásicas.
La autoridad de registro documenta en su sitio web las instrucciones contenidas en el texto de la norma ISO 639-3 sobre cómo deben mantenerse las tablas de códigos. [ 21 ] También documenta los procesos utilizados para recibir y procesar las solicitudes de cambio. [ 22 ]
Se proporciona un formulario de solicitud de cambio y un segundo formulario para recopilar información sobre las adiciones propuestas. Cualquier parte puede presentar solicitudes de cambio. Una vez presentadas, las solicitudes son revisadas inicialmente por la autoridad de registro para verificar que estén completas.
Cuando se recibe una solicitud debidamente documentada, se añade a un índice de solicitudes de cambio publicado. Asimismo, se envían anuncios a la lista de discusión general de LINGUIST en Linguist List y a otras listas que la autoridad de registro considere relevantes, invitando al público a revisar y aportar comentarios sobre el cambio solicitado. Cualquier administrador de lista o usuario puede solicitar notificaciones de solicitudes de cambio para regiones o familias lingüísticas específicas. Los comentarios recibidos se publican para que otros usuarios los revisen. En función del consenso expresado en los comentarios recibidos, una solicitud de cambio puede retirarse o convertirse en una solicitud candidata.
Tres meses antes de que finalice el ciclo de evaluación anual (normalmente en septiembre), se envía un anuncio a la lista de discusión LINGUIST y a otras listas sobre las solicitudes de cambio de estatus de candidato. Todas las solicitudes permanecen abiertas para su revisión y comentarios hasta el final del ciclo de evaluación anual.
Las decisiones se anuncian al final del ciclo de revisión anual (normalmente en enero). En ese momento, las solicitudes pueden adoptarse total o parcialmente, modificarse y trasladarse al siguiente ciclo de revisión, o rechazarse. Los rechazos suelen incluir sugerencias sobre cómo modificar las propuestas para su nueva presentación. Se mantiene un archivo público de cada solicitud de cambio, junto con las decisiones tomadas y su justificación. [ 23 ]
Crítica
Los lingüistas Morey, Post y Friedman plantean diversas críticas a la norma ISO 639, y en particular a la ISO 639-3: [ 18 ]
- Los códigos de tres letras son problemáticos en sí mismos, ya que, si bien oficialmente son etiquetas técnicas arbitrarias, a menudo derivan de abreviaturas mnemotécnicas de nombres de idiomas, algunas de las cuales son peyorativas . Por ejemplo, al yemsa se le asignó el código
jnj, derivado del peyorativo «Janejero». Por lo tanto, estos códigos pueden ser considerados ofensivos por los hablantes nativos. - La administración del estándar es problemática porque SIL es una organización misionera con escasa transparencia y rendición de cuentas. Las decisiones sobre qué idiomas deben codificarse se toman internamente. Si bien las aportaciones externas pueden ser bienvenidas o no, las decisiones en sí mismas son opacas, y muchos lingüistas han desistido de intentar mejorar el estándar.
- La identificación permanente de una lengua es incompatible con el cambio lingüístico.
- Con frecuencia, las lenguas y los dialectos no pueden distinguirse con rigor, y los continuos dialectales pueden subdividirse de muchas maneras, mientras que la norma privilegia una sola opción. Estas distinciones suelen basarse en factores sociales y políticos.
- La norma ISO 639-3 puede ser malinterpretada y utilizada indebidamente por las autoridades que toman decisiones sobre la identidad y el idioma de las personas, lo que anularía el derecho de los hablantes a identificarse o no con su variedad lingüística. Si bien SIL es consciente de estas cuestiones, este problema es inherente a la naturaleza de una norma establecida, que puede utilizarse (o utilizarse indebidamente) de maneras que ISO y SIL no prevén.
Martin Haspelmath coincide con cuatro de estos puntos, pero no con el relativo al cambio lingüístico. Discrepa porque cualquier descripción de una lengua requiere su identificación, y podemos identificar fácilmente las diferentes etapas de una lengua. Sugiere que los lingüistas podrían preferir una codificación realizada a nivel languoidal, ya que «rara vez les importa si se trata de una lengua, un dialecto o una familia lingüística estrechamente relacionada». También cuestiona la idoneidad de una norma ISO para la identificación de lenguas, dado que ISO es una organización industrial, mientras que él considera la documentación y la nomenclatura lingüísticas como una actividad científica. Cita la necesidad original de identificadores lingüísticos estandarizados como «la importancia económica de la traducción y la localización de software », para lo cual se establecieron las normas ISO 639-1 y 639-2. Sin embargo, plantea dudas sobre la necesidad industrial de la cobertura integral que ofrece la norma ISO 639-3, que incluye «lenguas poco conocidas de pequeñas comunidades que nunca o casi nunca se utilizan por escrito y que a menudo están en peligro de extinción». [ 24 ]
Uso
- Etnólogo
- Lista de lingüistas
- OLAC : la comunidad de archivos de lenguas abiertas [ 25 ]
- Microsoft Windows 8 : [ 26 ] Admite todos los códigos en ISO 639-3 en el momento del lanzamiento.
- Fundación Wikimedia: Los nuevos proyectos basados en idiomas (por ejemplo, Wikipedias en nuevos idiomas) deben tener un identificador ISO 639-1, -2 o -3. [ 27 ]
- Otras normas que se basan en la ISO 639-3:
- Etiquetas de idioma según lo define el Grupo de Trabajo de Ingeniería de Internet (IETF), como se documenta en:
- BCP 47: Mejores prácticas actuales 47 , [ 28 ] que incluye RFC 5646
- RFC 5646 , que sustituyó a RFC 4646 , que a su vez sustituyó a RFC 3066. (Por lo tanto, todas las normas que dependen de cualquiera de estas tres normas IETF ahora utilizan ISO 639-3).
- El estándar ePub 3.0 para metadatos de idioma [ 29 ] utiliza elementos de metadatos Dublin Core. Estos elementos de metadatos de idioma en los ePub deben contener códigos RFC 5646 válidos para los idiomas. [ 29 ] RFC 5646 remite a ISO 639-3 para idiomas sin códigos IANA más cortos.
- Iniciativa de metadatos Dublin Core : término de metadatos DCMI [ 30 ] para el idioma, a través del RFC 4646 de la IETF (ahora reemplazado por el RFC 5646 ).
- Autoridad de Números Asignados de Internet (IANA) El esfuerzo de internacionalización del W3C recomienda el uso del Registro de Subetiquetas de Idiomas de IANA para seleccionar códigos para idiomas. [ 31 ] El Registro de Subetiquetas de Idiomas de IANA [ 32 ] depende de los códigos ISO 639-3 para idiomas que no tenían previamente códigos en otras partes de la norma ISO 639.
- HTML5: [ 33 ] vía BCP 47 de IETF.
- XML: [ 34 ] vía BCP 47 de IETF.
- SVG: [ 35 ] vía BCP 47 de IETF.
- Códigos de la biblioteca MODS : [ 36 ] Incorpora el RFC 3066 de la IETF (ahora reemplazado por el RFC 5646 ).
- Iniciativa de codificación de texto (TEI): [ 37 ] vía BCP 47 de IETF.
- Marco de marcado léxico : especificación ISO para la representación de diccionarios legibles por máquina.
- Repositorio de datos de configuración regional común de Unicode : Utiliza varios cientos de códigos de ISO 639-3 que no están incluidos en ISO 639-2.
- Etiquetas de idioma según lo define el Grupo de Trabajo de Ingeniería de Internet (IETF), como se documenta en:
Referencias
- 1 2 3 "Aviso de retirada de la norma ISO 639-3:2007" . Organización Internacional de Normalización. 1 de febrero de 2007. Archivado del original el 6 de junio de 2024. Consultado el 6 de junio de 2025 .
- ↑ "Organismos de mantenimiento y autoridades de registro" . ISO. Archivado del original el 8 de octubre de 2012. Consultado el 12 de enero de 2014 .
- ↑ "Tipos de lenguas individuales – Lenguas antiguas" . SIL International . Archivado del original el 12 de junio de 2018. Consultado el 11 de junio de 2018 .
- ↑ "Informe de Ethnologue para el código ISO 639: zho" . Ethnologue . Archivado del original el 12 de septiembre de 2014.
- ↑ "ISO 639-3" . SIL International . Archivado del original el 24 de febrero de 2013. Consultado el 12 de septiembre de 2014 .
- 1 2 "Conjunto de códigos ISO 639-3" . SIL International . 18 de febrero de 2021. Archivado del original el 1 de abril de 2018. Recuperado el 7 de abril de 2021 .
- ↑ "ISO 639-3" . SIL International . Archivado del original el 15 de mayo de 2014. Consultado el 18 de mayo de 2014 .
- ↑ "Alcance de la denotación: lenguas individuales" . SIL International . Archivado del original el 20 de octubre de 2014. Consultado el 18 de mayo de 2014 .
- ↑ "Alcance de la denotación: dialectos" . SIL International . Archivado del original el 20 de octubre de 2014. Consultado el 18 de mayo de 2014 .
- ↑ "Alcance de la denotación: macrolenguajes" . SIL International . Archivado del original el 8 de febrero de 2013. Consultado el 14 de junio de 2012 .
- ↑
araen el registro ISO 639-3. - ↑
arben el registro ISO 639-3. - ↑ "Mapeos de macrolenguaje" . SIL International . Archivado del original el 11 de octubre de 2020. Consultado el 2 de noviembre de 2021 .
- ↑ "Alcance de la denotación: Lenguas colectivas" . SIL International . Archivado del original el 8 de febrero de 2013. Consultado el 14 de junio de 2012 .
- ↑ "Grabaciones de campo de llamadas de monos vervet" . Consorcio de Datos Lingüísticos . Archivado del original el 15 de enero de 2023. Recuperado el 15 de enero de 2023 .
- ↑ Bettencourt, Rebecca. "Registro de códigos ConLang" . KreativeKorp . Archivado del original el 8 de octubre de 2023. Recuperado el 12 de marzo de 2021 .
- ↑ "Presentación de solicitudes de cambio ISO 639-3: Tipos de cambios" . SIL International . Archivado del original el 2 de febrero de 2016. Consultado el 21 de mayo de 2014 .
- 1 2 Morey, Stephen; Post, Mark W.; Friedman, Victor A. (2013). Los códigos de lenguaje de ISO 639: una estandarización prematura, en última instancia inalcanzable y posiblemente perjudicial . Conferencia PARADISEC RRR. Archivado del original el 23 de febrero de 2016. Recuperado el 3 de noviembre de 2015 .
- ↑ "Alcance de la denotación para los identificadores de idioma" . SIL International . Archivado del original el 20 de octubre de 2014. Consultado el 18 de mayo de 2014 .
- ↑ "Tipos de lenguas" . SIL International . Archivado del original el 23 de febrero de 2016. Consultado el 21 de mayo de 2014 .
- ↑ "ISO 639-3 Gestión del cambio" . SIL International . Archivado del original el 14 de mayo de 2016. Consultado el 18 de mayo de 2014 .
- ↑ "Presentación de solicitudes de cambio ISO 639-3" . SIL International . Archivado del original el 2 de febrero de 2016. Consultado el 21 de mayo de 2014 .
- ↑ "Índice de solicitudes de cambio ISO 639-3" . SIL International . Archivado del original el 29 de enero de 2016. Consultado el 20 de mayo de 2014 .
- ↑ Haspelmath, Martin (4 de diciembre de 2013). "¿Se puede estandarizar la identidad lingüística? Sobre la crítica de Morey et al. a la norma ISO 639-3" . Comentario sobre lingüística de la diversidad . doi : 10.58079/nsst . Archivado del original el 19 de abril de 2014. Recuperado el 18 de abril de 2014 .
- ↑ "Extensión de lenguaje OLAC" . language-archives.org . Archivado del original el 16 de mayo de 2015. Consultado el 3 de agosto de 2015 .
- ↑ "Más de 7000 idiomas, solo 1 Windows" . Microsoft. 5 de febrero de 2014. Archivado del original el 3 de marzo de 2024. Consultado el 3 de marzo de 2024 .
- ↑ "Política de propuesta lingüística" . wikimedia.org . Archivado del original el 13 de julio de 2015. Consultado el 3 de agosto de 2015 .
- ↑ "BCP 47 – Etiquetas para identificar idiomas" . ietf.org . Archivado del original el 9 de marzo de 2018. Consultado el 3 de agosto de 2015 .
- 1 2 "Publicaciones EPUB 3.0" . idpf.org . Archivado del original el 2 de agosto de 2015. Recuperado el 3 de agosto de 2015 .
- ↑ "Términos de metadatos de DCMI" . purl.org . Archivado del original el 7 de diciembre de 2023. Consultado el 3 de agosto de 2015 .
- ↑ "Códigos de idioma ISO de dos o tres letras" . W3C . Archivado del original el 8 de agosto de 2015. Consultado el 3 de agosto de 2015 .
- ↑ "Registro de Idiomas" . Autoridad de Números Asignados de Internet. Archivado del original el 12 de noviembre de 2017. Recuperado el 12 de agosto de 2015 .
- ↑ "Semántica, estructura y API de documentos HTML — HTML5" . W3C . Archivado del original el 6 de junio de 2015. Consultado el 3 de agosto de 2015 .
- ↑ "Lenguaje de marcado extensible (XML) 1.0 (Quinta edición)" . W3C . Archivado del original el 25 de diciembre de 2021. Consultado el 3 de septiembre de 2022 .
- ↑ "Gráficos vectoriales escalables (SVG) 2" . W3C . Consultado el 3 de septiembre de 2022 .
- ↑ "Elements – MODS User Guidelines: Metadata Object Description Schema: MODS" . Biblioteca del Congreso . Archivado del original el 22 de agosto de 2015. Consultado el 3 de agosto de 2015 .
- ↑ "Lenguaje de elementos TEI" . Iniciativa de codificación de texto . Archivado del original el 14 de septiembre de 2015. Consultado el 3 de agosto de 2015 .
Lecturas adicionales
- Aristar, Anthony (2006). "Códigos lingüísticos estandarizados ISO y Ethnologue" (PDF) . Boletín SSILA . 247. Archivado del original (PDF) el 20 de mayo de 2014.
- Dobrin, Lise M.; Good, Jeff (2009). "Desarrollo práctico del lenguaje: ¿De quién es la misión?" (PDF) . Language . 85 (3): 619– 629. doi : 10.1353/lan.0.0152 . S2CID 144749106 .
- Epps, Patience (2006). "En oposición a la adopción de los códigos lingüísticos de Ethnologue para la norma ISO 639-3" (PDF) . Boletín SSILA . 246. Archivado del original (PDF) el 20 de mayo de 2014.
- Golla, Victor, ed. (2006). "Declaración de SSILA sobre los códigos de idioma ISO 639-3" (PDF) . Boletín de SSILA . 249. Archivado del original (PDF) el 20 de mayo de 2014.
- Good, Jeff; Cysouw, Michael (2013). "Languoid, doculect, and glossonym: formalizing the notion 'language'". Documentación y conservación de lenguas . 7 : 331– 359. hdl : 10125/4606 .
Enlaces externos
- Autoridad de registro ISO 639-3
- Preguntas frecuentes en el sitio web de la Biblioteca del Congreso de los Estados Unidos.
- Solicitudes pendientes según la norma ISO 639-3
- Lista de lingüistas - Lista de lenguas antiguas y extintas
- explicación de Håvard Hjulstad
- ISO 639
- Obras de 2007
- Identificadores de idioma