El ISO/IEC 2022 es un estándar internacional de tecnología de la información que define la estructura de los códigos de caracteres y las técnicas de extensión para la representación de texto en sistemas informáticos. Este estándar es equivalente a otras normativas técnicas como la ECMA-35, la ANSI X3.41 y la norma japonesa JIS X 0202.
Origen y Propósito
Establecido originalmente en 1971 y revisado por última vez en 1994, el ISO/IEC 2022 proporciona un marco general al que pueden ajustarse diversas codificaciones de caracteres. Su objetivo principal es permitir la coexistencia de múltiples conjuntos de caracteres en un mismo documento, facilitando la interoperabilidad entre diferentes idiomas y sistemas de escritura.
Estructura Técnica
El estándar dedica rangos específicos de bytes para funciones no gráficas, asegurando que el contenido textual se distinga de las instrucciones de formato:
- Códigos de Control: Los rangos
0x00–1Fy0x7F鼀se reservan para códigos de control no imprimibles. Estos se utilizan para el formateo y las instrucciones in-band, como los saltos de línea o comandos para terminales de texto. - Secuencias de Escape: Define una sintaxis para secuencias de bytes que comienzan con el código de control
ESC. Estas secuencias permiten realizar instrucciones complejas, como el cambio dinámico entre diferentes conjuntos de caracteres (por ejemplo, pasar de ASCII a JIS X 0208 para texto en japonés).
Esta capacidad de alternar entre conjuntos de caracteres convierte al ISO 2022 en una codificación stateful (con estado), donde el significado de un byte depende de la secuencia de escape procesada anteriormente.
Compatibilidad y Entornos de Transmisión
Una de las ventajas fundamentales del ISO/IEC 2022 es su versatilidad respecto al ancho de banda de los datos:
- Entornos de 8 bits: Soporta la representación completa de bytes.
- Entornos de 7 bits: Permite que los datos sean compatibles con sistemas que solo procesan siete bits por byte, una limitación común en los primeros sistemas de correo electrónico antes de la adopción de
8BITMIME.
Conformidad y Codificaciones Relacionadas
Sistemas de Escritura CJK
Para los idiomas del este asiático (chino, japonés y coreano, conocidos como CJK), que requieren miles de caracteres, el ISO 2022 ha sido fundamental. Codificaciones como ISO-2022-JP utilizan los mecanismos de escape del estándar para alternar entre el alfabeto latino y los caracteres complejos de doble byte.
Relación con Unicode y UTF-8
Aunque la llegada de Unicode ha reducido la necesidad de codificaciones con estado, el ISO 2022 dejó una huella permanente. Unicode heredó el concepto de códigos de control C0 y C1. Sin embargo, los formatos de transformación como UTF-8 difieren significativamente del ISO 2022 al no utilizar secuencias de escape para cambiar de conjunto de caracteres, sino un sistema de longitud variable basado en el valor del bit más significativo.
Resumen de Elementos Especificados
| Elemento | Descripción |
|---|---|
| Infraestructura de Conjuntos | Múltiples conjuntos de caracteres gráficos y códigos de control primarios (C0) y secundarios (C1). |
| Formato de 8 bits | Método de codificación asumiendo la disponibilidad de 8 bits por byte. |
| Formato de 7 bits | Método de transformación para entornos restringidos a 7 bits. |
| Códigos de Escape ANSI | Estructura general y formatos específicos para identificar conjuntos de caracteres e interactuar con otros sistemas. |

