Lección 7

Escape de strings y Unicode

Secuencias de escape, puntos de código Unicode y caracteres especiales en cadenas JSON.

Las cadenas JSON siempre van delimitadas por comillas dobles. Cualquier carácter que rompa la cadena — o sea ambiguo — debe escaparse con barra invertida.

Secuencias de escape habituales

SecuenciaSignificado
\"Comilla doble dentro de una cadena
\\Barra invertida literal
\nSalto de línea
\tTabulación
\rRetorno de carro
\bRetroceso
\fAvance de página

Ejemplo:

{
  "message": "Line one\nLine two",
  "path": "C:\\Users\\dev\\config.json"
}

Escapes Unicode

Usa \uXXXX para un punto de código Unicode con exactamente cuatro dígitos hexadecimales:

{
  "greeting": "Hello, \u4e16\u754c"
}

Para caracteres fuera del Plano Multilingüe Básico, los pares sustitutos UTF-16 aparecen como dos escapes \u en JSON; la mayoría de editores y parsers lo manejan al leer/escribir archivos UTF-8.

Caracteres que no puedes poner en bruto en cadenas

Los caracteres de control (U+0000 a U+001F) deben escaparse. Los saltos de línea sin escapar dentro de cadenas son JSON inválido — usa \n en su lugar.

Archivos UTF-8 frente a Unicode escapado

Un archivo .json guardado como UTF-8 puede contener caracteres chinos o emoji literales:

{ "label": "世界" }

Es JSON válido. Las formas escapadas \u son equivalentes cuando se normalizan — elige la que mantenga más contento a tu pipeline y herramientas de diff.

Consejos prácticos

  • Al copiar cadenas desde logs, cuidado con comillas tipográficas " " — no son delimitadores JSON válidos.
  • La documentación de APIs suele mostrar \n en ejemplos; tu parser los convierte a saltos de línea reales en memoria.
  • Si la validación falla dentro de una cadena larga, busca barras invertidas sin escapar o secuencias \u rotas.

Volver al resumen del curso