Definición:
Una URL es un identificador que localiza un recurso e indica cómo acceder a él. Su nombre procede de Uniform Resource Locator. Es un tipo de URI y puede señalar una página web, una imagen, un archivo, un servicio o cualquier otro recurso asociado a un esquema reconocido. Aunque dirección web y URL suelen utilizarse como equivalentes, el concepto no se limita a documentos HTML ni al protocolo HTTP.
Índice de contenidos
Estructura y componentes de una URL
La sintaxis genérica definida en RFC 3986 organiza una URL en componentes. No todos tienen que aparecer y su interpretación depende del esquema utilizado. En una dirección como https://, pueden distinguirse los siguientes elementos:
- Esquema:
httpsindica las reglas que deben utilizarse para interpretar y recuperar el recurso. Un esquema no siempre equivale a un protocolo de red. - Autoridad: comienza después de
//y puede contener información de usuario, host y puerto. En la web suele incluir el nombre de dominio. - Ruta: identifica una ubicación dentro del espacio gestionado por el servidor. Su aspecto jerárquico no demuestra que exista un directorio físico equivalente.
- Consulta: empieza con
?y transporta parámetros cuya estructura y significado define la aplicación. - Fragmento: empieza con
#e identifica una parte o estado dentro del recurso. Normalmente se procesa en el cliente y no se envía al servidor en una petición HTTP.
El host no es necesariamente un servidor concreto. Puede resolver hacia varias máquinas, una red de distribución o un intermediario. El puerto también puede omitirse cuando se utiliza el valor predeterminado del esquema. Por ello, expresiones como servidor, directorio y página describen solo algunos casos y no constituyen una gramática general de URL.
El esquema y el host se tratan sin distinguir mayúsculas y minúsculas en los usos web habituales, pero la ruta, la consulta o el fragmento pueden tener reglas diferentes. Cambiar letras, barras, parámetros o codificación sin conocer la aplicación puede producir otra dirección o un error.
URL absoluta, referencia relativa y resolución
Una URL absoluta incluye la información necesaria para localizar el recurso sin depender de otra dirección. Una referencia relativa omite partes y se resuelve utilizando una URL base. Por ejemplo, images/logo.png puede convertirse en una dirección distinta según la página o el elemento base desde el que se interprete.
Las referencias que empiezan por / conservan el origen y sustituyen la ruta; las que comienzan por // heredan el esquema, pero aportan otra autoridad. Los segmentos . y .. representan operaciones sobre la ruta durante la resolución. No deben confundirse con redirecciones realizadas por un servidor.
El estándar URL de WHATWG define el análisis y la serialización utilizados por los navegadores modernos. Esto explica por qué una cadena introducida en la barra de direcciones puede normalizarse antes de mostrarse o enviarse. La forma visible, la cadena copiada y la representación utilizada internamente no siempre son idénticas carácter por carácter.
Caracteres, codificación y normalización
Una URL utiliza un repertorio de caracteres con funciones reservadas. Los dos puntos, las barras, el signo de interrogación, la almohadilla y otros delimitadores no pueden interpretarse siempre como texto ordinario. Cuando un carácter no es válido en una posición o tendría otra función, puede representarse mediante codificación porcentual, formada por % y dos dígitos hexadecimales.
La codificación no equivale a cifrado y no oculta información. Un correo, identificador o dato personal incluido en la consulta puede quedar expuesto en historiales, registros, analítica, cabeceras de referencia y herramientas externas. Los secretos y credenciales no deben transportarse en una URL solo porque aparezcan codificados.
Los nombres de dominio internacionalizados pueden mostrarse con caracteres Unicode y representarse mediante Punycode para su resolución. Esta diferencia facilita direcciones localizadas, pero también puede utilizarse para crear nombres visualmente parecidos. El usuario debe comprobar el host real antes de introducir datos o descargar archivos.
Dos URLs diferentes pueden conducir a contenidos equivalentes sin ser cadenas idénticas. Los puertos predeterminados, mayúsculas permitidas, segmentos vacíos, parámetros, barras finales y variantes codificadas pueden afectar a la comparación. La normalización debe seguir las reglas del esquema y de la aplicación; no existe una transformación universal que pueda aplicarse sin riesgo.
Al abrir una URL web, el navegador analiza sus componentes, resuelve el host, establece la conexión requerida y construye una petición para la ruta y la consulta. El servidor puede devolver el recurso, un error o una redirección hacia otra dirección. El fragmento se aplica después sobre la respuesta y no forma parte normalmente de la petición HTTP.
La URL solicitada puede diferir de la dirección final por redirecciones, reglas de reescritura, selección de idioma, autenticación o navegación dentro de una aplicación. La URL visible describe la dirección mostrada en determinados contextos publicitarios y no sustituye la URL de destino ni la cadena que finalmente carga el navegador.
HTTPS protege el transporte entre el cliente y el extremo con el que establece la conexión, siempre que la validación sea correcta. No demuestra que el contenido sea verdadero, que el sitio sea legítimo ni que una descarga sea segura. El host, la ruta y la procedencia del enlace siguen necesitando evaluación.
URL, SEO y medición
Los buscadores utilizan URLs para descubrir, solicitar y diferenciar recursos. Una estructura estable y comprensible facilita el mantenimiento y el enlazado, pero incluir palabras en la ruta no garantiza una posición. Google recomienda estructuras de URL sencillas, parámetros coherentes y caracteres legibles cuando sea posible.
Una misma página puede ser accesible mediante parámetros de seguimiento, filtros, ordenaciones, diferencias de protocolo o variantes de host. Si esas direcciones no aportan recursos distintos, pueden fragmentar señales y consumo de rastreo. Redirecciones, enlaces internos y Rel Canonical ayudan a indicar la versión preferida, pero deben reflejar el comportamiento real del sitio.
El slug es solo una parte de la ruta, no la URL completa. Cambiarlo altera la dirección y puede requerir una redirección permanente, actualización del enlazado, sitemap, hreflang, datos estructurados y sistemas de medición. Una migración no queda resuelta únicamente modificando el texto visible.
Las plataformas de analítica pueden tratar consulta, fragmento, host y protocolo de formas diferentes. Antes de comparar páginas o campañas deben definirse reglas para parámetros, mayúsculas, barras finales y referencias cruzadas. Una URL es una cadena técnica con efectos en navegación, seguridad, indexación y medición; interpretarla exige conservar sus componentes y el contexto en el que se utiliza.
