
Un URI (Uniform Resource Identifier o identificador uniforme de recursos) es una secuencia de caracteres que identifica un recurso mediante un esquema determinado. El recurso puede ser un documento, una imagen, un servicio, una persona, un concepto o cualquier otra entidad que el esquema permita distinguir. Un URI sirve para identificar; no implica necesariamente que el recurso pueda recuperarse a través de una red.
Índice de contenidos
Diferencias entre URI, URL, URN e IRI
URI es el concepto general definido por la sintaxis de Internet. Dentro de ese marco se han utilizado varias denominaciones que responden a funciones o representaciones diferentes:
- URL: identifica un recurso indicando un mecanismo o una ubicación para acceder a él. Las direcciones HTTPS utilizadas en la web son el ejemplo más habitual. Según la clasificación de RFC 3986, una URL es un URI.
- URN: es un URI que utiliza el esquema
urny un espacio de nombres. Se asigna con la intención de proporcionar un identificador persistente e independiente de la ubicación, como ocurre con determinados identificadores bibliográficos. - IRI: amplía la representación de los URI para admitir caracteres del repertorio Unicode. Para intercambiarse en contextos que esperan la sintaxis URI, esos caracteres necesitan una conversión o codificación adecuada.
- Referencia URI: puede ser un URI completo o una referencia relativa que se resuelve utilizando un URI base.
En la plataforma web actual, los navegadores aplican el URL Standard de WHATWG para analizar y serializar direcciones. Este estándar utiliza de forma general el término URL y define algoritmos compatibles con el comportamiento real de los navegadores. La distinción conceptual de URI sigue siendo útil para comprender identificadores que no funcionan como una dirección web convencional.
Un URI no debe confundirse con la URL visible utilizada en determinados anuncios. Esta última es una representación mostrada al usuario y puede no coincidir carácter por carácter con la dirección final, dentro de las reglas de la plataforma publicitaria.
Componentes de un URI
La sintaxis genérica de RFC 3986 organiza un URI a partir de un esquema y varios componentes opcionales. La forma general puede expresarse como esquema:, aunque cada esquema define requisitos propios.
En https://, los componentes son:
- Esquema:
httpsindica cómo debe interpretarse el resto del identificador. - Autoridad:
www.ejemplo.com:443puede incluir información de usuario, host y puerto. Las credenciales dentro de una dirección presentan riesgos y no deberían exponerse. - Ruta:
/carpeta/recursoidentifica una ubicación jerárquica dentro de la autoridad. - Consulta:
idioma=esaporta datos que el recurso o la aplicación pueden utilizar. - Fragmento:
seccionidentifica una parte o vista secundaria. El fragmento no se envía al servidor en una petición HTTP.
No todos los URI contienen autoridad, ruta jerárquica o consulta. Por ejemplo, mailto:usuario@ejemplo.com utiliza el esquema mailto y una estructura definida específicamente para él. El esquema no es siempre un protocolo de red: también establece cómo se interpreta y procesa el identificador.
Caracteres, codificación y referencias relativas
Algunos caracteres tienen funciones reservadas como separadores. Otros pueden representarse mediante codificación porcentual, utilizando un signo de porcentaje seguido del valor hexadecimal de los bytes correspondientes. Codificar o decodificar sin conocer el componente puede cambiar el significado del identificador, por lo que no debe aplicarse indiscriminadamente a toda la cadena.
Una referencia relativa omite el esquema y se interpreta respecto a una base. Desde https://, la referencia otra puede resolverse como https://, mientras que /otra parte de la raíz del mismo host. Los segmentos . y .. intervienen en este proceso de resolución.
El navegador, una API o una aplicación debe utilizar un analizador de URL adecuado en lugar de separar componentes mediante operaciones simples de texto. Casos como IPv6, caracteres internacionalizados, puertos, consultas repetidas o rutas codificadas pueden producir resultados incorrectos si se procesan manualmente.
Equivalencia, web y seguridad
Dos URI diferentes pueden identificar el mismo recurso, y dos cadenas parecidas pueden identificar recursos distintos. El esquema y el host de una URL HTTP no distinguen mayúsculas y minúsculas, pero la ruta puede hacerlo según el servidor. Los puertos predeterminados, la codificación porcentual y determinados segmentos de ruta también influyen en la comparación.
En una web, variantes accesibles del mismo contenido pueden fragmentar las señales de rastreo y medición. Las redirecciones, los enlaces internos coherentes y rel canonical ayudan a declarar la versión preferida, pero no convierten todas las variantes en cadenas idénticas. Un slug es solo una parte de la ruta y no representa por sí solo el URI completo.
Un URI tampoco acredita que el destino sea seguro o legítimo. El esquema HTTPS protege la conexión cuando la validación y la configuración son correctas, pero no garantiza la fiabilidad del contenido. Antes de utilizar un identificador conviene revisar el esquema, el host real, la codificación, los posibles caracteres confusos y la presencia de datos sensibles en la consulta.
URI proporciona una sintaxis extensible para identificar recursos en diferentes sistemas. Comprender sus componentes y reglas permite construir, resolver y comparar referencias sin reducir el concepto a una dirección web ni asumir que toda cadena identificadora conduce a un recurso accesible.
