Zum Inhalt springen
L

Wikipedia · einfach zusammengefasst · Stand

Uniform Resource Identifier

Ein Uniform Resource Identifier (Abk. URI; englisch für „einheitlicher Bezeichner für Ressourcen“) ist ein Identifikator und besteht aus einer Zeichenfolge, …

Inhalt5 Abschnitte
  1. 1. Begriff und Grundidee
  2. 2. Bestandteile und allgemeine Syntax
  3. 3. Bedeutung der Bestandteile
  4. 4. Absolute und relative Referenzen
  5. 5. Schemata, Unterarten und Beispiele

Begriff und Grundidee

Ein Uniform Resource Identifier (URI) ist eine Zeichenfolge, die eine abstrakte oder physische Ressource eindeutig bezeichnet. Solche Ressourcen können beispielsweise Webseiten, Dateien, Webservices oder E-Mail-Empfänger sein. Auch Menschen, Organisationen, gedruckte Bücher, mathematische Begriffe und Zahlen können als Ressourcen gelten. Eine Ressource muss also weder eine Datei noch über das Internet erreichbar sein. Der maßgebliche Standard ist RFC 3986 von Januar 2005.

URIs bestehen nur aus druckbaren ASCII-Zeichen. Internationalized Resource Identifiers (IRIs) erweitern dieses Konzept auf weitere Zeichen. In digitalen Dokumenten, besonders in HTML, können URIs als Verweise eingebunden werden; ein Verweis von einer Webseite auf eine andere heißt Hyperlink oder kurz Link.

Das URI-Konzept kennt drei grundlegende Anwendungen:

  • Ein Name kennzeichnet den Inhalt einer Ressource und damit alle inhaltsgleichen Kopien. Beispiel: Die ISBN bezeichnet ein Buch unabhängig davon, wie viele Exemplare existieren.
  • Ein Locator kennzeichnet eine Ressource über ihren Ort. Bei einem aktuellen Wetterbericht bleibt etwa die URL gleich, obwohl sich der Inhalt ändert.
  • Ein Individuum oder eine andere zuordenbare Entität kann ebenfalls identifiziert werden, auch wenn es sich nicht um eine klassische Informationsressource handelt. Beispiele sind eine Person, eine Firma, ein Reisepass, eine Sozialversicherungsnummer oder ein abstrakter mathematischer Wert.

Bestandteile und allgemeine Syntax

Nach RFC 3986 kann ein URI aus fünf Bestandteilen bestehen: scheme, authority, path, query und fragment. Nur das Schema und der Pfad sind immer vorhanden. Die allgemeine Syntax lautet:

URI = scheme ":" hier-part [ "?" query ] [ "#" fragment ]

Der hierarchische Teil „hier-part“ umfasst eine optionale Authority und den Pfad. Wird eine Authority verwendet, beginnt sie mit zwei Schrägstrichen „//“; der folgende Pfad muss dann mit einem Schrägstrich beginnen.

Beim Beispiel „foo://example.com:8042/over/there?name=ferret#nose“ ist „foo“ das Schema, „example.com:8042“ die Authority, „/over/there“ der Pfad, „name=ferret“ die Abfrage und „nose“ das Fragment. Nicht jeder URI besitzt jedoch alle Teile: „urn:example:animal:ferret:nose“ kommt beispielsweise ohne Authority, Abfrage und Fragment aus.

Bedeutung der Bestandteile

Das Schema steht vor dem ersten Doppelpunkt. Es legt den Typ und den Interpretationskontext des URI fest. Bekannte Schemata sind etwa http und ftp für Protokolle sowie urn und doi für Bezeichnungssysteme. Besteht kein Bezug zu einer zentral verwaltenden Authority, folgt der Pfad unmittelbar auf den Doppelpunkt.

Die Authority bezeichnet die für einen Namensraum zuständige Instanz. Sie besteht aus einer optionalen Benutzerinformation mit anschließendem „@“, einem Host und einer optionalen Portnummer nach einem Doppelpunkt. Der Host kann ein registrierter Name, eine IP-Adresse oder eine in eckige Klammern gesetzte IPv6-Adresse sein, beispielsweise „de.wikipedia.org“, „192.0.2.16:80“ oder „[2001:db8::7]“. Die Schreibweise „user:password@…“ gilt nach RFC 3986 als überholt und sollte nicht verwendet werden, weil URIs häufig im Klartext übertragen und protokolliert werden.

Der Pfad enthält häufig hierarchisch geordnete Angaben zur Ressource. Bei vorhandener Authority muss er mit „/“ beginnen; ohne Authority darf er nicht mit „//“ anfangen. Beispiele sind „/over/there“ und „example:animal:ferret:nose“.

Die optionale Abfrage, auch Query-String genannt, liefert zusätzliche Daten, wenn der Pfad allein eine Ressource nicht genau bestimmt. Sie beginnt mit „?“ und endet vor einem Fragment oder am URI-Ende. Ein Beispiel ist „title=Uniform_Resource_Identifier&action=submit“.

Das optionale Fragment verweist auf eine Stelle innerhalb der zuvor bezeichneten Ressource. Es beginnt mit „#“; ein typischer Fall ist ein Anker in einem HTML-Dokument.

Absolute und relative Referenzen

URI-Referenzen umfassen vollständige und verkürzte Schreibweisen. Verkürzungen sparen Platz und erleichtern beispielsweise den Umzug von Inhalten auf einen anderen Server.

Ein absoluter URI identifiziert eine Ressource unabhängig vom Verwendungskontext. Er enthält mindestens ein Schema und einen hierarchischen Teil, also eine Authority und/oder einen Pfad. Beispiele sind „https://de.wikipedia.org“ und „file://localhost/var/spool/dump.bin“.

Beginnt eine URI-Referenz nicht mit einem Schema, gilt sie als relative Referenz. Sie beschreibt die Abweichung vom absoluten URI des aktuellen Kontexts und wird nach standardisierten Regeln zu einem absoluten URI aufgelöst. Sie besteht aus einem Pfad sowie optional aus Abfrage und Fragment. Es gibt drei Formen:

  • Eine relative Pfad-Referenz beginnt ohne Schrägstrich, beispielsweise „image.png“, „./image.png“ oder „../images/image.png“.
  • Eine absolute Pfad-Referenz beginnt mit einem einzelnen Schrägstrich.
  • Eine Netzwerk-Pfad-Referenz beginnt mit zwei Schrägstrichen.

Eine Referenz kann auch auf das Dokument zeigen, in dem sie selbst steht. Besonders häufig geschieht dies mit „#“ und einem Fragmentbezeichner.

Schreibweisen wie „www.wikipedia.de“, bei denen das Schema fehlt und aus einem Namensbestandteil erschlossen werden soll, heißen Suffix-Referenzen. Ihre Auswertung hängt von Annahmen und der verwendeten Software ab; deshalb sollten sie vermieden werden.

Schemata, Unterarten und Beispiele

Das Schema zeigt, nach welchen Regeln ein URI zu verstehen ist. Offizielle Beispiele sind „http“ für das Hypertext Transfer Protocol, „ftp“ für das File Transfer Protocol, „file“ für lokale Dateien, „geo“ für geografische Koordinaten, „mailto“ für E-Mail-Adressen, „tel“ für Telefonnummern, „data“ für direkt eingebettete Daten, „ldap“ für das Lightweight Directory Access Protocol, „sip“ für den Sitzungsaufbau etwa bei IP-Telefonie, „ws“ und „wss“ für WebSockets sowie „urn“ für Uniform Resource Names. Die vollständige offizielle Liste führt die Internet Assigned Numbers Authority (IANA). Daneben gibt es als „vorläufig“ bezeichnete oder inoffizielle Schemata, darunter „doi“, „git“, „irc“, „magnet“, „sftp“, „ssh“ und „webcal“.

Traditionell werden zwei Unterarten hervorgehoben:

  • Ein Uniform Resource Locator (URL) bezeichnet eine Ressource über ihren primären Zugriffsmechanismus, beispielsweise http oder ftp, und ihren Ort im Netz, meist einen Domain-Namen. Weil URLs ursprünglich die einzige URI-Art waren, werden „URL“ und „URI“ häufig gleichbedeutend verwendet.
  • Ein Uniform Resource Name (URN) identifiziert eine Ressource durch einen vorhandenen oder frei vergebenen Namen, etwa mit „urn:isbn“ oder „urn:sha1“.

Die ursprünglich geplante strenge Einteilung jedes URI in URL oder URN wurde aufgegeben. Sie ist unnötig, und Schemata wie „data“ und „mailto“ passen nicht eindeutig in diese beiden Klassen.

Typische vollständige Beispiele sind „https://de.wikipedia.org/wiki/Uniform_Resource_Identifier“, „mailto:[email protected]“, „geo:48.33,14.122;u=22.5“ und „urn:oasis:names:specification:docbook:dtd:xml:4.1.2“. Ein Beispiel mit besonders vielen Bestandteilen ist „http://nobody:[email protected]:8080/cgi-bin/script.php?action=submit&pageid=86392001#section_2“: Es enthält Schema, Benutzerinformation, Host, Port, Pfad, Abfrage und Fragment; die darin gezeigte Passwortangabe gilt allerdings als überholt.

Lernvideos zu Uniform Resource Identifier

Weiterlesen

Ressource Eine Ressource kann ein materielles oder immaterielles Gut sein. In Betriebswirtschaft, Volkswirtschaft und Organisationen werden darunter meist Betriebsmittel, … E-Mail Die oder das E-Mail (englisch [ˈiːmeɪl], im Deutschen kurz Mail; englisch electronic mail für „elektronische Post“ oder „elektronischer Brief“) ist zum … Internet Mit Social-Media-Plattformen wie Facebook, Twitter oder YouTube trat das bidirektionale Austauschen von Inhalten unter den Nutzern (sogenanntem user … World Wide Web ... Trennung von Inhalt und Darstellung. Durch diese Trennung können die in HTML ausgezeichneten Inhalte optimal für das jeweilige Ausgabegerät aufbereitet werden. Tim Berners-Lee Sir Timothy John Berners-Lee, OM, KBE, FRS, FRSA (* 8. Juni 1955 in London) ist ein britischer Physiker und Informatiker. Er ist der Entwickler der … Zeichensatz Traditionell in der Informatik bekannte Zeichenkodierungen sind der ASCII- und der EBCDIC-Code. Letzterer hat allerdings stark an Bedeutung verloren … Hypertext Markup Language Die Hypertext Markup Language (HTML, englisch für Hypertext-Auszeichnungssprache) ist eine textbasierte Auszeichnungssprache zur Strukturierung … Hyperlink Es wird technisch nachgewiesen, dass es keinen Unterschied mache, ob man eine URL textlich nenne oder ob man die URL mit einem Link (eben der URL) verlinke. American Standard Code for Information Interchange Der American Standard Code for Information Interchange (ASCII, alternativ US-ASCII, ausgesprochen [ˈæski], deutsch „Amerikanischer Standard-Code für den … Internationale Standardbuchnummer Internationale Standardbuchnummer. Nummer zur eindeutigen Kennzeichnung von Büchern und anderen Veröffentlichungen. Artikel · Diskussion. Hypertext Transfer Protocol Das Hypertext Transfer Protocol (HTTP; englisch für Hypertext-Übertragungsprotokoll) ist ein 1991 eingeführtes zustandsloses Protokoll zur Übertragung von … Uniform Resource Name Aufbau. Bearbeiten. Syntax-Diagramm. URNs sind URIs mit dem Schema urn . Der Schema-spezifische Teil des URIs ist weiter in Namensräume (NIDs, Namespace …