Zum Inhalt springen

Glossar HTML

Was ist HTML?

Definition

HTML (HyperText Markup Language) ist die Sprache, in der Struktur und Bedeutung der Inhalte einer Webseite festgelegt werden: was eine Überschrift ist, was ein Absatz, was ein Link oder ein Bild.

Auf dieser Seite 5
  1. Was HTML bedeutet
  2. Wie es funktioniert
  3. Warum es zählt
  4. Best Practices
  5. Häufige Fehler
Kurz gefasst

HTML gibt einer Webseite Struktur und Bedeutung: was es ist, wie Browser und Suchmaschinen es lesen und was KI-Crawler davon tatsächlich sehen.

Was HTML bedeutet

MDN beschreibt HTML als den grundlegendsten Baustein des Webs: Es legt Bedeutung und Struktur der Inhalte fest. Für das Aussehen ist CSS zuständig, für interaktives Verhalten JavaScript. HTML ist eine Auszeichnungssprache: Sie kennzeichnet jeden Teil des Textes mit Tags, die sagen, was er ist, ohne etwas zu berechnen oder zu entscheiden.

Jedes Tag steht zwischen spitzen Klammern. Das Tag h1 öffnet die Hauptüberschrift, seine Fassung mit Schrägstrich schließt sie; das Tag p kennzeichnet einen Absatz; das Tag a mit dem Attribut href erzeugt einen Link. Tags können Attribute mit zusätzlichen Angaben tragen, etwa das Ziel eines Links, den Alternativtext eines Bildes oder die Sprache der Seite.

Maßgeblich ist der HTML Living Standard der WHATWG, ein Dokument, das laufend aktualisiert wird: Die letzte veröffentlichte Fassung stammt vom 7. Oktober 2026. Nummerierte Versionen gibt es nicht mehr, Änderungen fließen in den lebenden Standard ein, sobald Browser sie übernehmen.

Wie es funktioniert

Öffnet jemand eine Seite, lädt der Browser das HTML vom Server, liest es von oben nach unten und baut daraus eine Struktur im Speicher, das DOM. Unterwegs findet er Verweise auf weitere Dateien wie Stylesheets, Skripte und Bilder und lädt auch diese. Mit allem zusammen zeichnet er die Seite auf den Bildschirm.

Eine Seite kann auf zwei Wegen beim Browser ankommen. Beim serverseitigen Rendering enthält das HTML bereits den vollständigen Inhalt. Beim clientseitigen Rendering schickt der Server ein fast leeres HTML, und JavaScript füllt den Inhalt erst danach im Browser nach. Für den Menschen vor dem Bildschirm kann das Ergebnis identisch sein. Für einen Crawler, der kein JavaScript ausführt, nicht: Im zweiten Fall ist die Seite leer.

Suchmaschinen lesen das HTML mit einem anderen Ziel als der Browser. Sie wollen verstehen, was die Seite sagt und wie sie mit anderen zusammenhängt: Title und Meta-Description, Überschriften, Text, Links, das Canonical-Tag, die Sprachvarianten (hreflang) und die strukturierten Daten.

Prüfen lässt sich das am Quelltext, nicht am Browserfenster.

Warum es zählt

Für SEO ist das HTML die Fassung der Seite, die wirklich zählt. Ein Titel, der nur als Bild existiert, ein Text, der erst per Klick geladen wird, oder ein Link, der ein Button ohne href ist, bleibt für einen Crawler unsichtbar oder unklar, auch wenn ein Mensch ihn mühelos versteht.

In der KI-Suche ist der Unterschied noch größer. Im Dezember 2024 veröffentlichte Vercel eine Auswertung des Crawler-Verkehrs in seinem Netz mit dem Ergebnis, dass keiner der großen KI-Crawler, darunter die von OpenAI, Anthropic und Perplexity, JavaScript ausführte; nur Gemini, das die Infrastruktur von Googlebot nutzt, und Applebot taten es. Was nicht im ursprünglichen HTML steht, gibt es für diese Crawler nicht.

Gemessen haben wir das in diesem Glossar selbst, am Eintrag zum CMS, am 8. Oktober 2026. Der Server liefert 186.694 Byte HTML aus, der lesbare Text belegt davon 12.769, weniger als 7 %. Der Rest sind Struktur, Komponenten-Styles und Skripte. Entscheidend ist, dass diese 2.049 Wörter samt den fünf häufigen Fragen schon im HTML stehen, das ohne jede Ausführung ankommt, zusammen mit genau einem h1, vierzehn h2, dem Sprachattribut lang mit dem Wert „es“ und vier hreflang-Verweisen (es, en, de und x-default). Genau das liest ein Crawler, der kein JavaScript ausführt.

Best Practices

  • Mit „Seitenquelltext anzeigen“ oder einer Anfrage ohne JavaScript prüfen, dass der Hauptinhalt im HTML steht, das der Server ausliefert.
  • Pro Seite genau ein h1 verwenden und eine Überschriftenhierarchie, die den tatsächlichen Aufbau des Textes abbildet.
  • Links als a-Tags mit href und echter URL setzen, nicht als Buttons oder JavaScript-Ereignisse.
  • Die Sprache mit dem Attribut lang angeben und, wenn es mehrere Fassungen gibt, diese per hreflang verknüpfen.
  • Bildern, die Informationen tragen, einen aussagekräftigen Alternativtext geben.
  • Das Markup ab und zu validieren: Ein fehlendes schließendes Tag kann dazu führen, dass ein ganzer Block falsch gelesen wird.

Häufige Fehler

  • Den Haupttext nur per JavaScript laden und davon ausgehen, dass alle Crawler ihn sehen.
  • Überschriften-Tags einsetzen, um Text größer zu machen, statt seine Hierarchie zu kennzeichnen.
  • Wichtige Inhalte hinter Reitern oder Akkordeons verstecken, die sich erst per Klick füllen.
  • Denselben Title und dieselbe Meta-Description auf vielen Seiten wiederholen.
  • Das, was der Browser-Inspektor zeigt und JavaScript bereits verändert hat, mit dem HTML verwechseln, das der Server geschickt hat.
Manuel Riveiro Rodriguez CEO & Digital Strategist

Eine technische Prüfung sieht sich das und alles Weitere in einem Durchgang an.

Audit anfragen

Häufige Fragen

Ist HTML eine Programmiersprache?

Nein. HTML ist eine Auszeichnungssprache: Sie gibt an, was jeder Teil des Inhalts ist, etwa Überschrift, Absatz oder Link, rechnet aber nichts und trifft keine Entscheidungen. Dafür gibt es JavaScript, für die optische Gestaltung CSS. Die drei arbeiten auf fast jeder Webseite zusammen.

Was ist der Unterschied zwischen HTML und CSS?

HTML legt fest, was etwas ist und in welcher Reihenfolge es erscheint. CSS legt fest, wie es aussieht: Farben, Schriften, Größen und Position. Man kann das Aussehen einer Seite komplett ändern, indem man nur das CSS anpasst, ohne das HTML anzufassen, und der Inhalt, den Suchmaschinen lesen, bliebe derselbe.

Wie wirkt sich HTML auf SEO aus?

HTML ist das, was Suchmaschinen lesen, um eine Seite zu verstehen: Title, Überschriften, Text, Links, Canonical, Sprache und strukturierte Daten. Steht der wichtige Inhalt nicht im HTML oder ist er falsch ausgezeichnet, versteht die Suchmaschine ihn schlechter oder sieht ihn gar nicht. Sauberes HTML garantiert keine guten Positionen, fehlerhaftes kann sie verhindern.

Lesen KI-Crawler das JavaScript einer Seite?

Laut der Auswertung, die Vercel im Dezember 2024 veröffentlicht hat, führten die großen KI-Crawler, etwa die von OpenAI, Anthropic und Perplexity, kein JavaScript aus; Gemini schon, weil es die Infrastruktur von Googlebot nutzt. Deshalb sollte der Inhalt bereits in dem HTML stehen, das der Server ausliefert.

Was ist HTML5?

Unter diesem Namen wurde die HTML-Fassung bekannt, die unter anderem semantische Tags wie header, nav, article und footer sowie native Unterstützung für Audio und Video einführte. Nummerierte Versionen gibt es heute nicht mehr: Die WHATWG pflegt den HTML Living Standard, der laufend aktualisiert wird.

Quellen

  1. MDN Web Docs, „HTML: HyperText Markup Language“ (englische Fassung). Quelle für die Beschreibung von HTML als grundlegendem Baustein des Webs, der Bedeutung und Struktur der Inhalte festlegt, neben CSS und JavaScript.
  2. WHATWG, „HTML Living Standard“, zuletzt aktualisiert am 7. Oktober 2026. Quelle für den maßgeblichen Standard und seine laufende Aktualisierung.
  3. Vercel, „The rise of the AI crawler“, 17. Dezember 2024. Quelle dafür, dass die untersuchten großen KI-Crawler kein JavaScript ausführten, mit Gemini und Applebot als Ausnahmen.