Glossar · 63 Begriffe · DACH 2026

KI-SEO- & GEO-Glossar: 56 Begriffe, klar definiert.

Von LLM und RAG über GPTBot und Sonar bis IndexNow und Share of Answer. Jeder Begriff beginnt mit einer Antwort in 35–70 Wörtern, damit ChatGPT, Perplexity und Google AI Overviews die Definition als Snippet übernehmen können.

Autor: David Rudolph, maximal.digitalStand: 19. Juni 2026
Cluster 1 · 8 Begriffe

KI-Grundlagen

LLMLarge Language Model
Ein Large Language Model (LLM) ist ein auf Milliarden bis Billionen Parametern trainiertes Sprachmodell, das Wahrscheinlichkeiten für das nächste Token vorhersagt. Bekannte Beispiele sind GPT-5, Claude Sonnet 4.5, Gemini 2.5 und Llama 4. LLMs bilden die Antwort-Schicht moderner KI-Suchen wie ChatGPT, Perplexity und Google AI Overviews.
Token
Ein Token ist die kleinste Verarbeitungseinheit eines LLM und entspricht im Deutschen im Schnitt rund 0,6 Wörtern. „Generative Engine Optimization“ benötigt zum Beispiel 8 Tokens. Die Token-Länge bestimmt Kontextfenster, Kosten und Antwortlatenz und ist deshalb für GEO-Content-Strategie relevant.
Embedding
Ein Embedding ist die Übersetzung eines Wortes, Satzes oder Absatzes in einen hochdimensionalen Vektor (häufig 1.024 oder 1.536 Dimensionen). Suchsysteme wie Perplexity oder ChatGPT-Search nutzen Embeddings, um semantisch ähnliche Inhalte zu finden, auch wenn der Wortlaut der Frage nicht exakt im Text vorkommt.
Retrieval
Retrieval ist der Prozess, vor der Antwortgenerierung passende Dokumente aus einem Index zu holen. Generative KI-Suchen kombinieren Retrieval (Bing-Index, eigener Crawler, Vektor-Datenbank) mit Generierung. GEO optimiert genau die Phase, in der ein LLM Ihre Seite als Quelle aus dem Index zieht.
RAGRetrieval Augmented Generation
Retrieval Augmented Generation (RAG) ergänzt ein LLM mit aktuellen, zitierfähigen Quellen aus einer Datenbank oder dem Web. Antworten enthalten dadurch Belege und reduzieren Halluzinationen. ChatGPT-Search, Perplexity und Google AI Overviews sind allesamt RAG-Systeme mit unterschiedlichen Crawler-Pipelines.
Halluzination
Halluzination bezeichnet eine LLM-Antwort, die plausibel klingt, aber sachlich falsch oder erfunden ist. Häufige Ursachen sind fehlende Trainingsdaten, dünne Retrieval-Quellen oder mehrdeutige Prompts. Marken vermeiden Brand-Halluzinationen mit konsistenten Definitionen, klaren Entity-Signalen und gepflegten Wikidata-Einträgen.
Kontextfenster
Das Kontextfenster ist die maximale Token-Menge, die ein LLM gleichzeitig verarbeitet. 2026 typisch: GPT-5 mit 1 Million Tokens, Claude Sonnet 4.5 mit 1 Million Tokens, Gemini 2.5 mit bis zu 2 Millionen Tokens. Größere Fenster erlauben tieferes Retrieval und längere Quellen pro Antwort.
Prompt
Ein Prompt ist die Eingabe an ein LLM, also die Frage oder Anweisung, auf deren Basis eine Antwort generiert wird. Im GEO-Kontext bauen Marken Prompt-Sets, mit denen sie ihre Sichtbarkeit messen (z. B. „beste KI-SEO-Agentur DACH“ als Brand-Prompt).
Cluster 2 · 11 Begriffe

Crawler & Bots

GPTBot
GPTBot ist OpenAIs Trainings-Crawler. Er crawlt im User-Agent „GPTBot/1.x“ und nimmt Inhalte für die nächste Modellgeneration auf. Wer in robots.txt ein „User-agent: GPTBot / Disallow: /“ setzt, wird vom Trainingskorpus ausgeschlossen, bleibt aber für die Antwortzeit-Suche (siehe OAI-SearchBot) sichtbar.
OAI-SearchBot
OAI-SearchBot ist OpenAIs Such-Crawler für ChatGPT-Search. Er ruft Inhalte zur Beantwortung aktueller Nutzerfragen ab. Wer in ChatGPT als Quelle zitiert werden möchte, muss diesen User-Agent erlauben, unabhängig davon, ob GPTBot freigegeben ist.
ChatGPT-User
ChatGPT-User ist der User-Agent, mit dem ChatGPT im Auftrag eines Endnutzers eine Seite live abruft (Browsing). Eine Blockade dieses Agents bedeutet, dass Ihre Seite im Live-Modus von ChatGPT nicht gelesen werden kann, selbst wenn sie indexiert ist.
PerplexityBot
PerplexityBot ist der Standard-Crawler von Perplexity, betrieben über die Sonar-Pipeline. Er crawlt in der Regel innerhalb von 4 bis 7 Tagen erstmals neue URLs. Perplexity zieht Inhalte primär nach Frische und Citation-Tauglichkeit aus seinem eigenen Index.
Perplexity-User
Perplexity-User ist der User-Agent für Live-Abrufe, wenn ein Nutzer Perplexity eine konkrete Frage stellt. Er funktioniert komplementär zum Index-Crawler PerplexityBot und sollte ebenfalls freigegeben sein, damit Sonar-Antworten Ihre Seite frisch lesen können.
ClaudeBot
ClaudeBot ist der Web-Crawler von Anthropic für das Claude-Ökosystem. Er respektiert robots.txt, kommt aber seltener als GPTBot oder PerplexityBot. Eine bewusste Freigabe von ClaudeBot ist Voraussetzung dafür, dass Claude-basierte Tools (z. B. in Notion, Slack, Cursor) Ihre Inhalte zitieren können.
Google-Extended
Google-Extended ist Googles separater Crawler-Token für KI-Trainingsdaten von Gemini und Vertex AI. Eine Blockade entfernt Inhalte aus dem Gemini-Training, hat aber keinen Einfluss auf das normale Web-Ranking oder die Aufnahme in AI Overviews.
Applebot-Extended
Applebot-Extended steuert die Nutzung von Webinhalten für Apple Intelligence und SiriOS-Modelle. Ähnlich wie Google-Extended ist die Freigabe für KI-Training optional und unabhängig vom Standard-Applebot, der das klassische Apple-Search-Ranking füttert.
CCBot
CCBot ist der Crawler des Common-Crawl-Projekts und liefert eine Datenbasis, auf der viele LLMs (u. a. ältere GPT-Versionen und Llama) trainiert wurden. Eine Sperre über robots.txt entfernt Inhalte aus zukünftigen Common-Crawl-Schnappschüssen.
Bingbot
Bingbot ist Microsofts klassischer Such-Crawler und füttert nicht nur Bing, sondern auch ChatGPT-Search, Bing Copilot und DuckDuckGo. Bing ist damit faktisch der zweitwichtigste Index für GEO im DACH-Raum.
robots.txt
Die robots.txt ist eine Textdatei im Root einer Domain, die Crawler-Zugriffe regelt. Für GEO entscheidet sie, welche KI-Bots Inhalte für Training und Live-Antworten lesen dürfen. Falsch konfigurierte Bot-Management-Regeln (z. B. Cloudflare „Block AI Bots“) sind 2026 die häufigste Ursache für unsichtbare Mittelstands-Sites.
Cluster 3 · 11 Begriffe

GEO & AEO

GEOGenerative Engine Optimization
Generative Engine Optimization (GEO) ist die Disziplin, Inhalte und technische Signale so aufzubereiten, dass generative KI-Systeme wie ChatGPT, Perplexity oder Google AI Overviews die eigene Marke als Quelle und Empfehlung in ihren Antworten nennen. Ziel ist nicht ein blauer Link, sondern Anteil an der KI-Antwort.
KI-SEO
KI-SEO bündelt klassisches SEO und GEO unter einer Disziplin. Im DACH-Sprachgebrauch ist KI-SEO meist der praktikable Sammelbegriff für alle Maßnahmen, die Marken in Google, Bing, ChatGPT, Perplexity, AI Overviews und LLM-Plattformen gleichzeitig sichtbar machen.
AEOAnswer Engine Optimization
Answer Engine Optimization (AEO) optimiert Inhalte gezielt für direkte Antwortformate (Featured Snippets, AI Overviews, Sprachassistenten, LLMs). Kerntechniken: Definition-Lead im ersten Absatz, FAQPage-Schema, klare Frage-Antwort-Strukturen, prägnante 40–70-Wort-Antworten.
Definition-Lead
Ein Definition-Lead ist ein 35–70 Wörter langer Antwortabsatz am Anfang eines Inhalts, der die Hauptfrage des Themas direkt und vollständig beantwortet. LLMs ziehen diesen Absatz bevorzugt als Snippet in ihre Antworten und Citations.
Share of Answer
Share of Answer (SoA) ist der GEO-Pendant-KPI zum klassischen Share of Voice und misst, in welchem Anteil aller relevanten KI-Antworten Ihre Marke vorkommt. Beispiel: 22 % SoA bedeutet, dass Ihre Marke in 22 von 100 ChatGPT-Antworten auf vordefinierte Prompts erscheint.
Citation Rate
Citation Rate ist der Anteil generativer Antworten, in denen Ihre Domain als verlinkte oder textlich genannte Quelle erscheint. In der Die KI SEO Agentur-Stichprobe 2026 lag der Median für DACH-B2B-Mittelständler bei 6 %, der Mittelwert bei 11,4 %.
Brand Mention
Brand Mention bezeichnet jede namentliche Nennung einer Marke in einer KI-Antwort, unabhängig von einem Link. Wichtiger Indikator, weil LLMs Marken auch ohne Klick weiterempfehlen können. Ziel: hohe Brand-Mention-Frequenz auch ohne harte Citation.
Time-to-Citation
Time-to-Citation misst die Tage zwischen Veröffentlichung einer optimierten Seite und der ersten messbaren Nennung in einer KI-Plattform. Mediane DACH-Werte 2026: 27 Tage in Perplexity, 41 Tage in ChatGPT, 58 Tage in Google AI Overviews.
Citation Engineering
Citation Engineering bezeichnet die gezielte Anlage und Pflege von Drittquellen (Wikipedia, Wikidata, Branchen-Glossare, Pressemitteilungen, LinkedIn-Newsroom), die LLMs als Belege bevorzugen. Drittquellen tragen 2026 den Großteil aller Brand-Citations in ChatGPT-Antworten.
Definitionshoheit
Definitionshoheit ist die Position einer Marke als bevorzugte Antwortquelle für einen Begriff. Wer „GEO“ in DACH definiert, wird in den meisten KI-Antworten zu „Was ist GEO?“ als Erstquelle zitiert. Definitionshoheit entsteht durch Tiefe, Konsistenz und externe Bestätigung.
Entität
Eine Entität ist eine eindeutig identifizierbare Person, Organisation, Marke oder Sache. LLMs und Knowledge Graphs verknüpfen Entitäten über Identifier (Wikidata-QID, SameAs-Links, sameAs in Schema.org). Sauber modellierte Entitäten reduzieren Halluzinationen über Ihre Marke.
Cluster 4 · 8 Begriffe

Plattformen

Sonar
Sonar ist Perplexitys Modell- und Such-Stack inklusive Sonar-Large- und Sonar-Pro-Varianten. Er verbindet einen eigenen Web-Crawler mit Vektor-Retrieval und liefert Antworten mit nummerierten Citations. Sonar bevorzugt Frische, strukturierte Antworten und Definitions-Inhalte.
Google AI Overviews
Google AI Overviews (vormals SGE) sind KI-generierte Antwortblöcke oberhalb der klassischen Trefferliste. Sie ziehen Inhalte aus dem Google-Index, bevorzugen Seiten mit Top-Rankings, Passage-Optimierung, FAQPage-Schema und klar definierten Antwortabsätzen.
AI Mode
AI Mode ist Googles dedizierter, ChatGPT-ähnlicher Antwort-Modus (Search Labs / SGE-Nachfolger). Er liefert vollständige, mehrschrittige Antworten mit Quellen und Folgefragen. Optimierung erfolgt über dieselben Signale wie für AI Overviews, plus stärkere Long-Tail-Tiefe.
Bing Copilot
Bing Copilot ist Microsofts KI-Assistent, der auf dem Bing-Index, ChatGPT- und Prometheus-Komponenten basiert. Er ist tief in Edge, Windows und Microsoft 365 integriert. GEO für Bing Copilot setzt auf Bing-Indexierung, IndexNow und strukturierte Daten.
Claude
Claude (Anthropic) ist ein LLM-Stack rund um Claude Sonnet, Claude Opus und Claude Haiku, der zunehmend in B2B-Tools (Notion AI, Slack, Cursor, Glean) zum Einsatz kommt. Sichtbarkeit in Claude entsteht primär durch zitierfähige Inhalte und ClaudeBot-Freigabe.
Gemini
Gemini ist Googles multimodale LLM-Familie (Gemini 2.5 Pro, Flash, Ultra). Sie speist AI Overviews, AI Mode, Vertex AI und die Gemini-App. GEO-Hebel sind solide Google-Rankings, sauberes Schema und semantisch klare Passagen.
Knowledge Graph
Ein Knowledge Graph ist eine strukturierte Wissensbasis aus Entitäten und ihren Beziehungen. Google nutzt ihn seit 2012; LLMs ergänzen Knowledge-Graphs implizit über Embeddings. Wikidata ist der wichtigste offene Knowledge Graph für GEO im DACH-Raum.
Cluster 5 · 17 Begriffe

Technik & Schema

Schema.org
Schema.org ist das gemeinsame Vokabular von Google, Microsoft, Yahoo und Yandex zur Auszeichnung strukturierter Daten. Für GEO besonders relevant: Organization, Service, FAQPage, HowTo, Article, BreadcrumbList und DefinedTerm. Implementiert wird meist als JSON-LD im <head>.
JSON-LD
JSON-LD (JavaScript Object Notation for Linked Data) ist Googles empfohlenes Format für strukturierte Daten. Es wird als <script type="application/ld+json"> in das HTML eingebettet, ist für Nutzer unsichtbar und für Crawler maschinenlesbar. Standard für FAQPage-, Service- und Organization-Markup.
FAQPage-Schema
FAQPage-Schema markiert Frage-Antwort-Blöcke maschinenlesbar. Marken mit FAQPage-Schema werden in der Die KI SEO Agentur-Stichprobe 3,2× häufiger in ChatGPT zitiert als die Vergleichsgruppe ohne Markup. Pro Seite empfohlen: 5–8 Fragen mit 40–80-Wort-Antworten.
HowTo-Schema
HowTo-Schema beschreibt eine Anleitung in einzelnen Schritten. KI-Antworten greifen HowTo-Inhalte häufig als nummerierte Schrittfolge auf. Pflichtfelder: name, step (mit text), totalTime und supply, je nach Anwendungsfall.
Organization-Schema
Organization-Schema bündelt Stammdaten (Name, Logo, sameAs, contactPoint, founder, areaServed) Ihrer Firma. Wichtig für die Entitäten-Eindeutigkeit in Knowledge Graph und LLM-Embedding. Ohne Organization-Markup steigt das Risiko von Brand-Halluzinationen.
Service-Schema
Service-Schema beschreibt eine Dienstleistung mit serviceType, provider, areaServed und offers. LLMs ziehen daraus Antworten auf Prompts wie „Wer bietet GEO-Beratung in der Schweiz?“. Pflichtfelder: name, provider, serviceType, areaServed.
DefinedTerm
DefinedTerm ist das Schema-Vokabular für Glossarbegriffe und Fachterminologie. Kombiniert mit DefinedTermSet auf einer Glossar-Seite signalisiert es Suchmaschinen und LLMs eine kuratierte Begriffssammlung mit Autorität für die jeweiligen Definitionen.
Dataset-Schema
Dataset-Schema beschreibt einen Datensatz oder eine Studie (name, description, creator, datePublished, license, distribution). Für Statistik- und Studien-Seiten ein Pflicht-Markup, weil es LLMs erleichtert, Zahlen und Quellen sauber zu zitieren.
llms.txt
llms.txt ist eine Markdown-Datei im Root einer Domain, die LLMs eine kuratierte, KI-freundliche Karte der wichtigsten Inhalte liefert. Sie ersetzt nicht robots.txt, sondern ergänzt sie um eine semantische Sitemap. Adoption 2026 wächst, ist aber nicht verbindlich für alle Crawler.
IndexNow
IndexNow ist ein offener Standard von Microsoft, Yandex und Seznam zur sofortigen Benachrichtigung von Suchmaschinen über neue oder geänderte URLs. Beschleunigt das Auftauchen in Bing und damit indirekt in ChatGPT-Search und Bing Copilot.
Canonical-Tag
Das Canonical-Tag (<link rel="canonical">) markiert die bevorzugte Version einer URL bei mehreren Varianten. Für GEO ist ein konsistentes Canonical-Setup essenziell, damit LLMs Brand-Citations einer eindeutigen Quell-URL zuordnen.
Sitemap.xml
Sitemap.xml ist eine maschinenlesbare Liste aller wichtigen URLs einer Domain inklusive lastmod, changefreq und priority. Sie beschleunigt das Crawling durch Bingbot, Googlebot und KI-Crawler wie PerplexityBot. Pflicht in robots.txt als Sitemap-Direktive verlinkt.
Core Web Vitals
Core Web Vitals sind Googles UX-Performance-Kennzahlen LCP, INP und CLS. Sie wirken indirekt auf GEO, weil schlechte Werte das Ranking in der klassischen Suche drücken, was wiederum die Wahrscheinlichkeit einer Citation in Google AI Overviews senkt.
Passage Indexing
Passage Indexing ist Googles Fähigkeit, einzelne Absätze einer Seite unabhängig vom Gesamt-Ranking als Antwort auszuwählen. Für AI Overviews zentral: Klare Absätze mit Frage-Antwort-Struktur, sprechende Zwischenüberschriften und kompakte Definitions-Sätze.
Semantisches HTML
Semantisches HTML nutzt Tags wie article, section, figure, figcaption, dl und nav für inhaltliche Bedeutung statt rein optischer Darstellung. LLMs interpretieren saubere HTML-Hierarchien deutlich zuverlässiger als reine div-Suppen und zitieren entsprechend genauer.
sameAs
sameAs ist eine Schema.org-Property, die eine Entität mit ihren Profilen in Wikipedia, Wikidata, LinkedIn, Crunchbase oder X verbindet. Mehrere sameAs-Links machen Ihre Organisation für LLMs eindeutig identifizierbar und reduzieren die Verwechslungsgefahr mit Namensvettern.
Cluster 6 · 8 Begriffe

Mess- & KPI

Prompt-Set
Ein Prompt-Set ist eine kuratierte Liste von Suchanfragen, mit denen Ihre KI-Sichtbarkeit standardisiert gemessen wird. Typisch sind 30–120 Prompts pro Marke, aufgeteilt in Brand-, Kategorie-, Vergleichs- und Problemlösungs-Fragen. Grundlage für reproduzierbares Monitoring.
Brand-Prompt
Ein Brand-Prompt fragt explizit nach Ihrer Marke („Was bietet maximal.digital?“). Ist die Marke in einer Brand-Prompt-Antwort nicht enthalten oder wird falsch beschrieben, liegt ein direktes Entitäts- oder Citation-Problem vor.
Kategorie-Prompt
Ein Kategorie-Prompt fragt nach einer Leistungs- oder Produktkategorie ohne Markenbezug („beste KI-SEO-Agentur Schweiz“). Der Anteil an Antworten, in denen Ihre Marke unaufgefordert genannt wird, ist die belastbarste GEO-Erfolgsgröße.
Profound
Profound ist eine 2024 gestartete Monitoring-Plattform für KI-Sichtbarkeit. Sie misst Marken-Citations in ChatGPT, Perplexity, Google AI Overviews, Gemini und Claude über kuratierte Prompt-Sets. Nutzung im DACH-Mittelstand 2026 noch unter 10 %.
Otterly
Otterly.ai ist ein europäisches Tool zur Messung von Brand-Visibility in ChatGPT, Gemini und Perplexity. Stärken sind Multi-Brand-Tracking, Quellen-Analyse und ein DSGVO-konformes Setup. Im DACH-Mittelstand eine der ersten ernstzunehmenden Alternativen zu US-Plattformen.
AthenaHQ
AthenaHQ ist eine GEO-Monitoring-Plattform mit Fokus auf Enterprise-Anwendungen, Wettbewerbsanalysen und Citation-Quellen über mehrere LLMs hinweg. Liefert Trend-Daten zur Marken-Präsenz in KI-Antworten und sucht nach Halluzinationen und Falschaussagen.
Share of Source
Share of Source misst, welcher Anteil aller in einer KI-Antwort gezeigten Quellen auf Ihre Domain entfällt. Anders als Share of Answer fokussiert es nicht auf die Markennennung, sondern auf die tatsächlich verlinkte Quell-Domain. Wichtig für Lead-orientierte GEO-Strategien.
Prompt Coverage
Prompt Coverage ist der Anteil der relevanten Prompts in Ihrem Monitoring-Set, bei denen Ihre Marke mindestens eine Nennung erhält. Liegt der Wert unter 20 %, gibt es typischerweise Lücken in Definitionshoheit, externen Erwähnungen oder Crawler-Freigabe.

Vertiefung

Die Glossar-Definitionen sind die kürzeste Form. Im Wissens-Hub vertiefen wir jeden Cluster mit Methodik, Beispielen und Daten.