§ 44b UrhG: Warum dein AGB-Satz KI-Training nicht stoppt
· Sandra Straub
Deine Fotos. Deine Blogtexte. Die Produktbeschreibungen, die du dir überlegt hast.
Wenn sie auf einer öffentlich zugänglichen Website stehen, dürfen KI-Unternehmen sie nach aktuellem deutschen Recht für ihre Trainingsdatensätze verwenden. Das ist gesetzlich erlaubt, ohne vorher zu fragen.
Das lässt sich einschränken. Aber nicht durch einen AGB-Satz.
Was § 44b UrhG bedeutet
§ 44b UrhG (Text und Data Mining) erlaubt es Dritten, öffentlich zugängliche Werke zu vervielfältigen, wenn das zum Zweck des maschinellen Lernens und der KI-Entwicklung dient. Die Norm gilt für alle, die solche Inhalte öffentlich bereitstellen: Fotografinnen, Bloggerinnen, Anbieterinnen von Online-Kursen, Unternehmerinnen mit Website.
Die Erlaubnis gilt automatisch. Solange du keinen Vorbehalt erklärst, greift sie.
Das Gegenstück steht im selben Paragrafen: Wer sich die Nutzung vorbehält, schaltet die Erlaubnis aus. Der Widerspruch muss aber in maschinenlesbarer Form erklärt werden.
Warum dein AGB-Satz nicht reicht
Die Vorinstanzen im aktuellen BGH-Verfahren haben das sehr klar entschieden: Ein Widerspruch, der nur als Fließtext in Nutzungsbedingungen steht, gilt nicht als maschinenlesbarer Vorbehalt im Sinne von § 44b UrhG. Er richtet sich an Menschen, nicht an Crawler. Und Crawler lesen ihn nicht als rechtlich wirksame Erklärung.
Das betrifft konkret:
- AGB mit Klausel gegen automatisierte Verarbeitung
- Impressum mit Verbotsvermerk
- Copyright-Hinweis im Footer
- Hinweise auf der Kontaktseite oder im Datenschutztext
All das schützt auf anderen Ebenen. Für § 44b UrhG genügt es nicht.
Was maschinenlesbar ist, erkläre ich im nächsten Abschnitt.
Der BGH-Fall: Was war passiert
Am 3. September 2026 hat der I. Zivilsenat des Bundesgerichtshofs zum ersten Mal über diese Frage verhandelt (Az. I ZR 281/25). Ein Berufsfotograf klagt gegen einen gemeinnützigen Verein, der einen Datensatz mit über fünf Milliarden Bild-Text-Paaren öffentlich zugänglich macht und damit KI-Training ermöglicht. Das Vorschaubild des Fotografen war in diesem Datensatz enthalten.
Die Bildagentur hatte automatisierte Downloads in ihren Nutzungsbedingungen ausdrücklich untersagt – auf Englisch, als Fließtext. Beide Vorinstanzen haben das nicht als maschinenlesbaren Vorbehalt anerkannt:
- LG Hamburg, Urt. v. 27.09.2024, Az. 310 O 227/23: Klage abgewiesen
- OLG Hamburg, Urt. v. 10.12.2025, Az. 5 U 104/24: Berufung zurückgewiesen
Der BGH hat noch nicht entschieden. Die Urteilsverkündung ist für den 17. Dezember 2026 angekündigt. Nach den vorliegenden Berichten zur Verhandlung könnte er einzelne Rechtsfragen dem Europäischen Gerichtshof vorlegen.
Was dieser Fall schon jetzt zeigt: Es geht nicht ums Ob des Widerspruchs, sondern ums Wie.
Was einen maschinenlesbaren Vorbehalt ausmacht
Zwei technische Wege sind etabliert:
robots.txt
Die Datei robots.txt liegt im Stammverzeichnis deiner Website und wird von Crawlern automatisch abgerufen, bevor sie Seiten indexieren oder verarbeiten. Du kannst dort bestimmte Crawler oder alle automatisierten Anfragen ausschließen.
Bekannte KI-Trainingscrawler und ihre User-Agent-Bezeichnungen (Stand September 2026):
User-agent: GPTBot
Disallow: /
User-agent: Google-Extended
Disallow: /
User-agent: CCBot
Disallow: /
User-agent: ClaudeBot
Disallow: /
User-agent: anthropic-ai
Disallow: /
User-agent: Applebot-Extended
Disallow: /
User-agent: Meta-ExternalAgent
Disallow: /
Hinweis: Die Liste der KI-Crawler wächst laufend. Eine aktuelle Übersicht findest du z. B. bei llmshub.de.
Wenn du alle Crawler ausschließen möchtest:
User-agent: *
Disallow: /
Wichtig: User-agent: * sperrt auch reguläre Suchmaschinen-Crawler. Das kann deine Auffindbarkeit in Google erheblich beeinträchtigen. Für KI-Training reicht es, die bekannten KI-spezifischen Crawler gezielt auszuschließen.
Noch eine Unterscheidung, die oft übersehen wird: KI-Trainingscrawler (z. B. GPTBot) sind nicht dasselbe wie KI-Suchcrawler (z. B. OAI-SearchBot). Wer GPTBot blockt, verhindert, dass seine Inhalte als Trainingsdaten landen – erscheint aber weiterhin in ChatGPT-Suchergebnissen. Beides getrennt zu steuern ist möglich, aber ein eigenes Thema.
Meta-Tag im HTML-Head
Eine zweite Möglichkeit ist ein Meta-Tag, das du im <head>-Bereich deiner Website einfügst:
<meta name="robots" content="noai, noimageai">
Dieses Tag signalisiert, dass du die Nutzung für KI-Training nicht erlaubst. Nicht alle Crawler berücksichtigen es, aber es dokumentiert deinen Vorbehalt zusätzlich.
Was du realistisch erwarten kannst
robots.txt ist keine technische Sperre. Crawler, die den Eintrag ignorieren, verstoßen gegen die robots.txt-Konvention und müssen die rechtlichen Konsequenzen tragen. Aber sie werden nicht automatisch blockiert. Etablierte Anbieter wie OpenAI, Google und Anthropic veröffentlichen ihre Crawler-Namen und halten sich in aller Regel an die robots.txt-Konvention.
Der robots.txt-Eintrag dokumentiert deinen Vorbehalt nach § 44b UrhG. Ob er in jedem Einzelfall rechtlich bindend ist, wird sich durch die weitere Rechtsprechung klären. Der BGH-Fall ist dafür der entscheidende Schritt.
Was du konkret tun kannst
Schritt 1: robots.txt prüfen
Ruf deine-domain.de/robots.txt auf. Wenn die Datei leer ist oder keinen Eintrag für KI-Crawler enthält, ist der Vorbehalt noch nicht gesetzt.
Schritt 2: Eintrag ergänzen
Füge einen oder mehrere Einträge für bekannte KI-Crawler ein. Falls du ein Content-Management-System nutzt (WordPress, Squarespace, Wix): Viele CMS bieten Felder für robots.txt-Einträge direkt in den Einstellungen. Sonst ergänzt du die Datei über deinen Hosting-Anbieter oder FTP-Zugang.
Schritt 3: Meta-Tag setzen (optional, ergänzend)
Wenn du Zugriff auf den HTML-Head hast, ergänze das noai, noimageai-Tag. In WordPress geht das über SEO-Plugins wie Yoast oder Rank Math.
Schritt 4: Erwartung realistisch setzen
Ein Vorbehalt wirkt ab dem Zeitpunkt, an dem du ihn setzt. Was bereits in Trainingsdatensätzen gelandet ist, holt er nicht zurück. Je früher du handelst, desto mehr greift er.
Häufige Fragen
Kann ich mit robots.txt KI-Training wirklich verhindern?
Technisch nicht vollständig. Crawler, die robots.txt ignorieren, können trotzdem zugreifen. Rechtlich dokumentiert der Eintrag deinen Widerspruch nach § 44b UrhG. Wie weit dieser Schutz im Einzelfall reicht, wird sich durch die Rechtsprechung weiter konkretisieren.
Was ist mit Inhalten, die bereits erfasst wurden?
Daran ändert ein nachträglicher Vorbehalt nichts. Er wirkt nicht rückwirkend.
Gilt das nur für Fotos oder auch für Texte?
§ 44b UrhG gilt für alle urheberrechtlich geschützten Werke: Texte, Bilder, Musik, Videos. Wenn deine Website-Texte oder Blogbeiträge die Voraussetzungen für urheberrechtlichen Schutz erfüllen, greift dieselbe Logik.
Reicht ein Copyright-Hinweis im Footer nicht?
Für das allgemeine Urheberrecht ja, für § 44b UrhG nein. Dieser Paragraph verlangt ausdrücklich eine maschinenlesbare Erklärung.
Dein nächster Schritt
Wenn du wissen möchtest, wie dein KI-Einsatz insgesamt rechtlich einzuordnen ist – Urheberrecht, Datenschutz, Kennzeichnungspflichten, Haftung – dann empfehle ich den kostenlosen KI-Rechtsrisiko-Check.
Und wenn du noch mehr zu KI und Urheberrecht lesen möchtest: Der Beitrag KI-Content & Urheberrecht 2026: Wem gehört dein Output? behandelt die andere Seite des Themas – was mit dem Urheberrecht an KI-generiertem Content passiert.
Quellen: Bundesgerichtshof, Pressemitteilung Nr. 085/2026, Az. I ZR 281/25 (Verhandlung 03.09.2026) · LG Hamburg, Urt. v. 27.09.2024, Az. 310 O 227/23 · OLG Hamburg, Urt. v. 10.12.2025, Az. 5 U 104/24 · § 44b UrhG (Text und Data Mining), abrufbar unter dejure.org · Stand: September 2026
Dieser Beitrag ersetzt keine fallbezogene Rechtsberatung.
Wo stehst du gerade?
Der kostenlose KI-Rechtsrisiko-Check gibt dir in 2 Minuten eine erste Orientierung.
Check starten