Gemini Notebook: Deine Website wird jetzt anders gescrapt
Google hat NotebookLM still und leise zu Gemini Notebook umbenannt. Was nach einem harmlosen Rebranding klingt, hat eine konkrete technische Konsequenz: Der bisherige User Agent Google-NotebookLM wird ab August 2026 nicht mehr unterstützt. Wer diesen String in seiner Firewall oder .htaccess-Datei hinterlegt hat, verliert damit die Kontrolle über den Zugriff.
Gemini Notebook ist ein KI-Recherchetool, das Webseiten direkt abruft und deren Inhalte für Nutzer aufbereitet. Die sogenannte Discover-Sources-Funktion sucht automatisch nach passenden Quellen zu einem Thema, scrapt bis zu zehn Seiten, erstellt eine KI-Zusammenfassung und schickt dabei keinen einzigen Referral zurück. Kein Traffic, keine Attribution, kein Backlink. Zusätzlich können Inhalte in Audio-Podcasts oder Video-Erklärungen umgewandelt werden, die dann potenziell in direkter Konkurrenz zum Originalcontent stehen.
Das Besondere und Problematische: Gemini Notebook ist ein sogenannter User-Triggered Fetcher. Das bedeutet, er wird durch Nutzeraktionen ausgelöst und ignoriert robots.txt vollständig. Eine robots.txt-Direktive ist für diesen Crawler rechtlich und technisch nicht bindend. Die einzige wirksame Kontrolle läuft über Firewall-Regeln oder .htaccess-Konfigurationen.
Parallel dazu ist Project Mariner seit Mai 2026 eingestellt worden und aus der Google-Dokumentation verschwunden. Der neue User Agent für Gemini Notebook lautet Google-GeminiNotebook, mit separaten Strings für Mobile und Desktop. Wer bisher auf den alten String gesetzt hat, hat nur noch wenige Wochen Zeit zum Aktualisieren.
1. Prüfe sofort deine .htaccess-Datei und Firewall-Regeln auf den String 'Google-NotebookLM'. Dieser User Agent wird ab August 2026 nicht mehr funktionieren. Ersetze ihn durch 'Google-GeminiNotebook', um die Blockierung aufrechtzuerhalten.
2. Füge folgende Regel in deine .htaccess ein, falls du Gemini Notebook blockieren willst: RewriteEngine On RewriteCond %{HTTP_USER_AGENT} Google-GeminiNotebook [NC] RewriteRule ^ - [F,L]
3. Prüfe ob du auch den Desktop- und Mobile-User-Agent separat blockieren willst. Google hat zwei neue Strings veröffentlicht: einen für Mobile (Chrome/138 auf Android) und einen für Desktop (Chrome/137 auf Linux x86_64). Beide sind in der aktualisierten Google-Dokumentation unter developers.google.com/crawling/docs/crawlers-fetchers/google-gemininotebook dokumentiert.
4. Entscheide strategisch, ob du blockieren willst. Gemini Notebook sendet keinen Traffic zurück. Wenn dein Geschäftsmodell auf Seitenaufrufen, Werbeeinnahmen oder Lead-Generierung basiert, ist das Scrapen ohne Referral ein direkter Verlust. Für reine Brand-Awareness-Ziele kann Sichtbarkeit in KI-Zusammenfassungen trotzdem wertvoll sein.
5. Robots.txt allein reicht nicht. Wer glaubt, mit einem Disallow-Eintrag geschützt zu sein, irrt. User-Triggered Fetcher ignorieren robots.txt per Design. Nur Firewall- oder .htaccess-Regeln greifen hier wirklich.
Original-Artikel auf Search Engine Journal:
Google NotebookLM Rebrand May Expose Your Site To More AI Scraping via @sejournal, @martinibuster ↗Mehr lesen
Steht deine Website auch in ChatGPT?
Buch dir einen 15-Min Call — wir zeigen dir live wo deine Seite in Google + AI Search aktuell unsichtbar ist.