Glossareintrag
Wir denken. KI tippt mit.
Deep Research (deutsch etwa Tiefenrecherche, auch KI-Recherche-Agent genannt) ist eine Funktion in KI-Chatbots, mit der ein KI-Agent eine Rechercheaufgabe selbstständig bearbeitet. Er plant die Recherche, führt nacheinander Dutzende Websuchen aus, liest die gefundenen Seiten und fasst alles zu einem ausführlichen Bericht mit Quellenangaben zusammen. Ein Durchlauf dauert Minuten statt Sekunden, je nach Dienst und Aufgabe auch über eine halbe Stunde.
Damit unterscheidet sich Deep Research deutlich von der normalen Chat-Antwort mit Websuche, die sich auf wenige Suchanfragen stützt und in Sekunden fertig ist. Der Recherche-Agent arbeitet dagegen in einer Schleife aus Suchen, Lesen und Nachfassen und wertet dabei nach Angaben der Anbieter hunderte Quellen aus. Die Funktion heißt bei ChatGPT und Gemini „Deep Research“, bei Claude „Research“, bei Microsoft Copilot „Researcher“ und bei xAIs Grok „DeepSearch“. (Hinweis: Verwechselbar mit Deep Learning. Das ist ein Trainingsverfahren für neuronale Netze. Die beiden Begriffe haben inhaltlich nichts miteinander zu tun.)
Ein Deep-Research-Lauf beginnt mit einem Rechercheplan. Gemini zeigt diesen Plan vor dem Start an und lässt ihn bearbeiten (Google-Hilfeseite zu Deep Research). ChatGPT stellt vor dem Start Rückfragen zum Ziel der Recherche und legt seit Anfang 2026 ebenfalls einen bearbeitbaren Plan vor. Danach arbeitet der Agent allein. Er formuliert Suchanfragen, öffnet Websites, bewertet die Zwischenergebnisse und entscheidet auf dieser Basis, was er als Nächstes untersucht. Am Ende steht ein gegliederter Bericht mit Zitaten und Links zu den verwendeten Quellen. Gemini exportiert ihn auf Wunsch als Google-Docs-Dokument oder als Audio-Zusammenfassung.
Technisch stecken hinter den Funktionen Reasoning-Modelle, die vor der Antwort sichtbar Zwischenschritte durchdenken. Anthropic hat die Architektur der eigenen Research-Funktion offengelegt. Ein Leit-Agent plant die Recherche und startet mehrere Unter-Agenten, die parallel suchen; ein eigener Zitier-Agent ordnet am Ende jede Aussage ihrer Quelle zu. In internen Tests übertraf dieses Multiagenten-System einen einzelnen Agenten um 90,2 Prozent, verbrauchte aber rund 15-mal so viele Tokens wie ein normaler Chat (Anthropic-Entwicklerbericht). Dieser Rechenaufwand erklärt, warum alle Anbieter die Zahl der Läufe begrenzen (Nutzungslimit).
Den Anfang machte Google im Dezember 2024, die anderen großen Anbieter zogen 2025 nach:
Von RAG (Retrieval-Augmented Generation) unterscheidet sich Deep Research durch Datenbasis und Arbeitsweise. Ein RAG-System schlägt vor der Antwort in einem fest hinterlegten Bestand nach (z. B. in den eigenen Firmendokumenten). Deep Research durchsucht das offene Web und wählt seine nächsten Schritte selbst.
Die am besten dokumentierte Schwäche der Recherche-Agenten sind falsche oder erfundene Quellenangaben. Das Tow Center der Columbia-Universität ließ acht KI-Suchdienste in 1.600 Abfragen Zitate ihren Originalquellen zuordnen. Mehr als 60 Prozent der Antworten waren falsch, die Fehlerquoten reichten je nach Dienst von 37 bis 94 Prozent (Studie des Tow Center). Im Praxistest des Fachmagazins t3n kombinierte Perplexity Deep Research Zahlen aus zwei verschiedenen Erhebungen zu einer Statistik, die es so nie gab. Solche Fehler sind eine Form des Halluzinierens und fallen in flüssig formulierten Berichten kaum auf.
Für lokale Unternehmen und Handwerksbetriebe lohnt sich Deep Research vorrangig bei Recherchen, die bisher Stunden gekostet haben. Das Mittelstand-Digital Zentrum Chemnitz, ein vom Bundeswirtschaftsministerium gefördertes Beratungsnetzwerk, empfiehlt kleinen und mittleren Unternehmen die Funktion unter anderem für Markt- und Wettbewerbsanalysen und für die Beobachtung neuer Vorschriften.
Typische Aufgaben aus dem Betriebsalltag:
Ausprobieren lässt sich die Funktion auch ohne Bezahl-Abo. ChatGPT enthält im Gratis-Zugang einige Deep-Research-Aufgaben pro Monat in einer abgespeckten Variante (OpenAI-Hilfeseite). Gemini erlaubt ohne Abo eine begrenzte Zahl von Läufen (Google-Hilfeseite zu den Limits), Perplexity einige pro Tag. Claude bietet Research dagegen nur in den Bezahlplänen an (Claude-Hilfeseite). Die jeweils aktuellen Kontingente stehen auf den verlinkten Hilfeseiten der Anbieter.
Jeder Bericht benötigt vor der Verwendung eine Stichprobenprüfung. Das Mittelstand-Digital-Zentrum nennt die manuelle Kontrolle unverzichtbar, besonders bei rechtlich relevanten Themen. Praktisch heißt das, zwei bis drei zentrale Aussagen direkt in der verlinkten Originalquelle nachzulesen, bevor eine Zahl in ein Angebot oder einen Antrag wandert. Für einfache Faktenfragen, tagesaktuelle Einzelinfos oder Fragen zu internen Betriebsdaten ist Deep Research außerdem das falsche Werkzeug. Dort genügt die normale Chat-Antwort mit Websuche. Interne Dokumente erschließt eher ein RAG-System.