KI-Atlas Teil 1: Assistenten, Recherche und Wissenschaft
12 Bewertungen aus 3 Kategorien — welche Werkzeuge für Assistenten, Recherche und Wissenschaft in die engere Wahl gehören und wo ihre Grenzen liegen.
Kurz gesagt
Für Assistenten, Recherche und Wissenschaft bewertet der interne KI-Atlas 12 Produkte in 3 Kategorien nach Funktionspassung, Steuerbarkeit und Workflow-Anschluss — auf Basis der Herstellerdokumentation, nicht eines eigenen Produkttests.
Auf einen Blick
- 3 Kategorien und 12 bewertete Produkte in diesem Teil.
- Bewertung: Funktionspassung 50 %, Steuerbarkeit 25 %, Workflow-Anschluss 25 %, je 1–5.
- Prüfstand: Auswertung offizieller Herstellerangaben, kein eigener Labortest.
- Stand der Erhebung: 19. September 2026; 45 Kategorien, 95 Produkte, 123 Bewertungen insgesamt.
- Jede Kategorie nennt einen konkreten Vergleichstest, mit dem sich die Auswahl selbst prüfen lässt.
Teil 1 der Serie KI-Atlas ordnet ein, welche Werkzeuge für Assistenten, Recherche und Wissenschaft in die engere Wahl gehören. Grundlage ist ein interner Vergleich vom 19. September 2026: 45 Kategorien, 95 Produkte, 123 Bewertungen. Bewertet wurde die Eignung anhand offizieller Funktionsbeschreibungen der Anbieter — Funktionspassung 50 Prozent, Steuerbarkeit 25 Prozent, Workflow-Anschluss 25 Prozent, je 1 bis 5 Punkte. Das ist ausdrücklich kein eigener Produkttest und keine Messung der Ausgabequalität.
01 · Allgemeine KI-Assistenten & LLMs
ChatGPT und Claude gemeinsam in die engere Wahl nehmen; Gemini besonders bei vorhandenen Google-Abläufen. Kein hier gemessener Intelligenzsieger.
| Produkt | Bewertung | Besonders geeignet | Grenze | Kostenfaktor |
|---|---|---|---|---|
| ChatGPT | ★★★★★ 5 | Gemischte Wissensarbeit und fertige Arbeitsdateien | Modus und gebuchte Werkzeuge beeinflussen das Ergebnis. | Tarif und Nutzungslimits |
| Claude | ★★★★★ 5 | Lange Texte, Dokumente und mehrstufige Wissensarbeit | Quellen, Berechtigungen und Resultate müssen kontrolliert werden. | Tarif und Nutzungslimits |
| Gemini / Gemini API | ★★★★½ 4.5 | Multimodale Anwendungen und Google-naher Einsatz | Konkretes Modell, Modalitäten und Zugang getrennt prüfen. | Modellabhängige API-Nutzung / App-Tarif |
| Mistral Vibe, vormals Le Chat | ★★★★ 4 | Alternative Chat-/Coding-Umgebung | Nicht ungeprüft mit früheren Le-Chat-Tarifen gleichsetzen. | Tarif / API separat |
| Grok | ★★★★ 4 | Dialog und zeitnahe Themen als Recherche-Einstieg | Aktuelle Informationen sind nicht automatisch verlässlich. | Tarif / API separat |
| DeepSeek API | ★★★★ 4 | Eigene API-Anwendungen | Selbst zu bauende Anwendung; Qualität und Datenweg separat prüfen. | Nutzungsabhängige API |
| Qwen-Modellfamilie | ★★★★ 4 | Eigene Auswahl eines passenden offenen Modells | Gewichte, Lizenz und Hardwarebedarf pro konkretem Modell prüfen. | Hosting und Rechenleistung / API |
Vergleichstest: Ein identisches Briefing mit Quellen, Widersprüchen und gewünschter Datei an alle Kandidaten geben.
02 · Webrecherche & Quellenarbeit
Perplexity für die Suche im offenen Web; Gemini Notebook für einen definierten eigenen Quellenbestand. Die Empfehlungen betreffen unterschiedliche Aufgaben.
| Produkt | Bewertung | Besonders geeignet | Grenze | Kostenfaktor |
|---|---|---|---|---|
| Perplexity | ★★★★½ 4.5 | Schneller Einstieg mit verlinkten Originalquellen | Zitate müssen die konkrete Aussage tatsächlich tragen. | Tarif und Recherchekontingent |
| Gemini Notebook / NotebookLM | ★★★★★ 5 | Fragen zu einem abgegrenzten Quellenpaket | Vollständigkeit und Qualität hängen vom Quellenbestand ab. | Kontingent / Workspace-Zugang |
| ChatGPT | ★★★★ 4 | Recherche mit anschließender Ausarbeitung | Modus und gebuchte Werkzeuge beeinflussen das Ergebnis. | Tarif und Nutzungslimits |
Vergleichstest: Zehn überprüfbare Aussagen verlangen; jede Originalquelle öffnen und richtige Belegstelle zählen.
03 · Wissenschaft & Literaturauswertung
Elicit für strukturierte Extraktion und Review-Abläufe; Consensus für Literaturfragen und Zitationswege.
| Produkt | Bewertung | Besonders geeignet | Grenze | Kostenfaktor |
|---|---|---|---|---|
| Elicit | ★★★★★ 5 | Studien systematisch sichten und tabellarisch extrahieren | Studienauswahl und Extraktionen benötigen fachliche Prüfung. | Tarif / Nutzungspool |
| Consensus | ★★★★½ 4.5 | Literatur finden und Zusammenhänge nachverfolgen | Eine Zusammenfassung ersetzt keine Bewertung der Studienmethodik. | Tarif / Suchkontingente |
Vergleichstest: Eine bekannte Studienmenge vorgeben; fehlende Studien, falsche Zahlen und unpassende Schlussfolgerungen zählen.
Die Serie umfasst neun Teile; die übrigen Teile tragen die Nummern 2, 3, 4, 5, 6, 7, 8, 9. Sterne stehen für die dokumentierte Eignung, nicht für einen Sieger: In mehreren Kategorien empfiehlt der Vergleich ausdrücklich zwei Kandidaten nebeneinander, weil sie unterschiedliche Aufgaben lösen.
Häufige Fragen
Ist das ein eigener Produkttest?
Nein. Bewertet wurde die dokumentierte Eignung aus offiziellen Herstellerangaben. Ausgabequalität, Geschwindigkeit und Preis-Leistung im Alltag sind damit nicht gemessen.
Wie kommen die Sterne zustande?
Aus drei Teilnoten von 1 bis 5: Funktionspassung zaehlt 50 Prozent, Steuerbarkeit und Workflow-Anschluss je 25 Prozent. Das Ergebnis wird auf halbe Sterne gerundet.
Warum stehen manchmal zwei Produkte gleichauf?
Weil sie unterschiedliche Aufgaben lösen. Der Vergleich nennt in solchen Fällen bewusst beide, statt einen künstlichen Sieger zu bestimmen.
Quellen
- ChatGPT — Hersteller
- Claude — Hersteller
- Gemini / Gemini API — Hersteller
- Mistral Vibe, vormals Le Chat — Hersteller
- Grok — Hersteller
- DeepSeek API — Hersteller
- Qwen-Modellfamilie — Hersteller
- Perplexity — Hersteller
- Gemini Notebook / NotebookLM — Hersteller
- Elicit — Hersteller
- Consensus — Hersteller