Werkzeuge ändern sich. Kriterien bleiben.
Acht Aufgaben, für die KI-Werkzeuge in Frage kommen. Jeder Eintrag trägt gleich die zwei Bedingungen, an denen es im Betrieb scheitert: Betriebsort und Einstiegsaufwand.
Werkzeuge nach Aufgabe
selbst im Einsatz 09
näher betrachtet 06
im Blick 08
23 Werkzeuge · 8 Aufgaben · Stand 20. September 2026
-
LLM-Zugang 06
Zugang zu Sprachmodellen, gebündelt oder direkt beim Anbieter.
-
Workflow 02
Abläufe verdrahten, ohne sie zu programmieren.
-
Wissensbaustein 03
Eigene Dokumente auffindbar und abfragbar machen.
-
Agenten-Framework 03
Mehrschrittige Abläufe mit Werkzeugzugriff bauen.
-
Coding-Agent 02
Code lesen, schreiben und ändern lassen.
-
Orchestrierung 02
Datenflüsse steuern und schützen.
-
Plattform 04
Fertige Oberfläche für den täglichen Gebrauch.
-
Browser-Agent 01
Oberflächen bedienen, die keine Schnittstelle anbieten.
Jedes Werkzeug mit seinen Grenzen.
Wofür ein Werkzeug taugt, steht neben dem, wofür es nicht taugt. Beides stammt aus der jeweiligen Einordnung. Keine Bestenliste, sondern eine nachvollziehbare Momentaufnahme.
23 von 23
- Coding-Agent selbst im Einsatz
Claude Code
Anthropic
Agentisches Entwicklungswerkzeug mit Datei-, Shell-, Git-, Test- und Subagenten-Zugriff für prüfbare Arbeit in echten Code-Repositories.
- wofür gut
-
- Refactorings über mehrere Dateien hinweg
- Fehleranalyse mit Lese-Zugriff aufs Repo
- wofür nicht
-
- Teams ohne Code-Review-Disziplin (KI-Code braucht Augen)
- Greenfield-Architekturen ohne menschliche Vorgabe
Closed Source gehostet EU abhängig Einstieg mittel
- Wissensbaustein selbst im Einsatz
FastAPI
Sebastián Ramírez (Open Source)
Modernes Python-Web-Framework für APIs – der Klebstoff zwischen Modellen, Vektordatenbank und Frontend.
- wofür gut
-
- RAG-APIs, Inferenz-Endpunkte, Daten-Pipelines
- Async-Workloads (parallele LLM-Calls, Stream-Antworten)
- wofür nicht
-
- Klassisches Server-Side-Rendering (dann eher Django oder Astro)
- Teams ohne Python-Erfahrung – eine Sprach-Entscheidung
Open Source self-hostbar EU-Betrieb Einstieg schwer
- Wissensbaustein selbst im Einsatz
Jina AI
Jina AI GmbH (Berlin), seit 10/2025 Teil von Elastic N.V.
Multilinguale Embedding- und Reranker-API aus Berlin – die Bausteine, die Texte in Vektoren wandeln und Suchergebnisse nachsortieren, inzwischen bis hin zu multimodalen Modellen.
- wofür gut
-
- Mehrsprachige RAG-Systeme (DE/EN/FR/IT in einem Index)
- Reranker, der bei umgangssprachlichen Anfragen die richtige Stelle findet
- wofür nicht
-
- Komplettes Air-Gap (dann selbst hosten mit BGE oder E5)
- Sehr hohe Volumen (Pricing wird teuer – Self-Hosting prüfen)
Closed Source gehostet EU-Betrieb Einstieg leicht
- LLM-Zugang selbst im Einsatz
LiteLLM
BerriAI (Open Source, MIT; Enterprise-Verzeichnis eigene Lizenz)
Selbst betriebener Proxy vor allen Sprachmodellen – eine einheitliche API, virtuelle Schlüssel, Budgets und eine Stelle, an der Prompts geprüft werden können.
- wofür gut
-
- Eine Schnittstelle für OpenAI, Anthropic, Mistral, Azure und lokale Modelle
- Virtuelle API-Schlüssel je Team oder Anwendung, mit Budget und Nutzungsprotokoll
- wofür nicht
-
- Betrieb ohne eigenen Server – der Proxy will betrieben, aktualisiert und abgesichert werden
- Eine fertige Prüfoberfläche für maskierte Inhalte, die gibt es nicht
Open Source self-hostbar EU-Betrieb Einstieg mittel
- Workflow selbst im Einsatz
n8n
n8n GmbH (Berlin)
Visuelle Workflow-Plattform – Du klickst Integrationen zusammen statt sie zu programmieren, und kannst trotzdem Code einbetten wenn nötig.
- wofür gut
-
- Mail-Triage, CRM-Anreicherung, Dokumenten-Pipelines
- Self-Hosting im eigenen Docker-Stack – kein Vendor-Lock-in
- wofür nicht
-
- Workflows mit komplexen, langen Mehragenten-Schleifen (dann eher LangGraph)
- Einmal-Skripte – die schreibst Du in 20 Minuten in Python schneller
Open Source self-hostbar EU-Betrieb Einstieg mittel
- LLM-Zugang selbst im Einsatz
OpenRouter
OpenRouter Inc.
Eine API-Schnittstelle für 300+ Sprachmodelle – du wechselst das Modell ohne Code-Änderung, zahlst nur Verbrauch.
- wofür gut
-
- Modell-Vergleiche ohne neuen Vertrag pro Anbieter
- Preisbewusster Betrieb (Preise pro Modell transparent, keine Aufschläge auf Standard-Routing)
- wofür nicht
-
- Strikt EU-only ohne Enterprise-Vertrag (EU-Routing über eu.openrouter.ai nur mit Enterprise-Konfiguration)
- Hochsensible Daten ohne BYOK- oder Zero-Data-Retention-Setup
Closed Source gehostet EU abhängig Einstieg leicht
- Orchestrierung selbst im Einsatz
Presidio (vormals Microsoft Presidio)
Data Privacy Stack (Community, vormals Microsoft; Open Source, MIT)
Erkennt und ersetzt personenbezogene Daten in Texten – als eigener Dienst vor dem Sprachmodell, mit eigenen Regeln für deutsche Nummernformate.
- wofür gut
-
- Personenbezogene Daten aus Prompts entfernen, bevor sie einen Anbieter erreichen
- Deterministische Typen mit Prüfziffer: IBAN, Steuer-IdNr., Sozialversicherungsnummer
- wofür nicht
-
- Gescannte Unterlagen ohne saubere OCR – Lesefehler zerstören genau die Prüfziffern, von denen die Erkennung lebt
- Personennamen allein aus dem Modell heraus: spaCy trägt auf deutschen Geschäftstexten nur mit ergänzenden Regeln
Open Source self-hostbar EU-Betrieb Einstieg mittel
- Wissensbaustein selbst im Einsatz
Qdrant
Qdrant Solutions GmbH (Berlin)
Vektordatenbank für RAG-Systeme – speichert Dokument-Embeddings und liefert in Millisekunden die ähnlichsten Treffer zu einer Frage.
- wofür gut
-
- RAG-Pipelines mit kontrollierten Hosting-Anforderungen
- Self-Hosting in Docker, läuft auf einem 4-GB-VPS für KMU-Wissensbasen
- wofür nicht
-
- Klassische Volltext-Suche (das ist Pagefind oder Meilisearch)
- Wenige Dokumente – bei < 500 Chunks reicht oft ein simpler Index
Open Source self-hostbar EU-Betrieb Einstieg mittel
- LLM-Zugang selbst im Einsatz
Requesty
Requesty
LLM-Gateway mit EU-Endpunkt in Frankfurt – bei uns seit 17.08.2026 vor der Wissenssuche im Einsatz, die Inferenz-Zusage bleibt eine Anbieterangabe pro Modell.
- wofür gut
-
- Ein Endpunkt für Claude, GPT, Gemini und Mistral mit EU-Routing-Option
- Kandidat, wenn OpenRouter-EU-Routing (Enterprise-only) nicht in Frage kommt
- wofür nicht
-
- Ampel-2/3-Daten auf Basis der Anbieterangabe allein, ohne Prüfung des Modellpfads
- Als Ersatz für einen eigenen Proxy, wenn Budget-, Key- und Guardrail-Kontrolle im Haus bleiben sollen
Closed Source gehostet EU abhängig Einstieg leicht
- Agenten-Framework näher betrachtet
CrewAI
CrewAI Inc.
Python-Framework, das mehrere KI-Agenten als 'Crew' mit Rollen und Aufgaben orchestriert – inzwischen auch mit Flows für event-getriebene Ablaufsteuerung.
- wofür gut
-
- Recherche → Auswertung → Bericht-Pipelines
- Crews mit klaren Rollen (Researcher, Writer, Reviewer), sequenziell oder hierarchisch mit Manager-Agent
- wofür nicht
-
- Sehr granulare State-Maschinen mit vielen Bedingungen und Schleifen (dann LangGraph)
- Workflows mit vielen externen Integrationen (dann n8n)
Open Source self-hostbar EU-Betrieb Einstieg schwer
- Coding-Agent näher betrachtet
Cursor
Anysphere Inc. (seit 08/2026 SpaceX)
VS-Code-Fork mit eingebautem KI-Pair-Programmer – eigenes Composer-Modell, breite Fremdmodellauswahl, seit August 2026 SpaceX-Tochter.
- wofür gut
-
- Entwickler, die in einer IDE arbeiten und KI nicht nebenher wollen
- Schneller Einstieg ins KI-gestützte Coden, geringe Lernkurve
- wofür nicht
-
- Teams, die VS Code aus Lizenz- oder Compliance-Gründen nicht nutzen dürfen
- Zugesagte EU-Verarbeitung: eine EU-Region gibt es nicht, nur Inference-only auf Anfrage für Enterprise
Closed Source gehostet EU abhängig Einstieg leicht
- Agenten-Framework näher betrachtet
LangGraph
LangChain Inc.
Graph-basiertes Agenten-Framework – seit Version 1.0 der von LangChain empfohlene Standard für produktionsreife Agenten mit Schleifen, Verzweigungen und persistentem State.
- wofür gut
-
- Komplexe Mehragenten-Topologien mit Bedingungen und Schleifen
- Durable Execution: Agenten überstehen Abstürze und laufen über Tage weiter (State wird automatisch persistiert)
- wofür nicht
-
- Schnelle Prototypen ohne Klarheit über die Topologie
- Teams ohne Python- oder TypeScript-Erfahrung
Open Source self-hostbar EU-Betrieb Einstieg schwer
- Workflow näher betrachtet
Make
Celonis / Make (Tschechien)
SaaS-Workflow-Plattform – schöner Editor, breite Integration, kein Self-Hosting nötig.
- wofür gut
-
- Wenn niemand eigene Server betreiben will
- Einsteiger ohne IT-Abteilung – sehr UX-freundlich
- wofür nicht
-
- DSGVO-empfindliche Daten ohne genaue Standort-Prüfung
- Komplexe Workflows mit hoher Last (Pricing wird teuer)
Closed Source gehostet EU abhängig Einstieg leicht
- LLM-Zugang näher betrachtet
Mistral AI
Mistral AI (Frankreich)
Französischer Anbieter offener und gehosteter Sprachmodelle; EU-Sitz kann Drittlandrisiken senken, ersetzt aber keine Prüfung des konkreten Daten- und Vertragswegs.
- wofür gut
-
- EU-orientierte Modellpfade als Option für datenschutzsensible Workloads – nach Prüfung von Vertrag, Route, Retention und Zugriffen
- Self-Hosting der offenen Modelle (Mistral Small, Large 3 als offenes Gewichts-Modell, Codestral)
- wofür nicht
-
- Wenn Du das absolute Spitzenmodell für sehr anspruchsvolles Reasoning brauchst (dann eher Claude oder GPT)
- Wenn Du auf ein etabliertes großes Partner-Ökosystem/Tooling wie bei den US-Platzhirschen setzen willst
Open Source self-hostbar EU-Betrieb Einstieg leicht
- Plattform näher betrachtet
OpenWebUI
Open WebUI (Community, USA)
Self-Hosted Chat-UI für Mitarbeitende mit integrierter RAG-Engine, RBAC und Anbindung an EU-Modelle – DSGVO-konforme ChatGPT-Alternative.
- wofür gut
-
- Mitarbeiter-Chat auf firmeneigenem Wissen (Wiki, SharePoint, PDFs)
- DSGVO-konforme Ablösung von ChatGPT Enterprise oder Copilot
- wofür nicht
-
- Konzerne > 50 Nutzer mit Pflicht zu komplettem White-Label (Enterprise-Lizenz nötig)
- Reine Dokumenten-Workspaces ohne Chat-Charakter (AnythingLLM passt besser)
Closed Source self-hostbar EU-Betrieb Einstieg leicht
- LLM-Zugang im Blick
Anthropic API
Anthropic
Direkte API zur Claude-5-Modellfamilie (Fable 5.1, Opus 5, Sonnet 5, Haiku 4.5) – derzeit die stärkste Familie für Programmieraufgaben, lange Kontexte und nuancierte Sprache.
- wofür gut
-
- Code-Generierung und -Refactoring (Claude ist 2026 in der Spitze)
- Lange Kontexte (1M Tokens bei Fable 5.1, Opus 5 und Sonnet 5 – komplette Repos passen rein)
- wofür nicht
-
- Strikte EU-Datenresidenz über die Direkt-API – die kennt nur global und us; EU-Regionen gibt es nur über Bedrock oder Google Cloud
- Vendor-Lock-in-Vermeidung (über OpenRouter ist flexibler)
Closed Source gehostet EU abhängig Einstieg leicht
- Browser-Agent im Blick
Anthropic Computer Use
Anthropic
Claude steuert einen virtuellen Computer – Maus, Tastatur, Screenshot – und löst Aufgaben in Bestandssoftware, die keine API hat.
- wofür gut
-
- Legacy-Software ohne API automatisieren (mit Mensch im Loop)
- Test-Automatisierung von Web-Apps
- wofür nicht
-
- Produktive vollautonome Workflows
- Compliance-kritische Aktionen ohne Audit-Trail
Closed Source gehostet EU abhängig Einstieg schwer
- Plattform im Blick
ChatGPT Sites
OpenAI
OpenAI-Oberfläche für codegenerierte, veröffentlichbare Websites und kleine Apps, deren Produkt- und Datenpfad vor produktivem Einsatz separat geprüft werden muss.
- wofür gut
-
- Schnelle Prototypen für klar begrenzte Landingpages, Formulare und interne Team-Tools
- Iteratives Sichtbarmachen eines Prozesses, bevor Entwicklungskapazität gebunden wird
- wofür nicht
-
- Personen- oder geschäftskritische Datenflüsse ohne dokumentierte Datenschutz-, Zugriffs- und Löschprüfung
- Ungeprüfte Veröffentlichung oder eine implizite Zusage von Datenresidenz und Sicherheitsniveau
Closed Source gehostet kein EU-Betrieb Einstieg leicht
- Plattform im Blick
Claude Cowork
Anthropic
Agentische Arbeitsoberfläche für Dokumente, Ordner und Business-Apps – dieselbe Claude-Engine wie Claude Code, aber ohne Terminal und ohne EU-Verarbeitung.
- wofür gut
-
- Mehrstufige Büroarbeit delegieren: Recherche, Auswertung, Bericht, Präsentation
- Arbeit auf lokalen Ordnern und verbundenen Business-Apps ohne Programmierkenntnisse
- wofür nicht
-
- Personenbezogene Daten oberhalb von Ampel 1 – Cowork läuft nur gegen US-Infrastruktur
- Deterministische, auditpflichtige Abläufe; dafür bleibt n8n die tragfähige Schicht
Closed Source gehostet kein EU-Betrieb Einstieg leicht
- Agenten-Framework im Blick
Hermes Agent
Nous Research
Open-Source autonomer Agent mit persistentem Gedächtnis und Skill-Loop – lernt aus Erfahrung, läuft ab 5-Dollar-VPS bis GPU-Cluster.
- wofür gut
-
- Persönliche Assistenten für Geschäftsführer (Wachstum mit Nutzung)
- Self-Hosting in voller Hoheit, OpenRouter-kompatibel
- wofür nicht
-
- Multi-User-Org-Tools (eher persönliches Werkzeug, ein Install pro Klient/Marke)
- Enterprise-Anforderungen: zentrale RBAC/Mandantenmodell und zentrale Kostenlimits fehlen weiterhin; Betriebsaufwand durch Release-Takt alle paar Wochen
Open Source self-hostbar EU-Betrieb Einstieg schwer
- Plattform im Blick
Microsoft Copilot Studio
Microsoft
Low-Code-Baukasten für eigene Agenten innerhalb von Microsoft 365 – intern ohne Aufpreis in den Copilot-Lizenzen, externe Kanäle kosten Credits.
- wofür gut
-
- Erste eigene Agenten in einem Haus, das ohnehin auf Microsoft 365 läuft
- Interne Assistenten auf SharePoint-, Teams- und Dataverse-Inhalten ohne Entwicklungsteam
- wofür nicht
-
- Anbieterunabhängigkeit – der Agent lebt in der Microsoft-Welt und wandert nicht mit
- Zugesagte EU-Verarbeitung ohne vorherige Prüfung: Flex Routing und die Claude-Modelle verlassen die EU Data Boundary
Closed Source gehostet EU abhängig Einstieg leicht
- LLM-Zugang im Blick
OpenAI API
OpenAI
Direkte API zu GPT-6 Astra und der GPT-5.6-Familie; Responses API mit Computer Use, Web-/Dateisuche, Code-Ausführung, Skills und MCP.
- wofür gut
-
- Wenn das beste verfügbare Modell für eine spezifische Aufgabe gebraucht wird
- OpenAI-spezifische Features (Agents SDK inkl. Computer-Use-Tool, Realtime, Vision)
- wofür nicht
-
- Strikte EU-Datenschutz-Anforderungen ohne BYOK / Enterprise-Vertrag
- Vendor-Lock-in-Vermeidung (dann lieber via OpenRouter)
Closed Source gehostet EU abhängig Einstieg leicht
- Orchestrierung im Blick
Paperclip
Paperclip Labs, Inc. (Open Source)
Orchestrierungs-Plattform, die KI-Agenten als 'Firma' mit Org-Chart, Tickets, Budgets und Audit-Trail verwaltet – beantwortet die Frage 'wie greift KI in einer Organisation?'
- wofür gut
-
- Mehrere Agenten unter Aufsicht und mit harten Budgets laufen lassen
- DSGVO/EU-AI-Act-Konformität durch Audit-Trail per Default
- wofür nicht
-
- Einfache Use-Cases mit nur einem Agenten – Overkill
- Teams ohne Erfahrung im Hosting kleiner Node-Apps
Open Source self-hostbar EU-Betrieb Einstieg mittel
Zu dieser Auswahl ist kein Werkzeug eingeordnet.
Aus der aktiven Landkarte genommen.
Werkzeuge verschwinden nicht still. Frühere Einschätzungen bleiben mit Datum und Begründung nachvollziehbar.
- ChatGPT Agent Eingestellt: Der Agentenmodus in ChatGPT ist seit August 2026 nicht mehr verfügbar – OpenAI verweist auf ChatGPT Work und den Cloud-Browser in ChatGPT.
- Flowise Eingestellt: Die No-Code-Plattform für LLM-Apps wird seit August 2026 nicht mehr weiterentwickelt – Code bleibt forkbar, für neue Vorhaben keine Empfehlung mehr.
- OpenAI Operator Eingestellt: Operator gibt es seit 31.08.2025 nicht mehr, der Nachfolger ChatGPT Agent ist seit August 2026 ebenfalls eingestellt – OpenAI verweist auf ChatGPT Work.