Alle reden über Agenten – aber keiner sagt, was es alles braucht

"Da nimmt man halt einen Agenten." Dieser Satz fällt gerade in jedem zweiten Strategie-Meeting. Er klingt so einfach wie "da stellt man halt einen Mitarbeiter ein" …nur dass ein Mitarbeiter ohne Telefon, ohne Aktenschrank, ohne Zugang zu irgendeinem System nichts bewirken kann, egal wie klug er ist. Bei KI-Agenten ist es nicht anders. Um zu verstehen, was ein Agent wirklich braucht, lohnt sich ein altmodisches Bild: das Büro mit Telefonanlage.
Der erste Denkfehler passiert schon beim Begriff selbst: Das LLM ist nicht der Agent. Das LLM ist das Gehirn des Agenten. Ein Agent ist der komplette Mitarbeiter: das Gehirn, die Hände und ein Nervensystem, das beides verbindet. Jeder dieser Teile braucht eine eigene Infrastruktur, eine eigene Laufzeitumgebung, und eigene Kosten.
Diese drei Teile zusammen – Gehirn, Hände, Nervensystem – sind der Agent. Nicht mehr, nicht weniger.
Manchmal reichen die eigenen Hände nicht. Dann greift der Mitarbeiter zum Hörer und ruft einen Kollegen an – vielleicht in einer anderen Abteilung, vielleicht bei einer anderen Firma. Das ist A2A (Agent-to-Agent): Ein Agent schickt eine Aufgabe an einen anderen Agenten, der komplett auf seinem eigenen Schreibtisch denkt und handelt – eigenes Gehirn, eigene Hände, eigenes Nervensystem. Man bekommt nur das Ergebnis über den Telefonhörer zurück, keinen Einblick, was der andere dafür alles angefasst hat: wie beim Telefonieren sieht man das nicht.
Der entscheidende Unterschied zu MCP: MCP ist stumm, A2A ist ein Gespräch. Ein Werkzeug denkt nicht mit. Ein anderer Agent schon.
Sobald mehr als ein Mitarbeiter im Spiel ist, braucht es jemanden, der koordiniert – den Orchestrator. Wichtig: Der Orchestrator ist nicht Teil des Mitarbeiters, er ist eine eigene Instanz außerhalb davon. Wie ein Vorarbeiter oder Bürochef entscheidet er, welcher Mitarbeiter für welche Aufgabe eingesetzt wird, und stattet ihn aus:
Beide Registries sind reine Nachschlagewerke – kein Denken, keine Handlung, nur Metadaten (welche Tools gibt es, welche Agenten sind erreichbar, mit welchen Schemas und Berechtigungen). Aber auch Nachschlagewerke müssen irgendwo gehostet werden.
Damit sind wir bei mindestens fünf getrennten Compute-Stellen, die gleichzeitig laufen und bezahlt werden müssen:
Und die Liste ist noch nicht mal unbedingt vollständig: Optional könnte man noch ein Agent-Memory hinzufügen, also ein Langzeitgedächtnis, das technisch in ganz unterschiedlichen Arten und Weisen umgesetzt werden könnte. Genau deswegen würde es aber hier den Rahmen sprengen und daher lasse ich es an dieser Stelle außen vor.
Kein einzelner dieser Punkte ist "der Agent". Und "einen Agenten nehmen" heißt in Wirklichkeit: mindestens fünf Infrastrukturentscheidungen treffen und dauerhaft betreiben.
Und ja: man kann die Befähigung auch anders schneiden, als hier beschrieben. Man kann z.B. die Tool-Auswahl an einen Agenten delegieren (mehr Autonomie) oder man kann selbst den Orchestrator die Tools nicht auswählen lassen (weniger Autonomie). Das ist eine Entscheidung des Firmenchefs!
Eine Ebene fehlt noch – und sie ist anders als alle davor, weil sie kategorial keine Technik ist: der Firmenchef. Er ist der einzige Mensch in diesem ganzen Bild. Er legt fest:
Der entscheidende Punkt: Der Firmenchef ist kein Compute. Er läuft nirgends im System. Er entwirft und genehmigt die Architektur, ist aber nicht Teil davon. Jede neue Tool-Freigabe, jeder neue Agent, jede neue externe Verbindung ist am Ende eine Entscheidung von hier oben – alles darunter ist nur die technische Umsetzung.
Wer frägt "wo läuft das dann?", bekommt keine einzelne Antwort. Es ist ein kleines verteiltes System aus mehreren unabhängig laufenden, unabhängig skalierenden und unabhängig ausfallenden Komponenten: Gehirn, Nervensystem, Hände, Bürochef, Registries – plus fremde Infrastruktur, die man selbst gar nicht kontrolliert.
Das ist keine schlechte Nachricht. Es ist der Grund, warum diese Architektur robust und flexibel skaliert – jede Komponente kann für sich wachsen, ausfallen oder ersetzt werden, ohne die anderen mitzureißen. Es bedeutet aber auch: "Da nimmt man halt einen Agenten" ist ein Satz, der viele Teile involviert und kein
Dr. Andreas Kyek
Andreas is Practice Lead for Data Science and AI und seit April 2022 bei [at]. Er hat über 20 Jahre Erfahrung in der Fertigung in der Halbleiter-Industrie und ist Experte für Anomalie-Erkennung und prädiktive Wartung. Spätestens seit Large-Language-Modell verfügbar wurden, beschäftigt er sich mehr und mehr mit Agenten, Datenverarbeitung durch Agenten und insbesondere mit dem Entwurf von Multiagentensystemen - auf Basis einschlägiger Bibliotheken, aber auch „from Scratch“.
Cookie Freigabe
Diese Website verwendet notwendige Cookies zur Sicherstellung des Betriebs der Website. Eine Analyse des Nutzerverhaltens durch Dritte findet nicht statt. Detaillierte Informationen über den Einsatz von Cookies finden Sie in unseren Datenschutzerklärung.
Individuelle Cookie Einstellungen
Datenschutzeinstellungen
Hier finden Sie eine Übersicht über alle verwendeten Cookies. Sie können Ihre Zustimmung zu ganzen Kategorien geben oder sich weitere Informationen anzeigen lassen und so nur bestimmte Cookies auswählen.
Notwendige Cookies
Diese Cookies ermöglichen grundlegende Funktionen und sind für die einwandfreie Funktion der Website erforderlich.
Cookie Informationen anzeigen
Cookie Informationen verbergen
Hubspot CMS
HubSpot CMS ist ein Content-Management-System, das verschiedene Cookies zur Verfolgung von Besucherinteraktionen verwendet.
| Anbieter: | HubSpot, Inc., 25 First Street, Cambridge, MA 02141, USA |
| Cookiename: | __hstc; hubspotutk; __hssc; __hssrc; __cf_bm; __cfruid |
| Laufzeit: | 6 Monate; 6 Monate; 30 Minuten; Sitzungsende; 30 Minuten; Sitzungsende |
| Datenschutzlink: | https://legal.hubspot.com/de/privacy-policy |
| Host: | .hubspot.com |
Matomo Analytics
Matomo ist eine Open-Source-Webanalyselösung, die Datenschutz und Datenhoheit betont und statistische Nutzer-Informationen festhält.
| Anbieter: | InnoCraft Ltd., 150 Willis St, 6011 Wellington, New Zealand |
| Cookiename: | _pk_id..; _pk_ses.. |
| Laufzeit: | 13 Monate; 30 Minuten |
| Datenschutzlink: | https://matomo.org/gdpr-analytics/ |
| Host: | .matomo.cloud |
Cookies für Externe Inhalte
Inhalte von Videoplattformen und Social Media Plattformen werden standardmäßig blockiert. Wenn Cookies von externen Medien akzeptiert werden, bedarf der Zugriff auf diese Inhalte keiner manuellen Zustimmung mehr.
Cookie Informationen anzeigen
Cookie Informationen verbergen
YouTube
YouTube setzt verschiedene Cookies zur Verwaltung von Benutzereinstellungen und zur Verfolgung von Nutzerinteraktionen. Und wird verwendet, um YouTube-Inhalte freizuschalten.
| Anbieter: | Google Ireland Limited, Gordon House, Barrow Street, Dublin 4, Ireland |
| Cookiename: | YSC; VISITOR_INFO1_LIVE; PREF |
| Laufzeit: | Sitzungsende; 6 Monate; 8 Monate |
| Datenschutzlink: | https://policies.google.com/privacy?hl=de |
| Host: | .youtube.com |
Podigee
Podigee ist ein Podcast-Hosting-Dienst, der Cookies für die Freischaltung von Inhalten gesetzt.
| Anbieter: | Podigee GmbH, Revaler Straße 28, 10245 Berlin, Deutschland |
| Cookiename: | Nicht spezifiziert |
| Laufzeit: | Nicht spezifiziert |
| Datenschutzlink: | https://www.podigee.com/de/ueber-uns/datenschutz/ |
| Host: | .podigee.com |
Google Maps
Dient zum Entsperren von Google Maps-Inhalten. Google Maps verwendet Cookies, um Benutzerpräferenzen zu speichern und die Nutzung zu erleichtern.
| Anbieter: | Google Ireland Limited, Gordon House, Barrow Street, Dublin 4, Irland |
| Cookiename: | SID; HSID; NID |
| Laufzeit: | 2 Jahre; 2 Jahre; 6 Monate |
| Datenschutzlink: | https://policies.google.com/privacy?hl=de |
| Host: | .google.com |
Ihre Cookie-Einstellungen erlauben keine externen Inhalte von Google Maps.