AWS erweitert sein KI-Portfolio um ein spezialisiertes Laufzeit-System für KI-Agenten. "Strands Harness" ist eine quelloffene Runtime-Umgebung, die es Entwicklern ermöglicht, KI-Agenten effizienter und kostengünstiger zu betreiben.

KI-Agenten sind Systeme, die autonom Aufgaben durchführen, indem sie iterativ planen, handeln und lernen. Ein klassisches Beispiel ist ein Kundensupport-Agent, der Fragen beantwortet und Probleme löst. Solche Systeme erfordern häufig Zugriff auf grosse Sprachmodelle (LLMs), die über APIs abgerufen werden. Jeder API-Aufruf kostet Geld und benötigt Kontextinformationen, die in Token gemessen werden.

Das zentrale Problem ist das "Context-Management": Um einen Agenten funktionsfähig zu halten, muss man grosse Mengen von Kontextinformationen (zum Beispiel Instruktionen, Historie, Daten) bei jedem Request mitschicken. Dies führt zu hohem Token-Verbrauch und damit zu hohen Kosten. Strands Harness soll dieses Problem lösen, indem es intelligenter mit Kontext umgeht und nur das Nötigste an die LLM sendet.

Ein weiterer Vorteil ist die Möglichkeit, Agenten lokal auszuführen. Dies ist wichtig für Organisationen mit Datenschutzanforderungen oder solche, die ihre Agenten offline betreiben möchten. Lokale Ausführung bedeutet, dass sensible Daten nicht an externe APIs gesendet werden müssen.

Da Strands Harness quelloffen ist, können Entwickler es inspizieren, modifizieren und auf ihre Bedürfnisse anpassen. Dies ist attraktiv für Organisationen, die keine Abhängigkeit von proprietären AWS-Lösungen eingehen möchten.

Für KMUs, die an KI-Agenten arbeiten, ist dieses Tool interessant. Es reduziert die Kosten für die Betreibung von Agenten und bietet mehr Kontrolle. Besonders relevant ist es für Organisationen mit hohem Agenten-Throughput oder mit starken Datenschutzanforderungen.