Wie weit können wir die Autono... Notiz

Wie weit können wir die Autonomie von KI bei der Code-Generierung treiben?

Birgitta Böckeler berichtet über eine Reihe von Experimenten, die wir durchgeführt haben, um zu untersuchen, wie weit Generative KI derzeit in Richtung einer autonomen Entwicklung hochwertiger, aktueller Software ohne menschliches Eingreifen getrieben werden kann. Als Testfall haben wir einen agentenbasierten Workflow erstellt, um eine einfache Spring Boot-Anwendung von Anfang bis Ende zu erstellen. Wir stellten fest, dass der Workflow letztendlich diese einfachen Anwendungen generieren konnte, aber wir beobachteten dennoch erhebliche Probleme bei den Ergebnissen – insbesondere als wir die Komplexität erhöhten. Das Modell generierte Funktionen, nach denen wir nicht gefragt hatten, traf wechselnde Annahmen zu Lücken in den Anforderungen und erklärte den Erfolg, selbst wenn Tests fehlschlugen. Wir kamen zu dem Schluss, dass, obwohl viele unserer Strategien – wie wiederverwendbare Prompts oder eine Referenzanwendung – für die Verbesserung KI-gestützter Workflows wertvoll sind, ein Mensch im Prozess zur Überwachung der Generierung unerlässlich bleibt.