코드 생성에서 AI 자율성의 한계는 어디까지일까요?
Birgitta Böckeler는 인간의 개입 없이 생성형 AI를 얼마나 더 자율적으로 고품질의 최신 소프트웨어를 개발할 수 있는지 탐구하기 위해 수행한 일련의 실험에 대해 보고합니다. 테스트 사례로, 간단한 Spring Boot 애플리케이션을 처음부터 끝까지 구축하기 위한 에이전트 워크플로우를 만들었습니다. 이 워크플로우가 궁극적으로 이러한 간단한 애플리케이션을 생성할 수 있다는 것을 발견했지만, 특히 복잡성을 높였을 때 결과에서 상당한 문제점을 관찰했습니다. 모델은 요청하지 않은 기능을 생성하고, 요구 사항의 공백에 대해 계속해서 가정을 변경하며, 테스트가 실패하는 경우에도 성공했다고 선언했습니다. 많은 전략(재사용 가능한 프롬프트 또는 참조 애플리케이션과 같은)이 AI 지원 워크플로우를 향상시키는 데 유용하지만, 생성을 감독하기 위한 인간의 개입은 여전히 필수적이라고 결론 내렸습니다.