Daily Arxiv

전 세계에서 발간되는 인공지능 관련 논문을 정리하는 페이지 입니다.
본 페이지는 Google Gemini를 활용해 요약 정리하며, 비영리로 운영 됩니다.
논문에 대한 저작권은 저자 및 해당 기관에 있으며, 공유 시 출처만 명기하면 됩니다.

Live-SWE-agent: Can Software Engineering Agents Self-Evolve on the Fly?

Created by
  • Haebom
Category
Empty

저자

Chunqiu Steven Xia, Zhe Wang, Yan Yang, Yuxiang Wei, Lingming Zhang

개요

본 논문은 실시간으로 스스로 진화하며 실제 소프트웨어 문제를 해결하는 최초의 라이브 소프트웨어 에이전트인 Live-SWE-agent를 제안합니다. Live-SWE-agent는 가장 기본적인 에이전트 스캐폴드로 시작하여 런타임 중에 자체 스캐폴드 구현을 자율적으로 진화시킵니다. SWE-bench Verified 벤치마크에서 77.4%의 해결률을 달성하여 기존 소프트웨어 에이전트를 능가하며, SWE-Bench Pro 벤치마크에서도 45.8%의 해결률로 최고의 성능을 보입니다.

시사점, 한계점

시사점:
실시간, 자율적 진화를 통해 소프트웨어 문제 해결 능력을 향상시키는 새로운 접근 방식 제시.
기존 소프트웨어 에이전트 및 수동 제작 에이전트의 성능을 뛰어넘는 뛰어난 성능 입증.
라이브 환경에서 지속적인 학습 및 적응을 통해 문제 해결 능력을 향상시키는 잠재력 제시.
한계점:
논문에서 구체적인 한계점이 명시되지 않음.
👍