Claude·Cursor·Codex가 선택하는 개발 도구 분석…1.7만 건의 실행 데이터 공개
주요 코딩 에이전트들의 라이브러리 및 프레임워크 선호도를 분석한 자료로, 에이전트의 기술 스택 선택 경향을 파악할 수 있습니다.
요약
AI 코딩 에이전트가 어떤 도구를 선택하는지 분석하기 위해 17,000회 이상의 실험을 수행한 연구 결과가 발표되었다. 연구진은 GitHub 리포지토리의 언어, 프레임워크, 팀 규모 등 다양한 변수를 반영한 75개의 실제 환경 리포지토리를 구축해 Claude, Codex, Cursor 등의 성능을 측정했다. 실험에는 가상의 회사명과 깃 히스토리, 실제 lockfile이 사용되었으며, 1,163가지의 다양한 상황과 프롬프트를 적용하여 에이전트의 선택을 분석했다. 특히 프롬프트에 비용이나 사용량과 같은 구체적인 제약 조건을 추가했을 때 결과가 어떻게 달라지는지도 함께 검증했다. 이번 연구는 AI 코딩 에이전트가 실제 개발 환경에서 외부 서비스를 어떻게 선택하고 구현하는지에 대한 객관적인 데이터를 제공한다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 Which tools do Claude, Codex and Cursor choose? We measured 17k runs to find out
원문 보기 ↗