NVIDIA 내부 에이전트 하네스 설계 구조 공개: 6가지 핵심 설계 원칙
파이썬 기반 에이전트 설계의 표준이 될 수 있는 엔지니어링 패턴과 하네스 구조를 제시함.
요약
NVIDIA가 공개한 내부 에이전트 하네스(agent harness)는 SWE-bench Verified 벤치마크에서 82.2%의 점수를 기록하며 기존 모델들(78.2%, 78.6%)을 상회했다. 이 시스템은 29번의 모델 호출과 110만 개의 토큰을 사용하여 효율성을 입증했으며, 특정 프레임워크 없이 6가지 설계 원칙을 준수한다. 핵심은 도구 호출 시 파이썬 시그니처를 검증해 모델 도달 전 오류를 차단하고, 대규모 데이터를 전체 대화에 포함하지 않고 객체 참조 방식으로 처리하는 구조다. 또한, 에이전트 상태를 대화 기록 외부에서 관리하며 오케스트레이션 루프를 순수 파이썬 코드로 구성해 엔지니어와 모델이 모두 수정 가능하게 했다. 이러한 구조는 에이전트 클래스 내에서 메서드를 기능으로, docstring을 프롬프트로, 타입 어노테이션을 계약으로 정의하는 방식으로 향후 AI 에이전트 개발의 표준 모델이 될 것으로 전망된다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @undefinedKi: NVIDIA just published how they build agent harnesses internally. This is the shape everyone else will be running by next year Thei
원문 보기 ↗