Qwen3 에이전트 작업 중단 문제 해결: 툴 콜링 태그 분석
llama.cpp 환경에서 툴 콜링이 내부 추론 태그에 갇혀 무반응으로 끝나는 버그를 디버깅하고 해결하는 구체적 방법.
요약
최근 Qwen3 모델을 llama.cpp 환경에서 구동하는 실무자들 사이에서 AI 에이전트가 작업 도중 예고 없이 멈추는 현상이 보고되고 있습니다. 분석 결과, 이는 모델이 도구 호출(tool calling)을 수행했음에도 불구하고, 해당 내용이 외부로 출력되지 않고 <think> 태그 내부의 추론 영역에만 머물러 발생하는 문제로 밝혀졌습니다. API 상으로는 finish_reason이 'stop'으로 정상 반환되지만 실제 작업은 완료되지 않은 상태로 남게 됩니다. 이러한 현상은 Qwen3와 DeepSeek 모델을 vLLM, SGLang, llama.cpp 등에서 사용할 때 공통적으로 발견되는 이슈로 확인되었습니다. 프롬프트 오류로 오인하기 쉽지만, 사실상 모델 내부 추론 과정에서 도구 호출 정보가 누락되어 발생하는 기술적 결함입니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 My agent kept randomly stopping mid-task and I finally figured out why (llama.cpp + Qwen3 tool calling)
원문 보기 ↗