← promppy_ 실시간 AI 뉴스
참고Reddit

Doom 게임 플레이로 비교한 Jev, Laya, Qwen3.5 모델 성능 테스트

다양한 모델의 에이전트 제어 능력을 게임 환경에서 검증한 실증 사례.

요약

Reddit의 r/LocalLLaMA 커뮤니티에 Jev, Laya, 파인튜닝된 ModernCE-base-nli, Qwen3.5-4B 모델을 활용해 Doom을 플레이하게 한 실험 결과가 공유되었습니다. 각 모델은 동일한 시드값으로 게임을 시작하며, 이후 각자의 판단에 따라 고유한 게임 흐름을 생성했습니다. 입력 데이터로는 ViZDoom의 객체 라벨, 바운딩 박스, HUD 수치 등을 텍스트로 변환하여 사용했고, 출력값으로 좌우 이동이나 발사 등의 버튼 액션을 수행했습니다. 실험은 'Defend the Center'와 'Health Gathering' 시나리오에서 진행되었으며, 화면에는 각 모델의 행동 확률, 킬 수, 생존 시간이 실시간으로 표시되었습니다. 모든 모델은 단일 시스템 내에서 로컬로 구동되어 게임 플레이 제어 능력을 검증했습니다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 I gave Jev, Laya, finetuned ModernCE and Qwen3.5 the controls to Doom

원문 보기 ↗

광고

다음 뉴스 →

중요StepFun, 에이전트 작업 특화 플래그십 'Step 5 Preview' 공개

600B MoE·1M 컨텍스트에 10/15 오픈웨이트 예정. 금융·SWE 에이전트 자체 구축 대안으로 검토할 만.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스