Qwen 모델의 내부 구조를 실시간 제어하는 'AkbasCore' 공개
파라미터 튜닝 없이 모델 내부 신호를 추출해 행동 벡터를 주입하는 기법으로, LLM 제어 및 해석 가능성을 높이는 오픈소스 도구.
요약
AkbasCore는 Qwen2.5-7B 모델의 가중치를 수정하거나 파인튜닝, LoRA 학습 없이 모델 내부를 실시간으로 제어하는 새로운 기술을 공개했습니다. 이 시스템은 모델 내부의 28개 레이어 전체를 분석하여 특정 행동(상세함 vs 간결함, 창의성 vs 평이함 등)을 조절하는 방향성을 실시간으로 추출합니다. 미리 정의된 벡터를 불러오는 방식과 달리, 모델이 실행되는 즉시 내부 신호를 읽어 8가지 행동 차원에 대한 조절 벡터를 스스로 생성하고 주입합니다. 사용자는 별도의 학습 과정 없이도 모델의 출력 특성을 즉각적으로 제어할 수 있는 것이 특징입니다. 현재 해당 프로젝트는 오픈소스로 공개되어 누구나 직접 테스트해 볼 수 있습니다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 AkbasCore: I Opened Qwen’s Black Box — It Builds Its Own Steering Vectors, Injects Them Live, and X-Rays All 28 Layers [Open Source / Try It Yourself]
원문 보기 ↗