0.8B 모델 파인튜닝으로 받아쓰기 텍스트 정제 'SpeakoFlow Mini' 공개
소형 모델 파인튜닝으로 특정 작업에서 범용 모델 능가 가능. 받아쓰기 정제 등 도메인 특화 모델 구축에 참고.
요약
SpeakoFlow Mini는 Qwen3.5-0.8B 모델을 기반으로 튜닝된 Apache-2.0 라이선스의 받아쓰기 교정 전용 모델이다. 일반적인 챗봇이나 문장 다듬기 모델과 달리, 음성-텍스트 변환(STT) 출력물에서 화자가 수정한 내용만 정확히 반영하고 나머지 텍스트는 그대로 유지하는 데 초점을 맞췄다. 기존 범용 모델들은 이미 정확한 텍스트까지 과도하게 수정하는 문제가 있었으나, SpeakoFlow Mini는 불필요한 편집을 최소화했다. 개발자가 자체 구축한 영어 벤치마크 결과, SpeakoFlow Mini는 70.7%의 정확도를 기록하여 65.0%를 기록한 GPT-5.6 Luna와 통계적으로 대등한 성능을 보였다. 이번 사례는 특정 작업에 특화된 경량 모델이 거대 모델과 경쟁할 수 있음을 보여준다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 I fine-tuned a 0.8B local model for dictation cleanup. It matched a hosted frontier model on this narrow task
원문 보기 ↗