참고AI타임스
미니맥스, 멀티모달 영상 생성 모델 'H3' 공개
텍스트-오디오-영상 통합 처리 모델로 오픈웨이트 공개를 예고했습니다. 고성능 영상 생성 모델을 로컬 환경에 구축하려는 경우 고려해볼 만합니다.
요약
중국 AI 스타트업 미니맥스가 텍스트와 이미지, 영상, 오디오를 통합 처리하는 차세대 멀티모달 영상 생성 모델 'H3'를 공개했다. H3는 아티피셜 애널리시스의 각종 벤치마크에서 최상위권 성적을 기록하며 바이트댄스의 '시댄스(Seedance)'와 경쟁할 성능을 입증했다. 미니맥스는 31일 '하이루오(Hailuo)' AI 플랫폼과 개발자 API를 통해 H3 서비스를 시작했다. 더불어 미니맥스는 수일 내에 H3의 모델 가중치를 커뮤니티 라이선스로 공개해 생태계 확장에 나설 계획이다. 이번 모델 공개는 연 매출 2000만달러 미만 기업 대상의 라이선스 전략을 포함하고 있어 향후 영상 AI 시장 경쟁 구도에 변화를 줄 것으로 전망된다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 미니맥스, 텍스트·오디오 통합 멀티모달 영상 AI 'H3' 공개... "오픈웨이트로 시댄스에 도전"
원문 보기 ↗