← promppy_ 실시간 AI 뉴스
참고Reddit

DeepSeek V4-Flash 0731 로컬 추론 속도 공유

실사용 환경에서의 토큰 처리 속도 및 벤치마크 공유. 로컬 구축 시 가이드라인으로 활용 가능.

요약

Reddit 커뮤니티 r/LocalLLaMA에서 DeepSeek v4 Flash 0731 모델의 추론 속도에 대한 사용자 경험 공유가 화제다. 한 사용자는 4x5060ti 16GB GPU와 DDR4 3200 4채널 RAM 환경에서 llamacpp를 사용해 해당 모델을 구동했다. 컨텍스트 윈도우는 128,000, -ub/-b는 4,096, unsloth의 q8 양자화 방식을 적용한 조건이다. 테스트 결과 프롬프트 처리 속도는 약 200 tps, 토큰 생성 속도는 약 11 tps로 측정되었다. 관련 실무자들은 동일 모델 사용 시의 구동 환경과 처리 속도 데이터를 비교하며 정보를 교환하고 있다.

AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.

원문 제목 What speeds are everyone getting with deepseek v4 flash 0731?

원문 보기 ↗
다음 뉴스 →

중요구글, 크롬에 AI 에이전트 'Gemini Spark' 통합...웹 브라우징 자동화 지원

저장된 로그인·계정으로 다단계 웹 작업 자동화. 에이전트 UX·보안 대응 검토 필요.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스