← promppy_ 실시간 AI 뉴스
참고Reddit

과학 분야 LLM 벤치마크, 정답 오류 수정하니 성능 점수 대폭 상승

벤치마크 데이터 신뢰성 문제 제기. 모델 평가 시 자체 데이터셋 검증의 중요성을 시사함.

원문 제목 Turns out that many current science-based LLM benchmarks have flaws in their answers. When corrected, the LLM benchmark scores rose significantly.

원문 보기 ↗

광고

다음 뉴스 →

중요메타, 자체 AI 칩 'MTIA' 3·4세대 데이터센터 배치...엔비디아 의존 축소

빅테크의 자체 칩 내재화 가속. 향후 GPU 수급·추론 비용 지형 변화 주시할 시점.

promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.

15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공

실시간 피드 보기 →RSS 구독

관련 뉴스

최신 뉴스