참고X
GPT-6 Astra, ARC-AGI 벤치마크서 97% 기록
CoT 없이도 기록한 놀라운 결과. 모델의 추론 능력 수준을 가늠하는 지표로 참고.
원문 제목 @haider1: Astra without CoT gets 97% on ARC-AGI-3 the 97% is actually with the provider-adapter harness, but still... this is kinda absurd h
원문 보기 ↗CoT 없이도 기록한 놀라운 결과. 모델의 추론 능력 수준을 가늠하는 지표로 참고.
원문 제목 @haider1: Astra without CoT gets 97% on ARC-AGI-3 the 97% is actually with the provider-adapter harness, but still... this is kinda absurd h
원문 보기 ↗광고
중요Claude, 페르마의 마지막 정리 첫 형식화 증명 완료…역대 최대 규모 Lean 증명
1,300만 줄·2.9만 정리 형식화. 대규모 형식 검증에 LLM 활용 가능성 입증.
promppy는 한국 AI 실무자를 위한 실시간 AI 뉴스 터미널입니다.
15분마다 속보·중요·팁 자동 수집 · 한국어 요약 제공