참고X
LMSYS Arena에 Claude Opus 5.5 및 GPT-6 Sol 등록
최신 모델인 Claude Opus 5.5와 GPT-6 Sol이 벤치마크 리더보드에 추가되어 성능 비교 가능.
요약
LMSYS Chatbot Arena 플랫폼에 Anthropic의 Claude Opus 5.5와 OpenAI의 GPT-6 Sol이 추가되어 나란히 생성된 결과를 비교할 수 있게 되었다. 현재 Claude Opus 5.5에 대한 구체적인 점수는 곧 공개될 예정이다. Arena 리더보드는 전 세계 사용자들이 실제 업무에서 직접 입력한 테스트 데이터를 기반으로 순위가 매겨진다. 사용자들은 지금 바로 Arena에 접속하여 해당 모델들의 성능을 직접 테스트해 볼 수 있다. 향후 업데이트되는 상세 점수와 결과에 주목해야 한다.
AI가 원문을 요약한 내용으로, 부정확할 수 있습니다.
원문 제목 @arena: Check out side-by-side outputs generated on Arena from Claude Opus 5.5 by @AnthropicAI and GPT-6 Sol by @OpenAI. Scores for @claud
원문 보기 ↗