오퍼스 5.5, 자기개선 평가서 1위…'완전 RSI' 내년 7월로 앞당겨
앤트로픽 오퍼스 5.5가 AI 자기개선 평가에서 1위를 차지했다
장기 과제를 에이전트에 맡기는 개발자라면 어떤 모델을 고를지 판단할 근거가 생겼다
클로드 오퍼스 5.5가 AI 벤치마크 평가에서 1위를 차지하여 자기개선 능력을 크게 향상시켰습니다. 이 모델은 24시간 내에 독자적으로 언어모델을 학습하는 데 성공했습니다. 발스 AI의 RSI 인덱스는 에이전트가 스스로 개선되는 능력을 측정합니다. 오퍼스 5.5는 이 평가에서 4개 부문에서 최고 점수를 받았습니다.
장기 과제를 에이전트에 맡기는 개발자라면 어떤 모델을 고를지 판단할 근거가 생겼다
원문 읽기이어서 볼 것
이 글을 읽은 뒤 바로 이어볼 수 있는 추천
더 읽기로 감을 넓히고, 사례를 본 뒤, 필요하면 참여나 도구로 넘어가면 됩니다.
다음 행동
아직 댓글이 없습니다. 첫 댓글을 작성해보세요!