구글, 내부서 '제미나이 4 아르곤' 성능 회의론..."벤치맥싱 한계" 지적
구글의 새 AI 모델은 시험 점수는 좋다는데 실전에서 흔들린다
새 모델을 코딩에 도입할 계획이라면 벤치마크 점수만 믿고 고르면 안 된다는 근거가 생겼다
구글이 새로운 AI 모델 '제미나이 4 아르곤'을 공개했지만, 실제 업무에서는 기대만큼 성능이 좋지 않다는 내부 평가가 나왔습니다. 여러 테스트에서 좋은 점수를 받았지만, 복잡한 작업에서는 안정적이지 못하다는 지적입니다. 구글은 이 모델을 먼저 일부 사람들에게 시험해보게 하고, 더 나아질 수 있도록 계속 개선할 계획입니다.
새 모델을 코딩에 도입할 계획이라면 벤치마크 점수만 믿고 고르면 안 된다는 근거가 생겼다
원문 읽기이어서 볼 것
이 글을 읽은 뒤 바로 이어볼 수 있는 추천
더 읽기로 감을 넓히고, 사례를 본 뒤, 필요하면 참여나 도구로 넘어가면 됩니다.
다음 행동
아직 댓글이 없습니다. 첫 댓글을 작성해보세요!