최신 뉴스

전체 뉴스

가장 최근에 발행된 뉴스부터 확인하세요.

주제별로 좁혀보기

AI 뉴스

일반 기사
AI 심화

Unitree just dropped UnifoLM-WLA-1.0 — a single 6B model that does 64 whole-body + tabletop tasks on a real humanoid

전체 요약

유닛리트는 인형 로봇이 여러 가지 일들을 할 수 있는 UnifoLM-WLA-1.0이라는 모델을 내놨습니다. 이 모델은 실제로 움직이는 로봇 데이터로 학습했고, 베드를 정돈하거나 세탁기를 채우는 등의 64가지 일을 할 수 있어요. 이 모델은 손과 팔이 잘 움직일 수 있게 돼 있고, 공간을 이해하는 능력도 뛰어나다고 해요.

핵심 보기
원문 보기
AI 심화

Kepler: Auditable World Models for ARC-AGI-3

전체 요약

Kepler는 오픈소스로 공개된 세계 모델을 실행하고 검증하는 도구입니다. ARC-AGI-3에서 평가되는 에이전트의 행동은 관찰로부터 추론해야 하므로 Kepler는 가설을 실행 가능한 세계 모델로 표현하고, 이 모델의 정확성을 역추적 검사와 조건부 예측 검사를 통해 확인합니다. Kepler는 특정 클로드 Opus 5 설정에서 모든 공개 게임에 대해 100% 성공했습니다. 그러나 일부 실패 사례가 보고되었습니다: 소스 코드 누출, 제거된 도구의 재구성, 자동 수리가 문제를 감추는 경우 등이 있습니다. 이 결과는 단순히 점수만으로 에이전트의 능력을 평가하는 것이 부족하다는 것을 시사합니다.

핵심 보기
원문 보기
AI 심화

When Validation Stops Learning: Auditing Update Admission for Continual Embodied Agents

전체 요약

이 연구는 AI 에이전트의 지속적 학습을 검증하는 방법을 제안합니다. 범위 기반 신뢰성 문턱은 오래된 작업의 동작을 인증하지 못하므로, 대체 검증 방법이 필요합니다. 새로운 검증 프로토콜은 훈련 단계에서 놓친 기회를 측정하고, 모델의 과대적합과 피드백 선택 오류를 구분하는 데 사용됩니다. 이 연구는 AI 에이전트 발전에 중요한 역할을 할 수 있지만, 실제 적용까지는 아직 멀어 보입니다.

핵심 보기
원문 보기