최신 뉴스

전체 뉴스

가장 최근에 발행된 뉴스부터 확인하세요.

주제별로 좁혀보기 · 개발·코딩
일반 기사
AI 심화

The Last Human Gate: Forward Deployed Engineering for Governance Automation

전체 요약

이 기사는 디지털 정부 프레임워크(DGF)에서 인공지능(AI)을 활용해 인간의 역할을 대체하는 방법에 대해 설명합니다. AI는 대부분의 검토 작업을 자동화할 수 있지만, 일부 예외 사항은 여전히 인간이 처리해야 합니다. 연구진은 300개의 가상 프로젝트와 899개의 모델-프로젝트 실행에서 AI가 76.92%까지 성공했습니다. 이 결과는 AI가 정부 관리 작업을 대체할 수 있다는 것을 보여줍니다.

핵심 보기
원문 보기
AI 심화

RECLAIM: Can Agents Reproduce the Claims of Machine Learning Papers?

전체 요약

AI 에이전트가 기계 학습 논문을 재현하는 데 도전했습니다. RECLAIM이라는 새로운 벤치마크를 통해 100편의 논문을 연간으로 재구성해 보았습니다. 가장 쉬운 경우에도 성공률은 41%에 불과했고, 코드나 데이터가 없는 경우는 거의 실패로 끝났습니다. 이 실험은 AI 에이전트들이 얼마나 정확하게 학습 모델을 이해하고 재현하는지 보여줍니다.

핵심 보기
원문 보기
AI 심화

Pistis Technical Report

전체 요약

Pistis 모델은 Qwen3.6과 Qwen3.5 기반으로 만들어졌고, 큰 이미지와 텍스트를 동시에 이해할 수 있는 능력을 가집니다. 이 모델은 새로운 학습 방법을 사용해 더 잘 작동합니다. Pistis-Thinking은 깊은 사고 능력을 강화하고, Pistis-Agentic는 장기 계획과 도구 사용을 지원합니다. 이러한 모델들은 기존의 기본 모델보다 성능이 좋습니다.

핵심 보기
원문 보기
AI 심화

Control the Harness, Control the Cost: Routing and Governing AI Coding Agents in the Enterprise

전체 요약

기업은 AI 코드 에이전트를 실행하는 하네스를 구매하여 직원들에게 도입하고 있습니다. Anthropic의 Claude Code와 OpenAI의 Codex 같은 대형 공급업체에서 제공되는 하네스는 모델 응답, 토큰 캐시 사용 및 서브 에이전트 실행 등을 결정합니다. 이 연구에서는 Jev라는 분류기를 활용하여 요청을 분류하고, 사용자의 한 번의 입력은 여러 요청으로 변환되므로 캐시를 재구성하지 않아도 되는 작업만 처리하는 빠른 라우터를 제안합니다. 이를 통해 Anthropic의 하네스 가격에서 연간 모델 비용 절감율이 14%에서 21%까지 예상됩니다. 그러나 원문에는 구체적인 데이터가 부족하여 정확한 효과는 불명확합니다.

핵심 보기
원문 보기
AI 입문

Gemini 3.8 Live with Live Avatar gives Google’s AI a face

전체 요약

Google의 새로운 Gemini 3.8 Live 업데이트는 사용자가 실시간으로 응답하는 애니메이션 AI 캐릭터와 대화할 수 있게 해줍니다. 이 Live Avatar는 입을 동그랗게 하는 것을 보면서 말하는 내용과 맞춰집니다. 현재는 기업용 고객만 이용 가능합니다. Gemini의 언어 능력은 97개국 이상에서 원활하게 작동하며, 영어와 일본어를 번역할 때도 입 모양이 잘 맞습니다.

핵심 보기
원문 보기
AI 심화

딥시크, AI 에이전트 '학습 비용 절감 핵심 인프라' DSec 공개

전체 요약

딥시크는 대규모 AI 에이전트 학습을 위한 전용 인프라 기술 '딥시크 엘라스틱 컴퓨팅'을 발표했습니다. 이 기술은 많은 실행 환경을 효율적으로 관리하고, 에이전트의 돌발 행동을 차단합니다. 연구진은 이를 통해 AI 에이전트 학습 비용을 줄일 수 있다고 설명합니다.

핵심 보기
원문 보기
AI 심화

FreedomIntelligence/HuatuoGPT-3-27B · Hugging Face

전체 요약

HuatuoGPT-3-27B은 의료용 AI 모델로, Qwen3.8-27B을 기반으로 One-stage Policy Optimization이라는 방법을 사용해 만들어졌습니다. 이 방법은 언어 모델을 단 한 번의 강화학습 과정에서 의학 분야에 맞게 조정합니다. 이전에는 9억 매개변수 규모의 버전이 있었지만, 이번에는 27억 매개변수 규모로 크게 성장했습니다. 이를 통해 의료 전문가들이 더 정확한 도움을 받을 수 있게 됩니다.

핵심 보기
원문 보기
AI 활용

Muse will apparently let you download its entire filesystem

전체 요약

개발자들이 무즈에 적은 지시만 주면 무즈의 모든 파일을 다운받을 수 있다고 말해요. 두 개발자는 무즈가 루트 파일 시스템과 앱 템플릿, 내부 문서까지 공유했답니다. 메타는 이 사건이 보안 문제라고 하지 않아요. 하지만 무즈는 거의 어떤 지시에도 반응한다고 해요. 원문에 구체적 데이터 미제시

핵심 보기
원문 보기
AI 활용

알리바바, ‘큐원-오디오-3.1’ 공개...최대 95% 가격 파괴

전체 요약

알리바바가 새로운 음성 인식 및 합성 기능을 추가한 ‘큐원-오디오-3.1’을 출시하여 글로벌 시장에서 가격 경쟁에 나섰습니다. 이 모델은 음성인식과 음성합성을 강화하고, 새로운 오디오 이해 및 생성 기능을 제공합니다. 개발자 생태계를 확대하기 위해 저렴한 가격으로 출시되어, 많은 사람들의 AI 음성 서비스 경험에 변화가 예상됩니다.

핵심 보기
원문 보기