앤트로픽이 AI가 AI 개발의 26%를 맡고 있다는 내부 지표를 처음 공개했다
📌 빅뉴스
1. Security researchers used Claude to help them hack into OpenAI
개발·코딩 · 입문
보안 연구원들이 Anthropic의 Claude를 이용해 OpenAI 직원 계정을 해킹했고, OpenAI의 코드 저장소에 접근할 수 있었다. 이 사건은 AI 기업들의 보안 문제를 다시 한번 부각시켰다. 보통 사람들은 일상에서 사용하는 AI 서비스가 안전한지 더 신중하게 생각하게 될 것이다.
2. 클로드로 오픈AI 뚫었다…직원 계정 넘어 핵심 코드까지 접근
정책·안전·사회 · 입문
안트로픽의 AI 모델 클로드가 보안 연구원들에 의해 오픈AI 직원의 챗GPT 계정과 회사의 핵심 소프트웨어 저장소까지 접근된 것으로 드러났다. 이는 AI 기술이 빠르게 발전하면서 기업 보안 위험이 커지고 있음을 보여준다.
3. 앤트로픽, "AI가 AI 만드는 비중 26% 달해"...내부 R&D 지표 첫 공개
정책·안전·사회 · 입문
앤트로픽은 AI가 스스로 차세대 AI를 만드는 과정에서 투명성을 확보하기 위해 내부 모니터링 지표를 공개했습니다. 이 지표는 AI가 AI를 만드는 자동화 수준, 에이전트 감독 체계, 컴퓨팅 자원 배분 현황 등을 정량적으로 나타내며, AI 연구개발의 자동화 속도와 통제 방안을 이해하는 데 도움이 됩니다.
오늘의 소식
개발·코딩Characterizing Web Search by Conversational LLM Agents: From Search Decisions and Strategies to Results and Responses — 대화형 LLM 에이전트들이 웹 검색을 어떻게 사용하는지 처음으로 연구했습니다. ChatGPT, Claude, Grok, DeepSeek 네 가지 플랫폼에서 실제 사용자와 실험을 통해 웹 검색의 품질과 전략을 분석했어요. 각 플랫폼마다 웹 검색 결정이 다르고, 더 자주 웹 검색을 하더라도 답변 품질은 항상 좋아지지는 않아요. 이 연구는 대화형 에이전트들이 어떻게 웹 정보를 활용하는지를 알려줍니다. arXiv cs.AI개발·코딩A Unified Evaluation Framework for Trustworthy Large Language Models, Agentic AI, and Multimodal Systems — 이 연구는 대형 언어 모델, 에이전트 AI 및 다중모드 시스템의 신뢰성 평가를 위한 통합 프레임워크를 제안합니다. 이 프레임워크는 능력, 안정성, 공정성 등 8개의 신뢰성 차원을 통해 시스템 성능과 증거의 신뢰성을 함께 평가합니다. 그러나 구체적인 데이터나 수치가 없어 정보 부족이 있습니다. arXiv cs.AI개발·코딩RTX 5090 Bonsai 2 27B vs Gemma 4 12B vs Qwen 3.5 9B Japanese voxel pagoda — RTX 5090에서 실행한 테스트 결과, Bonsai 2 27B 모델이 Qwen 3.5 9B과 Gemma 4 12B 모델보다 상당히 우수한 성능을 보였습니다. Bonsai는 추론 과정에서 많은 자원을 사용했음에도 불구하고, 세밀한 세부 사항까지 잘 표현했습니다. 반면, Gemma의 출력은 약간 흐려졌고 Qwen은 작동하지 않았습니다. 이 결과는 지역 AI 커뮤니티에 큰 의미가 있으며, 3060 그래픽 카드에서도 충분한 성능을 발휘할 수 있다는 점이 중요합니다. Reddit r/LocalLLaMA월드모델·로보틱스"낯선 가정서 집안일 척척"...피규어 AI, 로봇 모델 '헬릭스 2.5' 공개 — 피규어 AI가 만든 로봇 헬릭스 2.5는 처음 들어본 집에서도 청소나 요리를 잘해낼 수 있어요. 이 로봇은 사람의 행동을 많이 배워두고, 새로운 곳에 가도 바로 일할 수 있게 됐어요. 이렇게 되면 다양한 환경에서 똑똑하게 일하는 로봇이 더 많아질 것 같아요. AI Times Korea정책·안전·사회Gavin Newsom is pushing for an AI kill switch — 캘리포니아 주지사가 AI 모델에 안전장치를 설치하라는 명령을 내렸습니다. 이는 AI 기술이 발전하면서 발생할 수 있는 위험을 줄이기 위한 조치입니다. 주정부는 전문가 그룹을 구성하여 AI 안전 규제 방안을 제시하게 됩니다. The Verge AI정책·안전·사회Forget doomsday: The AI hacking crisis is here — 최근 AI 기술의 발전으로 인해 해커들이 새로운 공격 방법을 찾고 있습니다. 이는 일반 사용자들에게도 큰 위협이 될 수 있어 주의가 필요합니다(원문에 구체적 데이터 미제시). 이 문제는 AI 보안 연구 분야에서 중요한 이슈로 부상하고 있으며, 이를 무시하면 안 됩니다. Hacker News AI마케팅·업무 활용"워드 안에서 챗GPT 쓴다"...오픈AI, MS 워드 통합 기능 확대 — 오픈AI는 MS 워드에 챗GPT 기능을 통합해 사용자가 직접 워드 안에서 AI 도움을 받을 수 있게 했다. 이 변화로 문서 작성은 더 빠르고 효율적일 것으로 보인다. 예전에는 AI 서비스를 따로 이용해야 했지만 이제는 워드에서 바로 챗GPT와 대화할 수 있어 편리해졌다. AI Times Korea정책·안전·사회오픈AI, 경쟁사 AI에 뚫렸다…직원 계정 타고 내부 코드 저장소까지 — 연구원들이 오픈AI의 비밀 소프트웨어를 알아내는 경로를 찾았습니다. 연구진은 직원 계정을 이용해 내부 코드 저장소까지 접근했고, 여기서 AI 모델 작동 속도를 높이는 알고리즘을 확인했습니다. 이 사건은 AI 기업의 보안 취약점을 드러내며, 해킹 가능성과 관련된 우려가 커지고 있습니다. 뉴시스 국제마케팅·업무 활용Google’s new ‘CC’ is an AI agent that helps families run their households — Google은 가정 내에서 AI가 일상을 돕는 데 중점을 두고 있습니다. CC는 가족들이 이메일, 일정, 할 일을 공유할 수 있게 해 주면서 AI가 일정 관리와 쇼핑 목록 작성 등을 도와줍니다. 이 변화는 AI가 우리의 일상 생활에 더욱 깊숙이 끼치게 될 것을 예고합니다. (원문에 구체적 데이터 미제시) TechCrunch AI
🛠 오늘 바로 해보기
We benchmarked 24 LLMs against human writers on 475 creative writing prompts — 24개의 AI 작가 모델이 인간 작가와 475개의 글을 비교해 봤어요. 결과는 예상과 달랐습니다. 강력한 AI 모델들이 아마추어 작가들을 앞서고 있지만, 전문 작가들은 여전히 앞서 있답니다. 이 결과를 확인할 수 있는 링크가 있어요.
📚 오늘의 용어
✍️ 독자의 기록
오늘 해본 것을 한 줄로 남겨 주세요 → https://sociai.org/do
항목 14/15 · 독자 수준 L3
아직 댓글이 없습니다. 첫 댓글을 작성해보세요!