마이크로소프트가 작은 GPU에서도 도는 코딩 에이전트 모델을 내놨다
📌 빅뉴스
1. Two ~300B MoE models, each on ONE 128 GB mini PC (AMD Strix Halo): GLM-5.3-Flash at ~580 tok/s prefill, MiMo-V2.6-Flash up to 44 tok/s decode. EXL3 weights + open ROCm engine
개발·코딩 · 심화
이 기사는 두 개의 대형 모델, GLM-5.3-Flash와 MiMo-V2.6-Flash를 각각 하나의 128GB 미니 PC에 설치하는 방법을 소개합니다. 이 모델들은 토큰당 처리 속도가 빠르며, GLM-5.3-Flash는 약 580토큰/초, MiMo-V2.6-Flash는 최대 44토큰/초를decode합니다. 이 정보는 AI 모델의 성능과 사용 가능성에 관심이 있는 사람들에게 중요하며, 소상공인이나 창작자들이 직접 활용할 수 있는 기회가 생겼습니다.
2. '나만의 클로드 코드' 만든다...앤트로픽, 커스텀 확장 기능 '모드' 출시
개발·코딩 · 활용
앤트로픽이 AI 도구 '클로드 코드'에 맞춤형 기능을 추가하는 '모드(Mods)'를 출시했다. 개발자들이 자신만의 환경을 만들 수 있게 해, 일상 업무가 더 편리해질 것으로 보인다. 이 기능은 클로드 코드 사용자의 개인화된 경험을 높이는 데 도움이 될 것이다.
3. Unitree just dropped UnifoLM-WLA-1.0 — a single 6B model that does 64 whole-body + tabletop tasks on a real humanoid
월드모델·로보틱스 · 심화
유닛리트는 인형 로봇이 여러 가지 일들을 할 수 있는 UnifoLM-WLA-1.0이라는 모델을 내놨습니다. 이 모델은 실제로 움직이는 로봇 데이터로 학습했고, 베드를 정돈하거나 세탁기를 채우는 등의 64가지 일을 할 수 있어요. 이 모델은 손과 팔이 잘 움직일 수 있게 돼 있고, 공간을 이해하는 능력도 뛰어나다고 해요.
오늘의 소식
개발·코딩Replacing vector databases with SQLite and SIMD hypervectors in under 1.2GB VRAM (Hillock) — AI 모델을 실행할 때 VRAM이 부족한 문제를 해결하기 위해, Hillock이라는 오픈소스 프로젝트가 출시되었습니다. 이 프로젝트는 벡터 데이터베이스 대신 SQLite와 SIMD 히퍼벡터를 사용하여 8B 모델을 실행할 때 필요한 VRAM을 줄입니다. 이를 통해 문서 분석과 질문에 대한 정확한 답변을 얻을 수 있습니다. Reddit r/LocalLLaMA빌더·에이전트Come let your LLMs play World of Warcraft — 저자가 월드 오브 워크래프트의 개인 서버를 만들고, 브라우저에서 직접 플레이할 수 있는 클라이언트를 제작했습니다. 이를 통해 AI 모델을 사용해 게임을 자동으로 플레이하는 기능도 개발 중입니다. 현재는 몇 가지 AI 모델만 지원하고 있습니다. Reddit r/LocalLLaMA개발·코딩딥시크, 슈퍼 앱 형태 데스크톱 앱 '딥시크 하네스' 출시..."챗·코딩·문서 통합" — 딥시크가 AI 기반의 문서 작업과 개발을 하나로 통합한 데스크톱 앱 '딥시크 하네스'를 출시했습니다. 이 앱은 채팅, 코드 작성, 문서 작업 등을 한 공간에서 처리할 수 있어 사용자에게 편리함을 제공합니다. 딥시크는 이번 출시로 AI 작업 공간 경쟁에 참여하게 됐습니다. AI Times Korea사진·영상·생성미디어mlsubgen — subtitles in 45 languages for your videos, entirely on your own machine — mlsubgen은 45개 언어의 자막을 개인 컴퓨터에서 만들 수 있게 해주는 도구입니다. 저자가 태국에 살면서 처음에는 친구들의 요청으로 시작했지만, 지금은 다양한 언어를 지원하는 일반적인 도구로 발전했습니다. 이 도구는 여러 언어의 대화를 동시에 인식하고, 기존 인간 작업을 우선적으로 사용하며, Blu-ray 재mux 파일에서도 자막을 추출합니다. 하지만 Linux와 NVIDIA GPU만 지원하며, 성능은 메모리 크기에 따라 달라집니다. Reddit r/LocalLLaMA개발·코딩[10월2일] "뜻밖의 주인공은 로그인과 플러그인"…알트먼이 보여준 챗GPT의 다음 무대 — 오픈AI가 챗GPT의 기능을 업데이트하여 로그인과 플러그인을 추가했습니다. 이는 사용자가 다른 서비스에 쉽게 접속할 수 있게 해줍니다. 샘 알트먼 CEO는 이러한 변화가 큰 잠재력을 가지고 있다고 말했습니다. 이 변경은 챗GPT를 새로운 도구로 만들어, 다양한 서비스와 더 잘 연결될 수 있게 하는 중요한 단계입니다. AI Times Korea
🛠 오늘 바로 해보기
microsoft/FrogNano-4B-2609 · Hugging Face — 마이크로소프트는 GPU가 부족한 사용자들을 위해 FrogNano-4B라는 모델을 내놨습니다. 이 모델은 Qwen/Qwen3.5-4B에서 유래했지만, 주로 소스 코드 작업에 특화된 후처리를 거쳤습니다. FrogNano는 1,500개의 합성 SWE 환경에서 강화학습을 통해 훈련받았고, 이로 인해 장기적인 소스 코드 관리와 수정 능력이 향상되었습니다. 하지만 Python과 영어에 치우쳐 있어 일부 문제를 일으킬 수 있습니다.
📚 오늘의 용어
✍️ 독자의 기록
오늘 해본 것을 한 줄로 남겨 주세요 → https://sociai.org/do
항목 10/15 · 독자 수준 L3
아직 댓글이 없습니다. 첫 댓글을 작성해보세요!