최신 뉴스

전체 뉴스

가장 최근에 발행된 뉴스부터 확인하세요.

주제별로 좁혀보기 · 개발·코딩
일반 기사
AI 활용

아마존, AI 에이전트 전용 오픈소스 의사결정 모델 ‘스트랜즈 디사이더 2B’ 공개

전체 요약

아마존은 1일(현지시간)에 AI 에이전트의 판단을 빠르고 저렴하게 처리할 수 있는 오픈소스 의사결정 모델 ‘스트랜즈 디사이더 2B’를 공개했다. 이 모델은 20억 매개변수로 구성되어 있으며, 정해진 선택지 중 하나를 고르고 해당 판단에 대한 확률을 제공한다. 이는 복잡한 작업에서 AI 에이전트가 빠르게 결정을 내릴 수 있게 도와준다. 하지만 구체적인 성능 데이터나 비교 대상 모델은 언급되지 않았다.

핵심 보기
원문 보기
AI 활용

클로드 코드 eval 스킬로 팀원 작업 기록 평가하기

전체 요약

클로드 코드(Claude Code)에 평가(eval) 스킬을 적용하여 팀원 작업 기록을 자동으로 피드백하는 시스템을 만들었습니다. 처음에는 수작업으로 진행했으나, 공식 eval 스킬이 나와 이를 활용해 체계적인 평가를 할 수 있게 되었습니다. 하지만 초기 순서대로 진행하지 않아 문제점이 발생했습니다. 이제는 정확한 절차를 따르며 작업 기록을 평가하고 피드백을 자동화하려 합니다.

핵심 보기
원문 보기
AI 심화

ImaJev-4b: I spent 15 days fine-tuning a 4B model to make business decisions from text and photos, and it just ranked #1 of 91 on JevBench & ahead of GPT-5.6 Luna on DecisionBench

전체 요약

이 기사는 ImaJev-4b라는 새로운 AI 모델에 대해 설명합니다. 이 모델은 사진과 텍스트를 분석해 비즈니스 결정을 도와줍니다. 처음에는 성능이 좋지 않았지만, 개선 작업 후 JevBench에서 1위를 차지했습니다. ImaJev-4b는 LoRA 기술을 사용하며, Mac이나 GPU에서도 작동합니다. 이 모델은 비즈니스 프로세스 개선에 관심 있는 사람들에게 유용할 것입니다.

핵심 보기
원문 보기
AI 활용

Introducing KoboldCpp Agent (and a plea for help)

전체 요약

KoboldCpp는 사용자에게 내장된 Agentic Harness를 제공하여 복잡한 외부 도구 설정을 간소화했습니다. 이Harness는 코드 생성이나 게임 개발 등 기본 작업에 유용합니다.Harness는 28,000 컨텍스트와 8,000 생성량 이상의 VRAM이 필요하며, 최소 12GB가 추천됩니다. 또한 사용자가 직접 도구를 추가할 수 있는 기능도 있습니다.

핵심 보기
원문 보기
AI 심화

The Last Human Gate: Forward Deployed Engineering for Governance Automation

전체 요약

이 기사는 디지털 정부 프레임워크(DGF)에서 인공지능(AI)을 활용해 인간의 역할을 대체하는 방법에 대해 설명합니다. AI는 대부분의 검토 작업을 자동화할 수 있지만, 일부 예외 사항은 여전히 인간이 처리해야 합니다. 연구진은 300개의 가상 프로젝트와 899개의 모델-프로젝트 실행에서 AI가 76.92%까지 성공했습니다. 이 결과는 AI가 정부 관리 작업을 대체할 수 있다는 것을 보여줍니다.

핵심 보기
원문 보기
AI 활용

Streaming Nemotron 3 Diarization

전체 요약

나는 네모트론 3 디아리제이션을 테스트해 보았고, 이 모델은 누가 말하는지 알아내는 데 도움이 됩니다. 한 번에 여덟 명까지의 목소리를 추적할 수 있고, 실시간으로 결과를 내기도 합니다. 저는 이를 음성 변환 시스템에 연결해서 로봇이 새로운 사람을 인식하고 이름을 기억하도록 했습니다. 이 모델은 즉시 사용 가능한 상태로 출시될 예정입니다.

핵심 보기
원문 보기
AI 심화

Write up on building and improving reliability of agentic harnesses + a big dataset from my work.

전체 요약

개발자 Dyluhn은 오픈소스 Harness을 만들며, 4,000회 이상의 실험을 통해 에러를 줄였습니다.Harness은 AI 모델이 특정 작업을 반복적으로 수행할 수 있게 해줍니다. Dyluhn은Harness의 성능 향상을 위해 다양한 방법을 시도했으며, 실패 원인을 찾기 위해 상세한 기록을 남겼습니다.Harness의 개선으로 인해 AI 에이전트가 더 안정적으로 작동하게 됩니다.

핵심 보기
원문 보기