Qwen3.8-Flash-Next (125B) at 12-15 tok/s on a 2021 32GB M1 Max
5년 된 맥북에서도 1천억 매개변수 모델이 실용 속도로 돌아간다
로컬에서 대형 모델을 돌리는 개발자라면 서버 없이 맥 한 대로 실험 선택지가 생겼다
AI 모델 Qwen3.8-Flash-Next가 출시되었습니다. 이 모델은 2021년 M1 Max 프로세서에서 12-15 토큰/초의 속도로 작동합니다. 기본적으로 강력한 전문가들이 선택되며, 캐시 우선 순위 기능이 적용되어 성능을 높입니다. 이 모델은 코드와 데이터 분석 등 다양한 범주에서 우수한 점수를 받았습니다.
로컬에서 대형 모델을 돌리는 개발자라면 서버 없이 맥 한 대로 실험 선택지가 생겼다
원문 읽기이어서 볼 것
이 글을 읽은 뒤 바로 이어볼 수 있는 추천
더 읽기로 감을 넓히고, 사례를 본 뒤, 필요하면 참여나 도구로 넘어가면 됩니다.
다음 행동
아직 댓글이 없습니다. 첫 댓글을 작성해보세요!