Running 95.5 GiB Qwen3.8-Flash-Next at 41–52 tok/s on a 64GB Mac (1.76x faster than llama.cpp): Slipstream release, 130k context scaling, + Swift variant
전체 요약
Qwen3.8-Flash-Next 모델을 빠르게 실행할 수 있는 Slipstream 엔진이 출시되었습니다. 이 엔진은 기존 모델을 사용하지 않고 1.76배 더 빠른 속도로 작동합니다. 또한 긴 컨텍스트에서도 성능이 안정적입니다.