model : add Ling 3.0 VL support by aetherbird · Pull Request #29151 · ggml-org/llama.cpp
Ling-3.0-flash-VL 모델은 이미지와 비디오를 이해할 수 있는 능력을 추가하여 Ling-3.0-flash 모델의 언어, 논리적 사고 및 긴 맥락 처리 기능을 확장했습니다. 이 모델은 최대 25만 개 토큰까지의 컨텍스트를 지원하며, 124억 매개변수로 작동합니다. 이는 단어당 평균 5.5억 매개변수가 활성화되므로 효율성이 높습니다.
Ling-3.0-flash-VL 모델은 이미지와 비디오를 이해할 수 있는 능력을 추가하여 Ling-3.0-flash 모델의 언어, 논리적 사고 및 긴 맥락 처리 기능을 확장했습니다. 이 모델은 최대 25만 개 토큰까지의 컨텍스트를 지원하며, 124억 매개변수로 작동합니다. 이는 단어당 평균 5.5억 매개변수가 활성화되므로 효율성이 높습니다.
로컬에서 멀티모달 모델을 돌린다면 오늘 선택지가 하나 늘었다
원문 읽기이어서 볼 것
이 글을 읽은 뒤 바로 이어볼 수 있는 추천
더 읽기로 감을 넓히고, 사례를 본 뒤, 필요하면 참여나 도구로 넘어가면 됩니다.
다음 행동
아직 댓글이 없습니다. 첫 댓글을 작성해보세요!