Qwen이 자체 Qwen 3.8 27B 모델의 오픈 가중치를 출시했습니다. 체크포인트는 Hugging Face에서 사용할 수 있습니다.
media
r/LocalLLaMA
·
3시간 전
·
open_models
Qwen, Qwen 3.8 27B용 오픈 가중치 출시
번역 English → 한국어
관련 기사
media
MarkTechPost
·
28일 전
·
조회수 6회
PrismML이 Bonsai 27B를 출시하여 Qwen3.6-27B를 1비트 및 삼진 가중치로 압축
PrismML은 재학습 없이 노트북과 스마트폰에서 대규모 다중모달 모델을 실행할 수 있는 Qwen3.6-27B 모델의 저비트 양자화인 Bonsai 27B를 출시했습니다.
media
r/LocalLLaMA
·
30일 전
UD-Q2_K_XL로 양자화된 Qwen3.5 122B A10B는 64GB RAM에 맞으며 내부 지식을 개선합니다
한 사용자가 UD-Q2_K_XL로 양자화된 Qwen3.5 122B A10B가 시스템 RAM 64GB에 들어갈 수 있음을 보여줌으로써, 해당 제약 조건에 대한 이전 최상위 옵션을 대체했습니다.
media
r/LocalLLaMA
·
31일 전
듀얼 RTX 3090에서 Ternary Qwen3.6 27B가 60 tok/s로 실행됨
한 사용자가 두 대의 NVIDIA RTX 3090 GPU에서 ternary-quantized Qwen3.6 27B 모델을 성공적으로 실행했다고 보고했습니다. 이 설정은 안정적인 도구 호출 기능과 함께 초당 60개의 토큰 처리량을 달성합니다.
media
r/LocalLLaMA
·
32일 전
·
조회수 3회
PrismML이 Qwen3.6-27B를 iPhone용 <4GB로 압축
PrismML은 알리바바의 오픈소스 Qwen3.6 모델의 압축 버전을 개발하여, 270억 파라미터 대규모 언어 모델을 iPhone 17 Pro에서 실행할 수 있게 했습니다. 이 스타트업은 캘리포니아 공과대학(Caltech) 연구에서 유래한 수학적 기법을 사용하여 모델 크기를 약 54기가바이트에서 4기가바이트 미만으로 줄였습니다.
media
r/LocalLLaMA
·
40일 전
NVIDIA, Qwen3.6-27B-NVFP4 모델 출시
NVIDIA가 Hugging Face에 Qwen3.6-27B-NVFP4 모델을 출시했습니다.