새로운 DeepSeek V4-Flash 모델은 ArtificialAnalysis 지수에서 50점을 기록했습니다. 이 결과는 GLM-5.2 및 GPT-5.6 Luna보다 단 한 점 낮은 위치를 차지합니다.
media
r/LocalLLaMA
·
46일 전
·
open_models
DeepSeek V4-Flash, ArtificialAnalysis 지수에서 50 달성
번역 English → 한국어
벤치마크
| 벤치마크 | 모델 | 점수 |
|---|---|---|
| Artificial Analysis Intelligence Index | DeepSeek V4-Flash | 50% |
관련 기사
media
MarkTechPost
·
58일 전
·
조회수 43회
Kimi K3, DeepSeek V4 Pro, GLM-5.2 벤치마크, 라이선스, 서빙 비용 비교
세 가지 오픈 가중치 희소 Mixture-of-Experts 모델인 Moonshot AI의 Kimi K3, DeepSeek V4 Pro, Zhipu AI의 GLM-5.2를 비교하여 장기적 코딩 및 에이전트 워크로드에 대한 능력, 라이선스 조건, 서빙 비용을 평가합니다.
media
r/LocalLLaMA
·
19시간 전
·
조회수 3회
Base-10의 찰리 오닐은 Kimi와 GLM이 Opus 5보다 낫다고 주장
Base-10의 찰리 오닐은 Dwarkesh Patel과의 최근 에피소드에서 Kimi와 GLM 모델이 "거의 객관적으로" Opus 5보다 우수하다고 논의했습니다.
media
r/LocalLLaMA
·
2일 전
·
조회수 3회
DeepSeek V4.1 Flash, Artificial Analysis Intelligence Index v4.3 정상 등극
DeepSeek V4.1 Flash가 Artificial Analysis Intelligence Index v4.3 업데이트의 새로운 Astra 벤치마크에서 1위를 차지했습니다.
media
r/LocalLLaMA
·
5일 전
·
조회수 4회
LiveBench에 DeepSeek v4.1 Flash 추가
LiveBench 벤치마킹 플랫폼이 평가 스위트에 DeepSeek v4.1 Flash 모델을 추가했습니다.
media
Together AI Blog
·
18일 전
·
조회수 27회
GLM-5.3 Flash의 증류는 일관성을 희생하고 비용을 17배 절감
DeepSWE 벤치마크에서 GLM-5.3과 그 증류된 변형인 GLM-5.3 Flash를 비교한 결과, 증류가 핵심 코딩 능력을 유지하면서 롤아웃 비용을 크게 줄였음이 드러났다. 전체 모델은 작업당 $3.99에 69.0%의 pass@1률을 달성하는 반면, Flash 변형은 단 $0.24에 63.4%를 기록하여 17배의 가격 절감을 나타낸다.