연구소 · DeepSeek
lab DeepSeek API Docs · 21일 전 Codeforces (Elo) · 3471.0Elo · 조회수 67회

DeepSeek, 네이티브 멀티모달 지원을 갖춘 V4.1-Flash 모델 출시

DeepSeek는 새로운 아키텍처 패밀리의 가장 작은 구성원이며 네이티브 멀티모달 시각 이해 기능을 갖춘 DeepSeek-V4.1-Flash 모델을 공식적으로 출시했습니다. 이 새로운 아키텍처는 더 높은 능력 한계, 더 빠른 추론 속도, 더 높은 처리량 및 더 큰 모델에 대한 더 나은 확장 가능성을 제공하도록 설계되었습니다.

media MarkTechPost · 20일 전 · 조회수 55회

DeepSeek, 1M 컨텍스트와 FP4 KV 캐시를 갖춘 DeepSeek-V4.1-Flash 출시

DeepSeek AI는 100만 토큰의 컨텍스트 윈도우와 글로벌 캐시 크기를 토큰당 890바이트로 줄이는 FP4 KV 캐시를 탑재한 멀티모달 Mixture-of-Experts 모델인 DeepSeek-V4.1-Flash를 출시했습니다. 이 모델은 성능을 유지하면서 메모리 요구사항을 크게 낮추기 위해 인코더-디코더 구조와 Compressed Sparse Attention 2(CSA2)를 활용합니다.

arxiv arXiv cs.AI · 10일 전 · 조회수 24회

CodeMidas는 소스 코드를 사용하여 에이전트 코딩 RL 환경을 확장합니다

연구자들은 오픈소스 코드베이스에 구현된 기능을 사용하여 소스 코드를 유일한 입력으로 강화학습 환경을 구축하는 에이전트 파이프라인인 CodeMidas를 소개했습니다. 이 방법은 기능 탐색, 실행 기반 테스트 구축, 반복 롤아웃을 통한 작업 검증을 위해 에이전트 컴퓨팅을 할당하며, 그 결과 23개 프로그래밍 언어에 걸쳐 5,545개의 학습 작업 데이터셋이 생성됩니다. GRPO를 사용하여 이러한 작업에서 MiMo-V2.5를 훈련하면 DeepSWE (+11.7%), ProgramBench (+17%), Terminal-Bench v2.1 (+8.5%) 등 다양한 벤치마크에서 성능이 향상됩니다. 궤적 분석에 따르면 RL로 훈련된 에이전트는 코드베이스 탐색 증가 및 더 다양한 자기 검증과 같은 더 나은 행동을 보이는 것으로 나타났습니다. 이러한 결과는 소스 코드가 다양한 소프트웨어 작업에서 코딩 에이전트를 개선하는 RL 환경을 구축하기 위한 확장 가능한 기반임을 입증합니다.

arxiv arXiv cs.AI · 15일 전 · 조회수 27회

Atria Dawn 미리보기: 과학 연구를 위한 기반 에이전트 언어 모델

Atria Dawn Preview는 도구 매개 상호작용을 실행 가능 환경에 연결하는 검증 가능한 경험 파이프라인을 통해 학습된 과학 연구 및 엔지니어링 워크플로우를 위해 설계된 기반 에이전트 언어 모델입니다. 실제 연구, 엔지니어링 및 디지털 작업을 아우르는 16개 벤치마크에서 이 모델은 최첨단 에이전트들과 경쟁력 있으며, 그중 5개에서 최고 보고 점수를 달성했습니다.

media r/LocalLLaMA · 21일 전 · 조회수 56회

DeepSeek가 더 낮은 비용과 더 빠른 속도를 갖춘 552B MoE 모델인 V4.1 Flash 출시

DeepSeek는 네이티브 멀티모달 시각적 이해 기능을 갖춘 새로운 아키텍처 시리즈의 가장 작은 구성 요소인 DeepSeek V4.1 Flash 모델을 공식적으로 출시했습니다. Causal-Encoder-Decoder 설계에 기반한 이 모델은 552B 파라미터를 가진 Mixture of Experts (MoE) 모델로, 입력 측에서는 8B 파라미터만 활성화되고 출력 측에서는 16B가 활성화됩니다.