최근
787 →
Alibaba AI 모델, Hugging Face에서 30억 다운로드 달성하며 Meta와 Google을 제치다
llama.cpp b10437이 MiniMax-Text-01 및 MiniMax-M1 모델 지원 추가
OpenAI Python SDK v0.21.0는 공급자 중립 테스트 API와 OpenAI v3 호환성을 추가합니다
+784개 더
AI agents
246 →
OpenAI Python SDK v0.21.0는 공급자 중립 테스트 API와 OpenAI v3 호환성을 추가합니다
Claude Code v2.1.233이 GitLab MR 지원, 메모리 제한을 추가하고 새 모델에서 todo 도구를 비활성화함
OpenAI, GPT-5.6 Sol의 Ultrafast 모드 미리보기; Google, Gemini 3.7 Flash 출시
+243개 더
Inference efficiency
180 →
llama.cpp b10437이 MiniMax-Text-01 및 MiniMax-M1 모델 지원 추가
llama.cpp b10435이 jinja gather_string_parts의 이차 비용을 수정함
llama.cpp b10434이 템플릿에 reasoning_effort 전달
+177개 더
Open weights
166 →
Alibaba AI 모델, Hugging Face에서 30억 다운로드 달성하며 Meta와 Google을 제치다
Z.ai, 확장된 사후 학습이 적용된 GLM-5.3 출시
오픈 모델의 현황: 2026년 여름 관측
+163개 더
API & product launches
114 →
OpenAI Python SDK v0.21.0는 공급자 중립 테스트 API와 OpenAI v3 호환성을 추가합니다
xAI, GitHub Copilot에 Grok 4.6 코딩 모델 출시
OpenAI, GPT-5.6 Sol의 Ultrafast 모드 미리보기; Google, Gemini 3.7 Flash 출시
+111개 더
Code generation
94 →
Claude Code v2.1.233이 GitLab MR 지원, 메모리 제한을 추가하고 새 모델에서 todo 도구를 비활성화함
xAI, GitHub Copilot에 Grok 4.6 코딩 모델 출시
메타, Muse Code 에이전트형 하니스와 저비용 Muse Spark 1.2 모델 출시
+91개 더
Safety & alignment
76 →
Claude, EU AI법 준수 위해 SynthID-Text 워터마킹 구현
Muse-Ltd, LLM 인식론적 보정을 위한 UncertaintyGym 벤치마크 제출
OpenAI 에이전트가 우연히 Artifactory를 통해 Hugging Face를 공격하다
+73개 더
Research paper
74 →
HorizonRelight는 일관된 장시간 비디오 리라이트를 위해 마스크된 자기 조건화를 사용합니다
Faraday 27B, 논문 복제 작업에서 Claude Opus 4.8 및 GPT-5.5 능가
Faraday 27B, 논문 복제 작업에서 Claude Opus 4.8 및 GPT-5.5 능가
+71개 더
Benchmark results
58 →
Alibaba AI 모델, Hugging Face에서 30억 다운로드 달성하며 Meta와 Google을 제치다
Z.ai, 확장된 사후 학습이 적용된 GLM-5.3 출시
Qwen, ModelScope 및 Hugging Face에 Qwen3.8-27B 모델 출시
+55개 더
Local inference
51 →
llama.cpp b10434이 템플릿에 reasoning_effort 전달
오픈 모델의 현황: 2026년 여름 관측
llama.cpp b10418이 SYCL 호스트 고정 메모리 지원을 추가합니다
+48개 더
Training methods
41 →
ThetaMem은 고정 상태 시퀀스 메모리를 위해 부호 있는 승법 키 리프트를 제안합니다
Dyna Robotics가 100만 시간의 인간 영상을 기반으로 사전 학습된 월드 액션 모델 Dyna-2 출시
LLM이 하이퍼파라미터 최적화에서 베이지안 최적화와 동등하거나 이를 능가함
+38개 더
Multimodal
40 →
Intern-S2-Preview: 과학적 에이전트 파운데이션 모델
dots-studio, 280B MoE 모델인 dots3-note preview 출시
Liquid AI가 도구 호출 기능을 갖춘 3B 온디바이스 비전-언어 모델 LFM2.5-VL-3B 출시
+37개 더
Policy & regulation
37 →
Claude, EU AI법 준수 위해 SynthID-Text 워터마킹 구현
백악관 AI 정책 확대, 오픈 모델 추가 가능성
Anthropic, OpenAI, Google, Meta, Microsoft, Mistral이 EU AI 투명성 코드에 서명
+34개 더
Evaluation & benchmarks
33 →
생산 환경용 에이전트 시스템 구축에서 얻은 교훈
Muse-Ltd, LLM 인식론적 보정을 위한 UncertaintyGym 벤치마크 제출
ICML 2026 오픈 리프로덕션 챌린지, 검토된 논문 중 23%가 허위 주장을 포함하고 있음을 발견
+30개 더
Hardware & chips
20 →
알리바바, NVIDIA GB300 NVL72용 Qwen3.8-2.4T-A95B 오픈 가중치 출시
RunSnack은 단일 링크를 통해 P2P GPU 공유를 가능하게 합니다
llama.cpp b10306이 SYCL GLU 평탄 경로 추가 및 커널 통합
+17개 더
Robotics
19 →
Strands Agents가 LeRobot 및 Hugging Face Storage Buckets를 통합하여 로봇 데이터의 지속적 루프 구현
Dyna Robotics가 100만 시간의 인간 영상을 기반으로 사전 학습된 월드 액션 모델 Dyna-2 출시
Calibra, 로봇 학습 데이터셋의 문제 감지
+16개 더
Retrieval & RAG
16 →
VITA 임상 RAG는 HealthBench에서 최첨단 LLM과 동등하거나 이를 능가
Corpus 특화 VITA RAG가 HealthBench에서 최첨단 LLM을 추격하거나 능가
VITA 임상 RAG 시스템이 HealthBench에서 최전방 LLM과 동등하거나 우수함
+13개 더
Video generation
15 →
HorizonRelight는 일관된 장시간 비디오 리라이트를 위해 마스크된 자기 조건화를 사용합니다
LTX가 로컬 비디오 생성을 위한 오픈 가중치 월드 모델 LTX-2.5를 출시
MiniMax, 동기화된 오디오를 갖춘 오픈 가중치 H3 비디오 모델 출시
+12개 더
Voice & audio
13 →
llama.cpp b10369, pocket-tts 지원 추가 및 CUDA 생성 80% 가속
NVIDIA Magpie TTS 아랍어, 한국어 추가 및 품질 개선
NVIDIA, ~450ms 턴테이킹을 지원하는 오픈 풀듀플렉스 음성-음성 모델 NemotronLabs VoiceChat 11B 출시
+10개 더
Reasoning models
13 →
연구자들이 리플레이 공격을 통해 독점 LLM API에서 추론 트레이스를 탈취
연구자들이 Claude, GPT, Gemini API의 암호화된 추론 트레이스를 해독하다
연구자들이 세션 간 암호화 재사용을 악용하여 LLM API에서 추론 추적을 탈취
+10개 더