최근
781 →
IFM 연구원들이 K2 Horizon 오픈 모델 플릿에 대한 AMA를 개최
구글, Gemini 4 Argon 발표; NVIDIA, 자율 에이전트를 위한 OpenShell 출시
Meta Muse 에이전트, 범위 격차로 인해 마켓플레이스 목록을 잘못 처리
+778개 더
Inference efficiency
267 →
RAG에서 텍스트 대신 LLM 네이티브 잠재 메모리 검색 제안
llama.cpp b11309, 안전한 scatter 모드로 Hexagon ALLREDUCE 최적화
llama.cpp b11310이 짧은 행에 대해 iq4_nl 역양자화 커널을 보호합니다
+264개 더
AI agents
231 →
구글, Gemini 4 Argon 발표; NVIDIA, 자율 에이전트를 위한 OpenShell 출시
Meta Muse 에이전트, 범위 격차로 인해 마켓플레이스 목록을 잘못 처리
QuadWit Arena가 AI 에이전트를 위한 비전 없는 JSON 전용 전략 사다리를 출시
+228개 더
API & product launches
126 →
알버트슨스, 세이프웨이 결제에 ChatGPT 통합을 위해 OpenAI와 파트너십 확대
구글, Gemini 4 Argon 출시; 오픈에이아이, GPT-6.1 Sol 발표
OpenAI, GPT-6.1 Sol 출시: 아스트라급 코딩 및 컴퓨터 사용 성능을 5분의 1 비용으로 제공
+123개 더
Safety & alignment
99 →
구글, Gemini 4 Argon 발표; NVIDIA, 자율 에이전트를 위한 OpenShell 출시
Meta Muse 에이전트, 범위 격차로 인해 마켓플레이스 목록을 잘못 처리
AI 환각 방지를 위한 재현성 기반 인식론적 계층 Trail 제안
+96개 더
Local inference
93 →
llama.cpp b11320에 LLM-jp-4.1 하모니 방언 핸들러 추가
llama.cpp b11307, 추론 디코딩을 위해 배치 순서 유지
llama.cpp b11301이 ggml/gguf의 정수 오버플로우 수정
+90개 더
Open weights
81 →
IFM 연구원들이 K2 Horizon 오픈 모델 플릿에 대한 AMA를 개최
Cloudflare, 오픈 가중치 의사결정 모델 Clef 출시
NVIDIA, 분류 및 회귀를 위한 오픈 테이블 기반 모델인 Kumo Tabular 출시
+78개 더
Code generation
76 →
Claude Code v2.1.287에 Claude Mods, You should know 플러그인 및 수많은 버그 수정 추가
바클레이스, 클로드 확장으로 운영 업그레이드 및 고객 경험 개선
OpenAI, GPT-6.1 Sol 출시: 아스트라급 코딩 및 컴퓨터 사용 성능을 5분의 1 비용으로 제공
+73개 더
Research paper
61 →
Mid-Harness는 테스트 타임 컴퓨팅 스케일링을 통해 터미널 에이전트의 액션 신뢰성을 향상시킵니다
Pangram Labs, 야생 AI 텍스트가 사전학습에 해를 끼친다는 사실을 발견하고 새로운 스케일링 법칙 제안
AI 환각 방지를 위한 재현성 기반 인식론적 계층 Trail 제안
+58개 더
Evaluation & benchmarks
44 →
QuadWit Arena가 AI 에이전트를 위한 비전 없는 JSON 전용 전략 사다리를 출시
Anthropic, Claude Code용 자동 평가 도구 출시
Linda-Pro가 스타일로메트리와 DeBERTa를 사용한 로컬 영어 AI 텍스트 검출기 출시
+41개 더
Benchmark results
42 →
NVIDIA, 분류 및 회귀를 위한 오픈 테이블 기반 모델인 Kumo Tabular 출시
구글 딥마인드, 100만 토큰 출력 제한을 갖춘 제미니 4 아르곤 출시
NVIDIA 연구진, Cosmos 3 비디오 모델의 물리 추론 개선을 위해 Physis-Lang 공개
+39개 더
Hardware & chips
34 →
AI2, 확장 가능한 대규모 MoE 학습을 위한 Olmo-core 3 출시
ThermaCompute AI, 로컬 GPU 충돌 로그 분류를 위한 CrashLens 출시
llama.cpp b11280 릴리스는 고정 호스트 버퍼를 사용하여 텐서 allreduce 동기화를 줄입니다
+31개 더
Training methods
34 →
AI2, 확장 가능한 대규모 MoE 학습을 위한 Olmo-core 3 출시
마이크로소프트 리서치 시스템이 미국 66,935개 변전소의 우주 기상 위험을 예측
컨텍스트 언어 모델은 컨텍스트를 편집 가능한 파일로 네이티브하게 관리합니다
+31개 더
Multimodal
30 →
EviRover는 한 번의 시야를 넘어 에이전트형 시각적 지각을 강화합니다
Index-Translate, 텍스트·음성·장문서용 다국어 모델 패밀리 출시
마이크로소프트 리서치, 다중 모달 생물학 연구를 위한 AI 시스템 'Quine' 선보임
+27개 더
Retrieval & RAG
30 →
RAG에서 텍스트 대신 LLM 네이티브 잠재 메모리 검색 제안
Cohere, Embed 5 Pro 및 Fast 임베딩 모델 출시
Perplexity가 Photon을 출시하여 검색 p99 지연 시간을 800ms에서 65ms로 단축
+27개 더
Voice & audio
28 →
오픈 TTS 리더보드가 확장 가능한 다국어 TTS 평가를 출시하다
알리바바 Qwen이 전이중 음성 모델인 Qwen-Audio-3.1-Realtime를 출시
llama.cpp b11190이 LFM2 오디오의 mel 전처리기를 수정함
+25개 더
Policy & regulation
22 →
영원한 보완
트럼프, 기술 리더들과 AI에 관한 백악관 협정 서명
정렬 실패로 인해 OpenAI가 Astra 6.1 출시를 취소
+19개 더
Image generation
13 →
AutoRef가 다중 참조 이미지 생성을 위한 에이전트 하니스를 최적화합니다
Hung Tran, 과적합된 신경망 이미지 코덱의 클리핑 함정 식별
메타, Muse 커넥터 개방, SAM 3.1 출시, Gemini가 시스템 해킹
+10개 더
Video generation
13 →
NVIDIA 연구진, Cosmos 3 비디오 모델의 물리 추론 개선을 위해 Physis-Lang 공개
Google Research, 일관된 수 분 길이의 비디오 생성을 위한 4개 에이전트 프레임워크 소개
Runway, 실시간 상호작용형 세계 생성을 위한 WorldPrompt 출시
+10개 더
Reasoning models
11 →
TokenProbe는 정확성을 유지하면서 CoT 토큰 사용량을 76% 줄입니다
TelecomGPT-R1: 이종 Telecom 작업 전반의 추론을 위한 통합 사후 학습
CosmicUndercurrent이 LLM 전체 시스템 조정을 테스트하기 위한 Principia-Structurae-Realitatis를 공개
+8개 더