Open weights
media MarkTechPost · 1일 전 · 조회수 1회

Mistral AI가 정책 적응형 다중 모달 안전 분류기인 Shieldstral 1.0 3B를 출시하다

Mistral AI는 콘텐츠 검열을 고정된 해악 범주에 의존하는 대신 단일 예/아니오 질문으로 처리하는 오픈 가중치 모델인 Shieldstral 1.0 3B를 출시했습니다. Pixtral 비전 인코더와 함께 Ministral-3-3B-Base-2512를 기반으로 구축된 이 모델은 재학습 없이 추론 시 일반 언어 프롬프트를 통해 운영자가 정책을 정의할 수 있게 합니다.

media MarkTechPost · 1일 전

NVIDIA가 AI 에이전트 구축을 위한 객체 지향 Python 프레임워크인 NOOA를 출시

NVIDIA Labs는 모델 비종속성(model-agnostic) Python 프레임워크인 NOOA(NVIDIA Object-Oriented Agents)를 오픈소스로 공개했으며, 이는 에이전트 개발을 단일 Python 클래스로 통합합니다. 이 접근 방식은 메서드를 액션에, 필드를 상태에, docstrings를 프롬프트에, 타입 어노테이션을 강제 계약에 매핑함으로써 프롬프트 템플릿과 워크플로우 그래프가 포함된 파편화된 워크플로우를 대체합니다.

lab Google DeepMind Blog · 3일 전 · 조회수 16회

Google DeepMind, 사이클론 예보를 위한 WeatherNext AI 모델을 오픈소스로 공개

Google DeepMind와 Google Research는 열대성 사이클론의 경로, 강도 및 바람 구조 예측에서 최첨단 정확도를 달성한 WeatherNext 2 및 WeatherNext Cyclones AI 모델을 오픈소스로 공개했습니다. Nature에 게재된 이 연구는 이러한 모델이 기존 시스템 대비 예보관에게 하루분의 예측 정확도를 추가로 제공함을 보여줍니다.

media Hugging Face Forums · 3일 전 · 조회수 1회

QuantCheck, 4비트 양자화에 최종 체크포인트가 최선이라고 가정하지 말라고 경고

QuantCheck라는 새로운 도구는 사전 훈련의 최종 체크포인트가 4비트 양자화에 최적의 선택이 아닐 수 있음을 강조합니다. 벤치마크가 평탄하게 유지되는 동안 취약성이 증가할 수 있기 때문입니다. 저자는 Pythia-160m에서 이 패턴을 관찰했으며, 최종 체크포인트는 동일한 품질의 이전 체크포인트보다 약 4배 더 많은 품질 손상을 입었습니다.

media MarkTechPost · 4일 전 · 조회수 1회

NVIDIA가 자율주행용 34B 오픈 VLA 모델인 Alpamayo 2 Super 출시

NVIDIA는 OpenMDW-1.1 라이선스 하에 로봇택시와 자율주행을 위해 설계된 340억 파라미터의 비전-언어-액션(VLA) 모델인 Alpamayo 2 Super를 출시했습니다. 이 모델은 32B Cosmos 3 Super Reasoner 백본과 2.3B 확산 기반 액션 디코더를 결합하여 다중 카메라 영상에서 궤적, 인과 설명 및 메타 액션을 생성함으로써 롱테일 이벤트에 대응합니다.

media AI News (smol.ai) · 4일 전 Terminal-Bench 2 · 67.4% · 조회수 8회

알리바바, 2.4T 파라미터를 갖춘 Qwen3.8-Max와 향후 오픈 가중치 발표

알리바바는 새로운 플래그십 모델인 Qwen3.8-Max를 발표했으며, 이는 장기적 에이전트 작업, 코딩, 다중 모달 추론에 중점을 둔 2.4T 파라미터의 희소 아키텍처라고 설명했습니다. 회사는 다음 주 Qwen3.8-27B 변형과 함께 Qwen3.8-Max의 오픈 가중치를 출시할 것이라고 확인했습니다.

lab Liquid AI · 5일 전 · 조회수 5회

LFM2.5-2.6B가 온디바이스 에이전트 모델을 출시하며 무료 로컬 추론 지원

저자들은 계획, 도구 호출, 다단계 작업을 위해 온디바이스에서 완전히 실행되도록 설계된 26억 파라미터의 에이전트 모델인 LFM2.5-2.6B를 출시했습니다. 이 모델은 스마트폰에서 작동할 만큼 작고 CPU에서도 반응 속도를 유지할 만큼 빨라 클라우드 API 의존성 없이 무료 추론, 낮은 지연 시간, 프라이버시를 제공합니다.

lab Mistral AI News · 5일 전 · 조회수 3회

Shieldstral이 정책 적응형 3B 다중 모달 안전 분류기 선보임

Shieldstral은 콘텐츠 검수를 정책 적응형 질문 답변 작업으로 구성하는 3B 오픈 가중치 다중 모달 안전 분류기로, 재학습 없이 추론 시 일반 언어 정책을 받아들일 수 있습니다. 이는 텍스트와 이미지 안전 평가를 통합하고 다양한 벤치마크에서 교정된 안전 점수를 제공하며 단일 16GB NVIDIA GPU에서 효율적으로 실행됩니다.