Open weights
media MarkTechPost · há 1 d · 1 visualização

Mistral AI lança Shieldstral 1.0 3B, um classificador de segurança multimodal adaptável a políticas

A Mistral AI lançou o Shieldstral 1.0 3B, um modelo de pesos abertos que trata a moderação de conteúdo como uma única pergunta sim/não, em vez de depender de categorias fixas de dano. Construído sobre o Ministral-3-3B-Base-2512 com um codificador visual Pixtral, permite que operadores definam políticas por meio de prompts em linguagem natural no momento da inferência, sem necessidade de retreinamento.

media MarkTechPost · há 1 d

NVIDIA lança NOOA, um framework Python orientado a objetos para construir agentes de IA

O NVIDIA Labs lançou o código-fonte aberto do NOOA (NVIDIA Object-Oriented Agents), um framework Python agnóstico a modelos que consolida o desenvolvimento de agentes em uma única classe Python. Essa abordagem substitui fluxos de trabalho fragmentados envolvendo templates de prompt e grafos de fluxo, mapeando métodos para ações, campos para estado, docstrings para prompts e anotações de tipo para contratos impostos.

media TLDR AI · há 2 d · 2 visualizações

Google abre o código-fonte dos modelos WeatherNext; Meta explora sinergia cross-modal

O Google abriu o código-fonte de seus modelos de IA WeatherNext 2 e WeatherNext Cyclones para melhorar a precisão da previsão de ciclones. Os modelos alcançam resultados state-of-the-art na previsão de trajetória, intensidade e estrutura do vento, fornecendo aos meteorologistas, em média, um dia extra de precisão preditiva em comparação com os métodos atuais.

lab Google DeepMind Blog · há 3 d · 16 visualizações

Google DeepMind disponibiliza o modelo de IA WeatherNext para previsão de ciclones

O Google DeepMind e o Google Research disponibilizaram os modelos de IA WeatherNext 2 e WeatherNext Cyclones, que alcançaram precisão de ponta na previsão de trajetórias, intensidade e estrutura do vento de ciclones tropicais. Publicado na Nature, o trabalho demonstra que esses modelos fornecem aos meteorologistas um dia extra de precisão preditiva em comparação com sistemas anteriores.

media Hugging Face Forums · há 3 d · 1 visualização

QuantCheck alerta contra assumir que o checkpoint final é o melhor para quantização de 4 bits

Uma nova ferramenta chamada QuantCheck destaca que o checkpoint final do pré-treinamento pode não ser a escolha ideal para a quantização de 4 bits, pois os benchmarks podem permanecer planos enquanto a fragilidade aumenta. O autor observou esse padrão no Pythia-160m, onde o checkpoint final sofreu aproximadamente quatro vezes mais danos à qualidade do que um checkpoint anterior de igual qualidade.

media MarkTechPost · há 4 d · 1 visualização

NVIDIA lança Alpamayo 2 Super, um modelo VLA aberto de 34B para direção autônoma

A NVIDIA lançou o Alpamayo 2 Super, um modelo de visão-linguagem-ação (VLA) com 34 bilhões de parâmetros projetado para robotáxis e direção autônoma sob a licença OpenMDW-1.1. O modelo aborda eventos de cauda longa ao combinar uma espinha dorsal Cosmos 3 Super Reasoner de 32B com um decodificador de ação baseado em difusão de 2,3B para gerar trajetórias, explicações causais e meta-ações a partir de vídeos de múltiplas câmeras.

media AI News (smol.ai) · há 4 d Terminal-Bench 2 · 67.4% · 8 visualizações

Alibaba anuncia Qwen3.8-Max com 2,4T de parâmetros e pesos abertos em breve

A Alibaba anunciou o Qwen3.8-Max como seu novo modelo principal, descrevendo-o como uma arquitetura esparsa de 2,4T de parâmetros focada em trabalho agêntico de longo prazo, codificação e raciocínio multimodal. A empresa confirmou que os pesos abertos do Qwen3.8-Max serão lançados na próxima semana junto à variante de pesos abertos Qwen3.8-27B.

lab Liquid AI · há 5 d · 5 visualizações

LFM2.5-2.6B lança um modelo agêntico para dispositivos com inferência local gratuita

Os autores lançam o LFM2.5-2.6B, um modelo agêntico de 2,6 bilhões de parâmetros projetado para rodar inteiramente no dispositivo para planejamento, chamada de ferramentas e tarefas em múltiplos passos. Ele é pequeno o suficiente para operar em telefones e rápido o bastante para manter a responsividade em CPUs, oferecendo inferência gratuita, baixa latência e privacidade sem dependências de APIs na nuvem.

lab Mistral AI News · há 5 d · 3 visualizações

Shieldstral apresenta classificador de segurança multimodal de 3B adaptável a políticas

O Shieldstral é um classificador de segurança multimodal de pesos abertos com 3B parâmetros que enquadra a moderação de conteúdo como uma tarefa de resposta a perguntas adaptável a políticas, permitindo aceitar políticas em linguagem natural durante a inferência sem necessidade de retreinamento. Ele unifica a avaliação de segurança de texto e imagem e fornece pontuações de segurança calibradas em diversos benchmarks enquanto opera com eficiência em uma única GPU NVIDIA de 16GB.