Open weights
media MarkTechPost · há 1 d Terminal-Bench 2 · 69.7% · 9 visualizações

AWS Strands Agents lança o Strands Harness de código aberto com menor custo em tokens

A equipe do AWS Strands Agents lançou o Strands Harness, um harness de agentes de propósito geral e código aberto disponível sob a licença Apache 2.0 para Python e TypeScript. A ferramenta foi projetada para preencher a lacuna entre a prototipagem de agentes em ambientes como Claude Code ou Codex e sua implantação com loops personalizados.

lab Microsoft Research Blog · há 2 d · 29 visualizações

Microsoft lança RetroChimera para previsão de retrosíntese

A Microsoft Research publicou e disponibilizou como código aberto o RetroChimera, um novo framework para previsão de retrosíntese que combina dois modelos complementares para propor rotas de síntese de alta qualidade. O sistema integra R-SMILES 2, um modelo de-novo baseado em Transformer, com NeuralLoc, um modelo baseado em rede neural gráfica (GNN), utilizando uma estratégia de ensembling aprendida para classificar as previsões.

lab Hugging Face Blog · há 2 d · 10 visualizações

release candidate do tokenizers v1 entrega codificação 3 a 30 vezes mais rápida por meio de divisão e cache de bitstream

A biblioteca tokenizers lançou um release candidate da versão 1 que melhora significativamente o desempenho para codificação de texto, abordando gargalos nos fluxos de trabalho de treinamento e serviço. A atualização mantém compatibilidade de API com a v0.23 enquanto entrega acelerações substanciais em dez famílias de modelos.

lab Hugging Face Blog · há 2 d MMLU · 77.0% · 15 visualizações

Multiverse reformula a remoção de blocos de LLM como otimização de Ising para compressão profunda

O Multiverse publicou um artigo detalhando um método que reencaminha a poda de modelos de linguagem grandes como um problema de otimização binária restrita mapeado para um vidro de Ising. Ao tratar os blocos do transformer como spins com acoplamentos pares derivados da Hessiana da perda, a abordagem identifica configurações ótimas de remoção de blocos sem exigir benchmarking iterativo.

media Interconnects · há 2 d Artificial Analysis Intelligence Index · 45.0% · 17 visualizações

Modelos chineses de peso aberto superam contrapartes americanas em downloads e benchmarks

O autor apresenta um resumo sobre o estado dos modelos de peso aberto, observando que as empresas de IA chinesas se tornaram as claras líderes neste espaço desde aproximadamente abril de 2025. Essa mudança é evidenciada pelas métricas de download do Hugging Face e pelo desempenho em benchmarks de capacidade.

lab Tencent Hunyuan (HF) · há 6 d · 64 visualizações

Tencent lança WeVisDoc-4B, um analisador de documentos de ponta a ponta

A Tencent lançou o WeVisDoc-4B, um analisador de documentos de ponta a ponta para imagens de páginas que converte páginas em Markdown estruturado com fórmulas LaTeX e tabelas HTML. Fine-tuned a partir do Qwen3-VL-4B-Instruct, o modelo alcança uma pontuação geral de 95.38 no OmniDocBench v1.6 e ocupa o primeiro lugar entre os analisadores comparados em todas as quatro configurações relatadas.

media Together AI Blog · há 7 d · 16 visualizações

Together delineia estratégia para migração de modelos proprietários para código aberto

A Together oferece um framework para que empresas migrem de modelos de IA proprietários para modelos de código aberto (OSM) usando serviços gerenciados, com o objetivo de reduzir a complexidade e acelerar a adoção. O processo envolve descobrir modelos adequados por meio de benchmarks, avaliá-los via replay de tráfego, adaptar prompts ou pesos e calcular o ROI para justificar a mudança.