Open weights
media TLDR AI · il y a 2 h · 10 vues

Xiaomi open-source les modèles omnimodaux MiMo-V2.6 Pro et Flash

Xiaomi a open-sourcé les modèles omnimodaux MiMo-V2.6 Pro et Flash, conçus pour coordonner des agents afin de construire et tester visuellement des scènes 3D interactives. Ces modèles peuvent générer des actifs Blender, contrôler des bras robotiques à partir de flux vidéo, produire des frontends et des présentations, assembler des vidéos et composer de la musique sous forme de partitions et de MIDI.

media MarkTechPost · il y a 1 j Terminal-Bench 2 · 69.7% · 9 vues

AWS Strands Agents publie Strands Harness open-source avec un coût en tokens réduit

L'équipe AWS Strands Agents a publié Strands Harness, un harnais d'agent open-source à usage général disponible sous la licence Apache 2.0 pour Python et TypeScript. L'outil est conçu pour combler le fossé entre le prototypage d'agents dans des environnements comme Claude Code ou Codex et leur déploiement avec des boucles personnalisées.

lab Microsoft Research Blog · il y a 2 j · 29 vues

Microsoft publie RetroChimera pour la prédiction de rétrosynthèse

Microsoft Research a publié et open-sourcé RetroChimera, un nouveau cadre de prédiction de rétrosynthèse qui combine deux modèles complémentaires pour proposer des voies de synthèse de haute qualité. Le système intègre R-SMILES 2, un modèle de novo basé sur Transformer, avec NeuralLoc, un modèle basé sur un réseau neuronal graphique (GNN), en utilisant une stratégie d'assemblage apprise pour classer les prédictions.

lab Hugging Face Blog · il y a 2 j · 10 vues

tokenizers v1 version candidate offre un encodage 3 à 30 fois plus rapide grâce au fractionnement et à la mise en cache du bitstream

La bibliothèque tokenizers a publié une version candidate pour la version 1 qui améliore considérablement les performances de l'encodage de texte, en résolvant les goulots d'étranglement dans les flux de travail d'entraînement et de service. La mise à jour maintient la compatibilité de l'API avec la v0.23 tout en offrant des accélérations substantielles sur dix familles de modèles.

lab Hugging Face Blog · il y a 2 j MMLU · 77.0% · 15 vues

Multiverse reformule la suppression de blocs LLM en optimisation d'Ising pour une compression profonde

Multiverse a publié un article détaillant une méthode qui reformule l'élagage des grands modèles de langage comme un problème d'optimisation binaire sous contrainte mappé à un verre d'Ising. En traitant les blocs transformeur comme des spins avec des couplages par paire dérivés de l'hessienne de la perte, l'approche identifie les configurations optimales de suppression de blocs sans nécessiter de benchmarking itératif.

media Interconnects · il y a 2 j Artificial Analysis Intelligence Index · 45.0% · 17 vues

Les modèles chinois à poids ouverts surpassent leurs homologues américains en téléchargements et benchmarks

L'auteur présente un point sur l'état des modèles à poids ouverts, notant que les entreprises chinoises d'IA sont devenues les leaders clairs dans ce domaine depuis environ avril 2025. Ce changement est démontré par les métriques de téléchargement de Hugging Face et la performance sur les benchmarks de capacité.

media r/LocalLLaMA · il y a 5 j · 17 vues

Naive AI évaluée à 1,4 milliard de dollars, prévoit le lancement d'un LLM à poids ouvert

Naive AI, une startup en mode furtif fondée par le professeur Dai Jifeng de l'Université Tsinghua, a complété trois tours de financement totalisant 400 millions de dollars, atteignant une valorisation de plus de 1,4 milliard de dollars. L'entreprise se prépare à lancer son premier grand modèle de langage, également nommé Naive, en tant que version à poids ouvert dès ce mois-ci.

lab Tencent Hunyuan (HF) · il y a 6 j · 64 vues

Tencent lance WeVisDoc-4B, un analyseur de documents de bout en bout

Tencent a lancé WeVisDoc-4B, un analyseur de documents de bout en bout pour les images de pages qui convertit les pages en Markdown structuré avec des formules LaTeX et des tableaux HTML. Fine-tuné à partir de Qwen3-VL-4B-Instruct, le modèle atteint un score global de 95,38 sur OmniDocBench v1.6 et se classe premier parmi les analyseurs comparés dans les quatre configurations rapportées.

media Together AI Blog · il y a 7 j · 16 vues

Together présente sa stratégie de migration des modèles propriétaires vers des modèles open source

Together propose un cadre permettant aux entreprises de migrer des modèles d'IA propriétaires vers des modèles open source (OSM) à l'aide de services gérés, avec pour objectif de réduire la complexité et d'accélérer l'adoption. Le processus implique de découvrir des modèles adaptés grâce à des benchmarks, de les évaluer via la relecture du trafic, d'adapter les prompts ou les poids, et de calculer le ROI pour justifier le changement.

media r/LocalLLaMA · il y a 7 j · 18 vues

Le rapport de Mozilla affirme que les modèles d'IA à poids ouvert de la Chine sont en retard de 4 mois par rapport aux offres frontalières des États-Unis

Un rapport de Mozilla indique que les modèles d'IA à poids ouvert de la Chine ont réduit l'écart de développement à seulement quatre mois par rapport aux offres frontalières des États-Unis. Malgré cette progression rapide, les modèles continuent de prendre du retard dans certaines évaluations de benchmarks.