Tous les articles — korshunov.ai

Tous les articles Page 1 / 14

Dans GeneBench-Pro : 10 études de cas de raisonnement génomique complexe

GeneBench-Pro est un benchmark conçu pour évaluer les modèles sur des tâches de raisonnement génomique complexe, présentant dix études de cas détaillées qui mettent en évidence des questions représentatives et du matériel d'appui. Chaque étude de cas fournit le prompt original, les ensembles de données et le contexte nécessaires pour évaluer la performance des modèles sur des défis biologiques spécifiques.

lab OpenAI News · il y a 1 j

Présentation de GeneBench-Pro

GeneBench-Pro est un benchmark de niveau recherche conçu pour mesurer la manière dont les agents IA gèrent l'ambiguïté et prennent des jugements déterminants en biologie computationnelle, élargissant le cadre du GeneBench original. Il comble les limites des évaluations actuelles en testant des capacités d'ordre supérieur telles que la gestion du bruit dans les données, la révision des hypothèses et la détermination du moment où les résultats sont prêts à servir de base à une décision.

lab OpenAI News · il y a 1 j

Épidémiologie des core dumps : correction d'un bug vieux de 18 ans

Les ingénieurs d'OpenAI ont résolu des plantages C++ inexplicables dans leur infrastructure de données Rockset en identifiant deux causes distinctes : une corruption matérielle silencieuse sur un hôte Azure et une condition de course vieille de 18 ans dans GNU libunwind.

lab OpenAI News · il y a 1 j

Comment l'adoption de ChatGPT s'est élargie

Les données de OpenAI Signals révèlent que l'adoption de ChatGPT s'élargit et s'intensifie à l'échelle mondiale, les utilisateurs envoyant 50 % de messages en plus par jour et doublant le nombre de tâches distinctes essayées six mois après leur inscription.

github llama.cpp · il y a 2 j

llama.cpp b9849 release : gestion des URL IPv6 et nouveaux binaires

La version b9849 de llama.cpp introduit le support des littéraux IPv6 entre crochets dans les autorités d'URL, permettant au serveur d'analyser les formes [hôte]:port conformément à la RFC 3986. Cette mise à jour assure un formatage correct des journaux d'écoute, des en-têtes proxy et des reconstructions client tout en conservant l'adresse distante brute pour le suivi par requête.

lab Google DeepMind Blog · il y a 2 j

Commencez à développer avec Nano Banana 2 Lite et Gemini Omni Flash

Google a publié deux nouveaux modèles d'IA, Nano Banana 2 Lite et Gemini Omni Flash, conçus pour améliorer les capacités des développeurs dans la création d'applications intelligentes.

lab Hugging Face Blog · il y a 2 j

Pourquoi la spécialisation est inévitable

L'article soutient que la spécialisation en apprentissage automatique est une tendance inévitable, poussée par la complexité croissante des modèles et le besoin d'expertise spécifique au domaine.

github llama.cpp · il y a 2 j

La version b9848 de llama.cpp corrige get_rows_back pour CUDA et fournit des binaires

Le projet llama.cpp a publié la version b9848, qui inclut une correction critique pour le backend CUDA afin de résoudre les problèmes avec la fonction `get_rows_back` sur les tables dépassant 65535 lignes. Cette mise à jour corrige le clampage grid-y et les erreurs de stride qui affectaient précédemment les opérations sur de grandes tables.

lab Hugging Face Blog · il y a 2 j

Présentation des résultats de Every Eval sur les pages des modèles Hugging Face

Hugging Face a mis à jour ses pages de modèles pour afficher les résultats d'évaluation de l'initiative 'Every Eval', offrant une vue complète des performances des modèles sur divers benchmarks. Cette intégration permet aux utilisateurs d'accéder à un large éventail de métriques standardisées directement dans l'interface du hub de modèles.

github llama.cpp · il y a 2 j

La version b9847 de llama.cpp corrige Gemma E4B MTP FlashAttention

Le projet llama.cpp a publié la version b9847, qui inclut une correction pour Gemma E4B MTP FlashAttention sur CUDA et la suppression d'une déclaration de template inutilisée.

media Hugging Face Forums · il y a 2 j

Discussion communautaire sur les LLM open-source pour le développement de chatbots

Un fil de discussion sur les forums Hugging Face demande aux utilisateurs quels modèles d'IA gratuits ou open-source ils utilisent actuellement pour le développement de chatbots et leurs raisons de préférence.

media Hugging Face Forums · il y a 2 j

Top 5 modèles que je peux faire tourner avec mon matériel ? Pas de lobotomie IA

Un utilisateur des forums Hugging Face cherche des recommandations pour des modèles d'IA non censurés capables de raisonner sur des sujets complexes, citant une préférence pour les versions antérieures de GPT-4 par rapport aux itérations actuelles.

github llama.cpp · il y a 2 j

llama.cpp b9846 avec optimisation matmul Vulkan pour Asahi Linux

Le projet llama.cpp a publié la version b9846, qui inclut une optimisation du backend Vulkan pour Asahi Linux. Cette mise à jour annule la boucle de taille de bloc dans la multiplication matricielle afin d'améliorer la compatibilité et les performances sur le matériel Apple Silicon sous Linux.

github llama.cpp · il y a 2 j

La version b9844 de llama.cpp ajoute le support NVFP4 et de nouveaux binaires

Le projet llama.cpp a publié la version b9844, qui introduit le support ggml-webgpu pour le format de quantification NVFP4. Cette mise à jour fournit également des binaires préconstruits pour macOS, iOS, Linux, Android, Windows et openEuler sur divers backends matériels.

lab Google — The Keyword (AI) · il y a 2 j

Débloquer la prochaine ère de productivité du Royaume-Uni : Construire une nation de pionniers de l'IA

Google UK a publié son dernier rapport sur l'impact économique détaillant les stratégies pour aider davantage de personnes à débloquer les avantages des technologies alimentées par l'IA dans le pays.

github llama.cpp · il y a 2 j

Publication de llama.cpp b9843 avec des binaires pour macOS, Linux et Windows

Le projet llama.cpp a publié la version b9843, fournissant des binaires précompilés pour macOS, Linux, Android, Windows et openEuler sur diverses architectures matérielles.

github LangGraph · il y a 2 j

Notes de version LangGraph 1.2.7

La version 1.2.7 de LangGraph a été publiée, apportant des corrections de bugs et des mises à jour de dépendances pour l'écosystème LangChain.

lab Microsoft Research Blog · il y a 2 j

Memora : Une représentation de mémoire harmonique équilibrant abstraction et spécificité

Microsoft Research présente Memora, un framework de mémoire agentique évolutif conçu pour équilibrer abstraction et spécificité pour les tâches d'IA à long terme. Le système découple le contenu riche de la mémoire des structures de récupération légères, établissant de nouveaux résultats state-of-the-art sur les benchmarks tout en utilisant jusqu'à 98 % moins de tokens de contexte.

lab Claude Code Releases · il y a 2 j

Notes de version de Claude Code v2.1.196

La version 2.1.196 de Claude Code introduit les modèles par défaut de l'organisation, les pièces jointes de fichiers cliquables et une sécurité améliorée pour les approbations des serveurs MCP. La mise à jour améliore également la fiabilité des sessions en arrière-plan, corrige divers problèmes de rapport d'état des agents et optimise l'utilisation des jetons dans les flux de travail de revue de code.

lab Hugging Face Blog · il y a 2 j

DiScoFormer : Un transformateur pour la densité et le score, à travers les distributions

L'article présente DiScoFormer, un modèle de transformateur unifié capable d'effectuer à la fois l'estimation de densité et des tâches de génération basées sur le score sur diverses distributions de données.