Tous les articles
media r/LocalLLaMA · il y a 4 h

Suivi : DeepSeek V4 Flash sur 2x RTX PRO 6000 termine les tâches de codage réelles plus rapidement que Sonnet et Opus, avec une qualité approximativement équivalente à celle de Sonnet

Un benchmark de suivi évalue DeepSeek V4 Flash exécuté sur deux GPU RTX PRO 6000 en utilisant vLLM, comparant ses performances dans des tâches de codage réelles par rapport aux modèles basés sur API comme Claude Sonnet et Opus. L'étude révèle que bien qu'Opus et Fable maintiennent une qualité de code supérieure, DeepSeek V4 Flash atteint une qualité approximativement au niveau de Sonnet avec des temps d'exécution significativement plus courts.

github llama.cpp · il y a 7 h

llama.cpp b9864 release : Intervalle de ping SSE par requête et binaires pour plateformes

La release b9864 de llama.cpp introduit un changement dans la gestion des Server-Sent Events (SSE) du serveur, permettant de configurer l'intervalle de ping au cas par cas. Cette mise à jour garantit que les opérations de prefill lentes ne coupent pas les connexions saines en envoyant un ping aux flux silencieux toutes les 1 seconde et en les interrompant uniquement après 3 secondes.

media Hugging Face Forums · il y a 8 h

Validation inter-domain d'un cadre unifié d'auto-organisation

Un cadre mathématique unifié pour l'auto-organisation dans les systèmes complexes reçoit un soutien expérimental de deux domaines physiques indépendants : la décohérence quantique et les transitions de condensat de Bose-Einstein classique. L'étude rapporte que le couplage non local agit comme un « amplificateur critique », produisant des effets maximaux aux frontières de phase où les systèmes sont les plus sensibles.

media Hugging Face Forums · il y a 9 h

Octopus Smart construit un système d'analyse de la Coupe du Monde alimenté par l'IA

Octopus Smart développe Octopus Football, une plateforme d'analyse pour la Coupe du Monde et les tournois professionnels qui utilise l'orchestration d'intelligence de match alimentée par l'IA. Le système combine des modèles d'analyse prédictive avec des agents d'intelligence des données pour fournir la modélisation des performances des équipes, les évaluations des joueurs et des résumés automatiques des matchs.

arxiv arXiv cs.CL · il y a 9 h

Défis et recommandations pour les LLM-as-a-Judge dans des contextes multilingues

Cet article examine la fiabilité de l'utilisation des grands modèles de langage (LLM) comme évaluateurs dans des contextes multilingues et de langues à ressources faibles, mettant en évidence d'importantes lacunes dans les pratiques actuelles. Les auteurs ont analysé 650 articles du Anthology ACL pour identifier des incohérences et une dépendance excessive aux modèles de juge uniques.

arxiv arXiv cs.CL · il y a 10 h

BamiBERT : Un nouveau modèle linguistique basé sur BERT pour le vietnamien

Les chercheurs présentent BamiBERT, un nouveau modèle linguistique pré-entraîné basé sur BERT pour le vietnamien, conçu pour pallier les limites de la norme actuelle, PhoBERT. Entraîné à partir de zéro sur un corpus de 129 Go pendant 20 époques, il prend en charge une longueur de contexte étendue allant jusqu'à 2048 tokens et fonctionne directement sur l'entrée brute sans segmentation externe des mots.

arxiv arXiv cs.CL · il y a 10 h

CheckRLM : Vérification efficace de la cohérence Connaissance-Pensée dans le Raisonnement Augmenté par Récupération

Les auteurs proposent CheckRLM, un cadre qui améliore la fiabilité des Modèles de Langage de Raisonnement en utilisant la Génération Augmentée par Récupération pour vérifier et corriger rapidement les erreurs factuelles pendant l'inférence. Cette approche extrait les affirmations factuelles des chaînes de raisonnement pour identifier les incohérences et applique des corrections à coût minimal via des connaissances externes.