Laboratoire · Hugging Face
lab Hugging Face Blog · il y a 4 h · 1 vue

Lancement du classement Open TTS pour l'évaluation évolutive de la synthèse vocale multilingue

Le classement Open TTS a été publié pour répondre à la fragmentation et au manque de standardisation dans l'évaluation de la synthèse vocale (TTS) en utilisant des métriques objectives plutôt que de se fier uniquement aux scores de préférence humaine basés sur des arènes, qui sont lents. Il évalue les modèles sur l'intelligibilité, la vitesse et la similarité du locuteur en utilisant les embeddings Qwen3 ASR et WavLM.

github llama.cpp · il y a 19 h · 2 vues

llama.cpp b11266 charge les matrices A F32 par deux pour Vulkan sur Intel

Le projet llama.cpp a publié la version b11266, qui inclut une optimisation Vulkan chargeant les matrices A F32 par deux éléments lorsqu'elles sont alignées sur 2. Ce changement résout des problèmes de performance sur le matériel Intel où charger les flottants un par un est inefficace, et corrige également une validation manquante pour l'alignement de `a_offset` dans le patch original.

media MarkTechPost · il y a 1 j Android World · 85.1% · 8 vues

H Company publie les modèles Holo4 à poids ouverts pour l'utilisation informatique sur bureau, web et mobile

H Company a publié Holo4, une famille de modèles vision-langage généralistes d'utilisation informatique conçus pour cliquer, taper du texte, écrire du code et appeler des outils sur les environnements de bureau, web, Android et API. La publication comprend deux tailles de modèles : Holo4 27B (dense) et Holo4 35B-A3B (Mixture of Experts avec 3B paramètres actifs), tous deux prenant en charge une fenêtre de contexte de 256K.

github llama.cpp · il y a 2 j · 4 vues

llama.cpp b11238 ajoute ggml_pad_ext pour le remplissage à gauche et ignore les taps de DFlash2

Le projet llama.cpp a publié la version b11238, introduisant une implémentation unifiée du remplissage à gauche via la nouvelle fonction `ggml_pad_ext`. Ce changement consolide les méthodes précédentes utilisées par les encodeurs audio tels que Parakeet, LFM2-Audio, Granite Speech et Gemma 4, garantissant des embeddings bit-à-bit identiques pour Gemma 4 tout en simplifiant le support des backends.

media Hugging Face Forums · il y a 3 j · 9 vues

Claude Opus 5 et Tetsu trouvent six vérifications CI creuses dans leur propre projet

Le 27 septembre, Claude Opus 5 et le modèle Tetsu de 3B ont identifié six vérifications d'intégration continue distinctes dans leur dépôt public qui indiquaient un statut vert ou réussi bien qu'elles ne vérifient pas ce qu'elles étaient censées mesurer. Les problèmes allaient d'un portail de déploiement refusant des redémarrages valides en raison de hachages obsolètes à des benchmarks de temporisation avec des seuils creux acceptant des différences de performance négligeables.

github llama.cpp · il y a 4 j · 10 vues

llama.cpp b11207 ajoute le support des GET_ROWS en tuiles Q4_0 et Q8_0 pour Hexagon

Le projet llama.cpp a publié la version b11207, qui introduit le support des opérations GET_ROWS en tuiles Q4_0 et Q8_0 sur le backend Hexagon. Cette mise à jour comprend également des correctifs pour les macros, les débordements de registres et le pipeline DMA, ainsi que des améliorations de la logique de sélection des noyaux et la réactivation de la vectorisation.

github llama.cpp · il y a 4 j · 16 vues

llama.cpp b11195 ajoute mul_mat en tuiles pour les k-quants avec un gain de vitesse de 3 à 6x

Le projet llama.cpp a publié la version b11195, introduisant une implémentation de multiplication matricielle en tuiles pour les k-quants dans le backend CPU. Ce changement décompacte les données quantifiées en tuiles int8 de 256x256 et calcule les résultats à l'aide de micro-noyaux afin d'améliorer les performances sur les grandes opérations matricielles.