Un utilisateur a publié sur le forum de discussion de Hugging Face pour demander de l'aide concernant le renommage de son organisation. L'intéressé a indiqué avoir envoyé un email à website@huggingface.co le 15 juin, demandant un changement de DZER-Studios vers Vexion-LM. Malgré l'envoi de cette demande initiale, l'utilisateur signale n'avoir reçu aucune réponse et observe que le nom de l'organisation est resté inchangé. Par conséquent, l'auteur du message demande si les renommages d'organisation sont toujours pris en charge par la plateforme. Il demande également des conseils sur les méthodes alternatives pour contacter l'équipe concernant cette demande administrative spécifique.
Un utilisateur s'enquiert du processus de renommage d'organisation sur Hugging Face
ThoughtDAG teste le contrôle explicite du contexte graphique pour les LLM locaux
ThoughtDAG est un espace de travail open source et local-first qui traite les arêtes de conversation comme le mécanisme de contrôle du contexte du modèle. Chaque échange question-réponse fonctionne comme un nœud, et seuls les nœuds amont câblés sont sérialisés dans la prochaine requête au modèle.
llama.cpp ajoute le support du modèle Kimi-K3 avec reconditionnement MXFP4 et modèle de chat
Le projet llama.cpp a ajouté la prise en charge du modèle textuel Kimi-K3, implémentant son architecture d'attention hybride KDA (linéaire) + MLA (complet) ainsi que cinq caractéristiques architecturales spécifiques absentes de l'ancien Kimi-Linear-48B.
llama.cpp b10447 redessine le modèle de threads yield_to_queue
Le projet llama.cpp a publié la compilation b10447, qui inclut un redessin du modèle de threads `yield_to_queue`. Ce changement implique l'exécution de `common_speculative_process` dans le worker et le remplacement du design du thread worker vers le thread principal.
llama.cpp b10444 ajoute le support des modèles assistants MTP et supprime eagle3
Le projet llama.cpp a publié la version b10444, introduisant le support pour charger des modèles assistants de Prédiction Multi-Tokens (MTP) via le drapeau `--models-dir`. Cette mise à jour inclut également une vérification stricte du préfixe pour les modèles MTP dans les préréglages et supprime le support du type de brouillon eagle3.
Un préprint révèle le contrôle géométrique des sorties du Transformer via une analyse sphérique
Un préprint intitulé "Steer on a Sphere: Geometric Control of Transformer Outputs" analyse la géométrie des états cachés du Transformer, constatant qu'ils résident sur une sphère définie par l'échelle RMSNorm par couche plutôt que par la taille de la dimension. Ce rayon varie considérablement entre les architectures, telles que DeepSeek-7B et Mistral-7B.