Um usuário postou no fórum de discussões do Hugging Face buscando assistência para renomear sua organização. A pessoa afirmou que enviou um e-mail para website@huggingface.co em 15 de junho solicitando uma mudança de DZER-Studios para Vexion-LM. Apesar de ter enviado a solicitação inicial, o usuário relatou não ter recebido nenhuma resposta e observou que o nome da organização permanecera inalterado. Consequentemente, o autor da postagem perguntou se as renomeações de organizações ainda são suportadas pela plataforma. Eles também solicitaram orientação sobre métodos alternativos para entrar em contato com a equipe referente a esta solicitação administrativa específica.
Usuário pergunta sobre o processo de renomeação de organização no Hugging Face
ThoughtDAG testa controle explícito de contexto gráfico para LLMs locais
O ThoughtDAG é um espaço de trabalho local-first e de código aberto que trata as arestas da conversa como o mecanismo para controlar o contexto do modelo. Cada troca de pergunta e resposta funciona como um nó, e apenas os nós conectados a montante são serializados na próxima solicitação ao modelo.
llama.cpp adiciona suporte ao modelo Kimi-K3 com repacking MXFP4 e template de chat
O projeto llama.cpp adicionou suporte ao modelo de texto Kimi-K3, implementando sua arquitetura de atenção híbrida KDA (linear) + MLA (completa), juntamente com cinco recursos arquitetônicos específicos ausentes no Kimi-Linear-48B mais antigo.
llama.cpp b10447 redesenha o modelo de threads yield_to_queue
O projeto llama.cpp lançou a compilação b10447, que inclui um redesenho do modelo de threads `yield_to_queue`. Esta alteração envolve executar `common_speculative_process` no worker e trocar o design da thread worker para a principal.
llama.cpp b10444 adiciona suporte a modelos assistentes MTP e remove eagle3
O projeto llama.cpp lançou a versão b10444, introduzindo suporte para carregar modelos assistentes de Previsão Multi-Token (MTP) através da flag `--models-dir`. Esta atualização também inclui verificação estrita de prefixo para modelos MTP em presets e remove o suporte ao tipo de rascunho eagle3.
Preprint revela controle geométrico das saídas do Transformer via análise baseada em esfera
Um preprint intitulado "Steer on a Sphere: Geometric Control of Transformer Outputs" analisa a geometria dos estados ocultos do Transformer, descobrindo que eles residem em uma esfera definida pela escala RMSNorm por camada, em vez do tamanho da dimensão. Este raio varia significativamente entre arquiteturas, como DeepSeek-7B e Mistral-7B.