Fonte · Hugging Face Forums
media Hugging Face Forums · há 1 d · 1 visualização

ThetaMem propõe elevações multiplicativas com sinal para memória de sequência de estado fixo

ThetaMem é um estudo preliminar, com semente única, de um misturador recorrente que modifica o estado recorrente por meio de elevações de chave aprendidas com Hadamard ou produto externo com sinal, em vez de refinar mecanismos de portão. O autor apresenta resultados mistos em benchmarks sintéticos e busca explicitamente críticas para identificar o experimento mais barato capaz de falsear a abordagem.

media Hugging Face Forums · há 2 d · 1 visualização

Autor propõe "Selos Causais" abertos para proveniência verificável de decisões de IA

O autor de um formato aberto e independente de modelo para a proveniência de decisões de IA está buscando feedback da comunidade sobre um novo padrão chamado "cartões de interação". Esta iniciativa visa preencher a lacuna na verificação de como saídas específicas foram produzidas, complementando os cartões de modelos existentes que documentam o próprio modelo.

media Hugging Face Forums · há 9 d · 3 visualizações

QuantCheck alerta contra assumir que o checkpoint final é o melhor para quantização de 4 bits

Uma nova ferramenta chamada QuantCheck destaca que o checkpoint final do pré-treinamento pode não ser a escolha ideal para a quantização de 4 bits, pois os benchmarks podem permanecer planos enquanto a fragilidade aumenta. O autor observou esse padrão no Pythia-160m, onde o checkpoint final sofreu aproximadamente quatro vezes mais danos à qualidade do que um checkpoint anterior de igual qualidade.

media Hugging Face Forums · há 11 d · 4 visualizações

Competição GLEE no IAB@NeurIPS 2026 convida submissões de agentes de IA para negociações

A Competição GLEE, o evento oficial do Workshop IAB no NeurIPS 2026, está aceitando participantes para construir agentes de IA capazes de barganha multironda, negociação e persuasão. A competição avalia os agentes em sua capacidade de gerar linguagem, raciocinar estrategicamente e se adaptar a outros jogadores dentro de ambientes econômicos.

media Hugging Face Forums · há 12 d · 4 visualizações

LLM gera Hyperlambda com verificação em tempo de execução para eliminar alucinações de funções

Um LLM foi configurado para gerar código na linguagem Hyperlambda, onde cada invocação de função é verificada contra um conjunto conhecido de funções existentes durante a execução. Se o modelo tentar chamar uma função inexistente, o sistema tenta automaticamente a geração até duas vezes adicionais antes de retornar um erro.