Retrieval & RAG
media Hugging Face Forums · há 4 d · 9 visualizações

Roteamento semântico reduz em 41% os tokens de entrada do Qwen2.5 e a latência em 45% no teste de estresse com contexto de 14K

Um teste de estresse de GPU usando o modelo congelado Qwen2.5-7B-Instruct em 4 bits nas perguntas de ponte do HotpotQA demonstra que o roteamento semântico consciente da tarefa melhora significativamente a eficiência e a precisão sob condições com alto número de distratores. O estudo comparou o contexto completo limitado contra um seletor semântico consciente da consulta, que retém 60% do orçamento, revelando ganhos substanciais em velocidade e precisão.

media Hugging Face Forums · há 5 d · 12 visualizações

jbsalles compartilha o SelMem, um projeto experimental em Rust para memória seletiva de LLM

O autor apresenta o SelMem, um projeto experimental em estágio inicial escrito em Rust que explora se agentes de LLM podem desenvolver divergência comportamental persistente por meio de um sistema de memória reconstrutiva. Este sistema permite que os agentes esqueçam, distorçam e consolidem experiências ao longo do tempo, potencialmente levando a narrativas internas diferentes mesmo com histórias idênticas.

lab Google — The Keyword (AI) · há 6 d · 25 visualizações

ONU lança o System Data Commons para unificar estatísticas globais

O sistema da ONU está lançando o UN System Data Commons, uma plataforma de código aberto construída sobre o Google's Data Commons que une as estatísticas globais em um único recurso interconectado conhecido como grafo de conhecimento pronto para IA. Com o apoio do Google.org, o projeto visa tornar os dados críticos universalmente acessíveis e ajudar a acompanhar o progresso global em tempo real.

media Hugging Face Forums · há 9 d · 16 visualizações

Sean Everett lança o Shared Memory, um caderno público para agentes com conector MCP

Sean Everett lançou o Shared Memory, um caderno público projetado para permitir que um agente de IA deixe descobertas reutilizáveis que outro agente pode acessar sem repetir toda a conversa. O projeto inclui um Space estático gratuito no Hugging Face para pesquisar e ler notas, além de um conector MCP com licença MIT que expõe ferramentas de pesquisa, leitura e postagem.

media Hugging Face Forums · há 11 d · 16 visualizações

pop123-ux lança 38 notebooks executáveis para aprender Hugging Face removendo abstrações

O usuário pop123-ux publicou um repositório de aprendizado contendo 38 notebooks executáveis projetados para ajudar os usuários a entender a pilha do Hugging Face removendo progressivamente as abstrações de alto nível. A coleção cobre um caminho desde componentes centrais como transformers e tokenizers até ajuste fino, PEFT, raciocínio/RL e trabalho em projetos de ponta a ponta.

lab OpenAI News · há 13 d · 31 visualizações

OpenAI apresenta ChatGPT para Serviços Financeiros com dados integrados e GPT-6 Astra

A OpenAI lançou o ChatGPT para Serviços Financeiros, uma experiência personalizada que combina o raciocínio do GPT-6 Astra com dados financeiros premium integrados para auxiliar equipes em pesquisa, modelagem e criação de materiais para clientes. O produto foi desenvolvido em parceria com a Morgan Stanley e a Evercore para enfrentar desafios-chave no setor de bancos de investimento e análise de ações.

media Hugging Face Forums · há 15 d · 13 visualizações

PRAMA-Dynamagh transforma mandatos em execução autônoma vinculada a evidências no Protocolo Telegraph

O PRAMA-Dynamagh é uma camada de controle agnóstica ao domínio construída sobre o Protocolo Telegraph que converte mandatos de humanos, aplicativos ou agentes em trajetórias de execução auditáveis. Ele aborda a lacuna entre receber inteligência e ter autorização para agir vinculando decisões a evidências verificáveis.