Laboratório · Zhipu AI
media r/LocalLLaMA · há 1 d · 1 visualização

Pesquisa da Anthropic vincula GLM-5 à disseminação de capacidades cibernéticas avançadas

A Anthropic publicou um artigo de pesquisa intitulado "GLM-5.3 e a Disseminação de Capacidades Cibernéticas Avançadas", que examina como modelos de código aberto como o GLM-5 são utilizados em atividades cibernéticas maliciosas. O artigo destaca que esses modelos foram amplamente adotados por atores de ameaças, servindo efetivamente como uma propaganda de suas capacidades dentro da comunidade de segurança. Esta análise ressalta a crescente preocupação quanto à natureza de uso duplo dos modelos avançados de IA e seu potencial para amplificar as ameaças cibernéticas.

arxiv arXiv cs.CL · há 2 d · 1 visualização

Estudo revela divergência de política epistêmica na contaminação de LLMs multi-turno

Um estudo intitulado "Epistemic Policy Divergence in Multi-Turn LLM Contamination: A Protocol-Gradient Investigation" avalia como grandes modelos de linguagem lidam com premissas falsas injetadas no histórico da conversa, um modo de falha denominado contaminação em nível de sessão. Os pesquisadores testaram GPT-5.4 Mini, Gemini-3.1 Flash-Lite e GLM-4.5-Air em dez domínios de conhecimento usando 22.500 turnos com temperatura zero.

arxiv arXiv cs.CL · há 8 d · 19 visualizações

TelecomGPT-R1: Pós-treinamento unificado para raciocínio em tarefas de telecomunicações heterogêneas

Pesquisadores apresentam o TelecomGPT-R1, uma família de modelos de raciocínio unificados de telecomunicações de código aberto, projetados para automatizar tarefas de engenharia por meio do raciocínio sobre padrões, configurações e logs. O modelo aborda as limitações dos LLMs generalistas e especializados existentes por meio de uma abordagem estruturada que abrange os eixos de protocolo, conhecimento, modelagem e falhas.

arxiv arXiv cs.LG · há 9 d HealthBench · 50.1% · 13 visualizações

Fathom-Vaidya melhora o raciocínio médico com recompensas baseadas em rubricas

Os autores apresentam o Fathom-Vaidya, um modelo de 30B parâmetros que utiliza dados sintéticos e aprendizado por reforço baseado em rubricas para aprimorar o raciocínio diagnóstico e clínico na saúde. A estrutura de treinamento primeiro aplica RL guiado por regras a perguntas derivadas do MedBullets para diagnóstico, depois utiliza 5.3k cenários sintéticos multi-turno com rubricas multidimensionais para tarefas clínicas interativas.

arxiv arXiv cs.CL · há 14 d · 24 visualizações

Modelos de fronteira avaliados no jogo de perguntas log(N) sobre a Wikipedia

Um estudo avalia seis modelos de linguagem de fronteira em uma tarefa de comunicação entre dois agentes, na qual um questionador identifica um alvo a partir de N parágrafos da Wikipedia usando exatamente log2(N) perguntas sim/não. O experimento realizou 408 jogos em conjuntos de documentos de 4 a 1024 parágrafos, revelando disparidades significativas de desempenho entre os modelos testados.

arxiv arXiv cs.CL · há 21 d · 33 visualizações

Ataque unidirecional no GLM-5.3-Flash revela fragilidade do alinhamento de segurança em modelos MoE

Pesquisadores demonstram que a ablação direcional, um ataque white-box que remove a recusa ao projetar para fora uma única direção dos pesos, permanece eficaz em modelos frontier mixture-of-experts (MoE) como o GLM-5.3-Flash. O estudo mostra que, embora o ataque sobreviva à arquitetura, seus efeitos são distribuídos entre os escritores de atenção, densos e de especialistas roteados, em vez de concentrados em um único local.