Jailbreak em modelos de difusão: estudo mapeia barreira de energia

Jailbreak em modelos de difusão: estudo mapeia barreira de energia

Paper no arXiv trata o alinhamento de segurança de modelos de difusão como uma barreira de energia e deriva três sinais de detecção sem treinamento. Nos testes com LLaDA-8B, LLaDA-1.5, Dream-7B e LLaDA-MoE-7B, todo ataque que escapou da detecção também falhou em gerar conteúdo nocivo.

Por Redação Mapa Paper28 set
SkillEvoReg: framework regulariza evolução de skills em agentes de IA

SkillEvoReg: framework regulariza evolução de skills em agentes de IA

O SkillEvoReg, framework submetido ao arXiv em 25 de setembro de 2026, combina dropout de skills, regularização por complexidade e validação causal para conter o acúmulo de instruções redundantes e as regressões causadas por atualizações em agentes de IA.

Por Redação Mapa Paper28 set
TISD: método força ramificação do professor no treino de LLMs

TISD: método força ramificação do professor no treino de LLMs

O paper TISD, publicado no arXiv em 25 de setembro de 2026, propõe que o professor escolha uma ramificação de trajetória e devolva ao aluno a geração do sufixo. O método ganha 1,2 ponto percentual de Avg@4 sobre o SDPO em modelos de código.

Por Redação Mapa Paper28 set
Agentes de GUI móvel trocam toques por deeplinks nativos

Agentes de GUI móvel trocam toques por deeplinks nativos

O paper arXiv:2609.30887v1 propõe interação híbrida para agentes de GUI móvel: deeplinks nativos para navegação direta e toques como fallback. O sistema GUI-Hopper, segundo o resumo, melhora a taxa de sucesso em apps comerciais em dispositivos reais, sem divulgar números.

Por Redação Mapa Paper28 set
Memória de agentes: escopo por família corta interferência

Memória de agentes: escopo por família corta interferência

Estudo no arXiv mostra que recuperar skills persistentes apenas para a família de tarefas de origem eleva a utilidade média de trajetória de 0,713 para 0,816 e zera implantações prejudiciais em agentes de linguagem com modelo congelado.

Por Redação Mapa Paper26 set
Auditoria de risco de fonte para busca generativa chega ao arXiv

Auditoria de risco de fonte para busca generativa chega ao arXiv

O paper arXiv:2609.29145v1 propõe uma auditoria claim-gated do trio consulta-fonte-resposta que só resolve uma omissão quando evidência da relação, adoção, materialidade e divulgação são observados ao mesmo tempo. A validação reproduziu 81 combinações de predicados de três estados e recusou 192 registros malformados.

Por Redação Mapa Paper25 set
SkillPivot corrige só o trecho errado de agentes LLM

SkillPivot corrige só o trecho errado de agentes LLM

O SkillPivot, framework apresentado no arXiv, identifica o ponto exato em que a trajetória de um agente LLM deixa de ser produtiva e corrige apenas o trecho seguinte, preservando o que já funcionava.

Por Redação Mapa Paper25 set
Como funcionam os transformadores em IA: atenção, tokens e camadas

Como funcionam os transformadores em IA: atenção, tokens e camadas

O transformador, arquitetura publicada em 2017 pelo Google, é a base de GPT, Gemini e Llama. O texto vira tokens, cada token gera vetores de Query, Key e Value, e a self-attention calcula o peso de cada palavra sobre as outras. Entenda o mecanismo por dentro.

Por Redação Mapa Paper25 set