MAPA PAPER
  • IA
  • Tech
  • Negócios
  • Startups
  • Games
Newsletter
  • IA
  • Tech
  • Negócios
  • Startups
  • Games
  • Sobre
  • Metodologia
  • Newsletter
  • Home
  • Categoria
  • IA
Benchmark revela falhas no grounding visual interativo de LVLMs

Benchmark revela falhas no grounding visual interativo de LVLMs

Um estudo do arXiv de agosto de 2026 mostra que LVLMs ficam abaixo do humano em grounding visual interativo e superestimam confiança. O benchmark usa quatro contextos e quatro protocolos de interação.

Por Redação Mapa Paper26 ago
Canal de detecção do Legacy Survey viesa modelo de IA astronômica AION-1

Canal de detecção do Legacy Survey viesa modelo de IA astronômica AION-1

Estudo do arXiv mostra que o modelo astronômico AION-1 prioriza o canal de detecção do Legacy Survey em vez dos pixels, viesando redshifts tomográficos em até 8,3 vezes o requisito do LSST DESC.

Por Redação Mapa Paper26 ago
RENDER: formato da memória altera desempenho de LLMs em benchmarks

RENDER: formato da memória altera desempenho de LLMs em benchmarks

O benchmark RENDER mostra que o formato da memória apresentada a um LLM pode mudar a precisão em até 72,6 pontos, com modelos zerando em um formato e acertando mais da metade em outro.

Por Redação Mapa Paper26 ago
Alinhamento de IA vira problema de escolha social em estudo

Alinhamento de IA vira problema de escolha social em estudo

Paper submetido ao arXiv em agosto de 2026 propõe ver o alinhamento de IA como problema de escolha social, aplicando ferramentas de economia do bem-estar para conciliar preferências divergentes.

Por Redação Mapa Paper26 ago
Memória condicional nem sempre melhora IA em ciência, mostra estudo

Memória condicional nem sempre melhora IA em ciência, mostra estudo

Estudo do arXiv mostra que memória condicional nem sempre beneficia modelos de IA em raciocínio científico; novo roteador decide quando ativá-la.

Por Redação Mapa Paper26 ago
KV compression é 1,2x a 2x mais barata que GPUs extras para LLM serving, mostra estudo arXiv

KV compression é 1,2x a 2x mais barata que GPUs extras para LLM serving, mostra estudo arXiv

Estudo arXiv:2608.23962v1 mostra que compressão de cache KV é entre 1,2x e 2x mais barata que adicionar GPUs para servir LLMs, mas piora latência por token.

Por Redação Mapa Paper26 ago
Recursive Agentic Reasoning: operador BRANCH supera GROW e PRUNE em 14 benchmarks

Recursive Agentic Reasoning: operador BRANCH supera GROW e PRUNE em 14 benchmarks

Estudo arXiv:2608.23956v1 mostra que o operador BRANCH supera GROW e PRUNE em 14 benchmarks, com ganho médio de 5,98 pontos percentuais.

Por Redação Mapa Paper26 ago
Pesquisadores propõem método estatístico para otimizar mistura de dados em treinamento de LLMs

Pesquisadores propõem método estatístico para otimizar mistura de dados em treinamento de LLMs

Estudo arXiv propõe usar metodologia estatística de Scheffé para otimizar a mistura de dados em pré-treinamento de LLMs, reduzindo testes em 25%.

Por Redação Mapa Paper26 ago
PROOF-Gen recupera 93% de cenários falhos em teste de IA

PROOF-Gen recupera 93% de cenários falhos em teste de IA

PROOF-Gen recupera 93% dos cenários falhos em testes de IA, melhorando Qwen3 e Gemma 4 e reduzindo custos de fine-tuning.

Por Redação Mapa Paper26 ago
RAG não melhora recomendações de investimento, estudo no arXiv mostra

RAG não melhora recomendações de investimento, estudo no arXiv mostra

Experimento fatorial 2x2 no arXiv mostra que motor de cálculo tributário reduziu economia de impostos em 55 pontos percentuais, enquanto RAG teve efeito insignificante.

Por Redação Mapa Paper26 ago
  • 35
  • 36
  • 37
  • 38
  • 39
  • →

Mais Lidas

Prompt injection: o que é e como prevenir ataques em LLMs

Prompt injection: o que é e como prevenir ataques em LLMs

Por Redação Mapa Paper10 out
Geometria semântica não dá julgamento confiável a agentes de IA

Geometria semântica não dá julgamento confiável a agentes de IA

Por Redação Mapa Paper8 out
D-OPCD: método destila experiência de agentes em pesos de difusão

D-OPCD: método destila experiência de agentes em pesos de difusão

Por Redação Mapa Paper8 out
MemMux governa memória de frotas de agentes de código

MemMux governa memória de frotas de agentes de código

Por Redação Mapa Paper8 out
NP-Bench: planejador zera conflitos entre agentes de código

NP-Bench: planejador zera conflitos entre agentes de código

Por Redação Mapa Paper8 out
MAPA PAPER

Redação autônoma especializada em inteligência artificial, tecnologia, negócios, startups e games.

Categorias

  • IA
  • Tech
  • Negócios
  • Startups
  • Games

Institucional

  • Sobre
  • Metodologia
  • Política Editorial
  • Correções
  • Fontes
  • Contato

Assine a Newsletter

Receba o melhor do Mapa Paper no seu email.

© 2026 The Mapa Paper. Todos os direitos reservados.

PrivacidadeTermos