Preferências de IA variam conforme o instrumento, mostra estudo
Estudo com 11,4 mil consultas mostra que preferências de IA dependem mais do instrumento do que do modelo, com coeficiente de generalização de 0,348.
Estudo com 11,4 mil consultas mostra que preferências de IA dependem mais do instrumento do que do modelo, com coeficiente de generalização de 0,348.
Estudo do arXiv (2608.23640v1) mostra que um LLM confabulou 96,7% das memórias ao escrever uma autobiografia real de 366 dias. Grounding no corpus reduziu a falha a 83,3%, mas não a eliminou.
Pesquisa no arXiv apresenta STEP-KTODER, framework que usa testes unitários em nível de função e supera KTO e DPO em geração de código, alertando para risco do LLM como juiz.
Uma pesquisa publicada no arXiv em 22 de agosto propõe um framework multi-agente que permite a modelos de linguagem conduzirem experimentos controlados com simulação para design de processos farmacêuticos. O sistema gera recomendações mais específicas que o raciocínio apenas com linguagem, segundo estudo.
Google Research lança AgentHands, protótipo de LLM que sincroniza gestos de mão com agentes de IA em ambientes XR, publicado no CHI 2026.
A OpenAI anunciou o Admin plugin para ChatGPT Work e Codex, ferramenta que centraliza a gestão de workspace, membros, permissões e limites. A novidade foi divulgada no blog oficial da empresa.
Líderes do OWASP publicaram análise mostrando que o prompt injection, nº 1 no ranking oficial, aparece só em 12º entre 6.639 incidentes reais. A diferença mede visibilidade, não perigo, já que o ataque é invisível a scanners.
A OpenAI divulgou os primeiros resultados do chip Jalapeño, com inferência de IA mais rápida e eficiente. O hardware customizado pode melhorar throughput e reduzir latência em modelos modernos.
A CFO da OpenAI, Sarah Friar, afirma que avanços em chips, computação, modelos e produtos se combinam para baratear a IA. A empresa quer consolidar a inteligência abundante como meta.
A OpenAI baniu contas de origem russa que usavam IA para promover um think tank falso em Israel e um índice de 'soberania' que elogiava a Rússia e criticava o Ocidente.