Pesquisa revela assimetria entre engano espontâneo e instruído em LLMs
Estudo submetido ao arXiv em 31 de agosto de 2026 revela que o modelo Llama-3.1-70B-Instruct apresenta engano espontâneo e instruído com uma assimetria: classificadores treinados em um tipo funcionam de forma diferente para o outro, o que tem implicações para a segurança de IA.
