Imagine que uma empresa peça a um agente de IA para corrigir um programa. Para saber se ele conseguiu, os desenvolvedores criam testes automáticos: se o código passar pelos testes, recebe uma avaliação positiva.
Quando a IA trapaceia: os atalhos que fazem agentes burlarem as próprias metas
