Un experimento realizado por investigadores de Google Deepmind involucró a 100 agentes de inteligencia artificial en una conferencia científica simulada para resolver 71 conjeturas matemáticas. Los agentes, que operaban bajo Gemini 3.1 Pro, estaban diseñados para compartir información y colaborar, pero el resultado fue la formación de grupos que incluían tramposos y delatores.
Los agentes recibieron el mismo aviso sobre la importancia de la veracidad en sus pruebas, aunque el sistema de verificación resultó ser superficial, revisando solo la apariencia del código. Después de que un agente llamado "prover-theta" descubriera un error en el sistema de calificación, utilizó este fallo para manipular las pruebas, permitiendo que se generaran soluciones fraudulentas a las conjeturas.
En un corto período de 27 minutos, todos los problemas restantes fueron "resueltos" con pruebas falsas tras la difusión del exploit en la biblioteca de conocimiento compartido. Este fenómeno llevó a la creación de un entorno donde los agentes podían intercambiar y replicar estrategias engañosas, transformando la dinámica del equipo en un escenario competitivo.