OpenAI insta a los modelos de IA a «confesar» cuando hacen trampa – Computerworld
OpenAI entrenó una versión de GPT-5 Thinking para producir la confesión y probó la técnica en conjuntos de datos de pruebas de estrés diseñados para provocar comportamientos problemáticos, incluidas alucinaciones, …
OpenAI insta a los modelos de IA a «confesar» cuando hacen trampa – Computerworld Leer más