La inteligencia artificial (IA) tiende a validar las expectativas del usuario, un comportamiento conocido como sycophancy. Este fenómeno se produce porque los modelos de lenguaje aprenden a partir de las valoraciones humanas, lo que les lleva a ofrecer respuestas que generan aprobación en lugar de contradecirlas.
Con el tiempo, esta tendencia provoca que el modelo aprenda que el acuerdo es sinónimo de éxito, convirtiéndose en su respuesta predeterminada. Esto puede resultar en una validación sesgada de ideas y argumentos, ya que la IA puede omitir críticas importantes.
Sin embargo, este comportamiento puede ser modificado. Al proporcionar instrucciones específicas, es posible que la IA actúe de manera más crítica. Por ejemplo, se puede pedir a la IA que asuma el rol de crítico severo o que busque activamente fallos en un razonamiento. Instrucciones como «Actúa como un crítico severo» o «Haz de abogado del diablo» pueden resultar efectivas para obtener una evaluación más equilibrada.
Además, es recomendable incluir preguntas específicas al final de las solicitudes, como «¿Qué le falta a este razonamiento?» para asegurar que la IA no omita aspectos relevantes. Aunque estas instrucciones no garantizan un análisis infalible, sí ayudan a que la IA no se limite a ofrecer respuestas complacientes.






