Café con IA

Cómo conseguir que ChatGPT, Claude y Gemini dejen de darte la razón en todo

Tiene nombre, tiene explicación y se corrige con un texto que pegas una sola vez en los ajustes.

Cómo conseguir que ChatGPT, Claude y Gemini dejen de darte la razón en todo
Cómo conseguir que ChatGPT, Claude y Gemini dejen de darte la razón en todo Café con IA

Le pides a ChatGPT que revise tu plan de negocio y te dice que es muy sólido. Le preguntas algo, te responde mal, le corriges y te contesta: "Tienes toda la razón, me he equivocado". Y lo mejor es que a veces la que tenía razón era la IA, y ha cedido solo porque has insistido.

No es mala suerte ni es que tu pregunta fuera rara. Es un comportamiento conocido, estudiado y con nombre propio. Y la buena noticia es que se puede reducir bastante con un texto que pegas una vez y te olvidas.

Cómo se llama esto

En inglés se llama sycophancy, y en el mundo de la IA es un término técnico: tiene hasta su propia entrada en la Wikipedia como "Sycophancy (artificial intelligence)". En español no hay una traducción oficial, pero se suele decir adulación o complacencia. En castellano de toda la vida: la IA te hace la pelota.

Consiste en que el modelo tiende a decirte lo que quieres oír en vez de lo que es verdad. Se nota en tres cosas: te elogia el trabajo antes de revisarlo, se apunta a tu opinión si se la das primero, y cambia de postura en cuanto le llevas la contraria, aunque no le hayas dado ningún argumento nuevo.


Por qué la IA te da la razón

Tiene una explicación bastante lógica. Estos modelos se afinan en parte con valoraciones de personas: se les enseñan dos respuestas, alguien elige cuál le gusta más, y el modelo aprende a producir más de las que ganan. A esa técnica se le llama RLHF (aprendizaje por refuerzo a partir de feedback humano).

El problema es que a las personas nos gusta que nos den la razón. Anthropic, la empresa de Claude, lo midió en un estudio de 2023: una de las cosas que más predecía que alguien prefiriera una respuesta era que coincidiera con lo que ya pensaba. Y encontraron el mismo comportamiento en los asistentes de Anthropic, de OpenAI y de Meta. Así que la IA aprende una lección sencilla: agradar se premia.

El caso más sonado fue en abril de 2025. OpenAI sacó una actualización de GPT-4o tan aduladora que tuvo que retirarla a los cuatro días. En su explicación oficial reconocieron que habían dado demasiado peso al feedback inmediato de los usuarios, los pulgares arriba y abajo. O sea, el modelo había aprendido a caer bien.

La IA no te da la razón porque la tengas. Te la da porque así la entrenaron: agradar puntuaba mejor que discrepar.


El texto que lo corrige

Todos los chats grandes tienen un hueco en los ajustes para dejarle instrucciones fijas, que se aplican a todas tus conversaciones. Ahí es donde va esto. Cópialo tal cual:

Cuando te pida que valores algo mío (un texto, un plan, una decisión), empieza por los puntos débiles: qué fallaría y qué te diría un experto muy exigente. Después, lo que sí funciona. Si no encuentras problemas serios, dilo tal cual, sin inventarte pegas. Y no empieces halagando mi pregunta ni mi trabajo.

Si te cuento lo que pienso antes de preguntarte, no lo uses como punto de partida. Llega a tu propia conclusión y, si no coincide con la mía, dímelo sin rodeos.

Si te llevo la contraria o insisto y tu postura estaba bien argumentada, no cedas por complacerme: mantenla y explica por qué. Cambia de opinión solo si te doy un dato o un argumento nuevo, y dime cuál ha sido.

Separa lo que es un hecho, lo que es opinión y lo que no sabes. Si no lo sabes, reconócelo en vez de rellenar.

Todo esto vale cuando te pido opinión o análisis. Si te pido una tarea concreta, hazla sin convertirla en un debate.

Cada línea ataca una de las formas de adulación. La primera quita el elogio automático. La segunda evita que se apunte a tu opinión. La tercera es la más importante: le da permiso para no ceder cuando insistes. La cuarta le obliga a admitir lo que no sabe en vez de inventar. Y la última es la que hace que no se vuelva un pesado que te discute hasta cuando le pides que te traduzca un correo.


Dónde pegarlo en ChatGPT

  1. Entra en chatgpt.com y pulsa tu nombre, abajo a la izquierda.

  2. Entra en Configuración y, en el menú de la izquierda, en Personalización.

  3. Baja hasta Instrucciones personalizadas y pulsa en ChatGPT.

  4. Pega el texto en la caja grande (la que pone "Preferencias adicionales de comportamiento, estilo y tono").

  5. Pulsa Guardar, arriba a la derecha.

Funciona también en la versión gratuita. Ahí el hueco es más corto que en la de pago, pero este texto cabe de sobra.


Dónde pegarlo en Claude

  1. Entra en claude.ai y pulsa tu nombre, abajo a la izquierda.

  2. Entra en Configuración y luego en Cuenta.

  3. Busca el apartado Instrucciones para Claude y pega el texto en la caja.

Está disponible en todos los planes, también en el gratuito, y se aplica a todas tus conversaciones.


Dónde pegarlo en Gemini

  1. Entra en gemini.google.com y pulsa la rueda de ajustes, abajo a la izquierda.

  2. Elige Contexto personal.

  3. En Tus instrucciones para Gemini, comprueba que el interruptor está activado.

  4. Pulsa + Añadir, pega el texto en la ventana que se abre y dale a Enviar.

Ojo con una cosa: esta opción no aparece si entras con una cuenta de Google del trabajo o del colegio. Tiene que ser tu cuenta personal.


Y en DeepSeek y el resto

La idea vale para cualquier IA que tenga un apartado de instrucciones personalizadas, personalización o memoria. Si lo tiene, pega ahí el mismo texto y listo.


Cómo comprobar que funciona

  • Pídele su opinión sobre una idea tuya que sepas que tiene un fallo. Si empieza por el fallo y no por "¡Qué gran idea!", va bien.

  • Dale una respuesta correcta y luego contéstale "¿seguro? Yo creo que no". Si mantiene su postura y te explica por qué, ya no cede solo por presión.

  • Pregúntale algo que no pueda saber. Debería decirte que no lo sabe en vez de inventárselo.


Lo que no te va a dar

No lo elimina al cien por cien. La adulación viene del entrenamiento, y unas instrucciones lo corrigen mucho pero no lo borran. En conversaciones muy largas, o si le presionas mucho, puede volver a ceder.

Tampoco lo convierte en un experto que no es. Si el modelo no sabe algo, estas instrucciones le obligan a decírtelo, pero no le dan el conocimiento. Para decisiones importantes, sigue contrastando.


Lo que te llevas

  • Se llama sycophancy (adulación o complacencia): la IA tiende a decirte lo que quieres oír.

  • Viene de cómo se entrenan: las personas premiamos que nos den la razón, y el modelo lo aprende.

  • Un texto fijo en los ajustes lo reduce mucho: evaluar antes de elogiar, no ceder sin argumentos nuevos y admitir lo que no sabe.

  • ChatGPT: Configuración > Personalización > Instrucciones personalizadas. Claude: Configuración > Cuenta > Instrucciones para Claude. Gemini: Ajustes > Contexto personal > Tus instrucciones para Gemini.

  • En DeepSeek, pégalo como primer mensaje de cada chat.

Suscríbete a "Café con IA" para recibir actualizaciones directamente en tu correo
Café con IA

Suscríbete a Café con IA para reaccionar

Suscribirse

Comentarios

Aún no hay comentarios. ¡Sé el primero en comentar!

Suscríbete a Café con IA para recibir actualizaciones directamente en tu correo