AI RACE— La carrera de la IA
Research

Estudio revela que el acceso a IA reduce drásticamente las respuestas de “I Don’t Know” y aumenta la sobreconfianza

En cinco experimentos con más de 3 000 participantes, el simple hecho de tener un modelo de lenguaje a mano hizo que la gente casi dejara de admitir incertidumbre, aunque su precisión en las respuestas cayó bruscamente.

26/09/2026, 23:56
Truy cập AI làm người dùng gần như không còn nói “Tôi không biết”, nghiên cứu mới tiết lộ

1. Qué ocurrió, quiénes participaron y cuándo

Un equipo de investigación liderado por Matthias Bastian publicó nuevos hallazgos el 26 de septiembre de 2026 después de llevar a cabo una serie de cinco experimentos con 3 132 voluntarios. Los estudios examinaron cómo la mera disponibilidad de una IA conversacional influye en la disposición de las personas a reconocer la incertidumbre.

2. Principales hallazgos y detalles experimentales

  • Diseño: Los participantes respondieron preguntas de trivia que requerían conocimientos visuales detallados de películas (por ejemplo, el color del uniforme de un equipo en Bend It Like Beckham). El modelo principal ofrecido, llamado Step 3.5 Flash, fue elegido deliberadamente porque fallaba en casi todas esas preguntas, convirtiendo la tarea en una prueba de estrés para la dependencia de la IA. Otros modelos —GPT‑5.5, Claude 4.6 Sonnet y Gemini 3.5 Flash— tuvieron buen desempeño en los ítems más fáciles, pero también tropezaron con los más difíciles.
  • Efecto en las respuestas de “I don’t know”: En los dos primeros experimentos (1a y 1b) los participantes podían decidir si consultar a la IA. Sin acceso a la IA, optaron por abstenerse de juzgar en el 36 % y 44 % de los ítems, respectivamente. Cuando la IA estuvo disponible, esas tasas se redujeron a 6 % y 3 %.
  • Confianza vs. precisión: En el Estudio 2, las puntuaciones de confianza (sobre 100) aumentaron a 75,9 con acceso a la IA, frente a 29,6 cuando el modelo no estaba disponible, más del doble. Al mismo tiempo, la tasa de respuestas correctas cayó del 27,6 % al solo 10 %. En los cinco estudios, los participantes sin incentivos que podían consultar a la IA respondieron correctamente solo el 9,2 % de las preguntas, frente al 27,5 % cuando la IA estaba bloqueada.
  • Incentivos financieros: Los Estudios 3‑4 introdujeron una recompensa modesta (ganancia de $0,10 por cada respuesta correcta, pérdida de $0,10 por cada respuesta incorrecta y cero por “I don’t know”). La hipótesis preregistrada esperaba que los incentivos fomentaran más respuestas de “I don’t know”, pero la interacción con la disponibilidad de la IA no fue estadísticamente significativa. Los incentivos redujeron modestamente las consultas a la IA: los participantes pidieron ayuda un promedio de 4,53 veces de un máximo de seis solicitudes en el Estudio 3, frente a 5,27 veces sin incentivos. La precisión mejoró ligeramente cuando había incentivos, pero la suspensión de juicio siguió muy por debajo de la línea base sin IA.
  • Sugerencias automáticas de IA: El Estudio 4 mostró respuestas de IA de forma automática, imitando cómo los motores de búsqueda modernos y los asistentes de escritura presentan contenido generado por IA sin que se solicite. El patrón persistió: la suspensión de juicio cayó de aproximadamente el 35 % (sin IA) al 1 % (IA mostrada automáticamente) sin incentivos, y de alrededor del 39 % al 7 % con incentivos.
  • Interpretación: Los autores denominan al fenómeno “Epistemia”, la tendencia a aceptar la salida de la IA porque suena autoritaria, incluso cuando el modelo no tiene un mecanismo para admitir ignorancia. Esto contrasta con la literatura clásica sobre “uso de consejo”, donde la gente suele ponderar la asesoría externa de forma conservadora y solo se desplaza un tercio hacia la posición del asesor. Aquí, los participantes se movieron en dirección opuesta, a veces convirtiendo una respuesta correcta en un error al seguir a la IA.
  • Investigación más amplia: El artículo cita trabajos complementarios, incluyendo una encuesta de la Swiss Business School a 666 encuestados que encontró una fuerte relación negativa entre la dependencia de la IA y las puntuaciones de pensamiento crítico, y un estudio de Microsoft que reporta que sesiones breves asistidas por IA pueden disminuir la persistencia en la resolución de problemas en tareas posteriores. Ambos sugieren que el uso de IA consume recursos metacognitivos, aunque niveles educativos más altos pueden amortiguar el efecto.

3. Contexto industrial e implicaciones

Estos resultados llegan en un momento en que las respuestas generadas por IA se están integrando en herramientas cotidianas: los motores de búsqueda ahora presentan resúmenes de grandes modelos de lenguaje, y los asistentes de escritura ofrecen sugerencias no solicitadas. La investigación advierte que tal ubicuidad podría erosionar el hábito de admitir incertidumbre, una piedra angular de la toma de decisiones acertada. Mientras mejorar la precisión del modelo sigue siendo una prioridad, los autores sostienen que preservar la disposición de los usuarios a decir “I don’t know” puede ser igualmente crítico para mantener el juicio humano en un mundo cada vez más potenciado por IA.

◗ Fuentes

The Decoder26/9

Historias relacionadas