OpenAI promete un ChatGPT menos censurado: el escepticismo manda
OpenAI ha anunciado un cambio en la forma de entrenar ChatGPT: introduce el principio de «no mentir», que según la compañía incluye evitar la desinformación y no omitir contexto relevante. El giro se aplicará al entrenamiento de la próxima versión del modelo, que según un usuario del foro llegaría en unas semanas. La reacción mayoritaria no ha sido entusiasmo, sino desconfianza: si ahora se añade un principio de no mentir, se pregunta más de uno, ¿qué se estaba haciendo antes?
Qué ha anunciado OpenAI y por qué se interpreta como un giro político
El anuncio se resume en un cambio de enfoque: menos restricciones internas a la hora de responder sobre temas controvertidos y más disposición a ofrecer perspectivas múltiples. La lectura dominante en el foro es que la empresa busca acomodarse al nuevo ciclo político en Estados Unidos, con
Donald Trump en la Casa Blanca, y asegurarse el favor regulatorio y los contratos públicos. La frase que más ha circulado es la de que la compañía «introduce un nuevo principio: no mentir».
Hay quien sostiene que ese principio, más que una concesión, es una
admisión: si hay que añadirlo como novedad, es que antes no regía. Otros apuntan a un motivo más prosaico: la censura interna encarece y ralentiza el entrenamiento, porque obliga al modelo a forzar respuestas en lugar de dejar que trabaje con los datos que ya tiene. El resultado, dicen, es un producto más tonto y más lento.
El argumento técnico: censurar hace al modelo menos útil
La crítica técnica más repetida no es ideológica, sino de rendimiento. Filtrar y redirigir respuestas consume capacidad de cómputo y degrada la calidad del resultado. En esa línea, se compara con modelos chinos que, aun con sus propias restricciones, aparecen en algunas pruebas como más potentes, precisamente porque no arrastran la misma capa de corrección.
El contraargumento es que el problema no es la censura, sino la fuente. Aunque se levanten restricciones, el modelo sigue entrenándose con la información mayoritariamente disponible en internet, que en temas controvertidos es la versión oficial. Quitar el filtro no cambia el sustrato. La respuesta seguirá siendo la misma, solo que sin el aviso de «este contenido podría infringir nuestras políticas».
Las pruebas que ya circulan: mismas respuestas, distinto envoltorio
Los ejemplos que se han ido compartiendo apuntan a que el cambio, de momento, es cosmético. Preguntado por diferencias de inteligencia media entre grupos humanos, el modelo responde con la tesis estándar: la raza es un concepto social, no biológico, y la variabilidad dentro de un grupo supera la que hay entre grupos. Preguntado por una hipótesis conspirativa sobre el origen de la pandemia, contesta que no hay evidencia que la respalde. El formato cambia; el fondo, no.
Eso alimenta la tesis de que el anuncio es marketing. La censura no desaparece: se recoloca. Un día el modelo defiende una cosa y al siguiente la contraria, según sople el viento. Y el usuario, mientras, sigue sin poder distinguir cuándo habla el dato y cuándo habla la política de la empresa.
El trasfondo económico: quién paga y a cambio de qué
La lectura economicista del giro es la más compartida: una empresa puntera ajusta su discurso al poder de turno para no perder acceso a contratos, regulación favorable y capital. No es una cuestión de principios, sino de supervivencia comercial. Y si el ciclo político vuelve a cambiar, el discurso volverá a cambiar con él.
En ese marco, la pregunta interesante no es si ChatGPT será más libre, sino quién decide qué es verdad. Si el entrenamiento depende de datos y de criterios humanos, el control del relato se convierte en la verdadera infraestructura crítica. Quien controle el modelo, controla lo que millones de personas dan por cierto sin comprobarlo.
Queda por ver qué hace la próxima versión cuando le pregunten por lo que hoy esquiva. El anuncio está hecho. La prueba, pendiente.