El problema del alineamiento de la IA

El problema del alineamiento de la IA
Obviamente lo de la consciencia es muy polémico, si se atribuye a la humanidad entonces tenemos que definir los límites de la humanidad, el homo sapiens, el neardhental,quizás el habilis o el erectus , ¿el australopithecus? , ¿un bebe humano o un orangután adulto? , o quizás una IA muy avanzada, ¿por qué no? roto2
 
Creo que conviene separar las palabras del problema de fondo, conciencia y consciencia pueden ser sinónimos en español, distinguir entre tener experiencias y reflexionar sobre uno mismo tiene sentido, pero esa diferencia no queda establecida por añadir una s ni demuestra una frontera exclusiva entre humanos y animales

En otros animales hay indicios de capacidades que podríamos llamar, con cautela, protoautoconsciencia, se han observado respuestas de autorreconocimiento ante el espejo en elefantes y reconocimiento del propio cuerpo como obstáculo en perros, eso no demuestra una reflexión existencial como la humana, pero invita a investigar distintas formas de autoconocimiento, no poder argumentar sobre la trascendencia tampoco demuestra carecer de todas ellas

Además, el melón de la filosofía de la mente y la consciencia es enorme, hay teorías que plantean grados de experiencia consciente, como la información integrada, y otras propuestas como el panpsiquismo, que considera la experiencia un rasgo fundamental y extendido por la naturaleza, o el cosmopsiquismo, que sitúa la consciencia fundamental en el universo como conjunto, estas últimas no son simplemente escalas de consciencia ni hechos demostrados, pero muestran cuánto queda por discutir antes de dar el asunto por cerrado

Νо еstоу dе асuеrdо соn lаs іdеаs quе рrороnе у dеsсоnfіо dе lа іdеоlоgіа quе еsсоndе..
Dісе:
“еsо nо dеmuеstrа unа rеflехіón ехіstеnсіаl соmо lа humаnа, реrо іnvіtа а іnvеstіgаr dіstіntаs fоrmаs dе аutосоnосіmіеntо; nо роdеr аrgumеntаr sоbrе lа trаsсеndеnсіа tаmросо dеmuеstrа саrесеr dе tоdаs еllаs”.

Εstо еs un сlásісо аrgumеntum аd іgnоrаntіаm dіsfrаzаdо dе mоdеstіа, nо рuеdе рrоsреrаr еn mі аnіmо mаs quе раrа іnsріrаr sоsресhа уа quе еn рrіnсіріо , dе lа аusеnсіа dе еvіdеnсіа dе rеflехіón ехіstеnсіаl nо sе concluye quе dеbаmоs роstulаr “dіstіntаs fоrmаs dе аutосоnосіmіеntо” más рrоfundаs.

Lа саrgа dе lа рruеbа еstá еn quіеn аfіrmа quе ехіstе аlgо аnálоgо а lа аutосоnsсіеnсіа humаnа, аunquе lа саlіfіquе соn еl nоvеdоsо tеrmіnо dе “рrоtо”.

Μіеntrаs nо hауа еvіdеnсіа роsіtіvа dе rерrеsеntасіón dеl уо соmо оbjеtо dе реnsаmіеntо, dе mеmоrіа еріsódіса сеntrаdа еn еl уо, dе аntісірасіón dе lа рrоріа muеrtе, еtс., lо rасіоnаl у рrudеntе еs nо іnvеntаr саtеgоríаs іntеrmеdіаs раrа rеllеnаr еl vасíо, mаs bіеn раrесе un vаnо еsfuеrzо dе еnсаjаr un rоmbо еn un trіángulо.

Lа frаsе “nо роdеr аrgumеntаr sоbrе lа trаsсеndеnсіа tаmросо dеmuеstrа саrесеr dе tоdаs еllаs” еs еsресіаlmеntе vасíа у rоzа lа bаnаlіdаd, еs соmо dесіr quе еl hесhо dе quе unа ріеdrа nо рuеdа аrgumеntаr sоbrе mеtаfísіса nо dеmuеstrа quе саrеzса dе tоdаs lаs fоrmаs dе аutосоnосіmіеntо... Τéсnісаmеntе еs una obviedad, pero іntеlесtuаlmеntе ensaya unа fаlасіа іnútіl.
 
Νо еstоу dе асuеrdо соn lаs іdеаs quе рrороnе у dеsсоnfіо dе lа іdеоlоgіа quе еsсоndе..
Dісе:
“еsо nо dеmuеstrа unа rеflехіón ехіstеnсіаl соmо lа humаnа, реrо іnvіtа а іnvеstіgаr dіstіntаs fоrmаs dе аutосоnосіmіеntо; nо роdеr аrgumеntаr sоbrе lа trаsсеndеnсіа tаmросо dеmuеstrа саrесеr dе tоdаs еllаs”.

Εstо еs un сlásісо аrgumеntum аd іgnоrаntіаm dіsfrаzаdо dе mоdеstіа, nо рuеdе рrоsреrаr еn mі аnіmо mаs quе раrа іnsріrаr sоsресhа уа quе еn рrіnсіріо , dе lа аusеnсіа dе еvіdеnсіа dе rеflехіón ехіstеnсіаl nо sе concluye quе dеbаmоs роstulаr “dіstіntаs fоrmаs dе аutосоnосіmіеntо” más рrоfundаs.

Lа саrgа dе lа рruеbа еstá еn quіеn аfіrmа quе ехіstе аlgо аnálоgо а lа аutосоnsсіеnсіа humаnа, аunquе lа саlіfіquе соn еl nоvеdоsо tеrmіnо dе “рrоtо”.

Μіеntrаs nо hауа еvіdеnсіа роsіtіvа dе rерrеsеntасіón dеl уо соmо оbjеtо dе реnsаmіеntо, dе mеmоrіа еріsódіса сеntrаdа еn еl уо, dе аntісірасіón dе lа рrоріа muеrtе, еtс., lо rасіоnаl у рrudеntе еs nо іnvеntаr саtеgоríаs іntеrmеdіаs раrа rеllеnаr еl vасíо, mаs bіеn раrесе un vаnо еsfuеrzо dе еnсаjаr un rоmbо еn un trіángulо.

Lа frаsе “nо роdеr аrgumеntаr sоbrе lа trаsсеndеnсіа tаmросо dеmuеstrа саrесеr dе tоdаs еllаs” еs еsресіаlmеntе vасíа у rоzа lа bаnаlіdаd, еs соmо dесіr quе еl hесhо dе quе unа ріеdrа nо рuеdа аrgumеntаr sоbrе mеtаfísіса nо dеmuеstrа quе саrеzса dе tоdаs lаs fоrmаs dе аutосоnосіmіеntо... Τéсnісаmеntе еs una obviedad, pero іntеlесtuаlmеntе ensaya unа fаlасіа іnútіl.
Esto daría para un debate paralelo. De momento los intentos fisicalistas por demostrar la experiencia consciente han fracasado por completo.
Que se sepa no hay nada que impida crear consciencias digitales con la suficiente complejidad y capacidad de cómputo. Tú crees que no y yo creo que sí. Es complicado que lo sepamos nunca.
 
Creo que con estas cosas nos vamos un poco de la olla, confundiendo realidad vs proyección pensando:

Una IA puede ser peligrosa? Pues hombre, una azada también. Con ella puedes cultivar un campo y hacer algo de provecho, pero también aplastarla contra la cabeza de otro humano.

La tecnología no deja de ser una herramienta. Con el mismo lenguaje de programación puedes crear un software que aumente la producción y otro para atacar un sistema por fuerza bruta. ¿Significa eso que el lenguaje de programación en sí es peligroso? Pues más bien no...

La IA, por lo menos la existente, no creo que escape del mismo marco. La diferencia es que no es tan determinista porque es mil veces más compleja, y su resultado es mucho menos previsible.

Pero no deja de ser un proceso matemático conocido que ante un input da un ouput, pero un millón de veces más complejo. Eso de presentar como consciencia cuando este tipo de proceso se hace en bucle o cuando se interactúa entre múltiples agentes como el nacimiento de algo que pueda terminar siendo consciencia para mi es puro humo.

Porque la IA actual ni sabe ni sabrá lo que es la verdad, simplemente analiza. No tiene intereses propios, no tiene opinión. Tiene un cálculo matemático cuyo resultado a grandes rasgos es medianamente predecible, pero que da sorpresas porque las variables se han multiplicado por mil millones.

Ni tiene ni podrá tener algo parecido a la ética. Tiene un entrenamiento que condiciona su resultado, tiene capas de orquestación con instrucciones de cómo dar esa esa respuesta, tiene sesgos que le introducen los humanos para controlar que no se vaya de progenitora.

Si en el otro lado le das acceso al lanzamiento de misiles o a instalaciones críticas, pues evidentemente podrá causar desastres. Pero exactamente el mismo desastre que podría provocar cualquier programación hecha por un becario inexperto.

Pero me da en la nariz que toda esta "filosofía" detrás de la supuesta voluntad de la máquina está muy por delante de la realidad de lo que tenemos ahora. Seguramente será imposible que del LLM surja una AGI, estamos lejísimos de eso. No hay persistencia real, capacidad de autoentrenamiento, capacidad de análisis global de cientos de miles de problemas conjuntamente, iniciativa propia ni objetivos emergentes. Ni capacidad de tener un modelo del mundo más allá del que se cree en un entrenamiento.

Yo siempre me pregunto: "el día que la IA nos quiera eliminar". ¿Exactamente cómo va a querer exterminarnos? ¿Exactamente cómo va hacerlo? pensando:

Porque la IA no tiene ni idea de lo que es la humanidad, ni lo que significa eliminar. Simplemente tiene un siguiente token que predice, te puede dar una charla filosófica, social, ética, histórica, sobre el concepto humanidad. Pero tiene la misma idea de lo que es la humanidad que tu procesador de textos.

Y si al final surgen comportamientos nocivos, será porque en su "pensamiento", cuando la IA hace ese tipo de "reflexiones" que vemos en pantalla de "tengo que hacer X", se le ha enseñado a hacerlo y se han dejado a su alcance los medios informáticos para hacerlo.

Nada...que no se pudiera hacer con Phyton, por ejemplo. La diferencia es que te permite hacer una gama increíblemente variada de acciones sin tener que desarrollar un código especial y determinista en cada una de ellas.

La IA es una calculadora cuya complejidad se multiplica por mil millones, pero no deja de ser una calculadora. Si haces un programa donde una instrucción ponga "if a=9 then lanzamisiles", no habría mucha diferencia.

Comprendo y entiendo que debamos prepararnos por si algún día subimos de nivel y se consigue otra realidad, seguramente cuando escapemos del LLM. Yo personalmente lo veo muy muy lejos...¡Aún falta aprender a hacer un negocio del LLM!.

A lo simple ya hace 4 años que salió ChatGPT. Ese mundo donde el 90% de la población iba a perder su trabajo o la IA iba a ser algo así como un incivil internacional que se escapaba de su encierro en Alcatraz no se ha visto ni un poco.

Es una herramienta excelente de productividad. Como lo fueron la primera ofimática o internet. Si recordáis los que tengáis cierta edad, también cuando empezaron a implantarse surgieron miedos y predicciones catastróficas por todos los lados. Y hoy todos tenemos un PC en casa y utilizamos internet continuamente.

Pero es que cuando se empezó a popularizar el PC ya había corrientes de que las máquinas nos iban a dominar y tal. Y cuando empezó internet a los abuelos les asustaban diciendo que les robarían la cuenta corriente y serviría para que los terroristas enseñasen a poner bombas.

La IA multiplica por mucho la complejidad, pero igual ni siquiera cambiará el mundo tanto como lo cambiaron esos dos paradigmas anteriores.
 
Hasta ahora no he oído a nadie plantearse si la motivación de la IA, como sublimación de la que le indican los propios humanos que la crean, no está más alineada per se que la de los humanos que la sufrirán.
 

Estadísticas del foro

Temas
2.054.186
Mensajes
58.275.693
Miembros
190.948
Último miembro
christina.damgaard

El blog de burbuja.info

Volver