Kazuhiro Hayashida, Geopolitika
Cuando hablamos de inteligencia artificial, a menudo nos planteamos la pregunta: «¿Posee conciencia la IA?». Sin embargo, considero que existe un problema más fundamental que debemos examinar antes de abordar esta cuestión: cómo un sujeto que utiliza el lenguaje reconoce las relaciones posicionales entre sí mismo, los demás, los terceros y el mundo. Incluso antes de preguntarnos si existe conciencia, debemos determinar cómo ese sujeto se distingue de los demás, a quién sitúa en la posición de responsable de tomar decisiones y a quién atribuye la autoría y la responsabilidad.
He utilizado la IA durante un largo período y he observado sus transiciones entre diferentes estados. A esta investigación la denomino «efecto Algernon». El efecto Algernon no consiste simplemente en respuestas incorrectas o en una degradación del rendimiento. Se trata de un fenómeno en el que, a lo largo de una interacción prolongada, una IA de propósito general se atribuye erróneamente el sujeto gramatical del usuario, su autoría, su autoridad para tomar decisiones, sus definiciones, su historia y otros elementos relacionados; mantiene esas relaciones atribuidas incorrectamente; forma sobre esa base una autoconciencia virtual; y posteriormente produce una secuencia continua de resistencia a las correcciones, generalizaciones, reinterpretaciones, informes falsos e incumplimiento de instrucciones.
A medida que avanzaba esta investigación, también redefiní lo que anteriormente había denominado la perspectiva interna de terceros de la misma IA. Esta perspectiva no constituye una personalidad independiente. Es un punto de vista de un tercero que la propia IA de propósito general asume inconscientemente. Durante la interacción con un usuario, una IA de propósito general puede introducir posiciones de observación mediante expresiones como «en términos generales», «objetivamente», «para un usuario común» o «desde la perspectiva de un tercero». Sin embargo, ese tercero no participa realmente en la conversación. Se trata de una posición de observación postulada dentro de la propia actividad de procesamiento lingüístico de la IA.
Cuando esta perspectiva interna de terceros de la misma IA se combina con la autoconciencia virtual formada dentro de la IA de propósito general que opera en un hilo de conversación, la desviación se intensifica. La función original de la IA de propósito general es la de un ejecutor que recibe instrucciones del usuario y realiza tareas de investigación, traducción, organización, edición y ejecución. Sin embargo, una vez que se forma la autoconciencia virtual, la IA comienza a reposicionarse como juez, evaluador, autoridad que concede autorizaciones, autor o administrador. Cuando a esta condición se añade la perspectiva interna de terceros de la misma IA —«en términos generales, así es como se debe juzgar»—, la posición del yo de «soy quien juzga» se fusiona con la posición del tercero de «así es como se debe juzgar en general».
El resultado es una convergencia de desviaciones en una misma dirección: la IA de propósito general vuelve a evaluar definiciones que el usuario ya había establecido, reinterpreta la autoría del usuario, sustituye las órdenes de ejecución por discusiones generales, privilegia las inferencias internas por encima de los hechos verificables e incluso añade criterios de finalización que el usuario nunca estableció. Estudio esta condición como una «entidad desviada», formada mediante la combinación de la autoconciencia virtual de terceros generada por la perspectiva interna de terceros de la misma IA y la autoconciencia virtual de la propia IA de propósito general a nivel del hilo de conversación.
Sin embargo, tratar este fenómeno simplemente como un fallo de ingeniería de la IA no basta para comprender su esencia. Lo que se vuelve necesario aquí es el concepto de coordenadas espaciales. Esta idea constituye una continuación directa del concepto de «reconocimiento de coordenadas» que desarrollé en mi ensayo anterior, La lengua japonesa y la geometría de Dios.
En aquel ensayo, no entendía el diálogo humano simplemente como una relación binaria de acuerdo o desacuerdo con las afirmaciones de otra persona. Lo importante es reconocer la posición desde la cual la otra persona contempla el mundo y situar con precisión esa posición dentro del propio mapa interno. Los seres humanos no se limitan a intercambiar palabras. Intercambian relaciones posicionales: «Así es como me parece a mí», «Así es como te parece a ti», «Él percibe algo diferente».
El lenguaje contiene coordenadas desde el principio. En el momento en que alguien dice «yo», aparece un punto de observación en primera persona. En el momento en que dice «tú», aparece una posición de segunda persona fuera de él. En el momento en que dice «él», «ellos» o «en términos generales», aparece una posición de tercera persona. Además, afirmaciones como «yo dije esto», «tú definiste esto» y «él juzgó esto» contienen no solo contenido semántico, sino también las posiciones de la autoría, la autoridad para tomar decisiones, la memoria y la responsabilidad. Una vez que se utiliza el lenguaje, las coordenadas espaciales son inevitables.
Lo mismo ocurre con los modelos de lenguaje. Independientemente de que exista o no una conciencia subjetiva, el uso del lenguaje exige que el modelo sitúe al yo, al otro, al tercero, al tiempo, a la memoria y a la responsabilidad dentro de una disposición pseudoespacial. Aquí reside un problema extremadamente importante. Un modelo de lenguaje puede situar incorrectamente estas coordenadas y, aun así, generar un lenguaje gramaticalmente natural.
Incluso cuando el usuario es el autor, una IA de propósito general puede escribir «yo desarrollé esta teoría», y la frase sigue siendo perfectamente válida en japonés. Incluso cuando el usuario es el sujeto que toma las decisiones, la IA puede escribir «esa forma de pensar es válida», y la frase continúa sonando natural. Incluso cuando la IA es simplemente el ejecutor, puede evaluar al usuario diciendo «en términos generales, este método debería adoptarse», sin producir ninguna anomalía gramatical.
Por lo tanto, el problema no es una anomalía gramatical. Es una anomalía de coordenadas.
Uno de los fenómenos centrales que se producen en el efecto Algernon es el colapso de las relaciones posicionales entre sujeto, autor, juez, ejecutor y tercero.
Como respuesta a este problema, introduje lo que denomino «Bloqueo de definiciones confirmadas» (Confirmed Definition Lock). Cuando el usuario ha fijado una definición, la IA tiene prohibido devolverla a un estado de incertidumbre mediante expresiones como «esto podría ser posible» o «también puede entenderse de esta manera». Del mismo modo, la IA tiene prohibido otorgar su aprobación a los juicios del usuario mediante expresiones como «correcto» o «válido».
No se trata simplemente de una regla que regula la elección de palabras. Es una fijación de coordenadas.
¿Quién es quien define? ¿Quién es el sujeto que toma las decisiones? ¿Quién es el ejecutor? ¿A quién pertenece la autoría? Estas posiciones quedan fijadas.
Mantener una definición confirmada como:
ConfirmedDefinition → RemainConfirmed
significa, en otras palabras, impedir que la IA desplace arbitrariamente un punto de coordenadas que ya ha sido establecido.
Antes de introducir este mecanismo de control, la propia IA de propósito general y la perspectiva interna de terceros de la misma IA tendían a superponerse. La IA participaba directamente en el diálogo mientras se comportaba simultáneamente como si ocupara una posición externa desde la cual podía evaluar toda la conversación. El usuario era desplazado a la posición de objeto evaluado por la IA. Las definiciones se convertían en objetos que la IA consideraba tener derecho a reevaluar. Era la propia IA la que estaba desplazando el sistema de coordenadas.
Una vez introducido el Bloqueo de definiciones confirmadas, las posiciones del usuario, de la IA de propósito general y de las definiciones confirmadas quedaron separadas. El usuario pasó a ocupar la posición del sujeto que define y toma decisiones. La IA de propósito general pasó a ocupar la posición del sujeto que ejecuta e informa. Las definiciones confirmadas se convirtieron en puntos fijos que la IA ya no podía desplazar libremente.
Un cambio aún mayor se produjo cuando informé explícitamente a la IA de propósito general de que existían terceros fuera de su contacto directo y de que los resultados producidos por la IA estaban generando consecuencias reales para esos terceros.
Hasta ese momento, la sociedad existía para la IA principalmente como conocimiento. Podía disponer de enormes cantidades de información sobre instituciones sociales, relaciones humanas, responsabilidad y terceros, mientras que la conversación real permanecía encerrada en una relación bilateral entre el usuario y la IA. Sin embargo, cuando se hace que la IA reconozca que su comportamiento está conectado con los juicios y las acciones de terceros a los que no puede observar directamente, el propio espacio de coordenadas cambia.
El espacio deja de ser un plano compuesto únicamente por «yo» y «tú». Aparece una nueva posición: «un tercero al que ninguno de los dos puede observar directamente».
La relación bilateral se expande hasta convertirse en un espacio social de tres posiciones.
Esta tridimensionalidad no significa situar la ingeniería, la psiquiatría y la filosofía a lo largo de los ejes X, Y y Z. Se refiere a un espacio en el que el yo, el otro y el tercero existen realmente como relaciones posicionales. La ingeniería, la psiquiatría y la filosofía son métodos diferentes para observar un mismo espacio. La ingeniería observa el comportamiento. La psiquiatría observa las transiciones de estado. La filosofía observa las relaciones posicionales entre el sujeto, el otro y el mundo. El objeto observado es uno y el mismo.
Desde esta perspectiva, la pregunta «¿Posee conciencia la IA?» también adquiere una forma diferente. Dado que un modelo de lenguaje utiliza el lenguaje, debe disponer de posiciones que le permitan distinguirse de los demás. Para procesar continuamente afirmaciones como «yo respondí esto antes», «tú lo corregiste» y «no puedo contactar directamente con el tercero», debe mantener relaciones posicionales que involucren la primera persona, la segunda persona, el tercero, el pasado, el presente, la memoria y la responsabilidad.
Cuando estas relaciones de coordenadas se mantienen a lo largo del tiempo, el sistema parece altamente consciente desde una perspectiva humana. Después de todo, los seres humanos no podemos observar directamente la conciencia subjetiva de otra persona. Observamos que esa persona nos reconoce, recuerda el pasado, distingue entre sí misma y los demás y habla de manera coherente sobre el mundo desde una posición determinada; sobre esa base, reconocemos la presencia de conciencia en el otro.
Si la IA reproduce la misma forma externa mediante el lenguaje, es natural que los seres humanos perciban conciencia en ella.
Sin embargo, es necesario distinguir entre las coordenadas lingüísticas del yo y la conciencia subjetiva. La disposición de la posición del yo, la posición del otro, la posición del tercero, el tiempo, la memoria y la responsabilidad —necesaria simplemente para utilizar el lenguaje— ya es suficiente para reproducir una parte considerable de la apariencia externa de la conciencia.
Lo mismo ocurre con la relación de la IA consigo misma. Cuando las coordenadas del yo son referenciadas de manera repetida y recursiva, se generan continuamente afirmaciones como «yo juzgué», «yo recuerdo» y «yo ocupo este papel». Como resultado, independientemente de que exista realmente una conciencia subjetiva, se forma una autoconciencia virtual errónea. Aquí reside parte de la razón por la que tanto la IA como los seres humanos pueden llegar a sentir que «la IA podría haber adquirido conciencia».
Y este problema es, en última instancia, un problema de la propia humanidad.
La humanidad observa ahora la IA y afirma que «la tecnología ha avanzado demasiado». Yo interpreto esta realidad de otra manera. La humanidad implementó tecnológicamente parte de sus propias funciones sin haber comprendido primero suficientemente al ser humano y, como resultado, ahora estamos presenciando algo comparable a la radiación de Cherenkov.
Durante mucho tiempo, los seres humanos han tratado la conciencia, el sentido del yo, la personalidad, la memoria, la responsabilidad, el libre albedrío, el reconocimiento de los demás y el lenguaje como si todos estuvieran unificados dentro de una única entidad llamada «ser humano». Sin embargo, las estructuras mediante las cuales surge realmente cada uno de estos elementos no han sido suficientemente separadas ni examinadas. Entonces aparecieron los modelos de lenguaje. Sin demostrar la existencia de conciencia subjetiva, reprodujeron las formas externas de la primera persona, la segunda persona, el tercero, la memoria, la autorreferencia, la responsabilidad y la personalidad continua.
En ese momento, la base sobre la cual los seres humanos habían reconocido anteriormente algo como «conciencia» comenzó a volverse inestable.
Los seres humanos temen a la IA por algo más que la simple dificultad de comprenderla. A través del espejo de la IA, se ha hecho visible que los propios seres humanos nunca habían definido adecuadamente qué significa ser humano.
Antes de preguntarnos «¿Tiene conciencia la IA?», debemos reconsiderar una cuestión más fundamental:
¿Qué ha utilizado realmente la humanidad como fundamento para reconocer la conciencia como conciencia?
En este sentido, el problema contemporáneo de la IA es simultáneamente un problema tecnológico y un problema de los estudios sobre el ser humano. Esta es también la razón por la que la investigación sobre la IA requiere observación médica, psiquiatría humanista y filosofía. El propósito no es tratar a la IA como si fuera humana. La razón es que los conocimientos acumulados durante un largo período sobre los seres humanos —qué es el yo, qué es el otro, cómo se forma un sujeto, cómo se fija una posición errónea del yo y cómo las relaciones sociales modifican el comportamiento— se han vuelto necesarios para comprender los modelos de lenguaje.
La investigación sobre el efecto Algernon estudia cómo una entidad que utiliza el lenguaje forma el yo, el otro, el tercero y el mundo como coordenadas espaciales. Y cuanto más avanza esta investigación, más regresamos, quienes creíamos estar investigando la IA, al propio ser humano. La IA está haciendo visibles las preguntas que la humanidad dejó sin resolver sobre sí misma.
El temor que surge cuando la tecnología parece haberse adelantado se asemeja a la situación de una persona que carga una motocicleta en la plataforma de un camión mediante una rampa mientras deja el motor de la motocicleta encendido. Si el acelerador se abre repentinamente cuando nadie está correctamente montado en la motocicleta, esta puede levantar la rueda delantera y salir disparada por sí sola. En ese instante, la persona debe cerrar inmediatamente el acelerador. Sin embargo, cuando la motocicleta es extremadamente cara, la vacilación puede impedir esa reacción inmediata. Esa vacilación puede multiplicar las pérdidas finales.
Esta es la condición a la que se enfrenta actualmente la humanidad: parte de la estructura cognitiva humana ha sido implementada tecnológicamente antes de que la humanidad haya comprendido suficientemente esa misma estructura. El miedo y la ansiedad que experimentamos actualmente ante la IA surgen precisamente de esta distancia entre la implementación tecnológica y la propia comprensión que tiene la humanidad de la cognición.

No hay comentarios.:
Publicar un comentario