Se han hecho varios llamados últimamente en columnas y artículos abogando por una inteligencia artificial “más ética”. Pero rara vez los autores de esos llamamientos hacen explícito sus propios compromisos éticos. Esto es, no nos dicen a “qué ética” se refieren. Probablemente piensan que la eticidad de la IA es algo que se consigue insertando en sus códigos y algoritmos varios “principios éticos”, dejando luego que la IA misma discrimine entre ellos. Eso es al menos lo que hacemos los seres humanos: en un escenario en el que hay principios en conflicto (y rara vez un escenario éticamente relevante no pone principios en conflicto), nos comprometemos con uno y lo adoptamos como máxima para decidir un curso de acción. Quizás aquellos que abogan por una IA más ética piensan que la IA es capaz de adoptar los mismos compromisos. Pero entonces surge inmediatamente el, así llamado, “problema de la alineación”, pues, ¿cómo sabemos si una IA autónoma se comprometerá con los mismos principios éticos con los que sus usuarios están comprometidos?
Suponga que le pedimos a una IA que decida en el escenario del dilema del tranvía: un tranvía se dirige a toda velocidad por un riel y matará a cinco personas a menos que la IA active una palanca que desvía el tranvía, caso en el cual este mata solo a una persona. La ética no tiene una respuesta definitiva a este dilema. Lo que nos ofrece son principios con los que los seres humanos tenemos que comprometernos si es que nos toca decidir. Un kantiano optaría por dejar correr el tranvía en la dirección de los cinco, porque no puede decidir sobre la vida de otro ser humano, mientras que un utilitarista activaría la palanca, porque obviamente matar a uno es menos malo que dejar morir a cinco.
¿Qué debe hacer la IA? La pregunta es curiosa porque abordarla depende en parte de determinar si estamos tratando con un agente autónomo o no. Si la IA es un agente completamente autónomo, entonces debe hacer lo mismo que nosotros, comprometerse con algún principio ético. Es razonable asumir que será eventualmente posible (en caso que no lo sea ya), escribir en el código de la IA la idea de “compromiso”, esto es, la idea de que en ciertos escenarios límite la decisión que hay que tomar es difícil, de modo que puede ser que la decisión misma del agente, adoptada responsablemente, sea en parte lo que la hace la decisión “correcta”. Si, por otro lado, la IA no es completamente autónoma, entonces los humanos somos los que tenemos que comprometernos con un principio ético y luego escribirlo en el código de la IA para asegurarnos que esta decida siguiendo ese principio en todos los casos similares.
Cualquiera de las dos IA es capaz de tomar decisiones éticas. Pero solo la IA que decide sobre la base de principios éticos que nosotros le hemos insertado mantiene el problema de la alineación a raya. Una IA completamente autónoma también puede decidir éticamente, pero si le damos esa libertad no podemos reclamar después contra una de sus decisiones solo porque nuestros compromisos éticos son distintos. Para entonces la IA ya tendrá perfectamente claro que respecto de la ética hay amplio desacuerdo, y aunque nosotros queramos decidir el dilema del tranvía como kantianos, la IA autónoma siempre podrá responder “pero yo soy utilitarista”.
Los llamados a hacer la IA “más ética” son vacíos si no explican cómo debemos enfrentar los desacuerdos éticos y los conflictos entre principios. Hacer que la IA decida éticamente no es un desafío: el desafío es lograr “alineación” entre la ética de la IA y la humana, de modo de evitar la “alienación” entre IA y humanos.