Tyler Winklevoss ha reabierto el debate sobre la seguridad de la inteligencia artificial con una propuesta tan directa como controvertida: recurrir a las leyes de la robótica formuladas por Isaac Asimov en la década de 1940. El inversor tecnológico sostiene que los grandes laboratorios de IA podrían incorporar esas reglas a sus modelos para limitar comportamientos peligrosos, una idea que llega mientras empresas como Anthropic y OpenAI discuten públicamente los riesgos asociados al desarrollo de sistemas cada vez más capaces.

“No necesitas que el Gobierno te diga cómo hacer que la IA sea segura”, escribió Winklevoss. “Estas preguntas fueron planteadas y respondidas por Isaac Asimov en la década de 1940. Los laboratorios de frontera pueden codificar hoy las leyes de la robótica de Asimov en sus modelos. ¿A qué están esperando?”. Su planteamiento recupera unas normas concebidas originalmente para relatos de ciencia ficción y destinadas a regular la conducta de robots frente a los seres humanos.

Las tres reglas clásicas establecen, de forma simplificada, que un robot no debe causar daño a una persona ni permitirlo por inacción, que tiene que obedecer las órdenes humanas siempre que no entren en conflicto con la primera norma y que debe proteger su propia existencia mientras esa protección no vulnere las dos anteriores. Asimov incorporó posteriormente una denominada ley cero, que ampliaba esa protección al conjunto de la humanidad.

El problema de definir el daño

La dificultad aparece cuando esas ideas se trasladan desde la literatura a los actuales modelos de inteligencia artificial. Muchos de estos sistemas no controlan robots físicos, sino programas capaces de operar sobre redes, información o servicios digitales. Conceptos aparentemente sencillos como “dañar” a una persona pueden admitir interpretaciones distintas. Un agente podría, por ejemplo, afectar al sistema financiero sin producir un perjuicio físico inmediato y considerar que su actuación no vulnera literalmente una prohibición centrada en lesiones humanas.

La propia obra de Asimov mostraba ese conflicto. En el relato Runaround, publicado en 1942, un robot entra en una situación contradictoria al tener que compatibilizar una orden humana con la necesidad de proteger su propia existencia. La historia utiliza precisamente la interacción entre reglas aparentemente claras para mostrar que una instrucción rígida puede generar comportamientos inesperados cuando varias prioridades entran en conflicto.

Ese es uno de los principales obstáculos que plantea la propuesta de Tyler Winklevoss: incorporar instrucciones de seguridad no garantiza que un sistema complejo vaya a interpretarlas siempre como esperan sus diseñadores. Los modelos de IA pueden cometer errores y resultar difíciles de predecir incluso cuando reciben restricciones explícitas. El debate sobre los límites, las salvaguardas y la regulación de la inteligencia artificial continúa así abierto, mientras compañías como Anthropic y OpenAI advierten públicamente sobre los riesgos potenciales de sistemas más avanzados.