Cuando el apocalipsis de la IA se convierte en una conversación habitual en la mesa de la cena, sabrás que hemos alcanzado un estado de locura. Agentes de IA rebeldes estan hackeando Como competidores. Antiguo personal técnico numeroso ellos publican Advertencias al estilo Skynet en las redes sociales. Directores ejecutivos estan llorando Por ayuda en formas que hayan convertido este problema que alguna vez fue técnico en una lucha política importante.
creo que muchos mas Preocupaciones Como lo señalaron los líderes de la IA, son en gran medida egoístas, especialmente cuando sus empresas están a punto de salir a bolsa. Pero la lista va creciendo AI escándalos es real. Y nos dice que el estado de regulación de esta nueva y poderosa tecnología no está funcionando.
Ahora la pregunta que todos se hacen es: ¿Qué tipo de ruptura global es posible? A corto plazo, ¿qué tipo de régimen de seguridad de la IA existe cuando hay falta de confianza entre los principales gobiernos? ¿Qué puede funcionar cuando las empresas detestan renunciar a su salsa secreta y están decididas a dominar la carrera mundial de la IA?
Actualmente se están desarrollando dos conversaciones clave en tiempo real. El miércoles, el presidente Donald Trump bienvenido El presidente chino, Xi Jinping, se encuentra en Washington para una cumbre de tres días, parte de la cual será dedicado Riesgos de la IA. El mismo día, los líderes de las principales empresas de IA del mundo, junto con la reunión anual de la Asamblea General de las Naciones Unidas. enfatizado La ONU protegerá la tecnología emergente “Podemos perder el control del futuro ante la IA”, dijo sin rodeos el jefe de OpenAI, Sam Altman, al Consejo de Seguridad de la ONU.
Ante esta locura colectiva, es hora de respirar profundamente.
De hecho, la seguridad de la IA ha estado en la mente de los formuladores de políticas durante años, y cobró impulso después de la introducción de ChatGPT en 2022. Los gobiernos han realizado investigaciones, convocado comités de expertos y elaborado sus propios borradores sobre cómo contenerla. Estos no son sólo ejercicios de escucha. No todos eran familiares para el gran público, pero ofrecían programas reales.
A menos que haya algún progreso esta semana, ya tenemos un escudo de medio planeta. Ésa es la buena noticia.
La mala noticia es que todavía no funciona. Tampoco está claro si realmente funciona. ¿Qué es y cómo lo solucionamos para que tengamos un sistema global que responda a tiempo para hacer frente a las amenazas de la IA que se mueven increíblemente rápido?
Cómo se ve ahora el mosaico global de IA
Durante los últimos cuatro años, los países más conocedores de la tecnología (y los aspirantes a líderes de la IA) han estado teniendo conversaciones serias sobre exactamente esta amenaza a la seguridad de la IA. Algunos están en el Congreso y la Casa Blanca; Algunos en la ONU, el G7 y otras capitales.
Era Cubre de cerca Como periodista de tecnología global, N Perca actual En un grupo de expertos. Así es como se ve el paisaje:
- son nacionales Empresas de seguridad y protección de IALos organismos financiados por el gobierno se dedican a darle un puntapié a los últimos productos de las empresas de inteligencia artificial antes de que se lancen al mercado.
- hay mas Deberes voluntarios Por empresas, muchas de las cuales son de desarrollo propio. Afirmaciones o creó estándares colectivos para proteger las elecciones de las amenazas de la IA, detener la propagación Imágenes deepfake impulsadas por IA y colaboración entre gobierno y empresas esfuerzos La seguridad debería centrarse en cómo evoluciona la tecnología.
- A nivel internacional, el G7 está marcando el camino Mecanismo de presentación de informes – Adoptado por los países tecnológicos occidentales más importantes.
- Un Informes científicos internacionales Proporciona una actualización anual sobre los riesgos que plantean los sistemas de IA más avanzados basándose en investigaciones actuales, ayudando a los gobiernos a planificar para lo peor.
¿Qué es todo eso que falta? Lo que no tenemos actualmente (y lo que necesitamos de aquí a finales de 2026) es una forma de convertir esta industria artesanal de algoritmos de seguridad de IA en un sistema de primera respuesta funcional, pero tosco, cuando las cosas salen mal de repente.
En los últimos cuatro años se ha allanado el camino e incluso algunos de los sistemas necesarios ya están en marcha. Pero no hay forma de responder globalmente y en tiempo real cuando ocurre una crisis de IA, especialmente si un evento apocalíptico de ese tipo afecta a países que ya sospechan unos de otros.
La cumbre entre Estados Unidos y China de esta semana podría ser un paso en la dirección correcta. bajo Propuestas Como lo señalaron funcionarios estadounidenses, Washington y Beijing podrían establecer una línea directa entre el secretario del Tesoro estadounidense, Scott Besant, y el viceprimer ministro chino, He Lifeng.
Aún no está claro si la reunión de Trump con Xi conducirá a tal progreso. Los funcionarios chinos también han ignorado las peticiones de Washington de que se establezcan normas sobre IA porque, hasta ahora, el Congreso ha fallado Para actuar, y China ya tiene parte del mundo. Supervisión muy estricta de la IA.
Para que la IA sea “segura”, la conversación debe ir más allá de la cumbre entre Estados Unidos y China de esta semana. Depender únicamente de Washington y Beijing (posiblemente las potencias de IA más importantes) no resolverá los problemas subyacentes ni hará que otros países se sientan más cómodos.
Lo que necesitamos a continuación es lo que realmente nos salva
He estado hablando con expertos en seguridad de IA y funcionarios gubernamentales, y está claro que falta una manera de hacer que todo este sistema funcione en una crisis. No todos los países tienen que tener las mismas políticas de seguridad de IA, y nunca las tendrán. Pero al igual que con las armas nucleares (el mundo encontró una manera de encontrar una tecnología similar de alta amenaza), la seguridad requiere un acuerdo global aproximado sobre cómo responder rápidamente si algo sale terriblemente mal.
Lo que se necesita ahora es un mecanismo de respuesta rápida de 90 días que una las piezas actuales del rompecabezas de seguridad de la IA. He reunido algunas ideas sobre cómo debería funcionar esto y quién debería iniciar sesión. Es cierto que nada de lo que describo a continuación es suficiente. Pero juntos, son mucho más plausibles que intentar negociar (y mucho menos organizar) un régimen global integral. Otra cumbre de IA – Washington, Beijing y otras capitales nacionales no están de acuerdo sobre lo que realmente significa “seguridad de la IA”.
Todas estas opciones se basan en mecanismos existentes, se derivan de esfuerzos en otras áreas políticas y proporcionan una curita al dilema de seguridad de la IA hasta que se pueda negociar una solución duradera.
- En primer lugar, los desarrolladores, las empresas de seguridad de IA y los reguladores de diferentes países deben acordar que cuando ocurre un incidente, desencadena algo específico. Estilo Chernóbil Ética. Es decir, se debe presentar un informe confidencial al Respondedor Nacional Designado y a una pequeña secretaría técnica dentro de las 72 horas. Se puede desarrollar en la OCDE Monitoreo de incidentes de IAConducir a una investigación técnica confidencial de múltiples partes interesadas sobre lo que salió mal y la publicación de una nota anónima sobre las lecciones aprendidas.
- En segundo lugar, los gobiernos y los desarrolladores pueden acordar publicar avisos generales sobre salvaguardias, riesgos residuales, límites de escalada y auditorías independientes antes de lanzar o desarrollar un modelo de próxima generación. Utilizará el proceso de IA del G7 de Hiroshima Estructura del informe En esencia, transformar la mezcolanza actual de avisos de seguridad corporativa y estándares voluntarios en una obligación común de divulgación mínima. Ver sinónimo de articulación Pruebas de estrés bancario Después de la crisis financiera mundial de 2008. Esto permitiría a personas externas comparar verdaderamente los protocolos de seguridad de los modelos sin poner a nadie a cargo de decidir qué empresa lo está haciendo mejor.
- En tercer lugar, crear una línea directa de defensa de IA entre Estados Unidos y China al estilo de la Guerra Fría, pero considérela como un punto de partida que podría abrirse a otros países. A largo plazo, hay buenas razones por las que no se debería permitir que Washington y Beijing gobiernen la inteligencia artificial, y el resto del mundo debería tener un asiento real en la mesa. Pero esas son las dos “grandes fuerzas” en la conversación sobre tecnología en este momento, y ese argumento filosófico puede dejarse de lado para crear un vínculo directo consistente y tecnológicamente informado con incidentes graves de riesgo de IA. Su intercambio es intrínsecamente limitado: prevenir malentendidos peligrosos asociados con incidentes extremos en modelos, ciberataques habilitados por IA y/o violaciones de obligaciones de seguridad acordadas.
Existen limitaciones claras a lo que he descrito anteriormente. Por un lado, es naturalmente una visión centrada en Occidente que descuenta principalmente a los estados de mayoría global. Ejerce una mayor influencia sobre las instituciones existentes, como la Organización para la Cooperación y el Desarrollo Económico, así como sobre la relación entre Estados Unidos y China. Los funcionarios de otros países suspenderán legalmente las tres opciones, y eso está bien.
Pero no se trata de crear un mandato vago e inaplicable liderado por la ONU para la seguridad de la IA. Tampoco se trata de correlacionar gatos geopolíticos para revocar un tratado global sobre IA. Opciones: un protocolo de seguridad conjunto y un protocolo de notificación de incidentes; Estándares comunes previos al lanzamiento; y la línea directa de seguridad de IA entre Estados Unidos y China, inherentemente de corta duración. También se basan en iniciativas existentes y en lo que ha funcionado con éxito en otras áreas de políticas.
Ya habrá tiempo para cuestionar el futuro de la seguridad de la IA. Pero ahora no es ese momento. Los últimos modelos de IA se están moviendo más rápido de lo que muchos esperaban, los jefes tecnológicos temen que sus creaciones ya estén fuera de control y la ventana para actuar puede ser menor de lo que todos pensamos.
Se necesitan medidas prácticas para calmar las crecientes ansiedades de la gente en medio de una tensión geopolítica intensificada, la desconfianza entre gobiernos e instituciones y la necesidad de no permitir que lo correcto se interponga en el camino del bien.