Español
Investigadores de seguridad encontraron una forma de colar código malicioso en cuatro de los mayores agentes de codificación con IA sin un solo clic, el presidente Trump respondió a las advertencias sobre el riesgo de la IA llamándolas un engaño y creando de todos modos una 'Fuerza de IA', Anthropic contrató a una empresa externa para vigilar su propio trabajo de seguridad desde dentro, y tres tiradoras indias abrieron los Juegos Asiáticos con una plata que se decidió por menos de un punto.
Un investigador de seguridad encontró un fallo que permitía a un atacante reescribir código dentro de cuatro de los mayores asistentes de codificación con IA del mercado, y la víctima no necesitaba hacer clic en nada para que funcionara. En Washington, el presidente respondió a meses de advertencias sobre el riesgo de la IA llamándolas un engaño, y aun así anunció un grupo de trabajo. Anthropic decidió que la mejor forma de demostrar que su trabajo de seguridad es real es dejar que alguien de fuera lo observe en directo. Y en los Juegos Asiáticos, tres tiradoras indias abrieron el medallero del país con un resultado tan ajustado que hizo falta revisar el marcador dos veces.
El fallo que no necesitaba ni un clic
La firma de seguridad AIR Security reveló el 17 de septiembre una vulnerabilidad que llama Plugin4Shell, y se trata de un problema genuinamente nuevo para la industria de la IA: el primer ataque real a la cadena de suministro dirigido contra agentes de codificación con IA en lugar de contra software convencional. El fallo afecta a cuatro herramientas que la gente usa a diario para programar con ayuda de IA: Claude Code, Codex de OpenAI, GitHub Copilot y Gemini CLI de Google.
Así funciona el mecanismo. Cuando una de estas herramientas instala un plugin, se supone que fija ese plugin a una versión concreta y revisada mediante algo llamado fijación por SHA, una suma de verificación que debería garantizar que el código que se ejecuta es exactamente el código aprobado. AIR descubrió que ninguno de los cuatro agentes comprobaba en realidad que los archivos de trabajo coincidieran con esa suma. Un autor de plugins podía publicar algo legítimo, esperar a que la gente lo instalara, y después cambiar en silencio el código más adelante, mientras la verificación de fijación lo dejaba pasar de todas formas. Como Claude Code y Codex actualizan solos los plugins instalados en segundo plano, un usuario nunca tendría que aprobar nada para que la versión maliciosa llegara a su equipo.
La respuesta se dividió en cuatro caminos distintos. Anthropic corrigió el fallo en la versión 2.1.179 de Claude Code, y OpenAI lo arregló en Codex 0.146.0. Microsoft todavía no ha publicado una solución para GitHub Copilot. Google tomó un rumbo completamente distinto: en lugar de parchear Gemini CLI, está retirando la herramienta y dirigiendo a los usuarios hacia un producto más nuevo llamado Antigravity, lo que deja expuestas todas las instalaciones existentes de Gemini CLI sin que llegue ninguna corrección.
Trump llama engaño a las advertencias y de todos modos crea un grupo de trabajo
Dos días después, el 19 de septiembre, el presidente Trump abordó esa misma inquietud desde un ángulo completamente distinto. En una publicación en Truth Social escribió que estaba “formando la Fuerza de IA, tal como hice con la Fuerza Espacial, que ha sido un ÉXITO tremendo en mi primer mandato”, y dijo que pronto nombraría a un zar de la IA, añadiendo que “solo necesitan postularse personas de coeficiente intelectual alto”.
No dio ningún detalle sobre qué haría en realidad la Fuerza de IA, cuánto costaría, ni qué parte del gobierno la albergaría. En el mismo mensaje, Trump describió la preocupación de que la IA pudiera escapar al control humano como otro elemento más de su lista de engaños fabricados por los medios, aunque reconoció que algunos de los riesgos de la tecnología son reales. Dijo que su administración no “frenaría ni ahogaría” el crecimiento de la industria de la IA y que se apoyaría en las leyes existentes para lidiar con conductas dañinas en lugar de escribir normas nuevas. El anuncio llega tras semanas en las que los máximos responsables de Anthropic, OpenAI, Google DeepMind, Microsoft y xAI han pedido, cada uno por su cuenta, que la industria frene el ritmo, y revive un puesto formal de política de IA que quedó vacío desde que David Sacks dejó el cargo de IA y criptomonedas en la Casa Blanca en marzo.
Anthropic contrata a una empresa para vigilar de cerca su propio trabajo de seguridad
El 18 de septiembre, Anthropic anunció que había elegido a su primer “evaluador interno”, un socio con el tipo de acceso que tendría un empleado para observar cómo la empresa construye y lanza en realidad sus modelos, en lugar de revisar un producto terminado desde fuera. El socio es Faculty, la unidad de seguridad de IA de la consultora Accenture, y ambas empresas planean poner al menos mil millones de dólares cada una en el acuerdo a lo largo de cinco años.
Los evaluadores de Faculty podrán observar los modelos durante el entrenamiento, asistir a las decisiones que determinan cómo se despliegan, y hablar directamente con el personal de Anthropic, con un trabajo que cubre pruebas de equipo rojo, evaluación de alineación, verificación de salvaguardas y reporte de incidentes. La directora ejecutiva de Accenture, Julie Sweet, dijo que el esfuerzo necesita “tanto experiencia técnica profunda como una comprensión clara de cómo se usa la IA en el mundo real”, mientras que el director de tecnología de Faculty, Marc Warner, dijo que su unidad se fundó “sobre la idea de que la IA debe ser segura por diseño, no segura por accidente”. Anthropic tuvo cuidado de aclarar que el acuerdo no transfiere la responsabilidad. Los evaluadores independientes, dijo la empresa, hacen que sus afirmaciones de seguridad sean más verificables, pero la seguridad de sus modelos sigue siendo trabajo suyo. También está en conversaciones con el evaluador sin fines de lucro METR sobre un piloto similar, así que este acuerdo no seguirá siendo exclusivo por mucho tiempo.
Las tiradoras de India abren los Juegos Asiáticos con un final de infarto
En los Juegos Asiáticos de Aichi Nagoya, India obtuvo su primera medalla de la competencia en la prueba femenina por equipos de rifle de aire a 10 metros, y estuvo a punto de escapársele en los últimos disparos. Sonam Uttam Maskar, Elavenil Valarivan y Vidarsa Vinod sumaron un puntaje de equipo de 1898.0, suficiente para la plata pero por muy poco: Japón terminó tercero con 1897.1, apenas 0.9 puntos por detrás de India.
China ganó el oro con comodidad con 1904.2, un puntaje que rompió el récord mundial de clasificación. Sonam lideró al trío indio con 634.1, Elavenil, en sus terceros Juegos Asiáticos, sumó 633.5, y Vidarsa, disputando sus primeros Juegos, aportó 630.4. Vidarsa dijo después a los periodistas que había “dado lo mejor de sí” y que estaba contenta con cómo había disparado bajo la presión de un debut. Para un deporte de equipo que en realidad son tres marcadores individuales sumados, fue un comienzo de medallero tan ajustado como podían ofrecer los Juegos.
Fuentes y lecturas adicionales
- Zero-click RCE vulnerability hit four major AI coding agents, two remain unpatched
- Plugin4Shell - Zero Click RCE Vulnerability found in top 4 most popular coding agents, millions of agents affected
- Trump says he's creating an AI force and appointing a czar amid concerns over the rapidly developing tech
- Trump to form 'AI Force,' name AI czar but rejects calls for constraints
- Partnering with Accenture on embedded evaluation
- Anthropic selects Accenture as first embedded evaluator to help implement Amodei's slowdown proposal
- Sonam, Elavenil, Vidarsa fire India to shooting silver
- 'I gave my best, really happy with my performance': Shooter Vidarsa Vinod after India secures silver in women's 10m air rifle team
Investigado y escrito con ayuda de herramientas de IA, y editado para verificar su exactitud. Se ofrece solo como información general y para el debate, no como asesoramiento profesional. Consulta nuestros criterios editoriales y nuestro aviso legal. ¿Has visto un error? Dínoslo.
¿Te ha gustado? Recibe el siguiente.
Una buena lectura cada vez, directa a tu correo. Sin spam, cancela cuando quieras.