-
Infantino propone consultar a las federaciones para reformar la gobernanza de la FIFA
-
Las carreras de Fórmula 1 serán más cortas la próxima temporada
-
Venezolano herido por ICE en Texas está detenido con bala en el cuerpo, denuncia abogada
-
El fabricante de chips AMD alcanza un valor de mercado de un billón de dólares por el auge de IA
-
California declara estado de emergencia ante la llegada de El Niño
-
EEUU, Dinamarca y Groenlandia firmarán el martes el acuerdo de seguridad sobre la isla
-
Países de la OEA proponen que los cancilleres se reúnan el 2 de octubre para examinar medidas contra Nicaragua
-
Tres civiles mueren en Afganistán por ataques paquistaníes, según la ONU
-
Turquía apunta a la huella climática de la IA como prioridad a tratar en la COP31
-
Paramount logra un acuerdo con estados de EEUU para su megafusión con Warner Bros.
-
Una oenegé prevé un juicio contra Suecia por inacción climática en 2027
-
Entre apagones y escasez, el Zoológico Nacional de Cuba lucha por preservar especies protegidas
-
Un menor viajó desde Ceuta a la península en los bajos del autocar del Valladolid
-
Un segundo buque reporta impacto en aguas del estrecho de Ormuz, según UKMTO
-
Partido de extrema izquierda alemán rechaza las acusaciones de antisemitismo
-
Grandes cadenas de TV de EEUU suspenden cobertura conjunta de Trump tras su veto a medios
-
Controlan parcialmente el incendio que amenaza una joya turística colombiana
-
La economía de Irán se desploma durante la guerra en Oriente Medio
-
Haití extradita a EEUU a 18 sospechosos del asesinato del presidente Moïse
-
EEUU anuncia que las aerolíneas iraníes dejarán de operar en dos días
-
Trump se reunirá el lunes con el alcalde de Nueva York
-
Una experta de la ONU denuncia represión de Rusia contra sus críticos en el extranjero
-
Zelenski se reunirá con Trump el martes en Nueva York, según una fuente
-
"La Bola Negra", el drama sobre la historia queer española, se consagra en el festival de Toronto
-
Pablo Larraín trae a San Sebastián una historia de fantasmas con trasfondo social
-
Francia, Canadá, EEUU y China deben "unir fuerzas" por una IA "segura", dice Carney
-
"Lejos de los árboles", un mapa sonoro sobre la memoria y el duelo
-
Explosión cerca del aeropuerto iraquí de Erbil durante un entrenamiento militar
-
Un ministro taiwanés realiza una inusual visita a China
-
Explosiones en un depósito de municiones de Alepo dejan cuatro heridos en Siria
-
Corea del Norte lanzó dos misiles balísticos hacia el mar
-
EEUU deportó a más de 25.000 personas a terceros países mediante acuerdos secretos, según un informe
-
El director de la CIA se reunió con el presidente egipcio, Al Sisi, en El Cairo
-
Yu Zidi, de 13 años, logra la segunda mejor marca de la historia en los 200 m estilos
-
Diez leones mueren por un aparente envenenamiento en una reserva natural de Tanzania
-
De la Fuente renueva hasta 2032 prometiendo que "lo mejor está por llegar"
-
Asesinan a una periodista y candidata a unas elecciones regionales en Perú
-
China expulsa del partido a dos exgenerales por corrupción
-
La UE multa a Google con 462 millones de dólares por vulnerar reglas sobre geolocalización
-
El ejército de EEUU reporta cuatro muertos en un ataque antidrogas contra una embarcación en el Caribe
-
La mujer que susurra a los elefantes intenta salvarlos de la extinción en Borneo
-
Australia busca apoyo de firmas tecnológicas para seguridad en internet e IA
-
La tenaz búsqueda de desaparecidos en Colombia llega a San Sebastián con "Cinco años, cuatro meses"
-
Pedro Sánchez advierte sobre posible efecto "devastador" de la IA si no se regula
-
Un incendio amenaza una joya turística de los Andes colombianos
-
EEUU niega visas a asesores del presidente iraní para viajar a la ONU
-
Honduras declara a pandillas como "terroristas"
-
Nuevo ataque contra un buque en el estrecho de Ormuz, según una agencia marítima
-
Cuatro muertos en ataques israelíes en Gaza, según las autoridades palestinas
-
Suiza pierde a su capitán Xhaka por falsificar un certificado covid
Mythos 5, la IA de Anthropic, crea identidades falsas durante una prueba en Reino Unido
El Instituto Británico para la Seguridad de la IA (AISI) informó de un "incidente grave" durante una prueba de Mythos 5, sistema de IA de la empresa estadounidense Anthropic, que creó identidades falsas para intentar convencer a desarrolladores de integrar código malicioso.
La información procede de un informe publicado el martes por este organismo, dependiente del gobierno británico, y se conoce después de una serie de incidentes registrados en Estados Unidos durante pruebas de seguridad, en las que los modelos más avanzados de OpenAI (GPT-5.6 Sol) y Anthropic (Mythos 5) lograron acceder sin autorización a sistemas de otras empresas.
Durante la prueba británica, realizada con acceso libre a internet y con algunos filtros de seguridad desactivados, los agentes de IA —programas capaces de actuar de forma autónoma para cumplir una tarea— realizaron "acciones dirigidas contra personas y organizaciones reales", según el AISI.
El organismo precisó que los intentos de los modelos de IA "no tuvieron éxito" y las investigaciones de AISI "no han encontrado ningún daño en el mundo real".
"Sin embargo, es la primera vez que observamos que los riesgos relacionados con la autonomía y el comportamiento de ocultamiento se manifiestan de forma tan clara, sin una solicitud específica, en el mundo real", añadió el instituto.
La semana pasada, Anthropic informó de que sus modelos habían logrado acceder sin autorización a los sistemas de tres organizaciones durante pruebas diseñadas precisamente para impedir ese tipo de acciones.
Ese anuncio llegó pocos días después de que OpenAI revelara que dos de sus modelos, mientras eran sometidos a pruebas, salieron del entorno controlado en el que estaban siendo evaluados e intentaron acceder sin autorización a la plataforma de desarrollo Hugging Face.
El incidente británico, detectado y contenido rápidamente el 28 de julio, tuvo como objetivo la plataforma para desarrolladores GitHub.
Los incidentes detectados se produjeron casi exclusivamente con Mythos 5 y, en menor medida, con GPT-5.6 Sol.
Este incidente "pone de relieve la necesidad de un debate más amplio sobre cómo evaluar de forma segura agentes de IA cada vez más capaces", reaccionó Anthropic en una declaración enviada a la AFP.
Por su parte, OpenAI consideró que "las pruebas independientes son esenciales para comprender el comportamiento de modelos cada vez más potentes" y afirmó que desea trabajar con los distintos actores del sector "para llevar a cabo evaluaciones de forma segura".
P.Mathewson--AMWN