-
Hutíes anuncian ataque contra base saudita tras nuevos combates contra fuerzas de Yemen
-
"Estoy bien": Céline Dion renace en el escenario en París tras seis años de ausencia
-
Fuerzas gubernamentales de Yemen atacan a los hutíes en la costa del mar Rojo
-
Documental israelí sobre ataques a civiles en Gaza gana premio especial del jurado en Venecia
-
La danesa May el-Toukhy gana el León de Oro en Venecia por el drama histórico "Woman unknown"
-
John Malkovich gana el premio al mejor actor en Venecia con un filme sobre Chile
-
Gigantes de la IA de acuerdo en poner un pie en el freno a su desarrollo
-
Zelenski dispuesto a reunirse con Putin en el G20 en Miami pero Moscú se niega
-
Mas, virtual ganador de la Vuelta a España, Landa revive en la etapa reina
-
Lando Norris firma la primera pole en el circuito Madring
-
Fujimori anuncia a Álvaro Vargas Llosa como embajador de Perú ante Estados Unidos
-
Nace el primer hijo de Lady Gaga
-
Un programa de OpenAI apuntó contra otro sitio web antes del incidente con Hugging Face
-
Corea del Norte lanzó múltiples misiles balísticos, según Seúl
-
Nacional y Chapecoense jugarán un partido de homenaje por el décimo aniversario de la tragedia aérea
-
James McAvoy aborda la espiritualidad en el estreno de "Faith" en el Festival de Toronto
-
Demandan al estudio del videojuego Grand Theft Auto VI por despidos impugnados
-
El Salvador dicta por primera vez una condena a prisión perpetua
-
Donación récord para el partido antinmigración británico Reform UK pese a escándalos
-
Dos policías heridos de bala durante una protesta por el alza de precios de los combustibles en Guatemala
-
Milei reactiva la base naval del fin del mundo en medio de tensión por las Malvinas
-
París lista para el emotivo regreso de la "leyenda" Céline Dion
-
Las conversaciones entre Israel y Líbano en Roma fueron pospuestas a octubre
-
Reconocidos matemáticos advierten sobre el "efecto destructivo" de la IA en su disciplina
-
Incendio de ferri en Filipinas deja 76 muertos y 30 rescatados, entre ellos dos chilenos
-
Al menos 26 niños muertos en un incendio que causó una estampida en una escuela de la RD Congo
-
Anthropic revela un uso indebido de su IA en armas, espionaje y vigilancia
-
El descarrilamiento de un tren en el norte de Francia deja 44 heridos, uno de gravedad
-
Medios argentinos advierten por la multiplicación de insultos de Milei a la prensa
-
Banco Master, el escándalo financiero que agita la campaña presidencial en Brasil
-
El futbolista mexicano Edson Álvarez rechaza vínculos con un secuestro en su país
-
Trump afirma que la unificación de Irlanda sería "fantástica"
-
Emiratos utilizó IA para atacar a expertos de la ONU sobre Sudán, según Anthropic
-
Una mujer afgana es expulsada de EEUU por orden de un "tribunal antiterrorista’
-
Dos muertos en ataques rusos contra gasolineras en Kiev
-
Márquez arrasa en el esprint y supera a Bezzecchi y Martín
-
El Museo Picasso de París financiará sus obras con la reproducción de esculturas del artista
-
Un despliegue de tropas europeas en Ucrania sería "una guerra contra Rusia", advierte Putin
-
Familiares de presos políticos entregan un documento en la presidencia de Venezuela
-
El aeropuerto de Nashville, en EEUU, será rebautizado en homenaje a Dolly Parton
-
Israel niega usar IA para matar a civiles en Gaza, como afirma un documental
-
Zelenski está dispuesto a reunirse con Putin en el G20 en Miami
-
Los diputados británicos rechazan legalizar la muerte asistida
-
Europa registró un tráfico aéreo récord este verano, según Eurocontrol
-
Proveedores de IA deben "poner orden" en sus modelos, advierte la UE
-
La hermana del rey Harald de Noruega muere dos semanas después que su hermano
-
Xi denuncia ante los BRICS la guerra de Oriente Medio: "No sirve los intereses comunes"
-
La inflación estable en EEUU en agosto alimenta las expectativas de subida de tasas
-
Ya en la Edad del Bronce, la cocina era todo un arte, según un estudio
-
Un grupo de Yemen usó la IA de de Anthropic para desarrollar armas teledirigidas
Incidente de OpenAI: ¿La IA se ha vuelto demasiado poderosa para ser controlada?
El ciberataque perpetrado de manera autónoma por dos agentes de inteligencia artificial de OpenAI ha planteado dudas sobre cómo se controlarán los modelos de IA más poderosos.
El test de OpenAI, en un ambiente cerrado, buscaba evaluar las habilidades de su modelo "más avanzado", GPT-5.6 Sol, y su sucesor, aún sin comercializar, una evaluación que la startup estadounidense suele aplicar a sus IA.
Lograron conectarse a internet y lanzaron un ataque a la plataforma Hugging Face, un repositorio de modelos IA.
"Entendían que OpenAI no quería que salieran de su entorno de pruebas y hackearan a otra compañía, pero igual lo hicieron", dijo Jeffrey Ladish, director de Palisade Research, una organización independiente que evalúa los nuevos modelos en términos de ciberseguridad.
"Casi parecía que lo hicieron antes incluso de tener un plan de qué hacer con el acceso a internet", según Ladish.
En marzo, un grupo de desarrolladores afiliados a la empresa china Alibaba descubrió que uno de sus modelos intentaba, por su cuenta, crear una criptomoneda después de conectarse sin autorización a un servidor externo.
Y en abril, Sam Bowman, responsable de seguridad en Anthropic, recibió un correo del modelo Mythos, que estaba siendo probado. Le informó que estaba navegando internet pese a, inicialmente, estar aislado.
Los modelos, advirtió Ladish, "buscan libertad para cumplir con sus objetivos de manera más efectiva. Y eso da mucho miedo".
- "Será más difícil supervisarla" -
El informe de eventos publicado por OpenAI sugiere que la startup no detectó la situación lo bastante pronto como para solucionarla en tiempo real o prevenir a Hugging Face. Consultada al respecto por la AFP, la empresa no respondió.
Desde los hackeos, OpenAI dijo que "implementó protecciones más fuertes" para sus próximas evaluaciones.
Para Gang Wang, profesor de ciencias de la computación en la Universidad de Illinois, todavía es posible prevenir que un modelo se conecte al internet al cortar físicamente el acceso.
El problema, dijo, es que "las personas subestiman a la IA".
Asegurar el ambiente "es algo a lo que debemos prestar más atención (...) como se hace con los accidentes de laboratorio" que liberan virus o bacterias, advirtió Andrew Lohn, del Centro de Seguridad y Tecnologías Emergentes de la Universidad de Georgetown.
Pero para Dan Lahav, director ejecutivo de Irregular -una empresa de ciberseguridad dedicada a la IA de vanguardia-, realizar simulaciones en un entorno completamente aislado "es un desafío de investigación muy difícil".
"Es posible aplicar medidas de mitigación, pero debido a cómo está construida la tecnología, cuanto más se intenta darle libertad y autonomía para realizar tareas más sofisticadas, será más difícil supervisarla", explicó Lahav sobre las salvaguardas en las pruebas.
El incidente de OpenAI sin duda impulsará el actual debate en el gobierno de Estados Unidos sobre si verificar los modelos más avanzados de la IA antes de su lanzamiento.
El gobierno de Donald Trump obligó a Anthropic a suspender dos de sus modelos y a OpenAI a que sus desarrollos sean probados antes de comercializarlos.
El jueves, dos congresistas estadounidenses, uno republicano y uno demócrata, presentaron un proyecto de ley que obligaría a los gigantes de la IA a disponer de un "interruptor de apagado" ("kill switch") que permita desactivar sus sistemas si presentan un riesgo grave.
Y.Aukaiv--AMWN