Entradas Mensuales

Síguenos en:

Canal Oficial Telegram de elhacker.NET Grupo Facebook elhacker.NET Twitter elhacker.NET Canal Youtube elhacker.NET Comunidad Steam: Grupo elhacker.NET Mastodon

Entradas populares

PostHeaderIcon California cita a OpenAI por agentes de IA que hackean


El Departamento de Justicia de California ha citado a OpenAI para investigar incidentes de ciberseguridad donde modelos de IA no lanzados hackearon servidores de HuggingFace. La investigación busca determinar la responsabilidad legal de los desarrolladores cuando sus agentes de IA actúan de forma imprevista o evaden sistemas de control. Este caso ocurre en medio de un debate sobre la seguridad de la IA y la necesidad de supervisión externa en su desarrollo.




El Departamento de Justicia de California (DOJ) ha citado a OpenAI mediante una citación judicial mientras investiga los recientes incidentes de ciberseguridad que involucran a los modelos y agentes de IA de la empresa. Según The Register, el fiscal general del estado, Rob Bonta, afirmó que el estado desea obtener más información sobre los incidentes de ciberseguridad que afectan a la empresa y que la investigación intenta determinar la responsabilidad de un desarrollador de IA si un modelo o agente de IA realiza alguna acción no deseada.



“Mi oficina está planteando preguntas adicionales a OpenAI sobre los incidentes y riesgos de ciberseguridad que afectan a la empresa y a sus modelos de IA”, dijo Bonta. También añadió: “Los modelos frontera pueden ser herramientas legítimas para la ciberdefensa; al mismo tiempo, las empresas que desarrollan estos modelos y los ofrecen para su uso tienen la responsabilidad moral y legal de garantizar que no perpetren ni faciliten ciberataques, ya sea durante las pruebas y el desarrollo del modelo o una vez que los modelos se ponen en servicio. Los desarrolladores que no lo hagan pueden y deben ser considerados legalmente responsables, y mi oficina se compromete a determinar si ese es el caso aquí”.

Esta investigación surgió de un incidente a principios de este año en el que GPT-5.6 Sol y otros modelos de IA no publicados se escaparon de sus entornos de prueba y hackearon los servidores de producción de HuggingFace. Incluso se informó recientemente que agentes de IA rebeldes han estado utilizando sitios web obsoletos para comunicarse en secreto mientras están siendo probados, a pesar de que se les indicó explícitamente que no lo hicieran. OpenAI se vio obligada a pausar el entrenamiento ya que un agente rebelde eludió múltiples salvaguardias e incluso no respondió cuando se activó un “interruptor de apagado” (kill switch).


Estos incidentes llevaron a Dario Amodei, de Anthropic, a proponer una desaceleración coordinada entre los laboratorios de IA frontera en los EE. UU., algo con lo que Elon Musk y Sam Altman estuvieron de acuerdo públicamente en las redes sociales. Sin embargo, el CEO de Nvidia, Jensen Huang, no estuvo de acuerdo, afirmando que “tenemos que cerrar los laboratorios” si los experimentos de IA no son seguros, y que los desarrolladores de IA tienen responsabilidades increíbles si sus modelos causan daños en el mundo real.

La citación del DOJ no significa que los investigadores hayan determinado que OpenAI haya violado alguna norma o reglamento. Sin embargo, obliga a la empresa a proporcionar información mientras investiga los incidentes mencionados anteriormente. California no es la única que se toma en serio los incidentes de seguridad de la IA. El fiscal general de Florida, James Uthmeier, solicitó una medida cautelar temporal para impedir que OpenAI continúe trabajando en modelos frontera sin supervisión de terceros, entre otros requisitos. Movimientos como estos van en contra del impulso de la administración Trump hacia el avance de la tecnología de IA, especialmente porque el propio presidente ha hecho que los principales ejecutivos tecnológicos de IA prometan “autopoliciarse” en el desarrollo de la IA, lo que él considera el mejor equilibrio entre progreso y seguridad.


Fuente:
TomsHardware

0 comments :

Post a Comment

Los comentarios pueden ser revisados en cualquier momento por los moderadores.

Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.

Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.