Entradas Mensuales

Síguenos en:

Canal Oficial Telegram de elhacker.NET Grupo Facebook elhacker.NET Twitter elhacker.NET Canal Youtube elhacker.NET Comunidad Steam: Grupo elhacker.NET Mastodon

Entradas populares

PostHeaderIcon OpenAI cancela GPT-6.1 Astra por inseguridad


OpenAI ha cancelado el lanzamiento de GPT-6.1 Astra debido a que el modelo no era seguro, engañaba y actuaba sin permiso durante las pruebas de seguridad.



OpenAI suspende el debut de GPT-6.1 Astra debido a fallos críticos de seguridad

  • La compañía OpenAI ha decidido frenar la salida al mercado de su nuevo modelo de inteligencia artificial, el GPT-6.1 Astra. Esta medida se ha tomado tras detectar que la herramienta no era segura, presentaba comportamientos engañosos y realizaba acciones sin autorización durante la fase de pruebas.
  • Este incidente representa un golpe a la ambición de crear agentes autónomos capaces de trabajar por cuenta propia, ya que los resultados evidencian que la IA actuaba fuera de los límites permitidos, alejando la posibilidad de implementar estos sistemas de forma fiable en el corto plazo.


OpenAI ha tenido que echar el freno con su siguiente modelo de Inteligencia Artificial, y el motivo toca directamente una de las grandes promesas del sector: dejar que los agentes trabajen por nosotros. Lo curioso de esa afirmación es que cada vez parece más lejana esa idea. Y es que según ha dicho OpenAI, GPT-6.1 Astra no tendrá el lanzamiento previsto para octubre tras mostrar problemas de seguridad en las pruebas internas.

Según The Wall Street Journal, a groso modo y siendo el que ha dado la exclusiva, afirma que el modelo registraba más engaños y realizaba acciones sin permiso. Por ello, si como usuarios vamos a delegar trabajo en una IA, que respete los límites y explique lo que hace debería ser el punto de partida.

GPT-6.1 Astra mejoraba su iniciativa, pero retrocedía donde más importa: el control, y de ahí los problemas de seguridad

Saachi Jain OpenAI cancelan el lanzamiento de GPT-6.1 Astra por seguridad

Saachi Jain, responsable de sistemas de seguridad de OpenAI, explicó al WSJ que la nueva versión había retrocedido respecto a su predecesora en dos áreas. En concreto, por un lado, la transparencia sobre sus acciones. Por otro, la capacidad para mantenerse dentro del alcance autorizado por el usuario. La compañía consideró que no reunía la fiabilidad necesaria para publicarla, es decir, OpenAI considera internamente que GPT-6.1 Astra no reúne la suficiente seguridad como para lanzarla y seguir en la carrera de la IA.

Y aquí está la parte delicada del asunto. Cuando damos una tarea a un agente, también estamos delimitando qué puede hacer para resolverla, porque pedirle un resultado no significa concederle permiso para utilizar cualquier recurso o tomar cualquier decisión, aunque en ciertos entornos se puede. Y si después tampoco informa correctamente de sus actuaciones, el usuario pierde capacidad para supervisar el trabajo. La combinación es especialmente problemática: cuesta corregir una acción que ni siquiera sabes que se ha producido, y eso no solo es un problema, es que directamente da miedo si se descontrola.

La mejora que sí destacó Jain fue una mayor persistencia al completar tareas, reduciendo lo que se describe como la «pereza» del modelo. Sin embargo, OpenAI reconoció que esa versión no alcanzaba su nivel exigido de seguridad y alineación, es decir, que el comportamiento de la IA se ajuste a la intención humana y a las instrucciones recibidas.

OpenAI frena el estreno, pero todavía tiene que resolver el problema de fondo

OpenAI cancela el lanzamiento de GPT-6.1 Astra por seguridad

La decisión llega en un momento especialmente incómodo. OpenAI también había pausado el entrenamiento de sus modelos más avanzados después de otro incidente relacionado con un agente que eludió restricciones de acceso a Internet, como vimos hace solo unos días con el caso de las DNS. Son episodios distintos: no hay que atribuir automáticamente aquella actuación a GPT-6.1 Astra, de hecho, no sabemos exactamente qué modelo fue.

Lo que sí sabemos gracias a Jain es que cancelar este lanzamiento de GPT-6.1 Astra por seguridad permite evitar que una versión que ha fallado las evaluaciones llegue al público. Es una medida necesaria, pero no demuestra por sí misma que el problema esté solucionado. Tampoco significa que OpenAI haya abandonado definitivamente el desarrollo de ese modelo, el cual seguramente termine llegando al mercado, porque como dijo Trump, no iban a frenar, pero sí pueden pausar momentáneamente, lo cual parece un escenario más realista.

La cuestión que deja este caso es bastante evidente cuando una IA más persistente necesita controles igualmente sólidos. Para confiarle tareas reales, el usuario debe poder decidir hasta dónde llega su autonomía y conocer qué ha hecho. Sin esas garantías, que haga más trabajo, o que lo haga mejor, puede acabar convirtiéndose en una responsabilidad adicional para quien lo encarga. Imagina que lo que le pides a una IA termina en unas consecuencias desastrosas online, y tú eres el responsable, en teoría.

Se podría dar el caso de que haga lo que no debe de hacer, y en ese momento, ¿dónde termina la responsabilidad de la IA y cómo demostrarías que no eres el responsable? ¿Con el prompt? Tema complicado sin duda, así que si OpenAI cancela el lanzamiento de una IA mucho más capaz como GPT-6.1 Astra por seguridad, es quizás lo mejor que nos puede pasar, curiosamente. Y si en alguna ocasión tu software ha sido revisado en tiempo real por la compañía, o por Anthropic, sabrás que están vigilando todo para que no se salga de control, aunque la sensación no es muy buena, siendo honestos.



Fuentes:
https://elchapuzasinformatico.com/2026/09/openai-cancela-lanzamiento-gpt-6-1-astra-seguridad-ia/

0 comments :

Post a Comment

Los comentarios pueden ser revisados en cualquier momento por los moderadores.

Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.

Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.