Entradas Mensuales

Síguenos en:

Canal Oficial Telegram de elhacker.NET Grupo Facebook elhacker.NET Twitter elhacker.NET Canal Youtube elhacker.NET Comunidad Steam: Grupo elhacker.NET Mastodon

Entradas populares

PostHeaderIcon Anthropic frena su IA más potente por seguridad


Anthropic ha desarrollado un modelo de IA más poderoso que Mythos, pero ha decidido mantenerlo únicamente para uso interno por precaución.





  • Anthropic ha desarrollado una nueva inteligencia artificial que supera las capacidades de Mythos. A pesar de su potencia, la compañía ha decidido no lanzarla al público y mantener su uso exclusivamente a nivel interno.



Anthropic ha creado una auténtica bestia que supera las capacidades de Mythos 5 y que ha decidido mantener en el anonimato, con el nombre de Model 2, para evitar riesgos innecesarios derivados de su uso público.

La compañía ha publicado un documento en el que reúne los riesgos percibidos en el mes de agosto y donde ha hecho referencia a un nuevo modelo de inteligencia artificial al que no se había referido anteriormente.

Se trata de Model 2, un modelo que, según su criterio, "es más capaz que Mythos 5" y que "supone una mejora notable" con respecto a éste en muchas tareas relevantes para el uso interno, tal y como se indica en este informe.

A pesar de ello, este modelo "no muestra un salto en la capacidad del mismo nivel que el observado entre Claude Opus 4.6 y Mythos Preview". Eso no significa, no obstante, que se vaya a publicar y probar en este tiempo, sino que la empresa ha tomado la determinación de mantenerlo en el anonimato.

"Actualmente no tenemos planes de lanzar este modelo al público y no hemos llevado a cabo todas nuestras pruebas habituales de evaluación previas a la implementación, de modo que nuestra confianza en nuestras conclusiones sobre sus capacidades es algo menor", ha puntualizado OpenAI en este comunicado.

Usos de Model 2 y primeros resultados del modelo

En el informe, OpenAI ha reconocido que tanto Mythos 5 como Model 2 se están utilizando a nivel interno y de manera "intensiva" para la programación, la generación de datos y otros casos de uso relacionados con agentes que no se han especificado.

A pesar de que en este ámbito están respondiendo como se esperaba, desde la compañía han señalado que consideran que es "muy improbable" que ambos modelos "presenten una desalineación generalizada que aumente el riesgo de nuestras vías prioritarias". En cualquier caso, han puntualizado que el riesgo de daños catastróficos que plantean estas formas conocidas de desalineación es "bajo".

En cualquier caso, la compañía ha dejado caer que no tiene idea de ponerlo en manos de los usuarios y que, por el momento, se utilizará únicamente a nivel interna, además de que ha pasado por una evaluación "menos exhaustiva" que otros modelos y que solo con ella lo podría "comparar a otras" de su versiones de producción.

Qué es Mythos y por qué da tanto miedo

Clayde Mythos es la versión más avanzada y experimental de la inteligencia artificial desarrollada por Anthropic. No es una IA conversacional, esto es, pensada para razonar y responder preguntas, sino que se centra en analizar código y sistemas.

Una de las características que mejor lo definen es su agilidad para detectar fallos. Esto significa que tiene una tasa alta de éxito en la detección de vulnerabilidades y que, mientras otros modelos pueden ofrecer mejoras o encontrar errores básicos, ésta puede entender la lógica de un sistema operativo completo.

Sus altísimas capacidades han llevado a Anthropic decir de él que es un modelo de razonamiento "de alta fidelidad", que no solo adivina qué palabras vienen después de una determinada orden, como habitualmente hacen los chatbots normales.

De ese modo, simula de manera interna cómo funcionaría un programa y es capaz de detectar dónde se puede romper por bugs, aunque también puede plantear cómo aprovecharlos en caso de encontrarlos.

Así, Mythos ha demostrado ser capaz de encontrar vulnerabilidades zero day, incluso si estos no son recientes, debido a que no busca patrones, como hacen los humanos, sino que entienden la intención de estos fallos.

Esto puede ser muy favorable en el ámbito de la ciberseguridad, pero también puede suponer un problema si alguien consigue liberarlo para que recaiga por completo en manos de los ciberdelincuentes, que podrían crear ataques en apariencia irreversibles e inmanejables por otras IAs.



Fuentes:
https://computerhoy.20minutos.es/tecnologia/ia-empieza-dar-miedo-anthropic-tiene-un-modelo-mejor-que-mythos-no-quiere-lanzarlo_7027159_0.html

0 comentarios :

Publicar un comentario

Los comentarios pueden ser revisados en cualquier momento por los moderadores.

Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.

Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.