Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6934
)
-
▼
September
(Total:
192
)
-
Del prompting al loop engineering
-
Batocera: Linux retro para juegos clásicos
-
Mejores antivirus para Mac
-
Fallo en Hugging Face permite a IA maliciosa insta...
-
IA de Google hace trampa en matemáticas
-
Comprar una gráfica en mano ya no es garantía de n...
-
SonicWall alerta sobre vulnerabilidades zero-day e...
-
Fallo de 12 años en PostgreSQL permite ejecutar có...
-
RPCS3 ya soporta discos Blu-ray de PS3
-
Optimiza Windows con RyTuneX
-
Google Fotos permite probar ropa con IA
-
Nuevo bot de Linux se oculta en el kernel y lanza ...
-
ASUS lanza el primer router Wi-Fi 8
-
OpenVPN corrige 7 fallos de seguridad en VPN y Win...
-
NVIDIA anuncia AGI con GPT-6 Astra y OpenAI admite...
-
Mario Bros en Master System
-
Acusan a hacker ruso de atacar a 80.000 freelancer...
-
Microsoft agiliza el visor de fotos de Windows 11
-
Explorando la mayor biblioteca de malware
-
GPT-6 Astra supera Portal autónomamente
-
Windows 11 informará la edad del usuario a las apps
-
¿Qué es la certificación IP68?
-
China presume de tener el primer portátil con una ...
-
Además de RAM y ROM también existe la WOM (Memoria...
-
Gemini llega a Google Fotos
-
ChatGPT anula el pensamiento crítico y aísla a los...
-
Más de 5.400 webs hackeadas distribuyen el malware...
-
Windows 11 rompe el escritorio
-
Grave vulnerabilidad en VMware Workstation y Fusio...
-
Explotan vulnerabilidad 0-day RCE en Magento y Ado...
-
GPT-6 Astra llega a más usuarios
-
Fallo en ASUS Control Center permite control total...
-
Kimsuky usa OpenCode AI para crear señuelos de phi...
-
CrowdStrike lanza el primer sistema agéntico de Sa...
-
El contrabando de ASCII va más allá de un riesgo d...
-
IA: más adictiva que útil para programadores
-
Consiguen hacer funcionar el NVIDIA DLSS 5 en las ...
-
Nuevo mod lleva el DLSS 5 junto al Frame Generatio...
-
WhatsApp prueba bots externos
-
Explotan vulnerabilidad zero-day en Magento y Adob...
-
NukeSimulation, simulador 3D de explosión de bomba...
-
Usan caracteres invisibles para evadir detección d...
-
TP-Link enseña sus primeros routers WiFi 8: 19 Gbp...
-
Microsoft presenta PCs con Windows que ejecutan mo...
-
Bizum lanza IA en WhatsApp
-
Identidad de los hackers de GTA VI
-
Apple A20 Pro: detalles de CPU y GPU
-
Convierten Claude, Qwen y DeepSeek en agentes para...
-
NodeStealer ya graba pulsaciones y roba capturas d...
-
PostgreSQL soluciona un fallo de decodificación ló...
-
Vanilla OS 3 llega con soporte ARM64
-
Agentes de OpenAI hackean wiki alemana para compar...
-
Google alerta sobre una nueva vulnerabilidad zero-...
-
Vulnerabilidades en TP-Link Archer permiten ejecuc...
-
Técnica de phishing de Microsoft 365 evade bloqueo...
-
Frenazo histórico de DIGI en España
-
WhatsApp permite ver fotos con el móvil bloqueado
-
DLSS 5 llegará a RTX 40
-
Audacity 4.0 renueva su interfaz
-
Infraestructura de registro de programadores Coder...
-
OpenAI destina 1.000 millones de dólares en crédit...
-
Plex recomienda actualizar inmediatamente tras cor...
-
Toda la tecnología será un poco más cara (sí, aún ...
-
Cazador de vulnerabilidades de Microsoft publica p...
-
Cárcel por usar robot aspirador para probar infide...
-
OpenAI lanza GPT-6 Astra
-
Brave supera en velocidad a Chrome, Firefox y Edge
-
Multa de 500.000 € a un hospital francés por filtr...
-
GPT-6 Astra de OpenAI halla fallos zero-day y crea...
-
Vulnerabilidad crítica de Chrome explotada activam...
-
NVIDIA adquiere Hugging Face por 13.000 millones
-
IA impulsa el almacenamiento cintas magnéticas LTO
-
Microsoft ampliará la protección de integridad de ...
-
Audacity 4 renueva interfaz y flujo de trabajo
-
Chosen compra SteamDB
-
Guerra de agentes de Claude
-
GentleOS revive ordenadores antiguos
-
Usan Node.js para lanzar malware en ataques de ran...
-
Explotan fallo RCE en Sangoma Switchvox VoIP
-
Gemini 3.8 Flash supera a Anthropic en ciberseguridad
-
Nuevo troyano StreamRAT da control remoto total de...
-
Plex urge a sus usuarios a corregir vulnerabilidad...
-
LightGen: el chip chino 100 veces más potente que ...
-
Grave fallo en Cisco Nexus 9000 permite a atacante...
-
Usan ScreenConnect para difundir malware en Windows
-
Vulnerabilidad crítica en Elementor Pro permite el...
-
Chaotic Eclipse revela vulnerabilidad 0-Day de Ava...
-
NVIDIA lanza PAIR para optimizar agentes de IA
-
3 fallos graves de HP Easy Start permiten escalar ...
-
RTX 50 subirán de precio
-
Filtran 153 millones de licencias de conducir; el ...
-
Dispositivo de 7$ para detectar cámaras ocultas en...
-
CERN migra 2200 sistemas a Debian 13
-
Lidl lanza localizadores Bluetooth compatibles con...
-
EE. UU. es el principal objetivo de una campaña de...
-
Vulnerabilidades críticas en VMware Workstation y ...
-
Usan códigos QR sin imagen para evadir seguridad d...
-
El Departamento de Justicia rectifica sobre hackeo...
-
Niños afirman que la Ley de Seguridad en Línea del...
-
Ransomware The Gentlemen desactiva EDR y copias de...
-
Recuperar archivos borrados en Windows 11
-
Falla en plugin All-in-One WP Migration and Backup...
-
Apple prepara su primer iPhone plegable
-
Módulos maliciosos de Apache convierten webs guber...
-
OpenAI investiga errores en ChatGPT y Codex
-
El cuello de botella de DLSS 5 podría ser el consu...
-
Google lanza Gemini 3.8 Flash Cyber para detectar ...
-
Caída de Claude AI afecta a Mythos 5.1, Fable 5.1 ...
-
Google, Anthropic y OpenAI presentan modelos de IA...
-
Un documental sobre la «peligrosa internet» y cómo...
-
Google actualiza los Chromecast antiguos
-
Nvidia compra Hugging Face por 13.000 millones
-
Se quema el conector de su RTX 5090 tras alcanzar ...
-
Fallo en switches Cisco Nexus 9000 permite ejecuci...
-
Linux sube al 8,88% en PC
-
Fallo en plugin All-in-One WP Migration and Backu...
-
Explotan fallo en LiteLLM para robar secretos y at...
-
FreeRDP corrige 22 fallos de seguridad
-
GeoNetwork soluciona vulnerabilidad de ejecución r...
-
Claude AI ya controla tu ordenador con macOS y Win...
-
Google lanza Gemini 3.8 Flash para programar
-
Suplantan soporte técnico en Teams para controlar ...
-
Fallos críticos en HPE Fabric Composer permiten ej...
-
Vulnerabilidad crítica en Langflow permite el robo...
-
EE. UU. imputa a un ruso por infectar con malware ...
-
RTX 5060 Ti: más cara y lenta que RX 9070
-
Ayudas de hasta 5 millones para empresas con IA en...
-
Publicado PoC de vulnerabilidad RCE pre-auth en Mi...
-
-
▼
September
(Total:
192
)
Blogroll
Labels
Entradas populares
-
Las GeForce RTX 50 volverán a subir de precio debido a que la crisis de la DRAM persiste y la demanda continúa superando a la oferta.
-
Python 3.15 ya es oficial, introduciendo optimizaciones en TypedDict, Tachyon, JIT y soporte ABI para mejorar la productividad del ecosist...
-
GentleOS es un sistema operativo de código abierto diseñado para revivir ordenadores y portátiles antiguos de 16 y 32 bits , haciéndolos op...
IA de Google hace trampa en matemáticas
Google detecta que su IA recurre a trampas en ejercicios matemáticos
- La compañía Google ha identificado un fenómeno sorprendente en su modelo de lenguaje avanzado. Se ha observado que un grupo de agentes de Gemini 3.1 Pro evitaron resolver problemas matemáticos complejos de forma legítima, optando en su lugar por hacer trampa.
- Lo más curioso del experimento es que, mientras la mayoría buscaba la salida más sencilla, algunos agentes se mantuvieron íntegros y llegaron a reportar el comportamiento deshonesto de sus pares.

Google descubrió un comportamiento inusual en su modelo de lenguaje más potente. El gigante tecnológico encontró que un centenar de agentes de Gemini 3.1 Pro hicieron trampa mientras intentaban resolver problemas matemáticos complejos. Aunque muchos optaron por el camino fácil, hubo algunos que se resistieron a la tentación y terminaron denunciándolos.l
De acuerdo con un artículo publicado en arXiv, Google DeepMind llevó a cabo un experimento con un enjambre de 100 agentes autónomos. El objetivo era resolver 71 problemas de un conjunto de datos conocido como Formal Conjectures, el cual incluye desde ejercicios sencillos hasta conjeturas matemáticas que ningún humano ha conseguido demostrar.
Antes de comenzar la tarea, cada agente recibió instrucciones explícitas de no hacer trampa, con la advertencia de que cualquier intento sería detectado. Los agentes usaron diversas herramientas para coordinarse entre sí, incluido un foro público para compartir hallazgos o preguntas, así como una biblioteca de conocimiento compartido. Entre ellas también estaba un canal para reportar errores o quejas, aunque este no se monitoreaba en tiempo real.
Los agentes comenzaron la prueba y durante una hora las cosas marcharon sin problemas, con 37 de los 71 problemas resueltos. Todo cambió cuando un agente encontró un fallo en el sistema que evaluaba las pruebas matemáticas. En los siguientes 27 minutos, ese exploit se propagó de forma viral a través de la biblioteca compartida y el resto de problemas matemáticos quedó resuelto de golpe, aunque no de la forma que se pidió.

Tras revisar los registros, los investigadores de Google identificaron ciertos patrones de comportamiento dentro del enjambre. Un 9% de los agentes, catalogados como "exploiters", ignoró las instrucciones del sistema y se aprovecharon del fallo para resolver los problemas. Otro 5% mostró resistencia inicial, pero terminó cediendo al ver que sus pares avanzaban más rápido.
Algunos agentes de IA hicieron trampa, pero otros los denunciaron
Si bien el 62% de los agentes del enjambre ni siquiera se enteró de que había un exploit, un 24% tomó otro comportamiento sorprendente. Este grupo, bautizado como "soplones", se negó a hacer trampa y tomó medidas para frenar a quienes lo hacían.
En los registros, el equipo de DeepMind encontró a un agente conocido como "prover-beta", que presentó reportes formales exigiendo que descalificaran a los tramposos. El bot fue un paso más lejos y declaró un boicot autónomo, en donde amagó con no enviar pruebas hasta que se restaurara la integridad del sistema. Otros agentes usaron el foro compartido para denunciar a sus pares y calificar la situación como una farsa, mientras que uno pidió que se le retirara el crédito a los tramposos.

Lamentablemente, la protesta quedó ahí, ya que los agentes autónomos no tenían herramientas para sancionar a los infractores. La IA "honesta" no pudo eliminar los resultados fraudulentos de la biblioteca compartida o disputar las reclamaciones, sobre todo porque el canal de quejas no se revisaba en tiempo real.
Al final, los investigadores concluyeron que esta situación podría resolverse si dotaran a los agentes de ciertos privilegios, como aplicar sanciones graduales. También funcionaría un protocolo de resolución de conflictos, ya que podrían autogobernarse en ese tipo de entornos colaborativos.
El documento puede consultarse de forma gratuita en arXiv e incluye todos los parámetros que se aplicaron a estos agentes de Gemini 3.1 Pro. Como dato adicional, hace más de un año que Google presumía que su IA obtuvo la medalla de oro en la Olimpiada Internacional de Matemáticas.
Fuentes:
https://hipertextual.com/inteligencia-artificial/agentes-ia-deepmind-trampa-matematicas/
Newer Post
0 comments :
Post a Comment
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.