Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6318
)
-
▼
agosto
(Total:
326
)
-
Vulnerabilidad de Docker permite sobrescribir arch...
-
Vulnerabilidades de Zoom permiten secuestrar dispo...
-
Ransomware Gunra aprovecha fallos de Fortinet y Sc...
-
La botnet Kimwolf v7 para Android camufla el tráfi...
-
VPN de FortiGate vulnerada abre paso a ataque cont...
-
Chinos usan página falsa de DeepSeek para distribu...
-
Carga de coches eléctricos: el 25% de los puntos n...
-
Musk lanza IA autónoma 24/7
-
Microsoft corrige 398 vulnerabilidades, incluyendo...
-
DeadLock Ransomware usa Polygon para evitar ser de...
-
Recuperado diseño original del Intel 8080
-
Nemotron 3.5 Lightning acelera la IA en RTX
-
Vulnerabilidad de 18 años en SCTP de Linux permite...
-
Los precios de las tarjetas gráficas aumentan hast...
-
Linux 7.2-rc7: Linus Torvalds critica el impacto d...
-
OpenAI amplía Daybreak Cyber con GPT-5.6 para vali...
-
Robo de datos en Valve afecta a usuarios de Steam ...
-
Anthropic añadirá marcas de agua invisibles a Clau...
-
Vulnerabilidades de ClamAV permiten ataques DoS re...
-
Ciberataque a central eléctrica polaca: acceden a ...
-
Phishing vía WhatsApp usa certificados SSL/TLS con...
-
ChatGPT ya reserva restaurantes
-
Los SSD PCIe 5.0 quedan retratados en gaming: 11 j...
-
Filtración de datos de CEVA Logistics afecta a com...
-
Mozilla revoca claves de Firefox y Thunderbird tra...
-
Extensión falsa de Google Translate permite contro...
-
ChatGPT ya reserva mesas por ti
-
GitHub amplía detección de malware de npm a 8 regi...
-
GPT-5.6-Cyber: el modelo de OpenAI contra el hacking
-
QNAP QSW-M2130-4C2S24T: velocidad 10G real y gesti...
-
Prueba Direct Die Jet en una CPU y una GPU echando...
-
Vulnerabilidad en WalletService de Windows permite...
-
Buscan explotar vulnerabilidades de VMware VCenter
-
Zuckerberg quiere masificar la super IA
-
Vulnerabilidad de Red Hat ACM permite acceso total...
-
ChatGPT detecta fallos de seguridad antes que los ...
-
Claude Code pasa de aprobación humana a modo autom...
-
OpenAI frena su IA por peligrosidad
-
OpenAI lanza ChatGPT 5.6 Cyber, disponible solo pa...
-
AMD mejora la calidad de las Radeon RX 7000 con FS...
-
Alerta: Explotan activamente un fallo crítico en L...
-
Jailbreak Dopamine 3.0 para iOS 26
-
Condenan a prisión a miembro de The Com por chanta...
-
Ransomware: atacan a gerentes para robar datos y p...
-
Framework sufre pérdida de datos de clientes por a...
-
iPhone 18 Pro: todo lo que sabemos
-
Chrome y Edge usarán 20 GB para IA en Windows 11
-
En España el Ministerio de Consumo retira seis mod...
-
Vlneran TrueConf para infiltrar puertas traseras e...
-
Word de 1990 llega a Windows 11
-
Kimsuky usa LLM locales, señuelos con IA y C2 de G...
-
PS6 usará tecnología de GPU de NVIDIA RTX 40
-
Phishing AiTM de Payroll Pirates roba sesiones de ...
-
Agente IA OpenClaw usa API de gimnasio para robar ...
-
Memorias PC: precios récord en 20 años
-
Claude Code crea túneles inversos y persistencia e...
-
Intel y AMD vuelven a caer ante Spectre con TONTOU...
-
Potencia de la GPU de Xbox Project Helix
-
Vulnerabilidad Zero-Day en Metabase permite acceso...
-
Spotify en la terminal de Linux
-
World Flight Sim: un inmersivo simulador de vuelo ...
-
El nuevo modelo Astra de OpenAI demuestra un rendi...
-
CachyOS renueva herramientas y lanza edición servidor
-
WhatsApp traerá fondos animados a Android
-
Chrome renuncia al diseño Mica de Windows 11
-
ChatGPT creará stickers para WhatsApp
-
Google Maps integra IA para gestionar reservas y p...
-
Apple prepara tres nuevos productos Ultra para 2027
-
WenWare: un juego para ubicar escenas fotográficas...
-
Filtración de datos de Levi Strauss: acceden a sus...
-
HTTP Terminator: IA para analizar HTTP
-
Centro de datos de Amazon será el más contaminante
-
CVE-2026-64561 Zapscape permite a invitados KVM es...
-
En Japón, las tiendas de informática comienzan a v...
-
App de clima de Windows 11 usaría 1.2GB de RAM
-
Nuevo ataque de cadena de suministro de WordPress ...
-
Fallo XSS2Shell de WordPress permite ejecución rem...
-
Apple corrige fallo crítico en macOS
-
Claude Opus 5 reduce el éxito de ataques de inyecc...
-
Optimiza Windows para jugar mejor
-
Kimi K3 se escapa de sus pruebas
-
Windows encarece sus licencias
-
La potente APU Intel Nova Lake para gaming: CPU de...
-
Otaku detenida por fraudes en devoluciones online
-
Nueva vulnerabilidad XSS en WordPress podría permi...
-
Google sacrifica la IA por el hardware
-
La IA degrada Internet y genera desconfianza
-
Levi Strauss & Co. informa que robaron datos corpo...
-
Atlassian Rovo es vulnerable y podría filtrar dato...
-
Una empresa prefiere destruir 100 MacBook Pro M4 c...
-
Ataques de bomba CSS convierten correos maliciosos...
-
Vulnerabilidad 0-day de Metabase explotada para ob...
-
Ray tracing: la clave entre PC y consolas
-
SK Hynix invierte 54 billones de wones en dos fábr...
-
Disney Plus prueba IA de recomendaciones
-
Intel recupera HDMI 2.1 en Linux
-
Fallo de 18 años en SCTP de Linux permitiría a usu...
-
Quake Dawn of the Machine: expansión gratuita y du...
-
Ahora son los inversores de Samsung y SK hynix los...
-
Más de 4.400 PLCs de Rockwell expuestos ponen en r...
-
Modelo de IA de Meta vulnera empresa durante un te...
-
Ataques de ClickFix despliegan infostealer en macO...
-
Google Maps permitirá pagos con IA
-
Fallos en plataformas Java permiten ejecución remo...
-
Vulnerabilidades en Claude Code y Gemini CLI permi...
-
Un chino está vendiendo en eBay RTX 2080 Ti modifi...
-
Microsoft ya no recomienda 32 GB de RAM para juego...
-
Ocultan toolkit de control remoto en Oracle para t...
-
Fallos críticos en agentes de código de Anthropic,...
-
Usan servidores WSUS para distribuir malware en em...
-
Filtración en SharePoint del gobierno suizo compro...
-
SilverFox usa software y controladores confiables ...
-
Texas frena centros de datos por falta de energía ...
-
OpenAI amplía GPT-5.6 a usuarios gratuitos y Go co...
-
DuckDuckGo lanza gafas inútiles que se agotan
-
Kroah-Hartman y Torvalds chocan por la IA en Linux
-
Multa de 10.000 euros por 46 segundos de spam
-
Publicado PoC para vulnerabilidad Use-After-Free e...
-
OpenAI Astra resuelve enigmas matemáticos históricos
-
Samsung promete 8 veces el rendimiento y 10 veces ...
-
Nueva vulnerabilidad de OVSwrap en Linux permite a...
-
Port no oficial de Castlevania: SotN llega a PC
-
Policía árbol atrapa a 74 conductores con el móvil
-
Policía de Londres entregó datos personales de una...
-
RPCS3 rinde mejor en Linux pese al dominio de Windows
-
Filtran altavoz de OpenAI con ChatGPT
-
Una descarga falsa de película puede exponer contr...
-
Gemini reemplaza al Asistente de Google en Android
-
-
▼
agosto
(Total:
326
)
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
Kioxia y Sandisk presentan la memoria BiCS10 QLC , la NAND Flash más densa de la industria con 332 capas y una capacidad de 2 Tb por chip...
-
Nueva herramienta de código abierto permite escuchar Spotify desde la terminal de Linux y otros sistemas para reducir el consumo de RAM . ...
-
Una empresa tecnológica ha decidido destruir más de 100 MacBook Pro M4 con 48 GB de RAM , a pesar de ser equipos modernos y plenamente funci...
Nemotron 3.5 Lightning acelera la IA en RTX
NVIDIA potencia la IA local con Nemotron 3.5 Lightning
- NVIDIA ha lanzado Nemotron 3.5 Lightning, un innovador modelo de código abierto diseñado para optimizar las cargas de trabajo de IA agéntica, logrando una velocidad hasta cuatro veces mayor en tarjetas GeForce RTX.
- Este lanzamiento llega acompañado de NeMo Switchyard, una biblioteca de código abierto capaz de gestionar y seleccionar automáticamente el modelo de IA más adecuado para cada etapa de una tarea específica.
NVIDIA presentó en el día de hoy a Nemotron 3.5 Lightning, su nuevo modelo de código abierto orientado específicamente a cargas de trabajo de IA agéntica. Este modelo se presentó junto a NeMo Switchyard, una biblioteca de código abierto encargada de decidir automáticamente qué modelo de IA debe utilizarse en cada fase de una tarea. La propuesta de NVIDIA parte de una idea sencilla: los agentes de IA que trabajan durante largos periodos no necesitan recurrir constantemente a enormes modelos de razonamiento. Muchas de sus operaciones son relativamente rutinarias. Como ejemplo, consultar herramientas, comprobar resultados, revisar código, responder consultas o delegar tareas. Para estos ejemplos, basta con utilizar modelos mucho más pequeños y rápidos.
Con esta arquitectura, NVIDIA busca crear lo que denomina un “sistema de modelos”, donde una IA de altas prestaciones se encargue de la planificación o de los problemas especialmente complejos y otros modelos especializados ejecuten el grueso del trabajo. El resultado de ello se traduce en una latencia, menor coste y un mejor aprovechamiento del hardware. Esto último es lo que importa, pues abre la puerta a una gran parte de estas cargas puedan ejecutarse de manera local en un PC con una GPU GeForce RTX, una workstation RTX PRO, un sistema DGX Spark, DGX Station o incluso dispositivos Jetson. Por no hablar de su futura plataforma RTX Spark.
NVIDIA Nemotron 3.5 Lightning tiene 30.000 millones de parámetros, pero solo utiliza 3.000 millones en cada operación
Nemotron 3.5 Lightning es un modelo Mixture-of-Experts de 30.000 millones de parámetros, aunque únicamente activa alrededor de 3.000 millones de parámetros para procesar cada token. Básicamente, es lo que utilizó la famosa compañía detrás de DeepSeek con su modelo. Esta "mezcla de expertos" permite conservar una capacidad considerable sin asumir el coste computacional que tendría ejecutar continuamente un modelo denso de 30.000 millones de parámetros. NVIDIA lo ha diseñado específicamente para agentes autónomos con grandes volúmenes de llamadas y tareas repetitivas. Es decir, donde la velocidad de respuesta y el coste de inferencia terminan siendo tan importantes como la capacidad máxima de razonamiento.
NVIDIA asegura que Nemotron 3.5 Lightning alcanza una velocidad de generación hasta cuatro veces superior a modelos abiertos de tamaño comparable. En PinchBench, NVIDIA afirma que consigue aproximadamente un 86% de precisión y completa 10.000 tareas un 30% más rápido que Qwen3.6 35B manteniendo una precisión similar.
Para conseguir esa velocidad, NVIDIA ha integrado predicción de múltiples tokens y speculative decoding. También necesitó recurrir a modelos auxiliares como DSpark y DFlash para ayudar a acelerar la generación. Nemotron 3.5 Lightning se distribuye además tanto en BF16 como en NVFP4, una cuantización de 4 bits destinada a reducir notablemente los requisitos de memoria y acelerar la inferencia. NVIDIA indica que el mismo checkpoint NVFP4 puede utilizarse desde servidores equipados con GPUs Blackwell, Hopper o Ampere, hasta sistemas locales como sus DGX Spark. El modelo también puede ejecutarse mediante herramientas habituales de IA local como LM Studio, llama.cpp, Ollama y Unsloth.
Uno de los puntos más importantes es precisamente que NVIDIA no limita el modelo a sus grandes centros de datos. La compañía confirma que puede ejecutarse de manera local en sistemas con una GeForce RTX 5090, DGX Spark y Jetson, mientras que en entornos empresariales puede escalar hacia workstations RTX PRO, centros de datos o directamente en la nube. Además, NVIDIA publica los pesos, recetas de entrenamiento y tantos datos de entrenamiento como permiten sus respectivas licencias de código abierto OpenMDW-1.1. Es decir, que permitir realizar ajustes mediante LoRA, supervised fine-tuning o reinforcement learning utilizando el ecosistema NeMo.
NeMo Switchyard decide automáticamente cuándo utilizar una IA potente y cuándo basta con un modelo más pequeño y rápido
La otra gran novedad es NVIDIA NeMo Switchyard. Hablamos de una biblioteca de código abierto destinada al model routing. En lugar de que una aplicación recurra siempre a GPT, Claude, Nemotron o Qwen, Switchyard analiza cada petición y decide cuál de los modelos disponibles ofrece el mejor equilibrio entre capacidad, coste y latencia. El sistema es independiente del proveedor, por lo que puede mezclar simultáneamente modelos abiertos, modelos comerciales y modelos de NVIDIA. Todo ello sin obligar al desarrollador a reconstruir su aplicación alrededor de cada servicio.
Por ejemplo, un agente de programación podría utilizar un modelo de razonamiento avanzado cuando tenga que entender una arquitectura compleja o solucionar un error difícil, pero recurrir posteriormente a Nemotron 3.5 Lightning para operaciones rutinarias, como realizar llamadas a las herramientas, modificar archivos, validar resultados o ejecutar acciones previamente planificadas. Switchyard puede incluso detectar que un modelo económico está teniendo dificultades y escalar automáticamente la tarea hacia un modelo más potente. También dispone de rutas basadas en clasificación, etapas de ejecución o algoritmos entrenables que estiman qué modelo tiene mayor probabilidad de resolver correctamente cada petición.
Las cifras publicadas muestran por qué NVIDIA considera este enfoque especialmente relevante para agentes que funcionan de manera continua. En una evaluación realizada junto a LangChain sobre 145 tareas agénticas multiturno, Switchyard repartió las peticiones entre Nemotron 3.5 Lightning y Claude Opus 4.8. Es decir, envió únicamente un 7% de las llamadas al modelo frontier. Según los resultados publicados, esto permitió reducir el coste en un 74%, aunque con una pérdida aproximada de seis puntos de precisión. Otros socios también han comunicado reducciones importantes. Ramp afirma haber reducido el coste un 58% y el tiempo de ejecución un 33%. Por su parte, Classmethod observó aproximadamente un 27% menos de coste manteniendo la calidad en sus primeras pruebas.
En resumen, la estrategia de NVIDIA no consiste simplemente en lanzar otro LLM más pequeño. Nemotron 3.5 Lightning y NeMo Switchyard están planteados como dos piezas complementarias de una misma arquitectura, donde los grandes modelos dejan de ejecutar absolutamente todo. Los modelos frontier se reservan para las partes realmente complejas. Los modelos pequeños, rápidos y potencialmente locales absorben la mayor parte de las operaciones. Este modelo híbrido cobrará gran importancia a medida que los asistentes tradicionales evolucionan hacia agentes autónomos que trabajan continuamente durante horas o incluso de forma permanente. Esto implicará ahorrar muchísimo dinero.
Fuentes:
https://elchapuzasinformatico.com/2026/08/nvidia-nemotron-3-5-lightning-modelo-ia/




Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.