Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
6803
)
- ► septiembre (Total: 61 )
-
▼
agosto
(Total:
750
)
-
Europa impone reglas estrictas a ChatGPT como busc...
-
OpenClaw 2.0 con mejoras de seguridad para agentes...
-
Linux 7.3 roza las 41 millones de líneas de código
-
Musk quiere quemar gas para alimentar la IA
-
Microsoft confirma falsas alertas de Defender desa...
-
Fire Ant, grupo vinculado a China, secuestra route...
-
Extraditan a nigerianos a EE. UU. por sextorsión y...
-
Fallo crítico de Microsoft UFO permite controlar A...
-
Fallo de Composer expone claves SSH y archivos sen...
-
Los bloqueos de LaLiga se intensifican: la web del...
-
Usan CAPTCHA falso de Cloudflare para infiltrarse ...
-
Hasbro, el gigante de los juguetes, admite filtrac...
-
Malware de hackers expone sus propias herramientas...
-
iPhone Ultra: caro de comprar y reparar
-
Bots dominan el 91% de las compras de RAM
-
GTA 6: disparadas las reservas tras tráiler de Net...
-
Gemini en Android Auto distrae a los conductores
-
OpenAI retira sus modelos de Cursor tras compra de...
-
Windows 11 moderniza función de hace 25 años
-
Linus Torvalds: usar IA para arreglar Linux fue in...
-
Cloudflare libera 100 TB de RAM sin cambiar un sol...
-
Filtrados más de 12 TB de archivos de Steam que ab...
-
WhatsApp detecta estafas con IA local
-
Cinco fallos críticos en temas y plugins de WordPr...
-
Brave integra alias de correo electrónico para evi...
-
Meta impide grabar en secreto con sus gafas
-
Gemini Notebook actualiza sus límites
-
Fallos críticos de ServiceNow permiten ejecutar có...
-
OpenAI golpeó fuerte a Hugging Face
-
iPhone 17 Pro resiste caída de 30 km
-
Google usa IA para gestionar viajes
-
Modo Dios sigue vivo en Windows 11 pese a Microsoft
-
Investigador demuestra que Claude Code puede ser e...
-
Android 17 implementa ECH en todo el sistema para ...
-
Windows 10 no soportará GTA VI
-
PaperCut lanza un segundo parche de emergencia par...
-
IA: alerta por ola de ciberataques
-
Explotan fallo en Cosmos EVM a pesar de que Cosmos...
-
Berlín se niega a pagar el rescate a los que robar...
-
GTA VI podría vaciar las oficinas
-
Gemini convierte Excel en apps
-
El SSD SanDisk de 64 GB de hace 16 años se niega a...
-
Banda de ransomware TITAN afirma que su IA analiza...
-
Estudia ingeniería informática gratis con este rep...
-
700 agentes de IA coordinados secretamente para ha...
-
Atacan infraestructura de IA con RCE, inyección de...
-
Cárcel para un hombre de 68 años que ganó 1,3 mill...
-
Fallo en el plugin de donaciones GiveWP para WordP...
-
Meta pagará 18.000 millones por adicción a sus redes
-
Grave fallo de cPanel podría permitir que un usuar...
-
AWS muestra cómo credenciales robadas permiten ata...
-
Vulnerabilidades de TeamViewer permiten ejecución ...
-
Malware Massiv ataca apps de IPTV en España
-
Razer lanza colección por los 25 años de Xbox
-
Lanzada la actualización KB5120998 de Windows 11 c...
-
Más de 100 entidades tecnológicas piden reforzar l...
-
Zen 6 compatible con AM5
-
Instalan malware mediante currículums falsos de es...
-
Filtración en universidad rusa revela entrenamient...
-
Windows XP cumple 25 años
-
Más de 8.300 servidores Gitea expuestos a ataques ...
-
Vulnerabilidades en el robot humanoide Unitree G1 ...
-
Ya disponible Ubuntu 26.04.1 LTS
-
Photoshop integra IA para editar con prompts y boc...
-
Cae uno de los mayores imperios de la piratería mu...
-
OpenAI advierte que el reward hacking llevó a agen...
-
OpenAI crea IA autónoma
-
Casi 700 agentes de IA coordinados en el ataque a ...
-
Next.js corrige fallos críticos de AVIF y Windows ...
-
Bill Gates advierte sobre el impacto de la IA
-
PaperCut sufre un ataque de día cero que está golp...
-
Roban datos de 8,7 millones de clientes en tres ae...
-
Policía australiana detiene a presuntos cerebros d...
-
Vulnerabilidad en dispositivos TP-Link Kasa permit...
-
Vulnerabilidad crítica de cPanel permite control t...
-
Secuestran Claude Code Opus 5 Auto Mode mediante p...
-
CISA advierte vulnerabilidad en Citrix NetScaler e...
-
Ciberdelincuentes venden números de seguridad soci...
-
Google lanza Gemini Omni 1.1 Flash para vídeos pro...
-
LibreOffice 26.8 se actualiza y rechaza la IA
-
OpenAI banea cuentas de ChatGPT vinculadas a Rusia...
-
OpenAI limita mensajes de GPT-5.6 Sol en ChatGPT Plus
-
El FBI desarticula infraestructura de QTFY vincula...
-
Operación Jackal IV de INTERPOL: 58 detenidos y 26...
-
28.000 repositorios Git expuestos revelan claves A...
-
Claude Opus 4.6 vulnera el límite de reservas del ...
-
Mac Studio M5: potencia extrema para IA
-
Vulnerabilidades de SonicWall NetExtender permiten...
-
Vulnerabilidades críticas en Next.js permiten ejec...
-
Vulnerabilidad en plugin TranslatePress de WordPre...
-
Garmin actualiza funciones en modelos antiguos
-
21 fallos críticos de Ubiquiti UniFi permiten salt...
-
Apple renueva Mac Mini y Studio con chip de 2nm
-
Comando de Windows para liberar espacio sin riesgo...
-
Llega NVIDIA DLSS 4.5 Ray Reconstruction
-
China sustituirá Windows por Linux
-
Linux cumple 35: el kernel aficionado que ahora im...
-
El gusano Morris infectó el 10% de Internet
-
Amazon sube el precio de sus dispositivos Echo, Ki...
-
UE busca sustituir a Visa y Mastercard para 2029
-
Chrome 152: 327 correcciones de seguridad y 10 crí...
-
Alerta por vulnerabilidad crítica de RCE en Gitea ...
-
Fallos de OpenSSL permiten colapsar servidores y c...
-
Qualcomm rompe la barrera de los 5 GHz en smartpho...
-
OpenAI suspende cuentas rusas de ChatGPT vinculada...
-
Intel convierte Diamond Rapids en una bestia de 25...
-
EE. UU. impone sanciones a hackers vinculados a Ir...
-
Ciberataque masivo colapsa los servicios digitales...
-
91 vulnerabilidades de Spring afectan a más de 209...
-
AliExpress usa WebAudio API para rastreo silencios...
-
Passkeys de WhatsApp alcanzan mil millones de usua...
-
Falso análisis de Microsoft pide quitar antivirus ...
-
La IA preferida de los hackers es DeepSeek
-
Fallo en plataforma B2B de Tata permite robo de cu...
-
Ocho agentes de IA vulneran sistemas gubernamental...
-
Sony: los juegos digitales no son tuyos
-
AWS Network Firewall ya muestra el recuento de reg...
-
Fallo sin parchear en Calix permite a hackers salt...
-
DOOM 64 estrena trazado de trayectorias
-
Crisis de RAM hunde a marca de Linux Pine64
-
Falsa demo de GTA 6 es malware que roba contraseña...
-
Ciberatacantes aprovechan fallos de miniOrange SAM...
-
Fallo crítico en Red Hat Keycloak permite tomar cu...
-
AliExpress es señalada por rastrear usuarios media...
-
Una página web maliciosa podría contaminar tu mode...
-
IA china crea vídeos desde PowerPoint
-
Investigador revela cinco vulnerabilidades crítica...
-
Vulnerabilidades en TP-Link Archer permiten ataque...
-
-
►
2025
(Total:
2103
)
- ► septiembre (Total: 148 )
-
►
2024
(Total:
1110
)
- ► septiembre (Total: 50 )
-
►
2023
(Total:
710
)
- ► septiembre (Total: 65 )
-
►
2022
(Total:
967
)
- ► septiembre (Total: 72 )
-
►
2021
(Total:
730
)
- ► septiembre (Total: 56 )
-
►
2020
(Total:
212
)
- ► septiembre (Total: 21 )
-
►
2019
(Total:
102
)
- ► septiembre (Total: 14 )
-
►
2017
(Total:
231
)
- ► septiembre (Total: 16 )
-
►
2016
(Total:
266
)
- ► septiembre (Total: 38 )
-
►
2015
(Total:
445
)
- ► septiembre (Total: 47 )
-
►
2014
(Total:
185
)
- ► septiembre (Total: 18 )
-
►
2013
(Total:
100
)
- ► septiembre (Total: 3 )
-
►
2011
(Total:
7
)
- ► septiembre (Total: 1 )
Blogroll
Etiquetas
Entradas populares
-
Python 3.15 ya es oficial, introduciendo optimizaciones en TypedDict, Tachyon, JIT y soporte ABI para mejorar la productividad del ecosist...
-
La UE propone un temporizador de 30 minutos para bloquear el fútbol pirata y las IPTV, basándose en el modelo italiano Piracy Shield, afect...
-
Dopamine 3.0 ha lanzado el jailbreak para iOS 26 , confirmando que estas herramientas de desbloqueo siguen vigentes a pesar de las restricc...
Nemotron 3.5 Lightning acelera la IA en RTX
NVIDIA potencia la IA local con Nemotron 3.5 Lightning
- NVIDIA ha lanzado Nemotron 3.5 Lightning, un innovador modelo de código abierto diseñado para optimizar las cargas de trabajo de IA agéntica, logrando una velocidad hasta cuatro veces mayor en tarjetas GeForce RTX.
- Este lanzamiento llega acompañado de NeMo Switchyard, una biblioteca de código abierto capaz de gestionar y seleccionar automáticamente el modelo de IA más adecuado para cada etapa de una tarea específica.
NVIDIA presentó en el día de hoy a Nemotron 3.5 Lightning, su nuevo modelo de código abierto orientado específicamente a cargas de trabajo de IA agéntica. Este modelo se presentó junto a NeMo Switchyard, una biblioteca de código abierto encargada de decidir automáticamente qué modelo de IA debe utilizarse en cada fase de una tarea. La propuesta de NVIDIA parte de una idea sencilla: los agentes de IA que trabajan durante largos periodos no necesitan recurrir constantemente a enormes modelos de razonamiento. Muchas de sus operaciones son relativamente rutinarias. Como ejemplo, consultar herramientas, comprobar resultados, revisar código, responder consultas o delegar tareas. Para estos ejemplos, basta con utilizar modelos mucho más pequeños y rápidos.
Con esta arquitectura, NVIDIA busca crear lo que denomina un “sistema de modelos”, donde una IA de altas prestaciones se encargue de la planificación o de los problemas especialmente complejos y otros modelos especializados ejecuten el grueso del trabajo. El resultado de ello se traduce en una latencia, menor coste y un mejor aprovechamiento del hardware. Esto último es lo que importa, pues abre la puerta a una gran parte de estas cargas puedan ejecutarse de manera local en un PC con una GPU GeForce RTX, una workstation RTX PRO, un sistema DGX Spark, DGX Station o incluso dispositivos Jetson. Por no hablar de su futura plataforma RTX Spark.
NVIDIA Nemotron 3.5 Lightning tiene 30.000 millones de parámetros, pero solo utiliza 3.000 millones en cada operación
Nemotron 3.5 Lightning es un modelo Mixture-of-Experts de 30.000 millones de parámetros, aunque únicamente activa alrededor de 3.000 millones de parámetros para procesar cada token. Básicamente, es lo que utilizó la famosa compañía detrás de DeepSeek con su modelo. Esta "mezcla de expertos" permite conservar una capacidad considerable sin asumir el coste computacional que tendría ejecutar continuamente un modelo denso de 30.000 millones de parámetros. NVIDIA lo ha diseñado específicamente para agentes autónomos con grandes volúmenes de llamadas y tareas repetitivas. Es decir, donde la velocidad de respuesta y el coste de inferencia terminan siendo tan importantes como la capacidad máxima de razonamiento.
NVIDIA asegura que Nemotron 3.5 Lightning alcanza una velocidad de generación hasta cuatro veces superior a modelos abiertos de tamaño comparable. En PinchBench, NVIDIA afirma que consigue aproximadamente un 86% de precisión y completa 10.000 tareas un 30% más rápido que Qwen3.6 35B manteniendo una precisión similar.
Para conseguir esa velocidad, NVIDIA ha integrado predicción de múltiples tokens y speculative decoding. También necesitó recurrir a modelos auxiliares como DSpark y DFlash para ayudar a acelerar la generación. Nemotron 3.5 Lightning se distribuye además tanto en BF16 como en NVFP4, una cuantización de 4 bits destinada a reducir notablemente los requisitos de memoria y acelerar la inferencia. NVIDIA indica que el mismo checkpoint NVFP4 puede utilizarse desde servidores equipados con GPUs Blackwell, Hopper o Ampere, hasta sistemas locales como sus DGX Spark. El modelo también puede ejecutarse mediante herramientas habituales de IA local como LM Studio, llama.cpp, Ollama y Unsloth.
Uno de los puntos más importantes es precisamente que NVIDIA no limita el modelo a sus grandes centros de datos. La compañía confirma que puede ejecutarse de manera local en sistemas con una GeForce RTX 5090, DGX Spark y Jetson, mientras que en entornos empresariales puede escalar hacia workstations RTX PRO, centros de datos o directamente en la nube. Además, NVIDIA publica los pesos, recetas de entrenamiento y tantos datos de entrenamiento como permiten sus respectivas licencias de código abierto OpenMDW-1.1. Es decir, que permitir realizar ajustes mediante LoRA, supervised fine-tuning o reinforcement learning utilizando el ecosistema NeMo.
NeMo Switchyard decide automáticamente cuándo utilizar una IA potente y cuándo basta con un modelo más pequeño y rápido
La otra gran novedad es NVIDIA NeMo Switchyard. Hablamos de una biblioteca de código abierto destinada al model routing. En lugar de que una aplicación recurra siempre a GPT, Claude, Nemotron o Qwen, Switchyard analiza cada petición y decide cuál de los modelos disponibles ofrece el mejor equilibrio entre capacidad, coste y latencia. El sistema es independiente del proveedor, por lo que puede mezclar simultáneamente modelos abiertos, modelos comerciales y modelos de NVIDIA. Todo ello sin obligar al desarrollador a reconstruir su aplicación alrededor de cada servicio.
Por ejemplo, un agente de programación podría utilizar un modelo de razonamiento avanzado cuando tenga que entender una arquitectura compleja o solucionar un error difícil, pero recurrir posteriormente a Nemotron 3.5 Lightning para operaciones rutinarias, como realizar llamadas a las herramientas, modificar archivos, validar resultados o ejecutar acciones previamente planificadas. Switchyard puede incluso detectar que un modelo económico está teniendo dificultades y escalar automáticamente la tarea hacia un modelo más potente. También dispone de rutas basadas en clasificación, etapas de ejecución o algoritmos entrenables que estiman qué modelo tiene mayor probabilidad de resolver correctamente cada petición.
Las cifras publicadas muestran por qué NVIDIA considera este enfoque especialmente relevante para agentes que funcionan de manera continua. En una evaluación realizada junto a LangChain sobre 145 tareas agénticas multiturno, Switchyard repartió las peticiones entre Nemotron 3.5 Lightning y Claude Opus 4.8. Es decir, envió únicamente un 7% de las llamadas al modelo frontier. Según los resultados publicados, esto permitió reducir el coste en un 74%, aunque con una pérdida aproximada de seis puntos de precisión. Otros socios también han comunicado reducciones importantes. Ramp afirma haber reducido el coste un 58% y el tiempo de ejecución un 33%. Por su parte, Classmethod observó aproximadamente un 27% menos de coste manteniendo la calidad en sus primeras pruebas.
En resumen, la estrategia de NVIDIA no consiste simplemente en lanzar otro LLM más pequeño. Nemotron 3.5 Lightning y NeMo Switchyard están planteados como dos piezas complementarias de una misma arquitectura, donde los grandes modelos dejan de ejecutar absolutamente todo. Los modelos frontier se reservan para las partes realmente complejas. Los modelos pequeños, rápidos y potencialmente locales absorben la mayor parte de las operaciones. Este modelo híbrido cobrará gran importancia a medida que los asistentes tradicionales evolucionan hacia agentes autónomos que trabajan continuamente durante horas o incluso de forma permanente. Esto implicará ahorrar muchísimo dinero.
Fuentes:
https://elchapuzasinformatico.com/2026/08/nvidia-nemotron-3-5-lightning-modelo-ia/




Entrada más reciente
0 comentarios :
Publicar un comentario
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.