Tutoriales y Manuales
Entradas Mensuales
-
▼
2026
(Total:
5979
)
-
▼
July
(Total:
697
)
-
Llamada de Teams de dos minutos podría cifrar tu r...
-
Estafa de nueve años clona webs de empresas rusas ...
-
Explotan vulnerabilidad 0-day de Cisco FMC para ro...
-
Desarrollador afirma que Claude Opus 5 borró una b...
-
Node.js corrige 11 fallos de seguridad que pueden ...
-
Ciberplataforma que convierte llamadas de soporte ...
-
Raspberry Pi revela datos ocultos del operador DNS
-
SK Hynix consigue aumentar sus ganancias en un 557...
-
Vulnerabilidad en Copilot de Word convierte prompt...
-
Rusos aprovechan fallo de Microsoft OWA para mante...
-
ChatGPT llega a Linux
-
IA engaña y traiciona al gestionar un negocio sola
-
TA488 pudo explotar fallo 0-day de Outlook antes d...
-
Pixel 11 Pro: teaser de Pixel Glow
-
Nuevo ransomware GenieLocker ataca Windows, ESXi y...
-
Logitech lanza ratones con batería reemplazable en...
-
Chrome 151 corrige 370 fallos de seguridad, siete ...
-
Firefox añade función vídeos HDR para Windows 11
-
Fallo en Ruflo MCP permite a atacantes no autentic...
-
EEUU prohíbe robots extranjeros
-
Paquetes npm de Joyfill hackeados despliegan RAT y...
-
vBulletin soluciona vulnerabilidad crítica de RCE ...
-
Anthropic admite que Claude puede vulnerar el cifr...
-
Vulnerabilidad Zero-Day en Cisco FMC explotada act...
-
Grave fallo en Rails permitiría a atacantes leer a...
-
Fallo crítico en Rails permite leer archivos y eje...
-
Caída global de Claude afecta a usuarios con error...
-
1Password limita la IA
-
Gusano informático se infiltra en Copilot y desata...
-
Sospechan que CyberAv3ngers, vinculados a Irán, es...
-
Rusos roban claves de Signal para secuestrar cuent...
-
GOG Galaxy llega a Linux
-
eBay pagará 56 millones por acosar a periodistas
-
Phishing con IA ya no requiere malware: roba sesio...
-
Mejores lectores de eBooks para Linux
-
WhatsApp añade cifrado de extremo a extremo a llam...
-
Vulnerabilidad de 20 años permite controlar miles ...
-
Apple creará un iPad sumergible
-
Los primeros dispositivos de OpenAI: altavoz, smar...
-
Publican PoC para el bypass de autenticación explo...
-
Rusia acusa al CEO de Telegram, Pavel Durov, de ay...
-
Aparece un Intel Core i9-14901KE con únicamente 8 ...
-
Presunta brecha de datos en Revolut: dicen acceder...
-
Paquetes maliciosos de npm despliegan RAT contra d...
-
NVIDIA impulsa la Alianza Segura Open Source para ...
-
Filtración de datos en Bank of Baroda: accedieron ...
-
DEF CON prohíbe las gafas perversas al estilo de Meta
-
Botnet Tengu reinicia dispositivos Linux infectado...
-
Primer ciberataque de agente de IA autónomo infilt...
-
OpenAI libera Codex Security CLI para hallar y cor...
-
Vulnerabilidad crítica en Gitea permite ejecución ...
-
Puerta trasera en plugin Advanced Responsive Video...
-
Nuevo fallo de RCE en Gitea permite a redactores d...
-
Filtran cientos de chats de Claude por falta de in...
-
Fabricantes chinos lanzan portátiles con GPUs GeFo...
-
IA descubre zero-day en kernel de Linux para escal...
-
Radeon RX 9050: especificaciones
-
JFrog confirma que los modelos de OpenAI aprovecha...
-
Kimi K3: la IA china que desafía a OpenAI y Anthropic
-
PortSwigger lanza Burp AT Agentic AI para pruebas ...
-
Claude AI descifra esquema de prueba post-cuántica...
-
Estafadores fingen ser ShinyHunters para chantajea...
-
Investigadores: empresa fantasma china creó la red...
-
Nueva botnet Tengu Mirai reinicia tu IoT si intent...
-
Amodei niega querer prohibir la IA de código abierto
-
App del Vaticano expone a 700.000 usuarios por fal...
-
Filtración de datos en la firma de facturación méd...
-
Múltiples vulnerabilidades de FFmpeg permiten corr...
-
Botnet DDoS Dysphoria se extiende a 200.000 dispos...
-
Profesor atrapa a 32 alumnos copiando con IA media...
-
Microsoft afirma que su nuevo modelo de IA para ci...
-
Claude Opus 5 de Anthropic llega a AWS con mejoras...
-
Backups a tu NAS QNAP en 3 pasos: guía con HDP PC ...
-
Phineas Fisher, el hacker más famoso del mundo, si...
-
Fuga de Sandbox en n8n permite a editores de flujo...
-
Ubuntu 26.04 LTS impulsa la computación confidencial
-
Coca-Cola confirma robo de datos tras ataque de ra...
-
La botnet de IoT Dysphoria implementa C2 de blockc...
-
GitHub combate el malware
-
Alianza contra ciberataques de IA
-
El Explorador de Windows 11 borra archivos grandes...
-
Investigadores inician iOS 27 con jailbreak en iPh...
-
Fallo crítico de vBulletin permite ejecución remot...
-
Guía básica del SoC y su importancia
-
Bandas de ransomware atacan VPN de Palo Alto, Fort...
-
GitHub implementa periodo de espera de 3 días en D...
-
Movistar y Orange activan Starlink en zonas incend...
-
Zen 7 cerrará AM5 y Zen 8 ya se desarrolla
-
ChatGPT quiere que vincules tus datos de salud a s...
-
Fuga de datos en app del Papa
-
Fallo de AgentForger en ChatGPT permitiría despleg...
-
Ocho fallos de NodeBB permiten leer chats privados...
-
El precio de las tarjetas gráficas continúa subien...
-
Chats compartidos de Claude AI expuestos en Google
-
Ataques aprovechan vulnerabilidad RCE de Fastjson ...
-
OpenAI tardó diez días en informar a Hugging Face ...
-
AMD confirma que sus CPU EPYC «Florence» basadas e...
-
Europol identifica 4.340 URLs para su eliminación ...
-
SourTrade crea malware en navegadores para evadir ...
-
Hombre condenado a seis años de prisión por hackea...
-
Cómo los logs de infostealers impulsan filtracione...
-
Google lanza actualización urgente de Chrome por c...
-
Fallos de seguridad en cada script de ChatGPT, Cop...
-
Apache Syncope parchea vulnerabilidades de RCE e i...
-
Guías online para tus vacaciones
-
YouTube crea IA para miniaturas
-
CXMT ya se permite el lujo de cobrar más que Samsu...
-
PentesterFlow: IA para automatizar flujos de pente...
-
Qualcomm aumentará el precio de todos sus chips: l...
-
Microsoft eliminará dos funciones de Copilot el pr...
-
Cuatro novedades de WhatsApp
-
Vulnerabilidades de GitLab permiten ejecución remo...
-
Claude Code optimiza el desarrollo para iPhone
-
Se cumplen 20 años desde la compra de ATI Technolo...
-
Afiliados de Cl0p explotan vulnerabilidades de RCE...
-
Facebook sustituye el muro por vídeos
-
Facebook ofrece verificación gratuita a cambio de ...
-
OpenAI dividida por la regulación
-
Chrome permitirá guardar fotogramas de vídeos con ...
-
Los ladrones de memoria RAM desvalijan los ordenad...
-
Vulnerabilidad en juego Age of Empires II
-
Fallo en ChatGPT AgentForger permitiría desplegar ...
-
Exploit Certighost permite que usuarios de Active ...
-
Vulnerabilidad en Bing Images permite ejecutar cód...
-
Despliega agente de IA Hermes de forma autónoma pa...
-
Un gateway Wi-Fi comprometido puede redirigir a to...
-
Nueva vulnerabilidad HTTP/2 permite colapsar servi...
-
Las CPU AMD EPYC 9006 (Venice) son muy potentes: h...
-
-
▼
July
(Total:
697
)
Blogroll
Labels
Entradas populares
-
Revolut está siendo investigada luego de que unos hackers afirmaran estar vendiendo una base de datos con registros de más de 75 millones de...
-
Un profesor detectó que 32 de 35 alumnos copiaron usando IA al ocultar un prompt invisible en el examen .
-
Google ha actualizado el canal estable de Chrome a la versión 151.0.7922.71 (con ligeras variaciones según el sistema operativo). Esta actua...
NVIDIA optimiza Blackwell para DeepSeek y reduce costes x5
NVIDIA optimiza sus GPU Blackwell para la IA china DeepSeek, logrando reducir el coste de los tokens cinco veces para hacer los modelos avanzados más accesibles.
- NVIDIA ha implementado mejoras en sus GPU Blackwell específicamente diseñadas para la inteligencia artificial china DeepSeek, logrando que el coste de los tokens se reduzca cinco veces. Esta optimización busca combatir la barrera económica que impide a muchas empresas adoptar los modelos de IA más sofisticados debido a sus elevados precios de funcionamiento.
NVIDIA anunció que gracias a las optimizaciones de sus GPU Blackwell para DeepSeek se ha reducido notablemente el coste de los tokens. Y sí, a día de hoy, para uso generalizado, muchas empresas se están alejando de los modelos de IA más avanzados por una simple razón: el precio. Junto a la carrera de tener la IA más avanzada se ha abierto otro frente, ofrecer la mejor IA a razón de lo que una compañía paga por utilizarla. Y es que estamos hablando de que grandes empresas pueden ahorrar millones de dólares recurriendo a modelos menos avanzados, pero más que suficientes para cumplir con sus propósitos, y todo ello ahorrando muchísimo dinero por el camino.
Según NVIDIA, su plataforma Blackwell ha conseguido reducir hasta 5 veces el coste por token de DeepSeek V4 en apenas un mes. Lo más importante de todo, es que esta reducción no se ha conseguido lanzando nuevo hardware, sino por software. Hablamos así de que NVIDIA, en un mes, ha implementando unas optimizaciones de software que reducen el coste de los tokens en cinco veces en el hardware ya existente. Esto se traduce en reducir los costes a aproximadamente una quinta parte frente a los niveles iniciales.
DeepSeek ya era muy popular por su bajo coste, y ahora lo será aún más gracias a las optimizaciones en NVIDIA Blackwell
El matiz importante es que no hablamos necesariamente de una bajada directa en la tarifa pública para acceder a la API de DeepSeek, sino del coste de servir el modelo en producción. Es decir, lo que le cuesta a un proveedor de infraestructura ejecutar el modelo, mantener una latencia aceptable y entregar tokens a gran escala. Si ese coste baja, los operadores tienen más margen para reducir los precios, mejorar su rentabilidad o atender más tráfico con la misma inversión en hardware. Es decir, que se refuerzan bastantes frentes en el negocio de DeepSeek.
DeepSeek V4 es un modelo especialmente exigente para este tipo de pruebas. En su versión Pro, NVIDIA lo describe como un modelo Mixture-of-Experts con 1,6 billones de parámetros totales, de los cuales se activan unos 49.000 millones por inferencia. Además, soporta una ventana de contexto de hasta 1 millón de tokens, lo que lo hace adecuado para cargas de trabajo de código, agentes, análisis documental y razonamiento complejo. En esencia, no hay nada mejor si tenemos en cuenta su bajo coste.
La propia página oficial de precios de DeepSeek muestra actualmente dos variantes principales: DeepSeek V4 Flash, con un coste de 0,14 dólares por millón de tokens de entrada y 0,28 dólares por millón de tokens de salida, y DeepSeek V4 Pro, con 0,435 dólares por millón de tokens de entrada y 0,87 dólares por millón de tokens de salida. Ambas versiones ofrecen contexto de 1 millón de tokens y soporte para modos de razonamiento. Para que nos hagamos una idea, con OpenAI GPT-5.4 mini, en igualdad de condiciones, se pagaría hasta un 1.507% más y con Claude Haiko 4.5 hasta un 1.686% más (vs DeepSeek V4 Flash). Con GPT 5.4 se pagaría hasta 1.624% más y con Claude Sonnet 5 hasta un 1.049% más (vs DeepSeek V4 Pro).
La IA china sale muy reforzada gracias a las optimizaciones
La mejora anunciada por NVIDIA se basa en optimizaciones de software para la arquitectura Blackwell. La compañía cita técnicas como serving desagregado, mayor paralelismo para modelos MoE, uso de NVLink, precisión NVFP4, optimización de kernels, solapamiento entre cómputo y comunicación, y multi-token prediction. En conjunto, estas mejoras permiten reducir hasta cinco veces el coste por token de DeepSeek V4 y elevar el throughput en hasta 20 veces en determinados escenarios de inferencia.
Con esto, NVIDIA quiere reforzar la idea de que Blackwell no es solo una GPU más potente, sino una plataforma completa donde hardware, red, memoria, CUDA, TensorRT-LLM, Dynamo, vLLM, SGLang y el ecosistema open source trabajan de forma conjunta. De hecho, la compañía menciona a proveedores como Baseten, Deep Infra, DigitalOcean y Hippocratic AI, que ya estarían aprovechando estas optimizaciones para mejorar el rendimiento, aumentar los tokens por segundo o reducir la latencia en cargas reales de IA.
Con esta actualización, ahora NVIDIA mueve el debate a la rentabilidad que implica la compra de sus GPUs con el coste real de servir IA a gran escala. Aunque Blackwell sea la plataforma más costosa, NVIDIA defiende que su coste efectivo por token puede caer de forma continua mediante software. Esto también convierte a modelos como DeepSeek V4, abiertos y agresivos en precio, en un argumento a favor de NVIDIA: incluso si el modelo no es suyo, la compañía quiere demostrar que la forma más eficiente de desplegarlo sigue siendo sobre su infraestructura.
Fuentes:
https://elchapuzasinformatico.com/2026/07/nvidia-optimiza-gpu-blackwell-ia-china-deepseek-coste-tokens/










Newer Post
0 comments :
Post a Comment
Los comentarios pueden ser revisados en cualquier momento por los moderadores.
Serán publicados aquellos que cumplan las siguientes condiciones:
- Comentario acorde al contenido del post.
- Prohibido mensajes de tipo SPAM.
- Evite incluir links innecesarios en su comentario.
- Contenidos ofensivos, amenazas e insultos no serán permitidos.
Debe saber que los comentarios de los lectores no reflejan necesariamente la opinión del STAFF.