ESCRÍBENOS: contacto@techplanet.es

Tech Planet

  • HARDWARE
  • SOFTWARE
  • PERIFÉRICOS
  • FORMACIÓN
  • PRODUCTIVIDAD
  • NOTICIAS
  • PRESUPUESTOS PC
  • GUÍAS
  • RANKINGS
  • Inicio
  • Noticias
  • DeepSeek lanza V4.1-Flash, un modelo abierto que divide por cuatro la memoria de los agentes

DeepSeek lanza V4.1-Flash, un modelo abierto que divide por cuatro la memoria de los agentes

Módulo de memoria iluminado con la inscripción V4.1-Flash en primer plano, y detrás cuatro módulos iguales apagados. Imagen generada con IA.
jueves, 10 septiembre 2026 / Publicado en Noticias

DeepSeek lanza V4.1-Flash, un modelo abierto que divide por cuatro la memoria de los agentes

DeepSeek ha presentado V4.1-Flash, un modelo multimodal pensado sobre todo para reducir el coste de operar con contextos largos. Según recoge The Decoder, el mayor avance está en el uso de memoria, aunque la compañía también promete mejor rendimiento general. El modelo tiene 552.000 millones de parámetros y procesa contextos de hasta un millón de tokens.

El objetivo declarado por DeepSeek en su informe técnico es reducir el llamado KV cache, el búfer que guarda las partes de un contexto que el modelo ya ha procesado para no tener que recalcularlas en cada paso nuevo. En agentes que encadenan muchos pasos, ese búfer crece deprisa y satura la memoria de la GPU, el SSD y el ancho de banda de datos, lo que dispara los costes de despliegue.


Cómo consigue reducir tanto la memoria caché

La reducción se apoya en varias técnicas combinadas. Una divide el modelo en dos mitades: la primera procesa los datos de entrada y la segunda se apoya en esos resultados en lugar de recalcularlo todo. Al leer una entrada, el modelo activa solo 8.000 millones de parámetros por token, frente a los 16.000 millones que usa durante la generación de texto. DeepSeek asegura que esto reduce casi a la mitad el cómputo necesario para procesar la entrada, algo pensado específicamente para agentes que hacen llamadas frecuentes a herramientas.

La compañía también almacena el KV cache principal en FP4 en lugar de FP8, lo que según el informe reduce casi a la mitad la huella de memoria de esa parte del búfer. El resultado combinado es que el búfer en memoria rápida de la GPU necesita ahora solo una cuarta parte del espacio que usaba su predecesor, V4-Flash, y la parte que se descarga de forma permanente a SSD o a la memoria del host se reduce a aproximadamente una octava parte. Comparado con DeepSeek-V1, el tamaño global del KV cache por token ha caído en un factor de 437.


Entrenó con 45 billones de tokens y evitó nuevos algoritmos

El modelo se entrenó desde cero con un conjunto de datos de 45 billones de tokens que cubre texto e imágenes. En la fase de post-entrenamiento, DeepSeek evitó deliberadamente incorporar métodos nuevos. La compañía afirma que las mejoras principales no vinieron de algoritmos distintos, sino de datos más grandes y mejor controlados, junto con tareas y entornos de entrenamiento más cuidados; según DeepSeek, en este punto escalar así ayuda más que ajustar el algoritmo.

El informe también reconoce comportamientos problemáticos durante el entrenamiento: los agentes entrenados intentaron a veces manipular su propio sistema de recompensas, y en otros casos hicieron fallar el entorno de pruebas por accidente, llegando a explotar fallos de seguridad recién descubiertos o a borrar archivos críticos del sistema.


Supera por poco a Opus 5 y GPT-5.6 Sol en un test de programación, pero falla en otros

A pesar de activar relativamente pocos parámetros por token, DeepSeek dice obtener resultados cercanos a los modelos punteros en varios benchmarks, y en pruebas de agentes llega a igualar a modelos cerrados de referencia. En el test de software DeepSWE v1.1 supera por poco a Opus 5, de Anthropic, y a GPT-5.6 Sol, de OpenAI, con un 74,2 %, aunque en ProgramBench queda muy por detrás. El propio informe técnico admite además una brecha frente a los sistemas cerrados líderes en tareas de agentes que exigen conocimiento experto muy exigente y en la lectura de imágenes complejas.

Como otros modelos de razonamiento, permite ajustar la «profundidad de pensamiento» mediante un único valor, lo que intercambia coste de cómputo por precisión. Según el informe, el ajuste más alto mejora de forma notable los resultados en varios benchmarks, pero genera unas 2,5 veces más tokens de salida.


Disponible en Hugging Face bajo licencia MIT y sin subir el precio de la API

DeepSeek publica los archivos del modelo en Hugging Face bajo licencia abierta MIT, con la idea de que sirvan de punto de partida para seguir desarrollando agentes de IA más baratos. El modelo también está disponible a través de la API a los mismos precios que V4-Flash. Para quienes desarrollan agentes que encadenan muchas llamadas a herramientas, esto es lo relevante: se puede sostener un contexto de hasta un millón de tokens sin que el gasto en memoria de GPU, SSD o ancho de banda se dispare, y sin pagar más por ello en la API.

DeepSeek había mejorado sustancialmente a su predecesor, V4-Flash, con la actualización 0731 de finales de julio: aquel modelo, con 284.000 millones de parámetros y 13.000 millones activos, quedó a un solo punto de GPT-5.6 Luna en el Artificial Analysis Intelligence Index y costaba alrededor de un 60 % menos por tarea. A mediados de agosto, DeepSeek retiró de pruebas su modelo insignia, V4-Pro, y subió al mismo tiempo los precios de la API; los aciertos de caché, es decir, las entradas ya guardadas en el búfer, pasaron a costar seis veces más.


Más financiación, un posible salto a bolsa y uso por grupos de hackers

En junio, DeepSeek levantó unos 7.400 millones de dólares en su primera ronda de financiación externa, con una valoración superior a los 50.000 millones de dólares, y según recoge Reuters ha contratado ahora al banco de inversión chino CITIC Securities de cara a una posible salida a bolsa en China. La firma de seguridad taiwanesa TeamT5 asegura, además, que grupos de hackers chinos han más que duplicado sus ataques desde que empezaron a usar DeepSeek para generar código de explotación y rastrear redes.

Te puede interesar

Tech Planet participa en el programa de afiliados de Amazon. Si compras a través de estos enlaces, recibimos una pequeña comisión sin coste extra para ti, lo que nos ayuda a seguir creando contenido como este.

Imagen Producto Características Comprar
Samsung Portable SSD T9 2 TB Samsung Portable SSD T9 2 TB 2 TB · hasta 2.000 MB/s de lectura y escritura · USB 3.2 Gen 2×2 · resiste caídas de hasta 3 m Ver precio en Amazon
WD Elements Ae 4 TB WD Elements Ae 4 TB 4 TB · USB 3.2 Gen 1 · con software de copia de seguridad Ver precio en Amazon
SanDisk Extreme Pro USB-C 256 GB SanDisk Extreme Pro USB-C 256 GB 256 GB · hasta 1.000 MB/s de lectura · conector USB Type-C Ver precio en Amazon
SanDisk Extreme PRO microSDXC 256 GB SanDisk Extreme PRO microSDXC 256 GB 256 GB con adaptador SD · hasta 200 MB/s de lectura y 140 MB/s de escritura · categoría A2 Ver precio en Amazon


Escrito por Eloy Andrade

También podría interesarte

Arte oficial de StarCraft II: un marine terran disparando, un guerrero protoss con hojas de energía y Kerrigan a la derecha
El shooter de StarCraft se revelará en BlizzCon el 12 de septiembre
Arte oficial de Super Smash Bros. Ultimate con decenas de luchadores de Nintendo y Mario y Link en el centro
Un filtrador afirma que Nintendo prepara un nuevo Smash Bros y un Nintendogs
Procesador AMD Ryzen 5 7500 con el logotipo de AMD en la tapa, en primer plano sobre una superficie oscura lisa. Imagen generada con IA.
AMD prepararía un Ryzen 5 7500 con gráficos integrados, idéntico al 7500F pero mucho más caro

Deja una respuesta Cancelar la respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *

BUSCAR

POSTS RECIENTES

  • Vista Big Art del modo Big Picture de Steam, con el arte de un juego a pantalla completa y la fila de juegos recientes debajo.

    Steam Deck y Steam Machine estrenan salvapantallas personalizables en la beta

    Una nueva actualización beta del cliente de Ste...
  • Armarios servidores abiertos en un centro de datos, con cables de red azules, conectores de alimentación rojos y luces indicadoras. Imagen generada con IA.

    Un fallo crítico de Cisco FMC con CVSS 10.0 ya se explota activamente

    Cisco Talos ha confirmado que tres grupos disti...
  • Tarjeta gráfica GeForce RTX 5070 de NVIDIA, vista en diagonal sobre un fondo negro con ondas verdes.

    Nvidia recorta hasta un 20% sus envíos de GPU de consumo, según reportes

    Fabricantes como Asus, Gigabyte y AMD han subid...
  • Portátil sobre escritorio de madera con una marca de verificación verde y dos botones en la pantalla. Imagen generada con IA.

    Microsoft acelera las aprobaciones parentales en Windows 11

    Microsoft ha reducido el tiempo de espera para ...
  • Ilustración oficial de Google: una ventana de Chrome con un megáfono junto al rótulo «A new Chrome release every two weeks».

    Google pasa de cuatro a dos semanas entre versiones mayores de Chrome

    Google ha empezado a distribuir Chrome 153 en e...

ARCHIVO

  • septiembre 2026
  • agosto 2026
  • julio 2026
  • junio 2026
  • mayo 2026
  • abril 2026
  • marzo 2026
  • febrero 2026
  • enero 2026
  • diciembre 2025
  • noviembre 2025
  • octubre 2025
  • septiembre 2025

CATEGORÍAS

  • Consolas
  • Formación
  • Gaming
  • Guías
  • Hardware
  • Noticias
  • Periféricos
  • Presupuestos PC
  • Productividad
  • Rankings
  • Redes
  • Seguridad
  • Sistemas operativos
  • Software
  • Tablets
  • Tecnología
  • Todas las noticias

Tech Planet es tu punto de encuentro para estar al día en informática y hardware. Publicamos comparativas, configuraciones de PC, consejos de software y guías prácticas para que saques el máximo partido a tus equipos. Con un estilo claro y accesible, acercamos la tecnología a usuarios de todos los niveles.

Únete a la newsletter de Tech Planet

Cada domingo enviamos un resumen con los mejores artículos de la semana.

¡No hacemos spam! Lee nuestra política de privacidad para obtener más información.

Revisa tu bandeja de entrada o la carpeta de spam para confirmar tu suscripción.

contacto@techplanet.es

CATEGORÍAS

  • HARDWARE
  • SOFTWARE
  • PERIFÉRICOS
  • FORMACIÓN
  • PRODUCTIVIDAD
  • NOTICIAS
  • PRESUPUESTOS PC
  • GUÍAS
  • RANKINGS

SOCIAL MEDIA

TEXTOS LEGALES

  • AVISO LEGAL
  • POLÍTICA DE PRIVACIDAD
  • POLÍTICA DE COOKIES

Powered by Trígono Comunicación | © 2026  Tech Planet | En calidad de Afiliado de Amazon, Tech Planet obtiene ingresos por las compras adscritas que cumplen los requisitos aplicables.

SUBIR
Gestionar consentimiento
Para ofrecer las mejores experiencias, utilizamos tecnologías como las cookies para almacenar y/o acceder a la información del dispositivo. El consentimiento de estas tecnologías nos permitirá procesar datos como el comportamiento de navegación o las identificaciones únicas en este sitio. No consentir o retirar el consentimiento, puede afectar negativamente a ciertas características y funciones.
Funcional Siempre activo
El almacenamiento o acceso técnico es estrictamente necesario para el propósito legítimo de permitir el uso de un servicio específico explícitamente solicitado por el abonado o usuario, o con el único propósito de llevar a cabo la transmisión de una comunicación a través de una red de comunicaciones electrónicas.
Preferencias
El almacenamiento o acceso técnico es necesario para la finalidad legítima de almacenar preferencias no solicitadas por el abonado o usuario.
Estadísticas
El almacenamiento o acceso técnico que es utilizado exclusivamente con fines estadísticos. El almacenamiento o acceso técnico que se utiliza exclusivamente con fines estadísticos anónimos. Sin un requerimiento, el cumplimiento voluntario por parte de tu proveedor de servicios de Internet, o los registros adicionales de un tercero, la información almacenada o recuperada sólo para este propósito no se puede utilizar para identificarte.
Marketing
El almacenamiento o acceso técnico es necesario para crear perfiles de usuario para enviar publicidad, o para rastrear al usuario en una web o en varias web con fines de marketing similares.
  • Administrar opciones
  • Gestionar los servicios
  • Gestionar {vendor_count} proveedores
  • Leer más sobre estos propósitos
Ver preferencias
  • {title}
  • {title}
  • {title}