第一财经

DeepSeek V4.1 ya está en pleno funcionamiento; la guerra de precios de los modelos continúa

原文:DeepSeek V4.1 Flash转正,模型价格战继续

Análisis en profundidad: La “revolución en la relación calidad-precio” detrás del lanzamiento de DeepSeek V4.1 Flash y la jugada de capitales

Hola a todos, soy vuestro reportero financiero. Hoy no hablaremos de código aburrido, sino de una “guerra de precios” y una “avanzada tecnológica” que están remodelando el panorama de la industria de la inteligencia artificial.

El 10 de septiembre, DeepSeek lanzó oficialmente el modelo V4.1 Flash. Si tuviéramos que resumir este lanzamiento en una palabra, sería rápido y económico. Para los usuarios comunes, esto significa que las respuestas de la inteligencia artificial son más rápidas; para los desarrolladores, significa que el costo de utilizar este modelo es menor.

Pero detrás de esto, no se trata simplemente de una reducción de precios. DeepSeek no solo ha demostrado su capacidad técnica (su arquitectura), sino que también ha establecido alianzas importantes (como la colaboración con Tencent) y ha lanzado noticias significativas en el mercado de capitales (rumores de financiación e IPO).

A continuación, desglosaré esta noticia en cinco dimensiones clave para que puedan entender la lógica detrás de este “regreso del gran pez”.

---

1. Desglose técnico: ¿Por qué es tan inteligente y a la vez económico? (El uso inteligente de una arquitectura asimétrica)

Muchos que no tienen conocimientos técnicos se preguntarán: ¿Por qué los modelos de IA más grandes (con más parámetros) suelen ser más inteligentes? ¿Por qué DeepSeek ha logrado ser a la vez económico y rápido?

Es como abrir un restaurante. Antes, independientemente de si pedías un tazón de sopa o una cena completa, el equipo de cocina tenía que trabajar con un grupo de 50 cocineros. Esto aseguraba la calidad, pero el costo era muy alto y la eficiencia, baja.

DeepSeek ha adoptado una arquitectura de modelo asimétrica (Causal-Encoder-Decoder), que divide el proceso de cocina en dos etapas:

  • Etapa de entrada (leer el menú/comprender las necesidades): Solo se utiliza un grupo de 8B (8 mil millones de parámetros) para comprender rápidamente lo que has pedido. Dado que entender las instrucciones no requiere una lógica compleja, este grupo es suficiente.
  • Etapa de salida (preparar la comida/generar respuestas): Se utiliza un grupo de 16B (16 mil millones de parámetros) para preparar cuidadosamente las respuestas y asegurar su calidad.

Aunque el número total de parámetros es de 552B (552 mil millones), solo una pequeña parte de ellos se utiliza realmente cada vez que se responde a una pregunta. Este diseño de distribución de poder según las necesidades elimina una gran cantidad de cálculos innecesarios.

En resumen sencillo: Antes era como si todo el equipo trabajara horas extras; ahora, cada uno tiene una tarea específica. Se utiliza menos recursos en la entrada y más en la salida, lo que permite mantener un alto nivel de inteligencia mientras se reducen significativamente los costos y la latencia.

---

2. Revolución en los costos: ¿Qué significa una reducción de precios del 50% para los desarrolladores?

La noticia indica que el precio de V4.1 Flash ha disminuido drásticamente, especialmente para los casos de “caché de entrada”, con una reducción del 60%.

Aquí hay un concepto clave: el caché de clave-valor (KV Cache), que puede considerarse la “memoria a corto plazo” de la IA. Cuando interactúas repetidamente con la IA, esta necesita recordar las conversaciones anteriores para mantener la coherencia del contexto, lo que consume mucho espacio en memoria (HBM) y disco duro (SSD).

DeepSeek ha reducido la necesidad de memoria y disco duro a solo una cuarta parte y una octava parte, respectivamente, gracias a la actualización de su arquitectura.

¿Qué significa esto para las personas comunes?

  • Respuestas más rápidas: Dado que la memoria necesaria es menor, la IA puede leer y escribir información más rápido, sin ralentizaciones perceptibles.
  • Servicios más estables: Los servidores soportan mejor la carga y no colapsan fácilmente durante los picos de uso.

¿Qué significa esto para los desarrolladores y empresas?

  • Reducción de costos de implementación: Antes, para ejecutar una aplicación de IA, se necesitaban servidores caros. Ahora, el mismo servidor puede soportar a más usuarios, o se pueden utilizar servidores más económicos para el mismo número de usuarios.
  • Iniciación de una guerra de precios: Al reducir los precios, si los competidores (incluidos los modelos cerrados) no siguen el ejemplo, perderán a muchos desarrolladores sensibles al costo.

En resumen sencillo: Antes, la IA era un lujo; ahora se está convirtiendo en un producto básico. DeepSeek ha reducido los costos operativos, lo que también permite bajar los precios de sus servicios.

---

3. Alianzas ecológicas: ¿Por qué Tencent apuesta todo por DeepSeek?

Hay un detalle muy interesante en la noticia: herramientas como WorkBuddy y CodeBuddy de Tencent han sido completamente integradas con V4.1 Flash, y Tencent AI ha declarado abiertamente: “También tenemos nuestros propios modelos, pero el código abierto es mejor que los modelos privados”.

Esto revela un cambio importante en la estrategia de IA de Tencent: de actuar de manera independiente a aprovechar la fuerza de la comunidad.

  • Los planes de Tencent: Tencent tiene escenarios de comunicación y ofimática poderosos (WeChat, WeCom, Tencent Docs), pero sus modelos propios pueden no ser tan flexibles en términos de relación calidad-precio y influencia en la comunidad de código abierto como DeepSeek. En lugar de invertir mucho dinero en desarrollar un modelo “suficiente”, es mejor integrar DeepSeek, que ofrece la mejor relación calidad-precio en ese momento.
  • Vínculos de capital: No olvidemos que Tencent fue el mayor inversor externo en la ronda inicial de financiación de DeepSeek, con una inversión de aproximadamente 10 mil millones de yuanes. Esto no es solo una colaboración técnica, sino también un vínculo de capital. Con esta inversión, Tencent asegura su influencia en la infraestructura de IA.
  • Código abierto vs. cerrado: Al decir que el código abierto es mejor que los modelos privados, Tencent está enviando un mensaje al mercado: en el segmento empresarial, los modelos abiertos, personalizables y económicos son más atractivos. La naturaleza abierta de DeepSeek se ajusta perfectamente a las necesidades de Tencent de construir una comunidad abierta.

En resumen sencillo: Tencent no quiere reinventar la rueda; prefiere utilizar el “motor más potente” que es DeepSeek y adaptarlo a sus propios productos. Ambas partes obtienen lo que necesitan: DeepSeek recibe tráfico y financiación, mientras que Tencent consigue una capacidad IA de bajo costo y alto rendimiento.

---

4. Implementación de productos: De “robots de conversación” a “fábricas de agentes inteligentes”

Este lanzamiento no es solo una actualización del modelo, sino también una actualización del DeepSeek Harness (marco de agentes inteligentes) a la versión v0.1.5.

¿Qué es un “agente inteligente” (Agent)? Antes, la IA solo respondía a las preguntas; ahora, un agente inteligente puede buscar información, escribir código, operar software y completar tareas, como un estudiante aprendiz.

DeepSeek Harness promueve el concepto de que todo es un plugin, lo que significa:

  • Modularidad: Modelos, herramientas y habilidades pueden combinarse libremente, como piezas de Lego.
  • Integración profunda: El modelo V4.1 Flash ha sido entrenado específicamente para diferentes configuraciones de Harness. Es decir, el modelo y el marco están “hechos a medida” para una mayor eficiencia.

¿Por qué es importante?

  • Menor umbral de desarrollo: Los desarrolladores no necesitan crear aplicaciones de IA complejas desde cero; pueden simplemente arrastrar plugins en Harness para crear rápidamente empleados inteligentes.
  • Ocupación del mercado empresarial: A las empresas no les interesan las conversaciones; necesitan empleados digitales que puedan manejar correos electrónicos, analizar datos y escribir código. DeepSeek está penetrando profundamente en el mercado empresarial.

En resumen sencillo: DeepSeek ya no solo vende “cerebros” (modelos), sino también “personas completas” (marcos de agentes inteligentes). Espera que los desarrolladores puedan crear todo tipo de aplicaciones de IA rápidamente, así como construir todo el mercado de aplicaciones de IA.

---

5. Flujos ocultos de capital: La financiación de 50 mil millones y el ambicioso plan de IPO en la Plataforma de Innovación Científica y Tecnológica

Finalmente, analicemos el aspecto más sensible del capital:

  • Rumores de financiación: DeepSeek planea iniciar su segunda ronda de financiación, recaudando 500 mil millones de yuanes, con una valoración previa de 500 mil millones de yuanes.
  • Rumores de IPO: Ha contactado a CITIC Securities y está considerando cotizar en la Plataforma de Innovación Científica y Tecnológica, con un objetivo de salida al mercado en 2027.

Aunque DeepSeek no ha respondido oficialmente, estos rumores no son infundados.

¿Por qué es tan alta la valoración?

1. Barreras técnicas: La arquitectura asimétrica y la optimización de costos demuestran su liderazgo tecnológico.

2. Posición en el mercado: DeepSeek ha creado un efecto ecológico similar al de Android en el campo de los modelos abiertos, lo que genera una alta fidelidad por parte de los desarrolladores.

3 Valor estratégico: En un contexto en el que el país promueve la autonomía y control de la IA, DeepSeek tiene un gran valor estratégico.

¿Qué significa un IPO?

  • Inyección de capital: La IA es un sector que consume mucho dinero; entrenar modelos grandes y comprar capacidad de cálculo requiere una gran cantidad de fondos. Una financiación en bolsa puede aliviar la presión financiera.
  • Anclaje de la valoración: Una vez que se cote en bolsa, la valoración de DeepSeek se convertirá en un indicador para la industria de IA en China.
  • Atracción de talento: La noticia menciona que el equipo está “muy escaso” y que se están ofreciendo 150 puestos de ingeniero. La expectativa de una salida a bolsa y las opciones de incentivo financiero son un fuerte atractivo para los mejores talentos en IA.

Riesgos:

  • Presión de rentabilidad: El mercado de capitales finalmente se fijará en las ganancias. Aunque los costos de DeepSeek son bajos, aún no está claro cómo pasará de ser gratuito/barato a ser rentable a escala.
  • Regulación y competencia: Con la presión de gigantes como Tencent, Alibaba y Baidu, así como de empresas extranjeras como OpenAI y Anthropic, DeepSeek necesita mantener su liderazgo tecnológico.

En resumen sencillo: DeepSeek está pasando de ser una empresa de geeks técnicos a ser un potencial gigante tecnológico. La financiación de 500 mil millones y el plan de IPO indican que su ambición no es solo crear un modelo útil, sino convertirse en un proveedor de infraestructura en el campo de la IA, incluso desafiando el panorama global.

---

Resumen general

El lanzamiento de DeepSeek V4.1 Flash es un triunfo en tres frentes: técnico, comercial y capital:

1. Técnicamente, ha logrado una gran inteligencia a un bajo costo gracias a su arquitectura asimétrica, rompiendo el mito de que los modelos grandes necesitan costos elevados.

2. Comercialmente, ha consolidado su posición en el mercado de alta relación calidad-precio y ha acelerado la implementación de la IA en el segmento empresarial mediante reducciones de precios y alianzas.

3. Capitalmente, con una gran financiación y planes de IPO, ha almacenado suficientes recursos para el desarrollo futuro y la competencia en el mercado.

Para las personas comunes, esto significa que en el futuro disfrutaremos de servicios de IA más económicos, rápidos e inteligentes; para la industria, DeepSeek está utilizando una estrategia de código abierto y alta relación calidad-precio para impulsar a toda la industria de IA hacia una nueva etapa más racional, centrada en la eficiencia y la aplicación práctica.

El gran pez ha regresado, y esta vez, con dientes más afilados y bolsillos más profundos.