第一财经

DeepSeek V4.1 wird offiziell eingeführt – der Preiskampf der Modelle geht weiter

原文:DeepSeek V4.1 Flash转正,模型价格战继续

Tiefer Einblick: Die „Preis-Leistungs-Revolution“ hinter der Veröffentlichung von DeepSeek V4.1 Flash und das Spiel der Kapitalmächte

Hallo zusammen, ich bin euer Finanzjournalist. Heute sprechen wir nicht über trockenen Code, sondern über einen „Preiskampf“ und eine „technische Durchbruch“, die das Geschehen in der KI-Branche neu gestalten.

Am 10. September hat DeepSeek offiziell das V4.1 Flash-Modell veröffentlicht. Wenn man diese Veröffentlichung mit einem Wort beschreiben sollte, dann wäre es „schnell und kostengünstig“. Für normale Nutzer bedeutet das, dass die Antworten auf ihre Fragen noch schneller kommen; für Entwickler bedeutet es, dass ihre Budgets bei der Nutzung dieses Modells weniger schnell schrumpfen.

Doch dahinter steckt mehr als nur eine Preissenkung. DeepSeek hat nicht nur seine technischen Fähigkeiten unter Beweis gestellt, sondern auch die Unterstützung eines starken Partners (Tencent) erhalten und zudem eine Bombe im Kapitalmarkt platziert (Gerüchte über Finanzierung und Börsengang).

Im Folgenden werde ich diese Nachricht in fünf Kernaspekte unterteilen und euch die Logik hinter diesem „Rückkehr des „Großen Wals“ verständlich machen.

---

1. Technische Analyse: Warum ist es sowohl intelligent als auch günstig? (Die Kunst der asymmetrischen Architektur)

Viele Nicht-Techniker fragen sich vielleicht: Je größer ein KI-Modell ist (je mehr Parameter es hat), desto intelligenter ist es in der Regel. Warum schafft es DeepSeek, sowohl günstig als auch schnell zu sein?

Stellen Sie sich vor, Sie eröffnen ein Restaurant. Früher musste das Küchenpersonal, egal ob Sie nur eine Suppe oder ein komplettes Festmahl bestellen, immer mit einer 50-köpfigen Mannschaft arbeiten. Das garantierte zwar die Qualität, war aber sehr kostspielig und ineffizient.

DeepSeek hat diesmal eine asymmetrische Modellarchitektur (Causal-Encoder-Decoder) verwendet, die das Küchenpersonal in zwei Bereiche aufteilt:

  • Eingabephase (Menü lesen/Anforderungen verstehen): Hier wird nur ein kleines Team mit 8 Milliarden Parametern eingesetzt, um schnell zu verstehen, was Sie möchten. Da die Anweisungen nicht zu komplex sind, reicht dieses Team aus.
  • Ausgabephase (Antworten erstellen): Für die Ausarbeitung der Antworten wird ein großes Team mit 16 Milliarden Parametern eingesetzt, um die Qualität der Antworten zu gewährleisten.

Obwohl die Gesamtanzahl der Parameter 552 Milliarden beträgt, wird bei jeder Antwort nur ein kleiner Teil tatsächlich genutzt. Diese bedarfsorientierte Verteilung der Rechenleistung reduziert unnötige Berechnungen erheblich.

Einfache Zusammenfassung: Früher musste das ganze Team Überstunden machen – jetzt arbeiten nur die richtigen Personen an den richtigen Stellen. Bei der Eingabe wird weniger Rechenleistung benötigt, bei der Ausgabe werden die besten Ressourcen eingesetzt. So kann DeepSeek trotz hoher Intelligenz die Rechenkosten und Verzögerungen deutlich senken.

---

2. Preisrevolution: Was bedeutet die Halbierung der Preise für Entwickler?

In der Nachricht wird erwähnt, dass die Preise für V4.1 Flash deutlich gesenkt wurden, insbesondere der Preis für „Cache-Einträge“ um 60%.

Hier kommt ein wichtiger Begriff ins Spiel: KV-Cache (Key-Value-Cache), das man sich als die „kurzfristige Speicherung“ der KI vorstellen kann. Wenn Sie mit der KI kontinuierlich kommunizieren, muss sie sich an frühere Gespräche erinnern, um den Kontext zu bewahren. Dieser Prozess verbraucht viel Speicher (HBM) und Festplatte (SSD).

Durch die Architekturverbesserung hat DeepSeek den Speicherbedarf auf 1/4 und den Festplattenbedarf auf 1/8 reduziert.

Was bedeutet das für die Allgemeinheit?

  • Schnellere Reaktionen: Da weniger Speicher benötigt wird, ist die Geschwindigkeit der Informationsabrufung und -speicherung höher – Sie bemerken keine Verzögerungen.
  • Stabilere Dienste: Die Server werden weniger belastet und fallen in Spitzenzeiten seltener aus.

Was bedeutet das für Entwickler/Unternehmen?

  • Gesunkene Implementierungskosten: Früher mussten teure Server eingesetzt werden, um KI-Anwendungen zu betreiben. Jetzt können die gleichen Server mehr Nutzer bedienen – oder für die gleiche Anzahl von Nutzern werden billigere Server benötigt.
  • Beginn eines Preiskampfs: Da DeepSeek die Preise gesenkt hat, werden andere Konkurrenten (einschließlich proprietärer Modelle), die nicht nachziehen, viele kostensensitive Entwickler verlieren.

Einfache Zusammenfassung: KI war früher ein Luxusgut – jetzt wird es allmählich zu einem Alltagsartikel. Durch technische Optimierungen hat DeepSeek die Kosten für Rechenleistung gesenkt und kann dadurch auch die Gebühren für die Nutzung der APIs (APIs) reduzieren.

---

3. Ökologische Allianz: Warum setzt sich Tencent so stark für DeepSeek ein?

In der Nachricht wird erwähnt, dass Tools wie WorkBuddy und CodeBuddy von Tencent vollständig auf V4.1 Flash integriert wurden und dass Tencent AI öffentlich erklärt hat: „Wir haben auch unsere eigenen Modelle, aber Open Source ist besser als proprietäre Lösungen.“

Dies zeigt einen wichtigen Wandel in Tencents KI-Strategie: Vom Alleingang zur Nutzung einer Ökologie.

  • Tencents Plan: Tencent verfügt über starke soziale und geschäftliche Plattformen (WeChat, WeCom, Tencent Docs), aber eigene große Modelle sind möglicherweise nicht so flexibel wie DeepSeek in Bezug auf Preis-Leistungs-Verhältnis und Einfluss auf die Open-Source-Community. Anstatt viel Geld in die Entwicklung eines „ausreichenden“ Modells zu investieren, ist es sinnvoller, das kostengünstigste Modell zu nutzen und es direkt in seine Produkte zu integrieren.
  • Kapitalbindung: Tencent war einer der größten externen Investoren in der ersten Finanzierungsrunde von DeepSeek (ca. 10 Milliarden Yuan). Dies ist nicht nur eine technische Zusammenarbeit, sondern auch eine Kapitalbindung. Durch die Investition sichert sich Tencent einen Einfluss auf die Grundlagen der KI-Infrastruktur.
  • Open Source vs. Proprietär: Tencents Aussage „Open Source ist besser als proprietär“ signalisiert dem Markt, dass offene, anpassbare und kostengünstige Open-Source-Modelle im B2B-Markt besonders attraktiv sind. DeepSeeks Open-Source-Charakter passt perfekt zu Tencents Ziel, eine offene Ökologie aufzubauen.

Einfache Zusammenfassung: Tencent möchte nicht alles selbst entwickeln, sondern nutzt DeepSeeks „stärksten Motor“, um seine eigenen Produkte zu ergänzen. Beide Parteien erhalten, was sie benötigen: DeepSeek erhält Traffic und Kapital, Tencent hochwertige KI-Fähigkeiten.

---

4. Produktimplementierung: Vom „Chatbot“ zur „Agent-Fabrik”

Die Veröffentlichung umfasst nicht nur die Aktualisierung des Modells, sondern auch die Aktualisierung von DeepSeek Harness auf Version 0.1.5.

Was ist ein „Agent“? Frühere KI-Systeme antworteten nur auf Fragen – wie ein Kundenservice. Heutige KI-Agenten können selbst Informationen suchen, Code schreiben, Software steuern und Aufgaben erledigen – wie Praktikanten.

DeepSeek Harness fördert das Konzept der „Alles als Plugin“: Modelle, Tools und Fähigkeiten können wie Lego-Steine frei kombiniert werden.

Warum ist das wichtig?

  • Gesenkte Entwicklungshürden: Entwickler müssen keine komplexen KI-Anwendungen von Grund auf erstellen, sondern können einfach Plugins in DeepSeek Harness einfügen, um sofort funktionierende KI-Anwendungen zu erstellen.
  • Eroberung des B2B-Marktes: Unternehmen benötigen nicht nur Chatfunktionen, sondern „digitale Mitarbeiter“, die E-Mails bearbeiten, Daten analysieren und Code schreiben können. DeepSeek dringt damit tief in den B2B-Markt ein.

Einfache Zusammenfassung: DeepSeek verkauft nicht mehr nur „Gehirne“ (Modelle), sondern „vollständige Systeme“. Es möchte, dass Entwickler schnell verschiedene KI-Anwendungen erstellen können – und somit den gesamten KI-Anwendungsmarkt erschließen.

---

5. Kapitalströmungen: 50 Milliarden an Finanzierung und der Ehrgeiz eines Börsengangs auf dem Science and Technology Innovation Board (STAR Market)

Zum Schluss schauen wir uns die sensiblen Kapitalaspekte an:

  • Finanzierungsgerüchte: DeepSeek plant eine zweite Finanzierungsrunde mit dem Ziel, 50 Milliarden Yuan zu beschaffen, bei einer vorfinanziellen Bewertung von 500 Milliarden Yuan.
  • Börsengangsgerüchte: Es wurden Kontakte zu CITIC Securities aufgenommen; ein Börsengang auf dem STAR Market im Jahr 2027 wird in Betracht gezogen.

Obwohl DeepSeek offiziell nichts bestätigt hat, basieren diese Gerüchte auf fundierten Informationen.

Warum ist die Bewertung so hoch?

1. Technologische Barriere: Die asymmetrische Architektur und die extreme Kosteneffizienz belegen die technologische führende Position von DeepSeek.

2. Marktposition: In der Open-Source-Modell-Branche hat DeepSeek bereits einen ähnlichen Ökoeffekt wie Android – die Entwickler sind stark an das Unternehmen gebunden.

3 Strategischer Wert: Angesichts der staatlichen Förderung der KI-Unabhängigkeit hat DeepSeek einen hohen strategischen Wert.

Was bedeutet ein Börsengang?

  • Finanzierung: Die KI-Branche ist kostspielig; der Börsengang kann finanzielle Unterstützung bieten.
  • Bewertungssignal: Ein Börsengang könnte DeepSeeks Bewertung zum Maßstab für die chinesische KI-Branche machen.
  • Talentattraktion: Die Nachricht erwähnt, dass das Team dringend Nachwuchs sucht (150 Ingenieure werden eingestellt). Die Aussicht auf einen Börsengang und Beteiligungsgelder sind eine starke Anziehungskraft für Top-KI-Fachkräfte.

Risiken:**

  • Gewinndruck: Der Kapitalmarkt wird letztendlich auf die Gewinne achten. Obwohl DeepSeek Kosten senkt, bleibt unklar, wie es von „kostenlos/geringen Preisen“ zu „skalierbaren Gewinnen“ kommen kann.
  • Regulierung und Wettbewerb: Mit dem Druck von Giganten wie Tencent, Alibaba, Baidu sowie ausländischen Unternehmen wie OpenAI und Anthropic muss DeepSeek seine technologische Führungsposition aufrechterhalten.

Einfache Zusammenfassung: DeepSeek entwickelt sich von einem „Technik-Enthusiasten-Unternehmen“ zu einem potenziellen Technologiegiganten. Die geplante Finanzierung und der Börsengang zeigen, dass es nicht nur ein gutes Modell entwickeln will, sondern zum „Infrastrukturanbieter“ im Bereich KI werden möchte – und sogar die globale KI-Struktur herausfordern will.

---

Fazit

Die Veröffentlichung von DeepSeek V4.1 Flash ist ein Dreiklang aus Technologie, Business und Kapital:

1. Technologisch hat DeepSeek mit der asymmetrischen Architektur einen Weg gefunden, „große Intelligenz bei geringen Kosten“ zu schaffen und das „Fluchbild“ der hohen Kosten für große Modelle zu durchbrechen.

2. Businesslich hat es durch Preissenkungen und die Zusammenarbeit mit Tencent seine Dominanz auf dem Markt mit hohem Preis-Leistungs-Verhältnis gefestigt und die Einführung von KI in den B2B-Bereich beschleunigt.

3. Kapitalmäßig hat es mit der geplanten Finanzierung und dem Börsengang genügend Mittel für zukünftige Forschung und Entwicklung sowie den Wettbewerb bereitgestellt.

Für die Allgemeinheit bedeutet dies, dass wir in Zukunft günstigere, schnellere und intelligente KI-Dienste erhalten werden; für die Branche bedeutet es, dass DeepSeek mit seiner Strategie von Open Source und hohem Preis-Leistungs-Verhältnis die gesamte KI-Branche zu einem rationaleren, effizienteren und praktischeren Bereich führt.

Der „Große Wal“ ist zurück – und dieses Mal mit schärferen Zähnen und tieferen Taschen.