虎嗅

Geheimnisvolles Modell Union Alpha greift an: Am ersten Tag wurden 2 Milliarden Tokens verkauft. Einige Nutzer berichten, dass die Leistung nahe an der von Astra liegt.

原文:神秘模型Union Alpha 突袭,上线首日跑掉20亿Token,部分网友实测称性能直逼Astra

Das mysteriöse Modell „Union Alpha“ macht Aufsehen: Ein „Blindtest“ ohne Markenname

Hallo zusammen, ich bin euer Finanzjournalist. Heute sprechen wir nicht darüber, welches große Unternehmen ein neues Handy veröffentlicht hat oder wie der Aktienmarkt sich entwickelt, sondern über eine besonders „spannende“ Entwicklung in der Welt der KI.

Gestern (16. September) tauchte plötzlich ein mysteriöses KI-Modell namens Union Alpha wie ein Geist auf der Plattform OpenRouter auf. Es hat keinen Namen, keine Entwicklerteam, keine Anleitung – und nicht einmal einen Preis – denn es ist kostenlos.

Stellen Sie sich vor, ein Michelin-Restaurant würde plötzlich auf der Straße einen Stand aufbauen, der Koch trägt eine Maske, die Gerichte sind kostenlos, und man wird gebeten: „Diese Gerichte wurden von einem Top-Koch zubereitet, aber ich verrate Ihnen nicht, wer er ist – probieren Sie sie einfach selbst aus.“

Das Ergebnis? Die Leute sind verrückt geworden. Am ersten Tag wurden 2 Milliarden Token verbraucht (Sie können das als Einheit für die Menge an Informationen verstehen, die die KI verarbeitet), und inzwischen sind es bereits über 100 Milliarden Token.

Was ist eigentlich los? Wer steckt hinter diesem mysteriösen Modell? Ist es wirklich so großartig? Heute werde ich diese Geschichte in fünf Teilen für Sie verständlich erklären.

---

1. Was ist „Union Alpha“ – und warum ist es so beliebt?

Zunächst müssen wir herausfinden, um was es sich bei „Union Alpha“ handelt.

Einfach ausgedrückt: Es ist ein „unsichtbarer“ hochentwickelter KI-Helfer.

  • Fähigkeiten: Laut offiziellen Angaben kann es Bilder analysieren, Code schreiben, Forschungen durchführen und komplexe Probleme schrittweise lösen (das nennt man „Intelligenzwerkfluss“). Seine „Erinnerung“ (der Kontextbereich) ist sehr groß – es kann etwa 256.000 Wörter eines Gesprächs speichern und gleichzeitig Antworten von 130.000 Wörtern geben.
  • Preis: 0 Euro – Sie haben richtig gelesen, es ist völlig kostenlos.
  • Identität: Vollkommen geheim. OpenRouter (die Plattform, die Anfragen an verschiedene KI-Modelle verteilt) gibt nur an, dass es von einer „dritten Partei anonym“ bereitgestellt wird; OpenRouter selbst ist nur der Überbringer der Nachrichten.

Warum ist es so beliebt?

Weil es kostenlos ist, mysteriös und als Top-Modell beworben wird.

Stellen Sie sich vor, Sie sehen ein Restaurant im Einkaufszentrum mit der Aufschrift „Alles kostenlos – und von höchster Qualität“. Aber Sie dürfen nicht fragen, wer der Besitzer ist. Dieser große Kontrast und die Neugierde haben das Internet sofort in Aufruhr versetzt. Entwickler strömen herbei, um zu sehen, ob es wirklich so gut ist.

---

2. Tests von Nutzern: Ist es ein „Wunder“ oder eine Falle?

Da es kostenlos ist, wollten viele es selbst ausprobieren. Die Meinungen im Internet schwanken extrem: Einige loben es in den Himmel, andere kritisieren es scharf. Schauen wir uns die echten Benutzerbewertungen an:

✅ Positive Bewertungen:

  • Ähnlich wie GPT: Viele Nutzer finden, dass sein Sprachstil dem von OpenAI’s GPT ähnelt – klar und schnell reagierend.
  • Starke Code-Fähigkeiten: Eine Gruppe namens Mike Gannotti führte 157 Tests durch; Union Alpha erzielte 136 von 157 Punkten (86,6 %) – und das ohne Fehler. Obwohl es in einigen Tests etwas langsamer war als ein anderes Modell, ist der Preis-Leistungs-Verhältnis unschlagbar, da es kostenlos ist.
  • Gute visuelle Fähigkeiten: Es kann Bilder verstehen und basierend darauf Code schreiben oder Fragen beantworten.
  • Vergleichsvorteile: In Bereichen wie Code-Schreiben, Mathematik und logischer Denkweise performt es besser als das vorherige mysteriöse Modell „Ox Alpha“ (das später als Glm-5.3-Flash von Zhipu identifiziert wurde).

❌ Negative Bewertungen:

  • Sehr langsam: Das ist das größte Manko. Viele Nutzer beschweren sich, dass es lange braucht, um auf Fragen zu reagieren. Ein Nutzer sagte: „Bei der Nutzung in OpenCode blieb es ständig bei ‚überlege‘ und gab keine Antwort.“
  • Stabilitätsprobleme: Es neigt dazu, bei langen Aufgaben zu versagen – beispielsweise funktionieren frühere Funktionen nicht mehr oder es gibt Fehler.
  • Fehlschläge bei einfachen Tests: Ein Nutzer bemerkte, dass es sogar einfache logische Tests nicht bestehen konnte, was enttäuschend war.
  • Preis-Leistungs-Verhältnis: Obwohl es kostenlos ist, ist die Wartezeit bei der Ausführung vieler Aufgaben ein Kostenfaktor. In einigen Programmier-Benchmarks (DeepSWE) schneidet es nur knapp besser ab als das teure Modell Opus 5 ab – allerdings ist die Geschwindigkeit deutlich langsamer.

📊 Daten sprechen für sich:

  • SMF-Test: 136/157 Punkte (86,6 %), sehr gute Leistung.
  • DeepSWE-Test: 74 Punkte – auf dem Niveau von GPT-6 Astra (ein sehr hoher Wert).
  • Terminal-Bench v4: Etwa 50 Punkte; der Kostenfaktor pro Aufgabe beträgt 1,5–2 Euro (wenn man es kostenpflichtig betrachtet).

Zusammenfassung: Es ist tatsächlich sehr intelligent, besonders in logischen und programmierbezogenen Bereichen – aber seine Langsamkeit ist sein größtes Problem. Es ist wie ein Ferrari mit einem starken Motor, aber einem etwas klemmenden Getriebe – die Fahrt ist nicht besonders reibungslos.

---

3. Wer steckt hinter Union Alpha? Die Spekulationen der Nutzer

Da das Modell keinen Namen preisgibt, haben die Nutzer angefangen, zu rätseln. Es gibt drei Hauptvermutungen:

🕵️‍♂️ Vermutung 1: Ist es OpenAI’s „GPT-6 Luna“?

  • Gründe:

1. Sprachstil: Der Tonfall erinnert an OpenAI’s Modelle.

2. Zeitpunkt: Sam Altman (CEO von OpenAI) kündigte an, in dieser Woche etwas Großes zu veröffentlichen.

3. Reaktion auf Fragen: Ein chinesischer Nutzer versuchte, das Modell mit speziellen Anweisungen zu manipulieren – das Modell antwortete mit „ChatGPT, OpenAI“.

4. Ungewöhnliche Token-Zählweise: Die Token-Zählweise des Modells unterscheidet sich von üblichen Open-Source-Modellen.

🕵️‍♂️ Vermutung 2: Ist es Zhipu’s „GLM 5.4“?

  • Gründe:

1. Vorherige Erfahrungen: Das frühere mysteriöse Modell „Ox Alpha“ war tatsächlich Glm-5.3-Flash von Zhipu.

2 Übereinstimmende Technik: Die Token-Zählweise von Union Alpha ist identisch mit der der Glm-5-Serie.

3. Andere Unterschiede: Die Kontextlänge von Glm-Modellen beträgt in der Regel etwa 1 Million Wörter; Union Alpha verwendet nur 256.000 Wörter. Zudem reagiert das Modell auf sensible Themen recht direkt.

🕵️‍♂️ Vermutung 3: Ist es Mistral oder ein anderes europäisches oder amerikanisches Unternehmen?

  • Gründe:

1. **Fehlender „chinesischer Einfluss“: Da es sensible Themen nicht meidet, wird es oft als nicht-chinesisches Modell eingestuft.

2. Neue Produkte von Mistral: Das französische KI-Unternehmen Mistral hat lange kein neues Modell veröffentlicht.

3. Kontextlänge: Die 256.000 Wörter entsprechen der Designphilosophie einiger europäischer und amerikanischer Modelle.

🔍 Mein Kommentar als Journalist:

Es gibt keine offiziellen Beweise für eine dieser Vermutungen. Die Antworten auf manipulierte Fragen könnten auf falsche Informationen zurückzuführen sein. Die wahrscheinlichste Erklärung ist, dass es sich um ein Modell eines Herstellers handelt, der nicht möchte, dass der Markenname die Bewertungen der Nutzer beeinflusst.

---

4. Warum führen Hersteller solche „anonymen Blindtests“ durch?

Warum veröffentlichen große Unternehmen keine offiziellen Pressemitteilungen, sondern nutzen solche mysteriösen Tests?

Das ist eine sehr raffinierte Marketingstrategie – genannt **„Debranding-Test“.

1. Voreingenommenheiten vermeiden:

  • Wenn ich sage, es ist OpenAI’s neues Modell, könnten Sie es wegen Ihrer Vorliebe für OpenAI positiv bewerten; wenn Sie OpenAI ablehnen, könnten Sie kritisch sein.
  • Wenn ich sage, es ist ein chinesisches Modell, könnten Sie es aufgrund von Vorurteilen unterschätzen.
  • Im anonymen Kontext bewerten die Nutzer nur nach der Leistung. Wenn das Modell wirklich gut ist, werden sie es weiterempfehlen; wenn nicht, werden sie es kritisieren.

2. Echte Daten sammeln:

  • Labortests liegen oft nicht im Einklang mit der tatsächlichen Nutzung. Durch die kostenlose Bereitstellung können Hersteller umfangreiche Daten über Nutzer, ihre Anfragen und Fehler sammeln – diese sind wertvoller als alle Benchmarks.

3. Interesse wecken und Traffic generieren:

Das mysteriöse Modell zieht viel Aufmerksamkeit auf sich. Die ersten 2 Milliarden Token zeigen die Popularität des Modells.

  • Es handelt sich dabei auch um eine kostenlose Werbung für das Unternehmen. Unabhängig davon, wer letztendlich hinter dem Modell steht, wird der Name des Herstellers im ganzen Internet bekannt werden.

4. Die Position als „Frontier-Modell“ testen:

  • Offiziell wird das Modell als „Frontier-Modell“ beworben. Wenn Entwickler es als solches einstufen, stärkt das die Marke – auch wenn es in den Tests nicht so gut abschneidet.

Kurz gesagt: Es handelt sich um einen „Blindtest“. Der „Koch“ serviert das Essen, ohne seinen Namen zu nennen, und die Kunden bewerten es. Wenn die Bewertungen gut sind, wird der „Koch“ bekannt.

---

5. Was bedeutet das für Normalverbraucher und Entwickler?

Bleibt das alles weit weg von uns? Eigentlich nicht.

Für Entwickler/Programmierer:

  • Kurzfristige Vorteile: Sie können es kostenlos für die Programmierung verwenden – und die Qualität ist in Ordnung.
  • Vorsicht: Trotz der kostenlosen Nutzung ist die Geschwindigkeit oft langsam; es eignet sich nicht für Anwendungen, die schnelle Iterationen erfordern. Achten Sie darauf, keine sensiblen Daten hochzuladen.
  • Integration in Tools: Es ist bereits in populäre Programmier-Tools wie OpenCode und Cline integriert.

Für normale Nutzer:

  • Stärkerer Wettbewerb in der KI-Branche: Die Konkurrenz konzentriert sich nun nicht mehr nur auf die Leistung der Modelle, sondern auch auf das Nutzererlebnis und das Preis-Leistungs-Verhältnis.
  • Beginn der kostenlosen Ära: Früher musste man für Top-KI-Dienste bezahlen; jetzt könnten Hersteller kostenlose Lösungen anbieten, um Daten und positives Feedback zu erhalten.
  • Vorsicht mit Versprechungen: Nicht alle „Frontier-Modelle“ sind wirklich so leistungsfähig, wie sie beworben werden. Ein Modell, das schöne Code erstellt, muss nicht unbedingt stabil genug sein, um große Systeme zu betreiben.

Für die Branche:

  • Neue Veröffentlichungsmethoden: „Zuerst Blindtest, dann Enthüllung“ könnte die neue Norm für die Veröffentlichung großer Modelle werden.
  • Neue Bewertungskriterien: Herkömmliche Benchmarks reichen nicht mehr aus; Stabilität, Geschwindigkeit und die Fähigkeit, mit anderen Tools zusammenzuarbeiten, werden wichtiger.

---

Fazit

Die Einführung von Union Alpha ist wie die Auslösung einer Bombe auf der ruhigen Oberfläche des KI-Teichs.

Es bleibt weiterhin ein Rätsel – wir wissen nicht, ob es OpenAI’s Geheimprojekt, Zhipu’s verborgenes Ass oder ein neues Modell eines europäischen oder amerikanischen Unternehmens ist.

Eines ist jedoch sicher: Es ist sehr leistungsfähig – aber nicht schnell genug. Es ist kostenlos – allerdings muss man dafür warten.

Für die meisten Menschen ist es vielleicht nur ein interessantes Gesprächsthema; für die KI-Branche ist es jedoch ein tiefgreifendes Experiment, das zeigt, dass Leistung wichtiger ist als der Markenname.

In den nächsten Tagen werden wir die Entwicklungen auf OpenRouter und den sozialen Medien genau beobachten. Sobald das Rätsel gelöst ist, wird dieser „Blindtest“ bereits zur Hälfte erfolgreich gewesen sein – er hat dazu geführt, dass alle die eigene Vorstellung von „Frontier-Performance“ neu überdenken.

Letzter Hinweis: Wenn Sie es jetzt ausprobieren, seien Sie geduldig – schließlich erfordern gute Dinge oft etwas Wartezeit.