虎嗅

„10.000 Wörter lang“ | Vom ChatGPT bis zur Arbeit mit „DouBao“ – Agenten sorgen für Aufregung im Büroalltag

原文:万字长文 | 从ChatGPT到豆包工作,Agent杀疯职场办公

Zusammenfassung des Kerninhalts

Diese 10.000 Wörter umfassende Branchenanalyse zerlegt die beiden meistbeachteten Ereignisse im aktuellen Inlandskontext der AI-Bürobranche: ByteDance hat das Team von Lark und das Team von DouBao zusammengelegt, um die „DouBao Work“-Agentenplattform zu launchen, während Tencent eine vollständig offene WorkBuddy-Agenten-Operationssysteme-Plattform eingeführt hat. Die beiden Unternehmen scheinen gegensätzliche Wege eingeschlagen zu haben – eines verfolgt eine Strategie der „geschlossenen, tiefgreifenden Integration“, das andere eine Strategie des Aufbaus einer offenen Ökologie. Beide haben jedoch das gleiche Ziel: den Kern der nächsten Generation von Unternehmensbürosystemen zu beherrschen. Dabei geht es nicht um die übliche Zugangsmöglichkeit über Chatfenster mit AI, sondern um die Berechtigung, echte Arbeitsaufgaben und wichtige Geschäftsdaten der Unternehmen der AI anzuvertrauen – insbesondere um die Berechtigung, Aufgaben auszuführen und die Ergebnisse zu überprüfen.

Der Artikel beschreibt den vollständigen Entwicklungsverlauf der Agenten von den ersten Robotern vor 60 Jahren bis hin zu ihrer heutigen Anwendung in Büroszenarien und weist darauf hin, dass die Branche noch in einem sehr frühen Stadium ist. Bislang gibt es noch nicht einmal einen „einheitlichen Browser“ für Agenten. Letztendlich entscheidet nicht, wer die meisten Nutzer hat oder welche Modelle die höchsten Bewertungswerte erzielen, sondern wer zuerst ein vertrauenswürdiges System aufbauen kann, bei dem Fehler der AI nachvollzogen und behoben werden können.

---

Detaillierte, verständliche Erklärung

1. Lassen Sie sich nicht von der „Eingangskampagne“ täuschen – es geht nicht um Klickzahlen, sondern um Vertrauen

In der Vergangenheit ging es beim Wettbewerb um Browser und Super-Apps darum, die Anzahl der Nutzerklicks zu erhöhen, indem diese vorinstalliert wurden oder mit Geldsubventionen attraktive Tagesaktivitätszahlen erzielt wurden. Der Wettbewerb im Bereich des AI-Büros ist jedoch völlig anders: Kein Unternehmen wird seine Kundendaten, unveröffentlichten Verträge oder wichtigen Finanzdaten in eine AI-Plattform einfügen, nur weil das AI-Eingabefenster gut aussieht oder die Antworten 2 Sekunden schneller sind, geschweige denn der AI die Erlaubnis geben, E-Mails zu senden, Verkaufsangebote zu ändern oder Zahlungsverfahren abzuschließen.

Bekannte AI-Tools wie Microsoft 365 Copilot funktionieren im Grunde noch als „Assistenten“, die auf Anweisungen des Benutzers reagieren; die endgültigen Aktionen müssen jedoch vom Benutzer bestätigt werden, und die Verantwortung bleibt beim Benutzer. Die großen Unternehmen streben vielmehr die „Standardbefugnis zur Ausführung von Aufgaben“ an: Man sagt beispielsweise „Erstelle einen Plan für die Kunden, die seit mehr als drei Monaten in der Region Ostchina verloren gegangen sind“, und die AI sucht die entsprechenden Daten, ruft das CRM-System auf, erstellt den Plan und erstellt sogar den Genehmigungsprozess – ohne dass der Benutzer Schritt für Schritt die entsprechenden Befehle ausführen muss. Um diese Befugnis zu erlangen, reichen allein Klickzahlen nicht aus; es ist notwendig, ein vertrauenswürdiges System aufzubauen, bei dem klar ist, welche Daten die AI sehen darf und welche nicht, bei dem Fehler sofort nachvollzogen werden können und bei dem die Verantwortung klar festgelegt ist.

2. AI-Bürosysteme haben 60 Jahre gebraucht, um sich zu etablieren

Viele glauben, dass der Begriff „Agent“ erst mit dem Aufkommen großer Modelle entstanden ist. Tatsächlich entwickelte Stanford bereits 1966 den ersten Roboter Shakey, der seine Umgebung wahrnehmen, Routen planen und sich bewegen konnte. Doch in den folgenden Jahrzehnten funktionierten Agenten nur unvollständig:

  • Die „Handlungsseite“ bestand aus Automatisierungstools wie Makros und RPA, die bestimmte Aktionen wiederholten, aber keine menschlichen Sprachanweisungen verstanden.
  • Die „Verständnisseite“ wurde erst mit dem Aufkommen großer Modelle verbessert; AI konnte unklare Anweisungen verstehen, konnte jedoch keine echten Bürosysteme nutzen und konnte nur im Chatfenster Texte ausgeben.

Erst ab 2022 wurden „Logik und Handlung“ kombiniert – AI konnte externe Tools nutzen, um Daten zu suchen, und später auch wie ein Mensch auf dem Bildschirm arbeiten. Erst dann waren Agenten wirklich in der Lage, im Büro eingesetzt zu werden.

3. Tencent und ByteDance haben gegensätzliche Wege eingeschlagen – es gibt keinen klaren Sieger

Viele glauben, dass der Zusammenschluss von Lark und DouBao sowie die Entwicklung der offenen WorkBuddy-Plattform von Tencent zu einem Preiskampf führen werden. Tatsächlich haben die beiden Unternehmen unterschiedliche Strategien gewählt:

  • Tencent baut eine offene Plattform auf, auf der Entwickler, Branchenexperten und Hersteller von AI-Hardware ihre Funktionen als „Skills“ integrieren können. Der Vorteil ist, dass die Plattform eine breite Palette an Funktionen bietet; der Nachteil ist die schwierige Qualitätskontrolle.
  • ByteDance nutzt das eigene, lang etablierte System (Lark) und verbindet es direkt mit den AI-Funktionen von DouBao. Der Vorteil ist die hohe Stabilität; der Nachteil ist, dass externe Funktionen nur schwer integriert werden können.

4. Der Sieger wird nicht durch die beste Leistung der Modelle entschieden

Derzeit konzentrieren sich viele Hersteller auf die Parameter großer Modelle und die Geschwindigkeit der Antworten. Doch im Büro ist es nicht wichtig, wie schnell die AI antwortet, sondern ob man ihr die Ausführung von Aufgaben anvertrauen kann. Ein erfolgreiches System sollte nachvollziehbar sein, Fehler schnell behoben werden können und sicherstellen, dass nur relevante Daten verwendet werden.

Für die meisten Mitarbeiter werden die bisher gelernten Fähigkeiten (z. B. die Nutzung von Tastenkombinationen oder der Zugang zu versteckten Menüs) an Bedeutung verlieren. Wichtig sind vielmehr die Fähigkeit, Anforderungen klar zu formulieren und die Arbeit der AI zu überprüfen. Die wirklich wertvollen Fähigkeiten sind:

1. Die Fähigkeit, Anforderungen klar zu formulieren und zu wissen, welche Standards erfüllt werden müssen.

2. Die Fähigkeit, die Arbeit der AI zu überprüfen und Fehler sofort zu erkennen.

In Zukunft werden Unternehmen, die diese Fähigkeiten besitzen, am erfolgreichsten sein – unabhängig davon, welche Technologie verwendet wird.