虎嗅

„GPT Image 2.5 ist da – OpenAI beginnt, die Arbeit von Banana nachzumachen“

原文:GPT Image 2.5来了,OpenAI开始抄Banana的作业

---

Zusammenfassung in einfachem Deutsch

OpenAI hat kürzlich in der frühen Morgenstunde seine AI-Bildgenerierungs-Software GPT Image 2.5 aktualisiert. Dabei wurden keine revolutionären Technologien eingeführt – der Fokus lag ganz auf der Verbesserung der bereits bekannten Probleme beim Bildbearbeiten, über die viele Nutzer geklagt hatten. Früher konnten Nutzer mit der AI Bilder erstellen, doch bei kleinen Änderungen zerfiel das gesamte Bild oder die Bildqualität verschlechterte sich nach einigen Anpassungen erheblich. Die neue Version behebt diese Probleme größtenteils und verbessert zudem die Generiergeschwindigkeit um die Hälfte. Besonders erwähnenswert ist, dass der Preis gegenüber der alten Version unverändert blieb.

Interessanterweise hatten Unternehmen wie Google sowie chinesische Anbieter wie Tencent Mix Yuan und Tongyi WanXing bereits vor über einem Jahr ähnliche Funktionen für das Bildbearbeiten entwickelt. OpenAI hat somit eine Lücke in seinem Produktportfolio geschlossen. Dank der riesigen Zahl von ChatGPT-Nutzern hat diese Aktualisierung jedoch die Nutzungshürden für AI-Bildgenerierung erheblich gesenkt: Normale Nutzer müssen nicht mehr unzählige Male Bilder erstellen, um ein brauchbares Ergebnis zu erhalten; bereits nach ein paar Anpassungen steht ein verwendbares Bild zur Verfügung – die Auswirkungen sind daher viel größer, als viele vermuten.

---

Detaillierte Erklärung

1. Es handelt sich nicht um eine Innovation, sondern um die Behebung von OpenAI’s „Versäumnissen“

Viele kritisieren OpenAI dafür, dass die Aktualisierung ein Jahr zu spät erfolgte. Doch das ist nicht ungerecht: Sowohl die älteren GPT-Bildgenerierungs-Tools als auch frühe AI-Produkte anderer Anbieter funktionierten nach dem Prinzip „Einmal kaufen, fertig“. Wenn man eine Beschreibung eingab, änderte sich das Bild – und selbst kleine Änderungen konnten das gesamte Erscheinungsbild des Bildes stark verändern. Google hatte bereits vor einem Jahr die Funktion „mehrere Anpassungen ohne Qualitätsverlust“ in seine Bildgenerierungs-Software integriert und vier Monate später eine Benutzeroberfläche eingeführt, die es ermöglichte, bestimmte Bereiche des Bildes auszuwählen und zu bearbeiten. Auch chinesische Anbieter unterstützten längst Funktionen wie das Zeichnen von Skizzen oder das Generieren von Bildern auf Basis von Linienvorlagen. OpenAI hat diese praktischen Verbesserungen bisher nicht mitgeführt; mit der neuen Version hat das Unternehmen nun bewährte Funktionen aus der Branche in sein eigenes System integriert.

2. Reale Vorteile: Mehr Praktikabilität – 80 % weniger Zeit für das Bildbearbeiten

Die Verbesserungen sind tatsächlich signifikant und treffen direkt auf die Bedürfnisse der Nutzer:

  • „Genau dort ändern, wo man will“: Man kann einzelne Elemente des Bildes bearbeiten, ohne dass andere Teile des Bildes beeinflusst werden. Zum Beispiel kann man bei der Erstellung eines Plakats nur den Text eines Produkts ändern – Hintergrund, Markenlogo oder das Aussehen des Produkts bleiben unverändert.
  • Mehrmalige Anpassungen ohne Qualitätsverlust: Nach mehreren Anpassungen bleibt die Bildqualität stabil. Man kann zunächst eine Skizze erstellen, anschließend die Farben der Kleidung der Personen ändern, später das Licht im Hintergrund und so weiter – ohne dass die vorherigen Änderungen verloren gehen.

OpenAI bietet außerdem zwei Versionen des Tools an: Eine Version mit hoher Geschwindigkeit und eine Version mit hoher Bildqualität, speziell für professionelle Anwender. Die Kosten für beide Versionen sind identisch mit denen der alten Version. Die Testergebnisse zeigen, dass die Bearbeitungsfähigkeit der neuen Version um mehr als 80 % verbessert wurde.

3. Zwei unscheinbare Funktionen – doch mit großem Potenzial

Zusätzlich zu den Hauptfunktionen wurden zwei weitere Funktionen hinzugefügt, die das AI-Bildgenerieren zu einem interaktiveren und sozialen Tool machen:

  • Skizzenerstellung: Man kann einfach eine grobe Zeichnung auf dem Bildschirm erstellen, und die AI generiert daraus ein vollständiges Bild.
  • Parameterbasierte Weitergabe: Bei der Weitergabe von Bildern werden alle verwendeten Parameter mitgesendet, sodass andere Nutzer die Bilder direkt anpassen können.

Diese Funktionen sind zwar nicht besonders technisch anspruchsvoll, aber sie erweitern die Nutzungsmöglichkeiten des Tools erheblich und machen es zu einem geeigneten Mittel für die soziale Kommunikation.

4. Die Konkurrenz im AI-Bildgenerationsbereich ist noch lange nicht vorbei

Obwohl OpenAI viele Funktionen erst später eingeführt hat, sind seine Produkte immer noch konkurrenzfähig. Allerdings gibt es weiterhin Schwachstellen – beispielsweise wird das Problem der ungenauen Bildgenauigkeit bei manuellen Eingaben noch nicht vollständig gelöst. Zudem kann die Ausführung komplexer Anweisungen manchmal fehlerhaft sein. Für Anwendungen, bei denen eine hohe Genauigkeit der Bildwiedergabe erforderlich ist, ist Google’s Modell weiterhin die bessere Wahl.

Insgesamt hat OpenAI mit der neuen Version die Nutzungshürden für AI-Bildgenerierung erheblich gesenkt und somit viele Nutzer dazu angezogen. Auch wenn viele Funktionen bereits von anderen Anbietern entwickelt wurden, bietet OpenAI nun „kostenlose“ Verbesserungen an, die die Nutzung von AI-Bildgenerierung für normale Nutzer einfacher machen. Daher wird die Nutzungshäufigkeit von AI-Bildgenerierung voraussichtlich stark ansteigen.