Realistische Bilder und lesbarer Text mit den neuesten KI-Modellen von OpenAI. Probieren Sie es kostenlos aus.
OpenAI hat sein 4-Modell in ChatGPT integriert, um die Bildgenerierung nativ innerhalb der Chatbot-Umgebung zu ermöglichen. Durch dieses Update entfällt die Notwendigkeit, das Dall-E-Bildgenerierungsmodell von OpenAI als separate Einheit zu verwenden, obwohl Dall-E für diejenigen, die es bevorzugen, weiterhin verfügbar ist. Das KI-Unternehmen hat seinen Sora AI-Videogenerator auch innerhalb von ChatGPT aktiviert.

Die neuen Funktionen sind derzeit für kostenlose ChatGPT-Benutzer sowie für ChatGPT Plus-, Team- und Pro-Benutzer verfügbar. Diese Funktionen werden nächste Woche für Geschäfts- und Bildungsnutzer verfügbar sein.
Dall-E 3 war zuvor das Bildgenerierungs-Plugin für kostenpflichtige ChatGPT-Abonnenten. Wer den Generator inzwischen kostenlos testen möchte, kann dies über die Basisversion von Microsoft Copilot tun.
Das Modell wurde als einer der besten verfügbaren Bildgeneratoren gelobt, insbesondere in der kostenpflichtigen Version. Zwar ist die Bildgenerierung, die in das 4o-Modell integriert ist, für alle ChatGPT-Nutzer von Vorteil, doch sollten sich Nutzer der kostenlosen Version von ChatGPT auf einige Einschränkungen einstellen, beispielsweise hinsichtlich der maximalen Dateigröße beim Upload und der Datenanalyse, wie CNET anmerkte.
Laut dem Wall Street Journal wird ChatGPT jedoch von realistischeren Bildern mit klarerem Text profitieren, nachdem OpenAI ein Jahr lang nach dem Start von GPT-4o durch ein Trainingsprogramm namens „Reinforcement Learning from Human Feedback“ (RLHF) trainiert hat.
Nach der Ankündigung von GPT-4o im Mai 2024 ließ OpenAI ein Team von mehr als 100 „menschlichen Trainern“ das Modell auf Tippfehler sowie häufige Fehler bei Händen und Gesichtern scannen, sagte der leitende Forscher des Projekts, Gabriel Goh, der Zeitung.
Das GPT-4o-Modell fügt ChatGPT außerdem die Möglichkeit hinzu, transparente Hintergründe zu erstellen. Dies dürfte für Geschäftskunden und Kreative sehr nützlich sein, da sie damit Logos oder andere Symbole erstellen können, wie Jackie Shannon, Leiterin für Multimediaprodukte bei ChatGPT, gegenüber dem WSJ anmerkte.
Trotz der von OpenAI vorgenommenen Verbesserungen weist das aktualisierte GPT-4o-Modell insgesamt noch einige Schwächen auf. Es neigt weiterhin zu Halluzinationen, einer häufigen KI-Eigenschaft, die nach wie vor ungelöst ist. Die Gewährleistung konsistenter Bearbeitungsprozesse stellt in der ChatGPT-Umgebung weiterhin eine Herausforderung dar; OpenAI hat jedoch schnelle Updates bereits für nächste Woche angekündigt .
Ein weiteres anhaltendes Problem, mit dem OpenAI konfrontiert ist, ist die Frage der Ethik und Legitimität. Das Unternehmen besteht darauf, dass sein Modell mit „öffentlich verfügbaren Daten“ sowie mit proprietären Daten trainiert wurde, die es durch Partnerschaften mit Marken wie Shutterstock besitzt, wie das WSJ anmerkte.
Von ChatGPT auf Basis des 4-Modells generierte Bilder enthalten keine KI-Wasserzeichen. Das Unternehmen wies jedoch darauf hin, dass die Bilder C2PA-Metadaten enthalten werden, die darauf hinweisen, dass sie durch KI generiert wurden. Dies bleibt der Industriestandard.
Kommentarfunktion ist geschlossen.