Ich habe ChatGPT Images 2.5 getestet: Die Rauschmuster sind furchtbar, und die Reddit-Community hat mir das geglaubt.
Hatte Reddit recht? Ich habe ChatGPT Images 2.5 getestet und kann bestätigen, dass das Bildrauschen wirklich furchtbar ist. Erfahren Sie mehr über meine Erfahrungen und warum die Qualität so enttäuschend ist.
Die wichtigsten Dinge, die Sie wissen müssen
- ChatGPT Images 2.5 leidet unter anhaltendem „Rauschen“ oder „Körnigkeit“ in den Bildern, wodurch diese rau und sandig wirken und den Versprechen von OpenAI hinsichtlich „schärferer Details und reichhaltigerer Texturen“ widersprechen.
- Die Tests des Autors, die mit den Beschwerden von Reddit-Nutzern übereinstimmten, zeigten eine anhaltende körnige Textur im Himmel, in Studiohintergründen und auf der Haut, selbst wenn weiche Farbverläufe angefordert wurden.
- Trotz der Geschwindigkeit und Effizienz von Images 2.5 schwächt die Vorliebe für körnige Texturen den versprochenen Realismus und führt dazu, dass manche Ergebnisse ins „Tal des Bizarren“ abgleiten, was das Programm für einige Anwender nahezu unbrauchbar für die Produktion macht.
OpenAI hat diese Woche ChatGPT Images 2.5 veröffentlicht und damit beeindruckende Verbesserungen an seinem KI-gestützten Bildgenerator hervorgehoben . Das Unternehmen verspricht mit dem neuesten Modell schärfere Details, natürlichere Lichtverhältnisse und differenziertere Bildkompositionen. Gleichzeitig soll die Detailgenauigkeit von Personen und Objekten in Referenzbildern verbessert werden. Zudem soll die Bildgenerierung bis zu 50 % schneller erfolgen und komplexe visuelle Anweisungen zuverlässiger umgesetzt werden.

Es gibt auch einige wirklich nützliche Neuerungen. Images 2.5 bietet eine Skizzenfunktion zum Umwandeln von Rohskizzen in fertige Bilder, Vorlagen für Poster und Produktfotografie sowie die Möglichkeit, bei Bearbeitungsanfragen direkt im Bild Kommentare zu hinterlassen. OpenAI bezeichnet dies als sein neuestes Bildmodell – ein recht hoher Standard für etwas, das unweigerlich das Zeichnen von Drachen vor dem Frühstück erfordert.
Die erste Reaktion war jedoch nicht so positiv wie erwartet. Ein Reddit-Nutzer lieferte die wohl einprägsamste Rezension: „Die Rauschmuster sind furchtbar.“ Ein anderer betrachtete ein KI-generiertes Bild und urteilte: „Das … sieht schrecklich aus.“ Die Kritik ist leicht verständlich; es geht einzig und allein um das Rauschen.
Alles wurde akuter, auch das Problem.
Der Begriff „Rauschen“ ist bei der Kritik an KI -Bildern etwas vage . In der Fotografie bezeichnet er üblicherweise die Flecken oder das Körnchen, die durch eine Diskrepanz zwischen Beleuchtung und Aufnahmetechnik entstehen. Generative KI-Bilder können jedoch etwas Ähnliches erzeugen, ohne jemals eine Kamera durchlaufen zu haben. Alles wirkt rau und sandig, und aus irgendeinem Grund sieht nichts sauber aus.
Rauschen ist besonders schädlich, weil es sich als Detail tarnen kann. Generative Modelle haben erkannt, dass Fotografien Körnung, Textur, subtile Farbvariationen und gelegentliche Unvollkommenheiten enthalten. Images 2.5 scheint diese Merkmale ungewöhnlich eifrig zu reproduzieren und projiziert sie mitunter auf Himmel, Haut, Federn und Studiohintergründe.
Dies widerspricht den von OpenAI versprochenen „schärferen Details“ und „reicheren Texturen“. Trotz des Fokus auf natürlichere Beleuchtung und Texturen sind einige Nutzer der Meinung, dass ChatGPT Images 2.5 die Erwartungen nicht erfüllt.
Eine Person schrieb: „Diese Rauschverzerrungen müssen beseitigt werden. Sie machen das Modell für die Produktion nahezu unbrauchbar.“ Lob und Kritik mischen sich, doch das ist weit entfernt von der allgemeinen Anerkennung, die OpenAI sich wohl wünschen würde.
Ich wollte überprüfen, ob das Problem über die auf Reddit kursierenden Screenshots hinausgeht, und testete daher einige Bilder mit feinen Details und Bereichen, die optisch glatt bleiben sollten, um zu sehen, ob Körnung auftritt. Ich achtete sogar darauf, dass meine Vorgaben sanfte Tonwertübergänge und die Entfernung jeglichen Bildrauschens vorsahen.

Ich begann mit dem Bild einer Tasse in einem Fotostudio. Auf den ersten Blick sind die Details des Pfaus, der Blumen, der Früchte und der Landschaft, die sich um die virtuelle Keramik winden, faszinierend. Doch bei genauerem Hinsehen offenbart der graue Hintergrund des Studios eine durchgehende, körnige Textur, während einige der kleinsten Muster in einem chaotischen Durcheinander verschwimmen. Das Modell liefert eine Fülle visueller Informationen, ohne dabei immer klar zu definieren, welche Teile Beachtung verdienen.
Ein ähnliches Problem trat auf, als ich ein Bild einer Schleiereule in der Abenddämmerung anforderte. Federn bieten eine ideale Möglichkeit, Komplexität darzustellen, und Images 2.5 meisterte dies hervorragend. Einzelne Strukturen bleiben auf den Flügeln und im Gesicht erkennbar, die Krallen wirken überzeugend, und das Tier vermeidet die plastisch anmutende Wirkung, die häufig bei älteren, KI-generierten Tierbildern auftrat.
Hinter der Eule erscheint ein Himmel, der eigentlich wie ein makellos weißes Blatt Papier wirken sollte. Stattdessen weist der sanfte Blauton ein subtiles, aber deutlich sichtbares Bildrauschen auf. Das beeinträchtigt das Bild zwar nicht völlig, aber nachdem ich es einmal bemerkt hatte, konnte ich es nicht mehr ignorieren.

Legendäre, granulare Verwirrung
Ich dachte, eine Fantasieszene wäre besser, eine, die nicht auf realen Fotos eines geflügelten Pferdes oder eines Drachen basiert. Doch obwohl diese Elemente zusammen mit einem Regenbogen über einem Bergsee in einer überraschend stimmigen Komposition existieren, wird das Problem sofort deutlich. Die übermäßige Schärfe verleiht dem Bild den Charakter eines Ladebildschirms aus einem Videospiel.
Der hellblaue Himmel wirkt eher subtil als mit der makellosen Tonwertabstufung, die ich von einem perfekt bearbeiteten Bild erwarten würde. Die Details der Berge, Bäume und Tiere hingegen erscheinen bei genauer Betrachtung pixelig und überbelichtet. Es ist keineswegs ein Desaster, aber das Bild wirkt wie eine stark retuschierte Fotografie.
Ich war sehr zufrieden mit dem Ergebnis meines Auftrags, zwei Freunde abends auf einem Dach zu fotografieren. Das Bild kam dem versprochenen Realismus sehr nahe, mit überzeugenden Gesichtsausdrücken und dem scheinbar authentischen Effekt der Schwerkraft auf ihre Kleidung. Betrachtet man es jedoch genauer als eine Minute, fällt die Körnigkeit auf, die den Dämmerungshimmel, ihre Haare und ihre Haut durchzieht. Dies ist besonders auffällig, da weder schlechte Lichtverhältnisse noch ein fehlerhafter Kamerasensor vorlagen. Wenn der Dämmerungshimmel körnig wirkt, ist diese Körnigkeit eine bewusste künstlerische Entscheidung oder ein Fehler des Modells, nicht etwa ein physikalisches Phänomen bei schlechten Lichtverhältnissen.

Betrachtet man diese vier Bilder speziell im Hinblick auf die Bildschärfe, muss ich mich den Kritikern auf Reddit anschließen. Eine feine, anhaltende Textur ist im Himmel, in Studiohintergründen und in Bereichen mit wenig Licht sichtbar. Schärfe ist zwar ein einfaches Marketingargument, da sie in der Einführungsgalerie gut aussieht, aber hier wurde es vielleicht übertrieben, wodurch einige Ergebnisse von ChatGPT Images 2.5 unnatürlich wirken.
Images 2.5 ist schnell, anpassungsfähig und oft effizient, doch die Vorliebe für körnige Texturen beeinträchtigt den Realismus, den es eigentlich erfassen soll. Vielleicht erkennt das nächste Update, dass das Beeindruckendste, was ein KI-Bildgenerator in ein Bild einfügen kann, im Grunde nichts ist.
Was denken Sie? Nehmen Sie an der obigen Umfrage teil und teilen Sie uns Ihre Meinung mit.
Kommentarfunktion ist geschlossen.