Originalarbeiterreichbar
Addendum to GPT-4o System Card: 4o image generation
OpenAIs Ergänzung zur Modellkarte von GPT-4o vom 25.03.2025, mit der die Bilderzeugung im Modell selbst eingeführt wurde. Sie ist der Beleg dafür, dass hinter einem erzeugten Bild bei OpenAI kein Diffusionsmodell rechnet: Abschnitt 2.1 der Druckfassung sagt, anders als DALL-E, das als Diffusionsmodell arbeite, sei die 4o-Bilderzeugung ein autoregressives Modell, das nativ in ChatGPT eingebettet ist. Dieser Satz steht nur im PDF, weshalb er hier nicht als Zitat geführt wird; die Seite selbst nennt die Einbettung in das Modell und die Fähigkeit, Text in Bilder zu setzen. Die GPT-Image-Modelle der Schnittstelle sind die Fortführung dieser Linie.
geprüft 24.09.2026
Worauf sich diese Seite beruft, wörtlich, abgerufen am 17.09.2026:
It can follow detailed instructions, including reliably incorporating text into images.
bestätigt 24.09.2026because it is embedded natively, deep in the architecture of our omnimodal GPT-4o model, 4o image generation can use everything it knows
bestätigt 24.09.2026
KI-GeschichteDiffusion im Glossar07 Die Systemkarte lesen14 Ein Bild, das es vorher nicht gab