OpenAI Imagegen

Offizieller OpenAI Skill für Bildgenerierung, Bildbearbeitung, Varianten und transparente Rastergrafiken.

OpenAI Imagegen ist ein offizieller Skill für Codex und kompatible Agenten, die neue Rasterbilder erzeugen oder vorhandene Bilder gezielt verändern sollen. Die ursprüngliche Smithery-Quelle verwies auf den kuratierten Pfad imagegen im offiziellen openai/skills-Repository. Dieser Pfad ist inzwischen nicht mehr erreichbar; die Prüfung des aktuellen offiziellen Repository-Baums zeigt den verifizierbaren Nachfolger skills/.system/imagegen. Die redaktionelle Einordnung berücksichtigt deshalb den aktuellen Systempfad und die offizielle OpenAI-Dokumentation zur Bildgenerierung. Laut Anbieter ist der bevorzugte Weg das eingebaute Bildwerkzeug. Ein mitgeliefertes CLI dient nur als ausdrücklich gewählter Rückfallweg und benötigt eine lokal konfigurierte Authentifizierung. Diese Zugangsdaten gehören nicht in Projekte, Prompts oder Katalogtexte.

Zweck und Zielgruppe

Der Skill richtet sich an Menschen, die für eine Website, ein Spiel, eine Produktpräsentation, einen Prototyp, eine Illustration, einen Mockup, ein Titelbild, eine Infografik oder eine transparente Freistellung ein Bitmap benötigen. Er hilft dem Agenten zuerst zu unterscheiden, ob ein neues Bild entstehen oder ein vorhandenes Bild bearbeitet werden soll. Bei Referenzbildern wird außerdem geklärt, ob sie nur Stil, Komposition oder Stimmung vorgeben oder ob sie das eigentliche Bearbeitungsziel sind. Diese Unterscheidung schützt bestehende Inhalte vor unbeabsichtigten Änderungen und macht den Arbeitsauftrag überprüfbar.

Imagegen ist nicht die richtige Wahl, wenn eine vorhandene SVG- oder Vektorwelt exakt erweitert werden soll, wenn ein Logo an ein bestehendes Icon-System angepasst werden muss oder wenn ein deterministisches Ergebnis in HTML, CSS oder Canvas genügt. Der Skill ist auch kein allgemeiner Bildhost, kein Bildarchiv und keine Zusage für perfekte Textdarstellung. Für code-native Gestaltung und exakte Vektorpfade bleibt die jeweilige native Technik meist besser geeignet.

Arbeitsmodi und Werkzeugwahl

Die Primärquelle unterscheidet einen bevorzugten eingebauten Werkzeugmodus und einen ausdrücklichen CLI-Rückfallmodus. Im Normalfall soll der Agent das eingebaute image_gen-Werkzeug verwenden und nicht selbstständig auf ein Skript wechseln. Wenn der eingebaute Weg nicht verfügbar ist, muss der Agent transparent erklären, dass der CLI-Rückfall existiert, und erst nach ausdrücklicher Auswahl damit fortfahren. Für den CLI-Modus nennt die Quelle die Vorgänge generate, edit und generate-batch. Das zugehörige Skript darf nicht eigenmächtig verändert werden. Der Skill beschreibt außerdem, dass ein Bild im eingebauten Modus standardmäßig unter dem Codex-Arbeitsbereich landet und bei einem Projektauftrag anschließend gezielt in das Projekt kopiert oder verschoben werden soll.

Vor der Erzeugung sammelt der Agent Zweck, Bildtyp, Szene, Hauptmotiv, Stil, Bildausschnitt, Lichtstimmung, Farben, Materialien, exakten Text im Bild und Ausschlüsse. Eine konkrete Nutzerbeschreibung soll nur geordnet, nicht kreativ überformt werden. Bei allgemeinen Wünschen darf der Agent sparsam Komposition oder Verwendungszweck ergänzen, aber keine unbeauftragten Figuren, Marken, Slogans oder zusätzlichen Objekte erfinden.

Prompting, Varianten und Bearbeitung

Die offizielle Anleitung empfiehlt eine konsistente Reihenfolge aus Szene oder Hintergrund, Motiv, wichtigen Details, Grenzen und Ausgabeabsicht. Für komplexe Aufträge helfen kurze beschriftete Angaben, damit das Ergebnis nicht auf einer vagen Stimmung basiert. Text im Bild wird wörtlich angegeben und typografisch sowie räumlich beschrieben. Bei Bearbeitungen müssen unveränderte Eigenschaften ausdrücklich wiederholt werden, etwa dass nur der Hintergrund ersetzt und das Produkt samt Kanten erhalten bleibt. Einzelne Iterationen sollen jeweils nur eine gezielte Änderung vornehmen. So lässt sich nachvollziehen, ob eine Abweichung aus der neuen Anweisung oder aus einer anderen Ursache stammt.

Der Skill deckt unter anderem fotorealistische Szenen, Produkt-Mockups, UI-Mockups, Infografiken, Illustrationen, stilisierte Konzepte und historische Szenen ab. Für Bearbeitungen beschreibt er präzise Objektänderungen, Hintergrundfreistellung, Beleuchtungs- und Wetteränderungen, Stilübertragung, Compositing und Skizze-zu-Render. Bei mehreren Varianten werden die gewünschten Unterschiede getrennt formuliert. Der Agent soll das Ergebnis anschließend auf Motiv, Stil, Bildaufbau, Textgenauigkeit und erhaltene unveränderliche Merkmale prüfen.

Sicherheit, E-E-A-T und Grenzen

Diese Beschreibung stützt sich auf den offiziellen OpenAI-Quellpfad skills/.system/imagegen und die offizielle OpenAI-Dokumentation zur Bildgenerierung. Laut Anbieter ist die Wahl zwischen eingebautem Werkzeug und ausdrücklich angefordertem CLI wesentlich; sie ist keine Garantie für Verfügbarkeit, Qualität oder Rechteklärung. Bilder können Personen, Marken, vertrauliche Referenzen oder urheberrechtlich geschützte Elemente enthalten. Vor einer Veröffentlichung muss ein Mensch prüfen, ob die Eingaben und Ausgaben genutzt werden dürfen, ob eine Kennzeichnung erforderlich ist und ob das Bild irreführende oder sensible Inhalte erzeugt. Ein generiertes Bild ist kein Beleg für die Wahrheit einer dargestellten Szene.

Lokale Dateipfade, Ausgabeordner und Referenzbilder können sensible Informationen preisgeben. Nicht benötigte Entwürfe sollten kontrolliert aufbewahrt oder gelöscht werden. Projektdateien dürfen nicht überschrieben werden, wenn keine ausdrückliche Ersetzung beauftragt wurde. Tokens, Schlüssel und andere Geheimnisse werden niemals in Beispieltexten oder Ergebnisdateien gespeichert. Ein kompatibler Agent kann je nach Umgebung weitere Protokolle, Modellpfade oder Netzwerkdienste verwenden; deshalb muss das nutzende Team den tatsächlichen Datenfluss, die Berechtigungen und die Aufbewahrung separat prüfen. Imagegen beschleunigt die visuelle Arbeit, ersetzt aber keine redaktionelle, rechtliche, markenbezogene oder fachliche Freigabe.

Kostenlos
Anbieter
OpenAI
Lizenz
Apache-2.0
Zuletzt geprüft
09.09.2026

Repository und Dokumentation

Kategorien

Kompatibel mit

Codex