Claude Skills für Bilderzeugung
Image-Generation-Skills decken den vollständigen Raster-Workflow ab: Text zu Bild, Bearbeitung und Inpainting, Modellwahl, Stilsteuerung, Upscale und Restore sowie Brand-Assets. Skills in diesem Thema erzeugen oder bearbeiten Bitmap-Visuals wie Fotos, Illustrationen, Texturen, Sprites, Mockups und Freisteller mit transparentem Hintergrund. Sie sind nicht für Arbeiten geeignet, die besser durch Bearbeiten vorhandener SVG-, Vektor- oder code-nativer Assets, Erweitern eines etablierten Icon- oder Logo-Systems oder direktes Erstellen von Visuals in HTML, CSS oder Canvas erledigt werden. Die praktische Reihenfolge ist Prompt, Modell, Stilsteuerung, dann Bearbeiten und Upscale; Bearbeitung ist oft wichtiger als Generierung. Diese Liste ist nach beobachteter Suchnachfrage geordnet und auf Relevanz geprüft. Sie ist keine Empfehlung. Nutze sie, um Ansätze zu vergleichen, und lies dann die eigene Dokumentation jeder Skill, bevor du sie übernimmst.
8 zum Start
48 geprüfte Optionen
Hier anfangen.
Image work is prompt, model, style control, then edit and upscale — editing often matters more than generation.
Dies sind die relevantesten Ergebnisse. Öffne einen Skill, lies die Anleitung und prüfe die Eignung.
- Rang 01Agent Skill ansehenDirekt
imagegen
OffiziellRasterbilder generieren oder bearbeiten, wenn die Aufgabe von KI-erzeugten Bitmap-Visuals profitiert, etwa Fotos, Illustrationen, Texturen, Sprites, Mockups oder Freistellern mit transparentem Hintergrund. Verwenden, wenn Codex ein brandneues Bild erstellen, ein vorhandenes Bild transformieren oder visuelle Varianten aus Referenzen ableiten soll und die Ausgabe ein Bitmap-Asset statt repo-nativer Code oder Vektor sein soll. Nicht verwenden, wenn die Aufgabe besser durch Bearbeiten vorhandener SVG-/Vektor-/code-nativer Assets, Erweitern eines etablierten Icon- oder Logo-Systems oder direktes Erstellen des Visuals in HTML/CSS/canvas erledigt wird.
- Rang 02Agent Skill ansehenDirekt
ai-image-generation
BeachtenswertErzeugt KI-Bilder mit GPT-Image-2, FLUX, Gemini, Grok, Seedream, Reve und über 50 Modellen über die inference.sh CLI. Modelle: GPT-Image-2, FLUX Dev LoRA, FLUX.2 Klein LoRA, Gemini 3 Pro Image, Grok Imagine, Seedream 4.5, Reve, ImagineArt. Fähigkeiten: Text-zu-Bild, Bild-zu-Bild, Inpainting, LoRA, Bildbearbeitung, Upscaling, Textrendering. Verwendung für: KI-Kunst, Produkt-Mockups, Concept Art, Social-Media-Grafiken, Marketing-Visuals, Illustrationen. Trigger: flux, image generation, ai image, text to image, stable diffusion, generate image, ai art, midjourney alternative, dall-e alternative, text2img, t2i, i
142.155 · Beliebtheit - Rang 03Agent Skill ansehenDirekt
image-edit
Leitet Bildbearbeitung auf RunComfy an das richtige Modell weiter (Nano Banana Edit, GPT Image 2 Edit, Flux Kontext, Z-Image Inpaint) mit dokumentierten Prompting-Mustern für Batch-, Text-Rewrite- und Maskenbearbeitungen.
421.211 · Beliebtheit - Rang 04Agent Skill ansehenDirekt417.503 · Beliebtheit
gpt-image-edit
Beachtenswert - Rang 05Agent Skill ansehenDirekt
eachlabs-image-edit
Bearbeitet, transformiert, skaliert hoch und verbessert Bilder mit über 130 KI-Modellen über die EachLabs API, einschließlich Style Transfer, Hintergrundentfernung, Inpainting, Face Swap und Try-on.
759 · Beliebtheit - Rang 06Agent Skill ansehenDirekt
image
BeachtenswertWenn der Nutzer Bilder für Marketing erstellen, generieren, bearbeiten oder optimieren möchte – Blog-Heroes, Social-Grafiken, Produkt-Mockups, Profilbanner, Listing-Visuals oder Marken-Assets. Auch verwenden, wenn der Nutzer 'AI image generation,' 'generate an image,' 'create a graphic,' 'product mockup,' 'hero image,' 'social media graphic,' 'banner image,' 'cover photo,' 'profile banner,' 'listing screenshot,' 'Flux,' 'Flux Kontext,' 'Midjourney,' 'DALL-E,' 'GPT Image,' 'ChatGPT Images,' 'Ideogram,' 'Gemini image,' 'Nano Banana,' 'Recraft,' 'Stable Diffusion,' 'Canva,' 'Figma,' 'image optimization,' 'com erwähnt.
69.825 · Beliebtheit - Rang 07Agent Skill ansehenDirekt
qianwen-image-generation
Generiert und bearbeitet Bilder mit Wan- und Qwen-Image-Modellen und unterstützt Text-zu-Bild, Stiltransfer, Subjektkonsistenz, Multi-Bild-Komposition und Textrendering.
Voraussetzungen (angegeben): Python
4.826 · Beliebtheit - Rang 08Agent Skill ansehenDirekt
qwencloud-image-generation
Erzeugt und bearbeitet Bilder mit Wan- und Qwen-Image-Modellen, unterstützt Text-zu-Bild, Stilübertragung, Motivkonsistenz und Textrendering.
Voraussetzungen (angegeben): Python
1.421 · Beliebtheit
40 weitere Agent Skills anzeigen
- Rang 09Agent Skill ansehenDirekt
stable-diffusion-image-generation
Erzeugt Bilder mit Stable Diffusion über HuggingFace Diffusers, einschließlich Text-zu-Bild, Bild-zu-Bild, Inpainting, ControlNet und LoRA.
880 · Beliebtheit - Rang 10Agent Skill ansehenDirekt
eachlabs-image-generation
Erzeugt neue Bilder aus Text-Prompts mit über 60 KI-Modellen (Flux, GPT Image, Gemini, Imagen, Seedream) über die EachLabs Predictions API.
294 · Beliebtheit - Rang 11Agent Skill ansehenDirekt
zenmux-image-generation
Erzeugt oder bearbeitet Bilder über ZenMux mit GPT Image, Nano Banana, Qwen Image, Seedream, FLUX und mehr, optimiert Prompts und verwaltet Projektkonfiguration.
287 · Beliebtheit - Rang 12Agent Skill ansehenDirekt
ai-image-editing
Leitet AI-Bildbearbeitungsaufgaben (Inpainting, Hintergrundentfernung, Upscaling, Outpainting, Restaurierung, Retusche) mit einem aufgabenorientierten Framework und Ehrlichkeitshinweisen an die richtige Engine weiter.
288 · Beliebtheit - Rang 13Agent Skill ansehenDirekt
layer-image-editing
Bearbeitet vorhandene Bilder auf Layer: Inpainting, Outpainting, Reframing, Relighting, Restyling, Multi-Angle, Layer-Splitting, Hintergrundentfernung, Vektorisierung und Upscaling.
504 · Beliebtheit - Rang 14Agent Skill ansehenDirekt
fal-text-to-image
Erzeugt, remixt und bearbeitet Bilder mit fal.ai-Modellen (FLUX, Recraft, Imagen), einschließlich Text-zu-Bild, Bild-zu-Bild und maskiertem Inpainting.
184 · Beliebtheit - Rang 15Agent Skill ansehenDirekt
generate-image
Generiert und bearbeitet Bilder über die OpenRouter Image API (Gemini, Seedream, Recraft, GPT-Image), einschließlich Fotos, Illustrationen, Logos und Compositing aus Referenzen.
Voraussetzungen (angegeben): Credentials · Network access · Python
1.656 · Beliebtheit - Rang 16Agent Skill ansehenDirekt65.496 · Beliebtheit
gpt-image-2
Beachtenswert - Rang 17Agent Skill ansehenDirekt
image-generation
Erzeugt Bilder aus strukturierten JSON-Prompts mit optionalen Referenzbildern über ein Python-Skript, für Charakterdesign, Szenen und Produkte.
2.762 · Beliebtheit - Rang 18Agent Skill ansehenDirekt
ai-image-prompts-skill
Empfiehlt kuratierte Prompts aus einer Bibliothek mit über 10.000 praxiserprobten Bildgenerierungs-Prompts, funktioniert mit jedem Text-zu-Bild-Modell und enthält Beispielbilder.
978 · Beliebtheit - Rang 19Agent Skill ansehenDirekt
linkfox-multimodal-generate-image
Erzeugt und bearbeitet Bilder für Produktvisuals über die Linkfox API, einschließlich Text-zu-Bild, Bild-zu-Bild, Hintergrundaustausch, Stilübertragung und Modellwechsel.
382 · Beliebtheit - Rang 20Agent Skill ansehenDirekt
image-prompt
Verwandelt ein Social-Media-Bedürfnis in ein Image-Brief, vermittelt modellagnostisches Prompt-Handwerk und leitet zum richtigen Bild-Tool weiter, mit KI-Generierungs-Gate und Barrierefreiheits-Hinweisen.
310 · Beliebtheit - Rang 21Agent Skill ansehenDirekt
marketing-image-generation
Generiert Marketingbilder, Werbemotive, Social Cards, Blog-Header und Produkt-Mockups, mit einem konkreten Workflow zur visuellen Ausrichtung und Anleitung zur Vermeidung von KI-Einheitsbrei.
217 · Beliebtheit - Rang 22Agent Skill ansehenDirekt
zimage-generation
Generiert Bilder über die Z-Image API von ModelScope mithilfe eines Python-Skripts, ausgelöst durch Zimage- oder ModelScope-Anfragen.
864 · Beliebtheit - Rang 23Agent Skill ansehenDirekt
short-drama-image-prompts
Schreibt kopierfertige Bild-Prompts für Kurzdrama-Charaktere, Looks, Orte, Requisiten und Zustandsvarianten, einschließlich Referenz- und Bearbeitungs-Prompt-Anleitung.
367 · Beliebtheit - Rang 24Agent Skill ansehenMöglich
brandkit
BeachtenswertPremium-Skill zur Bildgenerierung für Brand-Kits, zum Erstellen hochwertiger Brand-Guidelines-Boards, Logo-Systeme, Identity-Decks und Visual-World-Präsentationen. Trainiert für minimalistische, filmische, redaktionelle, Dark-Tech-, Luxus-, Kultur-, Sicherheits-, Gaming-, Developer-Tool- und Consumer-App-Markensysteme. Optimiert für bewusstes Logo-Konzepting, raffinierte Komposition, sparsame Typografie, starke symbolische Bedeutung, Premium-Mockups, art-direktierte Bildwelten und flexible Rasterlayouts.
297.293 · Beliebtheit - Rang 25Agent Skill ansehenMöglich
imagegen-frontend-mobile
BeachtenswertElite-Skill zur Bildgenerierung für mobile Apps, um erstklassige, app-native Screen-Konzepte und Flows zu erstellen. Konzipiert für iOS-, Android- und plattformübergreifende mobile Produkte. Priorisiert klare Hierarchie, gut lesbaren Text, starke Konsistenz über mehrere Screens, kontrollierte Farbpaletten, nicht-generische kreative Richtung, texturierte Oberflächen, bildgeführte Komposition, geschmackvolle individuelle Ikonografie und saubere Phone-Mockup-Rahmung. Standardmäßig sollten Screens in einem dezenten, hochwertigen iPhone- oder ähnlichen Phone-Mockup mit sichtbarem Rahmen gezeigt werden, während der Hauptfokus auf dem App-Inhalt selbst bleibt. Dieser Skill generiert
284.892 · Beliebtheit - Rang 26Agent Skill ansehenMöglich
chatgpt-image-ad
Generiert Meta-Bildanzeigen-Creatives über ChatGPT Image 2 durch die Arcads API, mit rand-sicheren Layouts und Glyph-Safety-Guards.
164 · Beliebtheit - Rang 27Agent Skill ansehenMöglich
nano-banana-image-ad
Erzeugt Meta-Bildanzeigen-Creatives über Nano Banana 2/Pro durch die Arcads API, mit edge-sicheren Layouts und Multi-Referenz-Unterstützung.
164 · Beliebtheit - Rang 28Agent Skill ansehenMöglich
syncfusion-react-image-editor
Implementiert die Syncfusion React Image Editor-Komponente für Zuschneiden, Anmerkungen, Filter, Transformationen und Export in React-Apps.
639 · Beliebtheit - Rang 29Agent Skill ansehenMöglich
syncfusion-blazor-image-editor
Implementiert die Syncfusion Blazor Image Editor-Komponente für Zuschneiden, Anmerkungen, Filter, Transformationen und Export.
329 · Beliebtheit - Rang 30Agent Skill ansehenMöglich
syncfusion-angular-image-editor
Implementiert die Syncfusion Angular Image Editor-Komponente zum Zuschneiden, für Anmerkungen, Filter, Transformationen und Export.
271 · Beliebtheit - Rang 31Agent Skill ansehenMöglich
syncfusion-maui-image-editor
Implementiert den Syncfusion .NET MAUI ImageEditor zum Zuschneiden, Transformieren, Annotieren, Filtern und Speichern bearbeiteter Bilder.
160 · Beliebtheit - Rang 32Agent Skill ansehenMöglich
physical-ai-defect-image-generation
Orchestriert die Generierung von Defektbildern mit NVIDIA Cosmos AnomalyGen auf OSMO für die PCBA-, Metall- und Glasinspektion, einschließlich Bildbearbeitungs-Augmentierung.
1.936 · Beliebtheit - Rang 33Agent Skill ansehenMöglich
image-editing
Leitet Bildbearbeitung und -verbesserung für Xiaohongshu-Inhalte mit mobilen Apps an, inklusive Anpassungen, Farbkorrektur, Retusche und Texteinblendungen.
422 · Beliebtheit - Rang 34Agent Skill ansehenMöglich
venice-image-edit
Katalogeintrag, der für Venice.ai Bildbearbeitungen, Upscaling und Hintergrundentfernung wirbt und auf das Upstream-Bundle für den vollständigen Workflow verweist.
2.495 · Beliebtheit - Rang 35Agent Skill ansehenMöglich
build
Implementiert Funktionen und richtet CE.SDK Web-Projekte für die Erstellung von Foto-, Video- und Design-Editoren über verschiedene Frameworks hinweg ein.
140 · Beliebtheit - Rang 36Agent Skill ansehenMöglich
fal-image-edit
Schlanker Katalogeintrag zu KI-gestützter Bildbearbeitung mit Style Transfer und Objektentfernung, der auf einen vorgelagerten fal.ai Skill verweist.
285 · Beliebtheit - Rang 37Agent Skill ansehenMöglich
og-image-generation
Erzeugt dynamische Social-Preview-Bilder (OG) mit Next.js-Dateikonventionen und der next/og-Bibliothek.
234 · Beliebtheit - Rang 38Agent Skill ansehenMöglich
neta
Routing-Skill, das Neta-Fähigkeiten indexiert und auf Sub-Skills verweist, darunter neta-creative für Bild-/Video-/Song-Generierung.
152 · Beliebtheit - Rang 39Agent Skill ansehenMöglich
editor
Analysiert, generiert und bearbeitet Video/Audio/Bilder mit Diffusion Studio und erstellt Videokompositionen.
1.447 · Beliebtheit - Rang 40Agent Skill ansehenMöglich
enhance-prompt
BeachtenswertVerwandelt vage UI-Ideen in ausgefeilte, Stitch-optimierte Prompts. Erhöht die Spezifität, fügt UI/UX-Keywords hinzu, injiziert Design-System-Kontext und strukturiert die Ausgabe für bessere Generierungsergebnisse.
56.037 · Beliebtheit - Rang 41Agent Skill ansehenMöglich
image-optimization
Optimiert Bilder für das Web mit Komprimierung, modernen Formaten und responsiven Techniken zur Reduzierung der Dateigröße.
648 · Beliebtheit - Rang 42Agent Skill ansehenMöglich
hatch-pet
OffiziellErstellt, repariert, validiert, prüft visuell und paketiert Codex-kompatible animierte Pets und Pet-Spritesheets aus Charakter-Art, generierten Bildern, Markenhinweisen von Unternehmen oder Interessenten oder visuellen Referenzen. Verwenden, wenn ein Nutzer einen Codex-Pet-Workflow für leichtgewichtige Worker, einen Nicht-Pixel-Custom-Pet-Stil, ein Prospect- oder Unternehmens-Maskottchen-Pet oder einen vollständigen 8x9 animierten Pet-Atlas mit transparenten ungenutzten Zellen, QA-Kontaktbögen und pet.json-Paketierung möchte. Dieser Skill kombiniert den installierten $imagegen-System-Skill für visuelle Generierung und nutzt gebündelte Skripte für deterministische Spritesheet-Montage.
Voraussetzungen (angegeben): Credentials
- Rang 43Agent Skill ansehenMöglich525.176 · Beliebtheit
image-to-video
Beachtenswert - Rang 44Agent Skill ansehenMöglich192.138 · Beliebtheit
seedance-2-5-image-to-video
Beachtenswert - Rang 45Agent Skill ansehenMöglich
ai-video-generation
BeachtenswertGeneriert KI-Videos mit Google Veo, Seedance 2.0, HappyHorse, Wan, Grok und über 40 Modellen über die inference.sh CLI. Modelle: Veo 3.1, Veo 3, Seedance 2.0, HappyHorse 1.0, Wan 2.5, Grok Imagine Video, OmniHuman, Fabric, HunyuanVideo. Fähigkeiten: Text-zu-Video, Bild-zu-Video, Referenz-zu-Video, Videobearbeitung, Lipsync, Avatar-Animation, Video-Upscaling, Foley-Sound. Verwenden für: Social-Media-Videos, Marketinginhalte, Erklärvideos, Produktdemos, KI-Avatare. Auslöser: video generation, ai video, text to video, image to video, veo, animate image, video from image, ai animation, video generator, genera
142.615 · Beliebtheit - Rang 46Agent Skill ansehenMöglich
ai-avatar-video
BeachtenswertErstelle KI-Avatare und Talking-Head-Videos über die inference.sh CLI. Empfohlen: P-Video-Avatar (schnellste, günstigste, integrierte TTS). Außerdem: OmniHuman, Fabric, PixVerse. Audio: Inworld TTS-2 (100+ Sprachen, Emotionssteuerung für Charaktere), ElevenLabs, Kokoro. Fähigkeiten: audiogesteuerte Avatare, Text-to-Avatar, Lipsync-Videos, Talking-Head-Generierung, virtuelle Präsentatoren, UGC-Inhalte. Verwendung für: KI-Präsentatoren, Erklärvideos, virtuelle Influencer, Dubbing, Marketingvideos, UGC-Anzeigen, Gaming-Avatare, NPC-Dialoge. Auslöser: ai avatar, talking head, lipsync, avatar video, virtual presenter, ai spokesperson
142.016 · Beliebtheit - Rang 47Agent Skill ansehenMöglich
chanjing-digital-human
Integriert die Chanjing-Plattform für Digital-Human-Videosynthese und KI-Creation-Bild-/Video-Assets innerhalb von FrameVideo.
150 · Beliebtheit - Rang 48Agent Skill ansehenMöglich
glmv-prompt-gen
Analysiert Bilder/Videos und erzeugt professionelle Prompts für Text-zu-Bild- und Text-zu-Video-Tools wie Midjourney, Stable Diffusion, DALL-E, Sora und Kling.
Voraussetzungen (angegeben): API key · Python
300 · Beliebtheit
Häufige Fragen
- Wann sollte ich einen Bildgenerierungs-Skill statt der Bearbeitung von SVG- oder code-nativen Assets verwenden?
- Verwende einen, wenn die Ausgabe ein Bitmap-Asset sein soll, etwa ein Foto, eine Illustration, eine Textur, ein Sprite, ein Mockup oder ein Freisteller mit transparentem Hintergrund. Vermeide ihn, wenn die Aufgabe besser durch Bearbeiten vorhandener SVG-, Vektor- oder code-nativer Assets, durch Erweitern eines etablierten Icon- oder Logo-Systems oder durch direktes Erstellen des Visuellen in HTML, CSS oder Canvas erledigt wird.
- Welche Fähigkeiten decken Skills in diesem Thema typischerweise ab?
- Sie reichen von Text-zu-Bild, Bild-zu-Bild, Inpainting, LoRA, Bildbearbeitung, Upscaling und Textrendering bis hin zu Style Transfer, Hintergrundentfernung, Face Swap und Try-on. Einige leiten Bearbeitungsanfragen an bestimmte Modelle mit dokumentierten Prompting-Mustern für Batch-, Text-Rewrite- und Mask-Bearbeitungen weiter.
- Ist bei einem Bild-Workflow Generierung oder Bearbeitung wichtiger?
- Der Workflow läuft als Prompt, Modell, Stilkontrolle, dann Bearbeiten und Hochskalieren, und Bearbeiten ist oft wichtiger als Generieren. Viele Skills konzentrieren sich darauf, ein vorhandenes Bild zu transformieren oder visuelle Varianten aus Referenzen abzuleiten, statt ein brandneues Bild zu erstellen.
- Wie wird diese gereihte Liste zusammengestellt, und ist sie eine Empfehlung?
- Die Liste ist nach beobachteter Suchnachfrage gerankt und auf Relevanz geprüft. Sie ist keine Empfehlung, also prüfe die Dokumentation jedes Skills, bevor du dich darauf verlässt.
Agent Skill installieren
Agent Skills sind SKILL.md-Dateien. Die meisten Agenten erkennen sie, sobald sie im richtigen Skills-Verzeichnis liegen:
- Claude Code — copy the SKILL.md for imagegen into ~/.claude/skills/imagegen/ for yourself, or .claude/skills/imagegen/ to share it with a project.
- From the registry — run npx skills add openai/skills@imagegen.
- Or download imagegen from its source and place that SKILL.md in the directory above.
Wie auswählen Prüfe Quelle und Anleitung des Skills vor der Installation. Die Labels Official und Notable beschreiben die Herkunft, nicht die Sicherheit.