面向图像生成的 Claude Skills
图像生成技能覆盖完整的光栅工作流:文生图、编辑和修复、模型选择、风格控制、放大和修复,以及品牌资产。本主题中的技能生成或编辑位图视觉内容,例如照片、插画、纹理、精灵图、样机和透明背景抠图。它们不适合更适合通过编辑现有 SVG、矢量或代码原生资产、扩展既有图标或 logo 系统,或直接用 HTML、CSS 或 canvas 构建视觉内容来处理的工作。实际顺序是提示词、模型、风格控制,然后编辑和放大;编辑往往比生成更重要。该列表按观察到的搜索需求排名,并经过相关性审核。它不是推荐。用它比较方法,然后在采用前阅读每个技能自己的文档。
8 个先看
48 个已审核选项
从这些开始。
Image work is prompt, model, style control, then edit and upscale — editing often matters more than generation.
这些是和这项工作最接近的结果。从第一条开始,打开后即可安装。
- 排名 01查看 Agent Skill直接匹配
imagegen
官方当任务需要 AI 生成的位图视觉素材(如照片、插图、纹理、精灵图、样机或透明背景抠图)时,生成或编辑栅格图像。适用于 Codex 应创建全新图像、转换现有图像或从参考图衍生视觉变体,且输出应为位图资产而非仓库原生代码或矢量的情况。当任务更适合通过编辑现有 SVG/矢量/代码原生资产、扩展现有图标或标志系统,或直接用 HTML/CSS/canvas 构建视觉时,请勿使用。
- 排名 02查看 Agent Skill直接匹配
ai-image-generation
精选通过 inference.sh CLI 使用 GPT-Image-2、FLUX、Gemini、Grok、Seedream、Reve 及 50+ 模型生成 AI 图像。模型:GPT-Image-2、FLUX Dev LoRA、FLUX.2 Klein LoRA、Gemini 3 Pro Image、Grok Imagine、Seedream 4.5、Reve、ImagineArt。能力:文生图、图生图、修复、LoRA、图像编辑、放大、文字渲染。用于:AI 艺术、产品样机、概念艺术、社交媒体图形、营销视觉、插画。触发词:flux、图像生成、ai image、text to image、stable diffusion、generate image、ai art、midjourney alternative、dall-e alternative、text2img、t2i、i
142,155 · 受欢迎程度 - 排名 03查看 Agent Skill直接匹配
image-edit
在 RunComfy 上将图像编辑路由到合适的模型(Nano Banana Edit、GPT Image 2 Edit、Flux Kontext、Z-Image Inpaint),并提供用于批量、文本重写和蒙版编辑的文档化提示模式。
421,211 · 受欢迎程度 - 排名 04查看 Agent Skill直接匹配417,503 · 受欢迎程度
gpt-image-edit
精选 - 排名 05查看 Agent Skill直接匹配
eachlabs-image-edit
通过 EachLabs API 使用 130 多个 AI 模型编辑、转换、放大和增强图像,涵盖风格迁移、背景移除、inpainting、换脸和试穿。
759 · 受欢迎程度 - 排名 06查看 Agent Skill直接匹配
image
精选当用户想要为营销创建、生成、编辑或优化图像时——博客主图、社交图形、产品样机、个人资料横幅、商品列表视觉或品牌资产。也适用于用户提到 'AI image generation'、'generate an image'、'create a graphic'、'product mockup'、'hero image'、'social media graphic'、'banner image'、'cover photo'、'profile banner'、'listing screenshot'、'Flux'、'Flux Kontext'、'Midjourney'、'DALL-E'、'GPT Image'、'ChatGPT Images'、'Ideogram'、'Gemini image'、'Nano Banana'、'Recraft'、'Stable Diffusion'、'Canva'、'Figma'、'image optimization'、'com
69,825 · 受欢迎程度 - 排名 07查看 Agent Skill直接匹配
qianwen-image-generation
使用 Wan 和 Qwen Image 模型生成和编辑图像,支持文生图、风格迁移、主体一致性、多图合成和文字渲染。
声明的前提(自述): Python
4,826 · 受欢迎程度 - 排名 08查看 Agent Skill直接匹配
qwencloud-image-generation
使用 Wan 和 Qwen Image 模型生成和编辑图像,支持文生图、风格迁移、主体一致性和文字渲染。
声明的前提(自述): Python
1,421 · 受欢迎程度
展开另外 40 个 Agent Skills
- 排名 09查看 Agent Skill直接匹配
stable-diffusion-image-generation
通过 HuggingFace Diffusers 使用 Stable Diffusion 生成图像,涵盖文生图、图生图、修复、ControlNet 和 LoRA。
880 · 受欢迎程度 - 排名 10查看 Agent Skill直接匹配
eachlabs-image-generation
通过 EachLabs Predictions API,使用 60+ AI 模型(Flux、GPT Image、Gemini、Imagen、Seedream)从文本提示词生成新图像。
294 · 受欢迎程度 - 排名 11查看 Agent Skill直接匹配
zenmux-image-generation
通过 ZenMux 使用 GPT Image、Nano Banana、Qwen Image、Seedream、FLUX 等生成或编辑图像,优化提示词并管理项目配置。
287 · 受欢迎程度 - 排名 12查看 Agent Skill直接匹配
ai-image-editing
通过任务优先框架和诚实指导,将 AI 图像编辑任务(修复、背景移除、放大、外绘、修复、润饰)路由到合适的引擎。
288 · 受欢迎程度 - 排名 13查看 Agent Skill直接匹配
layer-image-editing
在 Layer 上编辑现有图像:修复、扩图、重新构图、重新打光、重新风格化、多角度、图层拆分、背景移除、矢量化 and 超分辨率。
504 · 受欢迎程度 - 排名 14查看 Agent Skill直接匹配
fal-text-to-image
使用 fal.ai 模型(FLUX、Recraft、Imagen)生成、混音和编辑图像,涵盖文生图、图生图和蒙版修复。
184 · 受欢迎程度 - 排名 15查看 Agent Skill直接匹配
generate-image
通过 OpenRouter Image API(Gemini、Seedream、Recraft、GPT-Image)生成和编辑图像,涵盖照片、插画、标志以及基于参考图的合成。
声明的前提(自述): Credentials · Network access · Python
1,656 · 受欢迎程度 - 排名 16查看 Agent Skill直接匹配65,496 · 受欢迎程度
gpt-image-2
精选 - 排名 17查看 Agent Skill直接匹配
image-generation
通过 Python 脚本从结构化 JSON 提示词生成图像,可选参考图像,涵盖角色设计、场景和产品。
2,762 · 受欢迎程度 - 排名 18查看 Agent Skill直接匹配
ai-image-prompts-skill
从 10,000+ 真实图像生成提示词库中推荐精选提示词,适用于任何文生图模型,并包含示例图像。
978 · 受欢迎程度 - 排名 19查看 Agent Skill直接匹配
linkfox-multimodal-generate-image
通过 Linkfox API 生成和编辑产品视觉图像,涵盖文生图、图生图、背景替换、风格迁移和模型替换。
382 · 受欢迎程度 - 排名 20查看 Agent Skill直接匹配
image-prompt
将社交需求转化为图像简报,教授与模型无关的提示词技巧,并路由到合适的图像工具,附带 AI 生成门控和无障碍说明。
310 · 受欢迎程度 - 排名 21查看 Agent Skill直接匹配
marketing-image-generation
生成营销图像、广告创意、社交卡片、博客头图和产品样机,提供具体的视觉方向工作流和避免 AI 感泛滥的指导。
217 · 受欢迎程度 - 排名 22查看 Agent Skill直接匹配
zimage-generation
通过 Python 脚本使用 ModelScope 的 Z-Image API 生成图像,由 Zimage 或 ModelScope 请求触发。
864 · 受欢迎程度 - 排名 23查看 Agent Skill直接匹配
short-drama-image-prompts
为短剧角色、造型、地点、道具和状态变体撰写可直接复制的图像提示,包括参考和编辑提示指导。
367 · 受欢迎程度 - 排名 24查看 Agent Skill可能匹配
brandkit
精选高端品牌套件图像生成 skill,用于创建高端品牌指南板、logo 系统、品牌识别演示文稿和视觉世界展示。针对极简、电影感、编辑风、暗黑科技、奢华、文化、安全、游戏、开发者工具和消费级应用等品牌体系训练。优化方向包括有意图的 logo 概念设计、精致构图、稀疏排版、强符号意义、高端样机、艺术指导图像和灵活网格布局。
297,293 · 受欢迎程度 - 排名 25查看 Agent Skill可能匹配
imagegen-frontend-mobile
精选面向高端移动应用的精英级图像生成技能,用于创建优质、应用原生的屏幕概念和流程。专为 iOS、Android 和跨平台移动产品设计。优先考虑清晰的层级、舒适可读的文字、强大的多屏一致性、受控的配色方案、非通用的创意方向、有质感的表面、以图像为主导的构图、有品位的自定义图标以及干净的手机样机边框。默认情况下,屏幕应显示在带有可见边框的精致高端 iPhone 或类似手机样机中,同时主要焦点仍保持在应用内容本身。此技能生成
284,892 · 受欢迎程度 - 排名 26查看 Agent Skill可能匹配
chatgpt-image-ad
通过Arcads API使用ChatGPT Image 2生成Meta图片广告素材,具备边缘安全布局和字形安全防护。
164 · 受欢迎程度 - 排名 27查看 Agent Skill可能匹配
nano-banana-image-ad
通过 Arcads API 使用 Nano Banana 2/Pro 生成 Meta 图片广告创意,支持边缘安全布局和多参考图。
164 · 受欢迎程度 - 排名 28查看 Agent Skill可能匹配
syncfusion-react-image-editor
在 React 应用中实现 Syncfusion React Image Editor 组件,用于裁剪、标注、滤镜、变换和导出。
639 · 受欢迎程度 - 排名 29查看 Agent Skill可能匹配
syncfusion-blazor-image-editor
实现Syncfusion Blazor Image Editor组件,用于裁剪、标注、滤镜、变换和导出。
329 · 受欢迎程度 - 排名 30查看 Agent Skill可能匹配
syncfusion-angular-image-editor
实现 Syncfusion Angular Image Editor 组件,用于裁剪、标注、滤镜、变换和导出。
271 · 受欢迎程度 - 排名 31查看 Agent Skill可能匹配
syncfusion-maui-image-editor
实现 Syncfusion .NET MAUI ImageEditor,用于裁剪、变换、注释、滤镜和保存编辑后的图像。
160 · 受欢迎程度 - 排名 32查看 Agent Skill可能匹配
physical-ai-defect-image-generation
在 OSMO 上使用 NVIDIA Cosmos AnomalyGen 编排缺陷图像生成,用于 PCBA、金属和玻璃检测,包括图像编辑增强。
1,936 · 受欢迎程度 - 排名 33查看 Agent Skill可能匹配
image-editing
指导使用移动应用为小红书内容进行图像编辑和增强,涵盖调整、色彩校正、修图和文字叠加。
422 · 受欢迎程度 - 排名 34查看 Agent Skill可能匹配
venice-image-edit
目录条目,宣传 Venice.ai 图像编辑、放大和背景移除,指向上游捆绑包以获取完整工作流。
2,495 · 受欢迎程度 - 排名 35查看 Agent Skill可能匹配
build
实现功能并搭建 CE.SDK Web 项目,用于跨框架构建照片、视频和设计编辑器。
140 · 受欢迎程度 - 排名 36查看 Agent Skill可能匹配
fal-image-edit
精简的目录条目,介绍具备风格迁移和对象移除功能的 AI 图像编辑,指向上游的 fal.ai skill。
285 · 受欢迎程度 - 排名 37查看 Agent Skill可能匹配
og-image-generation
使用 Next.js 文件约定和 next/og 库生成动态社交预览(OG)图像。
234 · 受欢迎程度 - 排名 38查看 Agent Skill可能匹配
neta
路由技能,索引 Neta 能力并指向子技能,包括用于图像/视频/歌曲生成的 neta-creative。
152 · 受欢迎程度 - 排名 39查看 Agent Skill可能匹配
editor
使用 Diffusion Studio 分析、生成和编辑视频/音频/图像,并合成视频作品。
1,447 · 受欢迎程度 - 排名 40查看 Agent Skill可能匹配
enhance-prompt
精选将模糊的 UI 想法转化为精炼、针对 Stitch 优化的提示。增强具体性、添加 UI/UX 关键词、注入设计系统上下文,并组织输出以获得更好的生成结果。
56,037 · 受欢迎程度 - 排名 41查看 Agent Skill可能匹配
image-optimization
通过压缩、现代格式和响应式技术优化网页图像,以减小文件大小。
648 · 受欢迎程度 - 排名 42查看 Agent Skill可能匹配
hatch-pet
官方从角色美术、生成图像、公司或潜在客户品牌线索或视觉参考中,创建、修复、验证、视觉 QA 并打包 Codex 兼容的动画宠物和宠物精灵表。当用户想要轻量级 worker Codex 宠物工作流、非像素自定义宠物风格、潜在客户或公司吉祥物宠物,或带有透明未使用单元格、QA 联系表和 pet.json 打包的完整 8x9 动画宠物图集时使用。此技能组合已安装的 $imagegen 系统技能进行视觉生成,并使用捆绑脚本进行确定性精灵表组装。
声明的前提(自述): Credentials
- 排名 43查看 Agent Skill可能匹配525,176 · 受欢迎程度
image-to-video
精选 - 排名 44查看 Agent Skill可能匹配192,138 · 受欢迎程度
seedance-2-5-image-to-video
精选 - 排名 45查看 Agent Skill可能匹配
ai-video-generation
精选通过 inference.sh CLI 使用 Google Veo、Seedance 2.0、HappyHorse、Wan、Grok 及 40+ 模型生成 AI 视频。模型:Veo 3.1、Veo 3、Seedance 2.0、HappyHorse 1.0、Wan 2.5、Grok Imagine Video、OmniHuman、Fabric、HunyuanVideo。能力:文生视频、图生视频、参考生视频、视频编辑、唇形同步、虚拟形象动画、视频超分、拟音音效。用途:社交媒体视频、营销内容、讲解视频、产品演示、AI 虚拟形象。触发词:视频生成、ai video、text to video、image to video、veo、animate image、video from image、ai animation、video generator、genera
142,615 · 受欢迎程度 - 排名 46查看 Agent Skill可能匹配
ai-avatar-video
精选通过 inference.sh CLI 创建 AI 虚拟形象和口播视频。推荐:P-Video-Avatar(最快、最便宜、内置 TTS)。其他:OmniHuman、Fabric、PixVerse。音频:Inworld TTS-2(100+ 种语言,支持角色情感控制)、ElevenLabs、Kokoro。能力:音频驱动虚拟形象、文本转虚拟形象、唇同步视频、口播生成、虚拟主播、UGC 内容。适用场景:AI 主播、讲解视频、虚拟网红、配音、营销视频、UGC 广告、游戏虚拟形象、NPC 对话。触发词:ai avatar、talking head、lipsync、avatar video、virtual presenter、ai spokesperson
142,016 · 受欢迎程度 - 排名 47查看 Agent Skill可能匹配
chanjing-digital-human
集成 Chanjing 平台,在 FrameVideo 中实现数字人视频合成和 AI Creation 图像/视频素材。
150 · 受欢迎程度 - 排名 48查看 Agent Skill可能匹配
glmv-prompt-gen
分析图像/视频,并为 Midjourney、Stable Diffusion、DALL-E、Sora 和 Kling 等文生图和文生视频工具生成专业提示词。
声明的前提(自述): API key · Python
300 · 受欢迎程度
常见问题
- 什么时候应该使用图像生成技能,而不是编辑 SVG 或代码原生资产?
- 当输出应为位图资产时使用它,例如照片、插画、纹理、精灵图、样机或透明背景抠图。当任务更适合通过编辑现有 SVG、矢量或代码原生资产、扩展现有图标或 logo 体系,或直接用 HTML、CSS 或 canvas 构建视觉时,避免使用它。
- 该主题中的技能通常涵盖哪些能力?
- 它们涵盖文生图、图生图、修复、LoRA、图像编辑、放大和文本渲染,以及风格迁移、背景移除、换脸和试穿。有些会将编辑请求路由到特定模型,并提供用于批量、文本重写和蒙版编辑的文档化提示模式。
- 在图像工作流程中,生成和编辑哪个更重要?
- 工作流程依次是提示词、模型、风格控制,然后编辑和放大,而编辑往往比生成更重要。许多技能专注于转换现有图像或从参考中衍生视觉变体,而不是创建全新图像。
- 这个排序列表是如何整理的,它是否构成背书?
- 该列表按观察到的搜索需求排序,并经过相关性审核。它并非背书,因此在依赖它之前,请查看每个技能的文档。
如何安装 Agent Skill
从本页第一条开始。Claude Code 会读取放进 skills 目录的 SKILL.md:
- Claude Code——把 imagegen 的 SKILL.md 复制到 ~/.claude/skills/imagegen/(个人使用),或 .claude/skills/imagegen/(随项目共享)。
- 从 registry 安装——运行 npx skills add openai/skills@imagegen。
- 或者从 imagegen 的来源下载 SKILL.md,放进上面的目录。
如何挑选 安装前先看出处和技能自身的说明。Official 与 Notable 标签描述的是来源,不代表安全。