面向图像生成的 Claude Skills

图像生成技能覆盖完整的光栅工作流:文生图、编辑和修复、模型选择、风格控制、放大和修复,以及品牌资产。本主题中的技能生成或编辑位图视觉内容,例如照片、插画、纹理、精灵图、样机和透明背景抠图。它们不适合更适合通过编辑现有 SVG、矢量或代码原生资产、扩展既有图标或 logo 系统,或直接用 HTML、CSS 或 canvas 构建视觉内容来处理的工作。实际顺序是提示词、模型、风格控制,然后编辑和放大;编辑往往比生成更重要。该列表按观察到的搜索需求排名,并经过相关性审核。它不是推荐。用它比较方法,然后在采用前阅读每个技能自己的文档。

8 个先看
48 个已审核选项

从这些开始。

Image work is prompt, model, style control, then edit and upscale — editing often matters more than generation.

这些是和这项工作最接近的结果。从第一条开始,打开后即可安装。

48 个已审核选项

  1. 排名 04
    直接匹配

    gpt-image-edit

    精选
    • Text to image
    • Models
    417,503 · 受欢迎程度
    查看 Agent Skill
  2. 排名 05
    直接匹配

    eachlabs-image-edit

    通过 EachLabs API 使用 130 多个 AI 模型编辑、转换、放大和增强图像,涵盖风格迁移、背景移除、inpainting、换脸和试穿。

    • Editing and inpainting
    • Models
    • Style control
    759 · 受欢迎程度
    查看 Agent Skill
  3. 排名 06
    直接匹配

    image

    精选

    当用户想要为营销创建、生成、编辑或优化图像时——博客主图、社交图形、产品样机、个人资料横幅、商品列表视觉或品牌资产。也适用于用户提到 'AI image generation'、'generate an image'、'create a graphic'、'product mockup'、'hero image'、'social media graphic'、'banner image'、'cover photo'、'profile banner'、'listing screenshot'、'Flux'、'Flux Kontext'、'Midjourney'、'DALL-E'、'GPT Image'、'ChatGPT Images'、'Ideogram'、'Gemini image'、'Nano Banana'、'Recraft'、'Stable Diffusion'、'Canva'、'Figma'、'image optimization'、'com

    • Editing and inpainting
    • Models
    • Style control
    69,825 · 受欢迎程度
    查看 Agent Skill
  4. 排名 07
    直接匹配

    qianwen-image-generation

    使用 Wan 和 Qwen Image 模型生成和编辑图像,支持文生图、风格迁移、主体一致性、多图合成和文字渲染。

    • Text to image
    • Editing and inpainting
    • Style control

    声明的前提(自述): Python

    4,826 · 受欢迎程度
    查看 Agent Skill
  5. 排名 08
    直接匹配

    qwencloud-image-generation

    使用 Wan 和 Qwen Image 模型生成和编辑图像,支持文生图、风格迁移、主体一致性和文字渲染。

    • Text to image
    • Editing and inpainting
    • Style control

    声明的前提(自述): Python

    1,421 · 受欢迎程度
    查看 Agent Skill
展开另外 40 个 Agent Skills
  1. 排名 09
    直接匹配

    stable-diffusion-image-generation

    通过 HuggingFace Diffusers 使用 Stable Diffusion 生成图像,涵盖文生图、图生图、修复、ControlNet 和 LoRA。

    • Text to image
    • Editing and inpainting
    • Models
    880 · 受欢迎程度
    查看 Agent Skill
  2. 排名 10
    直接匹配

    eachlabs-image-generation

    通过 EachLabs Predictions API,使用 60+ AI 模型(Flux、GPT Image、Gemini、Imagen、Seedream)从文本提示词生成新图像。

    • Text to image
    • Editing and inpainting
    • Models
    294 · 受欢迎程度
    查看 Agent Skill
  3. 排名 11
    直接匹配

    zenmux-image-generation

    通过 ZenMux 使用 GPT Image、Nano Banana、Qwen Image、Seedream、FLUX 等生成或编辑图像,优化提示词并管理项目配置。

    • Text to image
    • Editing and inpainting
    • Models
    287 · 受欢迎程度
    查看 Agent Skill
  4. 排名 12
    直接匹配

    ai-image-editing

    通过任务优先框架和诚实指导,将 AI 图像编辑任务(修复、背景移除、放大、外绘、修复、润饰)路由到合适的引擎。

    • Text to image
    • Editing and inpainting
    • Models
    288 · 受欢迎程度
    查看 Agent Skill
  5. 排名 13
    直接匹配

    layer-image-editing

    在 Layer 上编辑现有图像:修复、扩图、重新构图、重新打光、重新风格化、多角度、图层拆分、背景移除、矢量化 and 超分辨率。

    • Text to image
    • Editing and inpainting
    • Upscale and restore
    504 · 受欢迎程度
    查看 Agent Skill
  6. 排名 14
    直接匹配

    fal-text-to-image

    使用 fal.ai 模型(FLUX、Recraft、Imagen)生成、混音和编辑图像,涵盖文生图、图生图和蒙版修复。

    • Text to image
    • Editing and inpainting
    • Models
    184 · 受欢迎程度
    查看 Agent Skill
  7. 排名 15
    直接匹配

    generate-image

    通过 OpenRouter Image API(Gemini、Seedream、Recraft、GPT-Image)生成和编辑图像,涵盖照片、插画、标志以及基于参考图的合成。

    • Text to image
    • Editing and inpainting
    • Models

    声明的前提(自述): Credentials · Network access · Python

    1,656 · 受欢迎程度
    查看 Agent Skill
  8. 排名 16
    直接匹配

    gpt-image-2

    精选
    • Text to image
    • Models
    • Style control
    65,496 · 受欢迎程度
    查看 Agent Skill
  9. 排名 17
    直接匹配

    image-generation

    通过 Python 脚本从结构化 JSON 提示词生成图像,可选参考图像,涵盖角色设计、场景和产品。

    • Text to image
    • Style control
    2,762 · 受欢迎程度
    查看 Agent Skill
  10. 排名 18
    直接匹配

    ai-image-prompts-skill

    从 10,000+ 真实图像生成提示词库中推荐精选提示词,适用于任何文生图模型,并包含示例图像。

    • Text to image
    • Models
    978 · 受欢迎程度
    查看 Agent Skill
  11. 排名 19
    直接匹配

    linkfox-multimodal-generate-image

    通过 Linkfox API 生成和编辑产品视觉图像,涵盖文生图、图生图、背景替换、风格迁移和模型替换。

    • Text to image
    • Editing and inpainting
    • Style control
    382 · 受欢迎程度
    查看 Agent Skill
  12. 排名 20
    直接匹配

    image-prompt

    将社交需求转化为图像简报,教授与模型无关的提示词技巧,并路由到合适的图像工具,附带 AI 生成门控和无障碍说明。

    • Text to image
    • Models
    • Style control
    310 · 受欢迎程度
    查看 Agent Skill
  13. 排名 21
    直接匹配

    marketing-image-generation

    生成营销图像、广告创意、社交卡片、博客头图和产品样机,提供具体的视觉方向工作流和避免 AI 感泛滥的指导。

    • Text to image
    • Style control
    • Brand assets
    217 · 受欢迎程度
    查看 Agent Skill
  14. 排名 22
    直接匹配

    zimage-generation

    通过 Python 脚本使用 ModelScope 的 Z-Image API 生成图像,由 Zimage 或 ModelScope 请求触发。

    • Text to image
    864 · 受欢迎程度
    查看 Agent Skill
  15. 排名 23
    直接匹配

    short-drama-image-prompts

    为短剧角色、造型、地点、道具和状态变体撰写可直接复制的图像提示,包括参考和编辑提示指导。

    • Text to image
    • Brand assets
    367 · 受欢迎程度
    查看 Agent Skill
  16. 排名 24
    可能匹配

    brandkit

    精选

    高端品牌套件图像生成 skill,用于创建高端品牌指南板、logo 系统、品牌识别演示文稿和视觉世界展示。针对极简、电影感、编辑风、暗黑科技、奢华、文化、安全、游戏、开发者工具和消费级应用等品牌体系训练。优化方向包括有意图的 logo 概念设计、精致构图、稀疏排版、强符号意义、高端样机、艺术指导图像和灵活网格布局。

    • Style control
    • Brand assets
    297,293 · 受欢迎程度
    查看 Agent Skill
  17. 排名 25
    可能匹配

    imagegen-frontend-mobile

    精选

    面向高端移动应用的精英级图像生成技能,用于创建优质、应用原生的屏幕概念和流程。专为 iOS、Android 和跨平台移动产品设计。优先考虑清晰的层级、舒适可读的文字、强大的多屏一致性、受控的配色方案、非通用的创意方向、有质感的表面、以图像为主导的构图、有品位的自定义图标以及干净的手机样机边框。默认情况下,屏幕应显示在带有可见边框的精致高端 iPhone 或类似手机样机中,同时主要焦点仍保持在应用内容本身。此技能生成

    • Style control
    284,892 · 受欢迎程度
    查看 Agent Skill
  18. 排名 26
    可能匹配

    chatgpt-image-ad

    通过Arcads API使用ChatGPT Image 2生成Meta图片广告素材,具备边缘安全布局和字形安全防护。

    • Text to image
    • Models
    • Style control
    164 · 受欢迎程度
    查看 Agent Skill
  19. 排名 27
    可能匹配

    nano-banana-image-ad

    通过 Arcads API 使用 Nano Banana 2/Pro 生成 Meta 图片广告创意,支持边缘安全布局和多参考图。

    • Text to image
    • Models
    • Brand assets
    164 · 受欢迎程度
    查看 Agent Skill
  20. 排名 28
    可能匹配

    syncfusion-react-image-editor

    在 React 应用中实现 Syncfusion React Image Editor 组件,用于裁剪、标注、滤镜、变换和导出。

    • Editing and inpainting
    639 · 受欢迎程度
    查看 Agent Skill
  21. 排名 29
    可能匹配

    syncfusion-blazor-image-editor

    实现Syncfusion Blazor Image Editor组件,用于裁剪、标注、滤镜、变换和导出。

    • Editing and inpainting
    329 · 受欢迎程度
    查看 Agent Skill
  22. 排名 30
    可能匹配

    syncfusion-angular-image-editor

    实现 Syncfusion Angular Image Editor 组件,用于裁剪、标注、滤镜、变换和导出。

    • Editing and inpainting
    271 · 受欢迎程度
    查看 Agent Skill
  23. 排名 31
    可能匹配

    syncfusion-maui-image-editor

    实现 Syncfusion .NET MAUI ImageEditor,用于裁剪、变换、注释、滤镜和保存编辑后的图像。

    • Editing and inpainting
    160 · 受欢迎程度
    查看 Agent Skill
  24. 排名 32
    可能匹配

    physical-ai-defect-image-generation

    在 OSMO 上使用 NVIDIA Cosmos AnomalyGen 编排缺陷图像生成,用于 PCBA、金属和玻璃检测,包括图像编辑增强。

    1,936 · 受欢迎程度
    查看 Agent Skill
  25. 排名 33
    可能匹配

    image-editing

    指导使用移动应用为小红书内容进行图像编辑和增强,涵盖调整、色彩校正、修图和文字叠加。

    • Editing and inpainting
    • Style control
    422 · 受欢迎程度
    查看 Agent Skill
  26. 排名 34
    可能匹配

    venice-image-edit

    目录条目,宣传 Venice.ai 图像编辑、放大和背景移除,指向上游捆绑包以获取完整工作流。

    • Upscale and restore
    2,495 · 受欢迎程度
    查看 Agent Skill
  27. 排名 35
    可能匹配

    build

    实现功能并搭建 CE.SDK Web 项目,用于跨框架构建照片、视频和设计编辑器。

    140 · 受欢迎程度
    查看 Agent Skill
  28. 排名 36
    可能匹配

    fal-image-edit

    精简的目录条目,介绍具备风格迁移和对象移除功能的 AI 图像编辑,指向上游的 fal.ai skill。

    • Editing and inpainting
    • Style control
    285 · 受欢迎程度
    查看 Agent Skill
  29. 排名 37
    可能匹配

    og-image-generation

    使用 Next.js 文件约定和 next/og 库生成动态社交预览(OG)图像。

    234 · 受欢迎程度
    查看 Agent Skill
  30. 排名 38
    可能匹配

    neta

    路由技能,索引 Neta 能力并指向子技能,包括用于图像/视频/歌曲生成的 neta-creative。

    • Style control
    152 · 受欢迎程度
    查看 Agent Skill
  31. 排名 39
    可能匹配

    editor

    使用 Diffusion Studio 分析、生成和编辑视频/音频/图像,并合成视频作品。

    1,447 · 受欢迎程度
    查看 Agent Skill
  32. 排名 40
    可能匹配

    enhance-prompt

    精选

    将模糊的 UI 想法转化为精炼、针对 Stitch 优化的提示。增强具体性、添加 UI/UX 关键词、注入设计系统上下文,并组织输出以获得更好的生成结果。

    • Text to image
    • Style control
    • Brand assets
    56,037 · 受欢迎程度
    查看 Agent Skill
  33. 排名 41
    可能匹配

    image-optimization

    通过压缩、现代格式和响应式技术优化网页图像,以减小文件大小。

    648 · 受欢迎程度
    查看 Agent Skill
  34. 排名 42
    可能匹配

    hatch-pet

    官方

    从角色美术、生成图像、公司或潜在客户品牌线索或视觉参考中,创建、修复、验证、视觉 QA 并打包 Codex 兼容的动画宠物和宠物精灵表。当用户想要轻量级 worker Codex 宠物工作流、非像素自定义宠物风格、潜在客户或公司吉祥物宠物,或带有透明未使用单元格、QA 联系表和 pet.json 打包的完整 8x9 动画宠物图集时使用。此技能组合已安装的 $imagegen 系统技能进行视觉生成,并使用捆绑脚本进行确定性精灵表组装。

    • Text to image
    • Style control

    声明的前提(自述): Credentials

    查看 Agent Skill
  35. 排名 43
    可能匹配

    image-to-video

    精选
    • Text to image
    525,176 · 受欢迎程度
    查看 Agent Skill
  36. 排名 44
    可能匹配

    seedance-2-5-image-to-video

    精选
    • Text to image
    192,138 · 受欢迎程度
    查看 Agent Skill
  37. 排名 45
    可能匹配

    ai-video-generation

    精选

    通过 inference.sh CLI 使用 Google Veo、Seedance 2.0、HappyHorse、Wan、Grok 及 40+ 模型生成 AI 视频。模型:Veo 3.1、Veo 3、Seedance 2.0、HappyHorse 1.0、Wan 2.5、Grok Imagine Video、OmniHuman、Fabric、HunyuanVideo。能力:文生视频、图生视频、参考生视频、视频编辑、唇形同步、虚拟形象动画、视频超分、拟音音效。用途:社交媒体视频、营销内容、讲解视频、产品演示、AI 虚拟形象。触发词:视频生成、ai video、text to video、image to video、veo、animate image、video from image、ai animation、video generator、genera

    • Text to image
    • Upscale and restore
    142,615 · 受欢迎程度
    查看 Agent Skill
  38. 排名 46
    可能匹配

    ai-avatar-video

    精选

    通过 inference.sh CLI 创建 AI 虚拟形象和口播视频。推荐:P-Video-Avatar(最快、最便宜、内置 TTS)。其他:OmniHuman、Fabric、PixVerse。音频:Inworld TTS-2(100+ 种语言,支持角色情感控制)、ElevenLabs、Kokoro。能力:音频驱动虚拟形象、文本转虚拟形象、唇同步视频、口播生成、虚拟主播、UGC 内容。适用场景:AI 主播、讲解视频、虚拟网红、配音、营销视频、UGC 广告、游戏虚拟形象、NPC 对话。触发词:ai avatar、talking head、lipsync、avatar video、virtual presenter、ai spokesperson

    • Text to image
    • Style control
    142,016 · 受欢迎程度
    查看 Agent Skill
  39. 排名 47
    可能匹配

    chanjing-digital-human

    集成 Chanjing 平台,在 FrameVideo 中实现数字人视频合成和 AI Creation 图像/视频素材。

    • Editing and inpainting
    150 · 受欢迎程度
    查看 Agent Skill
  40. 排名 48
    可能匹配

    glmv-prompt-gen

    分析图像/视频,并为 Midjourney、Stable Diffusion、DALL-E、Sora 和 Kling 等文生图和文生视频工具生成专业提示词。

    • Text to image
    • Models

    声明的前提(自述): API key · Python

    300 · 受欢迎程度
    查看 Agent Skill
常见问题

常见问题

什么时候应该使用图像生成技能,而不是编辑 SVG 或代码原生资产?
当输出应为位图资产时使用它,例如照片、插画、纹理、精灵图、样机或透明背景抠图。当任务更适合通过编辑现有 SVG、矢量或代码原生资产、扩展现有图标或 logo 体系,或直接用 HTML、CSS 或 canvas 构建视觉时,避免使用它。
该主题中的技能通常涵盖哪些能力?
它们涵盖文生图、图生图、修复、LoRA、图像编辑、放大和文本渲染,以及风格迁移、背景移除、换脸和试穿。有些会将编辑请求路由到特定模型,并提供用于批量、文本重写和蒙版编辑的文档化提示模式。
在图像工作流程中,生成和编辑哪个更重要?
工作流程依次是提示词、模型、风格控制,然后编辑和放大,而编辑往往比生成更重要。许多技能专注于转换现有图像或从参考中衍生视觉变体,而不是创建全新图像。
这个排序列表是如何整理的,它是否构成背书?
该列表按观察到的搜索需求排序,并经过相关性审核。它并非背书,因此在依赖它之前,请查看每个技能的文档。

如何安装 Agent Skill

从本页第一条开始。Claude Code 会读取放进 skills 目录的 SKILL.md:

  • Claude Code——把 imagegen 的 SKILL.md 复制到 ~/.claude/skills/imagegen/(个人使用),或 .claude/skills/imagegen/(随项目共享)。
  • 从 registry 安装——运行 npx skills add openai/skills@imagegen。
  • 或者从 imagegen 的来源下载 SKILL.md,放进上面的目录。

如何挑选 安装前先看出处和技能自身的说明。Official 与 Notable 标签描述的是来源,不代表安全。