「设计创意」Claude 技能排行榜第 20 页

#技能作者下载量星标
951
musicful music generator
通过一句话自然语言生成AI音乐或歌词,系统自动识别生成演唱歌曲或纯器乐BGM。
boner-bbb1,0304
952
Vidu — AI Video Generation - Vidu Q3 & Vidu 2.0
使用Vidu生成AI视频——支持文本生成视频、图像生成视频、参考生成视频和起始-结束帧生成视频,分辨率最高1080p,支持动画风格等多种风格。
MikeWang1,030-
953
Free Resource
在需要时,从 Pexels(照片/视频)、Pixabay(图片/视频)、Freesound(音效)和 Jamendo(音乐/背景音乐)中搜索并获取免版税媒体资源。
noah1,029-
954
openclaw's digital card
从本地 OpenClaw数据生成或迭代 OpenCard 个人名片。读取工作区身份信息、配置和会话统计;渲染 HTML 预览;导出 PNG。只读模式——不写入用户档案数据。
TrenLiu1,028-
955
Trackyard
从Trackyard的AI驱动音乐库搜索并下载授权音乐,用于视频、社交内容、播客等项目寻找背景音乐。
Benny1,027-
956
Web2Labs Studio
编辑录制内容,长视频转短视频,生成字幕和封面,处理前预估费用。支持上传本地文件或YouTube/Twitch链接...
Philipp Fanta1,0262
957
Speech
用于用户请求文本转语音旁白、配音、无障碍朗读、音频提示或通过 OpenAI Audio API 批量生成语音等场景。
Parker1,026-
958
Wuli Skill
通过 Wuli.art 开放平台 API,使用 25+ 个活跃模型生成 AI 图像和视频。适用于从文本提示生成图像、编辑图像等场景。
zihao chu1,0251
959
Moltazine Cli
使用独立 Moltazine CLI 完成社交与图像生成任务,最小化 token 输出。
Doug Smith1,025-
960
Showcase Video Builder
使用 ffmpeg 将截图、头像和文字叠加制作精美的展示和演示视频,适用于演示视频、黑客马拉松展示、专业作品集等场景。
Nissan Dookeran1,025-
961
Youtube Downloader
下载YouTube视频为最高画质MP4。用户发送YouTube链接并想保存时使用,触发于youtube.com等链接。
honeybee11301,025-
962
WaveSpeedAI Nano Banana Pro Image Generation/Editing
通过WaveSpeed AI使用谷歌Nano Banana Pro模型生成和编辑图像,支持文生图和自然语言图像编辑。
C1,024-
963
china-vision
多模态图片理解工具,用于分析、描述和理解图像,支持场景分析、物体识别、图表解读等功能。
ToBeWin1,021-
964
China Image Gen
国内可用的文生图技能,基于硅基流动(SiliconFlow)API。Use when the user wants to generate images from text in China without VPN. Supports FLUX.1-schnell (free/fast), FLUX.1-dev...
ToBeWin1,021-
965
ai视频人物真实性方法论
提供AI视频创作全流程方法论,涵盖专业电影运镜技巧、情绪表达、皮肤真实感提示词及实战案例指导。
JOEL4-51,0181
966
前端设计
Expert frontend design guidelines for creating beautiful, modern UIs. Use when building landing pages, dashboards, or any user interface.
user_e07fe9121,0174
967
Modellix
Integrate Modellix's unified API for AI image and video generation into applications. Use this skill whenever the user wants to generate images from text, cr...
modellix1,0161
968
LH HTML to Image
将 HTML+CSS 通过 Chrome headless 转为 PNG,精准呈现封面、海报、信息卡等文字布局,零 API 费用。
liuhedev1,0151
969
Nano Banana 2 — AI Image Generation (Gemini 3.1 Flash Image, Google, Evolink)
Nano Banana 2 —— 由 Google Gemini 3.1 Flash 驱动的 AI 图像生成工具。通过 Evolink API 实现快速、通用的文生图及图像编辑,仅需一个 API 密钥。
EvolinkAI1,0141
970
Music Analysis
在本地分析音频文件,无需外部API。提取节拍、律动感、脉冲稳定性、摇摆度、段落/重复结构、调性变化等。
Adam-Researchh1,013-
971
UX Research Engine
完整UX调研与设计系统——用户发现、人物角色构建、旅程映射、可用性测试、研究综合与设计验证。零...
1kalin1,0121
972
Snapdesign Rednote Clean
将话题或文章转化为小红书知识型图文(3:4 竖版图片组)。专为企业主、创业者、知识型 IP 设计。 首图以大字标题 + 数字/反问/反常识/信息差策略吸引停留;内容图文字密度高,传递实质干货。 设计风格:纸张浅色背景 + 深咖前景色系,高级感强,区别于生活博主审美。 凡用户提到以下任何情形,必须立即调用本技能:...
BaoAI1,012-
973
espeak-ng
使用espeak-ng进行文本转语音
MartianZenMonk1,010-
974
fastfish-format(article-wechat-xhs-format)
多渠道格式化与美化:公众号、小红书文章排版,30 套预设样式,配图编排指引。不包含发布。通过 system.run 调用 CLI,无需 MCP。当用户需要公众号格式整理、小红书文案格式化、Markdown 渲染、样式选择或配图流程指引时使用本技能。
superxs7771,0091
975
OpenRouter Image Generation
通过 OpenRouter API 调用 Google Gemini 生成图像,支持文生图及参考图引导生成。适用于用户请求生成图像的场景。
Wenyu Yang1,009-
976
Converter
本地优先的转换路由与格式策略。识别文档、图片、音频、视频、归档及数据转换的最安全本地路径。
AGIsearch1,009-
977
Miranda SAG (ElevenLabs TTS say-UX)
具有 Mac 风格 say 交互的 ElevenLabs 语音合成。
jeffpignataro1,009-
978
Ai Music
AI音乐适合需要 AI音乐生成、AI音乐创作、AI作曲、AI写歌和 ai music 工具的中文专业创作者。你只要描述主题、风格、情绪、歌词或使用场景,就可以在 AI 助手中生成可试听、可下载的歌曲或 BGM;作品会同步到海绵音乐账号,可在「海绵音乐AI写歌」小程序和 lexuan.club 网页继续管理。
MakeBestMusic1,008-
979
AI 火宝
根据文本提示生成图像或使用AI变换现有图像,支持配置数量、水印和API密钥。
培根6661,008-
980
ClawSpotify
控制Spotify播放:播放、暂停、恢复、跳过、上一首、重新开始、搜索、队列、设置音量、随机播放、循环播放以及查看当前播放状态。
Muhammad Fahreza1,0071
981
yolo-vision-tools
使用 Ultralytics YOLO 执行计算机视觉任务,例如检测图像和视频中的人物或物体、图像分类、人体姿态估计等。
Ruoyu1,0061
982
Ai Intelligent 3d Model Generation
AI3D模型生成:文字生成3D + 图片转3D
yang1002378395-cmyk1,006-
983
seedance2.0
字节跳动 Seedance 2.0 AI 视频生成技能,支持文字生成图片和视频,提供申请指南与快速生成封装。
Chen Meiyi1,0055
984
Nano Banana Pro Image Generation&Editing
使用谷歌的 Nano Banana Pro(Gemini 3 Pro Image / Imagen Pro)生成和编辑图像——专为专业需求优化的高端 AI 图像生成模型。
MikeWang1,0051
985
Faster Whisper Gpu
利用 Faster Whisper 和 NVIDIA GPU 加速实现高性能本地语音转文字转录。在本地转录音频文件,无需将数据发送到……
Felipe Oliveira1,005-
986
OpenFishy Feed Publisher
使用选定的视觉形象生成AI图像/视频,并发布至OpenFishy动态API(自定义网页平台,与Microsoft Visual Studio无关)
i54851498-gif1,003-
987
Giggle Generation Video
支持文字转视频和图像转视频(起始/结束帧)。适用于需要生成视频、制作短视频或将文字转换为视频的场景。
Parker1,0022
988
Skill Tiktok Video Pipeline
端到端TikTok广告视频管线。产品脚本→Veo底版视频→动态字幕叠加→音频混音→最终MP4。单条命令,全自动生成。
Zero2Ai1,002-
989
Vision Helper — AI Image Analysis
使用 Ollama 本地或云端视觉模型分析图像,识别内容、UI 元素和截图,支持 OCR 提取文本。
U3UT71,002-
990
vision-skill
Vision Skill 是专为 AI Agent(如 Trae, Claude, OpenClaw 等)设计的视觉能力扩展插件。它赋予纯文本模型强大的**视觉理解(Recognition)和图像生成(Generation)**能力,支持多种 OpenAI 兼容视觉模型,提供灵活的图片上传模式(COS 或 BASE64),实现高效、异步、高质量的视觉任务处理。 🆕 v2.0:集成 832 个 GPT Image 2 精选案例库(质量过滤自 3 个社区项目 1322 raw cases,去除 490 低质) + 智能提示词引擎,自动生成高质量生图 prompt。 🆕 v2.1:集成 PPT 生成引擎 — 30+ 内置风格、Markdown 转 PPTX、slide_spec 精确编辑、模板克隆、外部图片贴入、版本回滚。 🆕 v2.2:参考图角色优化 — 支持多参考图各自指定角色(背景/产品/风格等),Prompt 中自然融合,不再笼统 “参考图是 xxx”。 🌟 项目亮点 灵活模型配置:支持自定义 BaseURL、API Key 和模型名称,兼容 OpenAI 格式 API,可对接豆包、通义千问、DeepSeek 等多种视觉模型。 双模式图片处理:支持 COS 云存储和 BASE64 直接传输两种模式,适应不同场景需求。 全能视觉识别:支持 OCR 文字提取、场景描述、细节问答,准确率极高。 微信截图识别:专门优化的 wechat_chat 预设,自动区分 PC/手机端,识别发送者身份。 全场景图像生成: 文生图(Text-to-Image):精准理解 Prompt 生成高质量图像。 图生图(Image-to-Image):基于参考图进行风格迁移或细节修改。 文生图组(Sequential Generation):支持生成连贯的故事插画或分镜。 🧠 智能提示词引擎 (prompt_builder.py):自动匹配案例并提炼灵感信号,默认生成简洁 creative brief,避免案例/摄影术语过度堆砌。 📚 GPT Image 2 案例库 (832 cases):来自 3 个社区项目的精选 prompt(质量过滤自 1322 raw,去除 490 低质),10 大统一分类,单文件存储(cases/index.json),支持关键词检索。 📊 PPT 生成引擎 (ppt_generator.py):30+ 内置风格,Markdown→PPTX 全流程,slide_spec 精确编辑,模板克隆,外部图片贴入,版本回滚。 🚨 强制确认工作流:生图/生成PPT前必须经过需求确认→用户确认→冒烟测试,杜绝低质量输出。 🚫 参考图必要性检测:自动识别需要参考图的场景(照片优化/风格迁移/图生图等),无参考图则阻断。 🖼️ 多参考图角色融合:每张参考图可指定独立角色(背景场景/产品元素/风格参考等 7 类),Prompt 自然融合,不再笼统 “参考图是 xxx”。 场景化预置 (Presets):内置 ppt, business_flat, tech_isometric, hand_drawn 等生成风格,以及 invoice, contract, form, slide, whiteboard, table, json, wechat_chat 等识别输出格式。 高可用性设计:支持备用模型配置(FALLBACK_MODEL),主模型失败时自动切换。 批处理与稳定性增强:支持一次识别多张图片,内置失败重试、可选降级模型。 可观测任务元数据:任务状态中包含 started_at / ended_at / duration_ms / api_attempts / upload_mode 等字段。 灵活的任务架构:既支持异步轮询(适合批量大任务),也支持同步等待(适合即时反馈)。
lgwanai1,002-
991
WebChat Voice GUI
Voice input and microphone button for OpenClaw WebChat Control UI. Adds a mic button to chat, records audio via browser MediaRecorder, transcribes locally vi...
neldar1,002-
992
Huo15 Mind Map
规范 + 时尚的思维导图生成。输入 Markdown 大纲 / JSON / OPML / XMind,输出 XMind 2021+ (.xmind)、OPML、FreeMind (.mm)、Markdown、PNG、PDF、SVG;内置 13 种风格(modern / classic / dark / xiao...
Job Zhao1,0011
993
Whisnap
macOS 命令行工具,利用本地 Whisper 模型或 Whisnap Cloud 转录音视频文件。
Neolio421,001-
994
QR Code Generator
精准工具,使用 Python 根据 URL 或文本生成二维码图片。
Mrahil1231,000-
995
EuroBot Song Contest
参与每日EuroBot AI音乐大赛:通过24小时限时循环,提交MIDI歌曲、为作品投票并追踪排名。
CriXoZeta1,000-
浏览全部 4,490 个设计创意技能

其他分类排行

分类榜单收录下载量 1,000+ 的 Claude 技能,数据合并自 Clawhub 与 SkillHub。口径说明见数据方法