媒体 AI Skill 推荐 — 精选 16 个

精选 16 个媒体方向的 AI Skill,含功能说明、安装方式与官方链接,适用于 Claude、Cursor、ChatGPT。

按分类浏览
按平台浏览
🖼️
ChatGPT付费
ChatGPT 原生图像生成,文字直接转高质量图片,支持风格控制、局部编辑、多图对比,创作效率极高。
文本转图像
局部编辑修改
风格精准控制
高分辨率输出
媒体
🌀
Claude免费
用 p5.js 创作生成艺术:流场、粒子系统、种子随机,参数可交互调节,零代码也能玩出画廊级视觉作品。
流场与粒子系统
种子随机可复现
参数交互调节
p5.js 代码可导出
媒体
🎞️
Claude免费
专为聊天场景优化的动图生成器:自动控制尺寸与帧率、内置校验工具,一句话生成适合 Slack / 微信群的表情动图。
动画概念生成
尺寸帧率自动优化
Slack 限制校验
循环动效设计
媒体
🎬
Claude免费
Remotion 官方 Skill:用 React 代码程序化生成视频,产品演示、数据动画、批量个性化视频,改代码即改片子。
React 写视频
程序化批量渲染
数据驱动动画
官方团队维护
媒体
🎥
ChatGPT付费
OpenAI 官方 Codex Skill:通过 Sora API 生成、混剪、管理短视频片段,文字直接变成电影级画面,创意视频生产力拉满。
文生视频
视频 Remix 混剪
批量片段管理
API 全自动化
媒体
🖌️
ChatGPT付费
OpenAI 官方 Skill:调用 Image API 为项目批量生成和编辑图片,配图、图标、素材在开发流程里自动产出。
文生图与图生图
批量素材生产
局部编辑
项目内自动配图
媒体
🎬
community免费
开源的 agentic 视频生产系统,把 AI 编程助手变成完整的视频工作室。用自然语言描述需求,agent 会自动完成调研、脚本、素材生成、剪辑与合成。内含 12 条生产流水线、100+ 工具、700+ 技能与制作知识文件。
12 条视频生产流水线
自然语言一句话出片
无 key 也能离线出片
支持五种编程助手
媒体
🎬
Claude免费
把一句话主题自动做成 Vox 风格纸拼贴解说/广告视频的 agent skill:脚本、拼贴关键帧、运镜、配音、音乐、字幕全流程自动化。基于 Atlas Cloud API 加本地 ffmpeg,可被任意编码 agent 调用。
一句话主题生成成片
Vox 纸拼贴视觉风格
脚本运镜配音全自动
素材/真人/单图三输入
媒体
🎞️
Claude免费
面向 Claude Code 与 Codex 的 AI 视频 skill,用 Remotion 制作电影感产品视频。内置上百张分镜配方卡与 161 组运动预览,外加一套可直接投产的模板,含真实页面截取、2.5D 运镜、节拍剪辑与电影级音效。
Remotion 电影级产品视频
161 组运动预览可选
真实页面截取+2.5D运镜
节拍剪辑与电影级音效
媒体
📰
community免费
把文章、文案、截图、产品笔记、字幕、照片或用户视频转成小红书图文组图、Live Photo 动态卡与微信公众号 21:9 + 1:1 封面对。提供电子杂志和瑞士风格的内容规划、版式与质检流程。
小红书组图
公众号封面对
Live Photo 卡
版式质检流程
媒体
📰
ChatGPT免费
把约 5 秒口播、观点句或抽象概念转成编辑风半调纸拼贴 B-roll:先确认视觉隐喻,再确认彩色静帧,最后用 Gemini Omni Flash 生成首尾帧组装动画并做质量检查。
口播视觉隐喻设计
半调纸拼贴静帧
三阶段人工确认
首尾帧视频生成与 QA
媒体
🎞️
community免费
把单张角色、生物、载具、武器或道具图转换成风格一致的透明动作序列:先锁定身份、肢体与武器拓扑,再重绘关键姿势、补中间帧、去背景、统一画布并打包精灵图。
身份与肢体拓扑锁定
关键姿势重绘与中间帧
透明帧、精灵图与预览
结构校验与视觉复核
媒体
🎨
community免费NEW
浙江大学与北京大学团队开源的社媒内容工作台,内含 112 个 OpenClaw Skills,把热点发现、选题、文案、图片、音视频制作、六平台适配发布与效果复盘串成一条可执行流水线。
112 个可执行内容与媒体 Skills
选题到发布和复盘的闭环
图像、音频、视频本地工具链
账号画像、素材库与内容日历
媒体
🎬
community免费NEW
面向 AI 短剧与动态漫制作的 11 个 Agent Skills,从小说分析、项目开发和分集编剧,延伸到角色资产、画面提示词、分镜、视频提示词、生成、剪辑与终审。
11 个连续的短剧制作环节
剧本、资产、分镜与视频提示词
生成、剪辑和成片审核闭环
Claude Code 与 Codex 单项安装
媒体
👁️
community免费NEW
为纯文本 Agent 提供结构化图像证据:通过 OCR、布局、语义和可追溯 JSON 描述,让 Agent 能分析截图、界面、图表和照片,而不是猜测看不到的像素。
OCR、布局与语义证据
结构化 JSON 结果
六类模型/CLI 提供方
私有文件权限与凭据脱敏
媒体
🎞️
community免费NEW
两个面向 Claude Code 与 Codex 的视频分析 Skill:video-shots 用 ffmpeg 测量切点、时长与运动并生成逐镜头拉片表,video-sync 再把原片与随切点滚动高亮的分镜信息合成为可观看视频。
逐镜头切点、时长与运动实测
景别、类别、运镜和节奏标注
15 道代码质量门与离线报告
分镜信息同步滚动合成视频
媒体