技市SkillsCN

影视制作

682 个 Agent 技能

aivrarA
ASCII 字符视频
将视频/音频转换为带颜色的 ASCII 字符视频(MP4/GIF 格式)。
★ 186查看 / 安装 ›
alecs5am
音频解说视频
音频优先的长篇解说视频流水线:输入音频或播客/YouTube 链接,生成无脸、叠加驱动的讲解视频(5-30 分钟)。
★ 108查看 / 安装 ›
aliyun
云端视频编辑
无需本地 ffmpeg 的云端视频编辑:依据需求生成时间线、提交阿里云任务并输出最终视频 URL,适用于 URL/OSS 场景。
★ 191查看 / 安装 ›
aliyun
阿里云视频处理
阿里云媒体处理(MPS)一站式视频处理:转码、截帧、内容审核与上传,工作流化生成标准视频素材。
★ 191查看 / 安装 ›
aliyunO
OSS 媒体处理
处理阿里云 OSS 中的图像、音频与视频:缩放、裁剪、水印、智能识别、转码、截帧与 HLS 串流等。
★ 191查看 / 安装 ›
aliyunP
PDS 多模态搜索
实现 PDS 网盘的文件名精确/模糊搜索、语义搜索与以图搜图功能。
★ 191查看 / 安装 ›
allenhutchison
音视频转写笔记
将音频与视频文件转写为结构化笔记,适用于会议、播客、语音备忘录或知识库中的任何音视频内容。
★ 504查看 / 安装 ›
ArgentAIOSA
ASCII 字符视频
将视频/音频/图像/生成式输入转换为彩色 ASCII 字符视频(MP4/GIF/序列帧),支持音频可视化、生成式动画与实时终端渲染。
★ 117查看 / 安装 ›
ArgentAIOSA
ASCII 字符视频
将视频/音频/图像/生成式输入转换为彩色 ASCII 字符视频(MP4/GIF/序列帧),支持音频可视化、生成式动画与实时终端渲染。
★ 117查看 / 安装 ›
ArgentAIOS
音频频谱可视化
通过命令行从音频文件生成频谱与特征可视化(梅尔、色度、MFCC、节奏图等),用于音频分析与音乐制作调试。
★ 117查看 / 安装 ›
AtomicBot-ai
本地语音转写
使用本地 whisper 命令行(无需密钥)将 mp3/m4a/wav 等音频文件的语音转写为文字。
★ 716查看 / 安装 ›
benchflow-ai
语音识别转写
使用 Whisper 模型将音频片段转写为文字,支持 small 到 large-v3 多档精度,并与说话人分段对齐生成字幕。
★ 1.5k查看 / 安装 ›
benchflow-ai
视频音频提取
从视频文件中提取音频并转为 WAV,用于音频分析、能量计算或标准化格式处理。
★ 1.5k查看 / 安装 ›
binjuhorG
Gemini 多模态创作
用 Gemini API 分析图像/音频/视频(视觉优于 Claude),并生成图像、视频、语音与音乐,用于 OCR、设计与多模态 AI。
★ 94查看 / 安装 ›
brycewang-stanfordA
ACM 多媒体定稿
准备 ACM Multimedia 会议录用稿的相机就绪版本:去匿名化、填表、满足 sigconf 规范、发布素材并安排报告。
★ 778查看 / 安装 ›
calesthioA
Azure 语音转文字
使用 Azure AI Speech 的快速转写 REST API 将音频转为文字,用于生成字幕或处理口语内容;配置密钥时优先使用。
★ 3.9万查看 / 安装 ›
CharlesWiltgen
图形渲染开发
处理 GPU 渲染、Metal、OpenGL 迁移、着色器、3D 内容、RealityKit、AR 与 USD 文件及显示性能优化。
★ 1.1k查看 / 安装 ›
CharlesWiltgen
苹果媒体开发
处理相机、照片、音频、触觉、ShazamKit 与 Now Playing:AVCaptureSession、PhotosPicker、AVFoundation 等。
★ 1.1k查看 / 安装 ›
CharlesWiltgen
图形渲染开发
处理 GPU 渲染、Metal、OpenGL 迁移、着色器、3D 内容、RealityKit、AR 与 USD 文件及显示性能优化。
★ 1.1k查看 / 安装 ›
CharlesWiltgen
苹果媒体开发
处理相机、照片、音频、触觉、ShazamKit 与 Now Playing:AVCaptureSession、PhotosPicker、AVFoundation 等。
★ 1.1k查看 / 安装 ›
chujianyun
喔图相册下载器
喔图(alltuu.com)云摄影相册批量下载工具,支持下载原图、自动处理签名 URL 并并发下载。
★ 681查看 / 安装 ›
cinience
通义语音转写
使用阿里云 Qwen ASR 模型转写非实时语音,生成带时间戳的文稿,并记录 ASR 请求/响应字段。
★ 396查看 / 安装 ›
cinience
通义首帧生视频
使用 DashScope HappyHorse 1.0 图生视频模型,由单张首帧图像(可加文本引导)生成视频。
★ 396查看 / 安装 ›
cinience
通义参考图生视频
使用 DashScope HappyHorse 1.0 参考图生视频模型,将 1-9 张参考图融合生成视频(多主体合成)。
★ 396查看 / 安装 ›
cinience
通义视频编辑
使用 DashScope HappyHorse 1.0 视频编辑模型,按指令进行风格迁移或局部替换等视频编辑(可选参考图)。
★ 396查看 / 安装 ›
cinience
通义可灵视频
在 DashScope 上使用 Kling v3 模型生成视频:文生视频、图生视频、参考生视频、智能分镜与视频编辑。
★ 396查看 / 安装 ›
cinience
视频风格转换
使用 DashScope 视频风格转换模型将视频转为日漫、美漫、3D 卡通、水墨、剪纸或简笔插画等艺术风格。
★ 396查看 / 安装 ›
cinience
视频换唇同步
使用阿里云 VideoRetalk 替换已有视频的口型同步,用于配音、替换旁白或让对口型视频匹配新语音。
★ 396查看 / 安装 ›
cinience
通义万相图生视频
使用 DashScope Wan 2.7 图生视频模型,由图像生成视频:首帧生成、首尾帧插值、续写或音频驱动合成。
★ 396查看 / 安装 ›
cinience
通义万相视频编辑
使用 DashScope Wan 2.7 视频编辑模型进行风格迁移、指令化编辑与视频内容修改(可选参考图)。
★ 396查看 / 安装 ›

点击技能卡片查看简介与安装(GitHub 为次要选项,需科学上网时再前往)