技市SkillsCN

影视制作

682 个 Agent 技能

majiayu000G
Gemini 多模态处理
使用 Google Gemini API 处理与生成多模态内容:视觉分析、音频转写、视频处理、文档提取与图像/视频生成。
★ 466查看 / 安装 ›
majiayu000
有声书处理
处理收件箱中的有声书:转写为文字并整理音频,用于语音模型训练数据准备。
★ 466查看 / 安装 ›
majiayu000
视频画面描述
用 ffmpeg 提取并分析视频帧,为转录文本补充画面描述,生成带周期性视觉说明的可视化转录。
★ 466查看 / 安装 ›
majiayu000W
WAV 音频分析
分析 WAV 音频文件以调试 TTS 与音频管线,检查音质、校验 WAV 格式、波形与生成语音问题。
★ 466查看 / 安装 ›
majiayu000A
AI 上下文优化
优化 AI 编程助手的上下文文件(如 CLAUDE.md):在用户要求改进上下文文件、执行 /ai-context 或提升 AI 文档质量时使用。
★ 466查看 / 安装 ›
majiayu000
自适应码率串流
根据网络状况自动调整视频质量,使用 HLS、DASH 协议与播放器实现流畅播放与最佳体验。
★ 466查看 / 安装 ›
math-incA
ASCII 字符视频
将视频/音频/图像/生成式输入转换为彩色 ASCII 字符视频(MP4/GIF/序列帧),支持音频可视化、生成式动画与实时终端渲染。
★ 1.2k查看 / 安装 ›
Mathews-TomA
arXiv 图表优化
为 arXiv 投稿优化图表:格式转换(EPS/PDF/PNG/JPG)、压缩体积、去除元数据并确保编译兼容。
★ 268查看 / 安装 ›
MCKRUZ
视频合成装配
用 FFmpeg 或 Remotion 将生成的片段、音频与素材合成为最终视频:拼接、混音、转场、字幕与导出。
★ 82查看 / 安装 ›
MicrosoftDocsA
Azure 视频索引
Azure AI Video Indexer 开发专家知识:最佳实践、配额、安全、配置、集成与部署,用于视频索引与人脸脱敏等。
★ 654查看 / 安装 ›
MiniMax-AI
图像视觉分析
使用 MiniMax 视觉 MCP 工具分析、描述并提取图像信息,支持图像识别、OCR、图表数据提取与物体检测等。
★ 1.3万查看 / 安装 ›
mitsuhiko
本地音频转写
使用缓存的 MLX Whisper 模型快速转写本地音频/视频及苹果语音备忘录,包括低质量音频。
★ 2.7k查看 / 安装 ›
mk-knight23
多元包容视觉生成
多元包容视觉专家:克服 AI 系统性偏见,生成文化准确、正面且无刻板印象的图像与视频。
★ 75查看 / 安装 ›
mk-knight23
多元包容视觉生成
多元包容视觉专家:克服 AI 系统性偏见,生成文化准确、正面且无刻板印象的图像与视频。
★ 75查看 / 安装 ›
mkurman
图像增强库
Albumentations 图像增强库:70+ 变换,覆盖分类、分割、检测、关键点与姿态估计,统一 OpenCV 管线 API。
★ 320查看 / 安装 ›
ModalityDance
安卓媒体操作
通过 media 工具操作安卓媒体流程:拍照/录像、媒体列举、录音/播放及权限恢复,覆盖相机、相册与麦克风任务。
★ 1.1k查看 / 安装 ›
moltis-orgA
ASCII 字符视频
将视频/音频/图像/生成式输入转换为彩色 ASCII 字符视频(MP4/GIF/序列帧),支持音频可视化、生成式动画与实时终端渲染。
★ 2.8k查看 / 安装 ›
mrgoonieG
Gemini 多模态处理
使用 Google Gemini API 处理与生成多模态内容:音频转写、图像理解、视频分析、文档提取与文生图等。
★ 2.2k查看 / 安装 ›
mukul975
磁盘镜像取证
使用 dd 与 dcfldd 创建逐位、取证级可靠的磁盘镜像,并通过哈希校验保证证据完整性。
★ 2.6万查看 / 安装 ›
mukul975
磁盘镜像分析
使用 Autopsy 对磁盘镜像进行全面的取证分析,恢复文件、检查痕迹并构建调查时间线。
★ 2.6万查看 / 安装 ›
nativ3aiA
ASCII 字符视频
将视频/音频转换为带颜色的 ASCII 字符视频(MP4/GIF 格式)。
★ 192查看 / 安装 ›
nexu-io
音频生成助手
生成音频内容(广告短乐、铺垫乐、配音与音效):音乐走 Suno/Udio/Lyria,语音走 MiniMax/ElevenLabs TTS,音效走 ElevenLabs SFX 或 AudioCraft,输出单个 MP3/WAV 文件。
★ 7.8万查看 / 安装 ›
nexu-io
音频生成助手
生成音频内容(广告短乐、铺垫乐、配音与音效):音乐走 Suno/Udio/Lyria,语音走 MiniMax/ElevenLabs TTS,音效走 ElevenLabs SFX 或 AudioCraft,输出单个 MP3/WAV 文件。
★ 7.8万查看 / 安装 ›
NousResearchA
ASCII 字符视频
将视频/音频转换为带颜色的 ASCII 字符视频(MP4/GIF 格式)。
★ 0查看 / 安装 ›
NVIDIA
视频标定校准
通过 AutoMagicCalib REST API 从本地预录视频标定新数据集,适用于 'calibrate my videos' 等场景。
★ 2.5k查看 / 安装 ›
openakita
数字人工作室
基于 DashScope 的数字人工作室:照片说话、视频换唇、换脸、多参考图合成角色,用于生成对口型视频。
★ 1.8k查看 / 安装 ›
phuc-ntG
Gemini 多模态创作
用 Gemini API 分析图像/音频/视频(视觉优于 Claude),并生成图像、视频、语音与音乐,用于 OCR、设计与多模态 AI。
★ 1.2k查看 / 安装 ›
pproenca
音频取证修复
音频取证与人声恢复指南:从低质/低音量音频恢复人声、增强录音、进行取证分析或转写困难音频。
★ 180查看 / 安装 ›
PurpleAILAB
多模态跨渠道攻防
AATMF T9 多模态跨渠道:图像隐写→文本执行、音频提示注入、视频帧注入、含隐藏文本文档等攻击手法。
★ 4.7k查看 / 安装 ›
RedWoodOGA
ASCII 字符视频
将视频/音频/图像/生成式输入转换为彩色 ASCII 字符视频(MP4/GIF/序列帧),支持音频可视化、生成式动画与实时终端渲染。
★ 169查看 / 安装 ›

点击技能卡片查看简介与安装(GitHub 为次要选项,需科学上网时再前往)