volcengine/mediakit-cli

byted-mediakit-editing

面向音频、视频或图片素材组成成片的编辑制作目标,适用于时间线裁剪与拼接、速度和音量调整、视频滤镜、运镜特效、转场、画面裁切旋转翻转、画面叠加、字幕压制、动图截取、淡入淡出、音视频提取与合流、音频混合、文字滚屏成片、图转视频以及多画面空间组合等操作。若用户要给视频添加滤镜效果,或对象和目标族已明确是对现有素材做剪辑、合成、叠加、混合或成片编排,但具体做法不确定,可先加载本 Skill 探索。

Ver código-fonte
Documento original do Skill

Renderizado do repositório de origem, preservando títulos, exemplos, código, tabelas, links e imagens.

editing MediaKit Skill

使用规则

  1. 先读取 ../byted-mediakit-shared/SKILL.md,执行统一前置检查;该 Skill 缺失时停止并提示安装。
  2. 只从下表选择 editing 域工具;相似能力按各工具“能力描述”和参数边界区分。
  3. 执行前按需读取对应 reference;参数与结果说明来自同一份已审核文案,完整机器合同以当前 CLI --schema 为准。
  4. 缺少必填参数、鉴权环境变量或真实输入资源时,向用户索取;通用可选字段只能透传用户明确提供的值,其他可选字段可由明确意图准确确定,但不得伪造。
  5. 执行时设置 MEDIAKIT_SURFACE=skill,指定调用来源是 Skill。
  6. 执行时把 MEDIAKIT_RUNTIME 设置为当前 Agent 宿主,避免 CLI 无法可靠识别父级 Agent。

澄清与跨域路由

若只给出媒体类型而未说明要剪、合、叠、调、加滤镜还是分析,应先澄清。纯图像增强、抠图、OCR、图片水印或图片尺寸优化应路由到 image;视频画质增强、内容理解、从视频提取字幕、语音转字幕、字幕擦除、暗水印、人像或绿幕抠像等视频智能处理应路由到 video;音频转码、语音端点检测、人声背景分离等非剪辑目标应路由到 audio。滤镜效果包括春日/晚霞/鲜亮/白皙/食物等,具体参数以工具 reference 为准。

工具列表

工具说明支持模式命令参考
add-image-to-video支持将指定图片(如 Logo、水印等)叠加到视频画面上。Cloud / Localmediakit-cli editing add-image-to-videoreference/add-image-to-video.md
add-subtitle-to-video将字幕文件或文本内容按自定义样式压制到视频画面中,生成带内嵌字幕的新视频。Cloud / Localmediakit-cli editing add-subtitle-to-videoreference/add-subtitle-to-video.md
adjust-audio-speed用于音频调速,可调整音频播放倍速,实现快放或慢放效果。Cloud / Localmediakit-cli editing adjust-audio-speedreference/adjust-audio-speed.md
adjust-video-speed用于视频调速,通过调整播放倍速产生快放或慢放效果。Cloud / Localmediakit-cli editing adjust-video-speedreference/adjust-video-speed.md
adjust-video-volume用于调整输入视频的音量大小,也可实现静音。Cloud / Localmediakit-cli editing adjust-video-volumereference/adjust-video-volume.md
apply-camera-motion对输入视频在指定时间段内添加一种运镜特效,常用于素材二次创作、营销片头、短剧动效等场景。Cloudmediakit-cli editing apply-camera-motionreference/apply-camera-motion.md
apply-video-filter为指定视频添加滤镜效果。Cloudmediakit-cli editing apply-video-filterreference/apply-video-filter.md
concat-audio拼接多个音频片段。Cloud / Localmediakit-cli editing concat-audioreference/concat-audio.md
concat-video将多个视频按顺序拼接成一个完整的视频文件,并支持在拼接处添加转场效果。Cloud / Localmediakit-cli editing concat-videoreference/concat-video.md
crop-video按指定的矩形区域裁剪视频画面,裁剪结果仅保留指定的需要区域。Cloudmediakit-cli editing crop-videoreference/crop-video.md
extract-animated-image从视频中按指定开始时间和结束时间截取一段画面,生成 GIF 或 WebP 动图,常用于制作封面动图、营销素材和短预览。Cloudmediakit-cli editing extract-animated-imagereference/extract-animated-image.md
extract-audio从输入视频文件中分离音轨,生成独立的音频文件。Cloud / Localmediakit-cli editing extract-audioreference/extract-audio.md
fade-audio对输入音频的起止位置实现淡入或淡出效果,输出处理后的音频文件。Cloud / Localmediakit-cli editing fade-audioreference/fade-audio.md
fade-video-audio在片头或片尾对输入视频音轨执行淡入或淡出处理,用于弱化音轨突兀的起止,提升成片听感。输出处理后的视频文件。Cloud / Localmediakit-cli editing fade-video-audioreference/fade-video-audio.md
flip-video用于视频画面翻转,对指定视频进行上下或左右镜像翻转。Cloud / Localmediakit-cli editing flip-videoreference/flip-video.md
image-to-video将多张图片按顺序组合成动态视频,可配置转场动画和镜头内动画;仅把现有图片做成带动效的视频,不支持根据参考图生成新的画面内容。Cloudmediakit-cli editing image-to-videoreference/image-to-video.md
mix-audio将多个音频文件(如背景音乐、音效、人声)进行混音,生成一个新的音频文件。<br>处理耗时:处理耗时与视频时长正相关。视频时长越长,处理耗时越长。平均 RTF(处理耗时/原片时长)为 1。<br>输出音频的时长以最长的音频为准。<br>输出视频格式:mp3Cloud / Localmediakit-cli editing mix-audioreference/mix-audio.md
mux-audio-video可将输入的音频流与视频流合并成一个新的视频文件,并可选择保留或替换视频的原有音轨;当音视频时长不一致时,可进行对齐处理。Cloud / Localmediakit-cli editing mux-audio-videoreference/mux-audio-video.md
rotate-video用于视频画面旋转,对指定视频进行整体旋转。Cloudmediakit-cli editing rotate-videoreference/rotate-video.md
stitch-video将多个视频在空间上按水平或垂直方向拼接成一个完整画面,适用于多视角对比、画面组合等场景。Cloudmediakit-cli editing stitch-videoreference/stitch-video.md
text-to-scrolling-video将指定文本内容转换为文字滚屏视频,输出视频为固定 9:16 竖版,常用于小说推文、内容讲解和歌词视频等场景。Cloudmediakit-cli editing text-to-scrolling-videoreference/text-to-scrolling-video.md
trim-audio用于音频裁剪,按指定的开始时间和结束时间从输入音频中截取片段。Cloud / Localmediakit-cli editing trim-audioreference/trim-audio.md
trim-video用于视频裁剪,可按指定的开始和结束时间从输入视频截取片段。Cloud / Localmediakit-cli editing trim-videoreference/trim-video.md
do mesmo repositório

Mais Skills

Todos os Skills
volcengine
Comunidade

byted-mediakit-audio

面向音频文件或视频中的音轨,处理语音边界定位、音频媒资信息探测、音频转码与码流封装适配、人声与背景声分离等目标。若对象和目标族已明确属于音频内容理解、音频转码、音频格式治理或音轨分离,但具体做法不确定,可先加载本 Skill 探索。

instalações
530
GitHub Stars
198
Atualizado
2 de set.
volcengine
Comunidade

byted-mediakit-shared

MediaKit 是面向音视频与图像处理的专业工具集,覆盖视频剪辑与合成、音频处理、视频理解与增强、图像处理与内容理解等工作流。用户明确提出剪辑、拼接、裁剪、转场、滤镜、运镜、混音、提取字幕、语音转字幕、音视频处理、图片处理、视频分析或画质增强目标时,先加载本 Skill,再按对象和目标选择 audio、editing、image 或 video。不承担具体能力参数说明。

instalações
530
GitHub Stars
198
Atualizado
2 de set.
volcengine
Comunidade

byted-mediakit-image

面向单张或批量图片的视觉处理、质量优化、内容理解与基础编辑目标,适用于图片尺寸缩放与体积治理、元信息探测、裁剪旋转翻转与圆角、颜色与锐化清晰度调整、负片、模糊与打码、水印、背景移除、文字识别、画质评估与智能裁剪等。若对象和目标族已明确属于图片优化、图片理解或图片隐私保护,但具体做法不确定,可先加载本 Skill 探索。

instalações
529
GitHub Stars
198
Atualizado
2 de set.
volcengine
Comunidade

byted-mediakit-video

面向视频文件的智能处理、媒资理解、画质治理与画质检测、抽帧、隐私保护、语音转字幕、字幕提取、字幕擦除、水印处理、精彩片段与高光拆条分析生成、剧情结构化与剧本整理、场景与语义分段、画面文字识别、视频转码转封装及抠像换脸等目标。若对象和目标族已明确属于视频增强、视频分析理解、视频内容结构化、从视频提取字幕、语音转字幕、视频字幕识别或擦除、视频隐私脱敏、视频媒资探测或分发适配,但具体能力不确定,可先加载本 Skill 探索。

instalações
529
GitHub Stars
198
Atualizado
2 de set.