🎩 You're Invited:Meet the Socket team at Black Hat in Las Vegas, August 3-6.RSVP
Sign In

@volcengine/mediakit-cli

Package Overview
Dependencies
Maintainers
46
Versions
22
Alerts
File Explorer

Advanced tools

Socket logo

Install Socket

Detect and block malicious and high-risk dependencies

Install

@volcengine/mediakit-cli - npm Package Compare versions

Comparing version
0.2.0
to
0.2.1-beta.1
+51
skills/byted-mediakit-video/reference/enhance-video-fast.md
# 视频画质增强极速版
## 能力描述
集成轻量级超分与智能画质增强能力,采用速度优先算法优化策略,高效兼顾处理效率与画面效果,适配各类时延敏感型业务场景。
## 执行方式
| 项目 | 说明 |
|------|------|
| Domain | `video` |
| Tool | `enhance-video-fast` |
| 是否异步 | `是` |
| 是否支持 local | `否` |
| 模式说明 | cloud only;可通过 `--cloud` 强制当前调用 |
| 幂等行为 | 如命令支持 `client_token` 与 `callback_args`,重试时复用同一组值;强制重跑时更换新的 `client_token` |
## 参数
| 参数 | CLI flag | 类型 | 必填 | 默认值 | 说明 |
|------|----------|------|------|--------|------|
| video_url | `--video-url` | string | 是 | - | 输入视频。String 类型,支持http://xxx或https://xxx格式 URL |
| resolution | `--resolution` | string | 否 | - | 目标分辨率。支持的取值:240p / 360p / 480p / 540p / 720p / 1080p / 2k / 4k。配置此参数后,不可同时配置resolution_limit字段 |
| resolution_limit | `--resolution-limit` | integer | 否 | - | 指定输出视频的短边像素值,取值范围为 [128, 2160]。设置后,系统将锁定视频的短边像素值为设定值,并在保持原视频宽高比的前提下,等比缩放至该限制值。配置此参数后,不可同时配置resolution字段 |
| bitrate_level | `--bitrate-level` | string | 否 | medium | 码率档位。输出视频的目标平均码率。取值:low(低码率)/ medium(中码率,推荐)/ high(高码率)。默认为 medium |
| fps | `--fps` | number | 否 | - | 目标帧率,单位为 fps。取值范围为 [15, 120]。 |
| callback_args | `--callback-args` | string | 否 | - | 可选,回调参数 |
| client_token | `--client-token` | string | 否 | - | 可选,用于幂等,默认幂等,用户可根据需求进行调整 |
## 调用示例
```bash
mediakit-cli video enhance-video-fast \
--video-url https://example.com/video_url \
--resolution 720p \
--bitrate-level medium \
--fps 30 \
--callback-args sample-callback-args \
--client-token demo-client-token
```
## 输出格式
```json
{
"task_id": "task_demo_001",
"request_id": "req_demo_001"
}
```
## 任务结果查询
提交成功后会返回 `task_id`,再执行 `mediakit-cli shared query-task --task-id <task_id>` 查询。
- 当前命令:`mediakit-cli video enhance-video-fast`
- 推荐查询:`mediakit-cli shared query-task --task-id <task_id>`
# 视频理解智能策略
## 能力描述
基于视觉大模型的通用视频内容分析算子,对输入的视频 URL 列表进行智能分析,
输出视频级别的结构化理解结果,适用于内容审核、视频检索、标签生成等场景。
使用限制:单次最多输入 10 个视频,单个视频时长不超过 2 小时。
## 执行方式
| 项目 | 说明 |
|------|------|
| Domain | `video` |
| Tool | `video-understand-router` |
| 是否异步 | `是` |
| 是否支持 local | `否` |
| 模式说明 | cloud only;可通过 `--cloud` 强制当前调用 |
| 幂等行为 | 如命令支持 `client_token` 与 `callback_args`,重试时复用同一组值;强制重跑时更换新的 `client_token` |
## 参数
| 参数 | CLI flag | 类型 | 必填 | 默认值 | 说明 |
|------|----------|------|------|--------|------|
| video_urls | `--video-urls` | array<string> | 是 | - | 待处理的视频 URL 列表,支持 HTTP/HTTPS 公网可访问链接,最多 10 个视频。子项说明:视频 URL |
| prompt | `--prompt` | string | 是 | - | 提示词 |
| level | `--level` | string | 否 | Economy | 分析档位, 可选值: Economy, Balanced, Quality |
| prefer_endpoints | `--prefer-endpoints` | array<string> | 否 | - | 优先使用指定的自定义推理点列表,最多 10 个,优先级高于prefer_models。子项说明:指定使用的自定义推理点 |
| prefer_models | `--prefer-models` | array<string> | 否 | - | 优先使用指定的模型列表,最多 10 个模型。子项说明:指定使用的模型 |
| manual_option | `--manual-option` | object | 否 | - | 手动模式相关参数。CLI 传参时请使用 JSON 字符串,并用单引号包裹整个值 |
| callback_args | `--callback-args` | string | 否 | - | 可选,回调参数 |
| client_token | `--client-token` | string | 否 | - | 可选,用于幂等,默认幂等,用户可根据需求进行调整 |
## 调用示例
```bash
mediakit-cli video video-understand-router \
--video-urls '["https://example.com/video_url"]' \
--prompt "分析视频主要内容" \
--level Economy \
--callback-args sample-callback-args \
--client-token demo-client-token
```
## 输出格式
```json
{
"task_id": "task_demo_001",
"request_id": "req_demo_001"
}
```
## 任务结果查询
提交成功后会返回 `task_id`,再执行 `mediakit-cli shared query-task --task-id <task_id>` 查询。
- 当前命令:`mediakit-cli video video-understand-router`
- 推荐查询:`mediakit-cli shared query-task --task-id <task_id>`
+6
-6

@@ -1,6 +0,6 @@

97cf495acd07a1d0ed2f7435423c6910511b6e37350244bfc063c8acdd7d5dc1 mediakit-cli_0.2.0_darwin_amd64.tar.gz
97ca1a063b1c521dda10e64eba4010bcd01fe33ce33049702858f0035c54034b mediakit-cli_0.2.0_darwin_arm64.tar.gz
ac1a180001c476e00dc8efe779f6736f6c8df8d5c02958c1f30685b1ea1e8f21 mediakit-cli_0.2.0_linux_amd64.tar.gz
a3d303ee22e3df42807b8c3736fdbe2d9b1f7911be4169fc49c6c6b8d9d59053 mediakit-cli_0.2.0_linux_arm64.tar.gz
d69a22ce1e28f69db5f0048f6bbe6a4186f32412a4bdbc00bf0e8f8ab2caf14d mediakit-cli_0.2.0_windows_amd64.zip
93a1e1ad08473f30e72039d180cbf25073a004e6dc65b302373f9260815805ba mediakit-cli_0.2.0_windows_arm64.zip
89ac8777d81bb1444f6103d700fd7062ffd926c20e6af50a71f75bd7afc8f91d mediakit-cli_0.2.1-beta.1_darwin_amd64.tar.gz
680b3f2f9adb07623e84da7e015b1f57b8a4f4ce229efd5d882d5d65ef526596 mediakit-cli_0.2.1-beta.1_darwin_arm64.tar.gz
db00c8941c76e58477d89aafac21fc6db0022ae24164bd9afdddcb9b9535380e mediakit-cli_0.2.1-beta.1_linux_amd64.tar.gz
ad44d9b1f14355f52b7264c6cb3bd3a77e6d4fc3a4f047e4f6de3bc0b1f6ccde mediakit-cli_0.2.1-beta.1_linux_arm64.tar.gz
947d69062913fa0ff79fa2511b54217b0d2d43a6328a9d7739086e559c83e540 mediakit-cli_0.2.1-beta.1_windows_amd64.zip
68f3f3bd1bc1fba9e44eca01b96713deeab4eee83d8659b748bfe30f511c7f80 mediakit-cli_0.2.1-beta.1_windows_arm64.zip
{
"name": "@volcengine/mediakit-cli",
"version": "0.2.0",
"version": "0.2.1-beta.1",
"description": "MediaKit CLI with multi-platform binary distribution via npm",

@@ -5,0 +5,0 @@ "license": "MIT",

@@ -7,3 +7,3 @@ # 人声背景音分离

输入:video_url 和 audio_url 二选一。
输出格式:AAC。
输出格式:支持 mp3、wav、aac、m4a、flac,默认 aac。

@@ -24,4 +24,5 @@ ## 执行方式

|------|----------|------|------|--------|------|
| video_url | `--video-url` | string | 否 | - | 输入视频 Url(需公网可访问),与audio_url二选一,都存在时优先取video_url |
| audio_url | `--audio-url` | string | 否 | - | 输入音频 Url(需公网可访问),与video_url二选一,不能都为空 |
| video_url | `--video-url` | string | 否 | - | 输入视频资源 Url,支持 http/https 直链或 mediakit/tos/vod 平台资源链接;与 audio_url 二选一,都存在时优先取 video_url |
| audio_url | `--audio-url` | string | 否 | - | 输入视频资源 Url,支持 http/https 直链或 mediakit/tos/vod 平台资源链接;与 audio_url 二选一,不能都为空 |
| output_format | `--output-format` | string | 否 | aac | 输出音频格式,支持 mp3、wav、aac、m4a、flac,默认 aac |
| callback_args | `--callback-args` | string | 否 | - | 可选,回调参数 |

@@ -28,0 +29,0 @@ | client_token | `--client-token` | string | 否 | - | 可选,用于幂等,默认幂等,用户可根据需求进行调整 |

@@ -21,5 +21,7 @@ # 生成式画质增强

| video_url | `--video-url` | string | 是 | - | 输入视频。String 类型,支持http://xxx或https://xxx格式 URL |
| resolution | `--resolution` | string | 否 | 720p | 目标分辨率。支持的取值:720p / 1080p |
| resolution | `--resolution` | string | 否 | 720p | 目标分辨率。支持的取值:720p / 1080p / 2k |
| bitrate_level | `--bitrate-level` | string | 否 | medium | 码率档位。输出视频的目标平均码率。取值:low(低码率)/ medium(中码率,推荐)/ high(高码率)。默认为 medium |
| fps | `--fps` | number | 否 | - | 目标帧率,单位为 fps。若未指定,输出视频将保持与原始片源一致的帧率。取值范围为 [15, 120],建议不超过原片的 4 倍 |
| experimental_version | `--experimental-version` | string | 否 | - | 实验版本,用于内部业务传入特定版本模型,官网文档不提供该字段。可选值,0.2、1.0等。非必填 |
| generation_weight | `--generation-weight` | number | 否 | - | 生成强度。数值越大表示增强/生成强度越大,数值越小表示越遵循原片。建议最小取值是 0.4。非必填 |
| callback_args | `--callback-args` | string | 否 | - | 可选,回调参数 |

@@ -26,0 +28,0 @@ | client_token | `--client-token` | string | 否 | - | 可选,用于幂等,默认幂等,用户可根据需求进行调整 |

@@ -27,2 +27,3 @@ # 画质增强

| resolution_limit | `--resolution-limit` | integer | 否 | - | 目标长宽限制,用于指定输出视频的长边或短边的最大像素值,取值范围为 [64, 2160]。配置此参数后,不可同时配置resolution字段 |
| bitrate_level | `--bitrate-level` | string | 否 | medium | 码率档位。输出视频的目标平均码率。取值:low(低码率)/ medium(中码率,推荐)/ high(高码率)。默认为 medium |
| fps | `--fps` | number | 否 | - | 目标帧率,单位为 fps。取值范围为 (0, 120]。 |

@@ -29,0 +30,0 @@ | callback_args | `--callback-args` | string | 否 | - | 可选,回调参数 |

@@ -30,2 +30,4 @@ # 高光智剪-短剧

| opening_hook_param | `--opening-hook-param` | object | 否 | - | 精彩前置功能参数配置(可选)。CLI 传参时请使用 JSON 字符串,并用单引号包裹整个值 |
| video_ending_mode | `--video-ending-mode` | string | 否 | - | 高光智剪视频结尾选取模式。ReuseMainEnding=优先复用正片剧集结尾;SmartSelect=智能选取模式。不传则由后端按默认策略兜底 |
| enable_segment_tag | `--enable-segment-tag` | boolean | 否 | - | 是否在结果中输出高光片段/分镜的标签信息(tags 字段)。不传或 false = 不返回 tags;true = 在 clips 与 storyboard_info 中返回 tags,并透传给底层 |
| callback_args | `--callback-args` | string | 否 | - | 可选,回调参数 |

@@ -32,0 +34,0 @@ | client_token | `--client-token` | string | 否 | - | 可选,用于幂等,默认幂等,用户可根据需求进行调整 |

@@ -5,3 +5,3 @@ ---

license: "MIT"
description: "视频处理,涵盖视频画质增强、视频理解、字幕擦除等能力。包含能力:analyze-video-highlights, analyze-video-storyline, asr-subtitles, enhance-video, enhance-video-generative, erase-video-subtitle, erase-video-subtitle-pro, generate-highlights-microdrama, generate-highlights-minigame, matte-greenscreen-video, matte-portrait-video, probe-video-metadata, segment-scenes, video-ocr。当用户需要使用 video 域的 MediaKit CLI 能力时触发。"
description: "视频处理,涵盖视频画质增强、视频理解、字幕擦除等能力。包含能力:analyze-video-highlights, analyze-video-storyline, asr-subtitles, enhance-video, enhance-video-fast, enhance-video-generative, erase-video-subtitle, erase-video-subtitle-pro, generate-highlights-microdrama, generate-highlights-minigame, matte-greenscreen-video, matte-portrait-video, probe-video-metadata, segment-scenes, video-ocr, video-understand-router。当用户需要使用 video 域的 MediaKit CLI 能力时触发。"
permissions:

@@ -15,3 +15,3 @@ - shell

domain: video
capability_count: 14
capability_count: 16
---

@@ -31,7 +31,8 @@ # Video Skills

| asr-subtitles | 对输入视频或音频进行语音识别,输出带时间戳的字幕片段。 支持格式:主流音视频格式(如mp4、mov、mp3、m4a、wav等)。 输入:video_url和audio_url二选一。 | `video_url?:string, audio_url?:string, content_type?:string, language?:string, enable_speaker_info?:boolean, enable_confidence?:boolean, callback_args?:string, client_token?:string` | [reference/asr-subtitles.md](reference/asr-subtitles.md) |
| enhance-video | 画质增强:针对 AIGC / UGC / 短剧 / 教育 / 游戏 / 老片修复等场景,提供画质提升 + 超分增强一站式解决方案。依托 AI MediaKit 智能媒体处理引擎,融合视频内容理解、画质指标智能决策、多维度增强原子算法,实现画质的全面优化。 支持格式:主流视频格式如mp4、flv、ts、avi、mov、wmv、mkv。 使用限制:单文件大小不超过100G。 | `video_url:string, scene?:string, tool_version?:string, resolution?:string, resolution_limit?:integer, fps?:number, callback_args?:string, client_token?:string` | [reference/enhance-video.md](reference/enhance-video.md) |
| enhance-video-generative | 生成式视频增强修复(generative_video_restoration)是基于扩散大模型(Diffusion-based Large Model)的生成式视频修复技术。不仅可以还原被破坏的像素,更借助大规模预训练积累的丰富视觉先验,主动补全细节、理解语义,生成真实、自然、高保真的视频内容。 | `video_url:string, resolution?:string, bitrate_level?:string, fps?:number, callback_args?:string, client_token?:string` | [reference/enhance-video-generative.md](reference/enhance-video-generative.md) |
| enhance-video | 画质增强:针对 AIGC / UGC / 短剧 / 教育 / 游戏 / 老片修复等场景,提供画质提升 + 超分增强一站式解决方案。依托 AI MediaKit 智能媒体处理引擎,融合视频内容理解、画质指标智能决策、多维度增强原子算法,实现画质的全面优化。 支持格式:主流视频格式如mp4、flv、ts、avi、mov、wmv、mkv。 使用限制:单文件大小不超过100G。 | `video_url:string, scene?:string, tool_version?:string, resolution?:string, resolution_limit?:integer, bitrate_level?:string, fps?:number, callback_args?:string, client_token?:string` | [reference/enhance-video.md](reference/enhance-video.md) |
| enhance-video-fast | 集成轻量级超分与智能画质增强能力,采用速度优先算法优化策略,高效兼顾处理效率与画面效果,适配各类时延敏感型业务场景。 | `video_url:string, resolution?:string, resolution_limit?:integer, bitrate_level?:string, fps?:number, callback_args?:string, client_token?:string` | [reference/enhance-video-fast.md](reference/enhance-video-fast.md) |
| enhance-video-generative | 生成式视频增强修复(generative_video_restoration)是基于扩散大模型(Diffusion-based Large Model)的生成式视频修复技术。不仅可以还原被破坏的像素,更借助大规模预训练积累的丰富视觉先验,主动补全细节、理解语义,生成真实、自然、高保真的视频内容。 | `video_url:string, resolution?:string, bitrate_level?:string, fps?:number, experimental_version?:string, generation_weight?:number, callback_args?:string, client_token?:string` | [reference/enhance-video-generative.md](reference/enhance-video-generative.md) |
| erase-video-subtitle | 智能检测并擦除视频画面中已有的硬字幕,保留原始背景。 支持格式:主流视频格式如mp4、flv、ts、avi、mov、wmv、mkv。 | `video_url:string, callback_args?:string, client_token?:string` | [reference/erase-video-subtitle.md](reference/erase-video-subtitle.md) |
| erase-video-subtitle-pro | 针对视频中的字幕,实现高质量的无痕擦除,最大程度的还原视频画面。 支持格式:主流视频格式如mp4、flv、ts、avi、mov、wmv、mkv。 | `video_url:string, mode?:string, output_encode_mode?:string, erase_ratio_location?:array<object{top_left_x:number, top_left_y:number, bottom_right_x:number, bottom_right_y:number}>, callback_args?:string, client_token?:string` | [reference/erase-video-subtitle-pro.md](reference/erase-video-subtitle-pro.md) |
| generate-highlights-microdrama | 深度理解短剧角色、剧情与故事线,自动提取高光片段并混剪成投流视频。 支持故事线混剪模式(StorylineCuts),可选"短剧三要素"视觉模板,输出高光集锦、单集预告等。 支持输出详细分镜信息(storyboard)。 使用限制:单次最多 100 个视频,累计时长不超过 300 分钟。 | `video_urls:array<string>, mode?:string, enable_generate_video?:boolean, enable_return_poster?:boolean, edit_param?:object{mode:string, template_edit?:object{template?:string, title?:string, hint?:string}}, highlight_cuts_param?:object{enable_storyboard?:boolean, min_duration?:number, max_duration?:number, max_number?:integer, cut_mode?:string}, opening_hook_param?:object{enable_opening_hook?:boolean, min_duration?:number, max_duration?:number, min_clip_duration?:number, min_score?:number}, callback_args?:string, client_token?:string` | [reference/generate-highlights-microdrama.md](reference/generate-highlights-microdrama.md) |
| generate-highlights-microdrama | 深度理解短剧角色、剧情与故事线,自动提取高光片段并混剪成投流视频。 支持故事线混剪模式(StorylineCuts),可选"短剧三要素"视觉模板,输出高光集锦、单集预告等。 支持输出详细分镜信息(storyboard)。 使用限制:单次最多 100 个视频,累计时长不超过 300 分钟。 | `video_urls:array<string>, mode?:string, enable_generate_video?:boolean, enable_return_poster?:boolean, edit_param?:object{mode:string, template_edit?:object{template?:string, title?:string, hint?:string}}, highlight_cuts_param?:object{enable_storyboard?:boolean, min_duration?:number, max_duration?:number, max_number?:integer, cut_mode?:string}, opening_hook_param?:object{enable_opening_hook?:boolean, min_duration?:number, max_duration?:number, min_clip_duration?:number, min_score?:number}, video_ending_mode?:string, enable_segment_tag?:boolean, callback_args?:string, client_token?:string` | [reference/generate-highlights-microdrama.md](reference/generate-highlights-microdrama.md) |
| generate-highlights-minigame | 识别小游戏录屏视频中的核心玩法与高光事件(如连击、通关、极限操作等), 快速生成用于买量的视频素材。支持提供游戏名称、玩法描述、高光定义以辅助模型更精准识别。 使用限制:本期仅支持单视频输入。 | `video_urls:array<string>, mode?:string, enable_generate_video?:boolean, minigame_info?:object{name?:string, play_definition?:string, highlight_definition?:string}, callback_args?:string, client_token?:string` | [reference/generate-highlights-minigame.md](reference/generate-highlights-minigame.md) |

@@ -43,1 +44,2 @@ | matte-greenscreen-video | 对以绿幕或纯色为背景的视频进行抠图,自动识别主体(人物、物品、动物等),同时移除背景,生成背景透明的视频。 输出视频格式为 WEBM(默认)或 MOV,分辨率与原片对齐。 支持的格式:主流视频格式如 mp4、flv、ts、avi、mov、mkv、wmv。 | `video_url:string, format?:string, callback_args?:string, client_token?:string` | [reference/matte-greenscreen-video.md](reference/matte-greenscreen-video.md) |

| video-ocr | 识别视频画面中的字幕/文字内容,输出带时间戳的字幕片段。 支持格式:主流视频格式如 mp4、flv、ts、avi、mov、wmv、mkv。 | `video_url:string, mode?:string, callback_args?:string, client_token?:string` | [reference/video-ocr.md](reference/video-ocr.md) |
| video-understand-router | 基于视觉大模型的通用视频内容分析算子,对输入的视频 URL 列表进行智能分析,输出视频级别的结构化理解结果,适用于内容审核、视频检索、标签生成等场景。 使用限制:单次最多输入 10 个视频,单个视频时长不超过 2 小时。 | `video_urls:array<string>, prompt:string, level?:string, prefer_endpoints?:array<string>, prefer_models?:array<string>, manual_option?:object, callback_args?:string, client_token?:string` | [reference/video-understand-router.md](reference/video-understand-router.md) |