提取音频
extract_audio
用途:从音频或视频文件提取可识别音频,统一输出为 wav。适合给语音识别或字幕生成继续使用。
写法:提取音频 媒体路径=<媒体路径> [输出音频路径=<输出音频路径>] [采样率=<采样率>] [声道数=<声道数>] [覆盖已有文件=<覆盖已有文件>]
保存为
默认保存主结果,通常就是 音频路径 这个字段。
正确示例
提取音频 媒体路径='D:/素材/视频.mp4' 输出音频路径='D:/素材/视频_识别.wav'
# 说明:从视频提取单声道 16k wav 音频。
错误示例
提取音频 输出音频路径="D:/demo.mp3"
为什么错:漏写了必填参数:媒体路径。
展开查看参数和注意事项
| 中文参数 | 英文参数 | 用途 | 必填 | 默认值 |
|---|---|---|---|---|
| 媒体路径 | media_path | 输入媒体文件路径;支持视频文件和音频文件。 | 是 | 无 |
| 输出音频路径 | output_audio_path | 输出 wav 音频路径;不填时默认生成到原文件同目录。 | 否 | 无 |
| 采样率 | sample_rate_hz | 输出采样率,默认 16000。 | 否 | 16000 |
| 声道数 | channel_count | 输出声道数,默认 1。 | 否 | 1 |
| 覆盖已有文件 | overwrite | 输出文件已存在时是否覆盖;1 覆盖,0 不覆盖。 | 否 | 1 |
返回结果
如果你要整份返回对象,而不只是主结果,可在行尾写 返回结果=变量名。
返回结果
保存后通常可按字段路径继续读取。
| 字段路径 | 类型 | 必有 | 说明 |
|---|---|---|---|
音频路径 | string | 是 | 未提供说明 |
音频格式 | string | 是 | 未提供说明 |
采样率 | integer | 是 | 未提供说明 |
声道数 | integer | 是 | 未提供说明 |
文件大小 | integer | 是 | 未提供说明 |
返回/保存方式:普通动作需要留给后续步骤时,通常可在行尾追加 保存为=变量名,默认保存主结果字段 音频路径。