视频+背景音,批量生成 python

Ws4年前分什么类10391

去年项目中,有个需要根据用户姓名性别,播放不同欢迎语的视频需求。原计划通过webaudio实时在客户端生成的,总是最终还是放弃了,最终采用比较死板的方式,提前根据姓氏字典批量生成。直接展示代码了,当然了,这种代码chatGPT也能给出。

#-*- coding: UTF-8 -*-


import os
import subprocess
from tqdm import tqdm

video = "demo.mp4" #视频模板
audio_dir = "/背景乐文件夹"
output_dir = "/输出文件夹"


audios = [f for f in os.listdir(audio_dir) if f.endswith('.mp3')]
for audio in tqdm(audios):

    audiopath = audio_dir + audio
    videopath = output_dir + audio.replace(".mp3","") + ".mp4";
    command = "ffmpeg -i "+video+" -i "+audiopath+" -filter_complex \"[0:a]volume=4[a0];[1:a]adelay=5150|5150,volume=6[a1];[a0][a1]amix=inputs=2:duration=first\" -c:v libx264 -crf 18 -c:a aac -b:a 96k -strict experimental -y "+videopath
    subprocess.call(command, shell=True,stdout=subprocess.DEVNULL, stderr=subprocess.DEVNULL)


ffmpe的用法,需要直接下?

adelay解释下吧,项目要求,在5.150秒插入背景乐。其他的如果不了解,可以google,或者 chatGPT

相关文章

7B小模型指挥GPT-5、Mira发布实时交互模型、Anthropic估值狂飙:AI格局正在被重新定义

7B小模型指挥GPT-5、Mira发布实时交互模型、Anthropic估值狂飙:AI格局正在被重新定义

今天的AI圈,三条新闻同时指向同一个方向:AI竞争的规则正在被改写。 前OpenAI CTO Mira Murati的Thinking Machines发布了原生多模态"交互模型",200毫秒级实时...

UNTITLED

随便发发,域名 服务器 闲着也是闲着,偶尔也有干货互联网从业20年,总归有点儿东西...

不太理想的Fine-tunes

不太理想的Fine-tunes

之前了解到openai可以针对GPT3.0进行再训练时,就已经迫不及待的试验了一把,但是效果不尽人意,我都准备放弃它了。需求点,是准备让它充当客服,喂了一部分客服QA。但是各种微调之后给的结果仅是补充...

00后少年在自家客厅完成全基因组测序,成本从27亿降到1100美元

00后少年在自家客厅完成全基因组测序,成本从27亿降到1100美元

2003年,人类首次完成全基因组测序,耗时13年、花费27亿美元。2026年,一位00后少年在自家客厅餐桌上,用二手设备和AI模型完成了同样的工作——总成本约1100美元。 成本降低了245万倍。而...

2026年5月 AI 行业 10 大关键动态:从网络攻击工业化到中美冷战升级

2026年5月 AI 行业 10 大关键动态:从网络攻击工业化到中美冷战升级

2026年5月,AI 行业正经历一场深刻的结构性转变。从网络攻击的工业化升级,到中美 AI 冷战加剧,再到 AI 替代高技能岗位的加速——以下 10 条关键动态勾勒出了当前行业所处的真实阶段。...

换种思路训练gpt3.5

换种思路训练gpt3.5

问题一我用的是aws的免费服务器,centos,版本比较老旧,想在python3基础上运行openai,可惜怎么都装不了,openai提供的方法,使用pyenv来装,顺利解决。curl ht...

发表评论    

◎欢迎参与讨论,请在这里发表您的看法、交流您的观点。