公司动态
如何快速生成AI解说视频:开源工具auto-video-generateor完整上手教程
如何快速生成AI解说视频开源工具auto-video-generateor完整上手教程【免费下载链接】auto-video-generateor自动视频生成器给定主题自动生成解说视频。用户输入主题文字系统调用大语言模型生成故事或解说的文字然后进一步调用语音合成接口生成解说的语音调用文生图接口生成契合文字内容的配图最后融合语音和配图生成解说视频。项目地址: https://gitcode.com/gh_mirrors/au/auto-video-generateor周四下午三点一位初中历史老师盯着空白的剪辑软件发愁明天要交一节关于“四大发明”的微课PPT倒是做好了可配音、配图、字幕、剪辑这些活儿她一样都不会。外包预算为零。找人帮忙时间来不及。最后她只花了不到半小时把主题文字敲进一个开源工具收获了一个带配音、配图、字幕的完整教学视频。这个工具就是auto-video-generateor一款给定主题就能自动生成解说视频的开源AI视频生成工具。它不要求你会剪辑、不要求你懂代码甚至可以不花一分钱跑通全流程。30秒看懂这个工具到底替你干了什么自动生成解说视频这件事本质上是一条流水线auto-video-generateor 把这条流水线全部接好了环节传统做法这个工具的做法写文案自己憋稿子、反复改大模型根据你给的主题直接生成故事/解说词配音录音棚、找配音员调用语音合成接口自动生成解说语音配图找图库、P图调用文生图接口按每句内容生成对应画面合成剪辑软件逐段拼接自动对齐语音和图片输出带字幕的 MP4你唯一要做的就是输入一个主题或者直接扔一份 PPT/PDF 进去。它一共提供四个版本从简到繁v1 极简版代码级演示适合想看底层实现的技术党v2 千帆版基于百度千帆大模型适合已有百度云账号的企业用户v3 免费版全流程用免费资源跑通适合零预算尝鲜v4 免费校对版默认版本生成后还能逐条校对修改素材适合认真做内容的用户带你走一遍半小时从零跑出一个视频下面用最省事的方式把整个过程走一遍。你不需要理解每一行代码照做就行。第一步把代码拿到手打开终端克隆项目并进入目录git clone https://gitcode.com/gh_mirrors/au/auto-video-generateor cd auto-video-generateor然后安装依赖pip install -r requirements.txt 如果你的电脑还没装 Python先装一个 3.8 以上的版本再继续。第二步填好密钥这是唯一稍微麻烦的地方项目根目录有个config.env文件里面长这样DEEPSEEK_API_KEYsk-你的DeepSeek密钥 DOUBAO_TTS_APPID你的豆包语音应用ID DOUBAO_TTS_ACCESS_TOKEN你的豆包语音访问令牌 QIANFAN_ACCESS_KEY QIANFAN_SECRET_KEY简单解释一下DEEPSEEK_API_KEY用来生成文案和故事。DeepSeek 的接口很便宜10 块钱能用挺久去官网注册拿一个密钥填进去即可。DOUBAO_TTS_APPID / DOUBAO_TTS_ACCESS_TOKEN用来合成配音。豆包语音合成玩一玩基本不花钱按官方指引创建一个应用把 AppID 和 Token 填进来。QIANFAN_ACCESS_KEY / QIANFAN_SECRET_KEY用 v2 千帆版才需要用 v3/v4 免费版可以先不管。 三个密钥是调用第三方服务用的跟这个工具本身没关系。你也可以在 v3 免费版里使用完全免费的接口组合把成本压到零。第三步启动界面在项目目录下运行python main.py默认启动的就是v4 免费校对版推荐。想切版本就在后面加数字python main.py 1到4分别对应 v1 到 v4。等看到提示后打开浏览器访问http://127.0.0.1:9020会要求登录用户名密码随便填一个相同的就行。第四步输入主题一键生成进入主界面后重点看两个地方代号名称给你的项目起个名字比如sida-faming方便以后找回素材。主题/故事填上你的核心主题比如“用两分钟介绍中国古代四大发明”。然后直接点“一键生成”工具会按照“写文案 → 分句 → 配语音 → 画配图 → 合成视频”的顺序自动往下跑。整个等待过程会有点长尤其是生成图片那一步。生成完页面下方会出现可以播放的 MP4 视频。第五步不满意就校一校这是 v4 版最有价值的地方。生成完素材后进入校对界面每一句文案对应的语音和配图都会列出来某句话读错了改文字重新合成这一段语音。某张图风格不对改提示词单独重画。某段节奏拖沓直接把某条音频剪掉或合并。改完勾选“已确认”重新点合成视频就得到最终成品了。第六步下次接着干所有素材都会按“用户名/代号”保存在mnt/materials/目录下。下次打开页面先“更新代号列表”选中你的代号点“加载参数”“加载资源”就能接着上次的进度继续不用从头再来三个实用技巧外加我踩过的坑技巧一PPT 直接变成视频如果你已经做好了 PPT不用重新写文案——只要在每页幻灯片的备注里写上逐字稿然后上传 PPT工具会以幻灯片为画面、以备注为解说词自动合成视频。PDF 也可以它会先识别内容再生成。⚠️坑 1用 PPT 转视频功能前需要先安装 LibreOffice并把它加到系统环境变量里。没装会直接报错。技巧二用“代号”做版本管理同一主题想做不同风格起不同代号就行。sida-faming-v1、sida-faming-英文版……每个代号是独立的一套素材互不干扰特别适合做系列化内容时控制风格统一。技巧三赶时间就降分辨率画面尺寸默认是1280x720。如果只是快速出个草稿可以把尺寸调小一点比如 960x540图片生成会明显变快验证思路完全够用。⚠️坑 2一定要先把完整流程跑一遍“一键生成”执行完或者各个分步骤逐个执行一遍特别是“创建记录”这一步再单独修改某一条素材。顺序反了资源对不上号视频会合成失败。⚠️坑 3如果生成的配图变成了一堆“文字图片”通常是后台文生图接口临时抽风稍后再试一次通常就能恢复。新手最常见的五个问题Q1这工具真的免费吗v3/v4 免费版用的都是免费或低价接口组合v3 可以做到零成本。v4 的默认文案生成走 DeepSeek费用很低配音用豆包也基本不花钱。Q2完全不会写代码能用吗能。你只需要会打开终端、输入几条命令、填密钥。项目本身是带网页界面的安装好之后所有操作都在浏览器里点按钮完成。Q3视频里能换配音吗能。界面里有语音参数设置可以选不同的音色还能调语速、音量、音调改完重新合成配音即可。Q4生成的素材存在哪里存在项目下的mnt/materials/用户名/代号/目录里按text文案、audio语音、image图片、resource资源记录分门别类随时可以翻出来。Q5跑一半失败了怎么办大部分失败是第三方接口超时或限流导致的。检查密钥是否填对、网络是否通畅然后点重试即可。已经生成好的素材不会丢下次能接着跑。接下来你可以做什么这个周末随便找个你熟悉的话题——一道菜的做法、一本书的读后感、一个科学小常识——用它生成第一个视频。不追求完美先看流程能不能跑通。跑通之后试着把素材尺寸、音色、文案模板都换着调一遍感受一下哪些参数影响最大。等你想认真做了再把 PPT 转视频、资源校对这些进阶功能用起来。如果还想看更完整的操作演示仓库的 README 里有项目作者录制的教程视频入口跟着过一遍会更快上手。从“我不会剪视频”到“半小时出一个解说视频”中间只隔着一个 auto-video-generateor。剩下的就看你想讲什么故事了。【免费下载链接】auto-video-generateor自动视频生成器给定主题自动生成解说视频。用户输入主题文字系统调用大语言模型生成故事或解说的文字然后进一步调用语音合成接口生成解说的语音调用文生图接口生成契合文字内容的配图最后融合语音和配图生成解说视频。项目地址: https://gitcode.com/gh_mirrors/au/auto-video-generateor创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考