AI 直播与视频素材直播
3.2.5 可在直播话术中用 @视频 指令自动切画面,并支持实时画面变化、多层叠加、近期不重复、数字人长素材、更清楚的摄像头口型、8 平台互动和 OBS 输出。
一、产品简介
多财多亿AI 的「AI 直播」模块是一套运行在本机的直播内容系统。您可以使用纯音频、摄像头、数字人或自有视频素材作为画面,编写或生成话术、配置弹幕回复,并通过窗口或 OBS 输出;也可以使用“对口型”,为单段人物视频快速替换配音与口型。
适用对象包括:个人创作者、电商店铺、知识博主、品牌方、本地生活与文旅机构等。无需专业直播团队,即可完成长时间脚本轮播或半自动互动直播;实际开播时仍建议按平台规则安排人工巡检。
二、核心能力详解
1. 四种直播模式
纯音频直播——只输出声音,适合电台式轮播;摄像头神经口型——真人摄像头采集画面,由本地口型引擎让嘴型跟随语音,只换口型不换脸;数字人驱动——训练授权形象后按 AI 话术连续驱动;视频素材直播——使用多个自有视频作为主画面,支持默认素材、分组、话术切换与自动换镜。
数字人形象素材需通过质检:分辨率不低于 360、时长建议 10 秒以上(最好 30 秒以上)、帧率约 25fps、正脸少遮挡、画面为胸像/半身近景。点击训练后会立即显示处理窗口,并持续更新预处理、训练百分比、当前阶段和已用时。
2. 视频素材实时去重、编排与多层叠加
选择“视频素材”后,叠加、实时画面变化和播放换镜参数默认收起,素材选择与开播操作更集中。需要细调时点击“展开参数设置”,即可恢复原有三列完整选项,直播中的参数热更新能力保持不变。
开启“实时画面变化”后,软件会在直播输出中持续加入平滑的缩放、平移、旋转、清晰度、亮度、对比度、饱和度和色温变化;变化周期与幅度可调,每次开播使用新的变化序列,不修改任何源视频文件。
主画面素材可按随机或顺序切换,设置基础速度、近期不重复数量、素材播完行为,以及循环时是否重新选择速度或起点。话术支持切换指定视频、视频分组、随机素材和默认素材;控制指令不会被朗读,并在对应话术真正开始播放时生效。
把切画面指令直接写进直播话术
@视频[产品近景]切换到名称为“产品近景”的主画面视频。
@视频组[使用场景]从“使用场景”分组中选择视频,适合一组同类素材轮换。
@随机视频随机切换一段主画面素材;@默认视频 返回默认素材。
@叠加[优惠角标;透明度=40%;大小=38%;位置=右上;持续=8秒]临时加入指定叠加视频,并设置显示效果;@清除叠加 清除临时叠加。
示例:@视频[开场] 欢迎来到直播间。@视频组[产品细节] 接下来看看做工。 只有播到对应句子时才会切画面,指令本身不会被读出来。
叠加区可同时启用多个视频层,每层分别设置透明度、位置、大小、混合方式、水平/垂直翻转、圆角和边缘柔化。“全屏”会按原始比例铺满画布并居中裁切,不会拉伸源画面。直播中增减叠加层或调整参数不会重启主画面时间轴,设置会随会话保存。
3. 本地对口型
在“AI直播”下方打开“对口型”,上传一段人物视频,再选择现成音频,或输入文案并选择参考音频克隆本人或已授权音色,即可输出新口型 MP4。文字配音支持 69 种本地语言和方言,可选填参考音频原文;任务支持取消、播放成片和自选输出位置,临时素材不会加入数字人形象列表。
4. 8 平台弹幕抓取与 AI 回复
直播中控可连接各平台中控台,实时抓取 抖音/巨量百应、快手、视频号、淘宝、百度、拼多多、TikTok、小红书 共 8 个平台的弹幕,识别问题或关键词后调用大模型生成回复,支持文字回复与 TTS 语音回复。可设置回复频率、敏感词过滤与兜底话术。中控还提供关键词规则回复、不回复关键词、黑名单、评论上墙(视频号)、模拟互动暖场、订单感谢与回复去重时间窗等场控能力。
5. AI 话术与直播剧本
在「话术生成」中粘贴原话术,可一次勾选 37 种目标语言中的多种语言,并设置品牌术语保留与同义词变量。3.2.5 会先明确商品事实、口吻、结构和篇幅,再直接生成并保存完整成品;开启变量后,每个非空行会安排多组可互换表达。结果可直接用于数字人播报或人工主播脚本,配合多段轮播与定时切换完成长时间直播。
6. 配合 OBS 推流至多平台
软件直播画面经 OBS 虚拟摄像头输出:在 OBS 中将该虚拟摄像头添加为视频来源,并在 OBS 中填写各平台的推流地址即可开播;借助 OBS 的多路推流插件可将同一画面分发到多个平台同时开播。请确认本机上行带宽与平台要求的分辨率、码率、帧率一致。
7. 长时间脚本轮播
配置好数字人、话术与推流后,可设置循环播放与定时切换。数字人以实际声音位置驱动画面,句尾自然闭口,人物动作与背景继续播放;当前句播放时会准备下一条真实待播内容,正常的短时画面波动会平滑追齐,不再先定格再突然跳帧。暂停、插话、停播重开或切换画面模式时,未播放的旧声音与画面任务会被清理。建议配合直播时间表、平台自动化规则与人工巡检使用。
8. 商品讲解中控与直播工具
直播中控支持商品讲解弹窗——讲到哪件商品,直播间自动弹出对应商品卡片;支持定时公屏(按时间表自动发送公屏消息)与直播热键——开始/停止(同一键)、打断暂停、说完暂停、按住插话(音频避让),插话内容可选「立即说」或「排队说」。输出画面可选窗口预览或 OBS 虚拟摄像头,直播画面可直接进入 OBS、会议软件或平台直播伴侣使用。
三、适用场景与案例
- 电商直播:店铺长时间轮播爆款、上新与促销内容,话术可针对不同商品分段配置;弹幕回复解答「多少钱」「怎么买」等,提升转化。
- 知识分享 / 课程推广:数字人介绍课程、答疑常见问题,弹幕引导加群或购买。
- 品牌宣传:品牌故事、活动预告、新品发布由统一数字人播报,可复制到多账号多平台。
- 本地生活 / 文旅:景区、门店、展会持续轮播玩法与优惠,弹幕回复咨询营业时间、票价等。
四、使用流程(分步说明)
- 进入模块:在本地功能中点击「AI 直播」,进入直播控制台。
- 选择画面模式:选择纯音频、摄像头、数字人或视频素材。数字人模式选择已有形象或训练授权形象;视频素材模式添加主画面、默认素材、分组和叠加视频。
- 准备话术:在话术/脚本区域粘贴文本,或使用「话术生成」AI 生成后粘贴;视频素材模式可写
@视频[名称]、@视频组[分组]、@随机视频、@默认视频、@叠加[...]和@清除叠加控制画面。 - 配置声音与素材:选择语音合成与音色;视频素材的高级参数默认收起,点击“展开参数设置”后可设置实时画面变化、换镜、近期不重复、速度、播完行为和多层叠加效果。
- 弹幕回复(可选):在直播中控选择平台并连接对应平台中控台(按提示登录),弹幕即回灌本机;AI 回复需在设置中配置大模型接口,再开启自动回复与规则。
- 输出与推流:画面输出选择窗口预览或 OBS 虚拟摄像头;经 OBS 推流时,在 OBS 中填写各平台直播后台获取的推流地址与密钥,配合 OBS 可实现多平台分发。
- 等待准备完成:摄像头和数字人模式会准备相应画面能力;视频素材模式会检查文件、重复名称、默认素材和话术引用。不要在准备中反复点击开播。
- 试播与开播:先用短句预览/试推,检查画面、声音、闭口状态与 OBS 输出,确认后开始推流,并在平台侧核对直播正常显示。
更详细说明与故障排查可查看客户端内置的 AI 直播中控使用说明、本站 使用教程 与 完整在线文档。本地语音一次启动失败不会锁死整次软件会话,稍后重新检查即可恢复,通常无需退出整个软件。
五、硬件与网络建议
电脑:建议 NVIDIA 显卡、显存 6GB 及以上(如 RTX 3060),保证数字人驱动与神经口型同步流畅。网络:上行带宽建议不低于 5–10 Mbps(多路推流需更高)。平台:各平台对推流分辨率、码率、帧率有规定,请与软件内输出设置一致。
六、常见问题速查
- 画面黑屏:先查看画面输出卡的错误提示。摄像头打不开、被占用或中途断开时会显示原因;若外推 OBS,再确认虚拟摄像头已启动、OBS 选中了正确来源。
- 没有声音:检查 TTS 音色与合成、系统音量与推流音频轨。
- 推流失败/断流:确认地址与密钥无误、未过期;检查防火墙与上行带宽。
- 弹幕不回复:确认已连接直播间、API 已配置且额度充足;查看软件日志报错。
- 口型模型加载失败:页面会显示真实失败原因;可先关闭其他占用显卡的程序后重新开播。首次失败不会锁死后续尝试,下一次开播会重新准备;切换模式或停播会自动回收后台口型进程。
- 快速停播重开异常:当前版本会按场次清理旧声音、弹幕回复、摄像头采集和口型任务。若仍有叠声或设备被占用,请完整停播,等状态回到空闲后再开。
- 视频素材没有切换:检查指令是否使用英文半角
@和方括号,素材名或分组名是否与素材库完全一致,并确认默认素材存在;开播前的检查会直接列出缺失引用。 - 实时变化不明显:确认已开启实时画面变化,并检查变化周期、缩放、平移、旋转和色彩幅度;建议先在预览中逐项小幅调整,避免变化过强影响观看。
- 叠加层看不到或画面异常:确认该层已启用、透明度不为零、位置和大小在画布范围内;全屏模式会裁切边缘以保持比例,混合方式也会影响可见程度。
- OBS 虚拟摄像头无设备:虚拟摄像头插件需以管理员权限安装,请在软件内按提示提权安装后重试。
- 摄像头下拉为空:点击设备旁的「刷新」重新扫描摄像头设备。
- 数字人训练失败:按质检提示优化素材(正脸、时长、清晰度、构图等)后重新提交。
- 对口型失败:确认人物正脸清晰、视频可正常播放、参考音频为清晰单人声;跨语言或方言克隆时可填写准确的参考音频原文。