v3.2.5 · 8 月 15 日更新 一套客户端,连接内容、视觉、视频与直播

给短剧团队、电商商家、直播运营和内容工作室

把一份想法,连续做成
文案 · 图片 · 视频 · 直播

不再在多套工具之间反复搬素材。从内容方案、脚本和商品信息开始,继续完成做图、视频、配音、直播控场、混剪与发布,让一次准备产生更多可交付结果。

Agent 助手可引导、排队和分支协作 脚本与参考素材直接生成广告成片 换脸、动作、换人与对口型本机完成 短剧从策划到成片衔接更稳定

Windows 10 64 位及以上 · 完整客户端解压后约 24GB · 本地模型按需下载

50+ 项实用能力
34 类 内容生产方案
1 → 9 产品图变电商套图
4 种 直播工作模式
🎬
视频生成 文生 / 图生视频
📺
AI直播 数字人主播
🎞️
智能混剪 多版本剪辑
🎙️
语音克隆 声音复制
👤
数字人 音画自然同步
🎭
短剧视频 分镜到成片
🖼️
图像创作 文生图/图生图
创作中枢 素材持续流转
交付结果 成片 / 直播 / 发布
✍️ 话术一次明确要求,直接生成并保存可用成品 🌍 37 种目标语言分别按本地口语与文字习惯创作 🔀 变量话术每行提供更多可直接互换的表达 🎥 摄像头口型的唇线、牙齿边缘和嘴角更清楚 ⬇️ 旧版本可累计增量直达 3.2.5,只下载实际变化 查看完整更新日志 →

先看你要的结果,再选择怎么做

主页不再只列按钮。下面直接说明准备什么、软件帮你完成哪些步骤、最后能得到什么。

01 电商商家 / 品牌运营

一张产品图,扩成整套销售素材

上传产品图并填写真实商品信息,一次生成主视觉、场景、氛围、细节、工艺、明暗、卖点、参数和尺寸 9 张职责不同的图片,还能继续制作多语言文案、口播与商品视频。

产品图9 张套图话术与视频
  • 未填写的卖点和参数不会被擅自编造
  • 支持多语言商品文案,适合不同市场
  • 套图、口播、视频可以继续复用同一份资料
查看电商套图能力 →
02 短剧团队 / 内容工作室

从一个想法,推进到逐镜成片

选择 34 类内容方案之一,或导入 TXT、Markdown、DOCX 剧本;软件继续组织方案资料、大纲、分集内容、分镜、关键帧、逐镜视频与最终合并,项目过程集中保存。

想法或剧本分镜与关键帧成片
  • 34 类方案分别约束资料、结构与画面重点
  • 角色、素材、提示词和镜头按项目持续管理
  • 上游内容变化后,旧结果不会混入新一轮合并
查看短剧完整流程 →
03 直播运营 / 商品讲解

让话术直接控制直播画面

在脚本中写 @视频[名称] 或按分组调用素材,播到对应话术才切换画面;支持实时画面变化、多层视频叠加、自动换镜和近期不重复,一套素材可以持续编排。

话术脚本@视频 控场直播输出
  • 控制指令只负责切画面,不会被主播念出
  • 4 种直播模式,可按内容形式灵活选择
  • 支持 8 个平台的评论互动接入
查看直播玩法 →
04 自媒体 / 批量内容生产

一份旧素材,继续拆出更多内容

把已有视频、音频和文案继续用于文字提取、SRT 字幕、音频提取、金句切片、智能混剪、配音和多平台发布,减少重复整理与反复导入。

视频或音频拆解与重组多版本内容
  • 10 种混剪模式,支持去重、重排和变速
  • 字幕、封面、配音和批量任务一并处理
  • 覆盖 7 个内容平台的自动或半自动发布
查看内容再利用能力 →

把创作从“到处复制粘贴”变成一条工作流

不是要求每个人都用完所有功能,而是让你需要的那几步在同一套项目和素材体系里接得起来。

核心价值

少做重复动作,多交付有效结果

从聊天里的想法开始,到可编辑脚本、图片、视频、声音和直播画面,每一步都可以继续成为下一步的输入。

当前不扣算力自部署文字、图片、视频 结果回到原任务减少跨会话找文件 本地与云端可选按功能和素材情况处理
  1. 01
    内容起点

    把需求变成能执行的内容

    用 Agent 助手、话术生成和内容方案,把零散想法整理成文案、脚本、商品卖点、大纲或分镜计划。

    Agent 助手话术生成34 类方案
  2. 02
    视觉生产

    让文字和参考素材变成画面

    生成商品图、场景图、角色图和电商套图;支持多张参考图和批量结果,便于比较后继续使用。

    11 套图片模板0~9 张参考图1~9 张出图
  3. 03
    动态成片

    把画面推进成镜头和完整视频

    根据文字、图片、关键帧或多参考素材生成视频,再进入短剧逐镜生产、口播、对口型或智能混剪。

    文生与图生顺序关键帧短剧逐镜成片
  4. 04
    直播与分发

    让成片继续进入直播和内容矩阵

    @视频 在直播话术中控制素材,也可对成片提取字幕、音频、金句并制作多版本,再分发到内容平台。

    4 种直播模式8 平台互动7 平台发布

不仅“能生成”,还要更方便持续生产

01

本地文字、图片与视频当前免云端算力

当前 3.2.5 选择本地文字、图片或视频能力时不消耗云端算力;本地视频需显卡达到对应要求。

02

对话不只给文字答案

Agent 助手工作模式可以继续生成图片、视频、音乐和语音,结果回到发起任务的原会话。

03

本地工具照顾敏感素材

视频去水印、文字识别、语音、对口型等本地能力可在电脑内完成对应处理,减少素材外传。

04

批量任务不怕做到一半

混剪、音频和内容任务提供进度、结果与续做入口,长流程不必每次从头重新准备。

05

跨语言内容更容易落地

话术可生成多语言版本;对口型支持 69 种语言与方言,适合课程、商品和知识内容。

06

功能边界写得更明白

需要哪些素材、可选哪些参数、任务进行到哪里会直接显示;不会把服务实现和复杂接口暴露给用户。

先从你最需要的一条生产链开始不必一次学会全部能力,下载后按场景逐步使用。
下载 v3.2.5 客户端

AI 数字人直播系统

数字人口型跟随声音连续播放,句间自然闭口;支持长时间脚本轮播、弹幕互动与 OBS 虚拟摄像头输出

正在直播中 👁 12,580
👩‍💼
🛍️ 商品1
📦 商品2
用户A: 这个怎么买?
用户B: 太好看了!
AI回复: 点击下方链接即可购买~
🎭

真人级数字人形象

上传本人或已授权的视频素材,经质检后训练专属形象;声音连续播放,画面按实际声音位置追随,句间自然闭口

💬

智能弹幕互动

AI 自动识别弹幕意图,文字 / 语音双回复;直播中控覆盖抖音、快手、视频号、淘宝、百度、拼多多、TikTok、小红书 8 平台

📜

直播话术生成

按主题分批扩写,可一次生成多种语言;支持品牌术语保留和同义词变量,完成后按语言独立保存

🎬

@视频 话术控画面

脚本可按名称、分组、随机或默认素材切换主画面,并临时启用叠加层;指令不会被朗读,只在对应话术起播时执行

📺

OBS 虚拟摄像头输出

直播画面输出为 OBS 虚拟摄像头,配合 OBS 推流至抖音、快手、视频号、淘宝等平台开播

长时间脚本轮播

设置脚本后自动循环,商品讲解弹窗、定时公屏与直播热键齐备;建议按平台规则定期巡检直播状态

🎥

摄像头神经口型

真人摄像头采集 + 本地神经口型同步;口型准备完成后才起声,停播或切模式会自动回收资源

🎚️

四种直播模式

纯音频、摄像头神经口型、数字人实时驱动和视频素材直播,按内容形式灵活选择

AI 视频生成与编辑

文生 / 图生 / 首尾帧 / 多图角色场景 / 参考视频编辑等多模板玩法,另含短剧视频整条链路;详见 功能说明

视频生成
🎬

AI 文生视频

综合生成、侧移跟拍(浅景深)、联网搜索、电商产品展示、探店视频等多种模板;可选时长与画幅,云端渲染

多模板 联网检索
🖼️

AI 图生视频

单图动效、双图首尾帧过渡、人物+场景双图合成、多图角色场景与关键帧链路等

🎭

短剧视频

提供 34 类内容方案,按方案组织所需资料、大纲、分镜、参考素材和逐镜成片

🔍

提示词反推

上传 AI 生成视频或粘贴抖音分享链接,多模态大模型反推生成提示词

🎞️

AI 视频混剪

支持链接与本地素材导入、场景智能切分、去重 / 重排 / 变速等多版本混剪;含字幕、封面和配音,并支持断点续剪与混剪报告

🔇

AI 视频去水印

框选水印 / 台标区域,批量去除视频水印

短剧视频多类型内容生产线

从 34 类内容方案中选择适合的创作方向,再按对应资料和规则生成大纲、分集内容、分镜、逐镜视频与最终成片。

从需求到成片
🎬

一条链路管理完整内容工程

填写需求并确认内容方案后,所需的产品、受众、证据、人物、场地或商品图会集中显示;资料确认后再生成大纲、内容规划和可编辑的逐镜生产计划。

关键帧、视频提示词、角色声音和成片来源都会跟随项目与剧集保存;修改上游内容后,旧视频仍会保留,但不会继续冒充当前结果或参与新一轮合并。

连续故事 带货口播 探店知识 品牌课程
🧠

方案化内容策划

34 类方案分别约束资料、结构、画面重点和完成标准,不同类型不会再套用同一套生成逻辑。

👥

方案资料集中填写

生成大纲时按当前方案填写必需资料;缺少内容会明确提示,也可先保存部分资料稍后补齐。

🎥

内容方案可控切换

导入正文始终保留,其他正文由你决定是否迁移;旧方案的大纲、素材、分镜和输出与新方案隔离。

🎵

有效成片拼接与配乐

只使用来源仍匹配的镜头完成时间轴与配乐,可导出工程继续精剪,内容变化后不会误合并旧视频。

全栈 AI 能力矩阵

覆盖内容策划、生产、分发与数据闭环,企业级能力持续迭代

🎙️ AI 语音技术

🎙️

语音克隆

仅需 3–10 秒清晰人声即可高保真克隆音色特征

🔊

AI 配音 TTS

在线多语种合成 + 本地声音复刻双模式,支持多种语言、方言与情绪表达,语速可调

📝

语音转文字 / 字幕生成

本地离线识别 + 云端增强识别双模式生成字幕,支持多语言并可翻译成中文

🎚️

音频切片

基于静音检测的智能切片,批量处理长音频

🎼

音频提取

从视频提取音频转 MP3,支持本地文件和链接下载

🛠️

音频编辑

批量音频再加工:AI 一键改写重录、关键词替换与过滤

🖼️ AI 图像技术

🎨

AI 文生图

文字描述生成高质量图像,影院级风格与细节表现

👗

多图换装

在图片生成中用多图参考,将服装自然穿到人物身上

👤 AI 数字人技术

🎓

数字人形象训练

上传视频经质检后训练专属形象,处理阶段、真实进度与已用时清晰可见

👄

神经口型同步

本地神经口型引擎按音频连续驱动嘴型,实现自然同步

📺

数字人直播驱动

实时驱动数字人长时间轮播,声音连续、句间自然闭口,支持快速停播重开

🎞️

本地对口型

上传人物视频,用音频或 69 种语言与方言文案生成新口型 MP4

📝 AI 内容创作

📄

话术生成

按主题分批扩写,可一次生成多种语言;支持品牌术语保留和同义词变量,内容达标并保存成功后才提示完成

💬

Agent 助手

工作模式可直接识别聊天中上传的图片并生成图片、视频、音乐、语音,结果以缩略图回到原会话

🚀

多平台发布

抖音 / 快手 / 小红书 / B站 一键自动发布,视频号 / 百家号 / TikTok 半自动,覆盖 7 平台

🎵 AI音乐生成 🎭 短剧视频分镜 👥 角色定妆 🎬 逐镜出片 🎮 虚拟主播 📱 竖屏视频优化 🌈 滤镜特效 ⚡ GPU加速 ☁️ 云端处理 🔐 隐私保护 📦 批量处理 🌐 8 语言界面 持续更新中...

准备好释放 AI 创作力了吗?

50+ 项实用能力 · 内容、图像、视频、直播与语音一套完成

版本 3.2.5
大小 解压后约 24 GB
系统 Win 10 64位及以上

💡 模型按需下载:首次使用某功能时才拉取对应模型,请确保网络畅通 | 推荐显卡:RTX 3060+

让每个人都能驾驭 AI

多财多亿AI 团队专注将前沿多模态智能转化为可规模化落地的创作基础设施。我们以自研算法与工程化管线为核心,在视觉合成、语音智能、实时互动与云端推理等方向持续投入,构建统一技术底座,并完成端到端的性能调优与体验打磨。

从数字人直播到旗舰级视频生成,从音色复刻到图像创作,多财多亿AI 为内容与运营团队提供全链路、可信赖的一站式智能创作平台。

🎯 简单易用 ⚡ 持续更新 🛡️ 安全可靠 💻 本地运行 🔒 隐私保护

多财多亿AI

全链路智能创作平台

本地 AI 推理 GPU 加速 音视频处理 多媒体编解码