SHINEDAP DIGITAL HUMAN · V2.3

在一台电脑上,完成音色设计、配音和真人数字人视频。

从零设计新音色、克隆已有声音、生成带情感的长文配音,再把新声音同步到真人视频。一套本地工作台贯通主要流程,授权期内不按生成条数扣积分。

模型本机运行24 小时免卡试用音色可入库复用
闪搭数字人真人内容生产功能示意
先用自己的素材验证效果每台电脑可免卡试用 24 小时。首次先安装完整运行环境,再安装主程序并按任务下载模型。
用户价值

把一次创作,变成可以反复调用的内容资产。

它不只是做一个数字人头像,而是把“音色、文案、字幕、真人视频”连成一个可持续复用的本地工作流。

01

不需要参考音频,也能设计新音色

输入基础音色、年龄、性格和表达方式,由 Qwen3-TTS 闪搭全能版生成声音,并可一键入库长期复用

02

已有声音,克隆后持续生成新配音

用清晰参考音频建立固定声音,支持长文分段、批量合成和高级参数,适合品牌账号、角色旁白与矩阵号

03

一段人物素材,承载不同脚本

把新配音同步到真人视频,减少重复出镜,适合知识讲解、产品介绍与真人口播

04

旧录音与视频,快速回收成文字

本地识别音视频中的语音,用于字幕、脚本整理、内容检索和二次配音,减少人工听写。

效果示意

同一个真人形象,跟随新文案自然说话。

口型模型只负责把声音与唇形对齐;人物身份、画面质感和最终自然度,还取决于源视频清晰度、面部角度、音频质量与模型选择。

同一真人数字人不同说话口型功能示意

从文案到成片,四步连起来

不需要在多个命令行工具之间来回切换。运营人员按顺序准备素材,即可完成一条可发布的真人数字人口播。

01输入文案或导入现有录音
02选择声音或克隆目标音色
03选择真人视频与口型模型
04本地生成并导出成片

图片为原创虚拟演示形象,用于解释功能,不代表特定客户案例。实际成片效果请使用自己的素材在 24 小时试用期内验证。

V2.3 核心能力

从造声、配音到真人成片,在一套工具里完成。

软件把模型选择、语音指令、高级参数、素材与结果整理到统一界面,同时保留不同模型各自擅长的能力。

从零音色设计

通过年龄、性格、音色质感与表达方式设计新声音,无需先准备参考音频。

声音克隆

用参考音频复用固定音色,让不同文案保持稳定的声音身份。

语音合成

使用内置音色或入库音色生成配音,支持语速、语言与模型高级参数。

情感与风格控制

使用语音指令或 IndexTTS2.5 强化情绪、角色状态和表达风格。

长文与批量任务

按长度自动分段,设置段间停顿并批量生成,适合连续口播与长篇旁白。

语音识别

把录音和视频声音转成文字,服务字幕、脚本和内容二次加工。

真人口型同步

让新配音与真人唇形同步,并按生成速度或近景自然度选择模型。

本地模型管理

集中配置模型目录、查看运行状态和任务日志,模型可按需下载安装。

模型选择

先按任务选模型,不必一次装完。

第一次只下载当前任务需要的模型。以后增加情感配音、语音识别或高质量口型需求时,再继续扩展。

我要从零设计新声音

Qwen3-TTS 闪搭全能版

支持 VoiceDesign、内置音色、声音克隆和入库音色复用,旧版 Qwen 模型不再需要。

我要更强的情感表达

IndexTTS2.5

适合剧情对白、情绪旁白和需要更明显角色状态的语音内容。

我要做真人数字人口型

先 MuseTalk,再 LatentSync

MuseTalk 兼顾速度与效果;近景自然度优先时再测试 LatentSync。

高情感表达

IndexTTS2.5

强调情绪控制与表达层次,可用于更有表演感的对白和旁白。

适合:剧情、角色与情绪内容
语音转写

FunASR

把音频或视频中的语音快速转换为可编辑文字。

适合:字幕、纪要和脚本回收
近景质量

LatentSync 1.5

更重视唇形、牙齿和连续帧自然度,生成相对更慢。

适合:近景与最终成片
下载中心

先装主程序和运行环境,再选需要的模型。

主程序、完整运行环境与模型分开提供,软件升级不再重复搬运数 GB 的 Python 依赖;模型仍可按任务单独下载。

第一步:下载闪搭数字人主程序

Windows · V2.3 主程序安装文件夹

闪搭数字人 Windows 主程序安装文件夹 V2.3

约 152 MB · Windows 10/11 64 位
V2.3 主程序只安装软件、FFmpeg、FFprobe 和模型兼容适配器,不含 Python 环境和模型权重。首次使用请继续安装五模型完整运行环境 V1.0。
提取码:1369
下载主程序

第二步:安装五模型完整运行环境

首次安装一次 · 后续软件升级可复用

闪搭数字人五模型完整运行环境 V1.0

下载约 7.11 GB,安装后约 22 GB · Windows 10/11 64 位 · 建议预留 25 GB
为 Qwen3-TTS、IndexTTS2.5、FunASR、MuseTalk 1.5、LatentSync 1.5 提供完整本地环境。首次安装一次,后续升级主程序可直接复用。
提取码:1369
下载运行环境
首次安装请注意:这是完整环境包,不做依赖裁剪。安装一次后,V2.3 及后续主程序可直接复用。

第三步:按用途下载模型

每个模型一个完整压缩包

Qwen3-TTS 闪搭全能版 v1.1.0

11.90 GB · 音色设计 · 语音合成 · 声音克隆
包含旧版 Qwen3-TTS 的语音合成与声音克隆能力,并新增 VoiceDesign 从零音色设计、一键入库、入库音色复用、语音指令和长文分段。使用前请删除旧“闪搭调优版”配置。
提取码:1369
下载此模型

IndexTTS2.5 闪搭调优版 2.5

10.35 GB · 高情感语音 · 角色表达 · 声音克隆
强调情绪控制、表达层次与角色状态,适合剧情对白、情绪旁白和需要更明显表演感的语音内容。
提取码:1369
下载此模型

MuseTalk 1.5 闪搭调优版 1.5

3.52 GB · 数字人口型 · 推荐优先下载
适合大多数真人数字人口播,速度与自然度较均衡,建议首次制作先用此模型。
提取码:1369
下载此模型

LatentSync 1.5 闪搭调优版 1.5

4.98 GB · 高精度口型 · 显存要求较高
适合更重视牙齿、嘴型和连续帧自然度的成片,生成速度通常慢于 MuseTalk。
提取码:1369
下载此模型

FunASR v1.1.0

4.65 GB · 语音识别 · 字幕转写
用于把音频或视频中的语音转换为文字,适合字幕生成、文稿整理和批量转写。
提取码:1369
下载此模型
安装与升级说明

先分清首次安装还是升级,再开始操作。

试用不需要卡密。新电脑首次安装要先安装“五模型完整运行环境 V1.0”,再安装 V2.3 主程序;从旧版本升级也需先安装一次新环境,现有五个模型权重无需重新下载。

01

下载两个安装文件夹

下载 V2.3 主程序和五模型完整运行环境 V1.0;环境包中的安装程序必须与 dependencies 文件夹保持同级。

02

先装完整运行环境

选择空间充足的磁盘安装;下载约 7.11GB,完整解压后约需 22GB。

03

安装 V2.3 主程序

双击“闪搭数字人-V2.3-安装包-x64.exe”;以后只升级主程序,不必重复安装环境。

04

下载所需模型

每个模型单独下载并完整解压,不要把多个模型文件混到同一目录。

05

添加并检查模型

在模型根目录选择 config.json 并刷新状态;绿灯表示可用,红灯时打开日志排查。

新电脑首次安装

  1. 下载完整运行环境 V1.0 和 V2.3 主程序两个安装文件夹。
  2. 先运行环境安装程序,再运行 V2.3 主程序安装包。
  3. 打开软件,联网领取一次 24 小时免卡试用。
  4. 下载一个任务需要的模型并完整解压。
  5. 进入“AI模型 → 本地模型”,在模型根目录中选择 config.json;刷新后确认绿灯。
  6. 先做 5—10 秒短任务,确认声音、显存与输出目录正常后再做长任务。

从 V2.2 或更早版本升级

  1. 退出闪搭数字人和所有模型服务,不用卸载旧版。
  2. 先安装一次“五模型完整运行环境 V1.0”,替换旧版内置或裁剪环境。
  3. 运行 V2.3 主程序安装包并覆盖安装;现有五个模型权重不用重新下载。
  4. 首次启动 MuseTalk 和 LatentSync 时,V2.3 会自动更新旧桥接文件。
  5. 刷新模型状态,并分别做一次语音合成、音色合成或数字人口型短测。
V2.3 必须配合新环境:完整运行环境 V1.0 只需安装一次;Qwen3-TTS 闪搭全能版、IndexTTS2.5、FunASR、MuseTalk 和 LatentSync 模型权重均可继续使用。
正式激活:购买后直接在软件中输入卡密,服务器会在首次激活时自动绑定当前电脑,不需要提前把机器码发给管理员。
重要:模型目录不要随意改名或移动;必须移动时,先在软件中删除旧配置,再重新选择新模型根目录中的 config.json。
常见问题

先把最容易出错的地方讲清楚。

更深的模型参数可在软件对应页面查看;首次使用先保留默认参数,短测通过后再逐项调整。

原来的 Qwen3-TTS 模型还要保留吗?

不需要。Qwen3-TTS 闪搭全能版包含原有语音合成与声音克隆能力,并增加 VoiceDesign 音色设计、一键入库和入库音色复用。确认新版显示绿灯并短测成功后,删除旧模型目录和旧配置以节省空间。

模型显示红灯怎么办?

先确认完整运行环境 V1.0 已安装,再确认模型压缩包已经完整解压且目录没有被移动或改名;然后在“AI模型”中重新选择模型根目录里的 config.json 并刷新。仍为红灯时打开模型卡片日志,重点检查 Python 路径、模型文件和显卡显存。

出现 No Python 或 Unknown model service error 怎么办?

重新取得并完整安装“五模型完整运行环境 V1.0”,确认环境安装程序与 dependencies 文件夹同级;再覆盖安装 V2.3 主程序,删除软件中的失效模型配置并重新选择实际模型根目录中的 config.json。

生成内容时必须一直联网吗?

模型主要在本机运行。领取试用、首次激活、定期授权复核和下载资源需要联网;正常授权提供有限离线容错。

为什么不把所有模型放进一个安装包?

不同用户只需要其中一部分功能。按任务单独下载模型,可以减少等待与无用磁盘占用,也便于后续单独替换模型。

第一次做数字人口型,应该下载哪个?

建议先用 MuseTalk 1.5 验证源视频和配音;如果是近景、对牙齿和连续帧要求更高,再对同一段素材测试 LatentSync 1.5。

24 小时试用需要卡密吗?

不需要。每台电脑可联网领取一次 24 小时试用。正式购买后再输入卡密激活。

哪些内容不要删除?

不要删除五模型完整运行环境、正在使用的模型权重和自己的音色库。清理旧模型前先确认新版模型可用,并保留自己生成的重要音频与视频结果。

先用自己的素材,验证真实效果。

下载主程序,领取 24 小时免费试用,再选择一个模型完成第一条声音或真人数字人内容。

下载并开始试用