官方产品 新品

源创AIGC口播智能体

面向个人 IP、知识博主与短视频运营团队的 Windows AIGC 口播视频工作台,整合 IP 内容学习、文案辅助、声音与数字人形象管理、口型驱动、字幕封面、素材处理及多平台发布,帮助团队把选题、创作、合成、审核和发布集中到一套流程。

源创AIGC口播智能体图标

PRODUCT INTRODUCTION

产品介绍

源创AIGC口播智能体是一套面向个人 IP、知识博主、企业讲解和短视频运营场景的 Windows 桌面工作台。它将选题与文案辅助、声音生成、数字人形象、视频合成、字幕封面、素材处理和发布入口组织在同一个操作流程中,适合需要持续生产真人或数字人口播内容的个人与团队。

当前产品截图来自“超级IP智能体V8”客户端界面,功能布局、模型名称和平台支持范围可能随版本更新。软件用于提高内容制作效率,不能替代选题判断、事实核验、版权审核和平台运营。

从 IP 学习到口播视频的一体化工作台

首页按生产顺序组织 IP 深度学习、视频文案编辑、音视频生成、视频编辑、标题标签关键词、字幕与音乐、封面制作和视频发布。用户可以先选择目标内容或整理选题,再生成或编辑文案、选择音色与数字人形象,完成视频、字幕和封面后进入发布环节。

“一键自动模式”用于串联已配置好的步骤,适合流程稳定后的重复任务。首次使用或更换行业、账号和素材时,仍建议逐步检查每个环节,确认文案、声音、形象、字幕和发布账号无误后再启用自动流程。
AIGC口播视频一体化工作台界面截图
AIGC口播视频一体化工作台客户端将 IP 学习、文案、音色、数字人视频、标题关键词、字幕音乐、封面与发布入口集中在同一页面。
查看大图 ↗

IP 内容学习与爆款文案辅助

IP 学习区域用于整理对标对象、视频主题和标题选题,配合文本模型生成多个文案方向。系统源码显示当前流程支持从公开视频分享信息或本地视频中提取可用内容线索,并将标题或识别文本用于后续仿写与优化;这些能力应当用于分析内容结构和表达方式,不能直接搬运他人作品。

文案生成后可以继续编辑,并通过合规检查辅助发现绝对化表达、行业敏感词和潜在风险。任何自动生成或改写结果都需要人工核对事实、产品参数、案例、引用来源和广告用语。

管理数字人形象与授权素材

形象管理支持添加和维护多个数字人视频形象。上传页面会提示正脸、嘴部清晰、画面无遮挡、单一人物和合适时长等采集要求,良好的源视频有助于后续口型驱动与画面稳定。实际格式、分辨率、时长和文件大小限制以当前客户端提示为准。
数字人形象添加与管理界面截图
数字人形象添加与管理上传符合正脸、口型和画面要求的视频素材,建立可用于口播合成的数字人形象。
查看大图 ↗
请只使用本人形象,或已经取得明确书面授权的人像与视频素材。不得克隆公众人物、冒用他人身份,或将数字人用于虚假代言、欺诈和其他可能误导用户的场景。

声音合成、语音识别与声音管理

声音工作台包含声音合成、语音识别、音色管理、单条生成和批量文本合成等入口。用户可以输入口播文案、选择已配置音色并试听结果,也可以上传音频或视频进行语音识别。可用语言、方言、情绪、语速和生成质量取决于所选声音模型及其服务状态。
AI声音合成与任务管理界面截图
AI声音合成与任务管理在声音工作台选择模型和音色,创建单条或批量语音任务,并查看试听、下载和任务状态。
查看大图 ↗
声音克隆必须获得声音权利人的授权,并应在发布内容中根据平台规则标注 AI 生成或合成信息。涉及医疗、金融、法律、新闻等专业内容时,不得用合成声音冒充专业人士或权威机构。

音频驱动数字人口型合成

数字人合成模块支持选择数字人模型和形象,再使用已生成的声音或本地音频,输入对应文本后创建视频任务。音频用于驱动数字人口型,历史任务区域会记录模型、形象、音频来源、处理状态和结果预览,方便团队检查与复用。
数字人口型驱动视频合成界面截图
数字人口型驱动视频合成组合数字人模型、形象、声音或本地音频和口播文本,创建并跟踪数字人视频合成任务。
查看大图 ↗
本地模型的处理速度会受到显卡、内存、磁盘空间和素材分辨率影响;云端模型则会受到网络、服务额度和第三方接口状态影响。正式批量制作前,建议先用短文案和低风险素材完成一次小规模验证。

本地素材库与视频音频提取

素材库用于管理画中画和字幕逐行切换所需的图片、视频等本地素材。上传后的资源可以在视频编辑流程中继续选择,减少重复查找文件;使用固定、关键词或字幕匹配等模式时,应先检查素材与文案是否真实相关。
口播视频本地素材库界面截图
口播视频本地素材库集中上传和管理画中画、字幕切换与视频编辑所需的本地图片和视频素材。
查看大图 ↗
视频音频提取工具可以从本地视频文件中提取音轨,并设置输出音频格式、质量和采样率。提取结果可用于合法的素材整理、字幕识别或本人内容再编辑,不得绕过版权和访问限制处理无权使用的视频。
视频音频提取工具界面截图
视频音频提取工具选择本地视频并设置音频格式、质量和采样率,将音轨输出到指定文件夹。
查看大图 ↗

字幕、封面与视觉设计

主工作台支持自动生成字幕、智能字幕、字幕模板、背景音乐和封面设置。源码中还包含普通字幕、关键词特效字幕、时间轴、高亮样式、画中画和封面模板等配置入口,便于根据账号风格统一字体、颜色、描边、位置和视觉节奏。

视觉设计页面提供提示词、写实或插画等风格方向,以及 9:16、16:9、1:1、4:3 等常用尺寸入口,可作为口播封面与配图的辅助工作区。具体生成能力和可用模型以当前版本配置为准。
AIGC口播封面与视觉设计界面截图
AIGC口播封面与视觉设计通过提示词、视觉风格和画面比例准备口播视频封面或配图,适配不同内容发布尺寸。
查看大图 ↗

支持内置、本地与云端模型配置

模型设置提供内置模型入口,并允许添加自定义模型标识和显示名称。结合客户端源码,文本、声音识别、声音合成和数字人处理可按实际授权选择本地或在线服务;不同模型的安装方式、资源消耗、计费和数据处理规则并不相同。
AIGC本地与云端模型设置界面截图
AIGC本地与云端模型设置管理内置模型并按需要添加自定义模型,让文案、声音与数字人任务使用对应的模型服务。
查看大图 ↗
使用云端服务前,应确认数据上传范围、隐私政策、费用和可用地区;使用本地模型前,应检查硬件兼容性和模型文件来源。模型密钥属于敏感信息,不应出现在视频、截图或公开文档中。

推荐使用流程

1. 明确账号定位、目标受众、内容主题和可持续更新频率。
2. 导入本人或已获授权的 IP 资料,整理选题和标题方向。
3. 生成文案初稿,人工完成事实、合规和品牌表达审核。
4. 选择音色和数字人形象,先生成短样片检查口型与声音。
5. 添加字幕、音乐、画中画素材和封面,并检查版权来源。
6. 预览最终视频,确认画面、字幕、音量和联系方式准确。
7. 选择已授权的发布账号和时间,由人工确认后发布与复盘。

适用团队与运行环境

产品适合个人 IP、知识类创作者、企业产品讲解、本地生活商家、短视频运营团队和需要批量制作合规口播内容的服务团队。当前为 Windows 桌面应用,内置 FFmpeg 和本地处理组件;部分模型和在线能力需要联网、单独授权或消耗服务额度,实际可用功能以当前版本与账号权限为准。

使用与合规说明

请仅处理本人创作或已经取得合法授权的文案、声音、人像、视频、图片、音乐和字体。不得生成违法广告、虚假宣传、侵权搬运、深度伪造、冒用身份或误导性内容。发布前需要遵守《个人信息保护法》、肖像权与著作权相关规定,以及抖音、快手、视频号、小红书等目标平台的账号、AI 内容标识和社区规则。