No description
Find a file
2026-08-30 00:28:12 +08:00
.forgejo/workflows Initialize track repository 2026-08-12 15:45:16 +08:00
demo 提交作品:慧多客智能体 — AI数字人口播短视频获客平台(AI直播获客子赛道) 2026-08-30 00:28:12 +08:00
screenshots 提交作品:慧多客智能体 — AI数字人口播短视频获客平台(AI直播获客子赛道) 2026-08-30 00:28:12 +08:00
CONTRIBUTING.md Initialize track repository 2026-08-12 15:45:16 +08:00
README.md 提交作品:慧多客智能体 — AI数字人口播短视频获客平台(AI直播获客子赛道) 2026-08-30 00:28:12 +08:00
submissions.json Initialize track repository 2026-08-12 15:45:16 +08:00
SUBMISSIONS.md Initialize track repository 2026-08-12 15:45:16 +08:00

慧多客智能体 — AI 数字人口播短视频获客平台

本项目为「滴水湖全球 OPC 人工智能挑战赛 · 雪窦山 AIGC 品牌出海赛道 · 第三轮 Wave 3(Agents 完整智能体)」参赛作品。 子赛道:AI 直播获客(track-147)


一、Agent 入口说明

慧多客智能体是一个面向电商与品牌出海商家的 AI 数字人口播短视频获客平台,提供从「选题 → 文案 → 配音 → 数字人合成 → 智能剪辑 → 标题封面 → 发布」的端到端自动化获客能力。

  • 用户端:https://agent.huiduoke.cn/(商家自助使用,手机号验证码登录)

平台已部署上线、可直接访问体验。


二、核心能力 / 输入输出 / 调用方式

核心能力(端到端自动化链路)

环节 能力 说明
行业搜索 爆款选题发现 输入行业/产品关键词,自动聚合平台热点与爆款选题
文案生成 5 种口播写法 解题型 / 推荐型 / 揭秘型 / 案例型 / 疑问型,由大模型驱动生成
智能配音 音色克隆 + 情绪表达 10–15 秒样本即可克隆音色,支持 11 种情绪 + 语速调节
数字人合成 照片数字人 + 视频数字人 免训练形象、口型驱动,支持单镜头 / 双镜头
智能剪辑 自动化成片 达芬奇调色 / 网感大字 / MG 动画 / 画中画,全自动合成
标题封面 AI 生成 自动生成适配平台的标题与封面图
发布 自动分发 成片后一键发布至目标平台

输入 → 输出

  • 输入:行业/产品关键词、参考素材(图文/链接)、一段 10–15 秒真人音色样本、目标平台与风格偏好
  • 输出:可直接发布的数字人口播短视频(含口播文案、配音、数字人画面、剪辑、标题、封面)

调用方式

通过 Web 平台交互式调用,面向非技术型商家,全程无需代码。平台内部以 Agent 编排串联大模型文案生成、语音合成、数字人驱动与视频合成模块。


三、可运行代码 / 配置 / 提示词 / 工作流

说明:本项目为已上线部署的商业产品,源代码与内部模型部署属于团队核心资产,本仓库仅提供 Demo 与可复核的演示证据,不开放源码。

  • 可公开验证:平台线上入口(见上文)可直接访问体验完整链路
  • 技术栈(公开信息):大模型文案生成、语音克隆、照片数字人(对接第三方 API)、视频数字人(自部署大模型)、智能视频剪辑、AI 标题封面生成
  • 工作流:上述「行业搜索 → 文案 → 配音 → 数字人 → 剪辑 → 标题封面 → 发布」即平台固化的 Agent 工作流,已在产品中闭环运行

四、使用示例 / 运行截图 / Demo 链接

演示视频(核心 Demo)

  • demo/huiduoke-liveagent-demo.mp4:数字人口播成片视频(约 20 秒)。真实展示「文案 → 配音 → 数字人合成」的端到端效果:真人形象出镜口播、口型驱动、配音自然,商家无需真人出镜即可批量生产口播短视频。

核心链路截图(screenshots/ 目录)

  1. 01-dubbing.png — 智能配音页(音色克隆 + 11 种情绪 + 语速调节,实时预览时长)
  2. 02-copywriting.png — 文案生成页(AI 生成口播文案,多写法可选)
  3. 03-avatar.png — 数字人形象页(照片/视频数字人、口型驱动、剪辑气口/美颜)

在线体验

  • 用户端:https://agent.huiduoke.cn/(手机验证码登录)

五、与前两轮提交相比的关键更新

本项目为 首次参加 Wave 3,直接以「完整智能体(Agent)」形态交付,无前两轮提交对比。

相较于传统短视频获客方式,本作品的核心更新在于:

  1. 全链路 Agent 化:将「选题、文案、配音、数字人、剪辑、封面、发布」七环节整合为单一智能体闭环,商家无需多工具切换
  2. 数字人免训练 + 口型驱动:降低商家出镜门槛,解决「不愿露脸 / 不会拍口播」的核心痛点
  3. 音色克隆低成本复用:10–15 秒样本即可生成专属音色资产,可持续复用
  4. 面向品牌出海:支持多语种文案与配音,为跨境商家批量生产本地化口播内容

附:评分维度自查

维度 权重 本项目对应
创新性与技术含量 30% 数字人免训练口型驱动 + 全链路 Agent 编排 + 音色克隆
AI+OPC 模式可行性 30% 已上线部署可访问,端到端闭环跑通
市场潜力与社会价值 30% 电商/跨境商家降本增效,降低内容创作门槛
落地海外市场可行性 10% 多语种文案与配音,面向品牌出海场景设计