重庆AI直播教学系统 AI直招标公告(重庆三峡职业学院2025)
AI直播教学系统采购市场调研公告
一、项目概况
1. 采购项目名称:AI直播教学系统采购项目
2. 规格、性能、数量:见附件
二、服务要求
1. 企业资质要求:具有独立企业法人机构;
2. 须有国家相关部门颁发的经营许可证书;
三、时间及方式
截止时间:2025年7月17日17:00点前将加盖公章的报价单发至邮箱916934764@qq.com,邮箱主题格式:AI直播教学系统采购(报价方名称)。
联系人:张老师
联系电话:13330266525
附件:AI直播教学平台.xlsx
AI直播教学系统采购需求表
序号
类别
品名
配置参数简介
数量
单位
1
WEB平台
AI直播教学系统应用前端私有化部署(网页形式)
AI直播教学系统应用前端私有化:
数字人实训平台深度融合产业与教学需求,构建覆盖数字人全生命周期的教学实践环境。平台集成整合五大核心能力—数字人定制、数字人播报、数字人直播、多模态交互、虚拟IP形象建设。关键功能包括智能内容生成、实时语音识别、自动字幕生成、情绪分析、互动问答、个性化推荐、虚拟形象、智能场景切换、实时内容审核、观众行为分析、自动录制编辑、多平台同步、智能故障检测、用户界面定制、数据安全与隐私保护,以及技术支持服务等。
平台集成功能模块:
1.数字人定制训练:高级形象训练:支持提供Mp4视频,分辨率不低于1080P,支持4K,帧率不低于25帧/秒,复刻的数字人可用于播报、交互、直播。
普通形象训练:支持提供Mp4视频,分辨率不低于1080P,支持4K,帧率不低于25帧/秒,可用于播报&交互。
数字人形象自然度平均MOS值>4.6分
需能够保证在交互对话中整体使用的视觉观感良好,要求数字人视频FPS不低于25帧/秒
声音训练:支持提供mp3音频文件,支持在10分钟内完成声音复刻
语音合成MOS值≥4.6分
语音合成准确率≥99.9%
形象库:有丰富的形象库(≥100个公共形象)
音色库:有丰富的音色库,支持多语种能力
2.数字人播报模块:可以通过文案、录音方式驱动视频生产,支持多语种、一键导入PPT、PDF等功能进行视频制作。
视频导出规格:支持导出1080P及4K分辨率视频,支持MP4格式。
文案改写:输入短视频链接获取热门脚本进行改写。
智能成片:选择形象输入文本后自动生成视频,支持二次编辑。
3.数字人交互模块:
交互场景使用时,可添加和使用背景元素,支持图片或视频作为背景元素,可直接使用平台中自带背景元素,也支持用户自行上传,格式支持不少于jpg、jpeg、png、webp、gif、mov、mp4,选定的背景元素支持进行模糊、透明度的设置和调整,针对视频元素需支持是否循环播放及背景视频音量的设置,可将设置效果应用至全局
交互场景使用时,可添加和使用文本元素,可拖拽拖整文本位置和大小,可旋转文本任意角度,可设置文本内容的字体、字号、字距、颜色、以及加粗、倾斜、下划线样式,可将设置效果应用至全局
4、数字人直播模块:
支持模版创建、素材上传导入支持本地素材导入、视频比例设置添加/删除素材、文本添加、文本调整、互动脚本录入、从形象库选择调用数字人形象、支持从音频库选择调用数字人音频、支持配置讲解的频率,配置循环的次数、支持调整声音设置、支持操作过程中自动保存、手动保存、支持直播间创建,数字人直播内容推流,或第三方obs等工具推流影像内容到直播间、支持编辑添加答题库内容,根据识别文字推送回答;或支持大模型识别内容做直播间互动、平台根据产品迭代实时更新。
5、虚拟IP制作模块:
采取AIGC内容生成全新链路,通过AI文生图、图生视频全新链路制作虚拟IP
形象平面设计模块:
对接文生图能力,实现概念到平面视觉的转化。支持导入概念设计成果,提供多模式创作与精细化编辑功能,具体包含:
1输入支持:支持中 / 英文文本描述,中文提示词可自动翻译;提供关键词推荐库,支持点选内置关键词辅助创作;支持拖拽或点击上传参考图片(格式为 jpg/png),可直接引用图片生成参数进行二次创作。
2创作模式:支持自由创作与模板创作两种模式。自由创作下用户可灵活调整各项参数;模板创作提供多种风格预设模板,用户可快速生成符合需求的平面设计稿,降低创作门槛。
3尺寸与版本配置:支持选择 1:1、1:2、4:3、9:16、3:4、16:9、3:2、2:3 等多种尺寸;提供多版本模型选择,满足不同风格创作需求。
4.输出数字人平面素材作为视频设计基础,推进数字人视觉呈现阶段 。
5.通过私有化部署解决后续算力租用消耗问题。
6、组织管理系统:
1. 权限分组功能
1.1 角色权限隔离:支持为不同角色(如学生、教师、管理员)分配专属数字人形象,确保各角色仅能使用权限范围内的数字人资源
1.2 超管集中管控:超级管理员可管理所有子账号权限,包括创建/删除账号、批量分配数字人资源及操作审计
2. 运营看板功能
2.1 视频生产监测:支持按整体/组织/个人维度统计自定义时间段内的视频生产数量
2.2 直播数据分析:可查看整体/组织/个人账号的直播场次、时长、互动量等核心指标
2.3 资源消耗监控:实时显示播报时长、存储空间等资源使用数据,余量不足时自动预警
7、服务期限:
1、前端应用界面为一次性部署到本地服务器。
2、数字人播报、交互、直播模块训练推理部分为公有云服务。
3、虚拟IP制作为一次性部署到本地服务器,无后续租赁云服务费用。
4、整体软件质保为3年,后续每年运维服务费为软件部分的5%。
1
套
数字人定制训练模块
1. 数字人定制
1.1 高级形象训练:支持提供Mp4视频,分辨率不低于1080P,支持4K,帧率不低于25帧/秒,复刻的数字人可用于播报、交互、直播。
普通形象训练:支持提供Mp4视频,分辨率不低于1080P,支持4K,帧率不低于25帧/秒,可用于播报&交互。
数字人形象自然度平均MOS值>4.6分
需能够保证在交互对话中整体使用的视觉观感良好,要求数字人视频FPS不低于25帧/秒
1.2 声音训练:支持提供mp3音频文件,支持在10分钟内完成声音复刻
语音合成MOS值≥4.6分
语音合成准确率≥99.9%
1.3 形象库:有丰富的形象库(≥100个公共形象)
1.4 音色库:有丰富的音色库,支持多语种能力
2.数字人训练:
2.1保证数字人形象采集、训练流程可以在学校内部完成。
2.2保证数字人声音采集、训练流程可以在学校内部完成。
2.3配备相应数字人训练运营后台,支持上传采集素材、自动训练等。
1
套
2
数字人播报模块
数字人播报
账号登录:
账号数量:50个(可同时登录)
并发量:满足50人同时制作视频
2.1 数字分身自定义:用户在进行视频内容生产过程中,选择好数字分身后可灵活调整数字分身形象大小和位置,制作过程中允许替换数字分身及数字分身的音色及对应语速、音调及音量信息
数字分身支持多动作可以选择,每一个场景可以使用不同的动作。
3. 内容元素自定义
3.1 背景元素:播报视频生产时可添加图片/视频背景,支持平台自带或用户上传,支持模糊度/透明度调整;视频背景需支持循环播放及音量设置,效果可应用至全局
3.2 文本元素:支持拖拽调整,可设置字体样式,支持动画设置,效果可应用至全局
3.3 贴纸元素:支持平台自带或用户上传,支持拖拽调整,支持动画设置,支持对贴纸元素图层的调整,效果可应用至全局
3.4 视频元素:支持平台自带或用户上传,可预览播放/调整位置尺寸/旋转角度,支持动画设置,效果可应用至全局
3.5 音乐元素:支持平台自带或用户上传,可设置播放模式,调节声音大小及音乐的播放方式如单曲播放或循环播放等效果可应用至全局
3.6 字幕元素:支持设置字体样式,提供预设样式,效果可应用至全局
3.7 视频比例:支持调整输出尺寸
4. 编辑模式
4.1 多轨道编辑:支持多种元素分轨道处理
4.2 轨道操作:支持裁剪分割
4.3 轨道显隐:支持显示/隐藏该轨道
4.4 实时预览:拖动时间指针实时预览,停止后点击预览按钮可从此处开始快速预览
4.5 图层管理:通过调整轨道上下关系改变元素叠加顺序
4.6 时间轴控制:支持控制播放/暂停
5. 多场景设置
5.1 场景组合:支持单视频任务添加多场景,按场景顺序组合播报
5.2 转场动画:提供≥8种转场效果,支持设置动画时长
6. 文件导入生成
6.1 文件支持:支持导入PDF/PPT文件快速生成视频
6.2 PPT特性:保留原PPT动画效果,可将备注内容直接转为视频文本
7. 播报内容输入和标注
7.1 输入方式:支持语音输入及文本输入
7.2 文本标注:支持多音字/数字读法/替换发音/断句/停顿标注
8. 模板管理
8.1 内置模板:具备预制模板
8.2 自定义模板:支持用户将编辑内容保存为模板
9. 内容编辑模式
9.1 通用模式:支持文本编辑式视频编辑
9.2 专业模式:支持多轨道精准编辑
10. 效果预览与生成
10.1 预览功能:支持文本试听/单场景预览/整体视频预览
10.2 导出规格:支持导出1080P及4K分辨率视频
11. 视频文件管理
11.1 导出格式:支持MP4格式导出
11.2 文件管理:支持分类/文件夹管理,可批量移动/下载/删除
11.3 视频草稿再编辑:点击草稿状态任务,可进入编辑修改界面
12. AI视频工具
12.1 文案改写:输入短视频链接获取热门脚本进行改写
12.2 智能成片:选择形象输入文本后自动生成视频,支持二次编辑
1
套
3
数字人交互模块
数字人交互管理
1.1 交互元素自定义
交互场景使用时,可添加和使用背景元素,支持图片或视频作为背景元素,可直接使用平台中自带背景元素,也支持用户自行上传,格式支持不少于jpg、jpeg、png、webp、gif、mov、mp4,选定的背景元素支持进行模糊、透明度的设置和调整,针对视频元素需支持是否循环播放及背景视频音量的设置,可将设置效果应用至全局
交互场景使用时,可添加和使用文本元素,可拖拽拖整文本位置和大小,可旋转文本任意角度,可设置文本内容的字体、字号、字距、颜色、以及加粗、倾斜、下划线样式,可将设置效果应用至全局
1.1.1 背景元素:交互场景使用时,可添加图片/视频背景,支持平台自带或用户上传,支持模糊度/透明度调整;视频背景需支持循环播放及音量设置,效果可应用至全局
1.1.2 文本元素:支持拖拽调整位置/大小/旋转角度,可设置字体/字号/字距/颜色/加粗/倾斜/下划线样式,效果可应用至全局
1.1.3 贴纸元素:支持平台自带或用户上传,可拖拽调整等操作,效果可应用至全局
1.1.4 视频元素:支持平台自带或用户上传,可预览、拖拽调整,效果可应用至全局
1.1.5 音乐元素:支持平台自带或用户上传,可试听/调整音量/设置循环播放,效果可应用至全局
1.2 角色设定
可针对交互数字人的人设进行基础信息的设定,如人物性格,人物职位,日常工作任务,应处理哪些核心业务等。
可通过提示词自动生成人设基本信息
1.3交互驱动方式
针对数字人交互对话,可支持多种方式进行驱动,例如:文本驱动、问答驱动、音频驱动等。
1.4 交互大脑配置
1.4.1 FAQ知识库:支持问答对FAQ式的知识库配置,快速完成数字分身大脑配置
支持常见问题设置及兜底话术设置
1.4.2 大模型角色对话:提供大模型能力,支持启动/关闭大模型能力进行问答对话回答
1.4.3 文档问答:上传PDF/Word文件构建知识库,支持文档解析问答
1.5 可视化配置UI
需提供可视化页面,可以便捷的进行交互UI配置,查询和管理形象、音色资源,不同对话场景可配置使用不同数字人形象、音色。其交互对话能力可由交互模块进行逻辑对话、知识库的配置。
1
套
4
数字人直播功能
1. 模版创建
支持用户创建数字人视烦模板,点击模板支持进入模板编辑器进行制作
2. 素材上传导入
支持本地素材导入
3. 视频比例设置
支持设置视频比例
4. 添加/删除素材
支持添加/删除数字人素材片段
5. 文本添加
支持添加数字人讲解内容脚本
6. 文本调整
支持文本调整,添加停顿、多音字注音、试听
7.互动脚本
支持互动脚本录入
8. 数字人形象库
支持从形象库选择调用数字人形象、支持调整
9. 数字人音频库
支持从音频库选择调用数字人音频
10.讲解频率
支持配置讲解的频率,配置循环的次数
11. 音频设置
支持调整声音设置
12. 保存
支持操作过程中自动保存、手动保存
13. 直播推流
支持直播间创建,数字人直播内容推流,或第三方obs等工具推流影像内容到直播间
14. 直播间互动
支持编辑添加答题库内容,根据识别文字推送回答;或支持大模型识别内容做直播间互动
平台根据产品迭代实时更新。
1
套
5
虚拟IP制作能力私有化部署
基于 AI 文生图与图生视频的全新技术链路,构建从虚拟 IP 概念到平面视觉的全流程转化系统
形象平面设计模块:
1. 接入stable diffusion 模型、flux模型等开源模型,实现虚拟IP形象的平面设计
2. 输入支持:支持中/英文文本描述,中文提示词可自动翻译为英文
3. 提供关键词推荐库,支持点选内置关键词辅助创作
4. 支持拖拽或点击上传参考图片(格式为 jpg/png),并支持反推图片提示词,进行二次创作
5. 创作模式:支持自由创作与模板创作两种模式。自由创作下用户可灵活调整各项参数,模板创作提供多种风格预设模板,用户可快速生成符合需求的平面设计稿,降低创作门槛。
6. 支持选择 1:1、1:2、4:3、9:16、3:4、16:9、3:2、2:3 等多种尺寸
7. 支持调用本地模型进行提示词优化
形象视频设计模块:
1. 接入开源模型,实现虚拟IP形象的视频设计
2. 输入支持:支持中/英文文本描述
3. 支持设置首尾帧图片
4. 支持设置视频时长(5s与10s)
5. 支持设置视频帧数(24帧与30帧)
6. 支持设置视频比例以及分辨率
7. 支持调用本地模型进行提示词优化
5.通过私有化部署解决后续算力租用消耗问题。
1
套
6
数字人资产
数字人播报套餐
1.单个套餐权益
1.1播报时长:不低于700分钟(支持制作短视频和课件视频)
1.2普通形象定制权益无限次(形象克隆无限制,校方可自动完成克隆定制),形象高清度为1080P、4K(支持学生无限克隆形象用于实训)用于播报、交互场景使用。
1.3公共模特:支持50+公共模特免费使用
1.4使用期限:单个套餐开启后使用期限为1年(可选择单个或批量开通套餐)
1.5所有套餐权益一次性配置到校方管理后台,校方可根据实际情况自行开通套餐
100
套
数字人直播不限时套餐
1、不限时版(可以用于各大主流直播平台)
1.1直播时长:一年内不限时,支持同时创建10个直播间,同时发布一个直播间。
1.2平台精品主播使用权:所有会员专享主播
1.3平台精品声音使用权:所有会员专享声音
1.4所有套餐权益一次性配置到校方管理后台,校方可根据实际情况自行开通套餐
30
套
7
私有化部署所需硬件
教学系统前端部署应用服务器
CPU:处理器核心数不小于16核,需支持主流虚拟化技术,具备良好的多线程处理能力,能够满足多任务并发运行需求,确保系统在高负载情况下的稳定性能。
内存:内存容量不小于64GB,类型需为DDR4及以上规格,支持ECC错误校验功能,以提升数据处理的准确性和系统运行的稳定性,满足大规模数据运算及多应用同时运行的内存需求。
系统盘:系统盘存储容量不小于100GB,需采用SSD固态硬盘,具备较高的读写速度(连续读取速度不低于500MB/s,连续写入速度不低于300MB/s),以保障操作系统及关键应用的快速启动和高效运行。
数据盘:数据盘存储容量不小于500GB,可采用SSD或高性能HDD硬盘,若为HDD需支持7200转及以上转速,具备稳定的读写性能和数据存储可靠性,满足大量业务数据的存储与访问需求。
3
台
8
私有化部署所需硬件
虚拟IP制作能力私有化部署算力一体机
1)外形:2U 机架式服务器
2)处理器:配置2颗Intel Xeon 4310 2.1GHz 12C/24T
3)内存:配置256GB DDR4 RDIMM内存
4)存储控制器:支持Raid0,1
5)硬盘:配置2块1200GB SAS 10K
6)网络:2个10Gb SFP+端口(含对应模块)+2个千兆;
7)电源&导轨:1+1 2400W冗余电源;滑动导轨
8)配置4块Nvidia 4090D 24GB缓存 GPU卡
9)服务:3年维保服务
1
套
9
私有化部署所需硬件
虚拟IP制作能力私有化部署应用服务器
1)外形:2U 机架式服务器
2)处理器:配置1颗Intel Xeon 4310 2.1GHz 12C
3)内存:配置128GB DDR4 RDIMM内存
4)存储控制器:支持Raid0,1,5,6 2GB缓存
5)硬盘:配置2块1200GB SAS 10K,7块8TB SATA企业级硬盘,可用容量40T;
6)网络:2个10Gb SFP+端口(含对应模块)+2个千兆;
7)电源&导轨:1+1 800W冗余电源;滑动导轨
8)服务:3年维保服务
1
台
10
硬件
电脑
一、直播剪辑电脑
1.处理器 Intel i5-12490F ,12代架构多核性能出色
2.显卡 GTX 1660 Super 6G 显存满足1080P多轨道剪辑,CUDA/Turing编码器双重加速
3.内存 32GB DDR4 3200 (16x2) 双通道大容量避免多轨道卡顿
4.固态硬盘 1TB 独立缓存设计,稳定读写
5.电源 500W白牌 预留显卡升级空间
6.显示器:27寸液晶显示器,刷新率120Hz,分辨率1920*1080,满足高清视频任务处理
备注:根据市场情况提供≥该参数的电脑
售后服务:提供3年硬件免费质保
100
台
11
硬件
电脑
二、AI多任务电脑
1.处理器 Intel i7-14700KF,高频+多核兼顾单任务与并行计算
2.显卡 RTX 4090 24G,24GB显存支撑大模型训练
3.内存 64GB DDR5 6400 (32G×2) , 高频低延迟
4.固态硬盘 2TB,独立缓存设计,稳定读写
5.电源 1000W, 3.0认证,原生16Pin供电,
6.散热器 一体水冷,压制i7-14700KF全核负载
7.显示器:27寸液晶显示器,刷新率120Hz,分辨率1920*1080,满足高清视频任务处理
备注:根据市场情况提供≥该参数的电脑
售后服务:提供3年硬件免费质保
10
台
12
办公设备
电脑桌
长度1.4米、宽度60厘米、高度75厘米(供2人位使用),配套办公椅。
50
套
总价
投标 / 标书制作要点(原创)
本AI直播教学系统 AI直涉及「招标公告」,投标方需重点关注:① 营业执照经营范围须含招标公告或对应服务类目;② 提供同类项目业绩证明;③ 报价方案与售后响应须明确;④ 紧盯投标截止与开标节点,建议提前完成标书制作与盖章。重庆项目常要求本地化服务能力与快速响应,务必在投标文件中凸显。
标书制作联系冯经理:17551026086
