上次我们发布了《数字人智能课程平台 1.0 正式上线》后,很多人反馈说没有达到想要的效果,之前1.0的想法是什么都想做,既要教师端生成课件,学生端可以实时听课提问,还要生成各种练习题,各种交互效果的课件,各种3D镜头的动效,花里胡哨,导致做的东西什么都不像了。然后我们团队最近花了大量时间去调研国内外相关平台,最终在之前基础上精简并整合了竞品中的优秀功能发布了微课神器2.0,我们把它称为“灵影AI”。
我们看到市面上类似的工具每一步都需要收费,Heygen的付费包括:除去水印、限制视频生成时长、背景抠图、语音克隆、不同的价格不同的分辨率、视频处理速度、数字人数量等。考虑到生成一个口播视频需要来回尝试,一趟下来,一个月300块人民币完全不够用。
再看看国内蝉镜的收费方式,同样也是定制数字人、去除水印、生成视频、PPT动画、声音克隆、视频生成速度、是否保留作品、API调用、API并发数、团队资产、数据分析、商用授权、专属模板等等每一项都需要消耗积分。
因此我们打算制作一款完全本地化的系统,整合我们的实时互动数字人系统。跟之前我们的实时互动数字人系统一样,这次我们仍然不打算开放给C端用户使用,继续给相关有需求的个人、学校或企业做本地化部署方案。这样就可以多次尝试,无限克隆数字人,无限克隆音色,无限生成视频了。
主要功能是用户上传PPT,然后选择数字人、音色、背景、素材,一分钟内合成带数字人讲解PPT的视频。
上传PPT的时候可以选择用PPT 自带的注解生成口播文案还是让AI来自动生成。
可以从公共库中选择需要的数字人,或者上传自己需要的形象自己训练数字人。在PPT预览区域支持拖拽和缩放来调整数字人的位置。
选中上传的PPT后,可以调整PPT的位置和大小,非常灵活。
这是本次升级的一大亮点。时间轴轨道包括:PPT、字幕、音频、数字人、素材、文本。每个轨道都可以随时增减,意味着每一页PPT都可以控制这些元素是否在当前PPT页面显示,这个非常重要,因为在制作讲课视频的时候经常会插入视频素材,这个时候是不需要数字人进行播报的。
上述元素(PPT、字幕、音频、数字人、素材、文本)默认都是按全局设置位置和大小的,可以让它们脱离全局,每一页单独设置不同的样式,这也是在很多课件视频中经常看到的。
我们从口播文案中自动根据时间轴来提取字幕,并调整字幕的样式。
10. 音色支持默认免费的EdgeTTS和开源的VoxCPM,其它TTS也可以随时接入
https://github.com/nyblnet/bento2.让PPT拥有更多动效,上传的PPT页支持添加动效
该微课神器主要面向教师或者想做数字人自媒体讲课的博主。我们的系统还支持给一些有开发能力的个人和团队做二次开发使用。
公众号后台私信咨询并做自我介绍。我们会有相应的报价表和获取方式分享给大家。
我们的微课神器会随着客户的需求不断升级,获得我们系统的客户可以免费升级更新。数量有限,先到先得。
做一只爬的最久的乌龟,保持学习保持好奇,即使慢一点,遇到一点困难,只要最后能到达终点,又有什么关系呢。