OmniTalker
OmniTalker 是一个实时文本驱动的生成谈话头框架。
中文精选视频视频生成人机交互
OmniTalker 是由阿里巴巴 Tongyi 实验室提出的一种统一框架,旨在实时生成音频和视频,提升人机交互体验。其创新之处在于解决了传统文本到语音及语音驱动的视频生成方法中常见的音视频不同步、风格不一致及系统复杂性等问题。OmniTalker 采用双分支扩散变换器架构,能够在保持高效的同时实现高保真的音视频输出。其实时推理速度可达每秒 25 帧,适用于各种交互式视频聊天应用,提升了用户体验。
OmniTalker 最新流量情况
月总访问量
暂无数据
跳出率
暂无数据
平均页面访问数
暂无数据
平均访问时长
暂无数据
OmniTalker 访问量趋势
暂无访问量数据
OmniTalker 访问地理位置分布
暂无地理位置分布数据
OmniTalker 流量来源
暂无流量来源数据