视频

DiTCtrl

DiTCtrl是一种基于多模态扩散变换器架构的视频生成工具,能够利用多个文本提示生成连贯且高质量的视频内容,无需额外训练即可实现零样本多提示视频生成。它通过KV共享和潜在混合策略优化不同提示间的平滑过渡,同时在MPVBench基准上表现出色,适用于电影、游戏、广告及新闻等多个领域。

声动视界SoundView

一款面向带货短视频的AI视频工具,声动视界SoundView提供视频翻译、文本转语音和视频配音等功能。

Symphony Creative Studio

Symphony Creative Studio是一款由TikTok开发的AI视频创作工具,专注于简化广告主和内容创作者的视频制作流程。它具备视频生成、转换、扩展以及虚拟人物创作等功能,支持多语言翻译与配音,并可基于品牌IP定制虚拟形象。通过整合多种智能技术,该工具显著提升了内容创作效率与质量。

宣小二

宣小二是一款基于人工智能技术的媒体发稿平台,主要功能涵盖新闻发稿、自媒体发稿、短视频矩阵发布等。它还提供舆情监控、AI写作服务、数据分析系统及自媒体账号管理工具,帮助企业优化营销策略,提升品牌影响力,同时支持多平台协同推广。

MoCha

MoCha 是一款由 Meta 与滑铁卢大学联合开发的端到端对话角色视频生成模型,支持语音与文本驱动的角色动画生成,具备全身动作模拟与多角色对话交互能力。其核心技术包括扩散变压器架构和语音-视频窗口注意力机制,确保动画与语音精准同步。适用于虚拟主播、影视动画、教育内容及数字人客服等多个领域,提升了内容创作效率与表现力。

123goo文案网

一站式自媒体影视服务平台,提供影视解说文案、AI配音、视频剪辑和原创文案服务

OpenShot

一款免费、开源的视频编辑软件,OpenShot提供丰富的视频效果、标题和音轨功能,用户可以轻松创建和编辑高质量的视频。

多面AI面试

一款全自动AI面试评价系统,多面为企业提供招聘过程中对人才的管理、科学的甄别、AI提效的招聘需求。

DeOldify

DeOldify是一款利用深度学习技术的AI工具,可为黑白照片和视频上色并增强其视觉效果。它支持静态图像转动态视频、跨时代人物模拟等功能,适用于家庭相册修复、历史档案管理、教育演示及影视制作等多个场景,帮助用户更生动地记录和分享历史记忆。

KeySync

KeySync是一种高分辨率口型同步工具,由帝国理工学院和弗罗茨瓦夫大学联合开发。其采用两阶段生成框架,结合掩码策略和视频分割模型,实现音频与唇部动作的精准对齐。支持高清视频生成,具备遮挡处理、减少表情泄露等功能,在视觉质量、时间连贯性和同步精度上优于现有方法,适用于自动配音、虚拟形象、视频会议等多场景应用。