视频

Emote Portrait Alive

阿里巴巴发布的EMO,一种音频驱动的AI肖像视频生成框架。通过输入单一的参考图像和语音音频,Emote Portrait Alive可以生成动态的、表情丰富的肖像视频。

Sora.FM

一个使用nextjs创建的用于生成 Sora AI视频的开源Web模板。

DICE

DICE-Talk是由复旦大学与腾讯优图实验室联合开发的动态肖像生成框架,能够根据音频和参考图像生成具有情感表达的高质量视频。其核心在于情感与身份的解耦建模,结合情感关联增强和判别机制,确保生成内容的情感一致性与视觉质量。该工具支持多模态输入,具备良好的泛化能力和用户自定义功能,适用于数字人、影视制作、VR/AR、教育及心理健康等多个领域。

Oryx

Oryx是一款由清华大学、腾讯和南洋理工大学联合开发的多模态大型语言模型,专为处理视觉数据设计。其核心技术包括预训练的OryxViT模型和动态压缩模块,支持任意分辨率的图像处理及高效的视觉数据压缩。Oryx在空间和时间理解上表现优异,广泛应用于智能监控、自动驾驶、人机交互、内容审核、视频编辑及教育等领域。

必火AI

必火AI是一款面向短视频创作的国产AI数字人工具,支持数字人形象生成、语音合成与视频制作等功能。用户上传3分钟真人视频即可生成高精度数字人形象,搭配丰富的音色库实现自然语音交互。平台提供多场景模板,适用于营销、教育、娱乐等多种用途,助力内容创作者高效生成高质量视频内容。

Pixel Reasoner

Pixel Reasoner是由多所高校联合开发的视觉语言模型,通过像素空间推理增强对视觉信息的理解和分析能力。它支持直接对图像和视频进行操作,如放大区域或选择帧,以捕捉细节。采用两阶段训练方法,结合指令调优和好奇心驱动的强化学习,提升视觉推理性能。在多个基准测试中表现优异,适用于视觉问答、视频理解等任务,广泛应用于科研、教育、工业质检和内容创作等领域。

Morph Studio AI

Morph Studio是一个多功能的在线头像生成工具,它通过提供多样化的风格和个性化的定制选项,使用户能够轻松创建和分享自己的虚拟形象。

Stockio

Stockio提供成千上万的免费矢量图标、图片、视频和字体,设计师可以在这里找到丰富的设计素材。

CreatorKit

CreatorKit是一款基于AI技术的视觉内容创作工具,支持图片、视频及广告的智能生成与编辑。其核心功能包括AI图像生成、视频制作、品牌定制、多平台适配等,适用于电商、社交媒体及广告行业。用户可通过简单指令完成内容创作,提升效率并优化视觉呈现。提供多种订阅方案,满足不同规模企业的需求。

拓世AI数字人平台

拓世AI数字人平台通过其高效的AIGC技术和用户友好的操作界面,为用户提供了一个创新的数字人视频制作和IP打造解决方案。