生成

KeySync

KeySync是一种高分辨率口型同步工具,由帝国理工学院和弗罗茨瓦夫大学联合开发。其采用两阶段生成框架,结合掩码策略和视频分割模型,实现音频与唇部动作的精准对齐。支持高清视频生成,具备遮挡处理、减少表情泄露等功能,在视觉质量、时间连贯性和同步精度上优于现有方法,适用于自动配音、虚拟形象、视频会议等多场景应用。

PaperFake

PaperFake是一款利用先进大模型技术支持的论文写作平台,能够快速生成原创性高的论文初稿,支持多种格式输出并附带辅助材料,显著提升学术写作效率。其核心技术降低了AIGC痕迹,确保了论文的原创性和查重率达标,适用于各类学术与非学术写作场景。

AnimeGamer

AnimeGamer是一款由腾讯PCG与香港城市大学联合开发的动漫生活模拟系统,基于多模态大语言模型(MLLM),支持玩家通过自然语言指令操控动漫角色,沉浸于动态游戏世界中。系统能生成高一致性的动态动画视频,并实时更新角色状态,如体力、社交和娱乐值。其核心技术包括多模态表示、视频扩散模型及上下文一致性机制,适用于个性化娱乐、创意激发、教育辅助及游戏开发等多种场景。

QuickDesign AI

一个一键为你的假发商品图更换AI模特和场景的AI商拍工具,QuickDesign AI可以让你切实降低拍摄成本,缩短拍摄周期,生成高可用的假发商品图,为您的顾客带来完美的购物体验!

CDial

CDial-GPT是一项由清华大学研发的基于大型中文对话数据集LCCC的预训练对话生成模型。该模型提供LCCC-base和LCCC-large两个版本的数据集,并具备预训练、微调、多模态学习等功能,能够生成高质量的对话回应。其应用场景涵盖客户服务、智能助手、在线教育等多个领域。

TaoAvatar

TaoAvatar是阿里巴巴推出的高保真、轻量级3D全身虚拟人技术,基于3D高斯溅射(3DGS)实现照片级真实感的虚拟形象生成。支持多模态驱动,具备高帧率实时渲染能力,适用于AR、移动设备及高清显示平台。其轻量级架构结合深度学习优化,提升了运行效率与交互自然度,广泛应用于电商直播、全息通信、虚拟会议、在线教育及娱乐等领域。

WorldCraft

WorldCraft是一款基于大型语言模型的3D世界创建系统,支持用户通过自然语言交互快速生成和调整虚拟场景。其核心模块包括物体定制、场景布局优化和轨迹控制,具备高精度的几何与纹理控制能力。系统兼容多种3D生成工具,适用于建筑设计、影视娱乐、教育等多个领域,为非专业人士提供高效、直观的创意设计解决方案。

Kimi PPT助手

Kimi PPT助手是一款通过语音或文字指令生成PPT的工具,它提供多种模板,并具备智能排版功能。用户只需简单输入需求,Kimi即可自动生成PPT大纲及内容,节省时间和精力。该工具适用于学生、教师、商务人士以及PPT新手用户,帮助他们快速制作专业且吸引人的演示文稿。

Komiko

Komiko是一款基于先进生成式AI技术的动漫创作工具,支持用户在无限画布上轻松完成漫画创作,涵盖角色设计、对话气泡添加、视觉效果调整等多功能模块。其核心优势在于降低创作门槛,促进创意落地,并通过角色一致性维护保证作品质量,适用于个人创作、教育学习、市场营销等多个领域。

DeOldify

DeOldify是一款利用深度学习技术的AI工具,可为黑白照片和视频上色并增强其视觉效果。它支持静态图像转动态视频、跨时代人物模拟等功能,适用于家庭相册修复、历史档案管理、教育演示及影视制作等多个场景,帮助用户更生动地记录和分享历史记忆。