Perception Perception-as-Control是由阿里巴巴通义实验室开发的图像动画框架,支持对相机和物体运动的细粒度控制。它基于3D感知运动表示,结合U-Net架构的扩散模型,实现多种运动相关的视频合成任务,如运动生成、运动克隆、转移和编辑。通过三阶段训练策略,提升运动控制精度和稳定性,适用于影视、游戏、VR/AR、广告及教育等多个领域。 AI项目与工具 2025年06月12日 20 点赞 0 评论 544 浏览
Soundwave Soundwave是由香港中文大学(深圳)开发的开源语音理解大模型,专注于语音与文本的智能对齐与处理。它采用对齐适配器和压缩适配器技术,提升语音特征压缩效率,支持语音翻译、语音问答、情绪识别及多模态交互等功能。适用于智能语音助手、语言学习、内容创作等多个领域,具有广泛的应用前景。 AI项目与工具 2025年06月12日 50 点赞 0 评论 543 浏览
OldPicRestore 一个免费的老照片修复工具,可修复老照片中的损坏、模糊和褪色问题,还能增强照片的清晰度、对比度和色彩饱和度,同时提供去除背景、吉卜力风格转换功能。 Ai图片处理 2025年06月05日 16 点赞 0 评论 541 浏览
IMAGPose IMAGPose是由南京理工大学开发的统一条件框架,用于人体姿态引导的图像生成。其核心功能包括多场景适应、细节与语义融合、灵活对齐及全局一致性保障。通过FLC、ILC和CVA模块,解决了传统方法在生成多样姿态图像时的局限性,适用于虚拟现实、影视制作、电商展示等多个领域。 AI项目与工具 2025年06月12日 42 点赞 0 评论 541 浏览
Proxy Proxy 是一款由 Convergence AI 开发的自动化 AI 助手,支持自然语言交互,可高效处理日程安排、邮件管理、数据录入等重复任务。具备实时学习和优化能力,准确率达 88%。用户可通过简单指令创建任务,支持任务重复执行和自定义设置,适用于个人生活、企业管理、科研及开发等多个场景。 AI项目与工具 2025年06月12日 77 点赞 0 评论 541 浏览
PPTX.AI PPTX.AI是一个只要你上传 PDF、Word 文档和文本文档或仅输入描述,PPTX.AI将会自动生成设计高雅的幻灯片,然后直接发送到您的邮箱的PPT生成工具。 PPT资源 2025年06月05日 69 点赞 0 评论 541 浏览
Getfloorplan Getfloorplan 可随时创建 2D、3D 平面图和 360° 虚拟游览。使用我们的材料,您的普通房源可以变成您客户的梦想之家图片 生活创意 1970年01月01日 0 点赞 0 评论 540 浏览
Vocol.Ai语音转文本神器 Vocol.Ai语音转文本神器,一个一体化语音协作平台,它使用人工智能将语音高精度地转换为文本并分享可操作的见解。它具有多种语言转录功能。 Ai语音工具 2025年06月05日 20 点赞 0 评论 539 浏览
Sparkify Sparkify是谷歌推出的AI动画视频生成工具,基于Gemini 2.5和Veo 2模型。用户输入问题或复杂概念后,Sparkify能在2分钟内生成直观的动画短视频,讲解知识点。其多模态处理能力结合Google Search数据,确保内容准确且与最新信息同步。适用于教育、科普和企业培训等领域,提升理解效率和传播效果。目前处于内测阶段,可通过官网加入等候列表。 AI项目与工具 2025年06月11日 24 点赞 0 评论 538 浏览