豆包PixelDance 豆包PixelDance是一款由字节跳动开发的AI视频生成工具,基于DiT架构,支持文生视频和图生视频功能。它具备强大的语义理解能力,可生成长达10秒的连贯视频片段,并拥有丰富的运镜效果。该工具支持多种艺术风格和视频比例,适用于影视、广告、短视频等多种场景,极大简化了视频创作流程。 AI项目与工具 2025年06月12日 32 点赞 0 评论 632 浏览
Agent TARS Agent TARS 是字节跳动推出的开源多模态 AI 代理工具,支持浏览器、命令行和文件系统的集成,实现复杂任务的自动化执行。其核心功能包括代理工作流、数据处理、代码生成与解释等。基于事件流和模型上下文协议(MCP),Agent TARS 能高效分解任务并实时反馈结果,适用于网页自动化、任务管理、数据分析和代码辅助等多种场景。目前支持 macOS 平台,处于技术预览阶段。 AI项目与工具 2025年06月12日 29 点赞 0 评论 632 浏览
GTSinger GTSinger是一项由浙江大学研发的开源高质量歌声数据集,包含80.59小时的多语言专业录音棚歌声数据,支持歌声合成、技巧识别、风格迁移和语音到歌声转换等多种任务。它通过音素级标注和真实乐谱支持,为歌唱技巧的研究和应用提供了强大工具。 AI项目与工具 2025年06月12日 77 点赞 0 评论 632 浏览
Boolvideo Boolvideo是一款基于人工智能技术的视频生成工具,能够将产品链接、博客文章、图片、视频或文本内容快速转化为吸引人的视频。支持多个电商平台,具备动画视频、动态视频生成等功能,适用于电商卖家、内容创作者及市场推广人员,旨在简化视频创作流程,提高工作效率。 AI项目与工具 2024年11月24日 10 点赞 0 评论 633 浏览
ConsisID ConsisID是一款由北京大学和鹏城实验室开发的文本到视频生成工具,其核心技术在于通过频率分解保持视频中人物身份的一致性。该模型具备高质量视频生成能力、无需微调的特点以及强大的可编辑性,同时拥有优秀的泛化性能。其主要功能包括身份保持、高质量视频生成、文本驱动编辑以及跨领域人物处理,广泛应用于个性化娱乐、虚拟主播、影视制作、游戏开发及教育模拟等领域。 AI项目与工具 2025年06月12日 18 点赞 0 评论 633 浏览
讯飞星火PC版 讯飞星火PC版是科大讯飞推出的一款桌面级AI工具,集成了强大的跨领域知识理解和语言处理能力。它支持自然对话方式,涵盖写作、搜索、问答、翻译、PPT生成、图像生成等功能,并新增了深度搜索与多模态交互能力,可广泛应用于办公、教育、内容创作和技术开发等领域,提供高效便捷的智能服务。 AI项目与工具 2024年10月29日 65 点赞 0 评论 633 浏览
Brainly Brainly是一款基于人工智能的学习平台,旨在为学生提供全方位的学术支持。它涵盖了多个学科领域,支持用户提问与解答,并通过社交学习模式促进知识共享。Brainly的核心功能包括AI驱动的个性化学习支持、专家验证的答案以及扫描数学问题获取逐步解决方案等。此外,平台还提供了丰富的学习工具,如练习测试和AI生成的学习计划,适用于家庭作业帮助、考试复习、学术研究、语言学习及教师备课等多种场景。 AI项目与工具 2025年06月12日 48 点赞 0 评论 633 浏览
MARS MARS是一款由字节跳动开发的优化框架,专注于提升大型模型训练效率。它融合了预条件梯度方法与方差减少技术,并通过缩放随机递归动量技术优化梯度估计。MARS支持多种Hessian近似方式,可生成基于AdamW、Lion和Shampoo的优化算法实例。该框架适用于深度神经网络、大规模语言模型、计算机视觉任务及强化学习等领域,能有效加速模型收敛并提高训练稳定性。 AI项目与工具 2025年06月12日 79 点赞 0 评论 633 浏览
SUAPP AI SUAPP AI是一款面向建筑设计行业的AI工具,支持图生图、文生图、图生视频、图片建模及AI对话等功能,提升设计效率与表现力。结合SketchUp平台,提供插件扩展与沉浸式体验,适用于建筑、室内及景观设计场景,助力设计师快速生成高质量成果并优化设计方案。 AI项目与工具 2025年06月11日 70 点赞 0 评论 633 浏览
MoCha MoCha 是一款由 Meta 与滑铁卢大学联合开发的端到端对话角色视频生成模型,支持语音与文本驱动的角色动画生成,具备全身动作模拟与多角色对话交互能力。其核心技术包括扩散变压器架构和语音-视频窗口注意力机制,确保动画与语音精准同步。适用于虚拟主播、影视动画、教育内容及数字人客服等多个领域,提升了内容创作效率与表现力。 AI项目与工具 2025年06月12日 34 点赞 0 评论 633 浏览