MultiBooth MultiBooth是一种由多所高校和研究机构联合开发的多概念图像生成工具,能够根据文本提示生成包含多个指定概念的高质量图像。其核心技术包括单概念学习和多概念整合,采用多模态编码器、自适应归一化和区域定制化模块,实现高效、精准的图像生成。支持插件式架构,具备良好的扩展性和灵活性,适用于创意设计、广告、教育、电商及科研等多个领域。 AI项目与工具 2025年06月12日 42 点赞 0 评论 342 浏览
Dawn AI Dawn AI是一款基于AI技术的图像生成工具,支持文本转图像、多种绘画风格选择以及头像生成等功能。用户可通过输入文字或上传图片,快速生成艺术作品。界面简洁易用,适合各类用户,适用于社交媒体、创意内容制作及角色定制等多种场景,提升创作效率与个性化表达。 AI项目与工具 2025年06月12日 39 点赞 0 评论 494 浏览
Ingredients Ingredients是一款基于多身份图像与视频扩散Transformer的视频生成框架,支持多身份特征的高效整合与动态分配。其核心模块包括面部提取器、多尺度投影器和ID路由器,能够保持身份一致性并生成高质量视频内容。无需额外训练即可实现个性化视频制作,适用于娱乐、广告、教育等多个领域。 AI项目与工具 2025年06月12日 49 点赞 0 评论 415 浏览
Seer Seer是一款由多家科研机构联合开发的端到端机器人操作模型,基于Transformer架构实现视觉预测与动作执行的高度协同。它能够融合多模态信息,具备强大的泛化能力和数据效率,在真实机器人任务中表现优异。Seer适用于工业自动化、服务机器人、医疗健康等多个领域,支持精准动作预测和未来状态预判,显著提升了机器人系统的智能化水平。 AI项目与工具 2025年06月12日 54 点赞 0 评论 304 浏览
EnerVerse EnerVerse是由智元机器人团队开发的首个机器人4D世界模型,基于自回归扩散模型与稀疏记忆机制,实现未来具身空间的高效生成与动作规划。其核心技术包括逐块生成、时空注意力UNet结构、自由锚定视角(FAV)及Diffusion策略头,显著提升机器人在复杂任务中的表现。该模型已在自动驾驶、工业装配、医疗辅助等多个领域展现出广泛应用潜力。 AI项目与工具 2025年06月12日 92 点赞 0 评论 435 浏览
AutoDroid AutoDroid-V2是由清华大学人工智能产业研究院开发的基于小型语言模型(SLM)的移动端GUI自动化工具,支持多步脚本生成与执行,提升任务完成效率并减少对云端模型的依赖。其核心功能包括自动化UI操作、代码生成与执行、应用文档生成,适用于日常辅助、办公、测试、智能家居及医疗等多个场景,具有较高的实用性和技术前瞻性。 AI项目与工具 2025年06月12日 61 点赞 0 评论 521 浏览
Rooms Rooms是一款由前Google员工开发的3D房间设计工具,支持用户通过超过10,000个可编辑物品和Lua语言创建交互式3D空间与小游戏。应用提供类似TikTok的浏览模式,支持网页端和iOS平台使用。3.0版本新增无需编程的Actions编辑器,提升创作便捷性。适用于个人创作、游戏开发、教育、社交及品牌展示等多个领域。 AI项目与工具 2025年06月12日 41 点赞 0 评论 233 浏览
Momo Momo 是一款基于人工智能的照片生成工具,支持在移动端使用。用户上传 8-12 张照片后,可生成高真实度的 AI 头像和图像,并支持多种风格选择,如商务、约会、旅行等。应用提供高分辨率输出,适用于社交媒体、求职和约会等场景,帮助用户打造个性化的数字形象。 AI项目与工具 2025年06月12日 31 点赞 0 评论 352 浏览
LIGER LIGER是一种由Meta AI等机构研发的混合检索模型,结合生成式检索与密集检索技术,提升推荐系统的效率与准确性。其核心功能包括高效生成候选项目、优化排序、处理冷启动问题及融合语义信息。LIGER通过多目标优化和语义融合机制,显著提高了推荐的精准度与适应性,广泛应用于电商、内容、社交及教育等领域。 AI项目与工具 2025年06月12日 11 点赞 0 评论 266 浏览
SpinBot SpinBot是一款基于AI的文本改写工具,支持文章重写、语法检查和摘要生成等功能,适用于内容创作、学术写作、市场营销及社交媒体管理等场景。用户可通过该工具提升写作效率,生成高质量、原创性内容,同时支持自定义设置以保留特定术语。SpinBot有助于避免内容重复,提高文本的准确性和可读性。 AI项目与工具 2025年06月12日 49 点赞 0 评论 289 浏览