Gemini Diffusion Gemini Diffusion是谷歌推出的实验性文本扩散模型,通过逐步细化噪声生成文本,具备快速响应、生成更连贯文本和迭代细化等能力。与传统自回归模型不同,它能并行生成文本,提高效率。在外部基准测试中表现优异,速度更快,适用于内容创作、代码生成、数学问题解答和文本编辑等场景。用户需加入等待名单获取访问权限。 AI项目与工具 2025年06月11日 48 点赞 0 评论 454 浏览
BnbIcons BnbIcons是一款AI驱动的图标生成工具,能够创建类似Airbnb风格的等轴测图标。用户可通过文字描述或上传参考图片生成图标,提供464+个预设图标,支持批量生成和图标动画功能,适用于界面设计、原型设计、社交媒体内容等多种场景。 AI项目与工具 2025年06月11日 82 点赞 0 评论 423 浏览
3DTown 3DTown是由哥伦比亚大学联合Cybever AI等机构开发的AI工具,能够从单张俯视图生成高精度的3D城镇场景。它采用区域化生成和空间感知3D修复技术,将输入图像分解为重叠区域,分别生成3D内容并修复缺失结构,确保几何和纹理一致性。支持多种风格的场景生成,适用于虚拟世界构建、游戏开发、机器人模拟等领域,优于现有方法。 AI项目与工具 2025年06月11日 17 点赞 0 评论 261 浏览
VibeNecto VibeNecto是一款AI营销视觉素材生成平台,能够根据用户输入的文本描述快速生成高质量的定制化图片,适用于社交媒体、广告等多种营销场景。用户无需专业设计技能,可在几秒钟内获得符合品牌风格的视觉素材。平台提供多种视觉风格选择,具备背景移除功能,可自动去除图片背景,适合产品照片和专业头像处理。所有生成的图片都会被安全地存储在云端,自动保存历史记录,方便用户随时访问、下载或重复使用。 AI项目与工具 2025年06月11日 46 点赞 0 评论 199 浏览
VideoTutor VideoTutor是一款AI教育辅助工具,能够生成动画讲解视频,帮助学生理解知识点和解题过程。用户可通过文字、截图或语音输入问题,系统自动生成包含语音和动画的视频。支持SAT数学、AP数学、STEM知识和语言学习等领域,提供个性化学习内容,24小时在线使用,适合家长、学生和教师,尤其在SAT数学备考方面表现突出。 AI项目与工具 2025年06月11日 90 点赞 0 评论 439 浏览
Vid2World Vid2World是由清华大学和重庆大学联合开发的创新框架,能够将全序列、非因果的被动视频扩散模型(VDM)转换为自回归、交互式、动作条件化的世界模型。该模型基于视频扩散因果化和因果动作引导两大核心技术,解决了传统VDM在因果生成和动作条件化方面的不足。Vid2World支持高保真视频生成、动作条件化、自回归生成和因果推理,适用于机器人操作、游戏模拟等复杂环境,具有广泛的应用前景。 AI项目与工具 2025年06月11日 33 点赞 0 评论 510 浏览
Rork Rork是一款AI驱动的无代码开发工具,能够根据用户自然语言描述快速生成跨平台移动应用。它支持iOS和Android平台,基于React Native技术,可一键发布到App Store和Google Play,并与多种后端数据库集成。Rork适合初创企业、非技术用户及快速原型开发,降低应用开发门槛,提升效率。 AI项目与工具 2025年06月11日 92 点赞 0 评论 386 浏览
Kilo Code Kilo Code是一款开源的VS Code AI Agent扩展程序,旨在提升开发人员的编码效率。它具备自然语言生成代码、任务自动化、代码重构、智能补全等功能,支持多种预设模式和MCP服务器市场,内置最新AI模型如Claude 3.7 Sonnet和Gemini 2.5 Pro,无需手动配置API密钥。适用于快速开发原型、编程学习、代码维护和团队开发等场景。 AI项目与工具 2025年06月11日 38 点赞 0 评论 350 浏览
MTVCrafter MTVCrafter是由中国科学院深圳先进技术研究院计算机视觉与模式识别实验室、中国电信人工智能研究所等机构推出的新型人类图像动画框架,基于4D运动标记化(4DMoT)和运动感知视频扩散Transformer(MV-DiT)实现高质量动画生成。该工具直接对3D运动序列建模,支持泛化到多种角色和风格,保持身份一致性,并在TikTok基准测试中取得优异成绩。其应用场景包括数字人动画、虚拟试穿、沉浸式内 AI项目与工具 2025年06月11日 50 点赞 0 评论 301 浏览
AgenticSeek AgenticSeek是一款完全本地化的开源AI助手,作为Manus的开源替代品,它能够在本地设备上自主执行任务,如浏览网页、编写代码和规划项目,确保用户隐私。支持多种编程语言,具备智能任务拆解与执行能力,用户可通过语音或文本交互。适用于注重隐私和希望在本地环境中使用AI工具的用户。 AI项目与工具 2025年06月11日 21 点赞 0 评论 461 浏览