RelightVid RelightVid是一款基于时序一致性扩散模型的视频重照明工具,由多所高校和研究机构联合开发。它支持通过文本提示、背景视频或HDR环境贴图对视频进行细粒度和一致的场景编辑,具备全场景和前景保留重照明功能。该模型在预训练图像照明编辑框架基础上扩展,引入时序层提升视频重照明效果,并结合真实视频与3D渲染数据生成高质量数据对。RelightVid在保持时序一致性和照明细节方面表现突出,适用于影视制作、 AI项目与工具 2025年06月11日 53 点赞 0 评论 212 浏览
HRAvatar HRAvatar是由清华大学联合IDEA团队推出的单目视频重建技术,能够从普通单目视频中生成高质量、可重光照的3D头像。它采用可学习的形变基和线性蒙皮技术,结合精确的表情编码器和物理渲染模型,实现高精度重建和实时渲染(约155 FPS)。支持材质编辑、跨视角渲染和动画化,适用于数字人、虚拟主播、AR/VR、游戏开发和影视制作等领域。 AI项目与工具 2025年06月11日 43 点赞 0 评论 510 浏览
Pocket Flow Pocket Flow 是一个极简的 LLM(大型语言模型)框架,仅用 100 行代码实现。它具有轻量级、无依赖、无厂商锁定的特点,支持多 Agents、工作流、检索增强生成(RAG)等功能,帮助开发者快速构建基于 LLM 的应用程序。基于 Agentic Coding 范式,AI Agents 协助开发,提升效率。适用于多种编程语言,适合希望用极简方式开发 LLM 应用的开发者。 AI项目与工具 2025年06月11日 57 点赞 0 评论 334 浏览
CoreAgent CoreAgent是网易智企推出的企业级智能体开发协作平台,支持问答、工作流、自主智能体等多种形态的智能体开发、测评和托管。平台采用RAG技术构建知识库,具备高性能检索和高召回效果,并通过沙箱运行机制确保安全隔离和资源可控。同时支持MCP协议调度第三方服务,检测内容合规性,与网易CodeWave无缝连接,助力企业快速落地智能应用。 AI项目与工具 2025年06月11日 96 点赞 0 评论 280 浏览
Google Beam Google Beam是谷歌推出的AI驱动的3D视频通信平台,能够将2D视频流转换为逼真的3D效果,提升远程通话的自然度和直观性。用户可实现眼神交流和细微表情识别,增强沟通效果。支持实时语音翻译,打破语言障碍,并基于Google Cloud提供企业级可靠性,适用于远程协作、教育、医疗、国际合作和个人社交等多种场景。 AI项目与工具 2025年06月11日 76 点赞 0 评论 140 浏览
DeepWiki MCP DeepWiki MCP是Cognition Labs推出的远程服务器,基于开放标准的Model Context Protocol(MCP),为AI应用提供访问和搜索GitHub代码库文档的能力。它包含三个主要工具:获取文档主题列表、查看文档内容以及针对仓库提问获得AI回答。支持SSE和Streamable HTTP传输协议,确保信息实时性和准确性,适用于快速查询文档、技术问题解答、代码库结构概览 AI项目与工具 2025年06月11日 90 点赞 0 评论 491 浏览
Macaly Macaly是一款创新的无代码应用开发工具,通过自然语言处理技术,让用户能够将想法转化为可运行的应用程序。用户可通过文字描述或语音指令参与应用创建和修改,并实时看到视觉效果反馈,提升开发效率和协作体验。Macaly与GitHub深度集成,支持代码管理和协作,适用于个人创业者、小型团队、市场营销人员和企业内部项目,支持多环境部署,增强现有项目或从零开始构建。 AI项目与工具 2025年06月11日 16 点赞 0 评论 476 浏览
Gemini Diffusion Gemini Diffusion是谷歌推出的实验性文本扩散模型,通过逐步细化噪声生成文本,具备快速响应、生成更连贯文本和迭代细化等能力。与传统自回归模型不同,它能并行生成文本,提高效率。在外部基准测试中表现优异,速度更快,适用于内容创作、代码生成、数学问题解答和文本编辑等场景。用户需加入等待名单获取访问权限。 AI项目与工具 2025年06月11日 48 点赞 0 评论 452 浏览
JoyAgent智能体平台 JoyAgent智能体平台是京东云推出的企业级一站式AI智能体搭建与发布平台,聚合大模型、知识库、插件和工作流等能力,支持低代码开发,用户可通过自然语言快速构建基于大语言模型的AI智能体。平台提供丰富的预置模板和工具,支持一键发布到微信、企业微信等主流IM和协同办公渠道,适用于智能客服、OA自动化、热点营销等场景,帮助企业提升业务效率和客户体验。 AI项目与工具 2025年06月11日 20 点赞 0 评论 348 浏览
3DTown 3DTown是由哥伦比亚大学联合Cybever AI等机构开发的AI工具,能够从单张俯视图生成高精度的3D城镇场景。它采用区域化生成和空间感知3D修复技术,将输入图像分解为重叠区域,分别生成3D内容并修复缺失结构,确保几何和纹理一致性。支持多种风格的场景生成,适用于虚拟世界构建、游戏开发、机器人模拟等领域,优于现有方法。 AI项目与工具 2025年06月11日 17 点赞 0 评论 258 浏览