Shining Yourself Shining Yourself是商汤科技推出的高保真饰品虚拟试戴技术,基于扩散模型实现逼真试戴效果。支持多饰品、个性化调整、多场景模拟及动态展示,适用于电商、设计、社交及品牌推广等场景,提升用户体验与决策效率。 AI项目与工具 2025年06月12日 58 点赞 0 评论 756 浏览
TrackVLA TrackVLA是银河通用推出的端到端导航大模型,具备纯视觉环境感知、语言指令驱动、自主推理和零样本泛化能力。它能在复杂环境中自主导航、灵活避障,并根据自然语言指令识别和跟踪目标对象。无需提前建图,适用于多种场景,如陪伴服务、安防巡逻、物流配送等,为具身智能商业化提供支撑,推动机器人走向日常生活。 AI项目与工具 2025年06月11日 79 点赞 0 评论 756 浏览
11x 11X是一款基于AI技术打造的数字员工服务平台,主要功能涵盖自动化销售流程、跨渠道客户互动以及多语言支持等。其核心产品Alice和Mike分别负责潜在客户挖掘与沟通安排、电话销售与客户跟进,助力企业实现高效运营。平台支持25种语言,适用于多种业务场景,包括销售自动化、客户服务、市场推广及语言翻译等。 AI项目与工具 2025年06月12日 66 点赞 0 评论 755 浏览
In In-Context LoRA是一种基于扩散变换器(DiTs)的图像生成框架,通过微调少量数据实现多样化图像生成任务。它无需修改原始模型结构,减少了对大规模标注数据的依赖,同时保持了高质量的生成效果。该工具支持多任务图像生成、上下文学习能力、任务无关性以及条件图像生成等功能,适用于故事板生成、字体设计、家居装饰等多个领域。 AI项目与工具 2025年06月12日 35 点赞 0 评论 755 浏览
华为小艺 华为小艺是华为推出的一款AI助手,支持网页端访问,具备AI问答、写作、编程辅助、翻译及联网搜索等功能。其接入DeepSeek-R1智能体,支持实时信息检索,提升交互精准度。用户可通过语音或文本与小艺互动,适用于知识查询、多语言沟通、内容创作等场景,支持深度思考模式,满足多样化的使用需求。 AI项目与工具 2025年02月13日 76 点赞 0 评论 755 浏览
VisoMaster VisoMaster 是一款基于 AI 的面部编辑与换脸工具,支持图片、视频及直播场景,能生成自然逼真的换脸效果。采用 GPU 加速与自定义模型功能,适用于影视、广告、视频创作等领域。核心技术包括深度学习与 GANs,实现高精度面部特征提取与图像合成,支持实时预览与参数调整,提升用户体验与效率。 AI项目与工具 2025年06月12日 82 点赞 0 评论 755 浏览
Glarity Glarity是一款基于ChatGPT技术构建的浏览器扩展工具,主要功能包括为YouTube视频和网页内容生成自动摘要、多语言翻译、电子邮件写作辅助及AI问答等。它支持多种平台,如YouTube、Google、Twitter等,旨在帮助用户高效获取信息、突破语言限制并提升阅读效率。无论是语言学习、学术研究还是跨文化交流,Glarity都提供了便捷的解决方案。 AI项目与工具 2025年06月12日 45 点赞 0 评论 755 浏览
JoyHallo JoyHallo是一款由京东开源的AI数字人模型,专注于普通话语音到视频的转换,支持跨语言生成。它通过半解耦结构优化唇部同步效果,并结合特征嵌入和交叉注意力机制提升生成质量。JoyHallo适用于虚拟主播、在线教育、客户服务、娱乐产业等多个领域,能够显著提升内容创作效率并降低成本。 AI项目与工具 2025年06月12日 65 点赞 0 评论 755 浏览
GitHub Spark GitHub Spark是一款基于自然语言处理的AI编程工具,支持多种高级AI模型,允许用户通过自然语言描述需求快速生成微应用程序。其主要功能包括即时预览、多模型选择、自动保存和版本控制。用户可以轻松定制应用程序的外观和功能,适用于个人生产力、教育、财务、健康及娱乐等多个领域。 AI项目与工具 2025年06月12日 72 点赞 0 评论 755 浏览
Ultravox Ultravox 是一种多模态大型语言模型(LLM),能够直接处理文本和语音输入,无需额外的语音识别步骤。其核心技术包括多模态投影器,用于将音频数据转换为高维空间表示,显著提升语音理解和处理效率。该模型支持实时语音对话、多语言扩展及领域特定知识的学习,适用于智能客服、虚拟助手、语言学习、实时翻译及教育等领域。 AI项目与工具 2025年06月12日 51 点赞 0 评论 755 浏览