Copilot Vision Copilot Vision是一款由微软开发的人工智能辅助工具,专为Microsoft Edge浏览器设计,处于预览阶段。它能够理解网页内容,通过语音交互为用户提供实时分析和见解,帮助用户进行活动规划、购物决策和学习辅助,同时确保用户隐私安全。 AI项目与工具 2025年06月12日 79 点赞 0 评论 519 浏览
TianliGPT 一个专业的文字摘要生成工具,你可以将需要提取摘要的文本内容发送给TianliGPT,稍等一会他就可以给你发送一个基于这段文本内容的摘要,可以安装在WordPress等系统上。 Ai开源项目 2025年06月05日 72 点赞 0 评论 519 浏览
腾讯混元游戏 腾讯发布的混元游戏视觉生成平台,这是依托混元大模型打造的首个工业级AIGC游戏内容生产引擎,可以优化游戏资产生成与游戏制作流程。 3D&游戏 2025年06月05日 38 点赞 0 评论 520 浏览
EasyOCR EasyOCR是一款基于深度学习技术的开源OCR工具,支持超过80种语言及多种书写系统。它提供高精度的文字识别能力,用户可通过简单的API轻松地将图像中的文本转换为可编辑的文本。EasyOCR易于安装和使用,支持跨平台操作,并具备批量处理能力。该工具在图像质量有一定要求的情况下,能够高效处理大量图像文件。 AI项目与工具 2025年06月12日 89 点赞 0 评论 521 浏览
SyncAnimation SyncAnimation是一款基于音频驱动的实时动画生成框架,能够生成与音频同步的上半身姿态和面部表情,包括嘴唇动作。采用NeRF技术,结合音频到姿态和表情的同步模块,实现实时渲染与高精度动画生成。支持多种推理方式,具备高同步性和自然表现力,适用于虚拟主播、视频会议、动画制作、游戏开发及智能客服等多个领域。 AI项目与工具 2025年06月12日 41 点赞 0 评论 521 浏览
Orpheus TTS Orpheus TTS 是一款基于 Llama-3b 架构的开源文本到语音系统,支持自然、富有情感的语音生成。具备零样本语音克隆能力,无需预训练即可模仿特定语音,延迟低至 200 毫秒,适合实时应用。支持多种语音风格和情感控制,适用于有声读物、虚拟助手、游戏、教育等多个领域。 AI项目与工具 2025年06月12日 26 点赞 0 评论 523 浏览
说得相机 「说得相机」是一款为口播视频创作者量身定制的智能拍摄工具。提供AI提词、虚拟背景、自由重拍、AR演员、精准字幕、一键成片等创新功能,并兼有美颜美妆、文案提取、违禁词检测、... Ai视频生成 1970年01月01日 0 点赞 0 评论 524 浏览
FMHY 自称是互联网上最大的免费资源集合平台,提供影视、音乐、游戏、书籍、课程、工具和应用等丰富资源,堪称“白嫖”的一站式解决方案。 Ai学习资源 2025年06月05日 13 点赞 0 评论 526 浏览
EVI 3 EVI 3是Hume AI推出的全新语音语言模型,能够同时处理文本和语音标记,实现自然、富有表现力的语音交互。它支持高度个性化,根据用户提示生成任何声音和个性,并实时调节情感和说话风格。在与GPT-4o等模型的对比中,EVI 3在情感理解、表现力、自然度和响应速度等方面表现更优,具备低延迟响应能力,可在300毫秒内生成语音回答。EVI 3适用于智能客服、语音助手、教育辅导、情感支持和内容创作等多个 AI项目与工具 2025年06月11日 45 点赞 0 评论 526 浏览