Fish Speech 1.5 Fish Speech 1.5是一款基于深度学习的文本转语音(TTS)工具,支持多语言文本输入,通过Transformer、VITS、VQVAE和GPT等技术实现高质量语音合成。它具备零样本和少样本语音合成能力,延迟时间短,无需依赖音素,泛化性强,且支持本地化部署。Fish Speech 1.5可应用于有声读物、辅助技术、语言学习及客户服务等多个领域。 AI项目与工具 2025年06月12日 14 点赞 0 评论 314 浏览
OpenVoice OpenVoice是一款由MyShell开发的免费开源AI语音克隆工具,其主要功能包括精准的音色和音调克隆及灵活的语音风格控制。该工具能够捕捉并复制不同语言或口音的音色,生成自然流畅的语音,并支持零样本跨语言语音克隆。开发者可以通过GitHub项目地址进行本地安装和运行,也可以通过Lepton AI、MyShell或HuggingFace提供的在线演示体验该工具。 AI项目与工具 2025年06月12日 49 点赞 0 评论 316 浏览
FunClip FunClip是一款由阿里巴巴达摩院通义实验室开发的开源、本地部署的视频剪辑工具。它主要通过自动化语音识别技术,帮助用户基于语音转文字的结果,选择特定文本片段或说话人进行视频剪辑。其特点包括高精度的中文ASR模型、热词定制化、说话人识别功能、Gradio交互界面,以及支持多段剪辑和自动生成SRT字幕文件。 AI项目与工具 2024年07月01日 55 点赞 0 评论 317 浏览
LosslessCut LosslessCut 是一款基于 FFmpeg 的开源视频编辑工具,支持无损剪辑、合并、格式转换及多轨道编辑等功能。它通过直接操作数据流避免重新编码,保持视频质量,适用于家庭用户、视频创作者及专业人士。该工具提供了高分辨率截图、智能剪辑及多种接口支持,能够高效处理各类视频文件。 AI项目与工具 2025年06月12日 15 点赞 0 评论 318 浏览
MagicMirror MagicMirror是一款基于深度学习的开源AI工具,提供面部替换、发型调整和穿搭模拟功能。其特点包括易用性、硬件兼容性、隐私保护及轻量化设计,支持离线运行,适用于个人娱乐、创意设计及虚拟角色扮演等场景。 AI项目与工具 2025年06月12日 17 点赞 0 评论 318 浏览
Docmost 一款开源的Wiki协作和文档管理软件,可以为团队和个人提供一个强大的文档协作平台。Docmost类似于 Notion 和飞书等商业产品,但完全开源,用户可以自由本地部署和使用。 Ai办公效率 2025年06月05日 48 点赞 0 评论 319 浏览
AgentGPT 是由reworkd.ai 开发的开源项目,允许用户创建自主AI智能体(AI代理)以在互联网上执行各种任务。它基于 OpenAI 开发的 GPT-3.5 和 GPT-4 模型构建,使其能够自主行动,无需人工干预。 AI写作对话 2025年06月05日 26 点赞 0 评论 319 浏览
PsycoLLM PsycoLLM是由合肥工业大学研发的中文心理大模型,基于高质量心理数据集训练,具备精准理解心理问题、多轮对话交互、情绪识别与支持、心理健康评估等功能。其技术融合了多步数据优化、监督微调和Transformer架构,适用于个人心理支持、心理咨询、教育及社区服务等场景,为心理健康领域提供专业、高效的技术解决方案。 AI项目与工具 2025年06月12日 48 点赞 0 评论 320 浏览
Bamba Bamba-9B是一种基于Mamba2架构的解码型语言模型,专注于提升大型语言模型的推理效率,尤其擅长处理长文本。它通过恒定的KV-cache设计解决了内存带宽瓶颈问题,并在多个开源平台上得到支持。Bamba-9B不仅具有高效的吞吐量和低延迟的特点,还支持模型量化及长上下文长度扩展,适用于多种应用场景,包括机器翻译、智能客服、内容推荐、自动摘要和社会媒体监控等。 AI项目与工具 2025年06月12日 26 点赞 0 评论 321 浏览