MoshiVis MoshiVis是一款由Kyutai开发的开源多模态语音模型,支持图像与语音的自然交互。它基于Moshi 7B架构,集成了视觉编码器和跨注意力机制,实现低延迟、自然流畅的对话体验。支持多种后端部署,适用于无障碍应用、智能家居、教育及工业场景,提升人机交互的智能化水平。 AI项目与工具 2025年06月12日 72 点赞 0 评论 658 浏览
Cua Cua 是一款基于 Apple Silicon 的开源 AI 代理工具,支持在 macOS 上运行高性能的虚拟机,并实现 AI 对桌面应用的操作。其核心功能包括虚拟化、任务自动化、多模型兼容与安全隔离。适用于开发、办公、教育及安全测试等多个场景,提供高效、灵活的 AI 操作体验。 AI项目与工具 2025年06月12日 67 点赞 0 评论 656 浏览
QrGPT QrGPT是一款基于AI技术的二维码生成工具,支持用户通过输入链接或提示词自动生成个性化二维码。其主要功能包括快速生成二维码、个性化设计、开源代码以及一键部署。此外,QrGPT适用于多种场景,如营销推广、活动管理、个人名片及社交媒体链接分享等,助力用户高效实现信息传递。 AI项目与工具 2025年06月12日 51 点赞 0 评论 656 浏览
Archon Archon 是一个开源 AI 智能体构建与优化平台,支持多智能体协作、领域知识集成、本地 LLM 集成等功能。它提供自动化代码生成、语义搜索、Streamlit 界面交互及 Docker 部署能力,适用于企业、教育、智能家居等多个场景。技术上融合 Pydantic AI 和 LangGraph,强调框架无关性和高效开发流程。 AI项目与工具 2025年06月12日 74 点赞 0 评论 656 浏览
SFR-RAG 先进的大型语言模型,它通过强化对上下文的理解,提高了机器在生成文本方面的准确性和可靠性。无论是在客户服务、知识问答、内容创作还是专业咨询领域,SFR-RAG都能提供高质量的文... Ai平台模型 1970年01月01日 0 点赞 0 评论 655 浏览
EmotiVoice EmotiVoice是网易有道推出的开源文本到语音系统,支持中英文及2000+音色,能根据提示生成带情感的语音。具备情感合成、语音克隆、多语言支持等功能,提供Web界面和API接口,适用于有声读物、智能助手、教育、客服等场景,技术上支持高效部署与模型微调。 AI项目与工具 2025年06月12日 30 点赞 0 评论 654 浏览
Genmoai Genmoai-smol 是一款专为单 GPU 设备设计的开源视频生成模型,能够将文本描述转化为高质量视频内容。其核心优势在于高保真度运动表现、强大的文本提示遵循能力及显存优化技术,支持用户在资源受限条件下开展视频创作。该工具提供了 Gradio UI 和命令行界面两种操作方式,并广泛应用于视频内容创作、超现实效果视频制作和技术研究等领域。 AI项目与工具 2025年06月12日 26 点赞 0 评论 654 浏览
Qwen Qwen-Agent 是基于通义千问模型的开源 Agent 开发框架,支持指令遵循、工具使用、记忆能力、函数调用、代码解释器和 RAG 等功能,能够处理大规模上下文并快速开发复杂 AI 应用。其技术优势包括大语言模型、工具集成、智能代理架构和 RAG 算法,适用于客户服务、个人助理、教育学习、内容创作和技术支持等多个场景。 AI项目与工具 2025年06月12日 67 点赞 0 评论 654 浏览
腾讯混元3D 全称为Hunyuan3D-1.0,是腾讯推出的一款同时支持文生和图生的3D开源模型,解决现有3D生成模型在生成速度和泛化能力的不足。 Ai开源项目 2025年06月05日 59 点赞 0 评论 653 浏览
OpenShot 一款免费、开源的视频编辑软件,OpenShot提供丰富的视频效果、标题和音轨功能,用户可以轻松创建和编辑高质量的视频。 视频剪辑 2025年06月05日 80 点赞 0 评论 652 浏览