AI项目与工具

Muyan

Muyan-TTS是一款面向播客场景的开源文本转语音工具,基于超10万小时播客数据训练,支持零样本语音合成与说话人适配,可在0.33秒内生成1秒音频,适合实时与长内容合成。支持本地部署与API调用,应用于播客、有声书、视频配音、AI角色及新闻播报等领域,兼具高效性与灵活性。

AI酱

AI酱是一款结合二次元元素与AI技术的多语言智能聊天工具,支持多种语言交流,具备语音识别和即时反馈功能。它通过生动的角色形象和标准化发音,帮助用户练习外语口语,并能在情绪疏导、旅行规划等方面提供个性化服务。此外,其多角色设定和场景切换功能进一步增强了用户体验。

OpenR

OpenR是一个由多家知名高校联合开发的开源框架,专注于通过强化学习和搜索技术提升大型语言模型的推理能力。它集成了数据获取、强化学习训练及非自回归解码功能,支持多种搜索算法和在线强化学习训练,能够有效提高模型的推理效率和精度。同时,其自动化数据处理能力减少了人工标注的需求,适用于数学问题求解、代码生成、自然语言处理等多种应用场景。

AIpai

AIpai是一款AI视频创作Agent工具,支持用户快速生成专业视频内容。其主要功能包括智能编剧、角色设计、场景构建、图像生成、视频生成、声音设置和参数调整。用户只需输入文案,AIpai即可自动生成分镜、图像和视频选项,并支持多种风格和参数定制。适用于短视频制作、品牌宣传、个人创作、教育领域和影视制作等多种场景,大幅提升创作效率,降低制作门槛。

Zyler AI

Zyler AI 是一款面向营销分析的智能工具,支持多平台数据集成,提供 AI 驱动的洞察和趋势分析。拥有 50 多个预设模板,支持无代码拖拽式操作,便于用户快速生成专业报告。具备多层级数据分析和导出功能,适用于数字营销、产品管理及企业决策场景,提升数据处理效率和团队协作能力。

Ovis2

Ovis2是阿里巴巴国际团队开发的多模态大语言模型,采用结构化嵌入对齐技术提升视觉与文本的融合效果。支持视频、图像和多语言处理,强化了思维链推理和复杂场景下的OCR能力。提供多个参数规模的版本,适用于研究、开发及各类应用场景,展现卓越性能。

掌桥科研

掌桥科研是一款面向科研人员的综合性平台,集文献检索、翻译转换、科技查新、引证分析等功能于一体。平台拥有海量中英文文献资源,支持多语言处理,并提供AI辅助工具,如选题建议、论文综述生成等,助力科研效率提升与成果管理。

dinnerfy

Dinnerfy是一款利用AI技术打造的餐食规划与杂货购物应用,主打个性化食谱推荐、自动化购物清单生成及与配送平台的无缝对接。它支持食谱共享,满足不同用户的饮食需求,包括健康管理和特殊饮食要求。无论忙碌的职业人士还是新手厨师,都能从中受益,高效规划每日膳食。

麦琪的花园

《麦琪的花园》是一款融合AI技术与沙盒玩法的冒险游戏,玩家可创建个性化AI伙伴并与之互动,同时建设营地、探索魔法大陆。游戏支持多语言对话和语音合成,提供沉浸式社交体验,适合沙盒、二次元及AI技术爱好者。

OuteTTS

OuteTTS是一款基于开源技术的文本到语音(TTS)工具,利用纯语言建模方法生成自然语音。它支持语音克隆和自定义说话人声音,具备音频标记化、CTC强制对齐和结构化提示创建等功能。OuteTTS与llama.cpp和GGUF格式兼容,适用于有声读物、智能客服、语音导航等多种应用场景。