Ming Ming-Lite-Omni是蚂蚁集团开源的统一多模态大模型,基于MoE架构,支持文本、图像、音频和视频等多种模态的输入输出,具备强大的理解和生成能力。模型在多个任务中表现优异,如图像识别、视频理解、语音问答等,适用于OCR识别、知识问答、视频分析等多个领域。其高效处理能力和多模态交互特性,为用户提供一体化智能体验。 AI项目与工具 2025年06月11日 79 点赞 0 评论 243 浏览
飞船Kraft 一款基于先进AI技术的智能助手App,您可以通过文字或语音与飞船Kraft对话,解答疑问、获取各类信息,知识与灵感。同时还能个性化定制属于您自己的智能体进行创作和角色定制等。 AI写作对话 2025年06月05日 17 点赞 0 评论 245 浏览
Vozo AI 一款AI视频生成器,Vozo AI通过重新编写、重新配音、编辑声音,然后通过提示将现有视频配音成新的视频故事。用户可以轻松将视频转换为宣传片、喜剧或多语言版本。 Ai语音工具 2025年06月05日 78 点赞 0 评论 245 浏览
酷音 酷音网是一个真人配音与AI配音、视频拍摄与制作、音乐作词与谱曲、视频策划与创意等领域的创作、交易、推广运营于一体的音视频交易服务平台,致力于打造专注音视频领域的商业生态圈。 创作工具 1970年01月01日 0 点赞 0 评论 247 浏览
Speech Speech-02 是 MiniMax 推出的先进文本到语音模型,支持零样本语音克隆和高质量语音合成,具备多语言支持和情感控制功能。采用自回归 Transformer 和 Flow-VAE 架构提升语音自然度和相似度,适用于配音、有声读物、智能助手等多种场景。提供 HD 和 Turbo 两个版本,满足不同性能需求。 AI项目与工具 2025年06月11日 33 点赞 0 评论 247 浏览
Fugatto Fugatto是一款由英伟达开发的音频合成与转换模型,利用增强型Transformer架构实现了从文本到音频的高效转化。它支持多种音频生成任务,如音乐创作、声音效果设计及语音合成,并可通过ComposableART技术实现对声音属性的精细调控。此外,Fugatto擅长生成动态变化的声音景观,广泛应用于音乐创作、声音设计及广告音频制作等领域。 AI项目与工具 2025年06月12日 44 点赞 0 评论 247 浏览
豆包AI “豆包”是字节跳动公司基于云雀模型开发的 AI 工具,提供聊天机器人、写作助手以及英语学习助手等功能,它可以回答各种问题并进行对话,帮助人们获取信息。 AI写作对话 2025年06月05日 51 点赞 0 评论 250 浏览
卡卡字幕助手 | VideoCaptioner 一款基于 LLM 的智能字幕助手,无需GPU一键高质量字幕视频合成!支持生成、断句、优化、翻译全流程。卡卡字幕助手让视频字幕制作简单高效!优化、翻译,字幕视频全流程一键处理! Ai开源项目 2025年06月05日 64 点赞 0 评论 251 浏览