AI

MooER

MooER是一款基于国产全功能GPU训练的开源音频理解大模型,由摩尔线程推出。它能够进行中文和英文的语音识别,并具备中译英的语音翻译能力。MooER在Covost2中译英测试集中取得25.2的BLEU分数,接近工业级标准。其主要功能包括语音识别、语音翻译、高效率训练以及开源模型。该模型采用深度学习架构和端到端训练模式,具有强大的多语言处理能力和广泛的适用性。

PersonaTalk

PersonaTalk是一种基于注意力机制的两阶段框架,用于实现高保真度和个性化的视觉配音。其核心技术包括风格感知音频编码、唇形同步几何生成、双注意力面部渲染等,能够确保视频中人物的嘴型动作与输入音频精准匹配,同时保留说话者的独特风格和面部特征。相比现有技术,PersonaTalk在视觉质量和唇形同步方面表现更优,适用于电影、游戏、虚拟助手等多个领域。

Sloyd AI

Sloyd,一个 3D 建模平台,我们的文本转 3D 模型 AI 生成器专门用于将文本提示转换为详细的 3D 模型,可简化创建 3D 模型的过程。

AIdea

AIdea 是一款支持 GPT 以及国产大语言模型通义千问、文心一言等,支持 Stable Diffusion 文生图、图生图、 SDXL1.0、超分辨率、图片上色的全能型完全开源APP。

IKI AI

IKI AI 是一款AI驱动的知识管理平台,支持多格式内容整合、AI信息提取、OCR识别和个性化知识组织。用户可通过浏览器扩展快速保存资料,适用于学术研究、专业发展、内容创作及项目管理等场景。平台提供多种版本,满足不同需求,强调信息处理效率与团队协作能力。

Creatify AI

Creatify AI是一款由人工智能驱动的应用,只需输入产品链接或上传您自己的视觉和描述,Creatify将为您生成高质量的营销视频。

crAion

一款使用先进的 AI 技术让儿童绘画栩栩如生的应用程序。crAion使用先进的人工智能技术解读每幅绘画,揭示其中隐藏的意义和情感。

FreeLogo AI

Freelogo.co 是一个人工智能驱动的平台,旨在帮助企业和个人创建logo和网站。它的主要优势在于它能够提供符合当代设计标准的独特logo模板。

Sourcetable

Sourcetable 是一款基于AI的电子表格与数据分析工具,支持数据清理、公式生成、图表创建、实时同步及自然语言交互。具备超过500种公式支持,可自动生成SQL查询与数据报告,适用于财务、市场、科研等多场景,提升数据处理效率与协作能力。

EchoMimic

EchoMimic是一款由阿里蚂蚁集团开发的AI数字人开源项目,通过深度学习模型结合音频和面部标志点,创造出高度逼真的动态肖像视频。该工具支持音频同步动画、面部特征融合、多模态学习和跨语言能力,适用于娱乐、教育和虚拟现实等领域。其独特的技术原理包括音频特征提取、面部标志点定位、面部动画生成和多模态学习,使用了卷积神经网络(CNN)、循环神经网络(RNN)和生成对抗网络(GAN)等深度学习模型,实现