教育

MultiTalk

MultiTalk是由中山大学深圳校区、美团和香港科技大学联合推出的音频驱动多人对话视频生成框架。它根据多声道音频输入、参考图像和文本提示,生成包含人物互动且口型与音频一致的视频。通过Label Rotary Position Embedding (L-RoPE) 方法解决多声道音频与人物绑定问题,并采用部分参数训练和多任务训练策略,保留基础模型的指令跟随能力。MultiTalk适用于卡通、歌唱及

Quizbot.Ai

Quizbot.Ai是一个可帮助学生或学习者创建测验的网站。您可以使用 Quizbot 来测试学生对各种主题的知识、技能掌握和兴趣程度。

FlashVideo

FlashVideo是由字节跳动团队研发的高分辨率视频生成框架,采用两阶段方法优化计算效率。第一阶段在低分辨率下生成高质量内容,第二阶段通过流匹配技术提升至1080p,仅需4次函数评估。其特点包括高效计算、细节增强、快速预览及多场景应用,适用于广告、影视、教育等领域。

Google Beam

Google Beam是谷歌推出的AI驱动的3D视频通信平台,能够将2D视频流转换为逼真的3D效果,提升远程通话的自然度和直观性。用户可实现眼神交流和细微表情识别,增强沟通效果。支持实时语音翻译,打破语言障碍,并基于Google Cloud提供企业级可靠性,适用于远程协作、教育、医疗、国际合作和个人社交等多种场景。

寒武纪

打造各类智能云服务器、智能终端以及智能机器人的核心处理器芯片

ima知识号

IMA知识号是腾讯推出的用于知识库创作与管理的平台,支持知识发布、数据分析及云存储等功能。用户可通过该平台创建、编辑和管理知识库,并利用数据洞察优化内容。适用于企业、教育、社区和个人知识分享等场景,提升信息管理效率和内容质量。

AI Comic Factory

AI Comic Factory是一款基于人工智能技术的在线漫画生成平台,用户无需绘画技能即可创作漫画。它提供多样化的风格选择、布局调整、字幕添加等功能,并支持角色一致性维护和图像重绘,适合个人创作、教育、广告及IP开发等多种应用场景。

Nova Sonic

Nova Sonic是亚马逊推出的生成式AI语音模型,集成语音理解和生成功能,支持多种语言和口音,具备高准确性与自然对话能力。其采用HiFi语音识别技术,平均单词错误率低至4.2%,支持实时信息获取与请求路由,适用于客户服务、教育、医疗、旅游及娱乐等多个领域。该模型具备低延迟和高性价比优势,是当前市场上较为突出的语音处理工具。

NEXUS

NEXUS-O是一款由多家知名机构联合开发的多模态AI模型,能够处理音频、图像、视频和文本等多种输入,并以相应形式输出结果。它在视觉理解、音频问答、语音识别和翻译等方面表现出色,具备强大的跨模态对齐与交互能力。模型基于视觉语言预训练,结合高质量音频数据提升性能,并通过多模态任务联合训练增强泛化能力。适用于智能语音助手、视频会议、教育、智能驾驶、医疗健康等多个领域。

OriginPro

一款由OriginLab公司开发的科学绘图和数据分析软件,它提供了强大的数据处理、统计分析和图形可视化功能,支持多种数据格式,只要应用于科学研究、工程和技术领域。