学习

空军工程大学装备管理与无人机工程学院

于西安市灞桥区大学中心校区。2012年在空军工程大学原工程学院航空装备管理工程系的基础上创建装备管理与安全工程学院。2017年以原有学院和无人机运用工程系为主体,整合原理院军...

DynVFX

DynVFX是一种基于文本指令的视频增强技术,能够将动态内容自然地融入真实视频中。它结合了文本到视频扩散模型与视觉语言模型,通过锚点扩展注意力机制和迭代细化方法,实现新内容与原始视频的像素级对齐和融合。无需复杂输入或模型微调,即可完成高质量的视频编辑,适用于影视特效、内容创作及教育等多个领域。

OurTeacher

一款面向教师的一站式AI教学辅助网站,适用于幼儿园到大学的各个教育阶段,它通过智能技术帮助教师在备课、教学、作业批改和学生管理等方面提升效率和质量。

ChatGPT Projects

ChatGPT Projects是OpenAI推出的一项多功能集成工具,支持文件上传、个性化指令设置、对话组织及实时协作等功能,通过项目管理、数据存储和版本控制优化用户体验。该工具适用于项目管理、内容创作、编程开发、教育学习等场景,提供强大的文件管理和数据分析能力,助力用户高效完成多样化任务。

Bon French

一款专为法语初学者设计的法语学习工具,Bon French通过AI技术提供了一系列辅助学习功能。这些功能包括AI句子分析、语音朗读、单词本和句子收藏夹等

MooER

MooER是一款基于国产全功能GPU训练的开源音频理解大模型,由摩尔线程推出。它能够进行中文和英文的语音识别,并具备中译英的语音翻译能力。MooER在Covost2中译英测试集中取得25.2的BLEU分数,接近工业级标准。其主要功能包括语音识别、语音翻译、高效率训练以及开源模型。该模型采用深度学习架构和端到端训练模式,具有强大的多语言处理能力和广泛的适用性。

Lingo

Lingo是一款由西湖心辰开发的国内首个端到端语音大模型,具备实时交互、语音理解、多风格语音表达、情绪价值等功能。Lingo在人机对话的自然流畅度和情绪感知方面表现出色,适用于智能家居、客户服务、教育、医疗等多个领域。其核心技术包括端到端设计、深度学习算法和自然语言处理,旨在提供高质量的语音交互体验。

GigaTok

GigaTok 是一款基于语义正则化的高参数视觉分词器,支持自回归图像生成,具备优异的图像重建与生成能力。通过一维架构和非对称扩展策略,实现高效计算与稳定训练。适用于图像生成、编辑、数据增强及多模态应用,具有广泛的技术拓展性。

AskHackers

AskHackers是一款面向开发者的AI搜索工具,专注于技术领域的问答。该平台利用Hacker News上的评论区信息,结合AI技术自动生成问题的答案,为用户提供了一种全新的获取编程和技术解决方案的方式。其主要功能包括社区驱动的知识库、AI生成的答案、实时互动、链接和资源提供以及专注于技术问题。AskHackers的技术原理涵盖自然语言处理(NLP)、数据挖掘、机器学习、搜索引擎优化和知识图谱构

EchoMimic

EchoMimic是一款由阿里蚂蚁集团开发的AI数字人开源项目,通过深度学习模型结合音频和面部标志点,创造出高度逼真的动态肖像视频。该工具支持音频同步动画、面部特征融合、多模态学习和跨语言能力,适用于娱乐、教育和虚拟现实等领域。其独特的技术原理包括音频特征提取、面部标志点定位、面部动画生成和多模态学习,使用了卷积神经网络(CNN)、循环神经网络(RNN)和生成对抗网络(GAN)等深度学习模型,实现