研究

AI智匠

AI智匠是一款基于人工智能技术开发的学术写作辅助平台,能够根据用户提供的论文主题快速生成大纲与全文,支持多语言、多类型论文创作,并具备论文降重、查重及智能表格插入等功能,适用于大学生毕业论文、科研人员期刊论文撰写以及各类学术研究场景。

MyMemo

MyMemo是一款基于AI技术的智能工具,主要功能包括文件转换、一站式数字空间管理、AI聊天功能、全球标准合规以及安全存储。它能够将用户上传的各种文件(如TXT、PDF、Word文档)转化为精炼的报告和文章,并提供统一的平台来整理和管理数字内容。此外,MyMemo还通过AI聊天功能帮助用户轻松访问和检索数据,并严格遵守国际数据保护法规以确保用户数据的安全。适用于研究人员、学者、作家、内容创作者、企

通义智文

支持网页阅读、论文阅读、图书阅读和自由阅读,让AI帮你读得多、读得快、读得懂

MMSearch

MMSearch 是一款用于评估大型多模态模型(LMMs)搜索能力的基准测试工具,包含 MMSearch-Engine 框架和 MMSearch 测试集。其核心功能包括问题重构、网页排序和答案总结,通过多模态搜索能力评估提升 LMMs 的性能。实验结果显示 GPT-4o 在该测试中表现优异,且增加计算量比扩大模型规模更具优势。

ChildMandarin

ChildMandarin是由智源研究院与南开大学合作开发的3-5岁儿童普通话语音数据集,包含41.25小时高质量语音,覆盖全国22个省市。数据通过家长引导式对话采集,保证自然真实。该数据集支持语音识别、说话人验证和语言研究,适用于儿童语言学习、教育系统、智能玩具和语音助手优化等领域,为儿童语音技术研究提供重要资源。

生数

生数以其创新的多模态大模型和深度生成式算法研究,为艺术设计、游戏制作、影视后期和内容社交等领域提供了强大的技术支持和解决方案。

POINTS 1.5

POINTS 1.5 是腾讯微信开发的多模态大模型,基于LLaVA架构设计,包含视觉编码器、投影器和大型语言模型。它在复杂场景OCR、推理、关键信息提取、数学问题解析及图片翻译等方面表现突出,适用于票据识别、自动客服、新闻摘要、学术论文处理、旅游翻译和在线教育等多个领域。该模型通过高效的数据处理和特征融合技术,实现了跨模态任务的精准处理与高效输出。

NotebookLM

一款基于Gemini 的AI笔记和研究助手,旨在帮助用户更高效地进行信息整理和思考。它利用Google Gemini来处理和分析用户上传的文档和信息源。

清华大学人工智能研究院

清华大学人工智能研究院依托清华大学优势学科,以未来人工智能的原创性基础理论为发力点,力求在探究智能本质的基础上,产生人工能基础理论和关健技术上的颠覆性创新成果

MDM

Matryoshka Diffusion Models (MDM) 是一种由苹果公司开发的新型扩散模型框架,通过嵌套UNet架构实现多分辨率联合去噪,支持从低分辨率到高分辨率的渐进式训练,显著提升高分辨率图像生成效率,适用于多种应用场景,如数字艺术创作、游戏开发、电影制作等,并具备出色的零样本泛化能力。