AI

ImageRAG

ImageRAG 是一种基于检索增强生成(RAG)技术的图像生成工具,通过动态检索相关图像提升文本到图像模型的生成能力。它能够增强对罕见概念的理解与生成,提升图像的真实度和相关性,支持多模态生成与个性化定制。无需额外训练即可适配多种 T2I 模型,广泛应用于创意设计、品牌推广、教育及影视等领域。

青梧字幕

青梧字幕是一款基于AI语音识别技术的字幕提取工具,能够从视频中精准提取语音内容并生成时间轴字幕。支持多语言识别、多格式导出及多语种翻译,适用于视频创作者、外语学习者及字幕团队。所有数据处理在本地完成,保障隐私安全,兼容Windows和MacOS系统,提升字幕制作效率。

Ello

Ello是一款面向4-8岁儿童的AI阅读辅助工具,结合自适应学习系统和语音识别技术,提供个性化的阅读体验。它包含基于科学阅读法的解码电子书、AI实时辅导、互动阅读功能及激励机制,帮助孩子提升阅读能力、增强自信心。适用于家庭、学校及特殊教育场景,支持月度或年度订阅模式。

Uknow.AI

Uknow.AI 是一款基于 AI 技术的学习辅助工具,支持拍照搜题、作业检查、智能计算器等功能,涵盖数学及多学科内容。它提供错题回顾、视频讲解和手写识别等服务,帮助学生提升学习效率,适用于小学到高中阶段的学习场景。

OfficeAI助手

OfficeAI助手是一款面向Microsoft Office和WPS用户的智能办公工具,集成WordAI和ExcelAI插件,提供文档撰写、数据分析、格式优化等功能。支持AI对话、智能校对、自动排版、公式推荐、图表生成等,提升办公效率。具备本地部署、多语言支持与跨平台兼容性,适用于各类办公场景。

unsloth

Unsloth 是一款高效开源的LLM微调工具,通过优化计算流程和GPU内核设计,大幅提升训练速度并降低内存占用。支持多种主流大模型,提供动态量化、长上下文支持等功能,适用于学术研究、企业应用及资源受限环境中的模型优化。

Matrix3D

Matrix3D 是一种由多所高校与科技企业联合开发的统一摄影测量模型,集姿态估计、深度预测、新视图合成与3D重建于一体。其核心技术为多模态扩散变换器,支持跨模态数据融合与灵活任务处理。通过掩码学习策略,提高数据利用效率并增强模型泛化能力。适用于VR/AR、游戏开发、影视制作等领域,具有高度交互性和灵活性。

Light

Light-A-Video 是一种无需训练的视频重照明技术,由多所高校和研究机构联合开发。它通过 CLA 和 PLF 模块实现高质量、时间一致的光照调整,支持前景与背景分离处理,并具备零样本生成能力。适用于影视、游戏、视频创作等多种场景,兼容多种视频生成模型,提升视频表现力与创作效率。

Finedefics

Finedefics是由北京大学彭宇新教授团队开发的细粒度多模态大模型,专注于提升多模态大语言模型在细粒度视觉识别任务中的表现。该模型通过引入对象的细粒度属性描述,结合对比学习方法,实现视觉对象与类别名称的精准对齐。在多个权威数据集上表现出色,准确率达76.84%。其应用场景涵盖生物多样性监测、智能交通、零售管理及工业检测等领域。

Nephola

Nephola 是一款专注情绪管理和心理健康的 AI 应用,通过四个性格各异的 AI 智能体提供情感陪伴。用户可选择不同角色进行互动,获得个性化支持。应用包含心情日志、自我探索、正念冥想及休闲游戏等功能,帮助用户记录情绪、探索性格并缓解压力。适用于日常情绪管理与心理健康提升。