AI项目与工具

讯飞智聘

讯飞智聘是科大讯飞推出的智能化招聘管理平台,整合AI技术与大数据能力,提供从职位发布到人才入职的全流程服务。核心功能包括AI面试、智能简历解析、人才库管理、招聘助理、内推管理等,适用于社会招聘、校园招聘、猎头服务等多种场景,提升招聘效率与精准度。

Backflip AI

Backflip AI 是一款基于 AI 技术的 3D 模型生成工具,可将 3D 扫描数据快速转换为 CAD 模型,提升数字设计效率。支持多种文件格式,具备自动修复、智能特征识别等功能,适用于制造业、建筑、文化遗产保护等多个领域。用户可通过不同订阅方案灵活使用,满足多样化需求。

测测

测测是一款专注于星座心理情感分析的问答社区应用,提供星座分析、MBTI性格测试、心理测试及情感交流等功能。用户可通过与AI智能体、社区成员及认证达人的互动,深入了解自我,同时享有全天候心理支持和专业心理沙盘分析服务,助力情绪管理和内心探索。 ---

Show

Show-o 是一款基于统一 Transformer 架构的多模态 AI 工具,集成了自回归和离散扩散建模技术,可高效处理视觉问答、文本到图像生成、图像修复与扩展以及混合模态生成等多种任务。其创新性技术显著提高了生成效率,减少了采样步骤,适用于社交媒体内容创作、虚拟助手、教育与培训、广告营销、游戏开发及影视制作等多个领域。

Zerox

Zerox是一款基于GPT-4o-mini模型的开源OCR工具,支持多种文件格式,具备零样本识别能力,可高效处理扫描文档和复杂布局内容。其输出为Markdown格式,便于编辑与使用,同时提供API接口,适用于企业文档管理、学术研究、法律金融等多个场景,显著提升文档处理效率和准确性。

轻游梦工坊

轻游梦工坊是一款无代码编程游戏编辑器,提供丰富的资源库、预制逻辑模块及AIGC能力,支持多人帧同步,适用于个人开发者、教育机构以及独立游戏团队,帮助用户快速实现游戏创意并提高开发效率。

PDF to Podcast

PDF to Podcast 是一款由 NVIDIA 开发的 AI 工具,能够将 PDF 文档自动转换为高质量的音频内容,如播客。该工具结合了大型语言模型、文本到语音技术以及 NVIDIA NIM 微服务架构,支持从 PDF 提取信息并生成结构化文本,再通过语音合成输出自然流畅的音频。用户可自定义生成内容的重点,并支持多种部署方式,适用于企业培训、技术简报、客户服务、医疗教育等多个领域。

LLMDet

LLMDet是一款基于大型语言模型协同训练的开放词汇目标检测器,能够识别训练阶段未见过的目标类别。其通过结合图像和文本信息,实现高精度的零样本检测,并支持图像描述生成与多模态任务优化,适用于多种实际应用场景。

OmniManip

OmniManip是由北京大学与智元机器人联合实验室开发的通用机器人操作框架,结合视觉语言模型与三维操作技术,实现机器人在非结构化环境中的任务执行。其核心为以对象为中心的交互基元表示法,支持零样本泛化、跨平台部署及大规模仿真数据生成。通过双闭环系统设计与任务分解机制,提升操作精度与适应性,适用于日常操作、工业自动化及服务机器人等场景。

WebDreamer

WebDreamer是一款基于大型语言模型的网络智能体,专注于通过模拟和预测网络交互结果来进行高效的任务规划与决策。它具备模拟函数、评分函数以及候选动作生成等功能,能够显著提升网络任务执行的效率与安全性,同时支持多种应用场景,包括网页自动化、智能搜索、客户服务等领域。