AI项目与工具

AutoAgent

AutoAgent是香港大学开发的零代码LLM智能体框架,支持自然语言交互创建智能助手,适用于搜索、分析和报告生成等场景。提供三种使用模式和双交互模式,兼容多种LLM模型,具备自管理向量数据库和多代理协作能力,部署便捷,适合各类用户高效完成复杂任务。

Outspeed

Outspeed 是一个专注于实时语音和视频 AI 应用开发的平台,提供强大的流媒体处理、低延迟推理、即时部署等功能,支持企业级合规标准。其核心特性包括灵活的模型定制、全面的 SDK 支持以及高效的应用监控工具,广泛应用于客户服务、教育、医疗保健、娱乐、安全监控和质量控制等领域。

PGTFormer

PGTFormer是一款先进的视频人脸修复框架,通过解析引导的时间一致性变换器恢复视频中的高保真细节,同时增强时间连贯性。该方法无需预对齐,通过语义解析选择最佳人脸先验,并结合时空Transformer模块和时序保真度调节器,实现了高效且自然的修复效果。其主要功能包括盲视频人脸修复、语义解析引导、时间一致性增强、时空特征提取、端到端修复和时序保真度调节。PGTFormer适用于电影和视频制作、视频

秒哒

秒哒是一款由百度开发的零代码AI开发平台,基于大模型和智能体技术,支持多智能体协作和工具调用扩展。用户无需编程即可通过自然语言或图形化界面快速创建应用程序,实现创意落地。秒哒适用于企业自动化、教育、个人项目等多种场景,具有零代码编程、模块化构建、流程自动化等特点,大幅降低开发门槛并提升效率。

文墨启名

InkInspire Names 是一款结合中国传统文化和现代AI技术的取名应用。它利用 RAG 技术,为用户提供具有深厚文化底蕴的宝宝名字,并通过智能算法生成符合用户需求的名字。该应用支持文化融合、个性化定制及五格数理分析,帮助用户为新生儿挑选出既有内涵又易于记忆的名字。

AsrTools

AsrTools是一款无需复杂配置的智能语音转文字工具,支持多种音频格式的转换,生成SRT和TXT字幕文件,适用于视频字幕、会议记录、音频转写等多个场景。它具有友好的用户界面、高效的多线程处理能力以及详细的技术文档,旨在为用户提供便捷、准确的语音转文字解决方案。

PIKE

PIKE-RAG是由微软亚洲研究院开发的检索增强型生成框架,旨在提升复杂工业场景下的问答准确性与推理能力。通过知识原子化、多智能体规划等技术,支持多跳问题处理和创造性问题解决。适用于法律、医疗、金融等多个领域,具备结构化知识提取、动态任务分解及分阶段开发等核心功能,提高模型生成结果的可靠性和实用性。

Walles.AI

Walles.AI是一款多功能AI阅读工具,涵盖网页阅读、PDF解析、视频摘要生成及智能聊天对话等功能。它通过GPT-4和GPT-3.5技术支持,可快速提取关键信息并生成摘要,适用于学术研究、职场效率提升、语言学习及教育辅导等多个领域。

OmniSearch

OmniSearch是一款由阿里巴巴通义实验室开发的多模态检索增强生成框架,具备自适应规划能力。它能够动态解析复杂问题,根据检索结果和问题情境调整检索策略,模拟人类解决复杂问题的行为,提升检索效率和准确性。OmniSearch支持多模态信息处理,包括文本、图像等,并通过递归检索与推理流程逐步接近问题解答,显著提高多模态检索的灵活性和效果。

笔启AI

笔启AI是一款面向学术写作的智能辅助工具,支持快速生成论文大纲与正文,具备智能查重、降重、文献推荐等功能。平台提供多语言支持,涵盖中、英、日等多种语言,适用于不同学科需求。用户可通过上传资料定制内容,提升论文原创性与专业性,同时支持数据图表插入与格式导出,助力高效完成高质量学术论文。