AI项目与工具

Hunyuan3D 2.0

Hunyuan3D 2.0是腾讯推出的3D资产生成系统,支持从文本和图像生成高分辨率3D模型。系统采用两阶段生成流程,包含几何生成与纹理合成两个核心模块,具备高精度、高质量输出能力。支持多平台使用,涵盖游戏开发、UGC创作、电商、工业设计等多个应用场景,并提供多个开源模型供研究与开发使用。

YuE

YuE 是一款由香港科技大学与 Multimodal Art Projection 联合开发的开源 AI 音乐生成模型,支持多语言和多种音乐风格,如流行、金属、爵士、嘻哈等。通过语义增强音频分词器、双分词技术和三阶段训练方案,解决长上下文处理与音乐生成难题,生成结构连贯、旋律优美的歌曲。模型完全开源,用户可自由使用和定制,适用于音乐创作、影视配乐、游戏音效及社交媒体内容制作等多个场景。

PicHero

PicHero是一款基于人工智能技术的修图工具,主要功能包括人脸高清化、日常肖像美化、旧照修复及画质提升。它能够轻松解决低分辨率、模糊或损坏照片的问题,同时支持多语言操作,适用于摄影爱好者、社交媒体用户、专业摄影师以及设计师等不同人群。

Twitter Personality

Twitter Personality是一款AI驱动的分析工具,能够通过分析Twitter用户的公开言论生成个性化、幽默且尖锐的点评。用户只需输入Twitter用户名,即可获得针对其推文历史的评价。该工具主要应用于个人娱乐、社交互动、名人点评、内容创作以及市场调研等多个领域。

SpinBot

SpinBot是一款基于AI的文本改写工具,支持文章重写、语法检查和摘要生成等功能,适用于内容创作、学术写作、市场营销及社交媒体管理等场景。用户可通过该工具提升写作效率,生成高质量、原创性内容,同时支持自定义设置以保留特定术语。SpinBot有助于避免内容重复,提高文本的准确性和可读性。

Fast GraphRAG

Fast GraphRAG是微软推出的一款高效知识图谱检索框架,结合了RAG技术和知识图谱,用于提升大型语言模型在处理私有数据和复杂数据集时的表现。它具备可解释性、高精度、动态数据支持及实时更新能力,适用于多种应用场景如智能问答、企业知识管理、个性化推荐、医疗健康信息检索以及金融分析等领域。

StreamBridge

StreamBridge是一款由苹果与复旦大学联合开发的端侧视频大语言模型框架,支持实时视频流的理解与交互。通过内存缓冲区和轮次衰减压缩策略,实现长上下文处理与主动响应。项目配套发布Stream-IT数据集,包含60万样本,适用于多种视频理解任务,展现出在视频交互、自动驾驶、智能监控等领域的应用前景。

ReadPo

ReadPo是一款基于AI技术的知识创作辅助工具,集成了内容聚合、智能分析、写作指导等功能,支持从多种渠道获取信息,并将其转化为高质量内容。其特色包括自动评分排序、主题阅读支持、个性化定制选项以及Markdown转图文海报功能,广泛应用于公众号运营、博客写作、新闻编辑等领域,旨在提升内容生产效率和质量。

Mindsera

Mindsera是一款基于AI技术的日记应用,专注于提升用户的心理健康和认知能力。它能分析写作内容,识别情绪和思维模式,并提供智能反馈和个性化建议。支持语音输入、自动总结、习惯追踪等功能,结合多种思维模型帮助用户优化决策和目标管理。界面简洁,注重隐私保护,适合用于自我反思、情绪管理和日常记录。

FireRedASR

FireRedASR是小红书推出的工业级自动语音识别(ASR)模型系列,支持普通话、中文方言和英语,具备高精度和高效推理能力。其包含FireRedASR-LLM和FireRedASR-AED两个版本,分别聚焦于极致精度和计算效率。模型在多个场景如智能助手、视频字幕生成、歌词识别和语音输入中表现出色,且已开源,推动语音识别技术的发展。