R

Whisper语音识别模型

Whisper 是一种通用的语音识别模型。它在不同音频的大型数据集上进行训练,也是一个多任务模型,可以执行多语言语音识别以及语音翻译和语言识别。

MidJourney提示词工具

Midjourney提示词助手为Midjourney用户提供了一个便捷的学习和实验平台,帮助他们更好地掌握提示词的创作技巧,提升AI绘画的质量和效果。

GridMaker

一个专门针对社交媒体的照片网格布局图片分割工具,GridMaker能轻松将图片切割成网格布局,完美适配社交媒体多图发布需求。

Relingo

帮助你在浏览任何网页的时候自动提取生词、划词划句翻译、全文沉浸式翻译,Relingo帮助你轻松掌握语言和词汇。

SuperTinyIcons

一个收集了丰富 Logo的SVG 图标库,目前已收集386+ 个主流的品牌和产品的 Logo,包括GitHub、Twitter、Facebook等。适合用于网页设计、移动应用开发。

Qwen

Qwen-Agent 是基于通义千问模型的开源 Agent 开发框架,支持指令遵循、工具使用、记忆能力、函数调用、代码解释器和 RAG 等功能,能够处理大规模上下文并快速开发复杂 AI 应用。其技术优势包括大语言模型、工具集成、智能代理架构和 RAG 算法,适用于客户服务、个人助理、教育学习、内容创作和技术支持等多个场景。

ReadPo

ReadPo是一款基于AI技术的知识创作辅助工具,集成了内容聚合、智能分析、写作指导等功能,支持从多种渠道获取信息,并将其转化为高质量内容。其特色包括自动评分排序、主题阅读支持、个性化定制选项以及Markdown转图文海报功能,广泛应用于公众号运营、博客写作、新闻编辑等领域,旨在提升内容生产效率和质量。

AvatarGO

AvatarGO是由南洋理工大学、上海AI Lab和香港大学联合开发的AI框架,能够根据文本描述生成高质量的4D人体与物体交互场景。其核心在于利用LLM引导的接触重定位、空间感知的分数蒸馏采样和运动优化技术,实现精确的接触识别与动画生成,有效解决穿透问题。支持多种人物与物体组合,适用于虚拟导购、展厅讲解、VR/AR内容创作等多个领域。

VideoDrafter

一个高质量视频生成的开放式扩散模型,相比之前的生成视频模型,VideoDrafter最大的特点是能在主体不变的基础上,一次性生成多个场景的视频。