AI

Udio

由前 Google Deepmind 研究人员开发的AI音乐生成器。用户可以通过文字描述轻松生成带有歌词的音乐。

Relume

Relume是一款基于AI的网站构建平台,主要功能包括AI生成网站地图、线框图转换、UI风格指南创建等,支持Webflow和Figma无缝集成,并提供高效的跨团队协作功能。适用于初创企业、自由职业者及数字代理公司,助力快速高效地完成网站设计与开发。

ChatPaper.ai

一个论文、视频、笔记的AI总结学习助手,轻松提炼论文精华、整理课堂重点、生成会议纪要。基于先进AI技术,支持多语言处理,为学生、研究者和职场人士量身打造。

AgentQL

AgentQL是一款利用AI技术实现网页抓取的工具,通过自然语言描述取代传统XPath或DOM选择器,支持语义选择器以提高查询稳定性。该工具提供精确的输出控制和高确定性结果,适用于数据抓取、自动化测试及网页自动化任务,同时支持多种应用场景,包括数据收集、功能测试和信息监控等。

A2E

A2E是一款基于AI技术的数字人视频创作平台,支持通过照片、视频或文本生成高度逼真的虚拟形象,具备声音克隆、多语言翻译、视频生成及形象换脸等功能。适用于内容创作、教育、营销等多个领域,帮助用户降低创作门槛,提升内容效率与表现力。

Voicebox

Voicebox 是由 Meta AI 研究团队开发的一款领先的语音生成模型。Voicebox 能够在六种语言中合成语音,消除瞬态噪声,编辑内容,在语言之间转移音频风格,并生成多样的语音样本。此...

Clay AI

一个可以将您的角色照片转换成粘土动画风格图像的工具。

SynthLight

SynthLight是由耶鲁大学与Adobe Research联合开发的基于扩散模型的人像重照明工具,通过物理渲染引擎生成合成数据并结合多任务训练策略,实现高质量的光照效果生成。它能够根据环境光照图重新渲染人像,生成自然的高光、阴影和漫反射效果,并适用于摄影后期、虚拟场景、游戏开发及广告设计等多个领域,具备良好的泛化能力和实用性。

Voice Engine

Voice Engine是由OpenAI开发的AI语音合成和声音克隆技术。该技术能够通过15秒的音频样本和文本输入生成自然语音。它已在OpenAI的文本到语音API和ChatGPT的语音功能中应用。Voice Engine广泛应用于教育、翻译、远程服务提供、支持言语残障者以及帮助恢复患者声音等方面。为了确保技术安全,OpenAI实施了严格的使用政策和安全措施。

ViDoRAG

ViDoRAG是阿里巴巴通义实验室联合高校开发的视觉文档检索增强生成框架,采用多智能体协作与动态迭代推理技术,提升复杂文档的检索与理解能力。通过高斯混合模型优化多模态信息整合,支持精准检索与高质量生成,适用于教育、金融、医疗等多个领域,显著提升文档处理效率与准确性。