R

Tesseract

Tesseract是一款开源的光学字符识别(OCR)引擎,支持多语言识别和多种图像格式。其具备高精度的文字识别能力,适用于文档数字化、表格数据提取、发票识别及移动OCR应用等多个场景。支持跨平台运行,并提供丰富的编程接口和自定义训练功能,便于开发者集成和优化识别效果。

BookmarkGPT

BookmarkGPT,一个用于保存ChatGPT提示词的扩展。通过BookmarkGPT浏览器扩展,提升您的ChatGPT体验,极简地整理和组织您的提示。

HandTalk

一款利用人工智能技术,自动将文本和音频翻译成手语的应用程序。它支持美国手语(ASL)和巴西手语(Libras),为全球约4.66亿聋人和重听人士提供了一个融入社会的新途径。

photosonic AI

Photosonic 智能AI绘画生成器,只需要短短几秒钟就可以根据用户文字描述生成一副艺术画,完全不需要画画基础,只凭借你的脑海里面的想象用文字描述出来,通过 Photosonic 智能 AI 技术就可以创作出来,

普林斯顿大学

普林斯顿大学(Princeton University),简称“普林斯顿”,是一所私立研究型大学,创建于1746年,位于美国东海岸新泽西州的普林斯顿市,是美国大学协会的14个始创院校之一,也是常...

Emote Portrait Alive

阿里巴巴发布的EMO,一种音频驱动的AI肖像视频生成框架。通过输入单一的参考图像和语音音频,Emote Portrait Alive可以生成动态的、表情丰富的肖像视频。

RecordScreen

一款不需要安装的浏览器在线屏幕录制工具,用户可以直接通过浏览器录制屏幕。它支持录制整个屏幕、浏览器窗口或特定标签页,并可选择同步录制摄像头画面。

FaceLift

FaceLift是一种由Adobe与加州大学默塞德分校联合开发的AI工具,能够从单张人脸图像中重建出高精度的3D头部模型。其核心技术包括多视图扩散模型和GS-LRM重建器,支持多视角一致性、身份保持和4D新视图合成,适用于虚拟现实、数字娱乐、远程交互等多个领域。该工具具备强大的几何与纹理细节表现能力,且可与2D面部重动画技术集成,广泛应用于内容创作与科研场景。

SkipWatch AI

一款AI驱动的YouTube视频总结工具,可一键生成视频摘要,支持多语言,能提取关键信息,适用于学生、职场人士等用户群体。

MediaGo

一款开源免费的跨平台视频提取工具。支持流媒体下载、视频下载、m3u8 文件下载以及 B 站视频下载。