AI

Liquid

Liquid是由华中科技大学、字节跳动和香港大学联合开发的多模态生成框架,通过VQGAN将图像编码为离散视觉token并与文本共享词汇空间,使大型语言模型无需修改结构即可处理视觉任务。该框架降低训练成本,提升视觉生成与理解性能,并在多模态任务中表现出色。支持图像生成、视觉问答、多模态融合等应用,适用于创意设计、内容创作及智能交互等领域。

Bard PDF

一个用于汇总和分析 PDF 文档的终极 AI 驱动工具,AI Bard PDF允许用户通过自然对话上传PDF文档并与之交互。

Orbofi

Orbofi允许用户为web3、游戏...

ReplaiGPT

ReplaiGPT是一个Chrome扩展,根据您的上下文生成Gmail回复。

Pippo

Pippo是由Meta Reality Labs研发的图像到视频生成模型,可基于单张照片生成多视角高清人像视频。采用多视角扩散变换器架构,结合ControlMLP模块与注意力偏差技术,实现更丰富的视角生成和更高的3D一致性。支持高分辨率输出及细节自动补全,适用于虚拟现实、影视制作、游戏开发等多个领域。技术方案涵盖多阶段训练流程,确保生成质量与稳定性。

Medio.cool

Medio.cool是一款面向企业海外市场的AI视频编辑工具,提供视频水印去除、商品翻译、商品解说视频自动生成等功能。它支持多语言翻译,涵盖超过100种国际语言,并能一键下载4K高清原视频,适用于YouTube、TikTok等多个平台,助力企业高效实现全球化推广。

自由画布

百度文库和百度网盘联合推出的一款产品,自由画布打通了公域与个人授权的私域内容,支持对多格式、全模态文件的混合理解、生成、创作,并实现了一键分享和存储。

Stablecog

Stablecog 是一款基于人工智能技术的开源图像生成工具,能够根据文本描述或现有图片生成逼真的艺术作品。它支持多种艺术风格,具备图像编辑和调整功能,适用于艺术创作、设计、社交媒体内容制作等多个领域。

QANDA

QANDA是一款由韩国Mathpresso公司开发的AI学习应用,主要面向学生,提供数学及其他学科的即时解答与详细解析。用户可通过拍照或输入问题,获取分步解答、常见错误提示及个性化辅导。应用还支持多语言、学习数据分析和类似题目推荐,适用于家庭作业、考试复习、日常学习及教学辅助等多种场景,帮助用户提升学习效率和理解能力。