图像

Avat3r

Avat3r 是由慕尼黑工业大学与 Meta Reality Labs 联合开发的高保真三维头部头像生成模型,基于高斯重建技术,仅需少量输入图像即可生成高质量且可动画化的 3D 头像。其核心优势在于使用交叉注意力机制实现表情动态化,支持多源输入,具备良好的鲁棒性和泛化能力。适用于 VR/AR、影视制作、游戏开发及数字人等领域。

Poet.so

一款社交媒体内容截图美化工具,Poet.so主要功能是将Twitter、LinkedIn或Shopify的帖子链接转换成好看的截图,并可调整颜色、浅深色背景、显示相关信息和图片尺寸。

CogAgent

CogAgent是一款由清华大学与智谱AI联合开发的多模态视觉大模型,专注于图形用户界面(GUI)的理解与导航。它具备视觉问答、视觉定位、GUI Agent、高分辨率图像处理及多模态能力,可应用于自动化测试、智能交互、多模态人工智能应用开发、企业级AI Agent平台等多个领域。CogAgent在多个基准测试中表现出色,尤其在GUI操作数据集上显著超越现有模型。

ProfilePicture.AI

Postcraft的免费PFP Maker是一个在线工具,允许用户为他们的社交媒体账户创建自定义头像。它允许用户上传照片,然后该工具将自动删除背景,并生成数百张独特的头像照片。

HunyuanCustom

HunyuanCustom是腾讯混元团队开发的多模态视频生成框架,支持图像、音频、视频和文本等多种输入条件,生成高质量定制化视频。采用文本-图像融合与图像ID增强技术,提升身份一致性和视频真实性。适用于虚拟人广告、虚拟试穿、视频编辑等场景,具备音频驱动和视频驱动两种生成方式,展现强大可控性与灵活性。

Transpic

Transpic是一个AI图像转绘插画创作平台,方便设计师寻找素材/灵感后进行转绘创作参考,普通用户也可以使用该工具来转绘头像。

OpenArt Photo Booth

OpenArt Photo Booth是一款人工智能工具,可以让用户从真实图像中生成个性化的照片。它为一个对象拍摄照片,并根据输入的图像训练一个模型,允许用户使用自定义提示免费生成400张...

OmniAlign

OmniAlign-V是由多所高校联合开发的多模态大语言模型对齐数据集,包含约20万个多模态样本,涵盖自然图像和信息图表。其核心功能包括提供高质量训练数据、提升模型的开放式问答能力、增强推理与创造力,并支持模型持续优化。数据集通过图像筛选、任务设计及后处理优化确保数据质量,适用于多模态对话系统、图像辅助问答、创意生成等多个应用场景。

Shot Rate

Shot Rate是一种用于电商的 AI 工具,可以生成无限变化的产品图像。它使用基于用户原始图像训练的自定义 AI 模型,为营销和宣传材料创建独特且高质量的产品视觉效果。