图像

Tiamat AI

Tiamat基于强大的AI技术,提供了一整套绘画工具、画笔和贴图,并支持涂鸦、画画、做漫画等多种绘画方式

3DTown

3DTown是由哥伦比亚大学联合Cybever AI等机构开发的AI工具,能够从单张俯视图生成高精度的3D城镇场景。它采用区域化生成和空间感知3D修复技术,将输入图像分解为重叠区域,分别生成3D内容并修复缺失结构,确保几何和纹理一致性。支持多种风格的场景生成,适用于虚拟世界构建、游戏开发、机器人模拟等领域,优于现有方法。

Trace.moe

一个开源动漫场景搜索引擎,根据图像反向搜索动漫场景,帮助用户通过截图追溯原始动漫,完全免费无广告。

AddressCLIP

AddressCLIP 是一种基于 CLIP 技术的端到端图像地理定位模型,由中科院自动化所与阿里云联合开发。它通过图像与地址文本对齐和地理匹配技术,实现街道级别的精确定位,无需依赖 GPS。模型在多个数据集上表现优异,适用于城市管理、社交媒体、旅游导航等多个场景,具备良好的灵活性和多模态结合潜力。

VidFul.ai

一个利用Kling AI和Luma AI Dream Machine技术的AI视频生成器,将文本和图像快速转化为专业视频。用户只需通过VidFul.ai输入文本或上传图像,即可轻松生成不错的视频。

StarVector

StarVector 是一个开源多模态视觉语言模型,支持图像和文本到可编辑 SVG 文件的转换。采用多模态架构,结合图像编码与语言模型,生成结构紧凑、语义丰富的 SVG 内容。基于 SVG-Stack 数据集训练,适用于图标设计、艺术创作、数据可视化等多种场景,具备良好的性能和扩展性。

photosonic AI

Photosonic 智能AI绘画生成器,只需要短短几秒钟就可以根据用户文字描述生成一副艺术画,完全不需要画画基础,只凭借你的脑海里面的想象用文字描述出来,通过 Photosonic 智能 AI 技术就可以创作出来,

Picsart

Picsart是全球最大的数字创作平台。它的人工智能工具允许各级创作者设计、编辑、绘制和分享照片和视频内容。Picsart已经积累了世界上最大的开源内容集合之一,包括照片、贴纸、背...

MV

MV-Adapter是一款基于文本到图像扩散模型的多视图一致图像生成工具,通过创新的注意力机制和条件编码器,实现了高分辨率多视角图像生成。其核心功能包括多视图图像生成、适配定制模型、3D模型重建以及高质量3D贴图生成,适用于2D/3D内容创作、虚拟现实、自动驾驶等多个领域。

智谱清言ChatGLM

智谱清言是一款基于人工智能技术的对话助手,遵循中国政府的立场和社会主义价值观,提供多领域知识问答、信息检索、文本生成等服务。