图像

LDGen

LDGen是一款结合大型语言模型与扩散模型的文本到图像生成工具,支持零样本多语言生成,提升图像质量和语义一致性。通过分层字幕优化、LLM对齐模块和跨模态精炼器,实现文本与图像的高效交互。实验表明其性能优于现有方法,适用于艺术创作、广告设计、影视制作等多个领域,具备高效、灵活和高质量的生成能力。

AILabTools

一个拥有数十款人工智能产品的平台,旨在为用户提供便捷的图像编辑和处理解决方案。我们的产品包括表情编辑、发型编辑、图像无损放大、人像动漫化等等,为用户提供了多种图像处理的选择。

Paint By Text

Paint by Text 是一个允许您在 AI 的帮助下使用书面说明编辑照片的网站。您可以上传图像,键入描述如何更改图像的文本提示,并根据提示生成新图像。例如,您可以添加帽子、更改颜色或从照片中移除对象。

AI拓图-缩放高清无损

POP服装趋势网是一家时尚、专业、高端、领先的服装设计资讯网站,涵盖独立服装设计师作品、时装周秀场高清款式图片和时尚杂志书籍,从色彩、面料、图案印花、款式、灵感

HeadshotBooth.ai

HeadshotBooth.ai 是一款基于人工智能技术的在线服务,能够快速生成专业级头像。用户通过上传自拍照并选择背景与服装风格,即可获得高分辨率、多样化的头像作品。其核心优势在于高效生成、丰富定制化选项以及友好的用户体验,广泛适用于社交媒体、职业发展及个人品牌建设等领域。

HIAIX导航

HIAIX,1500+AI全品类AI工具集,找AI工具,一个HIAIX导航网站就够了。

LLMDet

LLMDet是一款基于大型语言模型协同训练的开放词汇目标检测器,能够识别训练阶段未见过的目标类别。其通过结合图像和文本信息,实现高精度的零样本检测,并支持图像描述生成与多模态任务优化,适用于多种实际应用场景。

BrushEdit

BrushEdit是一款基于多模态大型语言模型和双分支图像修复模型的先进图像编辑框架,支持用户通过自然语言指令进行自由形式的多轮交互式编辑操作。其核心功能包括指令引导的图像编辑、多轮交互式编辑、自由形式掩码编辑、背景与前景处理以及图像修复。该工具通过特征融合、零卷积层和混合微调策略,实现了对编辑区域的精准控制和背景的无缝衔接,适用于内容创作、影视修复、广告设计、社交媒体分享及电商产品图片优化等多个

VARGPT

VARGPT是一款多模态大语言模型,整合了视觉理解和生成任务于统一的自回归框架中。它通过next-token和next-scale预测机制,支持文本与图像的混合输入和输出,具备高效的视觉生成能力。模型采用三阶段训练策略,提升了在视觉问答、推理及图像生成任务中的表现。适用于多模态内容创作、指令到图像合成等场景。

Genmo AI

Designs.ai Videomaker是一个创新的在线工具,它通过AI技术简化了视频制作流程,使得用户能够快速、轻松地创作出专业级别的视频内容。