Transfusion Transfusion是由Meta公司开发的多模态AI模型,能够同时生成文本和图像,并支持图像编辑功能。该模型通过结合语言模型的下一个token预测和扩散模型,在单一变换器架构上处理混合模态数据。Transfusion在预训练阶段利用了大量的文本和图像数据,表现出强大的扩展性和优异的性能。其主要功能包括多模态生成、混合模态序列训练、高效的注意力机制、模态特定编码、图像压缩、高质量图像生成、文本生成 AI项目与工具 2025年06月12日 26 点赞 0 评论 249 浏览
Upscayl Upscayl 是一款效果非常出众的图片放大变清晰图片处理软件,通过使用高级的 AI 模型来升级低分辨率图像,使得模糊的图片即使放大也同样清晰。 Ai图片处理 2025年06月05日 97 点赞 0 评论 248 浏览
aoGen aoGen 是一款面向电商行业的 AI 图像生成工具,可快速生成多种风格的虚拟模特并实现服装适配,提供虚拟试衣功能以提升购物体验。其图像增强与编辑功能包括智能修复和物体移除,还可将静态图片转为动态视频,支持多场景应用,有效降低拍摄成本并提升视觉吸引力。 AI项目与工具 2025年06月12日 69 点赞 0 评论 248 浏览
Aragon.ai Aragon.ai 是一款基于人工智能技术的头像生成平台,通过上传照片并结合用户选定的服装和背景,快速生成高质量的专业头像。平台支持个性化定制,具备强大的图像处理能力,可一次性生成大量头像,并提供照片编辑工具。其应用场景广泛,包括职业形象打造、社交媒体展示、企业团队建设以及个人品牌塑造等领域。 AI项目与工具 2025年06月12日 100 点赞 0 评论 248 浏览
Pixel Studio Pixel Studio 是谷歌为 Pixel 9 系列手机预装的一款 AI 图像生成应用。它基于 Imagen 3 模型,能够快速生成艺术风格的图片,生成时间仅需约2秒。Pixel Studio 利用 Tensor G4 芯片,支持本地和云端生成方式,并具备 Gemini overlay 功能,便于用户直接分享生成的图片至邮件或聊天平台。该应用适用于艺术爱好者、设计师、社交媒体用户以及专业创作者 AI项目与工具 2025年06月12日 90 点赞 0 评论 247 浏览
Cutout Pro Cutout Pro成立于2018年,拥有一群技术狂,cutout.pro 利用人工智能和计算机视觉的力量提供范围广泛的产品,让您的生活更加丰富多彩 更轻松,您的工作更高效。 Ai图片处理 2025年06月05日 49 点赞 0 评论 247 浏览
Maya Maya是一款开源多语言多模态模型,基于LLaVA框架开发,支持中文、法语、西班牙语等多种语言,专注于提升低资源语言的AI内容生成能力。它结合图像和文本数据,实现跨模态对齐和指令微调,广泛应用于跨语言内容理解、图像分析、教育和电子商务等领域。 AI项目与工具 2025年06月12日 26 点赞 0 评论 247 浏览
AddressCLIP AddressCLIP 是一种基于 CLIP 技术的端到端图像地理定位模型,由中科院自动化所与阿里云联合开发。它通过图像与地址文本对齐和地理匹配技术,实现街道级别的精确定位,无需依赖 GPS。模型在多个数据集上表现优异,适用于城市管理、社交媒体、旅游导航等多个场景,具备良好的灵活性和多模态结合潜力。 AI项目与工具 2025年06月12日 30 点赞 0 评论 246 浏览
Gen Gen-3 Alpha是一款由Runway公司研发的AI视频生成模型,能够生成长达10秒的高清视频片段,支持文本到视频、图像到视频的转换,并具备精细的时间控制及多种高级控制模式。其特点在于生成逼真的人物角色、复杂的动作和表情,提供运动画笔、高级相机控制和导演模式等高级控制工具,确保内容的安全性和合规性。 AI项目与工具 2025年06月12日 93 点赞 0 评论 246 浏览