美图云修 美图云修是美图公司专为商业摄影行业打造的一站式AI修图解决方案,是一款可以批量对商业人像摄影图片进行一键精修的AI智能电脑端软件,轻松易用,只需简单操作即可完成高品质人像... 创作工具 1970年01月01日 0 点赞 0 评论 696 浏览
DanceGRPO DanceGRPO 是由字节跳动与香港大学联合开发的视觉生成强化学习框架,支持文本到图像、文本到视频、图像到视频等多种任务,兼容多种生成模型与奖励机制。其通过强化学习优化生成过程,提升视觉内容质量与一致性,降低显存压力,提高训练效率与稳定性,适用于视频生成和多模态内容创作。 AI项目与工具 2025年06月11日 45 点赞 0 评论 694 浏览
NVILA NVILA是一款由NVIDIA开发的视觉语言模型,通过“扩展-压缩”策略优化处理高分辨率图像和长视频,兼具效率与准确性。它在图像和视频基准测试中表现优异,支持时间定位、机器人导航和医疗成像等应用场景,并通过参数高效微调和量化技术提升模型性能。未来将在GitHub和HuggingFace平台上开源。 AI项目与工具 2025年06月12日 68 点赞 0 评论 692 浏览
SuperEdit SuperEdit是由字节跳动与佛罗里达中央大学联合开发的图像编辑工具,基于扩散模型和优化监督信号,实现高精度的自然语言指令图像编辑。其特点包括高效训练、保留图像质量以及支持多种编辑类型。该工具适用于内容创作、影视、游戏、教育和医疗等多个领域,提供灵活且高效的图像处理方案。 AI项目与工具 2025年06月11日 100 点赞 0 评论 688 浏览
IC IC-Light是一款由张吕敏开发的AI图像处理工具,专注于图像的光源操纵和光影重构,支持基于文本和背景条件下的图像重照明。该工具适用于多种场景,包括个人照片编辑、专业摄影后期、电商产品展示、广告和海报设计等。IC-Light具备自动抠图、光源方向选择、文本条件重照明等功能,并且支持开源获取。 AI项目与工具 2024年01月01日 56 点赞 0 评论 687 浏览
LBM LBM(Latent Bridge Matching)是一种基于潜在空间桥接匹配的图像到图像转换框架,支持目标移除、图像重光照、深度图生成等多种任务。通过布朗桥和随机微分方程实现高效且多样化的图像转换,具备良好的可控性和视觉一致性。适用于摄影、设计、3D建模等多个领域,具有广泛的应用前景。 AI项目与工具 2025年06月11日 40 点赞 0 评论 687 浏览
WebSSL WebSSL是由Meta和纽约大学等机构开发的视觉自监督学习模型,基于大规模网络图像数据训练,无需语言监督即可学习有效视觉表示。其包含多个变体,参数规模从3亿到70亿不等,在多模态任务如视觉问答、OCR和图表理解中表现出色。通过筛选含文本图像数据,显著提升特定任务性能。模型具备良好的扩展性,适用于智能客服、文档处理、医疗影像分析等多个领域。 AI项目与工具 2025年06月11日 92 点赞 0 评论 686 浏览
aftershoot Aftershoot 是一款基于 AI 的摄影辅助工具,支持快速筛选和自动编辑照片,适用于婚礼、活动、人像等多种摄影场景。它能识别重复、模糊或闭眼照片,并提供风格化编辑功能。用户可自定义 AI 编辑偏好,支持 RAW 和 JPEG 格式,兼容主流后期软件,提高工作效率。 AI项目与工具 2025年06月12日 11 点赞 0 评论 686 浏览
BEN2 BEN2是一款由Prama LLC开发的深度学习图像和视频处理工具,专注于高效、精准的背景移除与前景分割。采用置信度引导抠图技术,可处理复杂细节,如头发和边缘,确保高精度分割。支持4K图像处理,具备GPU加速功能,适用于图像编辑、视频剪辑及批量处理等多种应用场景。 AI项目与工具 2025年06月12日 60 点赞 0 评论 684 浏览