图像
Pixel Reasoner
Pixel Reasoner是由多所高校联合开发的视觉语言模型,通过像素空间推理增强对视觉信息的理解和分析能力。它支持直接对图像和视频进行操作,如放大区域或选择帧,以捕捉细节。采用两阶段训练方法,结合指令调优和好奇心驱动的强化学习,提升视觉推理性能。在多个基准测试中表现优异,适用于视觉问答、视频理解等任务,广泛应用于科研、教育、工业质检和内容创作等领域。
Remaker AI
一款AI图像生成器、AI换脸器和AI图像编辑器。能让用户能够无缝替换图像和视频中的脸部,除此之外,Remaker AI 还拥有对象移除器、图像放大器和各种其他AI工具。
