Sa2VA Sa2VA是由字节跳动联合多所高校开发的多模态大语言模型,结合SAM2与LLaVA技术,实现对图像和视频的密集、细粒度理解。它支持指代分割、视觉对话、视觉提示理解等多种任务,具备零样本推理能力和复杂场景下的高精度分割效果。适用于视频编辑、智能监控、机器人交互、内容创作及自动驾驶等多个领域。 AI项目与工具 2025年06月12日 66 点赞 0 评论 315 浏览
DCEdit DCEdit是一款基于双层控制机制的图像编辑工具,结合精确语义定位策略与视觉、文本自注意力优化,提升图像编辑的准确性和可控性。无需额外训练即可应用于现有扩散模型,支持复杂场景下的精细编辑任务,如对象替换、颜色调整等,适用于广告、影视、社交媒体等多个领域。 AI项目与工具 2025年06月12日 15 点赞 0 评论 121 浏览
HoloPart HoloPart 是一种基于扩散模型的 3D 分割工具,能准确识别并补全被遮挡的语义部件,支持几何与材质编辑等任务。其两阶段方法结合局部与全局注意力机制,提升分割精度与一致性。适用于动画制作、几何优化及数据生成等领域,已在多个数据集上取得优异性能。 AI项目与工具 2025年06月11日 84 点赞 0 评论 283 浏览
PDF2Go 一款由德国软件公司QaamGo开发的在线PDF工具,PDF2Go提供一系列便捷的PDF处理功能,包括编辑、合并、拆分、转换等。 格式转换 2025年06月05日 42 点赞 0 评论 286 浏览
GridMaker 一个专门针对社交媒体的照片网格布局图片分割工具,GridMaker能轻松将图片切割成网格布局,完美适配社交媒体多图发布需求。 Ai编程建站 2025年06月05日 85 点赞 0 评论 409 浏览