OpenVision OpenVision是加州大学圣克鲁兹分校推出的多模态视觉编码器系列,具备从5.9M到632.1M参数的多种模型,适用于不同硬件环境。其采用渐进式多阶段分辨率训练策略,训练效率比同类模型高2至3倍,在多模态任务中表现优异。支持可变大小patch输入,兼具灵活性与高效性,广泛应用于工业检测、机器人视觉、自动驾驶及科研教育等领域。 AI项目与工具 2025年06月11日 58 点赞 0 评论 681 浏览
JanusFlow JanusFlow是一款集成了自回归语言模型与校正流技术的多模态AI模型,能够在单一框架内高效完成图像理解和生成任务。它通过解耦视觉编码器和表示对齐策略,显著提升了模型在视觉理解与图像生成上的表现,广泛应用于图像生成、多模态内容创作、视觉问答、图像理解和辅助设计等多个领域。 AI项目与工具 2025年06月12日 20 点赞 0 评论 682 浏览
KAZE KAZE是一款依托人工智能技术的在线图片处理平台,主要功能涵盖图片去水印、风格转换、旧照修复及物体移除等。凭借其智能化算法,KAZE能够准确识别并清除水印,同时确保图片质量不受影响。用户可直接通过浏览器使用该服务,无需下载额外软件,适用于内容创作、艺术设计、教育科研等多个领域。 AI项目与工具 2025年06月12日 36 点赞 0 评论 682 浏览
VersaGen VersaGen是一款基于生成式AI的文本到图像合成工具,支持多样化视觉控制和灵活的创意表达。通过适配器训练和优化策略,VersaGen将视觉信息融入生成过程中,显著提升了图像质量和用户体验。该工具适用于创意设计、数字艺术、广告营销、游戏开发及影视制作等多个领域,为用户提供了高效且直观的视觉创作解决方案。 AI项目与工具 2025年06月12日 19 点赞 0 评论 682 浏览
AutoVFX AutoVFX是一款由伊利诺伊大学香槟分校研发的先进物理特效框架,通过神经场景建模、大型语言模型(LLM)代码生成及物理模拟技术,实现自然语言指令驱动的视频特效编辑与创作。其主要功能涵盖3D场景建模、程序生成、VFX模块、物理模拟、渲染与合成等,适用于电影制作、广告营销、游戏开发、虚拟现实及教育等多个领域。 AI项目与工具 2025年06月12日 85 点赞 0 评论 682 浏览
parsio Parsio是一款利用AI技术的文档解析工具,支持从PDF、电子邮件及发票等多种文档中自动提取结构化数据。它提供PDF解析与OCR功能,支持多语言识别和表格提取,适用于业务流程优化、客户关系管理及财务管理等多个领域,帮助企业提高效率并减少错误。 AI项目与工具 2025年06月12日 21 点赞 0 评论 682 浏览
Gendo Gendo是一款结合生成式AI技术的建筑可视化平台,通过生成对抗网络(GANs)和扩散模型等手段,帮助设计师快速创建逼真的建筑概念图,并支持从草图到最终图像的全周期操作,具备生成性编辑、风格迁移和文本到图像生成等功能,旨在提升设计效率与视觉沟通质量。 AI项目与工具 2025年06月12日 34 点赞 0 评论 683 浏览
LeetTools LeetTools是一款人工智能驱动的文档处理工具,支持知识库构建、文章生成和智能搜索等功能。用户可通过关键词快速生成分析报告、新闻聚合等内容,并自定义格式与结构。具备高度可定制性,支持多源数据整合与本地系统集成,适用于市场调研、内容创作及知识管理等场景。 AI项目与工具 2025年06月12日 39 点赞 0 评论 683 浏览
CloneUI 一款强大的AI驱动的图片转代码工具,能够将截图、网址或 Figma 设计一键转换为 React、Vue 或 HTML/CSS 代码。 Ai编程建站 2025年06月05日 63 点赞 0 评论 684 浏览