R - 智狐AI导航

VARGPT

VARGPT是一款多模态大语言模型，整合了视觉理解和生成任务于统一的自回归框架中。它通过next-token和next-scale预测机制，支持文本与图像的混合输入和输出，具备高效的视觉生成能力。模型采用三阶段训练策略，提升了在视觉问答、推理及图像生成任务中的表现。适用于多模态内容创作、指令到图像合成等场景。

AI项目与工具 2025年06月12日 17 点赞 0 评论 532 浏览

UnZipLoRA

UnZipLoRA是一种由伊利诺伊大学厄巴纳-香槟分校研发的图像处理技术，能够将图像内容与风格分离，并分别以两个LoRA模型表示。该技术通过提示分离、列分离和块分离策略，有效解决内容与风格纠缠的问题，支持高效训练和兼容性组合。可用于艺术创作、图像编辑、风格迁移及个性化图像生成等场景，提升图像处理的灵活性和可控性。

AI项目与工具 2025年06月12日 81 点赞 0 评论 783 浏览

LightPDF

LightPDF是一款基于AI的在线PDF处理工具，支持格式转换、OCR识别、文本编辑、注释标注、水印添加、页面操作、加密解密、数字签名等功能。用户可通过智能聊天功能提取文档关键信息并生成摘要，支持多语言处理。适用于文献管理、内容创作、移动扫描及文件处理等多种场景。

AI项目与工具 2025年06月12日 17 点赞 0 评论 863 浏览

SyncAnimation

SyncAnimation是一款基于音频驱动的实时动画生成框架，能够生成与音频同步的上半身姿态和面部表情，包括嘴唇动作。采用NeRF技术，结合音频到姿态和表情的同步模块，实现实时渲染与高精度动画生成。支持多种推理方式，具备高同步性和自然表现力，适用于虚拟主播、视频会议、动画制作、游戏开发及智能客服等多个领域。

AI项目与工具 2025年06月12日 41 点赞 0 评论 764 浏览

qeen.ai

qeen.ai 是一款面向电商行业的 AI 平台，提供动态内容生成、本地化、营销活动优化及智能对话服务。其基于 RL-UI 技术，可实时学习用户行为并优化策略，适用于产品文案生成、多语言本地化、个性化营销及 24/7 客服支持，帮助电商企业提升转化率与运营效率。

AI项目与工具 2025年06月12日 96 点赞 0 评论 562 浏览

OCRmyPDF

OCRmyPDF 是一款开源的命令行工具，用于将扫描 PDF 转换为可搜索、可编辑的文档。基于 Tesseract OCR 引擎，支持 100 多种语言，具备图像优化、纠偏、清洁等功能，提升识别准确率。支持多核处理与批量操作，适合高效处理大量文件，且完全离线运行，保障数据安全。

AI项目与工具 2025年06月12日 39 点赞 0 评论 541 浏览

node

Node-DeepResearch 是一款基于 Gemini 语言模型和 Jina Reader 的开源 AI 智能体，支持持续搜索、多步推理和复杂问题处理。用户可通过 Web Server API 实时获取查询进度，适用于文献综述、市场调研、新闻报道等多种场景。项目具备灵活性和可扩展性，适合研究人员和开发者使用。

AI项目与工具 2025年06月12日 34 点赞 0 评论 665 浏览

Open Deep Research

Open Deep Research 是一个开源 AI 智能体，支持多语言模型和 Firecrawl 数据提取，用于执行复杂的研究任务。它提供统一 API 和 Next.js 框架，具备实时数据处理、结构化信息提取及多维度分析能力，适用于文献综述、行业分析、投资研究等场景。

AI项目与工具 2025年06月12日 33 点赞 0 评论 698 浏览

Chatbox AI

Chatbox AI是一款开源跨平台AI助手，支持多语言模型集成与本地部署，提供图像生成、代码辅助、文档交互等功能。用户可自由定制并参与社区开发，确保数据安全与隐私保护，适用于办公、学习、开发等多种场景，提升工作效率与创意表达。

AI项目与工具 2025年06月12日 66 点赞 0 评论 809 浏览

FluxSR

FluxSR是一种基于单步扩散模型的图像超分辨率工具，由多所高校与研究机构联合开发。它通过流轨迹蒸馏技术，将多步模型压缩为单步模型，实现高效且高质量的图像增强。采用TV-LPIPS感知损失和注意力多样化损失，有效提升图像细节并减少伪影。适用于老照片修复、影视制作、医学影像增强等多个领域，具备高性能与低计算成本优势。

AI项目与工具 2025年06月12日 24 点赞 0 评论 565 浏览

R

首页

R

列表

默认

浏览次数

发布日期