训练 - 智狐AI导航

AGUVIS

AGUVIS是一款由香港大学与Salesforce联合开发的纯视觉框架，专为自主GUI智能体设计。它支持跨平台操作，通过图像观察与自然语言指令的关联，以及显式规划和推理能力，提高了代理在复杂数字环境中的交互效率。AGUVIS采用大规模数据集及两阶段训练方法，实现了在离线与在线场景中的高效性能，成为首个不依赖外部闭源模型即可独立完成任务的纯视觉GUI代理。

AI项目与工具 2025年06月12日 97 点赞 0 评论 542 浏览

GameFactory

GameFactory 是由香港大学与快手科技联合研发的AI框架，专注于解决游戏视频生成中的场景泛化问题。它基于预训练视频扩散模型，结合开放域数据与高质量游戏数据，通过多阶段训练实现动作可控的多样化场景生成。具备高精度动作控制、交互式视频生成及丰富场景支持，适用于游戏开发、自动驾驶模拟及具身智能研究等领域。

AI项目与工具 2025年06月12日 31 点赞 0 评论 542 浏览

EPLB

EPLB是DeepSeek推出的专家并行负载均衡工具，用于优化大规模模型训练中的资源分配。它通过冗余专家策略和分层/全局负载均衡机制，提升GPU利用率和训练效率。支持多层MoE模型，减少通信开销，适应不同场景需求。

AI项目与工具 2025年06月12日 10 点赞 0 评论 540 浏览

AI建筑设计-Stable Diffusion

15课时以案例实操的方式，结合实际工作场景需求讲解包括室内设计、建筑鸟瞰、人视角，规划，景观等相关操作流程。

Ai学习资源 2026年06月21日 0 点赞 0 评论 540 浏览

LongVILA

LongVILA是一款专为长视频理解设计的视觉语言AI模型，由多家知名研究机构共同开发。它具备强大的长上下文处理能力和多模态序列并行性，能在大量GPU上高效训练，无需梯度检查点。LongVILA通过五阶段训练流程，结合大规模数据集构建和高性能推理，显著提升了长视频字幕的准确性和处理效率。此外，它还支持多种应用场景，包括视频字幕生成、内容分析、视频问答系统等。

AI项目与工具 2025年06月12日 52 点赞 0 评论 536 浏览

Skywork o1

Skywork o1是一款具备中文逻辑推理能力的大规模预训练模型，其核心优势在于内嵌思考、规划和反思能力，显著提升了复杂任务的推理性能。该模型基于开源Llama架构，同时提供增强版以满足更高要求的应用场景。它适用于技术开发者、企业决策者、教育工作者、内容创作者及客户服务等多个领域，助力创新应用开发和高效决策支持。 ---

AI项目与工具 2025年06月12日 73 点赞 0 评论 535 浏览