多模态 - 智狐AI导航

Zulu

Zulu 是百度文心快码推出的多模态 AI 编程助手，支持从自然语言需求到代码的端到端生成。具备智能任务拆解、多文件编辑、实时预览、多模态输入及多 IDE 适配等功能，适用于开发者、学习者及各类技术岗位，有效提升开发效率和代码质量。

AI项目与工具 2025年06月12日 59 点赞 0 评论 838 浏览

GaussianAnything

GaussianAnything 是一款基于多模态输入的 3D 内容生成框架，支持点云、文本和图像等多种输入方式，能够生成高精度且可编辑的 3D 模型。其核心技术包括点云结构化潜空间和级联扩散模型，具备几何与纹理解耦特性，适用于游戏开发、影视制作、VR/AR、工业设计等多个场景。该工具在生成质量和一致性方面表现优异，为 3D 内容创作提供了高效解决方案。

AI项目与工具 2025年06月12日 41 点赞 0 评论 839 浏览

DreamFit

DreamFit是由字节跳动与高校联合研发的虚拟试衣框架，专注于轻量级服装图像生成。通过优化文本提示与特征融合技术，提升图像质量与一致性，降低模型复杂度和训练成本。支持姿势控制、多主题服装迁移等功能，适用于虚拟试穿、服装设计、广告制作等多个场景，具备良好的泛化能力和易用性。

AI项目与工具 2025年06月11日 89 点赞 0 评论 839 浏览

紫东太初 – 多模态大模型

“紫东太初”平台展现了中国科学院自动化研究所在人工智能领域的深厚实力。它不仅具备强大的多模态处理能力，还通过自监督学习和跨模态语义关联技术，为广泛的AI应用提供了坚实的模...

Ai平台模型 2026年06月21日 0 点赞 0 评论 840 浏览

西鲸AI

一个集成了几十款大模型的平台，西鲸AI免费提供文生文大模型的使用，支持midjourney、Dall-E、SD，以及RAG知识库功能。

AI写作对话 2025年06月05日 27 点赞 0 评论 841 浏览

YAYI2

中科闻歌研发的一款新一代开源大语言模型，中文名为“雅意”。该模型包含 Base 和 Chat 版本，参数规模达到 30B，基于 Transformer 架构构建。

Ai平台模型 2025年06月05日 11 点赞 0 评论 841 浏览

Grok 3

Grok 3是由马斯克旗下xAI推出的最新AI模型，具备强大的推理能力和多模态处理功能。采用“思维链”技术，支持复杂任务的逐步分析，提升逻辑准确性。模型参数量达1.2万亿，基于10万块H100 GPU训练，性能在多个基准测试中超越同类产品。适用于自动驾驶、医疗、教育、客服及营销等多个领域，提供高效智能解决方案。

AI项目与工具 2025年06月12日 66 点赞 0 评论 841 浏览

Valley

Valley是一款由字节跳动开发的多模态大语言模型，擅长处理文本、图像和视频数据，广泛应用于内容分析、图像和视频描述、电子商务及短视频平台等领域。其Eagle版本通过引入VisionEncoder增强了模型性能，支持灵活调整令牌数量，实现了更高效的多模态数据处理。Valley在多项基准测试中表现出色，尤其在参数规模较小的情况下依然保持优异的成绩。

AI项目与工具 2025年06月12日 60 点赞 0 评论 842 浏览

AgiBot Digital World

AgiBot Digital World 是一款基于 NVIDIA Isaac-Sim 的高保真机器人仿真框架，支持多模态大模型驱动的任务与场景自动生成，具备真实感强的视觉与物理模拟能力。其提供多样化专家轨迹生成、域随机化与数据增强功能，助力机器人技能训练与算法优化，并开源了包含多种场景和技能的数据集，适用于工业自动化、服务机器人开发及人工智能研究等领域。

AI项目与工具 2025年06月12日 63 点赞 0 评论 843 浏览

讯飞星辰MaaS

讯飞星辰MaaS是一个AI大模型定制微调平台，提供从数据管理到模型微调、评估、托管及推理服务的全流程支持。平台支持多种行业知名模型的零代码微调，具有高度灵活性和可扩展性，适用于逻辑推理、数据管理和多模态应用等场景，为企业提供高效、专业的AI解决方案。

AI项目与工具 2025年06月12日 88 点赞 0 评论 844 浏览

多模态

首页

多模态

列表

默认

浏览次数

发布日期