Gemini Embedding Gemini Embedding 是 Google 推出的文本嵌入模型,能将文本转化为高维向量以捕捉语义和上下文信息。支持超过 100 种语言,具备高效的检索、分类、聚类和相似性检测能力。其支持长文本输入和灵活的维度调整,适用于多场景应用,如智能搜索、数据分析和自然语言处理。模型基于 Gemini 训练,具有优秀的语言理解能力。 AI项目与工具 2025年06月12日 17 点赞 0 评论 685 浏览
小白研报 基于元石自研模型,让小白研报模拟人类思维,通过多轮思考与工具调用,自动生成论文、行业研究与趋势报告,并以精美可视化网页呈现出来。 AI写作对话 2025年06月05日 40 点赞 0 评论 685 浏览
AI Mirror AI Mirror是一款基于人工智能技术的照片编辑与视频创作工具,具备丰富的滤镜选择、动漫化处理、角色生成等功能。用户可通过其多样化的编辑工具实现照片美化、风格转换及创意表达,广泛适用于社交媒体分享、节日纪念、艺术创作和个人化礼物制作等场景。 AI项目与工具 2025年06月12日 39 点赞 0 评论 685 浏览
Gendo Gendo是一款结合生成式AI技术的建筑可视化平台,通过生成对抗网络(GANs)和扩散模型等手段,帮助设计师快速创建逼真的建筑概念图,并支持从草图到最终图像的全周期操作,具备生成性编辑、风格迁移和文本到图像生成等功能,旨在提升设计效率与视觉沟通质量。 AI项目与工具 2025年06月12日 34 点赞 0 评论 685 浏览
AutoVFX AutoVFX是一款由伊利诺伊大学香槟分校研发的先进物理特效框架,通过神经场景建模、大型语言模型(LLM)代码生成及物理模拟技术,实现自然语言指令驱动的视频特效编辑与创作。其主要功能涵盖3D场景建模、程序生成、VFX模块、物理模拟、渲染与合成等,适用于电影制作、广告营销、游戏开发、虚拟现实及教育等多个领域。 AI项目与工具 2025年06月12日 85 点赞 0 评论 685 浏览
OpenVision OpenVision是加州大学圣克鲁兹分校推出的多模态视觉编码器系列,具备从5.9M到632.1M参数的多种模型,适用于不同硬件环境。其采用渐进式多阶段分辨率训练策略,训练效率比同类模型高2至3倍,在多模态任务中表现优异。支持可变大小patch输入,兼具灵活性与高效性,广泛应用于工业检测、机器人视觉、自动驾驶及科研教育等领域。 AI项目与工具 2025年06月11日 58 点赞 0 评论 684 浏览
LeetTools LeetTools是一款人工智能驱动的文档处理工具,支持知识库构建、文章生成和智能搜索等功能。用户可通过关键词快速生成分析报告、新闻聚合等内容,并自定义格式与结构。具备高度可定制性,支持多源数据整合与本地系统集成,适用于市场调研、内容创作及知识管理等场景。 AI项目与工具 2025年06月12日 39 点赞 0 评论 684 浏览
Zonos Zonos是一款由Zyphra开发的高保真文本到语音(TTS)模型,支持零样本语音克隆和多语言生成,具备精细的情感与语音参数控制能力。其采用Transformer和SSM混合架构,基于大规模语音数据训练,适用于有声读物、虚拟助手、多媒体创作及无障碍技术等多个领域。模型开源且支持实时语音生成,具有广泛的应用潜力。 AI项目与工具 2025年06月12日 69 点赞 0 评论 682 浏览
Depth Pro Depth Pro 是一款由苹果公司开发的先进单目深度估计模型,能够在不到一秒的时间内从单张2D图像生成高分辨率的3D深度图。它支持零样本学习,无需依赖相机内参即可提供度量级深度信息,并在细节捕捉方面表现出色。Depth Pro 在增强现实、3D重建、图像编辑、机器人导航和自动驾驶等领域展现出广泛的应用前景。 AI项目与工具 2025年06月12日 37 点赞 0 评论 682 浏览