AI

EmojiGen

EmojiGen是一个开源的表情符号生成器。用户只需要在输入框中输入一个词或短语,EmojiGen就会立即生成相关的表情符号。

Recall

Recall是一款AI知识管理工具,支持将分散的内容转化为自我组织的知识库,具备即时总结、聊天互动功能,可处理YouTube视频、PDF、文章等多种格式内容。它提供增强浏览体验,自动链接相关内容到知识图谱中,帮助用户发现关联信息。Recall支持离线使用,跨平台访问,并注重数据安全与隐私保护,用户可随时导出数据,确保数据所有权。

MineWorld

MineWorld是由微软研究院开发的基于《我的世界》的实时交互式AI模型,采用视觉-动作自回归Transformer架构,实现高保真、可控性强的场景生成。通过并行解码算法,模型可在每秒4至7帧的速度下实现实时交互,适用于具身智能、强化学习、游戏代理及视频生成等场景。其核心技术包括图像与动作标记器、Transformer解码器以及优化的训练与推理流程。

AI速搭

AI速搭是百度智能云推出的低代码开发平台,支持可视化操作,无需编程即可快速构建智能应用。集成文心一言、人脸识别、OCR等AI能力,提供数据管理、API对接、流程控制等功能,适用于内容创作、智能客服、数据分析等多种场景,提升开发效率与智能化水平。

Buildin.AI

Buildin.AI 是一款集 AI 技术与知识管理于一体的云端协作平台,支持文档编辑、项目管理、智能写作和数据分析等功能。平台提供多端同步、实时协作和安全存储,适用于团队协作、个人知识管理及企业应用,旨在提升工作效率与信息处理能力。

MakeAnything

MakeAnything是由新加坡国立大学Show Lab团队开发的多领域程序性序列生成框架,能够根据文本或图像生成高质量的分步教程。它采用扩散变换器和ReCraft模型,支持从文本到过程和从图像到过程的双向生成。覆盖21个领域,包含超24,000个标注序列,具备良好的逻辑连贯性和视觉一致性,适用于教育、艺术、工艺传承及内容创作等多种场景。

MILS

MILS是由Meta AI开发的一种无需额外训练即可为大型语言模型(LLM)提供多模态能力的框架。它通过多步推理、评分反馈和迭代优化,实现图像、视频、音频等多模态内容的生成与理解。MILS支持零样本描述生成、风格迁移、跨模态推理等任务,适用于内容生成、多模态检索、视觉问答等多个场景,具备高效、灵活和无需训练的优势。

OmAgent

OmAgent是由Om AI与浙江大学滨江研究院联合开发的多模态语言代理框架,支持文本、图像、视频等多种输入形式,简化设备端智能代理的开发流程。它具备高效模型集成、灵活算法接口和复杂任务处理能力,适用于视频监控、内容推荐、教育辅助等场景,提升设备智能化水平和用户体验。

Flowin

Flowin是一款结合AI技术的内容创作与协作平台,提供文案生成、文档续写、智能助手等功能,支持多人实时协同编辑和权限管理,适用于教学、学术、商业写作及项目管理等场景,助力高效内容创作与团队协作。

SmolVLM

SmolVLM是一款由Hugging Face开发的轻量级视觉语言模型,专为设备端推理设计。该模型具有三个版本,包括SmolVLM-Base、SmolVLM-Synthetic和SmolVLM-Instruct,分别适用于不同的应用场景。SmolVLM借鉴了Idefics3的理念,采用SmolLM2 1.7B作为语言主干,并通过像素混洗技术提升视觉信息的压缩效率。其训练数据集包括Cauldron和