AI项目与工具

TextHarmony

TextHarmony是一款由华东师范大学与字节跳动联合开发的多模态生成模型,擅长视觉与文本信息的生成与理解。该模型基于Slide-LoRA技术,支持视觉文本生成、编辑、理解及感知等功能,广泛应用于文档分析、场景文本识别、视觉问题回答、图像编辑与增强以及信息检索等领域。通过高质量数据集的构建与多模态预训练,TextHarmony在视觉与语言生成任务中表现出色。

Rowboat

Rowboat 是一款开源低代码 AI IDE,用于构建多智能体助手的多云平台(MCP)工具。它提供可视化界面和 AI 辅助开发功能,支持用户通过自然语言快速生成智能体结构,并进行实时测试。具备灵活的工具集成能力,可连接多种外部服务,同时提供 API 和 SDK 便于应用集成。支持企业级功能如长会话记忆和权限管理,适用于客户服务、任务协调、业务处理及个人助理开发等多种场景。

Botify AI

Botify AI是一款基于人工智能的聊天机器人平台,提供高度可定制的数字角色和自然语言交互功能。用户可以通过直观的界面和强大的编辑工具创建和管理聊天机器人,支持多种应用场景,如客户服务、市场营销、教育培训等。平台具备自然语言处理、多媒体内容集成及跨平台兼容性等特点,旨在提升用户体验并优化工作效率。

WhisperKeyboard

WhisperKeyboard 是一款基于 OpenAI Whisper 技术的 AI 语音输入工具,支持多语言实时语音转文字,适用于写作、编程、会议记录等场景。具备离线识别、文本润色、多语言翻译和隐私保护等功能,兼容多平台,提升输入效率与文本质量。

Open Materials 2024

Open Materials 2024 (OMat24) 是Meta发布的开源数据集,包含超过1.1亿个无机材料的密度泛函理论(DFT)计算数据,并配备了预训练的图神经网络模型EquiformerV2。该模型在材料的基态稳定性及形成能预测方面具有卓越表现,为新材料的发现和设计提供了高效工具。其核心功能包括大规模数据集支持、高效的材料属性预测以及在多个领域(如能源、环境、催化等)的实际应用潜力。

FastVLM

FastVLM是一款高效的视觉语言模型,采用FastViTHD混合视觉编码器,显著提升高分辨率图像处理速度并减少token数量。其在保持高性能的同时,降低了计算成本和模型复杂度。适用于视觉问答、图文匹配、文档理解、图像描述生成等多模态任务,具备良好的实用性和扩展性。

Rodin

Rodin是一款由影眸科技开发的AI驱动3D生成工具,专注于快速生成高质量的3D模型。它支持文本提示和图片输入生成3D资产,具备多视图融合、模型调整及材质生成等功能,适用于游戏开发、角色建模、虚拟现实等多种场景,同时兼顾生成效率与细节表现,但需进一步优化精度与数据集适应性。

PerfectEssayWriter

PerfectEssayWriter是一款利用自然语言处理和机器学习技术的AI辅助论文写作工具,涵盖从头脑风暴到最终润色的全过程。其主要功能包括智能生成论文草稿、定制化内容创作、语法校对、引用推荐及模板应用,支持学术论文、研究报告等多种文体。该工具既适合新手入门,也能满足高阶用户的严格要求,助力提升写作效率并保证内容质量。

Chai

Chai是一款AI伴侣应用,提供强大的内容生成能力和独特的交互体验。用户可以与各种AI角色进行聊天,角色具有不同的性格、背景和对话风格。Chai支持用户创建自定义AI角色,个性化推荐适合的AI角色,并提供数千个预设角色。用户可主导剧情走向,探索成人向内容,享受自由度极高的互动体验。同时,Chai支持多语言交流,适用于AI陪伴、角色扮演、语言学习和情感支持等多种场景。

Qwen

Qwen-Agent 是基于通义千问模型的开源 Agent 开发框架,支持指令遵循、工具使用、记忆能力、函数调用、代码解释器和 RAG 等功能,能够处理大规模上下文并快速开发复杂 AI 应用。其技术优势包括大语言模型、工具集成、智能代理架构和 RAG 算法,适用于客户服务、个人助理、教育学习、内容创作和技术支持等多个场景。