工具

Kotaemon

Kotaemon 是一款基于RAG技术的开源工具,支持用户通过自然语言与文档进行互动,从而实现高效的信息检索和理解。它支持多种语言模型,包括OpenAI、Azure OpenAI和Cohere等,提供简易的安装脚本。Kotaemon 还支持多用户协作、文档管理和复杂的推理方法,并允许用户自定义UI元素。其主要功能包括基于RAG技术的问答系统、多语言模型支持、文档管理、混合RAG管道、多模式问答支持

PaneFlow

一款所见即所得的PPT制作工具,它采用拖拽式界面,用户可以通过简单操作添加文本、图片、视频等元素,并利用内置模板和即时预览功能快速调整布局与动画效果。

BlockDance

BlockDance是由复旦大学与字节跳动联合开发的扩散模型加速技术,通过识别结构相似的时空特征(STSS)减少冗余计算,提升推理效率达25%-50%。结合强化学习的BlockDance-Ada模块实现动态资源分配,平衡速度与质量。适用于图像、视频生成及实时应用,支持多种模型,兼顾高效与高质,适用于资源受限环境。

SongCreator

SongCreator是一款基于AI技术的音乐生成工具,由清华大学深圳国际研究生院与香港中文大学等机构联合开发。它采用双序列语言模型(DSLM)和注意力掩码策略,支持歌词到歌曲、歌词到声乐、伴奏到歌曲等多种音乐生成任务,并允许用户灵活调整生成内容的声学特性。SongCreator适用于音乐制作、教育、娱乐、内容创作等多个领域,为用户提供高效便捷的音乐解决方案。

CreatorKit AI

CreatorKit 的 AI 照片工具彻底改变了企业的产品摄影,为创建高质量图像提供了无缝且经济高效的解决方案。CreatorKit直接与 Shopify 集

Agent TARS

Agent TARS 是字节跳动推出的开源多模态 AI 代理工具,支持浏览器、命令行和文件系统的集成,实现复杂任务的自动化执行。其核心功能包括代理工作流、数据处理、代码生成与解释等。基于事件流和模型上下文协议(MCP),Agent TARS 能高效分解任务并实时反馈结果,适用于网页自动化、任务管理、数据分析和代码辅助等多种场景。目前支持 macOS 平台,处于技术预览阶段。

DragAnything

DragAnything 是一款由快手与高校联合研发的视频生成工具,通过实体表示和轨迹输入实现对视频中物体的精确运动控制。它支持多实体独立操作、相机运动调整,并采用扩散模型生成高质量视频内容。具备用户友好的交互方式,适用于视频编辑、游戏开发、教育及广告等多个场景。

Largo

Largo是一个基于AI技术的影视内容开发平台,通过分析海量影视数据为制片人、发行方和工作室提供数据驱动的洞察和决策支持。其核心功能包括剧本分析、角色与选角建议、财务预测、品牌测试以及项目与融资匹配,帮助优化制作流程、降低风险并提升内容吸引力。

码多多

为多元行业提供智能化AI服务的先行者 码多多是一个技术团队,专注提供AI系统的源代码解决方案。

SUAPP AI

SUAPP AI是一款面向建筑设计行业的AI工具,支持图生图、文生图、图生视频、图片建模及AI对话等功能,提升设计效率与表现力。结合SketchUp平台,提供插件扩展与沉浸式体验,适用于建筑、室内及景观设计场景,助力设计师快速生成高质量成果并优化设计方案。