AI项目与工具

LDGen

LDGen是一款结合大型语言模型与扩散模型的文本到图像生成工具,支持零样本多语言生成,提升图像质量和语义一致性。通过分层字幕优化、LLM对齐模块和跨模态精炼器,实现文本与图像的高效交互。实验表明其性能优于现有方法,适用于艺术创作、广告设计、影视制作等多个领域,具备高效、灵活和高质量的生成能力。

DeepEyes

DeepEyes是由小红书团队和西安交通大学联合开发的多模态深度思考模型,基于端到端强化学习实现“用图思考”能力,无需依赖监督微调。它在推理过程中动态调用图像工具,增强对细节的感知与理解,在视觉推理基准测试V* Bench上准确率高达90.1%。具备图像定位、幻觉缓解、多模态推理和动态工具调用等功能,适用于教育、医疗、交通、安防和工业等多个领域。

AnyCharV

AnyCharV是一款由多所高校联合研发的角色可控视频生成框架,能够将任意角色图像与目标场景结合,生成高质量视频。它采用两阶段训练策略,确保角色细节的高保真保留,并支持复杂的人-物交互和背景融合。该工具兼容多种文本生成模型,具备良好的泛化能力,适用于影视制作、艺术创作、虚拟现实等多个领域。

Hunyuan3D

Hunyuan3D-1.0 是腾讯推出的一款3D生成模型,支持文本和图像输入生成高质量3D资产。该模型采用两阶段方法,包含轻量版和标准版,具有快速生成和高质量重建的特点,广泛应用于3D创作、工业设计、建筑设计等领域。

鱼鳞智慧脑图

鱼鳞智慧脑图是一款AI驱动的思维导图工具,可将文本、网页链接、PDF和Word文件自动转换为结构化导图,提升信息整理效率。支持主题扩展、在线协作与多格式导出,适用于学习、研究、项目管理等场景,操作简便,适合各类用户使用。

ChatLearn

ChatLearn是一款由阿里云开发的高效对齐训练框架,支持多种对齐训练方法,包括RLHF、DPO、OnlineDPO和GRPO。它提供灵活的编程接口、资源调度机制和分布式计算支持,适用于自动化对话系统训练及复杂多模型训练场景。用户可以自定义模型执行流程,实现个性化训练策略。

AopsAI

AopsAI是一款基于AI技术的照片动画化工具,能将静态照片转化为动态短视频,重现历史瞬间。用户无需注册,仅需上传照片并提供邮箱,即可在24小时内获取视频。支持多种图片格式,操作便捷,适用于个人回忆、商业展示及活动宣传等多种场景。

Retake

Retake是一款基于人工智能技术的照片编辑和修复应用程序,主要功能包括超分辨率放大、低清人像修复、超级降噪、低光照增强和人像动漫化等。其所有AI计算均在本地进行,保障了用户的数据安全和隐私。Retake支持用户上传多张照片,通过AI分析和合成,生成高质量的照片,适用于摄影爱好者、专业摄影师、设计师、普通用户以及历史照片修复者等多种用户群体。

Medio.cool

Medio.cool是一款面向企业海外市场的AI视频编辑工具,提供视频水印去除、商品翻译、商品解说视频自动生成等功能。它支持多语言翻译,涵盖超过100种国际语言,并能一键下载4K高清原视频,适用于YouTube、TikTok等多个平台,助力企业高效实现全球化推广。

Endex

Endex是一款面向金融行业的智能平台,基于生成式AI技术提供金融数据分析、文档处理、市场预测、交易策略优化等服务。其核心产品包括Nova自主金融分析师和Forge AI原生编排层,能够提升金融工作的效率和准确性。适用于金融文档分析、风险识别、报告生成、智能客服及财富管理等多个场景,具备高度自动化和智能化能力。