AI

LDGen

LDGen是一款结合大型语言模型与扩散模型的文本到图像生成工具,支持零样本多语言生成,提升图像质量和语义一致性。通过分层字幕优化、LLM对齐模块和跨模态精炼器,实现文本与图像的高效交互。实验表明其性能优于现有方法,适用于艺术创作、广告设计、影视制作等多个领域,具备高效、灵活和高质量的生成能力。

书生·筑梦2.0(Vchitect 2.0)

书生·筑梦2.0是一款由上海人工智能实验室开发的开源视频生成大模型,支持文本到视频和图像到视频的转换,生成高质量的2K分辨率视频内容。它具备灵活的宽高比选择、强大的超分辨率处理能力以及创新的视频评测框架,适用于广告、教育、影视等多个领域。

Modeli.ai

一个旨在使用AI模型为时尚产品优化和替代传统的拍照流程的AI模特生成工具。

通义听悟

全文概要、章节速览、发言总结等高阶AI功能,并获赠使用权益。阿里云推出的一款聚焦音视频内容的工作学习AI助手,接入了阿里大模型。它主要提供实时语音转写、文件转写、实时翻译...

URO

URO-Bench 是一个面向端到端语音对话模型的综合评估工具,支持多语言、多轮对话及副语言信息处理。它包含基础和高级两个赛道,分别涵盖16个和20个数据集,覆盖开放性问答、情感生成、多语言任务等。支持多种评估指标,提供简单易用的评估流程,并兼容多种语音对话模型。适用于智能家居、个人助理、语言学习等多个实际应用场景。

医真AI+

医真AI+自成立以来,专注于医疗影像、超声、内镜、核医学、病理等全医技医疗大数据底层核心技术的自主研发及应用,在医技业务、医技大数据应用、协同、科研、运营、百姓感知及人工...

掌桥科研

掌桥科研是一款面向科研人员的综合性平台,集文献检索、翻译转换、科技查新、引证分析等功能于一体。平台拥有海量中英文文献资源,支持多语言处理,并提供AI辅助工具,如选题建议、论文综述生成等,助力科研效率提升与成果管理。

替我做图

替我做图是一款基于AI技术的图像生成平台,提供人台图、真人图、假发图、物品图等多样化服务,支持真人换脸及产品展示图优化,广泛应用于电商、社交媒体营销、广告制作等领域,助力提升品牌形象和营销效果。

Eduwriter.ai

一种开创性论文写作工具,可以帮助学生毫不费力地撰写复杂的论文。通过选择主题、论文类型、主题领域和所需的页数,在几秒钟内轻松撰写一篇独特的论文。