生成

AIMv2

AIMv2是苹果公司开发的开源多模态自回归预训练视觉模型,通过图像与文本的深度融合提升视觉理解能力。其采用图像块与子词标记拼接的方式进行自回归预训练,支持多种参数规模,适用于不同设备。具备视觉问答、指代表达理解、图像字幕生成、多媒体检索等功能,并可无缝集成到大型语言模型中。模型在多个视觉任务中表现优异,具备良好的可扩展性和零样本适应能力。

Videotoword.ai

Videotoword.ai 是一款以AI驱动的在线服务,支持将音频和视频文件转化为文本,具有高精度(99.9%)和多语言支持(98种以上)。它能处理长达10小时的文件,具备自动转录、文本编辑导出及AI摘要生成功能,广泛应用于教育、媒体、法律和企业等领域。

ZMO.AI

ZMO.AI 是一款多功能的 AI 图像生成与编辑平台,支持文本或图片输入生成艺术作品、动漫、照片等,具备照片编辑、背景更换、风格迁移等功能。适用于电商、社交媒体、广告设计、数字艺术等领域,帮助用户高效创作高质量视觉内容。

FunAudioLLM

FunAudioLLM是由阿里巴巴通义实验室开发的开源语音大模型项目,包含SenseVoice和CosyVoice两个子模型。SenseVoice擅长多语言语音识别和情感辨识,支持超过50种语言;CosyVoice则专注于自然语音生成,支持多种语言、音色和情感控制。该项目适用于多语言翻译、情感语音对话等场景,其相关模型和代码已公开发布。

Xmind AI

Xmind AI是一款功能强大的思维导图和头脑风暴软件,它通过直观的可视化方式帮助用户组织、管理和扩展思路。Xmind支持多种图表类型,让用户能够以最适合自己的方式捕捉创意和规划项...

NightCafe

NightCafe是一款基于人工智能技术的在线艺术生成平台,支持用户通过文本描述或图片生成多样化的艺术作品。平台提供多种算法(如Stable Diffusion、DALL-E 2等),支持风格迁移与图像增强,并拥有活跃的社区功能,用户可分享作品、参与挑战及互动交流。此外,NightCafe还支持将艺术作品打印为实体形式。

FutureKid

FutureKid是一款基于AI技术预测孩子未来长相的应用,通过分析父母面部特征生成逼真图像。它支持个性化定制,注重隐私保护,确保数据安全。适用于家庭规划、婚礼纪念及创意设计等多种场景,提供简单高效的用户体验。

a0.dev

a0.dev 是一款基于 AI 技术的 React Native 开发平台,可通过自然语言输入生成完整的应用代码,涵盖前端界面、状态管理、路由配置和后端云函数。支持组件级控制、云端开发、自动配置等功能,显著提升开发效率,适用于创意验证、MVP 构建和企业技术探索。

libcom

libcom是一款由上海交通大学BCMI实验室开发的图像合成工具箱,支持图像融合、和谐化、阴影生成、对象放置及生成式合成等功能,采用传统图像处理与深度学习技术相结合的方式,提供高质量的合成图像解决方案。适用于增强现实、艺术创作、电子商务、影视制作及游戏开发等多个领域。

讯飞星火PC版

讯飞星火PC版是科大讯飞推出的一款桌面级AI工具,集成了强大的跨领域知识理解和语言处理能力。它支持自然对话方式,涵盖写作、搜索、问答、翻译、PPT生成、图像生成等功能,并新增了深度搜索与多模态交互能力,可广泛应用于办公、教育、内容创作和技术开发等领域,提供高效便捷的智能服务。