生成

Fugatto

Fugatto是一款由英伟达开发的音频合成与转换模型,利用增强型Transformer架构实现了从文本到音频的高效转化。它支持多种音频生成任务,如音乐创作、声音效果设计及语音合成,并可通过ComposableART技术实现对声音属性的精细调控。此外,Fugatto擅长生成动态变化的声音景观,广泛应用于音乐创作、声音设计及广告音频制作等领域。

AgentGen

AgentGen是一款由香港大学与微软联合研发的AI项目框架,旨在通过自动生成多样化环境和任务,显著提升大语言模型(LLM)的规划能力。其核心技术包括环境生成、任务生成和动态难度调节,支持零样本生成和指令微调,适用于机器人控制、智能家居等多个领域。

妙鸭相机

妙鸭相机是一款在线生成专业质感大片的AI相机,拥有潮流、时尚、有趣、好玩的风格模板,让你方便快捷地拥有百变照片,掌握引爆朋友圈的流量密码,成为社交圈的时尚先锋!

VDSpeak

一个专注于为YouTube视频提供多语言翻译和配音服务的在线工具,只需输入视频链接,就能快速生成翻译字幕或配音音频。

AutomateClips

AutomateClips是一款人工智能视频生成器,专为社交媒体平台如TikTok、Instagram和YouTube设计,以自动化创建吸引人的视频内容。

MAETok

MAETok是一种基于掩码建模的图像标记化方法,通过自编码器结构学习更具语义丰富性的潜在空间,提升图像生成质量与训练效率。它支持高分辨率图像生成,具备多特征预测能力和灵活的潜在空间设计,适用于娱乐、数字营销、计算机视觉等多个领域。实验表明其在ImageNet数据集上表现优异。

VDraw

VDraw是一款基于AI的信息图表生成工具,可将文本、文档或视频内容快速转换为可视化图形。用户可自定义颜色、字体及品牌元素,支持多格式输入并提供便捷的分享功能。适用于教学、营销、内容创作等领域,提升信息传达效率与视觉效果。

NightCafe Studio

NightCafe Creator是一款AI艺术生成器应用程序,可以让用户使用各种技术创建令人惊叹的AI生成艺术品。它还提供了一个平台供AI艺术爱好者互动社区。

Vibe Draw

Vibe Draw是一款开源AI 3D建模工具,能将2D草图自动转换为高质量3D模型,并支持文本提示优化和模型编辑。用户可一键导出为glTF格式,适用于创意设计、教育、游戏开发等多个领域。工具基于Next.js、React、Three.js、FastAPI等技术,具备高效的实时交互与异步处理能力。

Wiseone

Wiseone是一款集成了先进AI技术的浏览器扩展工具,专注于优化用户的网络搜索与阅读体验。它通过聚焦、交叉检查、提问、总结和探索等功能,帮助用户快速理解复杂信息、验证事实、生成摘要并挖掘相关资源。无论是在学术研究、新闻阅读还是日常学习中,Wiseone均能显著提高效率并确保信息的准确性和可靠性。