生成

MoonCast

MoonCast 是一个零样本播客生成系统,能够从纯文本源合成自然的播客风格语音。它采用长上下文语言模型和大规模语音数据训练,支持中文和英文,生成几分钟长的高质量播客音频。MoonCast 通过特定的LLM提示生成播客脚本,并利用语音合成模块转换为最终音频,具备长音频生成、增强自然性、多语言支持和零样本语音合成等功能。其技术原理包括多阶段训练、短段级别自回归音频重建和自发性增强,适用于内容创作、教

HaiSnap

一个适合小白用户快速开发简单应用的零代码开发平台。用户只需描述需求,即可生成应用并直接通过网页访问,无需部署。

造作AI助手

造作AI助手是一款集成多种AI功能的创作工具,涵盖智能对话、文案生成、视频脚本创作等领域,适用于内容创作、营销策划及企业服务等多个场景。其核心功能包括文章生成、短视频文案编写、社交媒体内容创作等,为企业提供高效、智能化的解决方案。

Open

Open-Sora是一个开源视频生成模型,基于DiT架构,通过三个阶段的训练(大规模图像预训练、大规模视频预训练和高质量视频数据微调),生成与文本描述相符的视频内容。该模型包括预训练的VAE、文本编码器和STDiT(Spatial-Temporal Diffusion Transformer)核心组件,利用空间-时间注意力机制和交叉注意力模块实现视频生成。项目旨在提供全面的视频生成模型训练过程,供

EasyPhoto

EasyPhoto是一个用于生成AI肖像的Webui UI插件,可以用来训练与你相关的数字化替身。

GPT Pilot

GPT Pilot是一款AI编程工具,旨在通过模拟人类开发者的工作流程,帮助从零开始构建应用程序。它能够编写代码、调试程序、与用户讨论问题,并请求代码审查,是真正的AI开发者伙伴。GPT Pilot支持多种运行方式,包括VS Code扩展、命令行工具和Docker容器,使开发者能够在熟悉的环境中提升开发效率。其主要功能包括全功能代码生成、交互式问题解答、高度集成的开发环境、逐步开发、任务分配、开发

AudioBox

Audiobox 是 Meta 推出的 AI 语音和音效工具,结合语音输入和自然语言文字提示词生成语音和音效,例如输入提示词「一条流淌的河流和鸟儿在鸣叫」,Audiobox 自动生成音效。

爱推文

一款漫画小说推文视频创作赚钱利器,爱推文帮助用户将小说推文快速转化成漫画视频解说且原创度高的工具,帮助小说推文作者进行快速变现。

potion

Potion是一款专注于AI视频生成的专业平台,通过深度学习技术实现用户面部表情、声音的精准模拟,支持文本到视频的自动化转换。其主要功能涵盖个性化视频创作、唇形同步、动态视频生成及多场景应用(如销售、营销、教育和客户服务)。产品设计注重效率与灵活性,适合各类企业提升品牌影响力与客户互动效果。