创作

SongGen

SongGen是一款由多家高校和研究机构联合开发的单阶段自回归Transformer模型,能够根据文本生成高质量音乐。它支持混合模式和双轨模式输出,可分别生成人声与伴奏,便于后期编辑。SongGen通过创新的音频标记化和训练策略,显著提升了人声清晰度和音乐自然度。其开源特性及高质量数据集为音乐生成研究提供了新基准,适用于音乐创作、视频配乐、教育辅助等多个领域。

啤啤熊

一款简单易用的AI绘画工具,用户只需输入一段文字,选择相应的主题和风格,啤啤熊即可免费生成精美的图片。

Emu3

Emu3是一款由北京智源人工智能研究院开发的原生多模态世界模型,结合了多模态自回归技术和单一Transformer架构,能够在图像、视频和文本之间实现无缝转换。它不仅能够根据文本生成高质量图像,还能预测视频发展并理解图文内容,广泛应用于内容创作、广告营销、教育、娱乐等多个领域。

团队快剪

团队快剪是由闪剪智能开发的一款专为团队带货打造的AI视频创作系统,集成了爆款脚本库、短视频拍摄模板和商品素材管理功能,旨在帮助本地生活服务商家和品牌提高视频内容创作和团...

Imagen 4

Imagen 4是谷歌推出的最新图像生成AI模型,支持高达2K分辨率的图像生成,具备出色的细节呈现能力,可清晰展示复杂织物纹理、水滴折射及动物毛发质感。其文本渲染能力显著提升,适合广告、漫画等设计场景。支持多种艺术风格,包括超现实、抽象、插图和摄影,满足多样化创作需求。同时,Imagen 4拥有快速生成模式和高效的特征蒸馏技术,提升了生成速度,并已集成到Gemini应用、Google Worksp

Super智能AI知识库

一款可以进行AI机器人角色设定、知识库训练、发布/分享智能体,同时还带有AI智能对话,可以设定多种AI行业场景等强大的功能,拥有强大的第三方对接能力的AI知识库

Vatic AI

Vatic AI 是一款利用先进 AI 技术的视频生成工具,能够将文本快速转化为视频内容,支持移动设备操作,具备一键生成、个性化定制及多平台适配等功能。适用于社交媒体、教育、营销、新闻等多个领域,提升内容创作效率与质量。

Lemon Slice Live

Lemon Slice Live 是一款基于扩散变换器模型(DiT)的实时视频聊天工具,可将图片转化为可互动的动画角色,支持多语言和实时对话。通过优化模型提升流畅度与响应速度,适用于娱乐、教育、营销等多种场景,结合语音识别、文本生成等技术,提供完整的交互体验。

Lumiere

谷歌研究院开发的基于空间时间的文本到视频扩散模型。采用了创新的空间时间U-Net架构,能够一次性生成整个视频的时间长度,确保了生成视频的连贯性和逼真度。

Browseragent

Browseragent是一款基于浏览器的AI自动化工具,支持无代码可视化工作流构建,可在本地运行以保障数据安全。用户可轻松实现文本处理、网页抓取、文件操作等任务,适用于内容创作、电商运营、数据分析等多个场景。通过Chrome扩展便捷访问,降低AI技术使用门槛,提升工作效率。