音频

QuickRecorder

一款基于ScreenCapture Kit for macOS的轻量级录屏工具/基于 ScreenCapture Kit的多功能、轻量化、高性能的开源macOS屏幕录制工具。

FLOAT

FLOAT是一款基于音频驱动的虚拟人像生成模型,利用运动潜在空间和流匹配技术,实现时间一致性视频生成。它支持情感增强,生成自然且富有表现力的虚拟人物,广泛应用于虚拟主播、视频会议、社交媒体、游戏以及电影制作等多个领域,同时具备高效的采样和生成能力。

Audio Enhancer

一个在线音频增强工具,Audio Enhancer使用人工智能算法来帮助用户轻松地减少音频文件中的背景噪音,用于改善音频录音的清晰度和整体质量。

Fineshare FineCut

Fineshare FineCut是一款功能全面的音频编辑工具,支持音频修剪、合并、格式转换、降噪、音量调整等功能。它适用于音乐制作、播客、视频编辑等多种场景,提供高效的音频处理解决方案。用户可通过其简洁的界面轻松完成复杂操作,满足专业与日常使用需求。

OmniHuman

OmniHuman是字节跳动推出的多模态人类视频生成框架,基于单张图像和运动信号生成高逼真视频。支持音频、姿势及组合驱动,适用于多种图像比例和风格。采用混合训练策略和扩散变换器架构,提升生成效果与稳定性,广泛应用于影视、游戏、教育、广告等领域。

voice.ai

voice.ai的使命是通过普及人工智能技术,增强协作创造力,并允许社区重新定义音频表达方式。公司相信人工智能应该是易于接近、对所有人开放且富有趣味的。

歌词AI鉴赏

用AI的力量理解你最喜欢的歌曲,发现音乐的美妙和感动

Lalalai

Lalalai啦啦爱,人声去除器和AI智能伴奏分离器,使用人工智能去除人声并进行音源分离,快速、简单、精确地提取词干(人声/伴奏)

HunyuanCustom

HunyuanCustom是腾讯混元团队开发的多模态视频生成框架,支持图像、音频、视频和文本等多种输入条件,生成高质量定制化视频。采用文本-图像融合与图像ID增强技术,提升身份一致性和视频真实性。适用于虚拟人广告、虚拟试穿、视频编辑等场景,具备音频驱动和视频驱动两种生成方式,展现强大可控性与灵活性。

TurboScribe Ai

一项语音AI转文字服务,提供无限音频和视频转录。TurboScribe Ai可以将音频和视频文件转换为98+种语言的文本,准确率极高。