网络

VoiceCraft

VoiceCraft是一款开源的神经编解码器语言模型,专攻零样本语音编辑和文本到语音(TTS)任务。它采用Transformer架构,通过token重排过程结合因果掩蔽和延迟叠加技术,实现在现有音频序列内高效生成自然的语音。VoiceCraft在多种口音、风格和噪声条件下表现出色,适用于有声读物制作、视频内容创作、播客音频编辑及多语言内容生产等场景。

飞跨浏览器

专为跨境电商卖家设计的浏览器,飞跨浏览器解决多账号管理、店铺安全、以及跨境操作中遇到的关联问题。

BgSub

BgSub是一个抠图网站,可以帮助用户消除或替换图像背景,BgSub提供了比传统的Photoshop等工具更快速的抠图体验。

Pixian.AI

Pixian.AI是一款基于人工智能的一键抠图工具,特别适合需要快速、高质量处理图片背景的用户。该工具无需订阅,提供高效且经济的解决方案,尤其在Beta测试阶段,用户可以免费使用。...

IAuto

IAuto,专业一站式办公绘图利器,是您职场的好帮手!

Freestyler

Freestyler是一款由多机构合作开发的AI工具,专注于说唱音乐的自动化生成。它通过结合语言模型、条件流匹配技术和神经声码器,实现了从歌词和伴奏到高质量说唱音频的全流程转化。Freestyler还推出了RapBank数据集,并支持零样本音色控制,广泛应用于音乐创作、现场表演、游戏音效及教育等领域。

Semantic Scholar

Semantic Scholar 是一款基于人工智能的科学文献搜索引擎,通过自然语言处理技术理解论文语义,提供精准搜索结果。它具备论文检索、引用网络展示、相关文献推荐及摘要提取等功能,并拥有语义阅读器以优化阅读体验。Semantic Scholar 还为开发者提供API支持,广泛应用于学术研究、教育、跨学科探索和文献综述等领域,助力科研人员提升工作效率。

豆瓣

图书、电影、音乐唱片推荐、评论和价格比较,以及城市独特的文化生活。

LATTE3D

LATTE3D 是由英伟达多伦多AI实验室开发的一种高效生成高质量3D对象的模型。它基于文本描述,能在约400毫秒内生成逼真的3D内容。LATTE3D采用摊销优化方法,增强了对新提示的适应能力。该模型支持文本到3D合成、快速生成、高质量渲染及3D风格化功能,适用于多种应用场景。

Colourlab Ai

Colourlab AI是一款利用人工智能技术的色彩分级软件,专为电影和视频制作设计。它提供自动色彩平衡、神经网络外观匹配、自定义参考等功能,简化工作流程并提升效率。软件支持多种相机品牌,适用于电影制作、纪录片、广告、独立电影及网络内容创作等多种场景。