AI

LatentSync

LatentSync是由字节跳动与北京交通大学联合研发的端到端唇形同步框架,基于音频条件的潜在扩散模型,无需中间3D或2D表示,可生成高分辨率、动态逼真的唇同步视频。其核心技术包括Temporal Representation Alignment (TREPA)方法,提升视频时间一致性,并结合SyncNet监督机制确保唇部动作准确。适用于影视制作、教育、广告、远程会议及游戏开发等多个领域。

秘塔翻译

秘塔翻译,专业的AI法律翻译,专为法律人训练的机器翻译系统.。

万卷

万卷是一个个人掌上AI助理,它能帮助你处理很多生活中的问题

Ymiai论文写作

毕业季将至,很多同学是不是都在为论文抓狂? 既要白天上班实习 又要晚上熬夜改论文,写实习报告...... 每天都焦虑的苦不堪言,但不要慌,今天我将手把手教大家如何利用Ymiai快速完成论文写作, 帮你攻克这个难题。

象寄AI

专注商业视觉内容的智能生成,一键生成高质量商品图, 为商家提供全新的图像生产方式

Edicho

Edicho 是一种基于扩散模型的图像编辑工具,能够在多图像间实现一致性编辑,无需额外训练。其核心技术包括 Corr-Attention 注意力模块和 Corr-CFG 去噪策略,通过显式图像对应关系提升编辑质量与一致性。适用于图像修复、风格转换、内容创作、医学影像增强等场景,具备良好的兼容性与扩展性。

Aishort

AIShort 提供一份简便的 ChatGPT 指令列表,可迅速筛选和查询适应各种场景的提示词,从而帮助用户精简操作过程,并提供了浏览器插件方便直接调用。

FUZZ

由Riffusion推出的一款基于扩散模型(Diffusion Model)的全新音乐生成模型,该工具能够通过“想象”生成音频的声谱图(Spectrogram),然后将其转换为音频。

VectorVein

VectorVein 是一款开源的无代码AI工作流工具,通过简化拖拽操作,使用户无需编程知识即可构建智能工作流,实现日常任务的自动化。它支持数据处理、分析和知识管理等多种应用场景,具备无代码、AI驱动和可定制化等特点。VectorVein 旨在降低AI应用的门槛,提升个人和团队的工作效率,并提供本地部署和开源选项,以满足不同用户的数据安全和隐私需求。

Moondream

Moondream是一款小型的开源人工智能视觉语言模型,具有强大的图像处理能力和灵活性,能够在不同设备上运行。它基于Apache 2.0许可证,支持商业使用,并广泛应用于安全监控、无人机和机器人技术以及零售与购物领域。