AI

Ola

Ola是一款由多机构联合开发的全模态语言模型,支持文本、图像、视频和音频等多种输入形式。通过渐进式模态对齐策略,逐步扩展模型的多模态理解能力,同时采用流式解码技术提升交互体验。其架构融合多种编码器与解码器,结合局部-全局注意力机制,实现高效多模态处理,在多项任务中表现优异。

Video Dubbing

一款具有语音克隆和口型同步功能的AI视频翻译器,可以将视频中的语音转换成多种不同的语言,同时保持与原始视频的音频同步。

达医智影

阿里巴巴达摩院医疗AI实验室自研的智能读片产品。它通过常规的胸部、腹部CT平扫,结合AI技术,帮助医生进行疾病筛查、诊断、治疗和随访。

Notiv

Notiv是一款面向学生的AI学习工具,可自动分析笔记并生成复习题、抽认卡和重点总结,提升学习效率。它提供个性化学习建议,支持快速备考模式,并具备智能总结和互动式学习功能,适用于日常学习、在线课程及团队协作等场景。

Dubbingx

全球唯一、多情绪、多语态、全可控的AI配音产品

Praktika

Praktika是一款基于AI技术的语言学习应用,通过高度逼真的虚拟人物提供沉浸式口语练习,帮助用户提升语言流利度与自信心。平台提供个性化学习路径、丰富多样的课程内容及实时反馈功能,涵盖基础语法、商务英语、考试准备等主题,适用于不同学习目标和兴趣场景,是高效语言学习的优质选择。

DesignEdit

DesignEdit是一个由微软亚洲研究院和北京大学的研究人员共同开发的AI图像编辑框架。它采用了多层潜在分解和融合技术,能够实现对象移除、移动、调整大小、翻转、相机平移和缩放等复杂图像编辑任务。DesignEdit还支持跨图像元素的组合,特别适用于设计图像和海报的编辑。通过关键掩码自注意力机制和伪影抑制方案,DesignEdit能够在不破坏图像整体连贯性的情况下,实现高精度的空间感知图像编辑。

Seaweed APT

Seaweed APT是字节跳动研发的对抗性后训练模型,支持图像和视频的一站式生成。其通过在真实数据上进行对抗性训练,实现单步高质量输出,包括1024px图像和1280×720、24fps视频。该模型采用先进的生成器和判别器设计,结合近似R1正则化技术,提升训练稳定性和生成质量。适用于视频广告、影视创作、社交媒体等内容生产场景。

RestorePhotos

一款人工智能驱动的工具,它使用先进的算法来修复和恢复损坏的旧照片。它可以去除划痕、撕裂、斑点和褪色,甚至可以为黑白照片着色。让旧记忆重获新生。

FillDream

一款基于人工智能的图像修改工具,允许用户通过输入提示来填充和修改图像。