AI

CoGenAV

CoGenAV是一种先进的多模态学习模型,专注于音频和视觉信号的对齐与融合。通过对比特征对齐和生成文本预测的双重目标进行训练,利用同步音频、视频和文本数据,学习捕捉时间对应关系和语义信息。CoGenAV具备音频视觉语音识别、视觉语音识别、噪声环境下的语音处理、语音重建与增强、主动说话人检测等功能,适用于智能助手、视频内容分析、工业应用和医疗健康等多个场景。

Radiant Photo

Radiant Photo是一款基于AI技术的照片编辑软件,旨在通过智能算法优化照片色彩和细节。它支持手动与自动操作模式,并可作为独立应用或Photoshop/Lightroom插件使用。软件提供多种预设和工具,涵盖专业摄影、肖像修饰、风景摄影及活动记录等场景,助力用户快速提升照片质量并实现个性化定制。

OpenAI Academy

OpenAI Academy是OpenAI推出的免费AI学习平台,提供多样化的课程和直播活动,涵盖从基础到高级的AI技能。课程内容包括AI教学、科研应用、开发者进阶等,适合教育工作者、学生、技术人员及普通学习者。平台还注重AI在公益和社会服务中的实际应用,致力于推动AI技术的普及与落地。

Plandex

Plandex是一个基于终端的开源 AI 编程引擎,可帮助程序员完成复杂的软件编程开发任务、解决不良输出并最大限度地提高生产力。

MotionGo

让PPT动效、动画表达更专业

Veo

Veo是Google DeepMind开发的一款视频生成模型,用户可以通过文本、图像或视频提示来指导其生成所需的视频内容。Veo具备深入的自然语言理解能力,能够准确解析用户的文本提示,生成高质量、高分辨率的视频。其主要功能包括高分辨率视频输出、自然语言处理、风格适应性、创意控制与定制、遮罩编辑功能、参考图像与风格应用、视频片段的剪辑与扩展以及视觉连贯性。Veo技术目前仍处于实验阶段,但已在电影制作

GaussianCity

GaussianCity是由南洋理工大学S-Lab团队开发的高效3D城市生成框架,基于3D高斯绘制技术,采用紧凑的BEV-Point表示方法降低显存和存储需求。其空间感知的BEV-Point解码器可生成高质量3D城市场景,支持多样化视角和实时渲染,适用于游戏、影视、城市规划等领域。相比现有方法,其生成速度提升60倍,兼具高效与高质量特性。

Mem

Mem是一款智能AI笔记应用,支持高效记录笔记,并基于AI技术自动发现笔记之间的关联,帮助用户快速找到所需信息。用户可通过Mem Chat提问,获取精准答案、总结会议要点或生成内容。Mem具备智能搜索、自动整理笔记、实时同步等功能,支持离线使用和多种格式输入,适用于创业者、高管和创意人士,提升工作效率与知识管理能力。

ToolBaz

ToolBaz 是一款多功能的 AI 创作平台,涵盖文章撰写、故事生成、图像与视频制作、语音合成及代码编写等功能,旨在通过人工智能技术简化创作过程,提升内容质量和效率。无论是营销文案、社交媒体帖子还是产品描述,ToolBaz 都能快速生成高质量的结果,同时支持跨领域应用,如品牌宣传、客户服务和教育培训等。