生成

万兴天幕大模型

万兴天幕大模型是万兴科技AILab的创新成果,展现了其在多媒体领域的深厚技术积累和前瞻性布局。通过自研技术和多年行业经验,天幕大模型为全球创作者提供了一个强大的工具,以实现...

特创易·云

特创易·云是一款集合了智能在线LOGO生成设计和设计模版的工具。

Fronty AI

Fronty AI,将设计图转换为HTML CSS,世界上第一个设计图到 HTML转换器,人工智能驱动的工具,可在几分钟内创建一个网站。

Video

Video-LLaVA2是一款由北京大学ChatLaw课题组开发的开源多模态智能理解系统。该系统通过时空卷积(STC)连接器和音频分支,显著提升了视频和音频的理解能力。其主要功能包括视频理解、音频理解、多模态交互、视频问答和视频字幕生成。时空建模和双分支框架是其核心技术原理。Video-LLaVA2广泛应用于视频内容分析、视频字幕生成、视频问答系统、视频搜索和检索、视频监控分析及自动驾驶等领域。

DistriFusion

DistriFusion是一个专为加速高分辨率扩散模型在多GPU环境中生成图像的分布式并行推理框架。通过将图像分割成多个小块并分配至不同设备上进行独立处理,它能够在不增加额外训练负担的情况下,将推理速度提升高达六倍,同时保持图像质量。其技术原理包括Patch Parallelism(分片并行)、异步通信、位移补丁并行性等,适用于多种现有的扩散模型。应用场景包括AI艺术创作、游戏和电影制作、VR/A

rtrvr.ai

rtrvr.ai 是一款基于自然语言交互的 AI 浏览器扩展工具,支持网页自动化操作、多标签页任务处理及数据提取导出功能。用户可通过指令完成表单填写、信息对比、图表生成等任务,同时支持与 Google Sheets 和 Slack 等工具集成,提升工作效率。该工具注重数据安全,采用沙盒技术保障隐私。

Reading Coach

通过AI驱动的故事和个性化练习吸引学生并提高阅读流畅度。

一键LOGO设计

一键logo设计是一款智能的在线生成Logo的网站。它根据AI大数据计算,只需输入Logo名称、口号或标题,选择心仪的行业或风格、配色、字体,即可一键生成专属的logo标志。

PixarAI

PixarAI 一个可以为您喜欢的角色或宠物生成迪士尼皮克斯风格海报的网站 链接传送门->https://www.pixarai.com PixarAI

Fugatto

Fugatto是一款由英伟达开发的音频合成与转换模型,利用增强型Transformer架构实现了从文本到音频的高效转化。它支持多种音频生成任务,如音乐创作、声音效果设计及语音合成,并可通过ComposableART技术实现对声音属性的精细调控。此外,Fugatto擅长生成动态变化的声音景观,广泛应用于音乐创作、声音设计及广告音频制作等领域。