AR

Pippo

Pippo是由Meta Reality Labs研发的图像到视频生成模型,可基于单张照片生成多视角高清人像视频。采用多视角扩散变换器架构,结合ControlMLP模块与注意力偏差技术,实现更丰富的视角生成和更高的3D一致性。支持高分辨率输出及细节自动补全,适用于虚拟现实、影视制作、游戏开发等多个领域。技术方案涵盖多阶段训练流程,确保生成质量与稳定性。

6Pen Art

支持多种模型和中文描述,不保留版权,不保留数据。6Pen为用户提供了一个强大且易于使用的AI绘画平台,适合需要进行创意绘画和视觉设计的个人或专业人士。

SupaRes

SupaRes 是一个使用人工智能 (AI) 来增强图像的平台。它可以提高您上传的任何图像的质量、分辨率和清晰度。

SpatialLM

SpatialLM 是一款由群核科技推出的开源空间理解多模态模型,能通过分析普通手机拍摄的视频生成详细的 3D 场景布局,涵盖房间结构、家具摆放等信息。它结合大语言模型与点云重建技术,实现空间认知与语义标注,并支持低成本数据采集。该模型适用于具身智能训练、AR/VR、建筑设计等多个领域,具备物理规则嵌入和结构化场景生成能力。

E言易图

E言易图,基于Apache Echarts的数据洞察和图表制作、文心一言里一款强大的数据可视化插件,目前支持柱状图、折线图、饼图、雷达图、散点图、漏斗图、思维导图等。

AIvatar

Aivatar是一款优秀的AI头像小程序,用户可以把自己的或者自己猫狗的照片上传上去然后生成一些好看的或者独特且个性化的头像。

NeuraPress

一款专注于微信公众号排版的Markdown编辑器,支持移动端,搭配DeepSeek和微信公众号助手,利用碎片化时间,通过手机就能编辑并发布带有排版效果的公众号文章。

DL4J

DL4J开源的使用JVM部署和训练...

Indic Parler

Indic Parler-TTS 是一款由 Hugging Face 与 AI4Bharat 联合开发的多语言文本到语音模型,支持 20 种印度语言和英语,提供 69 种独特语音。该模型基于深度学习架构,通过描述性文本输入实现对音调、语速、情感等参数的灵活控制,适用于多种语音合成场景。在低资源语言上表现优异,具备高自然度和清晰度的语音输出能力。

密歇根大学安娜堡分校

密歇根大学安娜堡分校(University of Michigan, Ann Arbor),也译作密西根大学安娜堡分校,于1817年建校 ,是密歇根大学系统的旗舰校区。因此通常“密歇根大学”就能代指“密歇根大...