Gemini Diffusion Gemini Diffusion是谷歌推出的实验性文本扩散模型,通过逐步细化噪声生成文本,具备快速响应、生成更连贯文本和迭代细化等能力。与传统自回归模型不同,它能并行生成文本,提高效率。在外部基准测试中表现优异,速度更快,适用于内容创作、代码生成、数学问题解答和文本编辑等场景。用户需加入等待名单获取访问权限。 AI项目与工具 2025年06月11日 48 点赞 0 评论 814 浏览
Clipconverter clipconverter是一个youtube等在线视频下载工具,能够帮助我们非常方便地下载各个平台的在线视频并保存到本地。 影视资源 2025年06月05日 54 点赞 0 评论 814 浏览
Artroom AI 一个允许用户在AI的帮助下创作艺术的平台。它使用一种称为**稳定扩散**的技术,可以从文本描述中生成逼真且多样化的图像. Ai绘画生成 2025年06月05日 61 点赞 0 评论 815 浏览
Signs Signs是由英伟达推出的AI手语学习平台,通过实时手势识别与3D虚拟教学,帮助用户精准掌握美式手语。平台支持用户上传视频,丰富学习资源,具备互动性与个性化反馈,适用于初学者及进阶学习者,同时为无障碍技术开发提供数据支持。 AI项目与工具 2025年06月12日 69 点赞 0 评论 815 浏览
OSUM OSUM是一款由西北工业大学研发的开源语音理解模型,结合Whisper编码器与Qwen2 LLM,支持语音识别、情感分析、说话者性别分类等多种任务。采用“ASR+X”多任务训练策略,提升模型泛化能力和稳定性。基于约5万小时语音数据训练,性能优异,适用于智能客服、教育、心理健康监测等多个领域。 AI项目与工具 2025年06月12日 46 点赞 0 评论 815 浏览