Parakeet TDT 0.6B Parakeet TDT 0.6B 是一款由英伟达开发的开源自动语音识别(ASR)模型,采用 FastConformer 和 TDT 架构,具备高速转录、高精度识别、歌词转录、文本格式化等功能。模型在 Hugging Face Open ASR Leaderboard 中表现优异,实时因子高达 3386,适用于会议记录、法律医疗、字幕生成及音乐索引等多种场景。 AI项目与工具 2025年06月11日 36 点赞 0 评论 713 浏览
IMGGEN.AI IMGGEN.AI是一款利用先进AI技术的在线图片生成工具,用户可通过文本输入生成高分辨率图片,并享受图像锐化、老照片修复、颜色校正和去模糊等多种功能。该工具操作简便,适用于个人、商业及艺术创作等多个场景,支持免费下载使用。 AI项目与工具 2025年06月12日 80 点赞 0 评论 712 浏览
Voyage Multimodal Voyage Multimodal-3 是一款多模态嵌入模型,能够处理文本、图像以及它们的混合数据,无需复杂文档解析即可提取关键视觉特征。它在多模态检索任务中的准确率显著高于现有最佳模型,支持语义搜索和文档理解,适用于法律、金融、医疗等多个领域的复杂文档检索任务。 AI项目与工具 2025年06月12日 27 点赞 0 评论 712 浏览
FinGPT FinGPT是一款面向金融领域的开源大语言模型,基于自然语言处理技术,支持情感分析、关系提取、标题分类和命名实体识别等多种金融任务。它采用端到端框架,结合低秩适配(LoRA)和基于股价的强化学习(RLSP),实现高效的数据处理与模型优化。适用于投资分析、市场研究、量化交易等多个场景,具备多语言支持和实时数据分析能力,为金融决策提供智能化解决方案。 AI项目与工具 2025年06月12日 23 点赞 0 评论 712 浏览
Imglarger Imglarger是一款利用AI技术的在线图像处理工具,主要功能包括图像放大(最高可达800%)、增强、编辑以及格式转换。它具备AI Uncrop功能,可优化图像视觉效果,并支持多种格式间的无缝转换。此外,Imglarger提供在线编辑工具、批量处理能力和安全保障,适用于摄影、设计、社交媒体内容制作及电子商务等多个领域。 AI项目与工具 2025年06月12日 93 点赞 0 评论 712 浏览
eSearch eSearch是一款基于Electron框架的开源跨平台AI桌面应用,适用于Linux、Windows和macOS系统。它集成了多种功能,包括快速截屏、OCR文字识别、搜索翻译、屏幕录制和屏幕贴图等。凭借简洁的界面和强大的功能,eSearch显著提高了用户在桌面环境中的工作效率,尤其适合教育、办公自动化、设计和内容创作等领域。 AI项目与工具 2025年06月12日 80 点赞 0 评论 712 浏览
ArtHub.ai ArtHub.ai 是一个集合艺术家与设计师的在线社区,专注于展示和分享由人工智能生成的艺术作品。平台具备艺术作品展示、关键词搜索、灵感获取等功能,支持用户上传和分享作品,促进社区互动与交流。此外,它还适用于艺术创作、设计灵感启发、教育学习、内容创作、广告营销以及游戏开发等多个领域。 AI项目与工具 2025年06月12日 71 点赞 0 评论 711 浏览
VideoCaptioner VideoCaptioner是一款基于大语言模型的智能字幕处理工具,支持语音识别、字幕优化、翻译、样式调整及视频合成等功能。无需GPU即可运行,兼容多语言和多种字幕格式,适用于视频创作者、教育工作者及字幕翻译团队,提升字幕制作效率与质量。 AI项目与工具 2025年06月12日 50 点赞 0 评论 711 浏览
SurveyGO卷姬 SurveyGO是一款由清华大学与面壁智能团队联合开发的开源AI论文写作工具,支持根据用户输入的主题快速生成结构清晰、内容详实的综述文章。其核心技术LLMxMapReduce-V2利用文本卷积算法整合多篇文献,提升信息完整性与逻辑性。支持中英文双语输出,适用于科研、教学、行业分析等多种场景,显著提升文献综述的写作效率与质量。 AI项目与工具 2025年06月11日 39 点赞 0 评论 711 浏览
DynaSaur DynaSaur是一个由Adobe Research开发的大型语言模型代理框架,通过动态生成Python代码实现与环境的交互,支持灵活的问题解决。它能够积累生成的动作形成可重用函数库,提高任务效率和适应性。在处理复杂和长期任务时尤为出色,同时适用于多种应用场景,如客户服务、个人助理、软件开发、教育和数据分析等。 AI项目与工具 2025年06月12日 13 点赞 0 评论 711 浏览