LanDiff LanDiff是一种结合自回归语言模型和扩散模型的文本到视频生成框架,采用粗到细的生成策略,有效提升语义理解与视觉质量。其核心功能包括高效语义压缩、高质量视频生成、语义一致性保障及灵活控制能力。支持长视频生成,降低计算成本,适用于视频制作、VR/AR、教育及社交媒体等多个领域。 AI项目与工具 2025年06月12日 92 点赞 0 评论 286 浏览
LongVU LongVU是一款由Meta AI团队研发的长视频理解工具,其核心在于时空自适应压缩机制,可有效减少视频标记数量并保留关键视觉细节。该工具通过跨模态查询与帧间依赖性分析,实现了对冗余帧的剔除及帧特征的选择性降低,并基于时间依赖性进一步压缩空间标记。LongVU支持高效处理长视频,适用于视频内容分析、搜索索引、生成描述等多种应用场景。 AI项目与工具 2025年06月12日 65 点赞 0 评论 280 浏览
HiCompress 一个在线图片压缩和转换工具,支持PNG,WEBP图片无损压缩,支持将JPG, JPEG, PNG, WEBP, TIF, DDS, AVIF, PSD, HEIC,RAW, JFIF等几十种图片格式转换成PG, JPEG, PNG图片。 格式转换 2025年06月05日 52 点赞 0 评论 275 浏览
SANA 1.5 SANA 1.5是由英伟达联合多所高校研发的高效线性扩散变换器,专用于文本到图像生成任务。其核心优势包括高效的训练扩展、模型深度剪枝、推理时扩展等技术,能够在不同计算预算下灵活调整模型性能。支持多语言输入,并具备开源特性,适用于创意设计、影视制作、教育等多个领域。实验表明,其生成质量接近行业领先水平,同时显著降低计算成本。 AI项目与工具 2025年06月12日 56 点赞 0 评论 272 浏览
PDFtoPDF PDFtoPDF是一款基于AI和OCR技术的PDF转换工具,支持高精度文字识别(准确率达99.5%),并能保留原始文档排版。具备多语言支持、文件压缩、跨平台使用及翻译功能,适用于学术、办公、教育和个人文档管理等多种场景,显著提升文档处理效率与便捷性。 AI项目与工具 2025年06月12日 51 点赞 0 评论 269 浏览
IlovePdf IlovePdf,免费丰富的PDF处理工具,完全免费、易于使用、IlovePdf功能包括:合并、拆分、压缩、转换、旋转和解锁PDF文件,以及给PDF文件添加水印的工具等。 格式转换 2025年06月05日 50 点赞 0 评论 262 浏览