ResAdapter ResAdapter是一种专为扩散模型设计的分辨率适配器,允许图像生成模型生成任意分辨率和宽高比的图像,同时保持原始风格。其主要功能包括分辨率插值、分辨率外推、域一致性、即插即用设计以及广泛的兼容性。通过在扩散模型中插入ResCLoRA和引入ResENorm,ResAdapter能够在不影响模型风格的情况下扩展其分辨率范围。 AI项目与工具 2024年01月01日 70 点赞 0 评论 397 浏览
Kiroku Kiroku是一款基于多智能体系统的写作辅助工具,通过模拟导师与学生的互动模式,帮助用户高效组织和撰写文档。其支持用户自定义文档结构,并利用自然语言处理和机器学习技术提供个性化建议,特别适用于学术、商业和技术领域的需求。 AI项目与工具 2025年06月12日 44 点赞 0 评论 397 浏览
mPLUG mPLUG-Owl3是一款由阿里巴巴开发的多模态AI模型,专注于理解和处理多图及长视频内容。该模型具备高推理效率和准确性,采用创新的Hyper Attention模块优化视觉与语言信息的融合。它已在多个基准测试中展现出卓越性能,并且其源代码和资源已公开,可供研究和应用。 AI项目与工具 2025年06月12日 73 点赞 0 评论 397 浏览
The Language of Motion The Language of Motion是一款由斯坦福大学李飞飞团队开发的多模态语言模型,能够处理文本、语音和动作数据,生成对应的输出模态。该模型在共同语音手势生成任务上表现出色,且支持情感预测等创新任务。它采用编码器-解码器架构,并通过端到端训练实现跨模态信息对齐。The Language of Motion广泛应用于游戏开发、电影制作、虚拟现实、增强现实及社交机器人等领域,推动了虚拟角色自 AI项目与工具 2025年06月12日 100 点赞 0 评论 397 浏览
Versatile Versatile-OCR-Program是一款开源多模态OCR工具,支持从教育材料中提取文本、公式、表格等结构化数据,输出为JSON或Markdown格式,准确率高达90%-95%。它基于DocLayout-YOLO、Google Vision和MathPix等技术,支持多语言处理,适用于教育数据集制作、教学辅助、AI模型训练及个人学习等场景。 AI项目与工具 2025年06月11日 77 点赞 0 评论 398 浏览
重磅!百度今日上线搜索AI伙伴,用户可免费进行对话、AI绘画和其他内容创作 百度搜索AI伙伴是一款基于文心大模型的AI搜索对话工具,允许用户通过AI进行对话、创作及其他活动。它提供了多种功能,如AI绘画、AI创作、AI趣味、AI职场效率工具和命理情感服务,旨在为用户提供全面的AI体验。 AI项目与工具 2023年01月01日 74 点赞 0 评论 398 浏览
TIP TIP-I2V是一个包含大量真实文本和图像提示的数据集,专为图像到视频生成领域设计。它涵盖了超过170万个独特的提示,并结合多种顶级图像到视频生成模型生成的视频内容。该数据集支持用户偏好分析、模型性能评估以及解决错误信息传播等问题,有助于推动图像到视频生成技术的安全发展。 AI项目与工具 2025年06月12日 23 点赞 0 评论 398 浏览
闪令 闪令是一款基于AI技术的互动内容社交平台,专为年轻用户打造。它提供高自由度的角色扮演和多种剧情体验,涵盖古风、同人、穿越等类型。平台特色在于其有声互动功能,拥有43种音色及丰富组合方式,并支持语音输入,增强用户体验的真实感。此外,闪令通过AI模型适配各类剧情场景,为用户提供无限结局与故事线,同时支持社交互动、创意写作等功能。 AI项目与工具 2025年06月12日 24 点赞 0 评论 398 浏览
Wysa Wysa 是一款基于AI技术的心理健康支持平台,提供匿名情绪管理与心理疏导服务。结合CBT等科学方法,帮助用户缓解焦虑、压力等问题,支持24/7在线服务和个性化护理。功能涵盖心理健康工具库、危机干预、企业支持等,适用于个人、企业及医疗机构,具备高隐私性与广泛适用性。 AI项目与工具 2025年06月12日 42 点赞 0 评论 398 浏览
Laminar Laminar是一款面向大型语言模型(LLM)的开源可观测性和分析平台,具备自动追踪LLM调用与数据库交互、事件驱动分析及数据标注等功能,同时支持高效的数据存储与可视化展示。其目标是提升LLM应用的透明度和效率,适用于开发调试、性能监控、用户体验优化及业务决策支持等多个场景。 AI项目与工具 2025年06月12日 98 点赞 0 评论 398 浏览