BAGEL BAGEL是字节跳动开源的多模态基础模型,拥有140亿参数,采用混合变换器专家架构(MoT),通过两个独立编码器捕捉图像的像素级和语义级特征。它能够进行图像与文本融合理解、视频内容理解、文本到图像生成、图像编辑与修改、视频帧预测、三维场景理解与操作、世界导航以及跨模态检索等任务。BAGEL在多模态理解基准测试中表现优异,生成质量接近SD3,并适用于内容创作、三维场景生成、可视化学习和创意广告生成等 AI项目与工具 2025年06月11日 92 点赞 0 评论 142 浏览
Heeyo Heeyo是一款面向3至11岁儿童的智能AI学习伙伴,提供超过2000种互动学习游戏,涵盖阅读、科学、智力问答等领域。这款AI学习伙伴支持20种语言,由顶尖教育机构训练,确保安全和有趣的学习体验。Heeyo能够根据孩子的年龄和兴趣个性化推荐学习内容,孩子们还可以设计自己的AI伙伴,享受定制化的学习体验。Heeyo承诺100%无广告,严格遵守COPPA儿童隐私保护法,让家长能够监控孩子的学习进度。 AI项目与工具 2025年06月12日 82 点赞 0 评论 142 浏览
Skyvern Skyvern是一款基于开源的浏览器自动化工具,集成了大型语言模型和计算机视觉技术,用于实现网页内容解析、交互计划生成及执行。其主要功能涵盖CAPTCHA解决、双因素认证支持、代理网络配置、可解释AI操作以及数据提取等,适用于网站数据抓取、表单填写、网页测试等多种应用场景。 AI项目与工具 2025年06月12日 90 点赞 0 评论 142 浏览
测测 测测是一款专注于星座心理情感分析的问答社区应用,提供星座分析、MBTI性格测试、心理测试及情感交流等功能。用户可通过与AI智能体、社区成员及认证达人的互动,深入了解自我,同时享有全天候心理支持和专业心理沙盘分析服务,助力情绪管理和内心探索。 --- AI项目与工具 2025年06月12日 25 点赞 0 评论 142 浏览
标贝悦读AI配音 标贝悦读作为一个在线文字转语音软件,以其快速、逼真的语音合成效果和丰富的发音人角色,适用于视频配音、美食教程、知识科普、生活妙招分享等多种场景。 Ai语音工具 1970年01月01日 0 点赞 0 评论 142 浏览
Hyper Hyper-SD是由字节跳动研究人员开发的高效图像合成框架,通过轨迹分割一致性蒸馏(TSCD)、人类反馈学习(ReFL)和分数蒸馏等技术,显著降低了扩散模型在多步推理过程中的计算成本。该框架在保持高图像质量的同时,大幅减少了推理步骤,实现了快速生成高分辨率图像,推动了生成式AI技术的发展。 AI项目与工具 2025年06月12日 73 点赞 0 评论 142 浏览
MonkeyOCR MonkeyOCR是由华中科技大学与金山办公联合开发的文档解析模型,能够高效地将非结构化文档内容转换为结构化信息。其支持多种文档类型和语言,处理复杂文档(如公式、表格)效果显著,处理速度达每秒0.84页。基于SRR三元组范式和MonkeyDoc数据集,模型在准确性和效率上表现优异,适用于自动化业务流程、数字存档、智能教育、医疗记录管理及学术研究等场景。 AI项目与工具 2025年06月11日 15 点赞 0 评论 142 浏览
STIV STIV是一款由苹果公司开发的视频生成大模型,具有8.7亿参数,擅长文本到视频(T2V)及文本图像到视频(TI2V)任务。它通过联合图像-文本分类器自由引导(JIT-CFG)技术提升生成质量,并结合时空注意力机制、旋转位置编码(RoPE)及流匹配训练目标优化性能。STIV支持多种应用场景,包括视频预测、帧插值、长视频生成等,适用于娱乐、教育、广告及自动驾驶等多个领域。 AI项目与工具 2025年06月12日 57 点赞 0 评论 142 浏览
Lemon AI Lemon AI 是一款创新的全栈通用 AI Agent,支持从任务需求到成果交付的全流程自动化。它具备独立思考和系统规划能力,能灵活调用多种工具,如编写代码、智能浏览网页等。Lemon AI 擅长分解复杂任务,自动分析、优先排序并动态调整计划,实时跟踪进度,提升工作效率与成果质量。 AI项目与工具 2025年06月11日 87 点赞 0 评论 142 浏览