评分
PaperBench
PaperBench是OpenAI开发的AI智能体评测基准,用于评估其复现顶级机器学习论文的能力。它涵盖从理解论文、编写代码到执行实验的全流程,具备8316个评分节点和自动评分系统。支持多种智能体配置,提供标准化测试环境,适用于模型优化、学术验证及教育实践等领域,推动AI研究的标准化发展。
StoriesForKids AI
StoriesForKids.ai 是一款使用AI为孩子们创建个性化的故事和插图工具。这是一种与孩子一起阅读和创作的有趣而简单的方法。