
AI人工智能
bingdada
OpenAI 发布 FrontierScience 基准:评估 AI 在科学研究中的深度推理能力
OpenAI 发布 FrontierScience 基准测试,评估 AI 在物理、化学和生物领域的专家级科学推理能力。GPT-5.2 在奥林匹克轨道得分 77%,研究轨道得分 25%,展示了 AI 加速科学研究的潜力与局限。
2026-08-0249约 5 分钟阅读
浏览所有关于 SEO、GEO 和搜索优化的技术文章

OpenAI 发布 FrontierScience 基准测试,评估 AI 在物理、化学和生物领域的专家级科学推理能力。GPT-5.2 在奥林匹克轨道得分 77%,研究轨道得分 25%,展示了 AI 加速科学研究的潜力与局限。