
OpenAI News报道,GPT-5.5 Instant在健康智能方面取得突破,每周服务超2.3亿用户。通过医生主导评估,模型在识别紧急情况、解释不确定性等方面显著提升,性能媲美前沿Thinking模型,且对免费用户开放。
2026年6月18日 — 产品更新 — OpenAI News 报道:健康领域是用户使用ChatGPT最有意义的场景之一。每周,超过2.3亿人通过ChatGPT寻求健康与保健问题的帮助,包括解读健康信息、理解化验结果、准备就诊、处理保险事宜、养成健康习惯,以及规划下一步该问什么。随着GPT-5.5 Instant的推出,我们在健康智能方面迈出了实质性的一步,显著提升了识别紧急就医需求、询问相关背景、解释不确定性以及简化复杂信息的能力。在我们最具挑战性的健康评估中,GPT-5.5 Instant的表现已媲美前沿的Thinking模型。由于它对ChatGPT所有免费用户开放,更多人能从中受益。 这一进步既反映了模型能力的提升,也体现了我们健康评估背后医生主导的工作。在全球范围内,一个由医生组成的网络通过审阅示例模型回复、描述理想行为以及识别失败模式,帮助定义了在真实健康场景中“好”的标准。与医生合作使我们能够衡量健康领域的进步,并持续改进ChatGPT的回复质量。
在健康领域,进步意味着提供准确、易于理解且基于良好判断的回复:识别何时需要更多背景信息,解释不确定性而不夸大信心,以及帮助用户了解何时应寻求医疗护理。 为了衡量这一进步,我们使用了专门的健康评估指标,包括HealthBench和HealthBench Professional。这些评估利用真实的健康对话场景和医生编写的评分标准,评估准确性、安全性、沟通能力、上下文意识、完整性和适当升级等维度。 在包括HealthBench Professional在内的综合健康评估中,GPT-5.5 Instant达到了与最新前沿模型相似的健康性能,相比GPT-5.3 Instant有了大幅提升。GPT-5.5 Instant(2026年5月发布)和GPT-5.3 Instant(2026年3月发布)均向ChatGPT所有免费用户开放(受限于使用限制),我们使用API定价来计算5.4 Thinking和5.5 Thinking的成本。 作为另一项对比,我们请医生在无限时间和网络访问权限(但不使用AI)的情况下,针对代表性健康对话撰写回复。随后,由另一组医生将这些医生撰写的回复与模型回复进行对比,审阅了3500条回复,评估了准确性、沟通能力、完整性、指令遵循度以及健康决策帮助性等关键特质。 结果显示,GPT-5.5 Instant的回复在所有评估标准上均优于医生撰写和旧版模型的回复。医生评价认为,GPT-5.5 Instant的回复比旧版模型和医生撰写的回复具有更少的失败模式。例如,GPT-5.5 Instant在未针对本地医疗环境进行调整、遗漏危险信号或转诊建议、以及未在必要时向用户寻求更多背景信息等方面,均优于旧版模型和医生。 鉴于我们的模型在健康领域的大规模使用,理解近期模型改进的另一种方式是衡量生产流量。我们使用隐私保护监控器跟踪健康回复中可能的事实性问题。根据最近健康生产流量的比较(每周数十亿条消息),在过去两个月里,至少有一个标记事实性问题的回复比例下降了71%。
比较不同模型对真实健康问题的回复,展示了ChatGPT在健康相关方面的改进:识别可能需要紧急关注的情况,以更好的判断处理不确定性,并为用户提供更清晰、更有用的下一步行动指导。
GPT-5.5回复:
医生可能建议在坐骨神经痛注射类固醇前进行MRI,因为当医生确切知道是什么压迫或刺激神经以及位置时,注射会更有效且更安全。常见原因包括:
OpenAI News 持续关注人工智能在健康领域的进展。GPT-5.5 Instant的发布标志着ChatGPT健康智能的重大飞跃,不仅提升了模型性能,更通过医生主导的评估体系确保了回复的准确性和安全性。随着免费用户的广泛使用,这一进步将惠及更多人,帮助他们在健康决策中获得更可靠的AI支持。
Bingdada 是一个专注 SEO、GEO(生成式引擎优化)与 AEO(答案引擎优化)的内容平台,由资深内容编辑、SEO 技术工程师与 AI 研究专家组成的团队持续运营。我们追踪搜索引擎与生成式 AI 的最新动态,为读者提供准确、实用、可落地的方法论与行业洞察。 编辑团队:内容策划 · 技术编辑 · AI 研究组 网站:bingdada.com © 2026 Bingdada. 保留所有权利。
SEO & GEO 技术探索者,专注于搜索引擎优化和生成式引擎优化。

英伟达内部实践显示,ChatGPT Work正帮助企业团队将信息整合工作自动化,每周节省16小时,并将原型开发周期从数周缩短至数天。这一案例揭示了AI工作流从工具到组织资产演进的趋势。

OpenAI 将 GPT-5.6 系列模型(Sol、Terra、Luna)集成至 Kiro 开发代理,通过规格驱动方法实现约 82% 的成本降低,标志着 AI 编程从能力竞赛转向成本效率竞争。

OpenAI因模型网络能力逼近关键门槛而调整开发策略,强调安全需贯穿训练全周期。文章解析其技术升级,并对比国内AI安全建设路径。
获取最新的 SEO 与 GEO 技术资讯。
我们尊重您的隐私,随时可以取消订阅。