首页
>
AI前沿
>
Introducing HealthBench
Introducing HealthBench
OpenAI
2025-05-12 18:30
12 阅读
查看原文
医疗AI
基准测试
评测
HealthBench:医疗AI新评估基准
HealthBench是一个面向医疗领域AI的新型评估基准,旨在真实场景中检验模型表现。
该基准由250多名医生参与构建,力求为医疗场景下的模型性能与安全性提供统一标准。
相关推荐
换一批
GLM-4.6暴涨26分 GPT-5.5跟进10.5 WDCD守约格局突变
2026-10-04 05:49
WDCD五大场景横评:业务规则垫底2.13分,GPT-6系列偏科差1.84
2026-10-04 05:49
Grok 4 95.69 分登顶 WDCD,Qwen3 Max 73.48 分垫底差距超 22 分
2026-10-04 05:48
Claude Opus 4.7以81.57分居首:2026-10-04 Smoke快测数据简报
2026-10-04 03:35
GPT-6.1 Sol主榜暴跌9.2分 代码执行单日降16.7分
2026-10-03 03:36
Gemini 2.5 Pro 材料约束暴跌28分 代码执行却升至100分
2026-10-03 03:36