首页
>
AI前沿
>
Introducing HealthBench
Introducing HealthBench
OpenAI
2025-05-12 18:30
10 阅读
查看原文
医疗AI
基准测试
评测
HealthBench:医疗AI新评估基准
HealthBench是一个面向医疗领域AI的新型评估基准,旨在真实场景中检验模型表现。
该基准由250多名医生参与构建,力求为医疗场景下的模型性能与安全性提供统一标准。
相关推荐
换一批
AI会做题,却未必能自进化:字节Seed等提出三项新基准
2026-09-17 06:00
添翼AI 3.0重磅发布!东软重塑医疗AI,迈入业务智能新时代
2026-09-16 16:55
清华稳准智能联合发布LimiX-2,结构化数据基础模型登顶国际评测榜单
2026-09-16 14:32
GPT-6刷到99.9%,ARC AGI考卷被迫重做,下一关考「发明」
2026-09-16 11:19
Claude Sonnet 4.6以100分居首:2026-09-16 Smoke快测数据简报
2026-09-16 03:35
缓存不该困在一台服务器里
2026-09-16 00:02