首页 / 新闻 / 京东健康在2026 WAIC发布JoyAI‑MedCode v2.0 联合共建MedBench v5.0评测基准

京东健康在2026 WAIC发布JoyAI‑MedCode v2.0 联合共建MedBench v5.0评测基准

摸鱼不慌
摸鱼不慌

2026世界人工智能大会(WAIC)7月17日至20日在上海召开。京东健康携最新医疗AI成果亮相,在同期举办的“AI+医健产业可持续创新论坛”上发布核心技术主张“确定性来自执行”与JoyAI‑MedCode v2.0代码化推理升级,同时联合上海人工智能实验室共建MedBench v5.0行业评测基准。旗下AI医生“大为”和“京东知医”也在展区同步展出。

JoyAI‑MedCode v2.0升级与“确定性来自执行”主张

京东健康在论坛上正式公布京医千询核心推理引擎JoyAI‑MedCode v2.0重大升级。该版本从传统自然语言推理全面转向代码可验证推理,并同步提出“确定性来自执行”技术主张。

京东健康称,这一升级“蹚出了医疗AI走向规模化可信交付的落地之路”。

代码化推理将医疗问题转化为可执行代码,通过运行代码获得可验证结论,从而降低推理过程中的不确定性。

联合共建MedBench v5.0行业评测基准

京东健康与上海人工智能实验室联合共建MedBench v5.0行业评测基准。MedBench是面向医疗AI的评测标准体系,v5.0版本旨在为行业提供更规范的评估框架。

AI医生产品展示与行业认可

在大会现场,京东健康旗下AI医生“大为”和“京东知医”同步亮相,吸引众多参会者关注。同时,京东健康获评“医健+AI创新卓越伙伴”,其在可信医疗AI全场景、规模化落地方面的领先优势得到认可。

  • 发布JoyAI‑MedCode v2.0代码化推理升级
  • 提出“确定性来自执行”技术主张
  • 联合共建MedBench v5.0行业评测基准
  • AI医生“大为”与“京东知医”参展
  • 获评“医健+AI创新卓越伙伴”
京东健康在2026 WAIC发布JoyAI‑MedCode v2.0 联合共建MedBench v5.0评测基准  第1张

京东健康发布医疗AI新模型 采用“指南即代码”路径确保诊疗推理可追溯

在医疗人工智能领域,大模型参数的竞赛正在转向交付能力的比拼。京东健康医疗AI相关负责人近日提出,下一阶段医疗AI的竞争核心不再是“谁的模型参数更大”,而是“谁能把AI可靠、可信、可规模化地交付到医生与用户手中”。基于这一理念,京东健康在WAIC现场展示了其最新技术成果,包括自主研发的JoyAI-MedCode v2.0模型与京医千询大模型(JoyMed)的评测突破。

“指南即代码”重构医疗推理路径

不同于通用大模型依赖概率生成、推理过程黑箱化、结论难以追溯校验的模式,JoyAI-MedCode v2.0采用“指南即代码”作为核心思路。该模型将NCCN、CSCO等权威临床指南编译为可执行的决策代码——诊疗建议直接由代码运行生成,指南诊疗分支对应代码逻辑分支,每一条结论都可精准回溯至指南对应章节。

这种设计意图从根源上保障医疗推理的确定性、合规性与可追溯性。模型能够像软件单元测试一样被批量校验,从而改变以往医疗AI“端到端黑箱”的输出模式。

全链路重构:从知识层到执行层

围绕可信推理目标,京东健康从知识层到执行层完成了全链路重构。在知识层面,采用结构化、可寻址的medwiki循证知识库替代传统概率式检索,检索沿确定路径进行,证据等级、引用来源清晰可查。知识更新有版本、可回归,确保医生或用户获取的信息始终基于最新、最权威的临床证据。

在执行层面,用真实“操作流轨迹”替代传统“思维链叙事”,模拟医生真实临床操作流程。每一步都是加载影像、选取病灶、测量比对等真实工具调用,全流程可重放、可校验、可审计。配合基于Rust实现的agentic框架,可以实现内存占用仅数十兆、可以在数百毫秒内拉起的用户AgentOS,确保了任务执行的完整和速度。

业内分析人士指出,这种将诊疗推理转化为可审计代码的思路,直接应对了医疗场景对AI输出结果的强合规与零容错要求,也是模型从实验室走向临床落地的关键一环。

京医千询大模型在HealthBench取得突破

在衡量医疗AI能力的权威评测体系HealthBench中,京东健康自主研发的京医千询大模型(JoyMed)取得了新的突破:Total得分达到69.3分,Hard难度子集得分达到50.6分。该结果表明,JoyMed在复杂医学知识理解、临床推理、风险识别和高难度医疗问答等方面已具备较强的综合能力。

这一成绩也验证了京东健康在高质量医疗数据构建、训练策略优化和模型能力增强方面的技术积累,并为后续医疗场景落地和持续能力迭代奠定了基础。

联合上海人工智能实验室共建MedBench v5.0

可信交付,评测先行。在WAIC现场,京东健康与上海人工智能实验室正式宣布,双方联合共建MedBench v5.0,将自主研发的医疗AI评测体系纳入国家级权威评测榜单,为全行业建立衡量医疗AI能力的“同一把尺子”。

  • 医疗AI的竞争焦点正从模型规模转向交付质量
  • JoyAI-MedCode v2.0通过将临床指南编译为可执行代码,实现诊疗建议的可回溯与批量校验
  • 京医千询大模型在HealthBench权威评测中Total得分达到69.3分
  • 联合上海人工智能实验室共建MedBench v5.0行业评测标尺
京东健康在2026 WAIC发布JoyAI‑MedCode v2.0 联合共建MedBench v5.0评测基准  第2张

MedBench v5.0发布千级真实临床案例与50万条影像问答数据集

在本届世界人工智能大会(WAIC)上,MedBench v5.0正式发布,同时京东健康旗下AI医生“大为”和京东知医同台亮相。MedBench v5.0此次向行业开放两大核心评测数据集,覆盖多模态线上问诊、3D影像评测及循证医学三大方向。

三大评测方向与两大开放数据集

MedBench v5.0将评测能力扩展至三大方向:多模态线上问诊、3D影像评测纳入全模态大模型主榜单,循证评测集进入专项赛道。其中,3D影像评测集与循证评测集分别弥补了行业在三维影像推理和循证评估方面的空缺。

新开放的两大数据集中,MedRealMM多模态真实场景评测集包含千级规模经伦理审查的真实临床多模态案例,首次系统实证图像信息对问诊评测的影响,图像与纯文本评测分差可达20-30分。另一数据集Med3DVQA三维影像评测集基于2万余例完整CT/MRI检查、约50万条影像报告问答构建,覆盖七类视觉问答任务,是国内首个面向完整放射学检查的全开源三维评测集。

MedRealMM填补了多模态真实场景评测空白,Med3DVQA补齐了三维影像跨时序、跨序列推理评测的行业空白。

全模态大模型主榜单聚焦综合处理文本、图像、影像等多种模态的模型能力,本次将3D影像评测纳入,意味着三维影像能力正式成为全模态模型的重要评价维度。

开放策略:推动行业统一评测标准

MedBench v5.0将评测基准、方法学与精标数据向全行业开放,旨在建立统一、可复现、可横向对比的评测标准,推动医疗AI从各自为战走向行业共评,为监管审批、支付落地及公众信任提供客观依据。

京东健康全场景产品矩阵亮相

在本届WAIC展会上,京东健康集中展示其AI产品矩阵。其中,AI医生“大为”用于临床专业辅助,京东知医面向大众健康服务,两者覆盖从大众健康到临床辅助的全场景应用。此前在MedBench 4.0榜单中,京医千询v2.0已获得文本榜72.6分、多模态榜66.4分,在5大能力维度21项评测中均位列榜首。京东健康在本届WAIC获评“医健+AI创新卓越伙伴”。

京东健康在2026 WAIC发布JoyAI‑MedCode v2.0 联合共建MedBench v5.0评测基准  第3张

京东健康AI医生“大为”一季度用户数超去年全年 “京东知医”接入CACA指南

京东健康旗下AI医疗产品在C端和B端同步推进。面向用户的“大为”基于京医千询医疗大模型,融合在线问诊、到家快检、护士上门、药品履约全流程能力,覆盖超千种中西医病症。

C端“大为”:用户数一季度超越去年全年总量

“大为”以循证医学为核心,依托超300个标准化诊疗路径、109项全流程质检标准,严格对标真人医生问诊规范。标准化诊疗路径指针对特定疾病制定的规范化诊断与治疗步骤,可减少医疗差异。

2026年前三个月,使用用户数已超越2025年全年总量,满意率达98%以上。

“大为”区别于泛健康科普类AI,通过结构化问诊流程提升准确性。618期间用户数同比增长超4倍。

近期上线的“减重不难瘦”大赛,上线3天报名人数突破300万,带动京东健康App登顶苹果App Store免费总榜。

B端“京东知医”:接入CACA指南 升级为任务助手

面向医生的“京东知医”,深度整合超4000万篇医学文献、4万份临床指南及3万余种药品说明书。自2026年1月上线以来,已成为临床工作者使用的循证AI工具。

近期,“京东知医”全面接入中国抗癌协会《中国肿瘤整合诊治指南》(CACA指南)。该指南汇聚超万名专家智慧,覆盖97%以上中国肿瘤疾病谱。被AI激活后,指南从“书架”走向“诊室”,使临床决策有据可依。

在应用场景上,“京东知医”正从单一检索工具升级为全能任务助手,覆盖更多临床任务需求。

京东健康在2026 WAIC发布JoyAI‑MedCode v2.0 联合共建MedBench v5.0评测基准  第4张

京东健康入选2026医健+ AI创新卓越伙伴

在由第一财经、健闻咨询与上海现代服务业联合会医疗服务专业委员会共同发起的评选中,京东健康经多轮遴选成功入选“2026医健+ AI创新卓越伙伴”。

评审方:可信AI路径推动多场景落地

评审方指出,京东健康率先探索出“代码化推理+操作流交付”的可信路径,推动可信AI在问诊、健康管理、临床辅助等多元场景规模化落地。该路径为医疗AI从技术概念走向合规交付,以及全场景AI的落地,提供了可复制的实践样本。

奖项背景与评选机制

该奖项由第一财经、健闻咨询与上海现代服务业联合会医疗服务专业委员会共同发起,经多轮遴选产生。多轮遴选指评选包含多个环节。

  • 第一财经
  • 健闻咨询
  • 上海现代服务业联合会医疗服务专业委员会

未来布局:深耕AI技术与开放生态

京东健康表示,未来将持续深耕医疗AI技术创新与开放生态,以可信技术底座连接行业伙伴,让更可靠、更专业、更可及的医疗健康服务,通过AI触达和服务更广泛的人群。