文章正文

中国新歌声

AI治病,走到哪一步了?_我的网站

速度与激情6

一 |     

“说 AI 能治愈癌症更像是一种陈词滥调,而非鼓舞人心,大多数人认为这是欺骗性的。

二 |     住房和城乡建设部近日发布第一批完整社区建设可复制经验做法清单,总结各地典型经验做法。杭州以印发《杭州市完整社区数字化建设指南》(以下简称《指南》)、搭建统一的数字化社区治理服务平台等做法,入选“推进社区智能化服务”典型经验。市建委印发的《指南》,并搭建统一的数字化社区治理服务平台,推动数字服务融入社区治理和居民生活。在管理端,强化“人、房、设施”等全要素数据感知能力,支持风险识别、资源调度和精准治理,实现治理从“被动响应”向“主动服务”、从“经验决策”向“数据决策”跨越;在居民端,整合社区活动、报事报修、空间预约等高频服务,推动线上线下一体化办理。”8 月 16 日,Anthropic 首席执行官 Dario Amodei 在 X 上写下了这句话。“通过统一平台建设,集成人、房、设施数据,可以实现社区资源精准匹配,在这基础上还能监测社区能耗、服务满意度等指标,辅助政府动态调整政策,实现治理能力升级。

三 | 两天后,Anthropic 公布了一项蛋白质设计实验:Claude 操作一组专业模型和研究工具,设计出了能够与多个目标蛋白结合的新蛋白。再过一天,莫德纳和默沙东宣布,包含机器学习设计环节的个体化癌症疫苗在黑色素瘤三期试验中达到主要终点。几项成果集中出现,再次激起了外界对 AI 医疗的关注,资本市场也迅速作出反应。8 月 19 日,莫德纳股价上涨约177%,默沙东上涨约 13%;Anthropic 相关实验的验证方 Twist 股价单日上涨 22.64%、从事 AI 精准医疗的 Tempus AI 也上涨 22%。热度随后扩散到整个生物科技板块,iShares Biotechnology ETF 和 SPDR S&P Biotech ETF 当天分别上涨 6.6% 和 5.9%。从蛋白质设计、AI 药物发现,到个体化癌症疫苗的三期试验,“AI 医疗”开始对应越来越具体的研究成果。那么,这些进展分别到了哪一步?哪些已经经过人体临床验证,哪些还停留在实验室;AI 又在其中承担了什么工作?它真的帮助人类“治愈”癌症了吗?“治愈”有着非常严格的要求“AI 医疗”听起来像一个单独的行业,但它内部其实包含一系列差别很大的工作。算法可以阅读病历、识别影像、预测疾病风险,也可以寻找药物靶点、生成分子结构、筛选临床试验患者。

四 | 它还可以辅助医生选择治疗方案、计算放疗剂量,或者监测患者服药后的反应。这些工作都与医疗有关,证据标准却各不相同。一个模型在医学考试中答对问题,证明的是它能处理某种形式的文本;在历史病例上准确预测诊断,证明的是它能复现数据中的模式;在医院里帮助医生提高诊断率,需要前瞻性试验;一种由 AI 参与设计的药物是否有效,最终还要在患者身上与现有治疗或者安慰剂进行比较。”市建委相关负责人表示。完整社区的最终落脚点在于居民的获得感与幸福感。美国食品药品监督管理局(FDA)称,自 2016 年以来已经收到超过 500 份包含 AI 组件的药品和生物制品申报材料。因此,在建设机制上,强调以共性能力复用为“标配”,同时为社区结合自身特色开展增量开发留出空间,推动数字平台从“建起来”向“用起来、持续用”转变。这里的“使用 AI”可以指预测药代动力学、优化剂量、分析临床终点、整合自然病史数据,也可以指辅助生产和质量控制。

五 | 《指南》明确,通过全域建设统一的数字化底座,实现共性数字化基础能力复用,同时鼓励各单点未来社区结合自身特色,通过二次增量开发打造更多个性化的场景应用,实现“标配+个性”的有效均衡。

六 | 这也让社区在平台的运营管理上拥有更大的自主权和灵活性,能够根据社区的发展变化及时调整平台功能和服务内容,更好地适应社区的动态需求。

七 | 它说明 AI 已经成为药物研发中的常用工具,并不意味着 500 款药物由 AI 独立发明。

八 | 已经获得监管授权的医疗 AI,同样主要分布在信息处理环节。在夯实数字化底座的基础上,杭州进一步推动社区建设向智能化跃升。

九 | JAMA 2025 年的一项系统研究统计了 950 款 FDA 授权的 AI 医疗器械,其中 723 款属于放射科,占比约 76%。它们处理的是 X 光片、CT、核磁共振和超声等高度数字化的数据。

十 | 医学影像有相对标准的输入格式,医院也已经积累了大量数字化资料,许多任务也拥有明确答案,例如一张图像中是否存在结节,病灶边界在哪里,前后两次检查发生了什么变化。因此,这也是目前聚集了最多 AI 产品的医疗环节。今年,《杭州市城乡建设领域“人工智能+”行动方案(2026—2028年)》发布,将智慧住区列为八个重点方面之一。由市建委牵头编制的团体标准T/ZS 0852—2026《智慧住区建设指南》正式发布,并于8月3日起实施。而对于治疗来说,它所提出的是另一类问题。

十一 | 该文件在完整社区数字化底座上,进一步把人工智能、物联网、数字孪生、城市信息模型(CIM)等技术纳入住区建设框架,为新技术从单点试用走向规范化、场景化应用提供指引。诊断模型试图回答“这个患者现在发生了什么”。《智慧住区建设指南》构建“1+N+1”总体架构,即1个基础条件、N个应用场景和1个智慧平台,覆盖智慧安防、智慧消防、智慧便民、智慧宜居等领域。

十二 | 其中,智慧平台可具备AI算法统一接入、部署、更新和版本管理能力,并借助人工智能、数字孪生等技术提升安全预警、资源调度和运维管理效率;应用场景则进一步延伸至独居老人异常监测与跌倒识别、应急风险预测、物业事项自动识别分类处理、设施设备故障诊断等居民可感可及的日常服务。

十三 | 治疗决策需要回答“采取某项干预后,这名患者会发生什么”。

十四 | 在具体应用建设时,各社区紧紧围绕人本化的特质,将问需于民贯穿始终,特别是聚焦“一老一小一青年”等核心群体提供精准的数字化服务保障。同一个患者不可能同时接受两套相互排斥的方案,研究者无法直接观察那个没有发生的结果。相关性很强的模型,也可能把接受某种治疗的人群特征误认为治疗效果。这就是随机对照试验仍然重要的原因。Nature Medicine 关于因果机器学习的综述指出,AI 可以结合临床试验和真实世界数据估算个体化治疗效果,但偏差、混杂因素和错误的因果假设仍会产生错误预测。

十五 | 例如,今年5月,上城区望江街道始版桥未来社区的AI社区食堂投入运营。至于“治愈”,医学要求的不只是治疗后暂时查不到癌细胞,还要确认它以后不再复发。约200平方米的空间内,两台“AI星厨”可按标准程序完成蒸、炒、煮等烹饪流程,日常运营仅需3名工作人员。美国国家癌症研究所将其解释为癌症的所有痕迹已经消失,并且以后不会复发。患者即使进入持续多年的完全缓解,医生通常仍然谨慎使用这个词,因为未来尚未发生。食堂服务周边5个社区,覆盖9000多名老年人,试运营不到一周,日均客流已稳定在180至200人次。西湖区翠苑一区社区围绕独居老人关爱和健康服务,通过用水监测设备、健康手环等智能硬件开展独居监护和异常预警。发现异常后,平台同步预警并定位居民住所,社区会及时安排人员上门查看处理。后续,社区还将持续拓展“AI+康养”场景。萧山区通过智能值守前端设备和视频解析技术,对车辆违停、打架斗殴等异常情况进行识别并推送给社区民警,实现社区安全风险早发现、早处置;同时将AI智能客服接入警务微信,汇聚治安隐患、矛盾纠纷、举报线索等信息形成风险清单,辅助社区民警精准治理。

图丨FDA 对于治愈的定义(来源:FDA)

图丨FDA 对于治愈的定义(来源:FDA)模型在基准测试或历史病例上取得高分,只能说明它完成了相应的预测任务。

十六 | 患者能否长期获益,则要看对照试验和数年随访。从“治理”到“智治”的跨越,从“标配”到“个性”的兼顾,杭州以数字化改革为牵引,走出一条完整的社区智慧服务新路径。接下来,杭州将继续坚持需求导向,推动人工服务与智能服务协同衔接,同步守住数据安全、个人隐私和长效运营底线,实现智慧服务与民生需求精准对接,让数字化和智能化成果真正润泽千家万户。三项成果,停在三道不同的门前这种差别,可以从 Anthropic 最近公布的实验说起。在这组持续 24 至 48 小时的任务中,Claude 通过阅读论文和数据库,调用公开的蛋白质结构预测与设计工具,挑选结合位置,生成候选蛋白,再根据计算结果不断筛选和调整。研究人员选定了 16 个目标蛋白,其中 15 个最终取得可以解释的测量结果。实验室对 1,320 个设计进行合成和测试,确认 354 个能够结合目标,在 15 个目标中有 14 个找到了结合蛋白。部分任务的命中率超过 Anthropic 此前使用的常规流程。这是一个扎实的研究成果。Claude 不只是总结已有知识,它连续工作了数十小时,组合专业模型,调整实验策略,交出了能够接受湿实验检验的新设计。

十七 | 外部实验室负责合成和检测,也降低了模型对自己打分的风险。

十八 |

图丨Claude 成功协调多个开源蛋白质设计模型,生成了具有高成功率和亲和力的结合蛋白。(来源:Anthropic)

图丨Claude 成功协调多个开源蛋白质设计模型,生成了具有高成功率和亲和力的结合蛋白。(来源:Anthropic)不过,实验对象是 15 个可以解释的蛋白靶点,不是 15 种疾病;354 个结果是蛋白结合物,也不是 354 款药。

十九 | 一个蛋白能够黏住靶点,只说明研发者找到了某把可能插进锁孔的钥匙。它是否会打开正确的门,会不会同时碰坏其他门,进入人体后能否抵达锁孔,免疫系统是否把它清除,都需要其他实验回答。Anthropic 在报告中也明确表示,这些小型结合蛋白不是标准意义上的药物,结合只是药物研发的第一步。相比之下,Rentosertib 已经走得更远。

| 这是一款用于治疗特发性肺纤维化的候选小分子药物,其研发公司英矽智能使用 AI 寻找 TNIK 靶点,又通过生成模型设计分子结构。2025 年公布的随机二期临床试验招募了 71 名患者,在为期 12 周的治疗中观察到初步疗效信号,药物总体耐受性尚可。不过这项研究规模很小,全部组别共有 16 人退出,观察时间也不足以判断长期疗效。研究者在论文中将结果称为“令人鼓舞,值得进一步研究”,而非一项已经得到确认的治疗突破。2026 年 7 月,Rentosertib 进入三期试验。

| 它是目前最接近完整临床验证的 AI 药物案例之一:AI 参与发现靶点、设计分子,候选药随后经历临床前实验、一期安全性研究、随机二期试验,现在开始接受更大规模的人体检验。它仍未获得上市批准,也没有治愈特发性肺纤维化。莫德纳的个体化癌症疫苗又处在不同的位置。研发人员先对每名患者的肿瘤和正常组织进行测序,找出肿瘤特有的突变,再用机器学习和生物信息学算法对候选新抗原排序。最多 34 个新抗原会被编码进一条为患者单独制造的 mRNA,目的是训练免疫系统识别其肿瘤细胞。在刚刚公布的 INTerpath-001 三期试验中,1,137 名高风险皮肤黑色素瘤患者接受了治疗。这些患者的肿瘤已经通过手术完全切除,研究考察的是疫苗联合 Keytruda 能否降低术后复发和远处转移风险。公司称,试验在预设的中期分析中达到无复发生存期和无远处转移生存期两个终点。总体生存期仍在随访,风险比、绝对事件率、置信区间和生存曲线尚未披露。

| 这项三期试验验证了“个体化疫苗加 Keytruda”整套方案的增量效果。它没有设置一组由人类使用其他方法挑选新抗原的疫苗,也没有比较“使用 AI”和“不使用 AI”。因此,研究能够证明包含机器学习环节的疗法有效,无法计算疗效中有多少应当归功于算法。三项成果分别回答了三个问题:模型能否设计出在实验室中结合靶点的蛋白,AI 发现和设计的候选药能否在人类身上显示初步疗效,包含机器学习组件的个体化疗法能否在三期试验中改善临床终点。

| 我们不需要用“治愈”的名号来给他们增加分量。Anthropic 提高了蛋白质设计的实验命中率,Rentosertib 把 AI 发现和设计的候选药推进到后期临床,莫德纳则让个体化癌症疫苗首次在三期试验中取得阳性结果。这些已经是足够重要的进展。最昂贵的失败,发生在算法交卷以后我们知道,现代药物研发是一套不断淘汰答案的制度。

| 研究人员从疾病机制中寻找靶点,从大量候选分子中找到能够影响靶点的少数,再优化活性、稳定性、选择性和生产条件。候选药随后进入细胞实验、动物实验和人体临床试验。每一步都会淘汰前一步看起来很有希望的结果。一项关于临床研发失败的综述估计,药物从发现到获批通常需要 10 至 15 年。即使已经进入一期人体试验,约九成候选药仍无法获得批准。

| 40%—50% 的失败源于临床疗效不足,约 30% 源于无法接受的毒性。

图丨药物发现与开发的过程,以及每一步的失败率。(来源:Acta Pharm Sin B)

图丨药物发现与开发的过程,以及每一步的失败率。(来源:Acta Pharm Sin B)而这组数字揭示了 AI 药物研发最容易被忽略的一点:生成一个在计算上表现优秀的候选物,可能只加速了失败率最高流程中的前半段。靶点与疾病相关,不等于干预靶点就能改善疾病;分子在培养皿中有效,不等于它在人体内能够达到足够浓度;动物模型出现变化,也不保证人类患者获得同样结果。

| 许多“完美”的候选药,直到二期或者三期临床才暴露出疗效不足。AlphaFold 就很好地代表了这种区别。它已经预测了约 2 亿个蛋白质结构,极大扩展了研究人员可以利用的结构信息。以前可能需要数月甚至数年才能获得的线索,现在几分钟便能生成。科学家能够更快提出假设,也可以研究一些过去缺乏实验结构的蛋白。

| 但模型给出的通常是一个预测构象,而真实蛋白会在不同温度、溶液环境和结合状态下改变形态,也可能与其他蛋白、离子和小分子共同作用。研究人员比较 AlphaFold 预测与实验结构后发现,即便模型置信度很高,局部构象、侧链位置和结构域方向仍可能不同。

| 因此,这些预测更适合被视为“非常有价值的假设”,关键相互作用仍需实验确认。AI 可以提出更多候选答案,生命科学缺少的却经常是高质量问题和能够检验答案的数据。2026 年 8 月,Nature Reviews Drug Discovery 发表的一篇行业评述认为,AI 在药物研发中的技术成果很多,临床相关影响仍然有限。作者把原因归结为几类:研究过度关注模型指标,生命科学数据高度依赖实验条件,现实任务没有被准确描述,技术团队解决了一个容易计算的问题,却未必解决药物研发中真正阻塞决策的问题。比如,一个生成模型可以在几小时内创造数百万个分子。但实验室没有能力合成和检测其中大部分,更多候选物甚至会放大后续筛选压力。

| 真正有价值的提升是把最可能失败的分子尽早排除,让有限的实验资源集中到更好的假设上。在这个意义上,“更快失败”也可能是 AI 对医学的重要贡献。

| 它不等于“治愈”,却可能节省数年时间和数亿美元成本。癌症会在治疗过程中改写题目而就这次引发关注的癌症来说,它所对应的问题更要复杂得多。美国国家癌症研究所将癌症描述为一组相关疾病,已知类型超过 100 种。不同器官的肿瘤由不同细胞产生,受到不同基因、免疫环境和外界因素影响。即使病理名称相同,两名患者的突变组合和治疗反应也可能相差很远。一名患者体内的肿瘤也不是整齐划一的细胞群。肿瘤在不断复制中积累突变,形成多个特征不同的亚群。

| 一次活检取到的只是某个位置、某个时间的样本,未必包含所有具有转移或耐药能力的细胞。更棘手的是,治疗还会改变肿瘤。药物杀死敏感细胞后,少数具有耐药性的细胞可能留下并扩张;免疫系统清除容易识别的细胞,也可能选择出更善于隐藏的亚群。2025 年 Nature Reviews Immunology 的一篇综述指出,肿瘤内部异质性与较差的临床结局、对免疫检查点抑制剂反应不足相关,免疫压力本身也会参与塑造肿瘤演化。算法此时面对的不再是一道答案固定的识别题。模型根据过去患者的数据学习规律,新的药物和治疗组合却会改变疾病的选择环境。当诊疗方式发生变化,历史数据中的关系也可能随之失效。癌症数据还存在一个看似矛盾的问题:医院和研究机构保存了海量影像、基因组和病历资料,但进入具体治疗决策后,可用样本迅速减少。

| 一旦按照癌症亚型、突变、治疗史、年龄、免疫状态和合并疾病继续划分,每组患者可能只剩很少几人。真正需要个体化治疗的罕见组合,恰好也是训练数据最稀缺的位置。记录方式不同、随访缺失、治疗选择偏差和人口代表性不足,还会继续削弱模型的可靠性。AI 仍然可以在这里发挥作用。它能把病理图像、基因突变和临床资料放在一起分析,寻找单一数据源难以发现的患者亚群;能够预测潜在新抗原、优化放疗计划、匹配临床试验,也能帮助医生更早发现复发迹象。这些工具提高的是观察、排序和决策能力。

| 它们给出的治疗建议是否真正优于医生原来的选择,仍需要前瞻性研究;一项建议能否在不同医院、不同族群和不断变化的治疗环境中保持有效,则需要真实世界验证。而当 AI 从识别疾病走向干预疾病,它就同时进入了因果关系、伦理责任和风险分配的领域。模型的一次错误分类可能导致重复检查;一次错误治疗建议可能让患者错过有效药物,或者承受不必要的毒性。越接近患者身体,证明责任就越重。因此,在“治愈癌症”乃至其他普通疾病的道路上,AI 依然任重而道远。成功之前的一切,正在加速但话又说回来,AI 对医学的影响,未必需要等待第一款“完全由 AI 发明”的药物获批才算成立。

| 它已经改变研究人员阅读知识的速度,扩大了可搜索的分子和蛋白质空间,也开始介入实验设计、患者招募、临床数据分析和监管材料处理。FDA 与欧洲药品管理局 2026 年共同发布的良好 AI 实践原则,把“明确使用场景”放在核心位置:模型是否可靠,取决于它被用来回答什么问题,以及答案将承担多大的风险。

| 这也提供了一种更有意义的衡量方式。

| 在药物发现阶段,可以考察 AI 是否缩短了候选物设计和优化时间,是否提高了经过实验确认的命中率。在临床阶段,应当观察它能否减少试验失败、改善患者招募、找到真正获益的亚群。最终的标准仍然是患者是否活得更久、更健康,是否用更低成本获得了安全有效的治疗。Rentosertib、Anthropic 的蛋白质设计和莫德纳的个体化疫苗,正在把 AI 推向这条链条的不同位置。它们比单纯的模型基准更接近生物世界,也比“AI 治愈癌症”复杂得多。

| Dario 所说的陈词滥调,问题或许就在这里。它把一个仍在逐级验证的过程提前写成了结局,也让那些已经发生、却不够戏剧化的进展失去了准确的名字。截至今天,AI 已经开始影响科学家下一步选择哪个靶点、设计哪个分子、进行哪项实验,而患者能否被治愈,仍要由实验、临床和时间共同回答。

|

Current article:http://shaimeihaoangguanwahuaisaiyao.buzz/news/20260826_23191.html

Published on:20:31:12


|