官方网站-首页官方网站-首页

联系电话021-26883548
搜索本站

新闻中心

洞悉品牌力与AI变革

当生命被编程:AI教会细胞“听话”,未来启发机器自进化

时间:2025-11-13 12:01:45
来源:
阅读量:270
分享: 分享到微信 分享到QQ 分享到微博

作者:郭瑞东

现在,我们可以让AI生成任何想象中的画面——梵高笔触下的猫,或在火星上奔跑的企鹅。算法从噪声出发,反向推理出图像的结构与色彩,仿佛在混乱中召唤出秩序。科学家也在思考一个问题,那生命能被“生成”吗? 

今年8月,哈佛大学与瑞士洛桑大学的研究团队在模拟环境中实现了一项令人惊叹的成果:为“生命生成模型”找到了它的“提示词”。科学家给让虚拟细胞群一个“目标形态”,然后让它反向推理,找出那套让细胞们自组织形成该形态的算法。该发现加深了我们对生物发育过程的理解,更让可编程物质走出科幻小说成为可能。

论文信息:Deshpande, R., Mottes, F., Vlad, AD. et al. Engineering morphogenesis of cell clusters with differentiable programming. Nat Comput Sci (2025).

研究形态发生的四个步骤

生命从最初的受精卵到一个完整的,拥有复杂器官的生物的发育过程中究竟发生了什么?是什么样的规则,决定了海量的单个细胞在发育过程不同阶段的行为,进而生长出具有精美功能性的复杂结构?该问题一直位于生物学的核心,被称为“形态发生”(Morphogenesis)之谜。

要回答这个问题,科学家们通常需要走过几个关键步骤:

1. 观察与描述: 首先,科学家用显微镜和分子生物学工具(例如基因测序),细致入微地观察和记录胚胎发育的每一个瞬间——细胞在何时、何地分裂?它们如何移动?又分泌了哪些化学信号?

2. 建立假设: 基于观察,科学家们会提出假设:也许某个基因控制着细胞的分裂方向,也许某种化学物质的浓度梯度决定了器官的形状。这些假设试图将宏观的形态变化与微观的细胞行为联系起来。

3. 实验验证: 接着,通过基因敲除、药物干预等实验手段,去验证这些假设。如果敲掉某个基因,胚胎发育就停滞了,那么这个基因很可能就是关键“开关”。

4. 构建模型: 最后是将所有零散的知识整合起来,构建一个能够“从头到尾”模拟整个发育过程的计算模型。这个模型不仅要能重现已知的现象,更要能预测未知的结果,从而揭示出支配全局的“底层算法”。正是在(zài)这(zhè)一(yī)层(céng)面(miàn),哈(hā)佛(fú)大(dà)学(xué)与(yǔ)洛(luò)桑(sāng)大(dà)学(xué)的(de)最(zuì)新(xīn)研(yán)究(jiū)实(shí)现(xiàn)了(le)突(tū)破(pò):他(tā)们(men)通(tōng)过(guò)“可(kě)微(wēi)分(fēn)编(biān)程(chéng)”,让(ràng)形(xíng)态(tài)发(fā)生(shēng)的(de)过(guò)程(chéng)首(shǒu)次(cì)具(jù)备(bèi)了(le)可(kě)计(jì)算(suàn)、可(kě)优(yōu)化(huà)、可(kě)设(shè)计(jì)的(de)可(kě)能(néng)。

可微分编程的建模和优化步骤

这项研究的方法学创新,如图1所述。研究者把每个细胞都看作一个能感知、能决策的“小智能体”。它们能探测周围环境——比如化学物质的浓度、受到的(de)机(jī)械(xiè)压(yā)力(lì)——并(bìng)根(gēn)据(jù)这(zhè)些(xiē)信(xìn)号(hào),通(tōng)过(guò)内(nèi)部(bù)的(de)“调(diào)控(kòng)网(wǎng)络(luò)”决(jué)定(dìng)自(zì)己(jǐ)的(de)行(xíng)动(dòng):是(shì)否(fǒu)要(yào)分(fēn)裂(liè)、分(fēn)泌(mì)哪(nǎ)种(zhǒng)分(fēn)子(zi)、向(xiàng)哪(nǎ)个(gè)方(fāng)向(xiàng)移(yí)动(dòng)。这(zhè)种(zhǒng)方(fāng)法(fǎ),就(jiù)是(shì)可(kě)微(wēi)分编程,在计算机中,它就是通过连续优化而非试错搜索来“学习规则”的方法。它能自动计算每一步调整对最终结果的影响,从而让复杂系统像神经网络一样被“训练”出来。

图1:每个细胞内模型的输入输出概述

而要理解这套“编程”系统如何运作,需要想象一下,细胞之间不能像我们一样说话,它们的“语言”是化学物质,这些分子并不会原地不动,而是像墨水滴入水中一样,在细胞集群所处的环境中扩散开来。

这种扩散遵循物理定律,最终会形成一个稳定的浓度梯度——距离化学物质的源头(图2中的黑点)越近,浓度就越高,距离越远,浓度越低(对应图2左图)。其他细胞就像一个个微型的“化学传感器”,通过感知自己周围环境中这些化学物质的浓度,就能“知道”附近有多少同类、它们在做什么,甚至能判断自己在组织中的“位置”。

图2:细胞如何分泌化学标志物和感知机械力

细胞不仅会“闻”,还会“摸”。把细胞想象成一个个柔软但有弹性的球。当两个细胞靠得太近时,它们会产生排斥力(图2右图中细胞距离曲线的左侧“REPULSIVE”区域),防止彼此重叠,这模拟了细胞膜的“排他性”。而当它们保持一个恰到好处的距离时,又会产生吸引力(图2右图中细胞距离曲线的右侧“ATTRACTIVE”区域),这模拟了细胞间的“粘附”性,让组织能保持完整而不散架。

有了“感知”(化学与机械)和“行动”(分裂与分泌),问题的关键就变成:细胞内部的“决策手册”——也就是基因调控网络——该如何编写?图3展示的,正是这一步的核心:用可微分编程来优化细胞的行为规则。

图3:梯度计算和优化示意图

在模型中,每个细胞的调控网络被设计成一个“黑箱”:输入是基因之间的连接强度(哪些基因彼此激活或抑制),输出则是整个细胞群最终长出的形态。系统的目标,是自动找到一组最佳参数,让模拟出来的形态尽可能接近目标——比如,让虚拟胚胎在计算机中长得像真实的胚胎一样。

传统方法往往靠“瞎猜和反复试错”,效率极低。而可微分编程的妙处在于:它能自动计算出一个“梯度”,也就是——如果我轻轻调整这个参数,结果会更接近目标,还是更远离目标?这个梯度就像一只指路的罗盘,告诉优化器(如 Adam 算法)应当沿哪个方向微调,才能让系统朝目标演化。

在这一研究中,科学家使用了一种名为 REINFORCE 的策略梯度算法。细胞分裂是带随机性的事件,无法直接求导。REINFORCE 的巧思是为每一次分裂打分(reward):若这次分裂让整(zhěng)个(gè)集群(qún)更(gèng)接(jiē)近(jìn)目(mù)标(biāo)形(xíng)态(tài),就(jiù)给(gěi)高(gāo)分(fēn);反(fǎn)之(zhī)则(zé)给(gěi)低(dī)分(fēn)。系(xì)统(tǒng)再(zài)根(gēn)据(jù)这(zhè)些(xiē)分(fēn)数(shù)调(diào)整(zhěng)控(kòng)制(zhì)网(wǎng)络(luò)的(de)参(cān)数(shù)——经(jīng)过(guò)成(chéng)千(qiān)上(shàng)万(wàn)次(cì)模(mó)拟(nǐ),模型逐步“学会”了如何(hé)让(ràng)细(xì)胞(bāo)群(qún)通(tōng)过最简单的局部互动,自发形成宏观上协调的结构。

图3中的“Policy Gradient”箭头,正象征着这一从结果反推原因的学习过程。它把宏观目标(我们希望看到的形态)与微观(guān)机(jī)制(zhì)(单(dān)个(gè)细(xì)胞的规则)连接起来,在两者之间搭建起一座“因果之桥”。通过这座桥,研究者不仅能得到让细胞自组织的算法,还能进一步简化网络、突出核心机制——让系统在保持整体功能的同时,展现出最精炼的生命逻辑。

接下来,将会从三个挑战:如何让细胞像排队一样定向生长(轴向伸长);如何让不同类型的细胞保持平衡共存(组织稳态)以及如何让所有细胞在发育中“雨露均沾”(均匀生长)三部分,逐个讲述用可微分编程算法来在模拟环境下,实现“可编程物质”,并让我们离“重塑生命”的梦想又近了一步。

挑战1:破解蝾螈的再生之谜——通过正反馈实现定向生长

蝾螈是一种能够如同蚯蚓一样,在一定范围内具有断肢重生能力的生(shēng)物(wù)。当(dāng)因(yīn)为(wèi)意(yì)外(wài)失(shī)去(qù)一(yī)条(tiáo)腿(tuǐ)的(de)时(shí)候(hou),它(tā)能(néng)重(zhòng)新(xīn)长(zhǎng)出(chū)一(yī)条(tiáo)功(gōng)能(néng)完(wán)整(zhěng)、形(xíng)态(tài)完(wán)美的新腿。

蝾螈的新腿要从无到有,首先要确定“往哪个方向长”。是向上?向下?还是向旁边?答案是:沿着原来腿骨的方向,笔直地向外生长。这就意味着向一个固定的方向生长。但蝾螈是怎么完成这一目标的,我们又如何用AI如何教会一群细胞“听话”,实现精准的轴向伸长呢?

符合直觉的方法是,假如想要让虚拟细胞组成的聚簇向右边生长,可在当前右边放一些刺激生长的化学物质,但研究人员模拟得到的算法,却是细胞感知到的化学信号浓度越高,其分裂倾向越低(图4b)。

图4:向一个方向定向生长的虚拟细胞

具体来看,图4c中的“源细胞”(Source cells,红色)固定在集群左侧,持续分泌一种化学物质。随该物质在细胞集群中扩散,形成一个从左(高浓度)到右(低浓度)的稳定梯度。靠近源细胞(左侧)的细胞,感知到高浓度化学信号,其分裂被强烈抑制。远离源细胞(右侧)的细胞,感知到低浓度信号,抑制解除,分裂倾向高,因此快速分裂增殖。 发生在右侧的增殖使集群向右延伸,新长出的细胞离源更远,感知到的信号更弱,分裂更活跃,从而形成了一个自我强化的正反馈循环,驱动集群持续向右(低浓度区)生长。最初生成的细胞集群,如图4d所示。

如此的结果,如图4a所示,其中左侧是当调控每个虚拟细胞的神经网络使用随机(jī)初(chū)始(shǐ)化(huà)参(cān)数(shù),得(de)出(chū)的(de)模(mó)拟(nǐ)结(jié)果(guǒ)——细(xì)胞(bāo)集群(qún)毫(háo)无(wú)章(zhāng)法(fǎ)地(de)向(xiàng)各(gè)个(gè)方(fāng)向(xiàng)膨(péng)胀(zhàng),最(zuì)终(zhōng)形(xíng)成(chéng)一(yī)个(gè)不(bù)规(guī)则(zé)的(de)、近(jìn)乎(hu)球(qiú)形(xíng)的(de)团(tuán)块。而右侧是经过可微分编程“训练”后的结果——细胞集群精准地沿着水平方向(X轴)伸长,形成一个细长的棒状结构。

这种“远端生长、近端抑制”的模式,与脊椎动物肢体芽的发育机制存在相似性。在真实胚胎中,肢体也是从一个芽状结构开始,通过远端(顶端外胚层嵴,AER)分泌的生长因子(如FGF)促进远端细胞增殖来实现伸长。

一个是亿万年进化打磨出的自然奇迹,一个是人类用代码和算法“逆向工程”出的人工神经网络。它们采用的“分子语言”或许不同(一个是FGF刺激近端,一个是虚拟抑制剂抑制远端),但它们遵循的“空间定位+局部抑制”的核心逻辑,却惊人地一致。生命的奥秘或许蕴于简洁的规则之中。算法没有复刻自然,但它殊途同归的再现了自然的智慧。

这一实验的成功,直观地证明了通过优化细胞内部的基因调控网络参数,我们能够从发育过程的底层“编程”宏观形态。研究者不需要直接告诉细胞“往右长”,而可通过调整它们感知化学信号和决定分裂的规则,让“向右伸长”这一宏观目标从众多细胞的局部互动中“涌现”出来。

与许多“黑箱”AI模型不同,这项研究的成果是高度可解释的。研究者可以拿着上述的“正反馈+梯度感知”模型,去真实的生物系统(如果蝇、小鼠胚胎)中寻找功能上等价的分子通路。研究者也不再需要从海量的分子生物(wù)学(xué)数(shù)据(jù)中(zhōng)大(dà)海捞针般地猜测调控机制,而是可以先在简化模型中,类似产品设计中的“逆向工程“,先“计算”出可能的机制,再用实验去验证和细化。这极大地加速了我们对复(fù)杂(zá)生(shēng)命(mìng)过(guò)程(chéng)的(de)理(lǐ)解(jiě)。

挑(tiāo)战(zhàn)2:骨(gǔ)骼(gé)里(lǐ)的(de)“建(jiàn)设(shè)者(zhě)”与(yǔ)“拆(chāi)迁(qiān)队(duì)”——负(fù)反(fǎn)馈(kuì)实(shí)现(xiàn)细(xì)胞(bāo)稳(wěn)态(tài)

生(shēng)物(wù)体(tǐ)不(bù)是(shì)由(yóu)单(dān)一(yī)类(lèi)型(xíng)的(de)细胞组成,而是多种类型的细胞通过分泌化学物质“互相喂养”并“自我抑制”,最终产生内稳态(homeostasis)。例如在你身体的每一块骨头里,都持续上演着“建设与拆迁”的双人舞。主角是两种细胞:成骨细胞(Osteoblasts)——“建设者”,和破骨细胞(Osteoclasts)——“拆迁队”。

如果只有“建设者”拼命盖楼,城市会变得臃肿不堪,结构失衡;如果只有“拆迁队”肆意破坏,城市又会变成一片废墟。健康的骨骼,需要两者数量和活性的完美平衡。这是如何达到的呢?

在真实生物体中, 当“建设者”(成骨细胞)在某个区域辛勤工作,建造新骨时,它们会分泌一种名为 RANKL 的化学信号。这个信号就像一封“邀请函”,飘向附近的“拆迁队”(破骨细胞),告诉它们:“嘿,这边新楼盖好了,有些旧材料可以拆了!”

之后“拆迁队”收到邀请,开始工作。在拆除旧骨的过程中,它们会释放出储存在骨头里的生长因子,比如 TGF-β。这些因子就像“感谢信”和“开工红包”,飘回给“建设者”,刺激它们在拆除后的空地上重建新骨。此外每种细胞都会分泌一些物质来抑制自己的过度增长。比如,“拆迁队”工作得太猛时,会释放 OPG(RANKL的诱饵受体),把多余的“邀请函”拦截掉,防止自己被过度激活。“建设者”也有类似的自我抑制机制。

在模拟环境中,存在两类细胞:红色细胞(类型1) 和 蓝色细胞(类型2)。每种细胞都拥有一个专属的“化学语言”(图5a)每种细胞都能“听懂”对方的语言。如图5b所示:红色细胞不仅能分泌化学因子1,还能感知环境中化学因子2的浓度;同样,蓝色细胞不仅能分泌化学因子2,也能感知化学因子1的浓度。

图5:让两类细胞数量稳定保持在1:1

而待优化(huà)的(de)虚(xū)拟(nǐ)细(xì)胞(bāo)调(diào)控(kòng)网络,其目标是要让两类细胞的数量之比稳定保持在1:1。要实现这一目标,需要两个机制,首先是互惠共生,即由蓝色细胞分泌的化学因子2会促进红色细胞的分裂;而由红色细胞分泌的化学因子1会促进蓝色细胞的分裂。这就像A族人越多,B族人就越有动力生孩子;B族人越多,A族人也越有动力生孩(hái)子(zi)。

而(ér)第(dì)二(èr)个(gè)机(jī)制(zhì)则(zé)是(shì)自(zì)我(wǒ)抑(yì)制(zhì),即(jí)红(hóng)色(sè)细(xì)胞(bāo)分(fēn)泌(mì)的(de)化(huà)学(xué)因(yīn)子(zi)1会(huì)抑(yì)制(zhì)红(hóng)色(sè)细(xì)胞(bāo)自(zì)身(shēn)的(de)分(fēn)裂(liè);蓝(lán)色(sè)细(xì)胞(bāo)分(fēn)泌(mì)的(de)化(huà)学(xué)因(yīn)子(zi)2会(huì)抑(yì)制(zhì)蓝(lán)色(sè)细(xì)胞(bāo)自(zì)身(shēn)的(de)分(fēn)裂(liè)。这(zhè)就(jiù)像(xiàng)A族(zú)人(rén)太(tài)多(duō)时(shí),会(huì)主动(dòng)“计(jì)划(huà)生(shēng)育(yù)”;B族人太多时,也会主动控制增长。

具有上述两个机制,训练后的虚拟细胞调控网络能让两种细胞能够始终保持数量接近(图5c的右边),而若是没有经过训练的调控网络,则会出现某种细胞数占比上升的情况(图5c的左边)。

这样的内稳态是可持续的(图5d),在使用训练好的网络所进行的模拟中,无论模拟运行多久(从100次分裂到300次分裂),红色细胞的比例都稳定地维持在50% 附近,波动极小。且能够从多种初始条件(红色细胞占比20-80%)最终都收敛到目标的50%(图5e)

真实生物体的调控机制与模拟条件下经过可微分编程自发涌现出的细胞调控机制一致,说明了经由可微分编程,可把握掌管生命运作的简洁而普适的规律。其关键在于建立局部、双向、带自我抑制的反馈回路,我助你成长,你助我繁荣;但我们都需自律,方能长久共存。这不必依赖一个中央控制者。

将上述的互惠共生+自我抑制的机制,应用到生态系统乃至人造的工程系统中。将为人类设计更稳健、更智能的工程系统(从合成生物学到社会治理)提供宝贵的蓝图。

挑战3:感知压力的细胞——靠“挤压反馈”实现均匀生长

在果蝇翅膀的发育早期,中心区域充满生长因子(如 Dpp、Wingless),浓度高、分裂快。按理说,中心细胞应该越长越鼓,翅膀最终会鼓起一个“包”。但事实恰好相反——到了发育中后期,翅膀的生长速度在各处几乎一样,最终形成精确而平整的扇形。

果蝇是怎么做到这一点的?答案藏在细胞对机械力的感知中。当中心细胞分裂太快、密度过高时,它们会互相“挤压”,压力升高,进而激活名为 Hippo 的基因通路。该通路会抑制一个关键分子 Yorkie (Yki) ——这是细胞分裂的“油门开关”。一旦 Yki 被抑制,细胞分裂被“踩了刹车”,生长自然放缓。就这样,果蝇用力学反馈实现了化学信号无法完成的自我平衡。

图6:机械力与化学信号共同促成胚胎的均匀生长

这一机制与果蝇翅膀的真实发育过程高度吻合:核心都是通过“压力感知→分裂抑制”的负反馈实现生长均衡。更令人惊讶的是,这个“会感压”的调控网络还具备极强的泛化能力。无论是在生长因子扩散速度更快、分泌源变多,还是偏离中心的情况下,它都能保持生长的平衡(图6c–e)。

即使外界扰动,细胞也能凭借对压力的感知,自我修正形态,保证最终结构的完整性。这也解释了为什么生物体在受损或环境波动时,仍能发育出正常形态——生命并不需要一个上帝式的“绘图者”,它靠局部互动就能重建秩序。

而当研究者在模拟中“关闭”细胞的机械感知功能(图6d),系统立刻失衡:细胞过度分裂,组织紊乱,最终形态畸变。这一结果与真实实验完全一致——若敲除 Hippo 通路的关键基因,果蝇组织同样会出现肿胀、畸形甚至肿瘤。在最终的可视化结果中(图6e),细胞的“分裂倾向”(红线)与感知到的“机械应力”(绿线)呈负相关,像一场精妙的“削峰填谷”:哪里压力大,就放慢生长;哪里空间宽,就加速分裂。这种自动的平衡机制,正是自然界“自组织智慧”的写照——翅膀的形态,不是被画出来的,而是被挤出来的。

将(jiāng)胚(pēi)胎(tāi)发(fā)育(yù)的(de)原(yuán)则(zé)应(yīng)用(yòng)于(yú)智(zhì)慧(huì)生(shēng)产(chǎn),对(duì)未(wèi)来的脑洞畅享

当科学家将三条发育原则结合起来——定向生长、数量平衡与均匀分布——一个令人着迷的设想随之出现:如果把细胞换成无人机,把基因调控网络换成算法程序,会发生什么?设想一条完全自动化的无人机生产线。当战场上10点钟方向出现步兵和装甲部队时,系统会像细胞感知化学梯度一样,通过“正反馈”与“生长因子”式的信息扩散,引导生产线在那个方向“生长”,集中制造对应型号的无人机。

算法同时会根据敌军比例自动调节A型与B型无人机的数量,维持整体平衡。而当生产线某处过度拥(yōng)挤(jǐ)、机(jī)械(xiè)压(yā)力(lì)上(shàng)升(shēng)时(shí),系(xì)统(tǒng)又(yòu)会(huì)自(zì)动(dòng)减缓产出,防止“过度增殖”。这样一个能自我调节、自动优化的生产线的生产线,将会使得未来的生产如同生命般高效而灵活。

上述只是笔者的一个科幻式的类比,而真正的科学图(tú)景(jǐng)可(kě)能(néng)更(gèng)令(lìng)人(rén)震(zhèn)撼(hàn)。原(yuán)论(lùn)文作(zuò)者(zhě),则(zé)是(shì)指(zhǐ)出(chū)未(wèi)来(lái)可(kě)将(jiāng)真(zhēn)实(shí)的(de)时(shí)空(kōng)成(chéng)像(xiàng)数(shù)据(jù)(如(rú)器(qì)官(guān)芯(xīn)片(piàn)或(huò)类(lèi)器(qì)官(guān)的延时摄影)和单细胞基因表达谱输入虚拟细胞发育的调控框架。如此科学家将不再是在“真空”中设计规则和优化目标,而是从真实的生命动态数据中学习和推断出其背后的调控逻辑。

在这样的图景中,研究者将果蝇翅膀、小鼠胚胎、甚至人类器官的发育过程拍成电影,然后输入给可微分编程算法。算法会从海量的细胞行为中,自动“推理”出驱动各类生物发育的隐藏规则。同时模型不再像本研究这样,使用球形模拟细胞,忽略真实的细胞形状、极性、细胞骨架等复杂生物物理特性。这样的模型,无疑将(jiāng)加(jiā)深(shēn)我(wǒ)们(men)对(duì)生(shēng)物(wù)发育过程的理解。

该研究已经开源了对应代码,并呼吁将真实的实验数据注入这个框架。未来有一天,生物学家,或将不仅是实验台前的观察(chá)者(zhě),更(gèng)是(shì)训(xun)练(liàn)模(mó)型(xíng)的(de)“炼(liàn)丹(dān)师(shī)”;医(yī)生(shēng)也(yě)能(néng)用(yòng)“数(shù)字(zì)孪(luán)生(shēng)”器(qì)官(guān)预(yù)演(yǎn)治(zhì)疗(liáo)方(fāng)案(àn);而(ér)未(wèi)来(lái)的工程师,或许能设计出会“自愈”的智能材料。这一切,都始于我们今天对“细胞如何发育”的探索和建模。

作者:郭瑞东

审核:张江 北京师范大学系统科学学院教授

出品:中国科协科普部

监制:中国科学技术出版社有限公司、北京中科星河文化传媒有限公司