AI“连络科学家”重塑科研协作编制
科技日报记者 张佳欣
2024年春的连络一天,美国斯坦福除夜学病理学家托马斯·蒙廷开启了一场史无前例的科学“考验考验室会议会议”——与6位由人工智能(AI)驱动的“虚构科学家”共商阿尔茨海默病的医治计策 。这些AI被授予不合的家重专业角色,从神经科学家到药物化学家,塑科在几分钟内展开多轮构和,研协最生平成了一份长达一万多字的作编制会议会议记要。这场看似科幻的连络气候,理论上是科学一个新兴趋势的缩影 :以多智能体言语模型构成“AI科研团队”,模仿真实研究协作过程 ,家重辅佐科学家俭仆时分、塑科完竣假定 ,研协甚至激起新的作编制科学灵感。斥地者称这类琐细为“连络科学家”。连络

多家机构打造“虚构考验考验室”
本年2月,科学谷歌旗下“深度思惟”公司推出了一款名为“AI连络科学家”的家重软件 。该软件由6个AI代办代办代办代理构成,分袂担当设法生成、反思或攻讦、定见演进 、往重 、排序和总结审稿,均由谷歌的Gemini 2.0模型驱动 。这套琐细是谷歌生物医学AI研究工作的延长 。在一项初期测试中 ,该琐细在两天内就措置了困扰科学家十多年的科学谜题 。
美国斯坦福除夜学也在旧年11月推出了“虚构考验考验室”琐细 ,蒙廷试用的恰是这个版本 。科技媒体Freethink网站报导称,如今,该琐细以OpenAI的GPT-4o为根本 ,默许设备“首席研究员”和“攻讦者”两个角色,用户可逍遥添加更多代办代办代办代理并设定他们的专业局限 ,疾速生成模仿会议会议记实。
在中国 ,上海人工智能考验考验室的研究团队也在斥地虚构科学家琐细,名为“VirSci”,专注于模仿科学家团队的合作过程 ,以鞭挞科研立异 。
英国《天然》杂志报导称,这些琐细所用的除夜型言语模型(LLM)不单仅是在“你一言我一语”地交换不雅不雅不雅不雅不雅不雅不美不雅不雅不雅不雅念 ,它们还具有联网检索信息、奉行代码 、调用专业对象等下场,属于一种“代办代办代办代理式AI”琐细。这一术语如今尚不严格 ,但一样往常指LLM在必定程度上能自立担当负务。美国阿贡国度考验考验室的筹算机科学家里克·史蒂文斯指出 ,多个AI代办代办代办代理协同作战,可延续数小时专注于措置宏壮科学问题 ,不会走神 ,也不会倦怠。
AI科研团队可否靠谱
那么问题来了 :这些AI之间的对话,像是一房子的诺贝尔奖得主,仍是一群本科生?它们的设法是天方夜谭 、浮泛无趣,仍是令人昂扬 、值得深挖?
现阶段的AI代办代办代办代理琐细切实其实存在“幻觉”问题 ,即生成偏向或虚构的信息 。但芝加哥除夜学筹算机科学家史蒂文斯指出,经由过程引进“攻讦者”或“评审者”的角色,琐细经常能有效筛除不公允内容,汲引集团刚毅性。他还认为,即就是“幻觉” ,在思惟风暴场景下也大年夜大年夜约激起出意想不到的创意 ,前提是有专家把关 。
现有研究也创作创造,多代办代办代办代理协作切实其实优于单一AI。以GPT-4o为例,斯坦福除夜学团队创作创造 ,若在对话中介入一名“攻讦者”,该模型在研究生程度的科学测试中的默示会进步几个百分点,在理论科研独霸中的答复也愈加精准,比如在放射医治筹划筹划方面更具逻辑。
谷歌也曾对其连络科学家琐细展开评价 ,下场展示,人类专家更偏向于由多个AI协作生成的答复,认为其更具新意和科研潜力。
关于若干很多若干良多若干很多若干良多若干很多若干名AI代办代办代办代理 、几轮互动最为有效 ,科学界也正在寻觅谜底。上海人工智能考验考验室筹算机科学家董楠卿等人斥地VirSci琐细时创作创造 ,最好创作创作创造力涌如今“8个代办代办代办代理人×每人5轮讲话”的设置下。而斯坦福除夜学的斯旺森则展示 ,超出3个专家后输进经常变得冗余 ,3轮此后琐细也随便跑题。
AI的点子幻想下场有多新
谷歌在宣布其连络科学家琐细时展示,该琐细辅佐研究者提出了“别致的料想” 。比如,斯坦福除夜学的加里·佩尔茨用谷歌的“AI连络科学家”琐细寻觅医治肝纤维化的新药时,AI团队在分化布景信息后提出3种药物建议 ,个中2种在考验考验中展示出疗效 ,反而优于他本身遴选的筹划 。但同时 ,一些科学家则认为这些建议真实“谈不上甚么新意”。
近似的争议也涌如今帝国理工学院微生物学家何塞·佩纳德斯团队测试谷歌琐细时 。AI在不雅不雅不雅不雅鉴赏布景文献后,提出了一种未见于任何文献的新假定 :挪动遗传元件可“跨细胞窃取”噬菌体尾部。这一不雅不雅不雅不雅不雅不雅不美不雅不雅不雅不雅念挑衅主流 ,却与该团队经由过程未悍然考验考验得出的结论齐截 。佩纳德斯认为 ,当然AI只是把已有信息作了一个“不问可知”的推理,但其本身就是科学进步。
《天然》杂志指出,这类AI琐细如今更像是一种科研助理:它们经由过程总结材料 、激起灵感 、提出新角度或查漏补缺 ,辅佐研究者俭仆时分,进步屈就 。大年夜大年夜约否能催生真正倾覆性的设法 ,还需经久验证。
如今 ,这类多智能体言语模型琐细还没有以群众化 、便捷的编制普及供给 。但研究人员普及认为,AI连络科学家终将成为科研往常的一部分 ,就像搜刮引擎一样 ,不过这真实不虞味着它能庖代人类 。史蒂文斯提示,假定年青科研人员过分依托AI,大年夜大年夜约会伤害其自立思虑和进修身手 。西班牙癌症研究者巴里加也展示,过分依托AI ,就似乎把思虑过程“外包” ,而那恰是科研中最滑稽的部分。
