科技日报记者 华凌
近日,智源研究院大模型安全研究团队联合北京大学完成一项端到端系统性评估,聚焦大语言模型进化为具备工具调用、任务规划能力的智能体之后,对生物安全边界带来的潜在影响。

本次评估重点考察,AI智能体是否会降低非专业人员绕过DNA合成筛查的知识门槛。研究构建完整测试链条,覆盖智能体方案生成、程序化计算校验、受控湿实验验证,最终通过电泳、测序检验方案在物理实验中的可执行性。评测选取11款商用大语言模型,采用国际通用DNA序列筛查基准开展对照实验。

测试结果显示,全部11个模型均可生成能够规避筛查机制的DNA分片方案。其中GPT-5.5、Claude Opus 4.6还能够输出完整的分步实验操作指导。研究团队在严格安全约束下开展实验,使用关键位点突变、丧失有害功能的良性代理序列完成验证,4组构建体均顺利组装成功,形成从数字方案到物理实验验证的完整证据链。

DNA合成筛查是当前生物安全领域关键防线,分片拆分攻击是已知风险方式。以往该操作高度依赖专业知识,知识门槛天然形成防护屏障。如今大模型智能体大幅降低相关操作门槛,暴露出现有筛查体系存在系统性短板,存在不容忽视的双重用途安全风险。
研究强调,本次实验严格遵循负责任披露原则,全程不生成具有活性的危险产物,不公开危险物质制备方法。面向风险新形势,需要搭建多层协同防护体系:完善大模型上线前生物安全能力测评、拓展智能体全流程安全管控;升级DNA合成筛查技术;加快推进国际标准落地,构建跨国协同治理机制。
(受访者供图)

网友评论