全球规模最大的AI开源社区Hugging Face近日在官网通报了一起安全事件,攻击源头竟是一个完全自主运行的AI智能体。这起事故迅速在全球激起关于人工智能安全防护、取证及应对机制的热议。据新民晚报记者从上海人工智能实验室了解,该实验室近期上线了“书安”AI安全基座平台。该平台整合了数字孪生平台、智能验证矩阵以及数据进化飞轮三大核心模块,意在打造一套可复现、能评估且具备自我进化能力的AI全链路安全验证体系。
文章配图-1
作为整套验证体系的基石,高保真孪生平台通过数字孪生、数据脱敏及安全隔离等技术手段,对真实系统中的业务流程、资产关联、权限架构及运行环境进行高精度映射,构建出动态的验证框架。这一孪生体不仅还原静态配置,更能实时模拟业务状态流转与异常响应,确保每一次测试都能精准捕捉生产环境中潜在的隐患与安全盲区。
据介绍,“书安”平台打破了传统安全“靶场”的局限,能够支持数千个级别的安全验证智能体在同一环境中博弈并迭代进化。目前已建成包含1500余个业务场景、50万余款真实工具的动态仿真环境,足以支撑复杂工具联动调用及多轮长程交互等全真业务流程的仿真验证。借助自研的超图马尔科夫链验证算法,平台已完成17套线上真实业务系统的全维度安全测评与有效性核验。
在AI安全验证环节,“书安”AI安全基座平台首先充当“体检中心”。其内置由上海AI实验室自主研发的智能扫描引擎,不依赖固定漏洞库,而是通过自适应推理理解系统业务逻辑。平台利用数字孪生技术高并发模拟极端场景,驱动多智能体协同检查不同模块。更具突破性的是,平台引入了类似AlphaZero的自博弈强化学习能力,赋予智能体自主演化的能力。
随后,平台切换至“体测中心”模式,对系统进行全方位的风险应对测试。它构建了多维度动态评估体系,结合数据库访问行为、全链路业务上下文及系统运行状态,自动识别异常并动态调整执行测试方案,形成自动化闭环的“体测”流程。
在整个验证过程中,一套智能裁判系统始终在后台运行。它实时记录验证全过程、最终效果及安全风险影响等数据,通过自动化研判打分并对结果做出公正裁决,最终输出标准化、可量化且可追溯的安全评估报告。
文章配图-2
新民晚报记者获悉,目前,“书安”AI安全基座平台已在多个产业关键场景中开展应用验证。在国际物流供应链领域,平台通过模拟新型安全隐患,助力厦门国际物流供应链中试基地验证核心业务系统应对复杂风险的能力,从而提升供应链在智能化场景中的安全韧性。在金融领域,平台支撑银联金融支付中试基地,针对金融支付垂域大模型PaySage1.0-Turbo、商户入网审核智能体、数据分类分级智能体及用户合作经营智能体等多类业务场景开展安全验证,保障模型与智能体应用的稳定可靠。在进出境领域,平台协助上海海关将安全多智能体协同能力嵌入单证审核、风险防控、口岸查验等关键环节,既实现了监管更精准严密、通关更便利高效,又确保了系统安全可控,保障业务平稳运行。
自2024年提出“AI—45°平衡律”以来,上海AI实验室致力于推动AI安全与性能同步演进,目前已逐步建立起覆盖顶层理念、核心技术与行业标准的完整支撑体系。















