天脉资讯
财经快讯 价值公司 财经人物 IPO解读 热门赛道 经济解码 科技业界 文化艺术 消费零售 大燕公益 商业快讯

360潘剑锋:AI漏洞挖掘崛起,智能体安全需以新范式驾驭不确定性

2026-06-27来源:快讯编辑:瑞雪

在ISC.AI 2026大会上,360集团首席科学家、集团高级副总裁潘剑锋提出,AI漏洞挖掘技术已从备受质疑发展到令安全人员感到压力的新阶段。他指出,这种转变并非预示着安全从业者的职业危机,而是整个行业迈向更高层次发展的契机。针对智能体在安全领域面临的天然短板,他创新性地提出了“驾驭AI不确定性”的安全治理新模式。

潘剑锋认为,传统安全面临的挑战已超越攻击手段数量和速度的增加,更深层次的变革源于计算逻辑的转变。传统软件基于确定性计算构建,人类将复杂多变的世界抽象为可计算的模型,以适应机器的运行方式。然而,大模型的出现使计算从确定性向不确定性转变,机器开始具备理解人类意图的能力,能够直接处理真实世界中模糊、开放且充满变化的任务。

这种不确定性赋予了AI强大的推理、创造和复杂任务处理能力,但同时也成为新型安全风险的源头。即使面对相同的任务输入,智能体可能因理解差异、推理路径不同或行动结果不一致而产生不可预测的行为。潘剑锋将这种不确定性分为外部和内部两个维度:外部风险源于攻击者通过隐蔽方式植入恶意指令,而内部风险则与大模型依赖统计规律生成结果、缺乏对现实世界的完整认知有关。

他进一步解释,攻击者无需直接下达明显恶意指令,而是将意图隐藏在用户输入、系统提示或工具返回信息中。大模型可能“解读”这些隐藏指令,导致模型注入或指令覆盖等安全问题。同时,大模型在生成结果时可能产生幻觉,例如虚构不存在的实体或错误认知事件顺序。当智能体进行连续推理、调用工具或与其他智能体协作时,单个判断错误可能沿任务链放大,引发严重后果。

针对这些挑战,潘剑锋提出,智能体时代的安全目标应从“防御确定威胁”转向“管控不确定性”。360集团据此构建了覆盖输入、推理和执行三个层级的安全治理框架:在输入层,通过恶意意图识别引擎检测隐藏攻击指令;在推理层,利用世界认知模型为大模型提供决策锚点,减少幻觉和错误判断;在执行层,借助环境孪生沙箱限制智能体的行动范围,实时监控工具调用、数据访问和系统操作。

在输入层的安全方案中,360采用“以模治模”策略,依托长期积累的搜索、安全攻防和监管合规数据构建专项训练模型。这些数据资源形成了一般安全厂商难以复制的语料优势。实测表明,接入360恶意意图识别引擎后,开源大模型的整体安全性可提升10%至30%。

推理层的世界认知模型通过提供对世界内在机制的理解和未来状态预测,为大模型的推理过程设置约束条件。该模型旨在从根源上抑制幻觉产生,确保智能体在处理复杂任务时保持逻辑一致性。执行层的环境孪生沙箱则通过模拟真实环境,在智能体行动前检测潜在风险,并在出现异常时立即拦截并回滚操作。

对于智能体安全市场的未来格局,潘剑锋预测,这项技术将成为每个智能体的基础配置,但不会由单一厂商垄断。市场结构可能类似于手机行业,既有占据主导地位的大型企业,也存在服务于细分领域的专业厂商。他强调,尽管AI模型能力持续增强,但安全领域仍需专业攻防经验和行业知识支撑,AI的发展正在重新定义安全行业的技术门槛。

昊志机电上半年业绩亮眼,董事长汤秀清两年薪酬达686.2万元
2026年上半年,昊志机电营业收入11.66亿元,同比增长65.86%;归属于上市公司股东的净利润为2.32亿元,同比增长266.57%;扣除非经常性损益后归属于上市公司股东的净利润为2.17亿元,同比增…

2026-08-07

谷歌1500万数据实探:AI未夺饭碗,反成打工人“琐事救星”?
一、 浅层渗透与“杠杆”真相:AI到底介入了我们工作的哪一部分? 图1:AI在美国职业与每日工作任务中的渗透梯度(数据来源:GoogleATLAS v1.0) 如图1所示,尽管68%的职业在工作中用上了A…

2026-08-07

42亿资金入局宇树科技,人形机器人产业从“概念”走向“实干”新阶段
过去两年,很多人看机器人产业,总觉得那是一个停留在实验室和展示视频里的炫酷概念。谁能拿到宇树的长期采购合同,谁能把减速器、电机、电池管理系统和轻量化外壳做出来,谁就能把账面上的利好变成实打实的营收。 机器…

2026-08-07

马云旗下云锋基金2.34亿港元入局,押注美国AI保险初创公司Corgi
8月6日,据外媒BusinessInsider报道,阿里巴巴创办人马云旗下云锋基金参与投资美国旧金山AI保险初创公司Corgi,这是云锋基金已知的首笔美国交易,该基金过往投资组合主要集中在中国市场。 Bus…

2026-08-07

具身智能浪潮下,聆动通用季超谈机器人:从想象到现实的关键跨越
Q2:外界常将“具身智能”与“人形机器人”划等号,而且确实有不少人形机器人正涌入工业场景,你怎么看这种形态选择与技术趋势? 季超:目前工业界普遍认可的周期是2到3年,我们在部分典型场景中已经将回本周期压缩到…

2026-08-07

AMC系长城新盛信托管理层变动:董事长任职资格获批,总经理也换新
长城新盛信托在2025年年报中披露,2026年3月16日,经公司董事会和2026年2月25日公司股东会审议,同意在拟任董事管春平任职资格核准后解聘吴映江公司董事职务。 长城新盛信托注册资金3亿元,注册地在乌鲁…

2026-08-07

Meta与DeepSeek“价格博弈”:AI混战下Agent成竞争新焦点
智东西8月6日报道,今日,Meta推出其首款编程Agent——Muse Code(测试版),以及该Agent搭载的新一代模型MuseSpark 1.2。 那么试图与DeepSeek打价格战的Meta,其最…

2026-08-07

AI短篇故事质量获认可,但人类创作仍受偏爱,读者难辨人机作品差异
结果显示,与阅读人类作品的参与者相比,阅读人工智能生成故事的参与者认为作品更具吸引力,整体质量也更高。每名参与者需要阅读两篇主题相同的短篇故事,其中一篇由人类创作,另一篇由人工智能生成,并判断两篇作品各自的…

2026-08-07

字节跳动全员会:梁汝波谈业务战略调整,回应AI布局与组织管理新动向
8月6日,界面新闻记者获悉,今天上午,字节跳动举办了公司CEO梁汝波以及刚刚成立的“创造力服务平台”部门负责人谭待等与全体员工的交流会。 梁汝波总结了字节跳动AI业务在2026年上半年的表现:豆包在C端(用…

2026-08-06

叮咚V5“不扩品”谋增长:组织系统“养”出锐利爆品,再造新可能
在听了叮咚买菜副总裁兼研究院院长申强、标品事业部负责人戴正近两个小时的分享后,我们感兴趣的是:是什么样的组织系统,能让叮咚买菜有信心“养”出200多个“锐利爆品”。 叮咚为叮咚V5确立三个根目录的本质,是把…

2026-08-06