首页 > 传媒 > 关键词  > AI安全最新资讯  > 正文

“首发,前沿大模型突破渗透测试新范式”——绿盟智能渗透测试系统2.0正式发布

2026-07-15 17:28 · 稿源: 站长之家用户

2026年7月,绿盟科技成功举办AI安全创新成果发布会,正式发布新一代智能渗透系统 AI-PTS2.0。围绕任务规划、资产(Web)测绘、漏洞分析、攻击验证与报告生成等核心环节,构建端到端自主化渗透测试闭环。相较上一代产品,AI-PTS2.0的升级重点不再局限于工具调度效率提升,而是进一步面向复杂业务场景、长周期测试任务和高对抗环境,提升系统级自主研判、动态执行与持续进化能力。

AI-PTS2.0核心逻辑是将大模型长程推理能力、安全专家知识体系与工程化运行框架进行深度融合。产品底层依托智谱GLM-5.2大模型,具备1M 无损上下文窗口、长链路推理和自主工具创造能力,重点强化了“AI像人一样思考和执行”的行为能力。在持续渗透测试任务中,它不仅能像人类专家一样保持目标理解与状态记忆的一致性,多维度研判漏洞、构建攻击链条并应对突发难题;还凭借复杂问题解决能力的质的飞跃,成功推动自动化渗透测试从“按规则执行”迈向“按目标推理”,开启了全新可能。

绿盟新一代智能化渗透系统架构

智谱GLM-5.2强力加持,实现持续渗透技术跨越式升级

全流程业务时序推演,自动化挖掘深层业务逻辑漏洞

在传统渗透测试中,业务逻辑漏洞的挖掘高度依赖专家经验,一直被视为自动化工具的“禁区”。受限于静态规则,传统工具无法理解“先登录→再找回密码→再越权修改”背后的状态机逻辑与时序因果,面对此类业务关联的开放性漏洞无法推导并验证攻击链。针对这一行业痛点,绿盟科技AI-PTS在GLM-5.2多步链式推理能力的驱动下,依托Web测绘与SDL STRIDE威胁建模机制,实现了业务功能解析与时序验证质的飞跃。

基于AI驱动浏览器构建的新一代爬虫引擎,支持语义级页面识别与功能梳理,智能串联页面与功能间的业务流转逻辑,还原系统真实业务场景,完成对目标系统的全面功能测绘。

在Web测绘基础上,AI-PTS通过威胁建模锚定业务风险点,并基于功能构建风险验证Playbook,对风险点发起精准的漏洞验证。

这一风险验证机制,使得系统首次具备了像人类专家一样从业务流程入手进行“对抗性思考”的能力。经实战检验,AI-PTS成功自主验证出JeecgBoot任意用户密码重置等深层功能场景漏洞,彻底填补了业务逻辑漏洞自动化验证领域的空白。

长链路全局推理,精准挖掘跨接口链式复杂漏洞

GLM-5.2赋能的核心能力在于长链路推理、跨接口关联思考以及1M无损上下文,这一能力组合确保了AI在长达数小时的渗透测试任务中,能够始终保持逻辑连贯与状态稳定。在真实的攻防场景中,高危漏洞往往具有极高的隐蔽性和对抗性,且并非孤立存在,传统渗透工具受限于基于固定规则的单点检测机制,只能检测接口与参数,难以洞悉跨功能、多接口间的因果关系,无法有效识别复杂多阶链式漏洞。

GLM-5.2的跨接口关联推演能力,赋予了AI-PTS高级安全专家般的宏观视野,使其能够将离散的检测点串联起来,实现从单点“POC”验证向全链路“Playbook”推演的跨越。经绿盟科技实战验证,AI-PTS通过Web测绘构建系统视图,并在此基础上执行跨接口关联分析,成功完成跨系统多阶链路存储xss漏洞利用链的自主检测。

1. 用户端系统:用户设置→头像上传→构建恶意xss svg图片文件→上传并提交;

2. 后台管理端系统:管理员查看用户列表→加载用户svg头像→触发xss漏洞→返回管理员cookie。

这一成果充分证实了GLM-5.2在关联分析复杂逻辑漏洞、提升深层次挖掘能力方面的关键价值。 

跨接口的多阶链式漏洞发现

实时自主编程突围,破解高防护场景渗透阻断行业痛点

纵观当下的AI渗透测试工具,大多停留在对既有工具集的任务级调度层面。当遭遇加密报文、WAF拦截或参数强校验等高对抗环境时,预置脚本极易失效,导致漏洞检测被迫停滞。此时,系统不仅无法自主破局,反而陷入两难:要么等待安全专家人工介入指导,要么直接放弃相关目标的深度检测,实战表现大打折扣。

相比之下,AI-PTS依托GLM-5.2大模型强大的底层编码能力,叠加绿盟自研Harness工程框架及深度适配的原子渗透工具,彻底打破这一桎梏,赋予了系统基于真实场景实时生成代码的“自主编程突围”能力,以从容应对各类高对抗性防护场景:

·在资产测绘阶段,系统调用实战中持续沉淀的反爬策略库,精准规避目标的频率管控与特征识别,实现高隐蔽性的稳态探测;

·面对加固与混淆的Web应用,AI-PTS可自动执行脱壳反编译,深度逆向前端JS源码,精准定位加密算法入口与参数构造逻辑,进而实时生成定制化加密Payload,一击穿透报文防护。

绿盟Harness:构建可执行、可审计、可进化的AI渗透运行体系

专家知识资产化:将经验转化为可调用能力

绿盟科技在网络安全领域深耕二十余年,沉淀了海量真实渗透测试案例、靶场环境、攻防对抗经验及漏洞挖掘方法论。我们将专家经验与历史文档中难以复用的“隐性知识”,通过知识工程与运行时编排机制,转化为AI可理解、可调用、可审计的技能资产体系。依据渗透测试执行标准(PTES),这些专家经验被进一步固化为专属的渗透测试Playbooks知识资产。

专属Harness工程:保障长周期、多智能体协同执行

AI-PTS采用经典的“指挥-执行”双层架构与“状态黑板”机制,有效解决了多Agent分工协作中的信息孤岛与状态不一致问题。依托上下文压缩与长程工作记忆机制,系统保障了海量资产在单次长时间渗透测试任务中的持续稳定执行,在高质量输出测试发现结果的同时,最大限度地降低了对目标系统的侵扰。

三层上下文压缩机制:保持长周期任务推理连续性

针对渗透测试长周期任务中的上下文膨胀难题,AI-PTS采用三层压缩机制:第一层实施精细裁剪,工具输出仅注入路径、规模及预览,完整内容落盘保存;第二层进行工具结果微压缩,清理历史已消费的大体积输出,仅保留近期结果与追溯引用;第三层执行全量摘要压缩,当接近窗口阈值时生成任务级摘要,并重构注入关键状态信息(如工具、计划),在保留关键推理链路的同时最大化释放上下文空间,确保 Agent 在有限上下文窗口内持续保持目标与执行脉络的高效连贯。持目标与执行脉络的

长程工作记忆机制:支撑恢复、协同与复用

围绕渗透测试语义结构,构建了面向渗透测试长程工作记忆机制,不再完全依赖模型对话记忆,使系统具备长周期恢复、跨 Worker 协同、过程审计和报告复用能力。长程记忆机制将一次性的渗透测试任务转化为可持续推理、可审计执行、可沉淀复用的 AI 渗透测试运行时体系。

执行边界控制:将安全约束嵌入运行机制

渗透测试的 Harness 执行框架与 Playbook 为破坏性操作设定了清晰的安全边界。对于修改密码、删除数据、写入文件、执行 RCE 及批量变更等高风险行为,系统不会仅凭任务提示直接执行,而是强制进入阻塞(Blocked)状态。只有在获得用户明确授权后,操作方可继续进行,以此切实保障客户系统的业务连续性。

数据飞轮与评估体系:支撑能力沉淀、拉齐与持续进化

数据飞轮与评估体系深度协同,构建起“沉淀进化”与“度量拉齐”的双轮驱动模式。其中,数据飞轮将实战渗透经验转化为可继承、可复用的战术资产,赋予系统随任务积累而持续增强的特性;评估体系则依托量化标准,精确锚定各能力维度的差距,确保每一次迭代改进均可验证、可追溯。二者相辅相成,从根本上将渗透测试从传统的“一次性人力消耗型作业”,重塑为“可持续积累、可量化演进的能力基础设施”。

能力基线拉齐:以高能力模型经验反哺全模型矩阵

受合规要求、部署架构、成本结构、生态绑定等多重因素影响,不同模型在渗透测试场景下的能力表现也会存在表现出差异性。以GLM作为基准,持续积累的漏洞利用路径、测试策略、覆盖维度,经飞轮沉淀后作为知识基座,通过渗透测试能力评估体系精确度量各模型在每一能力维度上的差距,驱动飞轮持续弥合,保证所有模型承载的战术知识厚度一致,拉齐接入模型在渗透测试方面的基准能力表现,AI-PTS模型选型与能力持续积累不再构成矛盾。

持续进化:构建任务驱动的自增强闭环

传统安全工具的能力演进高度依赖厂商的版本迭代与规则升级,而AI-PTS则基于“数据飞轮”机制,实现了任务驱动的自增强进化路径。每一次渗透任务都会产生结构化的评估数据,涵盖检测覆盖是否完整、漏洞定级是否准确、推理链路是否合规等核心维度。这些数据均被纳入数据飞轮体系,作为下一轮迭代优化的输入,支持Prompt策略调优、Playbook补充及规则体系完善,从而持续提升自主渗透能力。任务执行频次越高,系统积累的知识存量越深厚,面对新场景的渗透能力起跑线也就越高。

结语

以Mythos为代表的大模型将漏洞挖掘压缩至秒级,传统“打补丁”式被动防御遇到极大挑战。未来的安全博弈,胜负不再取决于团队规模,而在于人类专家智慧与AI规模化战力的深度融合。面对此消彼长的攻防失衡危局,绿盟科技AI-PTS深度融合国产顶尖模型智谱GLM-5.2,以实战淬炼集体智慧,全面释放模型+安全的效能。这不仅是产品的跨越式升级,更是抢占“以AI对抗AI”制高点、迈向“人机协同”决胜未来的关键一击!

推广

特别声明:以上内容(如有图片或视频亦包括在内)均为站长传媒平台用户上传并发布,本平台仅提供信息存储服务,对本页面内容所引致的错误、不确或遗漏,概不负任何法律责任,相关信息仅供参考。站长之家将尽力确保所提供信息的准确性及可靠性,但不保证有关资料的准确性及可靠性,读者在使用前请进一步核实,并对任何自主决定的行为负责。任何单位或个人认为本页面内容可能涉嫌侵犯其知识产权或存在不实内容时,可及时向站长之家提出书面权利通知或不实情况说明,并提供身份证明、权属证明及详细侵权或不实情况证明(点击查看反馈联系地址)。本网站在收到上述法律文件后,将会依法依规核实信息,沟通删除相关内容或断开相关链接。

  • 相关推荐
  • 智谱GLM-5.3大模型发布:开源中最强、编程/智能体性能接近Fable 5

    智谱创始人几个小时前才说GLM-5.3很快发布,没想到中午就发了,相比当前的GLM-5.2提升50%,是开源最强的,编程与智能体性能接近Fable 5。 与之前传闻的不同,GLM-5.3跟GLM-5.2基座模型还是一样的7400多亿参数量,升级到万亿参数是没有的,有可能是留给GLM-5.5了,但这也没有妨碍GLM-5.3通过后训练来提升性能水平。 根据智谱说法,在多项主流基准测试中GLM-5.3是当前排名最高的开源�

  • 腾讯:微信智能体AI“小微”已启动小规模原型测试

    今天下午,腾讯控股正式披露2026年第二季度财务报告,当期实现营业收入2047.85亿元,同比上涨11%;公司权益持有人应占盈利560.22亿元,同比小幅增长0.7%;非国际财务报告准则归母净利润684.15亿元,同比增长9%。 腾讯还不断加强AI投入,近几周已在微信内部对智能体AI小微”启动小规模原型测试。

  • 2026 智能座舱量产测试服务商:Testin 云测 AI 自动化测试能力解析

    2026年,车载大模型规模化落地、OTA常态迭代,叠加《AI-CAP(2026版)》实施,智能座舱进入体验量化、合规闭环、快速迭代的成熟期。行业呈现三大趋势:考核从功能验证转向体验+合规+可靠性等多维量化;模式从阶段性测试转向全流程持续测试;形态从人工主导向AI自动化主导。核心困境在于测试资产难复用、虚实脱节、人才适配滞后、迭代与合规难平衡。破局关键是依托AI构建标准化、全流程贯通、资产可复用的测试体系,打通数据闭环,实现效率、质量、合规的动态平衡,成为产业升级核心支撑。

  • 智谱发布 GLM-5.3,自称编程最强的开源模型

    智谱在8月14日正式推出 GLM-5.3。有意思的是,这一版的基座模型跟 GLM-5.2其实是同一个,提升全靠后训练 Scaling 把智能上限往上拉,用了几十倍的长程任务环境、更丰富的环境类型,还有超长的后训练时间。 编程是这次最被拿来当卖点的能力。智谱称 GLM-5.3是编程能力最强的开源模型,内部体感评测比上代提升50%,在 Terminal Bench3.0、Agents' Last Exam(CLI)这些公开基准上拿到开

  • 旅行拍糊的夜景照片,一键修图软件能救回来吗?真实场景测试

    旅行夜景糊片能否救回,关键先判断“糊”因:手抖拖影、对焦偏移、高ISO噪点或混合光源偏色。轻微对焦不实、整图发虚但主体线条可辨、严重偏色三类,可用AI超清配合色温校正、裁剪构图和分区调色修到朋友圈可用;若主体轮廓断裂、五官无法辨认则不建议修,保留原图更真实。

  • 企业AI落地:从大模型走向本体驱动的超级组织

    企业部署大模型后仍难落地,根因是缺乏统一业务语义与执行闭环。文章提出,企业AI真正的底层是“本体论+大模型+智能体AI”三层架构:本体定义业务对象与关系,让AI理解企业;大模型负责推理;智能体在治理框架内执行动作。以Orion AIP为例,通过构建统一本体、融合数据与规则,可实现风险分析等场景下的“感知-分析-决策-行动”闭环,让AI从对话工具进化为能工作、可追溯、可信赖的组织核心。

  • 华为苹果手机相继落地可变光圈!三星测试后直接放弃:S27彻底缺席

    关于三星Galaxy S27系列将引入可变光圈镜头的传闻已流传一段时间,公司内部确已测试相关组件,但最新报告明确指出,Galaxy S27系列最终不会搭载这一配置。 据媒体报道,三星已决定不在Galaxy S27系列上采用可变光圈镜头。消息称三星手机部门曾对由MCNEX和三星电机制造的可变光圈摄像头模组进行测试,但最终放弃了在S27系列上使用该方案。 三星方面认为,可变光圈镜头成本�

  • AI日报:MiniMax发布Music3音乐模型;百度GenFlow官宣中文名“库库AI”;智谱发布 GLM-5.3

    MiniMax发布Music3,可生成5分钟歌曲;百度GenFlow定名库库AI,月活破亿;智谱GLM-5.3后训练提升编程并开源;OpenAI推电脑历史功能;谷歌Gemini 3.7 Flash编码升级降价50%;App Store现AI假截图刷分应用;DeepSeek V4 Pro上线硅基流动,百万上下文低价;京东七鲜首发24小时无人咖啡店。

  • 全栈AI巨头盘点:联想、阿里、华为、百度贯通算力‑大模型‑终端‑行业方案‑生态

    中国AI正加速推进算力、大模型与终端协同。联想以万全异构智算平台与问天超节点为训练推理底座,通过词元中枢统一调度模型,天禧AI连通PC、手机与平板,并以城市、制造智能体落地行业。阿里以平头哥芯片和阿里云为核心,千问模型贯通应用与终端。华为依托昇腾与盘古模型,连接鸿蒙终端与行业场景。百度则以昆仑芯和文心大模型,延伸至小度与智能驾驶。四家企业全栈路径各异,但均在真实业务中持续交付。

  • Testin XAgent实战解析:大模型+视觉自愈如何重构自动化测试工程

    WAIC2026规模破纪录,核心焦点已从“拼参数”转向“拼落地”。AI测试正经历范式跃迁,从人工编写脚本迈向智能体自主生成逻辑。尽管企业试点热度高、AI生成用例比例飙升,但规模化落地仍存鸿沟,信通院联合各方发布了技术规范。以Testin云测为代表的“AI+Agent”派,通过自然语言驱动与多模态视觉自愈,实现了测试设计和脚本稳定性的关键突破,在金融、汽车等领域大幅提效。趋势表明,AI测试正从降本增效的工具,演进为贯穿AI生命周期的质量中枢,驱动生产力重构。

今日大家都在搜的词: