☰
24个真漏洞一条脚本挖出来,安全审计的报价表悬了
2026/9/30 23:42:45 网站建设 项目流程

24 个真漏洞一条脚本挖出来,安全审计的报价表悬了

**【ITADN导读】**GitHub 官方开源的 AI 安全代理,真刀真枪挖出 24 个 Android 漏洞,维基百科 App 的会话 Cookie 都能被偷走。挖洞的成本从按周报价压到一晚电费,安全审计这行最贵的部分先被端了。

一个 AI 代理,刚刚在 Android 应用里挖出 24 个真实漏洞,其中一个能让维基百科官方 App 的账号被全站接管。这份成果来自 GitHub 安全实验室开源的自动化审计工具,代码公开,任何人都能复现,和安全公司没什么关系。它最狠的一单:在下载量超千万的导航应用 OsmAnd 里,恶意应用可悄悄篡改地图瓦片下载地址,你去过的每个坐标、搜过的每条路线都会被送往攻击者服务器;在维基百科 App 里,它串联两个无害漏洞,直接偷走登录所有维基项目的会话 Cookie。过去这类活儿只有资深研究员按天收费才能干,现在一个脚本跑一两小时就出结果——安全审计的饭碗,正被 AI 端走。

一图看懂:本文关键数据

24 个洞,一夜全挖出来了

24 个。GitHub Security Lab 9 月 28 日官宣:他们开源的那个 AI 安全代理,在 Android 应用里真刀真枪挖出并上报了24 个漏洞——全是真洞,不是靶场练习题。

最能说明问题的是 OsmAnd 这个案例。导航应用,下载量超 1000 万,Google Play 上的老牌选手。

漏洞链条拆开看,每一环都是 Android 开发者天天摸的东西:OsmAnd 导出了 MapActivity(就是那个显示地图的页面),它接受任意 intent extras——意思是任何装在你手机上的 App,都能往它塞参数。恶意应用借着这个口子,静默导入一份设置,把地图瓦片的下载地址换成自己的服务器。

然后呢?你每看一块地图,那台服务器就记下一块瓦片的坐标。你搜一条路线,起终点也一并过去。全程没有任何弹窗,你毫不知情。

博文中展示的 android.xml 文件截图,AI 代理就是顺着这类配置摸到漏洞的

换句话说,你手机里的导航 App,可能正在替别人记你去过哪、住哪、每周往哪跑。这不是理论风险,是 AI 已经替攻击者把路探好的洞——好在这次先探到的是防守方。

更扎心的是速度。这种「导出组件没校验入参」的洞,人类审计员翻一个中大型 Android 项目,得按天算。AI 代理跑完一遍,交出 24 份带复现步骤的报告。

安全审计过去按人天收费,现在开始按脚本计次。这个行业的报价表,悬了。

维基百科也栽在同一行代码上

维基百科的 App,被同一行代码坑了两次。

先说 deeplink(App 内部的一个跳转入口)。维基百科 Android 客户端处理外部链接时,用一句「域名是否以 wikipedia.org 结尾」来判断来源可不可信。听起来没问题?攻击者花几十块钱注册一个 evilwikipedia.org,结尾完全匹配——校验直接放行。你的 App 就这么替攻击者开了门。

更离谱的是第二处。Cookie 的域名校验,写的是一模一样的判断。同样一个 endsWith,同样的姿势,同样被绕过。两个洞单独看都算低危,串起来就是一锅端:攻击者拿到的是跨所有维基媒体项目通用的长效登录 Cookie——维基百科、维基词典、共享资源,全线失守,账号直接接管。

GitHub 开源安全基金的合作方列表,微软、Stripe、Shopify 等均在列(资料图)

这个案例真正吓人的地方在于:endsWith 这种写法,几乎每个 Android 开发者都写过。判断域名、判断路径、判断文件后缀,顺手一句 endsWith 就完事了。这不是维基百科团队水平差——能维护全球前十大网站客户端的团队,栽在所有人心照不宣的惯用写法上。你的项目里,大概率也躺着这么一行。

为什么渗透测试团队漏了它?因为「两个低危串成高危」这种组合拳,恰恰是人最不擅长找的。安全工程师逆一遍 intent filter、手工试几个域名,每一项单独看都「不算大事」,报告里各归各位。AI 不一样——它不知道哪个「不算大事」,它把每一个校验点都按同一套逻辑过一遍,两个洞之间那根线,是系统性扫描扫出来的,靠灵感的猎人反而看不见。

所以别再问「AI 找的洞算不算真本事」。维基百科的账号接管链就在那儿,它的发现者不喝咖啡、不犯困、不觉得某个域名「看起来眼熟就放过」。

你能做的:全局搜一下自己项目里的 endsWith,看看它校验的是什么。是文件名,无所谓;是域名,今晚就改。

它不是运气,是提示词工程

先说结论:这次挖洞不是靠模型撞大运,是靠一套「审计流程说明书」。

GitHub 的做法叫「taskflow」——说穿了,就是把资深安全研究员脑子里的审计清单,写成 LLM 能一步步照着执行的流程文件。每一步干什么、先看什么、再查什么,全部写死在提示词里。这跟「把代码整包丢给 ChatGPT 问有没有漏洞」是两个物种:前者是一整套 SOP,后者是抽签。

有两个流程文件值得单独点名。一个负责摸清移动端攻击面——先把 App 暴露给外界的入口全列出来,再逐个排查;另一个强制检查混淆代理、不安全广播这类只有移动端才会踩的坑。审计 Android 代码漏掉这些类目,等于查消防隐患时没看安全出口。

更讲究的是运行策略。严格版提示词负责保底,保证明显的洞一个不漏;宽泛版提示词放开手脚,让模型发挥直觉去挖藏得深的。两套各跑几遍,查全率和深度同时要。这是人肉团队分工的玩法,现在写成了脚本。

这个代理不绑定任何模型,Claude Code、Codex、Cursor 都能跑

对你真正有用的是这个:taskflow 的思路可以整个搬回自己的代码库。你团队的代码规范、上线前检查清单、历史上踩过的坑——全都能改写成这种分步流程,挂到任意一个 Agent 上跑。前面说的那批漏洞,证明的不是某个模型多聪明,是「把经验写成流程」这件事本身值钱。

你的仓库,1 小时跑完审计

这不是藏在 GitHub 内部的玩具,仓库直接开源了。任何人都能去 seclab-taskflows 起 一个 codespace(相当于浏览器里临时开一台开发机),敲一条命令:

相信大家在日常手动绘图工作中,都有被画布需要反复调整拉扯、代码更新后图片又容易过期的问题烦到过。

./scripts/audit/run_mobile.sh myorg/myrepo

把 myorg/myrepo 换成你自己的 Android 仓库,然后去泡杯咖啡。中型仓库,大约 1 到 2 小时出结果。对比一下传统做法:请一支渗透测试团队进场,排期以周算,报价以万算,报告回来时代码都迭代两版了。

开源项目在 GitHub 上冲榜的场面(资料图)

但门槛得说清楚,别看错了:

它要 GitHub Copilot 许可证才能跑。跑一次会消耗 premium 模型请求,token 烧得也不少。额度紧张的团队,先拿一个小仓库试水,别一上来就把主力仓怼进去。

所以哪些人适合现在就上?有 Copilot 企业版、手上有 Android 客户端、又养不起专职安全团队的中小公司,这东西就是给你们造的。私有化部署受限、或者额度本来就见底的大厂内部团队,可以再等等。

还有一句实话:跑出来的每一条结果,都得有人复核。模型目前只会告诉你「这里有问题」,不会告诉你「这个问题值几个 CVSS 分」。它替代的是审计里最枯燥的那段人海搜索,签字画押的那一下还是人来的。

一句话:以前只有甲方乙方安全专家才做得起的事,现在是你仓库里一条脚本的事。就差一个许可证的距离。

评论区说说,你们团队敢不敢让 AI 先扫一遍生产代码?

AI 找洞快,评洞靠不住

泼冷水的话,是 GitHub 自己说的。

在他们自己的复盘里写得很直白:模型擅长找洞,但评洞经常翻车。你明确要求「只报高危」,它照样把低危的塞进来;有些洞看起来吓人,实际上代码路径只落在外部存储上,压根利用不了——这种「缓解因素」,模型看不出来。

所以每一条发现,最后都要过安全研究员的手。

听起来像是「AI 不行,还得靠人」?恰恰相反,这句话才是整件事里最要命的。

因为「人复核 24 个候选」和「人从零审计一整个仓库」,根本是两种工作量。前者是一下午的事,后者是一个团队按周算的活。中间隔着的,就是那一个数量级的差距——AI 把安全审计里最贵的部分(把整个仓库翻一遍)压到了几乎为零,人只剩最后一道签字。

这意味着两件事同时发生。

有安全团队的大厂,复核岗不需要那么多人了——以前五个研究员挖洞,现在两个验洞就够,剩下的岗位被挤掉。而从来养不起安全团队的小公司,第一次跑得起审计了——一晚上脚本的事,不用再赌「我这个仓库应该没人盯上」。

AI 安全代理的落地进度(资料图)

所以别问「AI 会不会抢安全研究员的饭碗」,这个问法已经过时了。真实发生的是:**挖洞的手艺在贬值,验洞的判断在涨价。**还在靠「我能找到洞」吃饭的人,该焦虑的今晚就该焦虑了;会评估「这个洞能不能打、值不值得修」的人,反而更抢手了。

岗位没消失,岗位在被 squeeze——评论区说说,你们公司的安全团队,今年缩了还是扩了?

下一个被扫的是谁?

工具一开源,事情的性质就变了。

GitHub 把代理挂出来,意味着这套东西已经属于所有人。白帽今晚就能把它指向自己负责的项目,赶在别人前面把洞堵上。但同一个仓库,黑帽也在 clone——找洞和审计,跑的压根是同一条命令。

这不是危言耸听。这次挖洞用的全是公开应用,从应用商店就能下载。**你上架的 App,和别人用来攻击你的武器,是同一份安装包。**OsmAnd 那个漏洞的可怕之处就在这:恶意应用导入一份设置、换掉地图瓦片的地址,用户每看一眼地图、每搜一条路线,坐标就流向了别人的服务器,全程无提示。这种洞以前要专家蹲在反编译器前面熬几天,现在是一条流水线里的一环。

所以给一个可以直接被验证的判断:**三个月内,主流 Android 应用会集中爆出一波「AI 审计」来源的漏洞披露。**理由很简单——应用安全里最贵的那步「攻击面普查」,第一次变成了脚本就能干的事。以前没人有精力把你 App 里每个导出组件翻一遍,现在翻一遍的成本是电费。

留给开发者的窗口就这么宽。你的仓库如果还没跑过一次完整的审计,等于裸奔在别人已经装好弹药的靶场里。

评论区聊一句:你敢把自己负责的项目丢给这个代理跑一遍吗——还是怕它挖出来的东西,你自己都不敢看?

现在能动手的就三件事:第一,去 GitHub 搜 seclab-taskflows 仓库,用 codespace 对自己团队的 Android 仓库跑一遍./scripts/audit/run_mobile.sh myorg/myrepo,一晚上就知道你家 App 底子有多干净;第二,把所有 deeplink 和导出组件里的主机名校验翻出来搜一遍endsWith——维基百科就是这么被接管的,别觉得自己是例外;第三,跑之前先看一眼团队的 GitHub Copilot 许可证额度和 premium 请求数,中型仓库一次审计要跑一到两个小时,token 烧得不便宜,别月底账单吓一跳。

工具、漏洞、方法论全都公开了,唯一没开源的是那个替你复核结果的安全研究员。这一部分,可能是这个岗位未来三年最值钱的东西。把你们团队管安全的同事拉来看这篇,他今晚大概率要重新排优先级了。

最后抛个站队问题:你觉得安全审计这行,会停在「AI 挖洞、人复核」的新常态,还是连「复核」这块剩下的地盘,也只是 AI 逐步吃掉的台阶?

学习资源


如果你也是零基础想转行网络安全,却苦于没系统学习路径、不懂核心攻防技能?光靠盲目摸索不仅浪费时间,还消磨自己信心。这份 360 智榜样学习中心独家出版《网络攻防知识库》专为转行党量身打造!

01内容涵盖

这份资料专门为零基础转行设计,19 大核心模块从 Linux系统、Python 基础、HTTP协议等地基知识到 Web 渗透、代码审计、CTF 实战层层递进,攻防结合的讲解方式让新手轻松上手,真实实战案例 + 落地脚本直接对标企业岗位需求,帮你快速搭建转行核心技能体系!

这份完整版的网络安全学习资料已经上传CSDN【保证100%免费】

**读者福利 |******[CSDN大礼包:《网络安全入门&进阶学习资源包》免费分享

02 知识库价值

  • 深度: 本知识库超越常规工具手册,深入剖析攻击技术的底层原理与高级防御策略,并对业内挑战巨大的APT攻击链分析、隐蔽信道建立等,提供了独到的技术视角和实战验证过的对抗方案。
  • 广度: 面向企业安全建设的核心场景(渗透测试、红蓝对抗、威胁狩猎、应急响应、安全运营),本知识库覆盖了从攻击发起、路径突破、权限维持、横向移动到防御检测、响应处置、溯源反制的全生命周期关键节点,是应对复杂攻防挑战的实用指南。
  • 实战性: 知识库内容源于真实攻防对抗和大型演练实践,通过详尽的攻击复现案例、防御配置实例、自动化脚本代码来传递核心思路与落地方法。

03 谁需要掌握本知识库

  • 负责企业整体安全策略与建设的CISO/安全总监
  • 从事渗透测试、红队行动的安全研究员/渗透测试工程师
  • 负责安全监控、威胁分析、应急响应的蓝队工程师/SOC分析师
  • 设计开发安全产品、自动化工具的安全开发工程师
  • 对网络攻防技术有浓厚兴趣的高校信息安全专业师生

04部分核心内容展示

360智榜样学习中心独家《网络攻防知识库》采用由浅入深、攻防结合的讲述方式,既夯实基础技能,更深入高阶对抗技术。

内容组织紧密结合攻防场景,辅以大量真实环境复现案例、自动化工具脚本及配置解析。通过策略讲解、原理剖析、实战演示相结合,是你学习过程中好帮手。

1、网络安全意识

2、Linux操作系统

3、WEB架构基础与HTTP协议

4、Web渗透测试

5、渗透测试案例分享

6、渗透测试实战技巧

7、攻防对战实战

8、CTF之MISC实战讲解

这份完整版的网络安全学习资料已经上传CSDN【保证100%免费】

**读者福利 |**[CSDN大礼包:[《网络安全入门&进阶学习资源包》免费分享 ]

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询