ARTICLE · INTELLIGENCE

战地情报 · 详情页

来自尧图项目组的一线实战观察与深度解析

24个真漏洞一条脚本挖出来,安全审计的报价表悬了

24个真漏洞一条脚本挖出来,安全审计的报价表悬了 24 个真漏洞一条脚本挖出来安全审计的报价表悬了**【ITADN导读】**GitHub 官方开源的 AI 安全代理真刀真枪挖出 24 个 Android 漏洞维基百科 App 的会话 Cookie 都能被偷走。挖洞的成本从按周报价压到一晚电费安全审计这行最贵的部分先被端了。一个 AI 代理刚刚在 Android 应用里挖出 24 个真实漏洞其中一个能让维基百科官方 App 的账号被全站接管。这份成果来自 GitHub 安全实验室开源的自动化审计工具代码公开任何人都能复现和安全公司没什么关系。它最狠的一单在下载量超千万的导航应用 OsmAnd 里恶意应用可悄悄篡改地图瓦片下载地址你去过的每个坐标、搜过的每条路线都会被送往攻击者服务器在维基百科 App 里它串联两个无害漏洞直接偷走登录所有维基项目的会话 Cookie。过去这类活儿只有资深研究员按天收费才能干现在一个脚本跑一两小时就出结果——安全审计的饭碗正被 AI 端走。一图看懂:本文关键数据24 个洞一夜全挖出来了24 个。GitHub Security Lab 9 月 28 日官宣他们开源的那个 AI 安全代理在 Android 应用里真刀真枪挖出并上报了24 个漏洞——全是真洞不是靶场练习题。最能说明问题的是 OsmAnd 这个案例。导航应用下载量超 1000 万Google Play 上的老牌选手。漏洞链条拆开看每一环都是 Android 开发者天天摸的东西OsmAnd 导出了 MapActivity(就是那个显示地图的页面)它接受任意 intent extras——意思是任何装在你手机上的 App,都能往它塞参数。恶意应用借着这个口子静默导入一份设置把地图瓦片的下载地址换成自己的服务器。然后呢你每看一块地图那台服务器就记下一块瓦片的坐标。你搜一条路线起终点也一并过去。全程没有任何弹窗你毫不知情。博文中展示的 android.xml 文件截图AI 代理就是顺着这类配置摸到漏洞的换句话说你手机里的导航 App,可能正在替别人记你去过哪、住哪、每周往哪跑。这不是理论风险是 AI 已经替攻击者把路探好的洞——好在这次先探到的是防守方。更扎心的是速度。这种「导出组件没校验入参」的洞人类审计员翻一个中大型 Android 项目得按天算。AI 代理跑完一遍交出 24 份带复现步骤的报告。安全审计过去按人天收费现在开始按脚本计次。这个行业的报价表悬了。维基百科也栽在同一行代码上维基百科的 App被同一行代码坑了两次。先说 deeplinkApp 内部的一个跳转入口。维基百科 Android 客户端处理外部链接时用一句「域名是否以 wikipedia.org 结尾」来判断来源可不可信。听起来没问题攻击者花几十块钱注册一个 evilwikipedia.org结尾完全匹配——校验直接放行。你的 App 就这么替攻击者开了门。更离谱的是第二处。Cookie 的域名校验写的是一模一样的判断。同样一个 endsWith同样的姿势同样被绕过。两个洞单独看都算低危串起来就是一锅端攻击者拿到的是跨所有维基媒体项目通用的长效登录 Cookie——维基百科、维基词典、共享资源全线失守账号直接接管。GitHub 开源安全基金的合作方列表微软、Stripe、Shopify 等均在列资料图这个案例真正吓人的地方在于endsWith 这种写法几乎每个 Android 开发者都写过。判断域名、判断路径、判断文件后缀顺手一句 endsWith 就完事了。这不是维基百科团队水平差——能维护全球前十大网站客户端的团队栽在所有人心照不宣的惯用写法上。你的项目里大概率也躺着这么一行。为什么渗透测试团队漏了它因为「两个低危串成高危」这种组合拳恰恰是人最不擅长找的。安全工程师逆一遍 intent filter、手工试几个域名每一项单独看都「不算大事」报告里各归各位。AI 不一样——它不知道哪个「不算大事」它把每一个校验点都按同一套逻辑过一遍两个洞之间那根线是系统性扫描扫出来的靠灵感的猎人反而看不见。所以别再问「AI 找的洞算不算真本事」。维基百科的账号接管链就在那儿它的发现者不喝咖啡、不犯困、不觉得某个域名「看起来眼熟就放过」。你能做的全局搜一下自己项目里的 endsWith看看它校验的是什么。是文件名无所谓是域名今晚就改。它不是运气是提示词工程先说结论这次挖洞不是靠模型撞大运是靠一套「审计流程说明书」。GitHub 的做法叫「taskflow」——说穿了就是把资深安全研究员脑子里的审计清单写成 LLM 能一步步照着执行的流程文件。每一步干什么、先看什么、再查什么全部写死在提示词里。这跟「把代码整包丢给 ChatGPT 问有没有漏洞」是两个物种前者是一整套 SOP后者是抽签。有两个流程文件值得单独点名。一个负责摸清移动端攻击面——先把 App 暴露给外界的入口全列出来再逐个排查另一个强制检查混淆代理、不安全广播这类只有移动端才会踩的坑。审计 Android 代码漏掉这些类目等于查消防隐患时没看安全出口。更讲究的是运行策略。严格版提示词负责保底保证明显的洞一个不漏宽泛版提示词放开手脚让模型发挥直觉去挖藏得深的。两套各跑几遍查全率和深度同时要。这是人肉团队分工的玩法现在写成了脚本。这个代理不绑定任何模型Claude Code、Codex、Cursor 都能跑对你真正有用的是这个taskflow 的思路可以整个搬回自己的代码库。你团队的代码规范、上线前检查清单、历史上踩过的坑——全都能改写成这种分步流程挂到任意一个 Agent 上跑。前面说的那批漏洞证明的不是某个模型多聪明是「把经验写成流程」这件事本身值钱。你的仓库1 小时跑完审计这不是藏在 GitHub 内部的玩具仓库直接开源了。任何人都能去 seclab-taskflows 起 一个 codespace(相当于浏览器里临时开一台开发机)敲一条命令:相信大家在日常手动绘图工作中都有被画布需要反复调整拉扯、代码更新后图片又容易过期的问题烦到过。./scripts/audit/run_mobile.sh myorg/myrepo把 myorg/myrepo 换成你自己的 Android 仓库然后去泡杯咖啡。中型仓库大约 1 到 2 小时出结果。对比一下传统做法请一支渗透测试团队进场排期以周算报价以万算报告回来时代码都迭代两版了。开源项目在 GitHub 上冲榜的场面(资料图)但门槛得说清楚别看错了它要 GitHub Copilot 许可证才能跑。跑一次会消耗 premium 模型请求token 烧得也不少。额度紧张的团队先拿一个小仓库试水别一上来就把主力仓怼进去。所以哪些人适合现在就上有 Copilot 企业版、手上有 Android 客户端、又养不起专职安全团队的中小公司这东西就是给你们造的。私有化部署受限、或者额度本来就见底的大厂内部团队可以再等等。还有一句实话跑出来的每一条结果都得有人复核。模型目前只会告诉你「这里有问题」不会告诉你「这个问题值几个 CVSS 分」。它替代的是审计里最枯燥的那段人海搜索签字画押的那一下还是人来的。一句话以前只有甲方乙方安全专家才做得起的事现在是你仓库里一条脚本的事。就差一个许可证的距离。评论区说说你们团队敢不敢让 AI 先扫一遍生产代码AI 找洞快评洞靠不住泼冷水的话是 GitHub 自己说的。在他们自己的复盘里写得很直白模型擅长找洞但评洞经常翻车。你明确要求「只报高危」它照样把低危的塞进来有些洞看起来吓人实际上代码路径只落在外部存储上压根利用不了——这种「缓解因素」模型看不出来。所以每一条发现最后都要过安全研究员的手。听起来像是「AI 不行还得靠人」恰恰相反这句话才是整件事里最要命的。因为「人复核 24 个候选」和「人从零审计一整个仓库」根本是两种工作量。前者是一下午的事后者是一个团队按周算的活。中间隔着的就是那一个数量级的差距——AI 把安全审计里最贵的部分(把整个仓库翻一遍)压到了几乎为零人只剩最后一道签字。这意味着两件事同时发生。有安全团队的大厂复核岗不需要那么多人了——以前五个研究员挖洞现在两个验洞就够剩下的岗位被挤掉。而从来养不起安全团队的小公司第一次跑得起审计了——一晚上脚本的事不用再赌「我这个仓库应该没人盯上」。AI 安全代理的落地进度(资料图)所以别问「AI 会不会抢安全研究员的饭碗」这个问法已经过时了。真实发生的是**挖洞的手艺在贬值验洞的判断在涨价。**还在靠「我能找到洞」吃饭的人该焦虑的今晚就该焦虑了会评估「这个洞能不能打、值不值得修」的人反而更抢手了。岗位没消失岗位在被 squeeze——评论区说说你们公司的安全团队今年缩了还是扩了下一个被扫的是谁?工具一开源事情的性质就变了。GitHub 把代理挂出来意味着这套东西已经属于所有人。白帽今晚就能把它指向自己负责的项目赶在别人前面把洞堵上。但同一个仓库黑帽也在 clone——找洞和审计跑的压根是同一条命令。这不是危言耸听。这次挖洞用的全是公开应用从应用商店就能下载。**你上架的 App,和别人用来攻击你的武器是同一份安装包。**OsmAnd 那个漏洞的可怕之处就在这恶意应用导入一份设置、换掉地图瓦片的地址用户每看一眼地图、每搜一条路线坐标就流向了别人的服务器全程无提示。这种洞以前要专家蹲在反编译器前面熬几天现在是一条流水线里的一环。所以给一个可以直接被验证的判断**三个月内主流 Android 应用会集中爆出一波「AI 审计」来源的漏洞披露。**理由很简单——应用安全里最贵的那步「攻击面普查」第一次变成了脚本就能干的事。以前没人有精力把你 App 里每个导出组件翻一遍现在翻一遍的成本是电费。留给开发者的窗口就这么宽。你的仓库如果还没跑过一次完整的审计等于裸奔在别人已经装好弹药的靶场里。评论区聊一句你敢把自己负责的项目丢给这个代理跑一遍吗——还是怕它挖出来的东西你自己都不敢看现在能动手的就三件事第一去 GitHub 搜 seclab-taskflows 仓库用 codespace 对自己团队的 Android 仓库跑一遍./scripts/audit/run_mobile.sh myorg/myrepo一晚上就知道你家 App 底子有多干净第二把所有 deeplink 和导出组件里的主机名校验翻出来搜一遍endsWith——维基百科就是这么被接管的别觉得自己是例外第三跑之前先看一眼团队的 GitHub Copilot 许可证额度和 premium 请求数中型仓库一次审计要跑一到两个小时token 烧得不便宜别月底账单吓一跳。工具、漏洞、方法论全都公开了唯一没开源的是那个替你复核结果的安全研究员。这一部分可能是这个岗位未来三年最值钱的东西。把你们团队管安全的同事拉来看这篇他今晚大概率要重新排优先级了。最后抛个站队问题你觉得安全审计这行会停在「AI 挖洞、人复核」的新常态还是连「复核」这块剩下的地盘也只是 AI 逐步吃掉的台阶学习资源如果你也是零基础想转行网络安全却苦于没系统学习路径、不懂核心攻防技能光靠盲目摸索不仅浪费时间还消磨自己信心。这份 360 智榜样学习中心独家出版《网络攻防知识库》专为转行党量身打造01内容涵盖这份资料专门为零基础转行设计19 大核心模块从 Linux系统、Python 基础、HTTP协议等地基知识到 Web 渗透、代码审计、CTF 实战层层递进攻防结合的讲解方式让新手轻松上手真实实战案例 落地脚本直接对标企业岗位需求帮你快速搭建转行核心技能体系这份完整版的网络安全学习资料已经上传CSDN【保证100%免费】**读者福利 |******[CSDN大礼包《网络安全入门进阶学习资源包》免费分享02 知识库价值深度 本知识库超越常规工具手册深入剖析攻击技术的底层原理与高级防御策略并对业内挑战巨大的APT攻击链分析、隐蔽信道建立等提供了独到的技术视角和实战验证过的对抗方案。广度 面向企业安全建设的核心场景渗透测试、红蓝对抗、威胁狩猎、应急响应、安全运营本知识库覆盖了从攻击发起、路径突破、权限维持、横向移动到防御检测、响应处置、溯源反制的全生命周期关键节点是应对复杂攻防挑战的实用指南。实战性 知识库内容源于真实攻防对抗和大型演练实践通过详尽的攻击复现案例、防御配置实例、自动化脚本代码来传递核心思路与落地方法。03 谁需要掌握本知识库负责企业整体安全策略与建设的CISO/安全总监从事渗透测试、红队行动的安全研究员/渗透测试工程师负责安全监控、威胁分析、应急响应的蓝队工程师/SOC分析师设计开发安全产品、自动化工具的安全开发工程师对网络攻防技术有浓厚兴趣的高校信息安全专业师生04部分核心内容展示360智榜样学习中心独家《网络攻防知识库》采用由浅入深、攻防结合的讲述方式既夯实基础技能更深入高阶对抗技术。内容组织紧密结合攻防场景辅以大量真实环境复现案例、自动化工具脚本及配置解析。通过策略讲解、原理剖析、实战演示相结合是你学习过程中好帮手。1、网络安全意识2、Linux操作系统3、WEB架构基础与HTTP协议4、Web渗透测试5、渗透测试案例分享6、渗透测试实战技巧7、攻防对战实战8、CTF之MISC实战讲解这份完整版的网络安全学习资料已经上传CSDN【保证100%免费】**读者福利 |**[CSDN大礼包[《网络安全入门进阶学习资源包》免费分享 ]
RELATED READING

延伸阅读

更多一线实战笔记与深度复盘,助您持续精进