TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview
/ }$ N* ~3 a/ U1 I7 U' w$ l; D! ]- V% }4 V: |
. K* X% u. n2 ^: E
一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……
; [4 q* c1 M* q8 ^4 N6 |! I' O- ~/ J3 n2 u
故事是这样的。( Y( c% W# k- Y, M6 K
# K$ T- u% q O我今天看到这个新闻,看完之后愣了好几秒。
/ G! u5 N/ ~+ A0 C7 e) p$ E
) y( b4 ~3 \$ c- @3 @1 c一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。2 W1 @3 `' u8 B: {
2 K# O% \5 [8 Z7 z, A- E9 m
结果被一个AI模型给挖出来了。/ M- i3 `" N/ N, O) e% U
) U# {! _5 a2 I+ @
这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。
( K1 \; u' ~$ N- C- c/ f7 {, L) h1 _" y& J
然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。
* F. |' ?3 g0 Y! R- k; m$ P O2 o+ t: J* ?" Z& }' z6 D
FFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。
8 I& ^* T* y J$ O
% [, i( A& b3 r, t+ B: ]2 T n然后呢?& @/ r3 E7 T! n7 ~) @* q
# z% K C; d3 g- b
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。9 ]+ u ~- l& s; K, `
. t C3 r! F' P& `3 x/ _; `: {" F这个项目,叫Glasswing。
/ i/ ~9 B$ U6 x, z8 p6 c: G: @$ E5 ~! { B+ m7 w
glasswing+ L; q* M( F* \8 @. S
5 C4 R( T* D8 i" z3 d& V9 H+ A6 r7 b5 }- V7 i5 C: P
先说清楚Glasswing是什么。$ b( r2 b0 s! I: N' B
6 m1 B* O0 y* e0 j
简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。
$ y; U* ~* q/ d* H2 R
) _/ Z6 d$ Y: S% _3 [有多强呢?
( F# |7 A5 A) \4 @' q4 {+ @ u# W* a
7 g8 r- o, M: ~( dCyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。& s# h8 _9 T/ a- h9 \9 a9 n
; `4 i8 f9 F# V- X2 a$ e* m
SWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。
v9 I8 S3 f9 c7 u& U/ K, o- E0 D& O7 j- |7 {" j/ \: j
差了13个百分点。! v* M9 x: O5 ~3 l) U% v6 d( l
6 o, Y0 ]' X8 p7 U% c; C
你说这13个百分点意味着什么?
) e7 g4 c* ~; l) V9 \! D% J- q0 J, f9 `: ]% a
意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。1 B4 Y* Y1 I* c( P! T6 g8 G4 S
8 O; k4 F" _% L' f- a, L6 v" ~
意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。
- p+ g" Q" H% B2 T2 v% q4 M2 M5 T9 v( \8 \: {, Z
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。+ z0 l0 l# A; ^$ ]: R/ x: z
2 Q; W3 |8 @$ e6 q# g说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。% { Z* C4 D. X$ O i# s0 f' ?1 E
* i7 Y: y- i f' o$ R& xOpenBSD是个什么存在?
8 B7 w; l% _6 g7 R/ i7 ?& q% G* F Q* r
它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。2 o4 b M6 I2 }* {* \+ E( `, s
1 u9 D, h/ d7 V8 g, ~& F
这样的项目,代码审计了多少年了?二十多年。, m8 W \& V5 z: R8 m- q/ H2 N
% D2 B0 D! s7 l! E% K然后,一个漏洞,在里面躺了27年。
% @8 E$ m" i% O' ~4 ]0 T5 D$ ]7 Q t
# a4 D$ y) T8 T" E# a& D# ~: L这说明什么?
( e8 X6 L; m9 T( `$ H
! E. z4 {3 h/ @, m: n! l! \不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。5 W. P [/ b5 G( h0 C0 s
5 B7 J& }4 N! R; H% v
但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。
" f% K0 h- O0 L( V3 A" h! P* l& r" r' f! ?5 d" l0 P1 o# g/ E
Mythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。& q4 p3 _/ e4 j# a& ~
W" s' l1 ]+ |
这种漏洞可怕在哪?, A3 \( k* Z! N
. k. g3 D/ s0 Z( `它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。
# M5 `7 ~+ n0 ?
7 w+ j0 [3 o) P7 F9 a% V传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。
& a& V" X: F# }, y9 E
9 D3 g9 e8 ?# \0 gFFmpeg那个例子更让我震撼。( |0 ~+ f4 R8 A' @
7 p- z& \4 `3 w, J3 A: ?4 m
16年。9 h; p, f. P8 h- o: f
. o( w9 K5 E# R- O8 R$ n" S, J7 FFFmpeg上一次发现这种级别的漏洞是什么时候?2009年。
4 w9 g) p% ^+ U/ o
; m$ r `- s9 q& G16年都没有人发现。然后Mythos Preview扫了一下,找到了。
, S5 |- t' N. N
4 `+ t3 Y* y ]2 z4 u4 a, k+ R9 s$ M3 k* Y注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。* t. k$ ]& y2 S7 x V9 R3 X
! s' ?9 R! `. i& Q这是主动防御,不是被动响应。
) q. D; r a- }
" y9 D) k! a+ f2 P$ z传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。
8 W& _ H6 R2 \0 u; ^' O9 ]0 w7 k" n& T* L8 x2 z
AI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。
/ L. L/ g" q; c7 l$ _& A9 d& \
7 q- r+ t7 j' y/ ~( ?1 U这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。" F* O0 u9 {/ P) R8 H( u1 z9 p
3 j0 s3 B7 K& d2 d* g9 B+ u
现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。# {1 U% N2 ?! c. }# J/ v8 G2 Z& z1 U
; }8 n) ]" v+ u* F0 T {Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
8 k; K: r& L5 P& R$ V2 J5 ]2 m
8 K; l. B) I9 b& Y0 x# t7 j' \这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。% c: n9 A0 Y$ W5 X" L9 w1 a
" w, y$ G# A3 {( s5 P; f& E
你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。
7 h( d6 ~: ^, R1 O% X8 _/ h4 G* }$ Y' m0 _( o9 w: M& i7 g
价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。) i8 J: ]+ F; H, M
/ ~2 g* @8 y. w- C这个价格贵不贵?2 i1 d, A7 b# c
9 A* w0 S5 n/ ^
对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。" e3 r0 @. e9 X4 o) u
2 r5 `7 | L2 U* B, c; P( Y7 U" CMythos Preview能发现那些工具发现不了的漏洞。" s# J. V4 q! Q0 s4 C5 n" {
5 E( ]9 w. {! C6 M这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。
% H- j7 U% x& {# d1 E" m4 n- |
: H6 w$ ^# J1 b2 V& p% o& E- ^8 D. ~另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。0 l x1 H* @: K) u1 }
8 N2 Y! q+ p4 n5 S9 m; ?- Z* {; s
这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。! F4 F* H* q+ M7 S2 L& K: `
) A) P$ N4 U+ X. N2 B$ O( W; R' ^
FFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。3 a- E) U7 K: [6 c. m3 j
1 T3 ^& Z/ f4 g) n- ~& s* q" V
还有一个细节,我觉得特别有意思。
9 Z; {2 j9 L! R4 k9 Z0 |3 p2 ?7 I" I/ N, t2 k+ K
漏洞发现之后,公开披露的时间是90天。
6 ]3 G& V }1 E3 z% k6 y
/ f/ Z$ h$ E* w) K' u* e90天是什么概念?) g# J4 X' q( Y2 L, f' z+ ]
0 E0 p( O. e& _/ b行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
/ R0 |' X j; A# J4 P! w2 A S$ X# [8 ~$ ]" Y1 ~
但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。! n' d p% {7 N2 C- ^
( H! D" Q: L9 M2 jMythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。" j$ ]) C% Q3 C% z- y
, ~) B& m7 ^- g) G) I这意味着,漏洞披露的节奏,整个就变了。
* q) l( f6 `: V% q' j/ S/ F4 \2 K/ R+ h, t, I2 M
以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。
& u/ h# J6 l& w. Y0 J5 \+ c3 L9 x& x( c9 k/ R) C2 S' [
厂商的补丁开发速度,能不能跟上AI的发现速度?7 u3 P3 s% Y) C# m: c( O9 G+ Q
' y3 B5 p8 x) o4 `7 b5 `
这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。" `2 W z! q8 m' A, \' {4 T% [/ `
6 U6 D! y6 n3 O: g* a# Z$ j
写到这儿,我突然想到了一个更大的问题。
+ y: _5 P3 r1 |. r, l: V& O; D4 i5 W" r: M
Glasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。
/ ^: N& ? L' U, k0 V6 m" i
7 s3 E& a& a4 b# l3 N透明,意味着隐藏的东西变可见了。+ W; t, t$ |% [6 m1 [( v
6 D* H# T0 n9 u8 o
一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。
; T# ?, |. r, \8 j$ @& w
1 a" o& `7 q/ A2 A) l5 ]; H' b7 {' `这个意象,放在漏洞挖掘上,太精准了。7 v- |, x% O% `0 o8 `
7 r' R( C z1 }
代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。
- G. v. R0 j- I* v. Z% d7 }7 y: \9 G
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。
/ ]: e- e- u3 J
1 ?! F8 d5 K8 G但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
9 }4 z9 [5 |% K) U# O
4 ^9 v0 f1 }2 {* F' U代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。
4 b: }' {# v3 t4 h1 ^; W& K) r: s6 U P- |2 {# m8 R0 G5 {
这是一件好事吗?
7 `' i4 a& c5 y" k P
6 v4 F& Z, ^: W t% S& x( i我觉得,短期内,这是一件非常非常好的事。
/ J" t' O: f% N$ \- \. w, m8 M4 q2 {9 Q. K
全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?
$ K1 {) F- O" Z' ?' A5 j ^
! P; j' W2 p" p( }% [& f( e这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。
( Q* K' V. e) q9 S9 \7 q& F* t% f5 u2 V: \' i" ]
AI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。0 ?5 c: @! Y) M, ]& c. q# L* V; w
+ C) S& T6 E5 M8 U- m. _. U9 M但长期呢?
4 G. G; ?; f$ z' X8 V6 D
" Z3 s% X4 R i$ x2 r1 _4 M当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?+ W. W+ E/ L$ q5 ^. k; D; w
7 R6 s5 x- @+ l( G- B7 j) M/ [是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?" I$ f" H+ S$ h
1 t5 ^! Q6 ]: z/ S8 k" p: p' @我也不知道。& W6 k7 E' h' T8 B6 H+ g
4 M7 U; Q% g8 P, ~+ {但有一件事我特别想强调。( D# K5 S3 A, h9 F2 @
3 r: [6 t, h9 T这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。7 \- P* s; t9 G( w+ G( S" A, B2 H
4 U1 \: }2 q4 J% l( C他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。/ ^, H z, C6 d% ^7 C
! F/ Y% L4 v4 ]6 g他们为什么还要加入这个联盟,用别人的AI?
: X* i. Y( ?/ R0 [/ d: j5 l+ H7 M7 x* P- J& N: Y! \' a
我大胆猜测一下:因为挖漏洞这件事,规模太大了。
1 n- t- a, X& f: m
9 {; L- ?& N) x5 c- {. J全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。7 L2 J, B: s& v
4 K0 b0 ]8 Z( Z9 k8 P bMythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。
) r& w" y: O! A V# g# A2 J4 Y' S+ a7 @0 X. ?8 [
这是规模效应。
0 t1 y: c4 h _, U s! w' Y6 ^4 X0 B- e7 q F, j
就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。
1 ?6 p2 W* V! \" t' q
& @" Y1 V% ]3 u+ K% ?9 C# @5 g这个规模,是人类团队根本无法覆盖的。
1 [- e; L1 t) l! X9 b4 q H$ S: Y5 }% l h8 J9 f2 {# Y
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。
' k3 u) `$ ?) n
* `# ~, B) O0 \9 Z& |% U什么意思?
# l" l; \+ M- Q
# r: \* b+ Y7 u) ~6 x现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。
" M/ a# f( R# s- ?5 y* U
1 x9 m" f" ]2 h2 R, g$ ]0 F, p& n类似现在的ISO认证,但针对的是代码安全。
% }2 E/ I/ h; W+ c( l! k, }% d9 W- `
想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。 h3 x4 K5 Q/ B- S/ N! ]8 E
8 }- |6 k. B5 o. @这不是不可能的。; M$ F4 }; p% T& V7 w) Z m
) r3 N/ R$ ^6 n$ W$ E0 _当然,路还很长。现在还只是第一步。但方向是对的。* i# O: W& `1 _$ q0 P) j6 ?
- o8 T5 Z0 ~# z) {" O: r
好了,写了这么多,让我最后说几句掏心窝的话。/ T4 Z" v1 Y# F1 K* ?1 W) Y4 [; w
) V& ~/ o' P' g- w8 Z
我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。! ]" ^, n9 J& W$ v- `
& O0 F# O1 b% R5 B0 L( L: o% o" U; w# d兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。6 ]- d: z# W, u' @ a9 l+ }' b
9 N ~' d) h! a: l7 E* c
这次不一样。这次是AI在帮我们发现自己的脆弱点。
. A% N& a+ l' Z5 b( Y& ^( |1 _0 I
r' E | r+ X" x j" ^这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。; {2 \/ z4 d4 K- F, W# W0 _0 x
3 p3 m" @% D8 S' c0 t$ { U/ G7 v2 ?5 q这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。
4 u& o9 `% P' |: U( s6 L9 J" R# q0 C4 t+ Q* `3 x! H# Z
我怕的是什么呢?, N) i+ a$ n C4 |: ~ Q8 L2 s& b" f
6 [, Y/ |# `+ L) ^- W7 {
我怕的是,这个工具,只有大公司用得起。$ l$ ]! t, U) l8 \% k# _' u( X
4 Z. Z- k. f4 F4 X/ U" v2 E" p# S
AWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?' K$ K' d& s! L k/ o6 M
/ N- r5 H' |) AAnthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?: Y( ?/ L1 [3 u( w1 w: |* i: Q
D+ F+ T" |$ b- |: c4 u
这些问题,现在还没有答案。$ w2 I/ e9 C; I9 s, C q3 c3 y
4 ^4 G: X- d7 {, z但有一点我特别想强调。
! t( \+ F0 Q1 l2 @1 Z4 J& w& S; u+ m; c. v' R- D) c3 M
Glasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。
5 v; H9 n/ y. K& d2 f" y1 X2 K" _" f: G; o- @! C
以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。+ D O9 U. x! W8 l1 V. r
0 q* \' V5 n7 G; O; U
AI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。
( D. I3 ~$ l. O. q+ {3 Y
) v9 }6 }! e) M6 W当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。( U* K3 j" u$ I2 z. g
; K" {, O; s6 q6 O7 X; r H( K# ?
这一天什么时候来?我不知道。可能5年,可能10年。8 i5 m7 ~$ g$ ?
# Y" m1 L; n/ V3 e$ C* G* o8 \但Glasswing,让我第一次觉得,这件事不是痴人说梦了。5 P/ R) {6 M$ o4 m4 b0 \' d8 _
|
评分
-
查看全部评分
|