TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview3 Q# n/ e) Z' C6 i& H
- n! P8 O9 q8 a4 l- {+ y1 }
% ]8 R7 w, U& Y5 t5 U& |/ t, s
一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……
4 ?, Y* v0 Z1 N) p3 k5 p) ~$ I" L' W) L$ |) {2 n( y; S( |
故事是这样的。! f( o$ E# F- n9 v& a; [( @0 y
0 S6 W3 _) L, q; Y9 ~9 X& h$ N: j9 f我今天看到这个新闻,看完之后愣了好几秒。
1 v1 l' E, ?9 L
0 `+ d4 ?" L7 y6 N" a一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。& g! f3 W: a" @0 d s
( u: p& T5 S4 D0 t- j5 H
结果被一个AI模型给挖出来了。
! b6 l& ?: `- c* _5 |- i" x# K e
" T, A% p/ H$ ?6 }这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。2 C8 o1 b* H5 x
( H# B9 a( O z% q: N8 E
然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。
+ I, \1 X G; y0 c+ M4 ]
! v9 s/ S0 s$ a# M4 ZFFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。
. [0 r. z! ~' O
! [" \! q* k: g* N然后呢?; X: x, U% `' z) C) C
* a% h/ i8 g4 D5 y$ ?, w* X, F
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。8 V( o( O6 v! L
$ F; |# R! }" W% |
这个项目,叫Glasswing。
1 A8 G! S% @; p4 g. y$ l$ D& I1 J6 {& v1 D5 ]/ D5 ^
glasswing- D* \) ~ G2 y; j. e' q3 B4 o
( C% b' A6 l$ X& z4 s. l+ l& P0 R: C. {. f/ P& S1 `2 ~
先说清楚Glasswing是什么。
1 b$ i4 Q* J* A' w$ `! ?+ j7 I0 }$ y. {* y0 ]
简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。
3 ~1 l3 P. w5 q9 B# d/ k
3 \8 J; M0 @/ [ c! h有多强呢?( S. T9 L& N! l$ c' l! R
" ?# A/ a4 N6 T9 l" nCyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。" d1 o( D/ ?$ H! F
* I8 h$ i' l" H" a6 w1 |! b' y' uSWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。# O6 d2 a2 \% U/ w5 d% ]. J
6 \" x: z0 O3 Q5 z6 v
差了13个百分点。4 j$ J& q. R) w# D& t* M# j8 B) k
& a) l B& x% t2 `# I
你说这13个百分点意味着什么?+ z* ]4 p3 w, x! Z1 i% I
% i3 w! B9 R+ [$ J0 w" c
意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。% O+ ~, A+ ?) S
9 L* | D7 d. |8 G" O) R4 ~2 a( {+ b
意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。: g* h) {+ y1 q4 X4 S3 @
. c7 t9 {# u+ b" \
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。
/ b9 i* ]5 t5 `5 c" T: b
. u& L/ i6 a7 s说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。
& x" `& r" F4 S, r) Q/ v- v# C! m! J, v
OpenBSD是个什么存在?3 T k ~/ ^( t) s. ~0 m5 e
1 t5 a0 |! O9 g: p( I, |
它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。2 V' q- Q0 c1 |7 z& d m
) L" H% {6 y( M( u9 m8 i7 V- i( {这样的项目,代码审计了多少年了?二十多年。$ s4 k8 L; P- s/ c
/ |0 |+ `' _1 R. E+ E9 W" c6 o7 c
然后,一个漏洞,在里面躺了27年。7 e/ g$ O5 b! @( ~# X/ {* a( P
6 e& U0 @4 n4 }这说明什么?9 b8 L' j( v2 X$ e) \( O- }
2 C/ g, z# T: v6 ^5 Z w
不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。5 s6 X5 E" G) M
" u' V* ~7 P" T' ~
但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。
% w* o, W8 u1 q( _" f( }+ q- H
! ` }3 }/ p( ?1 KMythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。
) B" m5 n6 W0 K& d9 B4 n
M" y5 y2 a9 W- I- A5 L: R# M8 F这种漏洞可怕在哪?3 m- ^: |' u; q8 Q' N* G/ q& W* \
) P) f7 A' {+ i6 w' `1 a它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。& f. C: h. c! Y% S' e4 b
' B5 F& X1 S7 X% h传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。
( F0 P9 b' Y/ i4 H' L" h
2 G/ ] C# s9 r: Y: @2 [, ?FFmpeg那个例子更让我震撼。
% S& T% a0 n7 t y' H$ N+ G' N# n" X' b: W0 l6 v/ X
16年。4 J. Q0 t: Z- A
5 r1 e0 B7 ]1 AFFmpeg上一次发现这种级别的漏洞是什么时候?2009年。
N' Y8 o2 t! S
; o, |; t; a$ r( ?, X. R16年都没有人发现。然后Mythos Preview扫了一下,找到了。6 W# [5 g( m$ A1 k, M/ z# r
1 R( c* z N& [, {
注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。2 u- S _% P' l; ~! W# r& T
3 a0 y0 Z' ~$ y o) s+ [3 \; s这是主动防御,不是被动响应。
2 Y S2 v: \, O9 h0 Y2 }) b% A8 m( R& e
传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。; a) \' p4 b5 i! L6 p2 m p# t
* e) R) l! f4 i k2 i2 {+ A3 f
AI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。" I( L- ^: |+ G5 A+ D" ]1 P/ s u
! u# d1 Z2 [1 P, W这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。& t' k& |. J1 ?- x( X* }" q3 d2 F/ u x
) S: n& R9 p* Q; W现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。
6 | K, X9 u& k( ^ Z$ G( z% @4 B3 a5 m) d$ _: O" T
Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
" ~1 C. ~3 f: p0 H6 J
* n$ [, R3 F$ I; A1 q4 j0 }5 I这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。
( }/ e: O6 g8 ]1 P4 w# n5 G
* C5 O+ y% D! Q; ], g1 J* ~3 q- @/ B你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。. t. ^/ _0 U9 d2 Y" V
. g6 J4 y, [& c4 L3 t- I, _2 J价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。( O4 g1 A, }! M: Y: C6 i
/ B5 `# h! ^) H2 o7 z
这个价格贵不贵?: l- |6 T- t" e* M
: E% Z, |# F8 x: ?! ~
对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。
' t# m& Z9 `- \2 i# n( M) \/ X `. Q7 e( T+ T! B
Mythos Preview能发现那些工具发现不了的漏洞。
& s3 w/ v0 U. [8 x- ]+ H0 J, x4 {( |1 J, E+ a, c8 A
这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。/ N7 B4 u6 P7 Q6 j9 ?+ m
0 e( t: n! `, {8 B另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。: Q7 J7 [( _$ k- A
" a, `, w# r; C9 X0 b5 `) O这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。; ^" b$ [+ H1 c6 ^7 [/ d2 U2 G
& t4 @8 V$ s3 h2 y& u! s6 e+ XFFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。
( T% F: L, I+ t1 u. y# U. ]
5 s' I8 F9 T3 @8 |8 h还有一个细节,我觉得特别有意思。$ |! l7 \# h2 ]. O) N- l2 b
) P8 G$ n& {/ ~ o) Y漏洞发现之后,公开披露的时间是90天。. n" ?2 s* Z5 @9 ^; }
' O5 L- S" `7 {; X4 D
90天是什么概念?
$ u& x4 v! m+ n" W! H9 e( c
" n4 [3 `0 k9 C' \4 W* i# f h行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
& g2 D* x+ y e' \- e: q
6 Y$ `0 D9 C7 p1 P但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。
/ x1 { t' z' p2 L7 D e0 C! p; |8 w
Mythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。
' N' M* v; h% R
" S9 V$ W5 O w% h. A) @( ?这意味着,漏洞披露的节奏,整个就变了。+ G; v4 @3 [ u
$ S7 f, M! R8 _ o7 u7 Z
以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。
8 z) y0 C' q( `, ~! y" M+ S9 S& |7 V0 m/ ?
厂商的补丁开发速度,能不能跟上AI的发现速度?
& [1 ^* o- Q* W C! w- `" c9 d
5 M7 `6 Y( T2 l" |1 q: x3 z! [ _这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。
; a ?; \/ | v ?& W4 Y0 c/ ]: d: ?: [
写到这儿,我突然想到了一个更大的问题。
$ Z5 }! j$ p8 ]( i; x# u1 F+ F! m
p' G. u2 a& l9 g$ w) N$ AGlasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。+ i0 ?! m" W) i" |5 @0 V
4 U- O- ^. Q1 p* V, w H: @
透明,意味着隐藏的东西变可见了。
- M; y+ w( B# N2 \7 F
5 s2 x6 B/ g7 X! _一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。" b) Z" R8 S3 j, w. e' @
% J+ I% [5 T) j; {1 w
这个意象,放在漏洞挖掘上,太精准了。% Q7 W V4 [) @. ~ m
+ \( q7 U2 g4 ^# u" Q( [1 F6 i代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。
: _, O) r/ y% |2 g" f- g) d. @ P8 }. y3 [7 K& Z- n2 O0 q
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。2 v/ H! T4 Y8 C6 K5 \4 z
" z0 Q7 o7 \7 H# W u但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
' i# e* M7 Q+ q6 J7 f- v; Z8 j( |9 F3 R# I
代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。: }8 A4 P7 N( O% ?4 ?
% u1 e. ^9 [0 @% l5 e3 P
这是一件好事吗?) j& v, G7 J9 v6 \- j) ]
! k) g: A( y1 E- x2 X% S2 ~
我觉得,短期内,这是一件非常非常好的事。
n, z3 M7 m4 O4 _8 z! s$ [1 n$ u& O/ @
全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?* ?& n) P- h5 f: F* n
8 L& L; A9 h$ w( a% \5 S6 O* C这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。
/ p" v9 |8 L" g0 o5 D) E) [3 Q! V+ `* |' f
AI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。9 h2 u }% ^$ j/ N) p! ^# g O
* ?* p- k X+ \; x" j) E% T; t* P, n3 B但长期呢?
]' A0 `9 G& y7 N7 y$ F7 c) D/ _* t. k/ }# T; \. h
当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?
8 m# w5 G o7 V9 T: t
. K6 O1 C! c, G* K- G6 p3 u; v是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?3 ~: I. Z7 ?% j2 p: h0 z8 O3 @
1 v& v/ {" N* n6 l+ G( D. r& }# b
我也不知道。
( r5 w5 M7 N3 m
L2 |, ~: f _: B0 r但有一件事我特别想强调。1 A% n, G# j( U u0 R! Y
& E' S* R% D' j0 H这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。
% i, R+ N, m8 H# o% x/ b6 _9 f: ?- s: C: T s S, M. s+ Z8 x/ I
他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。
, p- d# |& y O5 D t: I& h) @. f2 V/ S) Y' v6 v8 T) h5 {
他们为什么还要加入这个联盟,用别人的AI?2 C$ \; {5 ^8 X' u
& h" ~3 s8 t3 |' ^2 i9 ^, Q# L我大胆猜测一下:因为挖漏洞这件事,规模太大了。
7 U; D3 h/ r g5 N
3 q' b" } e: }( X2 B% a全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。
4 d Y5 H; C- d7 A2 u# t1 c, Q
0 b6 a! E+ k! j" N' R8 `Mythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。
4 Q0 C- h% f* N/ J4 R" w7 O1 i9 I0 x! t
这是规模效应。
; _( v2 X$ p) D& D) f4 L6 N& _& r' C# R7 d9 m" c/ _) h
就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。
/ H% h6 L2 S3 t: G, f
& N7 a2 h' h7 |3 K4 N这个规模,是人类团队根本无法覆盖的。! {. M% I! ^6 z3 C
" i6 K8 V% F/ P# C" r; _! p0 g
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。
. i6 |, R/ c _2 k
1 C& M" [8 R6 p- B3 c' @; q, O6 n什么意思?
' ~+ T6 y, i) P3 M' }3 i- u! i. S) c) i
现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。
/ w! F, H6 y# M- L3 f1 K) }+ E; U% _9 h3 D6 p+ n
类似现在的ISO认证,但针对的是代码安全。0 D: r. F) j, x# t( Y" H
/ G$ o9 n2 v9 `$ D
想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。
l6 n2 }1 }& z) q( z" [/ S! T" p/ E y/ e8 O
这不是不可能的。
# m2 z2 C* q: l/ _- t; ]! U) h% x* W' J2 x
当然,路还很长。现在还只是第一步。但方向是对的。. K1 U3 {0 S/ S1 Z$ H
5 r! m$ z" {5 z; v, M' F, x- J好了,写了这么多,让我最后说几句掏心窝的话。 ?# O/ k+ W$ K$ V# g
1 `; {5 x9 r7 E1 p B2 s& m我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。
* O& s9 \) E4 U: p+ u) h. F$ ]' a# P
兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。4 w% @ u; U4 K/ e8 H$ C1 r- F
( r" i2 |6 W$ k7 K. c) v7 B$ }2 y
这次不一样。这次是AI在帮我们发现自己的脆弱点。, [/ f( Z' ?! ~( x
; X. x, ?: G9 s& `3 [6 `+ m5 n) E
这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。
3 n; c$ G* M( U9 z8 ^* r P, c1 A* [) Z" I. [7 r' Q
这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。4 o* q6 F: f' G8 I- [- ~
# S. J1 h9 U3 V' }. S9 l. g+ J
我怕的是什么呢?
" H# z2 c/ C3 Q% q: Q W: E' E5 v# W/ t! u# W( `! Y
我怕的是,这个工具,只有大公司用得起。& g* _3 B# X2 v# p" W) n1 t; n
9 u3 L" w1 `5 G J* K+ T6 `AWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?
9 d9 ^3 C. o' ]! r. D
, \4 Q" X4 j1 }* R0 w2 S6 QAnthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?/ I: X3 R. i* V h& J4 Q: S1 l
& O* r" I X7 o7 g8 q, D% R3 y这些问题,现在还没有答案。. U0 Y* O2 t: ]& w1 q# y
! m3 l% ^+ `) y但有一点我特别想强调。
7 l- w- Q5 @' f) Q5 k8 h3 o! X. M' r
Glasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。$ ?; B" ~8 t. Z9 N9 B
" `. D! h: D; G* K6 }3 N5 }9 J4 E+ y
以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。
* V- h, z9 t$ j# J
; I, j, g1 r2 _7 r) c9 e! ]AI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。) S& C- ~. Z) s( D: I, F
0 I& g+ L8 R' u' y. k
当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。
2 x9 x: ?& O# | D- m) z$ B/ F* p" w1 c; X$ b* f5 @% ?
这一天什么时候来?我不知道。可能5年,可能10年。
2 v+ v% v4 Q( r$ ^5 K1 X2 O7 |! g' A% U8 ^- \; ]
但Glasswing,让我第一次觉得,这件事不是痴人说梦了。
7 H, q- K/ c5 Q9 k* T, I2 l4 w |
评分
-
查看全部评分
|