TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview9 L! X8 q, a3 Y: h3 X0 q
, p7 m: p& K! @ P# k7 V1 n! L* |; q9 ?
一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……5 d u5 ?. k$ I( `5 t
8 \5 s0 l2 k* Z- S+ N! o# L
故事是这样的。
4 f4 N6 A3 n8 G% c# Y% h3 V- E$ n' y+ \! p/ W+ w9 q
我今天看到这个新闻,看完之后愣了好几秒。
; Q. \" a3 X5 ]+ q
: k: w2 H6 r' T T; Z' m一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。5 F$ \! D5 }" B% s0 `( F) Q8 r
4 D H6 Z4 N* t& u0 q: t" n
结果被一个AI模型给挖出来了。' B/ N, M! q0 b
9 v6 }% ~, o2 L" M, F' y1 s$ M8 L/ T这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。
/ \4 ?& P, u8 ?. H, n0 y3 j6 L1 T# g( t ]7 @# z# D. {
然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。
$ Q$ g4 q, F, N$ m* \7 V& i4 \. e$ K: f! J* ^9 `* ]) G$ Q1 ?3 G1 R9 @
FFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。
" O1 E6 E+ }, R4 |4 A& s
3 s. M% ?$ O! \! \% \( L然后呢?; P! v+ \5 V4 @2 f9 L. }
; B+ y* d5 K7 `6 U) N
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。! p6 W" o% i: h, Q/ O: A/ Z
" q9 j$ W. E1 C j6 n/ b' [
这个项目,叫Glasswing。
5 _- \& J5 I/ ?4 w* M, E' K K/ b5 _. R1 J+ ?
glasswing+ Z( b" o4 C7 @& a* G* D6 D
9 D. |0 k' m# {* R
X# a L) v) ~6 z; [先说清楚Glasswing是什么。
/ P6 ]& V, D% q0 d- r* |2 ?
: ?% S6 G0 k; w( N3 J2 f简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。3 s+ H6 B7 t: Z8 o
y* O' K1 ]- ~7 q y2 Y
有多强呢?
: p2 w- ? i; K/ h( V- V
' p3 q7 L, O2 N$ R' pCyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。
; R; E8 Y& D4 K
{% p9 U! g2 Q" o0 ^' XSWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。
9 {- m5 _; C$ [# |5 j6 ^
8 K9 ~! t5 E3 ~( c4 ^, K) p差了13个百分点。
6 V, v" K! g! x1 |" l1 ]( j- E
' I3 j3 h1 D9 z% q4 F. R! S$ J你说这13个百分点意味着什么?
8 B9 |4 R4 `6 j. w8 w6 I; B/ k, @& D; y/ p6 e' @
意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。
% `" _# j Z+ ?. Q5 M, Y7 R ~! a3 E& y# c; e
意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。
3 l! C! j" _2 R5 [; r% |# C! x) w3 x+ s! m
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。1 y/ r; h- I# ~# g1 r2 N
, o: b: _' G O! U% o3 _说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。- ]; f+ V; p3 v& I X
0 u& H1 \, d: p5 [OpenBSD是个什么存在?1 K- r& W; K: `: K/ |' d
$ {5 w; M; K# N; N
它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。) U: p8 A5 {5 S- o1 {
$ V9 Q8 k% t3 P) G9 V5 r1 O8 ^* p这样的项目,代码审计了多少年了?二十多年。
( N' x% ]0 t: d" O$ K, N3 {5 g% F! ^: w; C! g$ I1 J
然后,一个漏洞,在里面躺了27年。6 w/ O3 c/ }6 |+ v. H& v6 m
8 ? F! i# p3 l* T* i8 ^) r# L9 E这说明什么?
2 L# }2 b& ?- V) s7 M& b! q3 U; m0 m* u3 ], l
不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。
* @; n, e( }" X3 V
- c7 [& _3 e2 a9 f* _但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。) M$ \1 e! g4 ]/ k! T
. Y& l) x0 H5 ], O. N0 _' N
Mythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。; A/ \0 H& O9 Q# ^1 g. H- q
- W/ x2 R( Z. E$ |9 z
这种漏洞可怕在哪?
' G7 K9 o7 n. k( K- e6 H$ Z3 v' E5 T% _8 G4 u# Y5 J$ e
它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。
0 ?" g' p. R% K- [+ X# _# X8 L$ D+ H, a% M; F
传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。
* u( E% A1 d1 k2 U; \+ q# r: x) N( h9 {8 {$ h
FFmpeg那个例子更让我震撼。
* c7 W9 z; ?- f$ G4 K1 N5 H3 M3 L+ R' R5 Q
16年。1 O8 j# t8 \/ w" j8 }
; r8 M& m' ~- @7 O# o u3 [
FFmpeg上一次发现这种级别的漏洞是什么时候?2009年。
e% v7 m8 o* E8 \1 b; ?6 l' v" S2 K# s$ h2 w s2 S: i
16年都没有人发现。然后Mythos Preview扫了一下,找到了。
! u2 w0 S X1 Y& h1 V+ z- A- q7 Q% S( w6 `7 R
注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。
4 F% ^1 X6 z3 p- F4 m4 {" J
4 n: m( x6 p7 y7 [( }& f6 C这是主动防御,不是被动响应。
: z* f% T1 t* V' W* K% o( u1 Q2 Y' s% u X
传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。+ P3 z4 r% r! G) I
* U. u/ J1 o2 t
AI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。, A }; t% J: H7 ]
$ }8 Q3 f& }# `& G v$ h
这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。
" a4 K+ Z( @) M S
% S, L! {0 z ~1 G( \现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。
8 c& q1 T/ f1 c8 \8 T* Z4 T6 W+ O+ Q# L) ]: O; K, B# U( i) ?
Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。8 Z3 H" `8 y$ G" e6 ?' O5 }
/ s- F+ K& b7 l- C
这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。$ r$ G* W/ @" w/ D
0 A6 R7 O+ Q6 s) Q( m9 I: c
你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。
j) m+ _+ ~2 I, ?8 e4 D" [- w- C3 V9 r9 c% u2 F# s; W8 ?* a
价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。
9 W* p) o! Y9 Y3 j# A0 ~2 g/ |! Q7 t& v0 U( \2 l% g1 c
这个价格贵不贵?5 `/ Q9 n% P- D
1 z) `0 S# G+ H6 x2 ^! ^1 }3 t对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。+ Q! }. m/ j5 H" \
# M: F f6 g* ?9 B G5 A6 `( yMythos Preview能发现那些工具发现不了的漏洞。/ j( e! O2 |8 E
8 {8 a1 D' w) ?( l% F% q8 A& N
这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。
5 E. X1 y- R3 V+ r' R5 Q* ^8 Q' S5 f$ M+ g, w
另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。$ e, k4 r( q' f3 z. C, e
% d: t. @1 A1 s这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。. n/ W) b( ]! {6 Y
8 k5 x" x- d; P) `7 k9 @6 xFFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。( P( p2 D+ x9 u4 T
) ?7 D4 y. ~# c e
还有一个细节,我觉得特别有意思。; |. B( S. J8 h& S- s6 I
' H+ \+ `5 t* K' l2 b/ I漏洞发现之后,公开披露的时间是90天。
; R0 X4 E$ k, S: A# A
, i, E; M2 W- x4 E0 d, o90天是什么概念?
( |0 b- e+ b% N* F% g4 a5 b, ^# @" a2 G1 Q+ M% `6 D
行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
& [* T; C/ {( u1 F9 A0 R3 |3 y$ h7 N$ b! J8 a$ |
但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。7 v- m1 ^* n: W) Y
2 J @8 N* v/ y
Mythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。+ a# |4 P% ^' e$ x
# |* g0 b9 z0 ~5 I9 r9 [这意味着,漏洞披露的节奏,整个就变了。
0 c! O% Z5 |. v0 i2 w( A5 {1 B4 G' M5 c. T
以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。' U8 ^' O: L) z A5 X
0 A4 v, q8 u) R) Y4 x+ L0 e厂商的补丁开发速度,能不能跟上AI的发现速度?5 R4 c5 g/ N- r; q0 M
8 b; C. z+ Z6 z: d
这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。
* n3 Y% f6 [3 T v8 D" B
: n, |1 R3 @7 K/ n' [写到这儿,我突然想到了一个更大的问题。
" R0 T; A( ~! Z6 Y5 i" E6 ^* }( N0 E; V' F G( N
Glasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。
$ ~" ?" n; W. t8 M7 @3 U. P Z! F7 Q3 L3 {5 I
透明,意味着隐藏的东西变可见了。5 I1 l9 l" U! G5 V4 u6 b% {
" \0 r. G0 b0 U% G9 d; o
一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。8 Y& e, N P9 F' t
! o6 s4 [1 z! T8 ^8 b& Q这个意象,放在漏洞挖掘上,太精准了。
! r% c+ G; |3 k; V! n" w) Y7 q$ p& x) B) Z
代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。! D0 i7 L$ c$ ~# \! \, P
1 J9 M+ }4 `/ |* X+ F
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。
$ C. W* [2 R, H& k5 O% ]* z; x; ?9 A3 N. d3 E
但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
: c" @) C4 |) X: S/ A% x4 T) D! D+ O7 _
代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。: t0 W- p) M0 `5 Y9 r" f
/ g6 `8 w2 H' f* h5 w/ r/ R1 X$ w7 d
这是一件好事吗?6 i0 ~9 n6 x i+ O. N! p8 M+ K
8 n2 x6 z8 K+ d
我觉得,短期内,这是一件非常非常好的事。! m2 b& e% o" X+ O1 H g9 L9 x
* X5 ^& h6 g2 G/ _, R
全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?
: W( B4 K& z/ u) f& {4 \! ?; \: k- O ^7 U, S! O; V1 D
这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。
$ s7 |8 \' \6 `. Z ~$ Q4 x. W5 b0 K9 p" Z% W d0 Y
AI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。$ M# p" S/ c c" P- R
1 w- Q9 X/ M. M" Q5 N* b# `
但长期呢?9 `- L( ~$ m: ~# A% J4 w' i9 X
4 s5 E& v7 F8 O7 ~
当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?8 N7 U: x5 A1 S$ f: Y3 I
J7 x6 J; B9 Z$ M! p, G4 R/ X是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?5 D$ s' l& _1 j) V+ E' ~
- K" q8 A( {5 V0 y
我也不知道。3 b& V7 _3 Y2 }* x8 j
# L5 q1 O5 U* t) Z/ c
但有一件事我特别想强调。
, J5 r; |) z9 Z6 I6 n, M$ _0 ^! e! c& o3 S: T3 Y
这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。1 y3 j) G5 q. V. B1 y8 k& P) o: R2 K
: L! `) m( |" j
他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。2 _1 B! R9 @ m! @8 @/ `
- c1 l8 U7 m% t, g P$ a
他们为什么还要加入这个联盟,用别人的AI?6 C }* i) K+ G% | i9 N& z$ h
2 p: W% S% U6 z我大胆猜测一下:因为挖漏洞这件事,规模太大了。
' a% J0 x: F- A- Q7 l2 n9 O& X1 ?+ K, y/ I
全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。# V+ T# T6 J) t- j3 `" k; X; p
/ P+ B% g' z. q5 o* X
Mythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。
, y! ?" h+ U, P- D e
( d5 h3 Y& G( }+ @7 r这是规模效应。
! S7 A2 |6 ]: L# B$ Q# Y; ?( N+ p2 _
就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。7 x5 V" S; @! x( O0 v
. g+ ?! {5 ~6 R6 t& x- K
这个规模,是人类团队根本无法覆盖的。
* A1 \4 d8 _0 X! H/ h( {
: `# k0 q" A/ r1 @/ e4 VGlasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。
/ R. }- M2 h$ q4 P1 R3 H
3 i' Q- X8 [ K# a什么意思? _9 f* ]. L$ t! t( k; h
) M. j% z' N5 Y6 B! j! ~" g现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。$ d5 m# G7 c4 }- }5 T2 j* L
$ c6 t! e0 D6 p* H# J f类似现在的ISO认证,但针对的是代码安全。! a( a% ~2 d9 w0 R: w, \
) h- d; u) n( w& a1 J
想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。& k0 H! V: |3 F/ q/ R
# W7 d, t$ n. A$ c: n+ u这不是不可能的。
6 G) P" V- S% L6 Q8 J1 I( x5 C4 t
, h6 \' q9 M# V; D3 y; E5 }+ `当然,路还很长。现在还只是第一步。但方向是对的。+ T9 F! j$ c; P/ v' q8 x
; B3 M0 K4 x4 e) X# _
好了,写了这么多,让我最后说几句掏心窝的话。- s! ^- B& G2 T$ ?) s( a! a0 m
% _4 f# g, F0 I8 ]/ O$ e我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。
, Q) U. L* Z; P! }, q1 I7 B. l5 y5 w. V9 X+ b H% P- t( F
兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。
# u/ e7 h7 K0 U" M
7 m4 {: T8 k. L' w; i a这次不一样。这次是AI在帮我们发现自己的脆弱点。9 u* j0 ~1 x- [2 Q- v
! j1 q- l. K2 @6 [, q& m
这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。
* J1 Q6 {- m% O( K) h0 [0 O7 P+ M: F8 ?" p9 l
这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。( w+ L+ d: @; x' u9 R$ T" [" q
, a, m5 e/ C* e, {' u9 p
我怕的是什么呢?
0 m0 A& ^/ Q# z. z+ W7 F8 Z. Y( E+ t1 J t% p; C
我怕的是,这个工具,只有大公司用得起。2 ]8 k0 e8 D/ S! e' ?# N& G
/ |0 { H. j/ `; V* X0 z# O
AWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?+ t5 o/ w9 R; X- x% c2 B/ v2 _
. }7 Q$ Y) b7 G3 ^0 f
Anthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?
, h+ m2 @9 h" a* n5 a% m7 K8 U( l
7 R I& u h* P这些问题,现在还没有答案。9 D. _6 k: K; G9 `8 u( t. p
" E3 L+ G9 X6 Q' m7 J但有一点我特别想强调。
% t* K, m1 G. w. U
1 i% P$ [" F- lGlasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。1 F/ d: h2 `4 K, v
~# C/ c& j9 l- D% I" M% z
以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。2 M6 U, Q- ]* A; o7 L
+ J2 p( J' [- f+ @2 L& ZAI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。+ H) f* C# l3 U; g% W
6 j7 n; D c3 Q% p! C5 S' O# a1 M! n
当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。
8 j2 h' `4 S3 `0 b( _1 l8 w8 Y( ^7 o3 q% L
这一天什么时候来?我不知道。可能5年,可能10年。8 q0 L7 y% k* _+ e7 e- {
T% j0 k8 D# Y% X6 A但Glasswing,让我第一次觉得,这件事不是痴人说梦了。
4 G( G4 J1 O0 r f. s# j |
评分
-
查看全部评分
|