TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview- w, ]+ J( a3 X v0 W, [8 j
: U5 x L1 Q( y, |7 z' |
8 l0 w0 E; E, c( c一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……
8 ]% |) v0 g* K+ [) R* b
5 J9 }* S7 l* H- A, l故事是这样的。
; ~# z* D" b- r# r% Z) F' |' U! C, Q4 f: R$ G
我今天看到这个新闻,看完之后愣了好几秒。& _; p# {+ X, w+ l- b3 z
9 q+ D( n1 z0 b6 A; _
一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。6 R: ~$ u. D* q3 b- K2 ^6 e
+ F/ M$ c. W" L, S L
结果被一个AI模型给挖出来了。, `+ u% [" O6 l& p
# q& y1 k$ P# E) Z8 ^) y; _ N- {
这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。
! y3 A! t6 ~: F$ E; ?
5 ?' n0 d0 M$ }$ P/ b% b; ~/ J& H; c然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。
" C1 G3 ^) |+ W v
, {+ r; I0 m2 X* s u$ MFFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。
3 H, v1 X, M8 { V
: z' J2 x2 |, w5 V) t' {# z然后呢?
' H' l8 Z0 A4 ^) K0 z- a) J7 Q8 ]# v: {. e3 \1 _
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。
9 W# M+ _# Z9 _# n* \5 m/ m( |2 ^' H! p' `% t/ w' x! V# f6 B# O0 P
这个项目,叫Glasswing。: d5 c4 Z U7 j
' }, }) \1 l3 Yglasswing3 ]1 t3 {' }/ M5 r6 \% T
6 x3 z$ r& Y5 O- z* e
) |$ |3 _' W+ `6 ^先说清楚Glasswing是什么。" e8 O1 w* X( i" G4 G
, I8 t; v/ {) P5 O* L
简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。7 H( g6 v: I8 M
% |7 L$ s- ]* O2 F, z3 B0 c有多强呢?5 ?' r8 h4 H9 R4 G' V
4 W1 ]$ \# a* ]0 _ G
CyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。1 w Z# r: ]! j" O
- Q" e6 F, N# ]. f
SWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。9 l4 A8 A. Q( h6 C( v9 G
3 U4 i6 K( s$ D$ e差了13个百分点。( C1 E. t& W9 m L
7 } O9 A8 {8 _, x* [6 v5 T' C' J你说这13个百分点意味着什么?
5 o+ h! N! m- m! W# @6 H8 r! u) j, I- f; K# B6 {, ]/ d
意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。' A! G# k2 v- [' `
: p" k5 {5 L9 T8 E5 W
意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。7 G2 m6 }% }, r0 B2 `6 Y
5 n. ?5 w. [: {8 e5 {! J
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。
, K( y* Y: k2 B# D2 h
, q" i$ f& \3 c' j3 K% f/ m说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。1 q6 C8 t2 ^6 S2 e$ b
: o1 d) M0 \: [" M: q. wOpenBSD是个什么存在?- W9 Y# }% U: g+ ]: e) J6 {
! b, k \5 ^0 r7 O- e它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。' k; M' A7 L% ~' T) x- L
- X8 y- C* H# a/ J4 ~: }这样的项目,代码审计了多少年了?二十多年。4 f+ `$ A0 z r# ~! c
! @, g: h: M9 b: _9 c然后,一个漏洞,在里面躺了27年。. A, h. z J7 E* a/ ~6 f
) ~+ p$ g/ \( o' s( `这说明什么?" P1 n# v% T& X% S! p' m
; X9 F, I6 r7 y3 S* e/ F
不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。5 ~* ]- @& y) q
3 k+ g" Y% ]1 }9 y1 n但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。- \; P* ]# z( k; D/ J* l8 u
' A0 t: m t8 G5 i* Y3 D# |
Mythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。
: E2 E9 y4 ]. q& s1 F9 m8 t) T8 v" {. v! W) u3 `1 ]
这种漏洞可怕在哪?" N/ x* \7 x- }9 g* E* ?
1 ?" _2 w0 u( H它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。
( N# @2 U4 }# i: J4 F. j5 E' F8 y9 X( L
传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。
1 S; e% _' A6 n! \( i& [; y T; X7 M0 _; Z& [
FFmpeg那个例子更让我震撼。5 c& C$ [1 C/ k- W
. ^/ v) s2 r0 T, J1 C
16年。3 `; U. k4 [& n6 D" o: X
7 ~1 Z/ ^+ i- D$ e/ K# F
FFmpeg上一次发现这种级别的漏洞是什么时候?2009年。% _) W n8 M% u& z
" B* j% |8 ^# Y. `9 S
16年都没有人发现。然后Mythos Preview扫了一下,找到了。 z* R( y8 H! ~% u5 b
- y! }" g3 Y8 ?3 t% y( x/ ?
注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。
+ s4 b/ }0 R- Q7 ?! M( W+ Y( K: m! i! n1 w& L: ^
这是主动防御,不是被动响应。
, H* r( l5 V: j/ a4 S1 g- z4 e6 p E( M7 |2 T+ I7 J
传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。
% Y- H# O: i* ]& `# k- t- U( V0 r3 M4 `4 ?
AI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。
M6 Y* Y6 p8 B" W$ {
) s8 K5 @1 S- [1 t# r- S6 g这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。8 ]" J Z: T; { M* U
' {2 t+ x) G4 _6 i w
现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。
' q9 Q) \; d0 n2 ?1 U- o4 Y( \: r( ^9 n
Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
) f- }' n4 K$ \ p) K
B6 _$ h( O- y/ } ~这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。
" U4 Q9 x5 b" C/ w8 z* Q
) \' H, d* X% Y$ j你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。
4 z% I+ [: l) e r- O8 g. C( _$ V, i7 V
价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。/ F6 e/ q* D( Y, }
% m2 H ]4 s6 H2 r+ R9 b
这个价格贵不贵?; q) e6 v+ w* s4 `
, | c1 C; ]# M1 p( @# E! V% Y! y对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。
6 j9 W, o; Q! V; v+ s4 V
6 X" j3 }# [3 l4 J: v- `. u3 F% @; ~Mythos Preview能发现那些工具发现不了的漏洞。' \( |1 \" I( Z# `' Y
5 J# A' L' {) }; ]% T
这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。
/ c) \: m1 D6 i7 P* Q& r; T( t: a! ^* T8 ^
另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。. e- B/ M/ \: M2 c3 Z3 x4 ~
4 E! _3 W: ?: |6 O7 R这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。& l) e r! n/ w6 o! m
8 G6 D& [& l1 ]! O$ X! s$ R
FFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。
8 A1 i2 x( D3 b; w3 `9 \
8 U; T; r$ [. R还有一个细节,我觉得特别有意思。
6 n6 W' i* F6 D8 M$ D1 l
- U& A ^, ~! p. O$ q漏洞发现之后,公开披露的时间是90天。5 j- l- ^# _ i) U
1 ?' P" L9 i8 J1 P2 j- z" v90天是什么概念?
( K+ ?! R7 R, D0 [
* L, C5 L: Q2 f2 u5 I+ H; D, D! a行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
, t$ S/ k' g. d5 ~2 |/ t- R& `1 m3 o2 }0 ^8 M! z8 h
但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。
/ t" Z2 Z7 r' _# p- }# [+ }" o
x' w6 u! s) ~4 M! UMythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。
" q, s% F7 y5 a* M) ]3 g7 c8 x0 c3 C R
这意味着,漏洞披露的节奏,整个就变了。2 D2 O4 |" G, L; K- G
7 E* E8 R7 d" r2 x* h; ~4 i# `以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。+ `! q8 ?' M* N$ j- {& N) c
6 F# S$ V3 w) D3 t0 \ s# y/ B( Q
厂商的补丁开发速度,能不能跟上AI的发现速度?
0 ^% u/ w" q' c- s a! N- b3 q- U( }; U: ?/ X2 c5 ]' V. ~( m
这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。2 e# `8 s( P# ]; r$ I& r
! l9 X. R% ~$ [0 a, r& u2 f( \写到这儿,我突然想到了一个更大的问题。$ w }8 o) E. h* Z
8 j8 |! p. `+ f+ r5 `, |& O: Q
Glasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。
+ j! \; G% m, t: @% s& r& B* |; [8 \: G: J* ]9 g
透明,意味着隐藏的东西变可见了。
5 S4 F# T* b6 _1 m) }5 l6 R6 j9 \) b4 O# ~5 E. L# D/ @2 D# F- K0 Y
一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。
; Z3 n4 q/ k9 M0 c& v" Z1 g. b# x* t) Y
这个意象,放在漏洞挖掘上,太精准了。
1 q# G3 q3 _5 J4 I) L5 A* _) L' a1 J; u5 Q
代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。' w$ x, L1 b7 `4 I1 b K
7 N7 ?: ?2 P/ r! w" `# d以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。# R! L) L! {1 Q1 N7 ?8 {
0 M K; r: `: i4 p
但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
5 d- g6 Y# }/ @0 _" D3 G0 o ~
代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。
, b P P/ g8 [; S1 z/ P2 F/ f- b. Q7 q0 f. a% P
这是一件好事吗?
" y: Y" B* P- c+ l- F" ~1 i1 I+ t4 K2 Q3 i, z- \( |! H0 u
我觉得,短期内,这是一件非常非常好的事。 c; n9 h6 P' t3 E
0 T* i: U) H, d$ ?0 _# \# {全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?2 f" x' @* N& e$ r/ T3 w4 e- L0 g% s
& B; M$ {# C1 N- ?1 i; z9 _这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。: N! s5 z; C- X* d
9 d4 Q9 B# h. T1 F0 [AI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。
5 \2 \4 A1 [- S) I4 x3 Y8 D
# G- f; p9 o: L/ ~' g但长期呢?4 b0 h2 l3 w! L7 s. K/ e+ h, E
3 E& N6 K" U6 g& Q! _
当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?
q/ E/ a( r# ]7 s
( Z! Q& ?1 E e% f8 n/ E1 `是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?/ f: b, D2 @- r1 ~2 X: [
) z8 Z; x8 c) ~" I我也不知道。! u' B: V2 w# r6 p- ^$ G
0 Z7 B) O) [0 s+ e但有一件事我特别想强调。, t+ o* h4 V9 N" \
) ] c! X2 T# O: S) Z6 q3 j这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。2 h! {0 Z$ P; D( x3 V- ?) G
! _2 G" ?9 }, I6 _2 {- d: X! y7 E
他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。
; c; L! W" O. O+ `8 V! d/ p5 b+ V; Y/ S7 E* l% k k3 `
他们为什么还要加入这个联盟,用别人的AI?. c4 g3 ^( T; X. K- v
7 F& R# C! I$ D8 R: n
我大胆猜测一下:因为挖漏洞这件事,规模太大了。/ `- `9 n# Q: G# a6 N
) ?0 ^# |: I& c: o7 W全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。
' R7 o5 B4 \, S! O. N" p8 u$ b9 P, C* e+ F, W$ d8 l
Mythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。7 ?$ p f0 ~" B% W0 T
- E+ p% F4 { l0 E这是规模效应。
# _8 `6 w: q. C" b5 ?. K
/ U$ Y! \) N9 h8 J就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。# S+ u/ K! w i$ z+ u5 W# i
7 @& R" c- D9 E) Z: e/ Q( R9 I! h这个规模,是人类团队根本无法覆盖的。
, Y7 Z0 D. C7 ~3 b7 Q3 L. O T4 f5 s3 Q4 b7 x5 l/ H9 R6 A
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。: O1 h3 W. ?: s/ {9 l: @! z: O }% I
& Y' c/ }2 f+ o4 V0 n( n
什么意思?
* B; _' z: X4 H7 k" v5 @1 ]8 Z$ e. H1 H' b% [; I
现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。
1 D& ~9 B5 I' c: [
( @, h4 u0 @. T类似现在的ISO认证,但针对的是代码安全。
9 ?7 ^$ q; `! E, k; z' k* F! ?; k; P( P+ A) M
想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。
4 P+ X8 p5 k8 g& w
$ p6 r, R+ e8 V$ g6 y8 W2 X+ o这不是不可能的。
" o. C) G1 j& A4 X3 _# J) O( e A, {. {- @
当然,路还很长。现在还只是第一步。但方向是对的。4 y7 T- [& s2 ]. ~9 r9 [ t
$ q, @! G# N9 a! G. P7 D
好了,写了这么多,让我最后说几句掏心窝的话。
_- X" A2 Q; ~5 U7 n; ~# S
& a7 u& g4 h6 q7 v* h7 {我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。3 y; A/ ]3 F% c0 A
7 @6 p; r7 s' I7 R4 u6 B" X! o
兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。
; b* w W0 M8 M- ~! k" X1 K/ t$ y8 g2 e3 z* \7 G- [/ z1 | v0 F& h
这次不一样。这次是AI在帮我们发现自己的脆弱点。
) ?+ f0 [+ {5 T( z- f2 H, V$ e! e( x9 C# V( x* [9 |
这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。
* C0 K4 R5 l# R1 } K& y. a+ R9 r' | K3 ~# K& `% X5 \% a5 R2 F
这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。
% H9 x5 c6 Z# A; i9 @2 Z) W+ {5 G/ ]/ E! s v, p# u7 [
我怕的是什么呢?8 ~* r& i# u5 ~4 X3 \
+ P/ X, m, p, }+ v) R Q9 C我怕的是,这个工具,只有大公司用得起。
6 ^: l) W- T- S6 f a; x
; o3 F$ x7 n. |7 H1 o5 z6 oAWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?
$ I. O$ W; o% _: b& C: \. y% _; c( ]; I P* N1 @4 z, C6 F7 b
Anthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?
$ E/ m ] R: Y# I& T
1 G9 \* u* G* A4 m) v) h- N* _3 @1 j+ e这些问题,现在还没有答案。
. F6 @* b. L. c0 o1 Z* ?9 Q6 O, j( L( Z' M+ Z& o. ]& i0 n
但有一点我特别想强调。; Z5 z+ L" _+ Q: ?5 {0 p, e
1 `9 u2 H6 r- ]4 nGlasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。
$ U9 i0 l' N. r8 }, b$ c0 Z7 R4 [! \! M& F, F+ x/ n, Z* W1 C
以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。
2 k: l0 n/ ^: U. W- J: |# \' O2 T) l& x2 }1 I( D0 v
AI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。
' l- U8 n! ~; U. q
: z' d. M% }, V- ?, \9 l. r当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。% k8 M: ^9 c7 f- w8 R4 b/ v1 N" X
6 {: ]/ H' H/ R7 q' ~这一天什么时候来?我不知道。可能5年,可能10年。
+ J) ]* w0 B1 _) ]2 `" u0 J) v) B! a2 S
但Glasswing,让我第一次觉得,这件事不是痴人说梦了。, n# M t9 f: z9 O1 H0 i. f* Q
|
评分
-
查看全部评分
|