TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview' _+ t% _, v( c+ C# x7 N6 d
5 E3 ^* \" T8 _0 F6 c% @3 y/ K' `& _* {; l' j# [& V
一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……
" s0 { X C9 Y: ]: H2 ]2 [; ^0 C4 A& k, q/ H
故事是这样的。; k6 t, P D8 X: Q- K; E
: C0 n7 O3 R% p; `. t
我今天看到这个新闻,看完之后愣了好几秒。8 h; [3 i K: U2 @9 F2 p' h
1 \. V5 ^2 T n: F* L m一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。/ t; _6 C$ ?3 n+ c7 k& ^2 s
# r% i0 o1 O1 T
结果被一个AI模型给挖出来了。9 z: y) n( r6 }; u3 E
7 H" {, P/ O: E+ K这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。
! ?9 L' }3 w' B% y$ O
! s; e' `& j' G; K& T2 w然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。- b, r* e* k! `8 @( n8 B! F
, `( D- l+ I& h9 \) k. |
FFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。
- c' _* R0 D& ]* \3 g- C+ a! M5 `: r! t4 G* l
然后呢?, D3 @2 `+ f" \. _ }; I
U; G- \4 M4 w- K. T: c! S1 d然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。
5 S! f, G& E- f2 b* b' W7 @9 i' E5 \1 \3 I- K9 X( O! \
这个项目,叫Glasswing。# W8 e T) V J* @: u( n# b8 ]: R
! c% \( C* S9 I' a: m2 q
glasswing% H$ a+ g5 m; x# Z
. s8 E& q7 [3 p
) T h6 A; p0 q* N
先说清楚Glasswing是什么。
- D* n; c0 a/ ?4 i% U& e5 m" q' G1 `8 A3 p
简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。
* W5 `/ T/ P: d" _
. V: w; P) x- A+ o有多强呢?1 M# ~: A2 `2 S: f" l/ [* U
$ g. r8 s$ j% K2 V& {& SCyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。
3 W7 u/ U3 V' [! E, [, L* C$ F
1 W* [* z+ j" E3 z5 SSWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。" R- z; I& D& H0 c; S9 a
& O2 ?0 H& t: G# B) N% U差了13个百分点。1 Y) T. Y1 d6 d+ m
( O, q7 q! X9 z, m, `
你说这13个百分点意味着什么?; v4 [- k8 T& ?
* T0 G0 E2 x* x# T
意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。
7 x+ A4 K) f3 p- G
1 M8 T: f, C0 g- K意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。
+ J3 L. n; f& p% g) M* n$ h% H# x' p" d' C L6 r* W
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。
* `$ i3 `2 U' a0 }0 H5 ~; [3 ?+ G6 G* Z/ }/ p" y& Y2 _6 _% Y
说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。7 Y% ?! V$ V/ e( [
, _: `* |7 R; AOpenBSD是个什么存在?
f* s. Z# A* e4 E( Z# z7 l. \: r* z j0 g3 y& @1 b4 B
它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。8 K- z* N3 B# n7 t% X# D- `
# W& Z( V$ {$ H- w
这样的项目,代码审计了多少年了?二十多年。* P1 ^2 N6 {( r7 }) ?. \
. w5 y, x2 D6 R" ?7 O1 t D, y然后,一个漏洞,在里面躺了27年。
+ L( h1 u7 f5 K, [9 {2 u0 {4 c' i& q, o- C
这说明什么?9 T; ^% i- F, L0 x8 j1 b0 |
: f2 x# }* f) I; \不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。7 ?, p7 {3 B/ G5 |" G
4 {1 n7 V# [2 _3 G. m0 l; Y但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。 T# \ A' P9 {2 F, |$ \
' Q# g& ^' o, A$ KMythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。
z" Y8 ^2 n# S/ ^- ~$ B e9 M1 @8 E* e% _
这种漏洞可怕在哪?0 Q; R, }+ Q. }
! U4 |; w ?4 [: N% x
它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。
8 N. p0 P# k) f# i" E& Z. O |$ Y6 P2 f# n1 O
传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。+ e! r) `/ b3 I
- p$ p) K8 H5 [' C9 BFFmpeg那个例子更让我震撼。; T4 L4 ~2 A! J0 W' n+ o0 O
3 N6 \# Y1 W$ D( E3 z7 R& o16年。
- x2 D/ b- t% U2 d+ C1 r9 X) P3 M
3 a }* E2 W: [6 ?FFmpeg上一次发现这种级别的漏洞是什么时候?2009年。
! p1 @$ U" N+ V5 Q3 K- U* a: W: y' e n4 f0 t6 X, ~6 U
16年都没有人发现。然后Mythos Preview扫了一下,找到了。
: X, d& _9 d" r1 ?" x" {( a) m6 i& b6 T4 w* Q U
注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。
5 q& k+ m, Q8 I, p( O
8 p* _7 {3 g4 D; v! ?这是主动防御,不是被动响应。# ^3 ^/ y9 X2 \6 S9 F' G# D- o
4 G& ?3 e# l( j8 @) S, ]传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。 ]; m0 q+ k s0 J
. f7 w4 v( v( C3 w' R
AI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。
0 Q0 h# s! ]+ a5 D: |
& F6 z# S) H6 ^/ m这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。
, z4 {1 k! J2 a# w. v3 T- d
% p3 R5 {7 g1 _! q/ X5 J现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。
1 z& l; f2 X) G/ I$ j. b# `$ @) ], A/ ]* {& L5 C9 ]2 G9 V
Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
2 r- }" S8 ^4 H1 m7 {
- Q& D' c, P- f/ D! Q: J8 }这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。
- n" S% |; H3 X% ^3 ]/ Z: r/ v, }! {: }9 q6 n
你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。; D% l/ C& V! y1 |% B. r1 x
1 d8 r! O3 F. X7 ^8 M& u4 q/ P% O; E
价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。
( t6 Y; }$ q: l# u! R( c6 A3 D4 N4 x: k& z- ? R
这个价格贵不贵?# d6 e. ?6 h% P1 J
$ i' s1 C% y( U/ h5 I4 h对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。1 ]$ H5 e' {$ n0 c, T$ Z
1 K( ]) G! h- }- D6 g
Mythos Preview能发现那些工具发现不了的漏洞。
4 A- D% b8 @: _" h- ?4 {* w1 r) d+ o$ u7 d1 o
这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。9 y+ i$ V% f) [$ a9 T
2 u, W3 d1 i8 O7 ?另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。 J5 ]& t7 d3 u* ]$ t
3 Y8 S. j( v. d7 [4 z这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。
) a( y# `( L' y& x; m1 y& t1 s. ]8 `. ~# r( c! X
FFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。) c9 @' y. H; ]1 n( |) a
2 Y6 g# p/ x$ P9 s还有一个细节,我觉得特别有意思。
0 z: n( n$ Z* s+ n2 R' q O, ]# x/ E+ ^% u/ y& K, p; Y9 v
漏洞发现之后,公开披露的时间是90天。 a* r `2 [- f* r% b7 \
1 h4 N4 V @% a# ]. w
90天是什么概念?5 R, ^$ F; Q: H d! h* Y
9 q$ B3 g' O. b/ {8 w) Q f+ z* r行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。9 }) u, ?$ T+ k$ U3 r" e
4 y& ?1 K/ r) ^" S4 }9 k但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。! c/ R4 Q" Y" U* m6 d
G5 O1 U$ I' J Y
Mythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。* A. Z% O) e J! @
2 {" ]0 \9 U" A) H; ^1 S这意味着,漏洞披露的节奏,整个就变了。! f z' |, g& s; i& p; H
, m4 E+ V* x* `- e6 Z$ c! ^6 X
以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。6 v! x9 b8 S2 |1 V
# M% C$ x* ~' x* A9 S& F; @* {/ k
厂商的补丁开发速度,能不能跟上AI的发现速度?
) |4 U, ~* L% D$ j
) D3 D7 f3 E; T" Y这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。1 o; o3 z' F( {1 e6 g3 n9 O
/ S$ }) [/ p2 f写到这儿,我突然想到了一个更大的问题。, o, {& v7 E& _) {/ o6 ]+ r! u# q9 b
c: J3 _+ G: k8 L5 d/ n# HGlasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。. ?3 J6 l) ]* r3 r! j8 _- ]
3 z. d7 m8 R, {* k" ~+ x* e透明,意味着隐藏的东西变可见了。) K) l* ^6 ^& f2 \( s) j
8 e: c4 T' z' c0 }% `一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。
( t7 U' W8 Q8 i- p& k" o( {! O" G1 t- @1 O, x2 Y" z, p1 \4 B- h! x
这个意象,放在漏洞挖掘上,太精准了。
- K0 O% l3 a, l! S( I; j
& z1 _/ y$ Y7 [% M0 {3 f) Z. `代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。
, A+ l/ [- I2 y! K: c7 {
# o8 M0 t0 J! A- b3 H$ J. f以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。
7 ^! I7 ]% {' f+ B2 ~. L! Q* I/ o2 U% J& L- {/ s, E& @
但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
2 {1 t# E M n8 \4 K* A2 h! R! B6 `) C' H3 b# ^: y$ V" T. k. @
代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。 @% A2 p; n8 [
0 ^8 l* `3 y2 o. T- x这是一件好事吗?% k- \# l. a* Z2 P% S! V L
0 j% A/ B }& g. y( ^% @; H: d* ]我觉得,短期内,这是一件非常非常好的事。& o; B. f9 ~5 S4 }, M
/ |( V3 Z- s. p! j( X
全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?7 z' j$ s; Q9 H/ b7 W
' }" L- j# l4 g9 v$ x0 m5 z
这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。" j8 {' _6 W! [( i9 u; C$ N
9 X' F" x' L8 H' T1 a/ r
AI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。
! {3 z9 f! X; N j; o E+ N
* X2 a3 |! c) I- M. Y但长期呢?2 j" ?9 U7 n6 q$ Q1 W! ?. W
, _- |' P. j& ]( {. j" @+ X( ~当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?
) ]; t+ _, ?3 y2 d$ c" J. y
1 X2 R2 ?0 l; z7 F% e是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?
6 I5 x& k# K @% B8 e# ?/ B O0 W& D
我也不知道。+ W, M! x+ a3 t) Z6 o% w
4 G1 D" U) |, y' u/ @/ n但有一件事我特别想强调。
\7 G/ X( Z8 h& N& P5 t
# |) ^ S, c8 n* K! Y1 C6 W' t这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。
" F" m; ] _) i( ]2 J$ W9 |
( A" F1 Y1 \: ?( Q% A5 l: M( a4 W他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。
( ?& A1 e3 j1 F5 H: D' D: f3 s }
7 z+ ^; \0 o- J他们为什么还要加入这个联盟,用别人的AI?
4 j O5 y4 j( e3 I( [
+ s0 ]; g3 |! D: n9 K4 E6 o我大胆猜测一下:因为挖漏洞这件事,规模太大了。% U3 L0 E' `: L5 U/ S
8 j5 d4 G% |; u& S5 I, r2 e0 {全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。
8 {' Y8 u4 v% K" W. ?" ]5 @0 s5 E' X. V
Mythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。: w7 ]. H# |: e' c' |( s* v8 i( I$ _
* M) A3 | e" ]4 l6 P" i这是规模效应。% w4 y" p1 i3 L' p$ K: N2 ~8 ?
8 _4 U* H2 K& v& J就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。
' K" E3 ^' V+ V$ u( j! h, a: `- y4 w1 R4 K! j( a: Q
这个规模,是人类团队根本无法覆盖的。& K8 h+ o0 E/ j" O( ?# v
5 I, |6 y4 d, q4 e( j( G& ^Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。2 L& L1 N0 V7 T) m! b
/ d3 h+ y' b0 K: G/ I* d0 Y# ]1 o什么意思?: e" n$ [3 B O% C r6 X9 H% R2 H
/ p5 G7 Z* a" S' M4 u4 v3 T- E
现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。9 U# n! J4 A4 \& y$ A5 t: T
\% f/ w# f; ?( w5 _7 P
类似现在的ISO认证,但针对的是代码安全。0 h _9 A3 f9 u+ w
$ K& s6 w- B1 Z: ? l, m
想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。$ A: E* _7 ~- O3 `1 O
V4 s- U" F! B/ f
这不是不可能的。
; H/ G; |% H# k# o( C5 `3 N: i- j/ E! g
当然,路还很长。现在还只是第一步。但方向是对的。8 l8 X- e6 g# x
4 E" D7 Y* E9 h: e
好了,写了这么多,让我最后说几句掏心窝的话。4 p4 M1 ~% ]/ W, q0 k! M7 i
9 T# j2 Q( O9 p我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。5 ~ C: ?' J( B% `; r
% f9 z4 Y8 `5 }( {! d
兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。3 X4 H1 l1 g r0 j: f" L
O- m' ^0 Q4 k9 l这次不一样。这次是AI在帮我们发现自己的脆弱点。9 t. E9 r- u9 t& E9 F# @% s0 E
^' i/ K2 w9 c2 s: s, h2 U+ W
这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。
- O) Y0 f- u% N4 H/ L& F) Z$ w! c6 `, H% E ]# @# W* E7 K7 \6 f5 i
这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。
]/ }5 u+ \. i+ A) i8 \7 Q6 Y [6 U
我怕的是什么呢?
, V1 i0 ?$ t4 d3 d4 X/ U, s( t0 a1 N2 s7 c# S
我怕的是,这个工具,只有大公司用得起。
4 O" P% U6 h; e3 k$ q/ D% s& l0 Y
, \, c \5 u$ X! nAWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?% Z& A" ^; ]' t3 ]+ c0 l) u
. y u4 l, ^& l& q
Anthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?9 e) M1 N% z; t) o& P
* G7 N, F$ q" k" l
这些问题,现在还没有答案。: Z6 C4 Z& y$ ]* g( R# Z
2 O0 S0 j( K) r' s: x$ c% v4 R
但有一点我特别想强调。
" ^/ y) y d3 T5 A% W$ Z. M" I9 p6 e5 g' s8 e* @
Glasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。
, m1 `/ D' x* c, I( u( E
7 }- X- i( c8 Q0 \! h* a# M7 X: b1 `以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。4 a9 L G2 B" F4 Q! P9 F |! T6 |1 [
, C# M! ~/ h- K; z. q6 A# qAI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。$ e6 w: A; Z2 h6 T/ T
& b; I9 R) n' f7 s _( u* ~. o+ b; u当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。0 w9 ^; F4 n3 c( Q
8 x% A' ?) H* P0 o6 O$ u5 B3 {- ]' N; s
这一天什么时候来?我不知道。可能5年,可能10年。
2 B7 b3 a) z u T. s! r* S
3 t1 F" [* ^! r: P, C但Glasswing,让我第一次觉得,这件事不是痴人说梦了。6 I: _3 g5 r7 w1 e+ m$ a* y: o
|
评分
-
查看全部评分
|