TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview
. E" P7 Q' s& S( X/ ~, s
7 @& X2 o' e9 [& N; x$ s; ?9 ~' n7 m9 y& h
一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……( j& R2 x+ Z, n& d; a" ^' j' i7 _
6 d: ~. v3 _: g( \; s5 L故事是这样的。
* h2 w/ ?3 u7 [4 a: W: T
6 i+ a4 o" p$ a$ E7 i3 Q' i- z我今天看到这个新闻,看完之后愣了好几秒。, G' n* F7 _% g
; `7 m, i% i4 d+ e5 f8 m* c一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。$ ~4 F- ]9 ^5 R# h# j1 |
) K; q( a% ^) h7 P$ M' o2 n结果被一个AI模型给挖出来了。) W% ~3 P, k, q, o( ~8 ]5 _$ e
- z0 r( D7 r5 K' L- t. a# u3 T
这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。
; ~5 t W) d. z0 x r' J/ x# c% n; P* I
然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。
' A% N' M0 Y# x9 x$ Q# n
+ @. S, T/ k( LFFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。
0 j! a+ } s$ ^% y
5 o6 X+ C( j" {. O然后呢?! z, l) c, k5 }2 i' [
3 P& j- C3 |+ Z* U$ X7 K
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。8 [. ~. m/ `# o" F4 T# t! j
# X0 |! n2 ?6 N+ B9 e这个项目,叫Glasswing。
7 |% K7 V& P6 Z1 S6 y( P' a
6 j _- M2 s' b( e0 m8 n6 z( r: W+ aglasswing- Y5 J) N4 X; p6 H5 J
: M5 m1 V. h& r! _- K% l
1 N; I) Y8 t g# J% u先说清楚Glasswing是什么。% ~; k2 I' ?6 s# ~9 L" Q
% X% S$ U c/ H E4 `2 h: c
简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。
$ i7 r9 Z) ^0 I0 r2 ~9 v3 F* O/ U3 [6 Y, T) t3 I
有多强呢?3 S$ |/ X) v, q1 N
; Z: }# D- Q! w x$ gCyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。5 M) D% B6 x. Z0 [6 i
& i/ o; @# `( |+ J8 G
SWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。4 C& o1 ~5 L8 C N# Z6 ^
# L- W. K/ {$ D- M9 U
差了13个百分点。
( R* d0 W% k b5 U2 w( Q4 i- d7 @6 G9 N- ~: ^$ T
你说这13个百分点意味着什么?5 y, S+ C' w* |9 s
* u* f* S4 n0 g4 V8 M4 `5 u3 X
意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。0 Y' h3 D5 z6 B6 ~) b6 \
! F, a8 I" x! X% U7 S. k' \
意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。
; Z! s8 l2 O; h- t2 K4 S2 R4 M: O: J& {- K ^6 H
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。( \: t6 ]- G o9 J
- n! q; U/ O( I3 L说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。
" U$ k/ i) y( h, K: I5 i/ H$ a8 K5 I% ]9 M, q7 C7 p, u" S
OpenBSD是个什么存在?
5 R8 y# q0 \& J3 f! Z/ V: F" F+ Y. q$ Y" ]+ Y
它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。3 y; g+ Y+ i+ ^ K# f& u3 Y# E
$ `& \2 W; F2 }) O+ ?, W9 |) i这样的项目,代码审计了多少年了?二十多年。% \* T1 J! v% [, @
$ @5 ?3 h- X: D
然后,一个漏洞,在里面躺了27年。$ \, Q) ?$ R) Z& V, L
M' E4 ~4 N" y. v. @1 c这说明什么?
2 w1 ^7 Y/ {3 B! `/ O# }+ R% b" h f: o
: s' K" O& M# V1 {7 Q不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。
% h' d; f7 T- B) W8 C: a+ }" }+ l, e- n2 D/ J; S
但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。5 n+ O, B0 W0 b. w- `8 |
/ q# G4 b5 l1 @4 ^
Mythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。7 P: n. ?9 X5 s9 G O1 H
. _+ Q* `1 H* P这种漏洞可怕在哪?
. c- }; J( M3 o
- f& y9 W. s! ?: a* N0 R它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。
2 C) j1 ?' m+ |- ~. `* U" g& P3 h# r- x, K
传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。9 v5 d6 s4 O6 g( H% k
; ]! q- a3 R! F8 SFFmpeg那个例子更让我震撼。6 M9 R. c/ V& p& l
0 N3 n3 n2 A3 n9 L; r
16年。0 l4 h1 Y3 w, K
% V. u3 E8 E) p1 Y
FFmpeg上一次发现这种级别的漏洞是什么时候?2009年。$ \$ t# J' B2 E" @" W' B. m% e
; O3 R) S6 _4 @
16年都没有人发现。然后Mythos Preview扫了一下,找到了。
3 m; H# n' e0 X$ A# x% B4 ^1 z! s+ r/ N6 P1 U9 d7 ^
注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。4 |1 w& [0 e. ?3 N* K) k6 D
- Y. |( A: F: x( T这是主动防御,不是被动响应。9 B7 o5 t- I [% x5 x
, x% s# B2 i; c4 j9 G( f s5 K传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。 i3 z8 H ~/ h( M( l! K
9 e; I* H3 [; k8 {) {0 V2 dAI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。: y! M, n# T- M& j. D& D5 z. r
+ t/ R, x. y3 C9 \1 {
这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。
1 n* t3 ?! ]4 {
5 @2 w/ c2 `: g+ M) A现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。- J2 G# m9 M5 y/ Z( \
1 Y' i- I9 C N: p
Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。: J# W/ k8 A' ^$ x; J6 C- I8 y
9 V& [7 o% X2 g; |这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。
% r \! {1 H) w9 C3 ?
& e; K+ t, Y7 [4 p, t你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。
# f/ M+ L N! u+ G6 S6 J; Y* \
3 [& v. h% Y* m% H2 p, T价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。
; i1 f- ]" z; x. ~8 B. b9 [* a- @' M! X, v+ `$ _- I
这个价格贵不贵?
$ o, e2 U7 r% c9 c: d% ?% o* V, q0 a. O. C4 H9 b
对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。
2 \3 V/ B8 J- V' v c/ S2 G
, N" B; S! W) Y/ VMythos Preview能发现那些工具发现不了的漏洞。( L: d; e0 [! R6 E7 M) b
' Q, d f: ]8 K! }5 {- W这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。
4 q) d8 c& y8 @( w8 u
4 _9 I% b2 B7 }& M* u+ ?; ^另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。9 Z! \: {/ w, m( v
0 a3 ?/ z2 \0 E8 S/ r& S2 ^8 m- O
这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。
1 A; ~# k( J, `' c' Y: q, _) |2 }" @, y8 v% N F3 h. S* _1 [6 p- d
FFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。
; s$ i1 T) M) e" r" @' Q
0 k; ~% d* z4 X' J5 D$ g0 \还有一个细节,我觉得特别有意思。+ K( q( ?3 i4 \" j2 a
1 ?5 m; a" {) E0 w1 ^7 u) s漏洞发现之后,公开披露的时间是90天。! \9 g/ V: {- ]" {
: @2 D6 K2 _' p/ u, C% k+ W90天是什么概念?
; g0 W/ t: A' f: `; ~3 y$ s0 B7 _
7 W/ L% S3 G) F* l1 W行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
& ~$ G* `) \& K! Y
0 ^8 Y% ^7 y1 W& ^; [/ A- L但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。 q' \6 T4 s! O/ p. R
% n& x% M5 `. L# R- GMythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。/ q, t2 Y/ Y4 }, ]6 E+ [& ^
2 N/ ^' \6 q! A4 q" c
这意味着,漏洞披露的节奏,整个就变了。& t! @! E% }' e. J
1 z# q7 G- W J
以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。0 H( f8 r) d) G1 V5 b3 S" B1 K
# w( d: J- @* F) g& C厂商的补丁开发速度,能不能跟上AI的发现速度?
s$ T) f" t& [% G" e2 D5 j8 U3 c* _! [) g n* T
这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。
6 Z1 |6 U/ {+ x+ O+ a+ ?2 z& H+ |. B
# w, B# Q2 [& s+ ?写到这儿,我突然想到了一个更大的问题。
7 I6 P" k% E# H9 t( q- X* ]9 F) c1 M" C5 R' o0 H) ^* e! v( I; d) G
Glasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。6 F/ e' ]3 Y2 N6 Z6 h4 Y9 ]+ ~. X
' f3 F7 n0 Z$ A w' `& Y透明,意味着隐藏的东西变可见了。9 M$ G; N9 T" X# U5 q2 w' D
7 H+ }* ` c0 e! A, d
一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。
1 m$ X9 v0 E; m, r$ e/ \, I6 w) d: _; M2 d8 O1 b0 b
这个意象,放在漏洞挖掘上,太精准了。6 h9 E: T* ~" _! v" B$ G' S& C! ^
/ R5 F" P. I. h, O
代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。) z2 c' g* c& A, V4 i' G9 x
+ r1 e2 `( l5 }0 `
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。
* e0 u) N) j+ _/ U& t
; h% I5 A$ B6 f( \/ m- H) G但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
# s" Y; R( B" x* U
& @' O+ \8 C. l4 N代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。
' ]+ ?1 ~( q- Y0 }9 x# k/ l9 U+ f" m! e
这是一件好事吗?
8 L0 x$ N! S4 ~2 b5 M! E& \' e
2 Z" K [! Z! W$ Z) d' E0 z我觉得,短期内,这是一件非常非常好的事。+ R5 e6 y* k! {) ~3 S: x
f8 s! ?- Y8 O! M( n1 ^
全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?
& V! i. A, [7 _& T, l, A9 t% V- k1 T! U1 G
这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。
- m3 e; b: W" u8 H- f) A5 m2 w# h* P
AI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。
6 X/ Z$ q& Y% {9 E) `- S2 l2 x1 i5 Q% [) o+ K
但长期呢? X' }" K3 ]0 N- g! l! ?" t; ?
1 D' @4 ~5 F& C/ L: @0 B+ a
当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?
0 _; f4 Q {" N1 p; {/ e3 V. ^$ U! ^" A
是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?# s0 F6 M5 J( E: S/ ?' p3 Y
) Y# K3 P5 g8 F! a- t! L4 b我也不知道。- K: m c' Y9 x: K ]' ]
& R0 R5 Q6 {3 Z$ |8 ?3 p: n5 _; r
但有一件事我特别想强调。
" V% g& ^% Q' l6 V2 Z* Z% ^) Z. T* |7 `/ T# _
这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。& G: s5 Y0 u! w8 U& F! u4 A
. P4 z) L7 ^+ w/ }& j他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。
0 @; t% b) V8 l- Y' W0 R G. _; M
( h( ^! Z7 i" P1 {他们为什么还要加入这个联盟,用别人的AI?
3 c5 B- k! H2 e+ S( ]7 w
/ Y, v4 L& Z: v我大胆猜测一下:因为挖漏洞这件事,规模太大了。' p; E2 Q `3 d& j& g
" |8 y6 g/ g8 Q2 u. r, z全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。
3 _3 k% s2 d9 Y; F. m& [8 `0 n% I4 U; _' X) v* `1 O
Mythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。! T) H) W; T; w0 c2 v! x
( z5 t) C% u8 `3 X! n; }+ N
这是规模效应。
5 N) g0 g% `# r+ f3 \' m
% @3 _ U% J/ i' y1 j就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。
) K6 h% O# H- a; v0 Z! j& i' g* l3 x) L. R# f
这个规模,是人类团队根本无法覆盖的。
) C: m7 U4 D1 d/ c) B% m3 {7 N4 y' R/ T3 h1 l& ?/ @7 b( O' ?, {7 D' _
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。; t2 j7 Y N* t; m% _4 @
' a$ p5 G% F8 H
什么意思?; o5 x7 F( R' K. D& F
8 D0 z, |3 a. T+ L+ i现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。
& v6 M+ n/ F' h' q/ U" ^, Q1 o* `& L% P/ v2 W6 d8 w+ n
类似现在的ISO认证,但针对的是代码安全。
; J3 U! M2 N) ]; a/ o, U' `- s
; M- B" J t0 o! G. Y8 k想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。! b/ J1 w# u/ ?; K6 f& ~
) S7 w# b' F; I( T; `( o; e
这不是不可能的。! ]2 ^' X" b i! B) F/ D# O+ ]
5 J2 c& Z8 X. Q/ _( a
当然,路还很长。现在还只是第一步。但方向是对的。
/ m9 c6 ~6 y! U/ g) H8 ?- x1 t
$ o3 [+ S' w. O# l9 m& {! C好了,写了这么多,让我最后说几句掏心窝的话。0 u- c* U! u4 ]$ y" ? m# a( j/ o
4 m6 k, L- e3 a5 D% X( q; p7 \4 l我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。, N5 P: y; |2 I' f5 R
& e& C8 J; N! V$ w- @& g( l' c
兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。8 X. e4 R3 ~5 h1 O
6 D1 t0 g' z# a9 S( @5 m这次不一样。这次是AI在帮我们发现自己的脆弱点。+ K4 N; q j- f$ M
: u. U' F. E! W( e- O这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。
8 M3 k+ m1 R7 E
& S, t2 _) O4 J% B这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。
. Z! v8 V! d& F; O
( U' q7 ^- q) H) ^! |& e我怕的是什么呢?
5 F+ ^( U3 |7 t7 R( j! m0 s6 \. h' C2 o2 R2 x* u- P: x
我怕的是,这个工具,只有大公司用得起。
- K& K. \" s9 o, L% D5 h, u) `' V
3 ]8 x+ G$ g( ^9 VAWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?
3 z, \# D+ s7 _8 j0 q3 o; _
* j7 U' f8 j$ z$ ?* }Anthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?
- A4 {* Z s" B, W1 x6 G
" t' F* w% j9 `8 g; p% f4 B2 g3 `这些问题,现在还没有答案。! i& K1 h" D; B8 j$ O6 H
- J8 Z3 [0 z& H但有一点我特别想强调。) v3 D. m$ a$ m
# |1 R2 d2 k( F# U6 o w; a9 PGlasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。% J% i5 V+ B3 p a) ?9 z
& o5 w5 `& O, m" ]以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。1 j; d" J* y; y* n6 T" d! H! p3 c6 M( o
% `( P4 d1 M% O$ f5 x. |# X- tAI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。# P1 D" [* K$ { E) j6 a" {
2 A. L O& B$ [5 L
当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。
" D5 C4 R: c f$ r; c% z& X
( Q% F% i2 i7 K这一天什么时候来?我不知道。可能5年,可能10年。
9 l5 e$ H) ~5 Z+ V7 d9 e$ J6 y. a1 s" A
但Glasswing,让我第一次觉得,这件事不是痴人说梦了。. l Z4 `, q) y: r. z7 ]7 R6 `
|
评分
-
查看全部评分
|