TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview
0 a9 m7 j- w. I# O# z9 S. i' Z3 d3 h! E w
7 a( Q3 O% i/ I0 ^! ~2 w* t一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……
1 Q3 f/ e* s$ \7 }0 x% R7 n% M5 ~$ F2 Z2 ]" J9 A3 x0 {
故事是这样的。1 s$ m1 `3 G5 _6 B# ?8 b
! [3 }+ v* M" `$ q$ x+ _
我今天看到这个新闻,看完之后愣了好几秒。
+ J$ \7 M$ q' L
( b# _* q: J- S- z$ D一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。
! L6 o+ j, c( A' `. T- W* H: C( B; w, @( b& Q
结果被一个AI模型给挖出来了。: r6 o# U7 P4 @' T" a" E
' q9 G( _, @5 }6 D/ `这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。
5 F8 u4 Y" I0 R) E9 n+ S
( d" l0 d9 E% e1 [- j然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。4 x7 Y# t8 J7 w! q0 n( y
5 [ p6 T; T; W
FFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。5 Q5 ^# z4 S. y* y5 Q
- w# N0 d) ?2 E
然后呢?+ c4 I! ~/ q" P+ A# z4 Q
% T5 w# c& p% N
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。
: z$ z* N1 i7 ?( i8 A
; F7 @. F) @* b" k0 @这个项目,叫Glasswing。" r1 {1 R1 Q$ `
/ T$ {0 d; [6 c7 i p5 d& yglasswing
U+ M* ?- I# T# C& x8 H6 i) `2 `, W
# w2 W5 [" A, ~: r+ F. l先说清楚Glasswing是什么。. Z- [' J5 s, B3 D* V* d2 ?
4 w* \: K9 K/ {$ ?. D$ \简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。
. A& f) v; a) Y: U
( B1 l5 t3 i5 P' n0 A- L) b有多强呢?
3 v& F. Y2 q/ ?& w' n. A
+ n; d8 o0 u9 a" m5 SCyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。
5 ^- u# v/ @) v
% e7 e; s! q! ~1 g. PSWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。) w7 Z: B* d( _$ {
9 A. |. ~, V# W9 t1 `* r
差了13个百分点。
' c: ]: _0 t7 V& Y+ f) A8 M+ H7 X" x0 Q3 r
你说这13个百分点意味着什么?& ~3 _) I' U+ l6 A
, Y0 m0 B# T# H9 X% D( O意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。# J Q ?$ l% Z6 V2 U
% ]3 P$ ?1 n) X. g5 G }2 {2 ~1 t意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。
, @. s9 H3 g( T4 D4 T7 L- m
0 s( i9 B4 `* V7 i或者说,这种级别的漏洞发现速度,会比以前快几个数量级。, O4 f% c7 o* I/ I
8 G4 k/ m1 A) s! \9 K0 q. q: p说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。
5 U* D! N7 f; L1 R, ?
4 N) Q! ]: L L T' \& s6 ZOpenBSD是个什么存在?, k$ A. Z1 [, [# {) G
7 M% X0 X1 h& A; e5 w$ B. Q- I& t
它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。
% g" w& T4 g/ e1 c O
3 G7 ^8 Z+ k0 t" N这样的项目,代码审计了多少年了?二十多年。
4 T2 r% f3 |: {" K# P7 A) f: f1 J+ x& L ^+ U1 w* W
然后,一个漏洞,在里面躺了27年。% X/ r6 g# z Q/ o2 a5 d7 O/ l4 l
1 E: h* D9 K8 ?9 O, ]8 b
这说明什么?
- B+ Z3 q H9 b |' W. G2 B) _* z6 k c; L5 E z1 J1 a p q$ x% [
不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。
, A C7 B3 E1 U9 e8 w* Y) U9 D
9 u+ Z& ^3 g8 b9 D但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。$ m$ v% D& h. C2 D6 j8 P
6 a2 a1 [( a3 MMythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。
* O) R4 Y" G7 c# O: e0 K9 I: W/ F. e3 s
这种漏洞可怕在哪?3 A+ h. u) S3 u& `# j2 ~
: a- O; l3 A8 Z* p它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。2 ]) H: G! p" l7 A c. r) k8 \3 S: L
3 s0 H/ x( T( b }
传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。; K; B2 s6 k0 D+ F
/ t. k- m% s7 L* p1 Z/ }FFmpeg那个例子更让我震撼。
: N1 y5 L. r9 X7 u+ r
: B7 X4 T" B6 h16年。( l9 o( `) q4 t8 }: j/ @
; ~' i9 Q; j& s- |& P
FFmpeg上一次发现这种级别的漏洞是什么时候?2009年。
, G, B c0 e# M6 c+ z v% c, I- ^6 B' R( s: c
16年都没有人发现。然后Mythos Preview扫了一下,找到了。
( j+ l9 K6 X2 ?% \( M
- G; i* R$ v! Z8 T0 R5 D" j注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。' G+ N0 z1 }- S" h
$ w, n, O& h0 l/ j( z0 L7 C5 U
这是主动防御,不是被动响应。/ f8 W7 d0 M1 ~# `( G
$ q5 h% _( v; ]. p* _0 H, r) g3 u1 a, J传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。2 J/ A2 T8 w4 S% S6 R
' I8 h9 L2 x( E1 D9 A
AI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。
s+ E7 D6 q# N7 ]( T- \" B1 }1 \2 \( u: \5 w- @0 g
这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。7 m1 z# }4 Z' @
! E' t1 w$ M ]现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。 Z1 C/ ]+ [0 N# a
1 d2 {7 O2 u, W; |4 o2 H
Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
6 i3 s8 T8 B+ w$ {; ^6 m7 ?- V5 v* } f: x8 C' u
这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。& Z6 i6 Z; n. r& W
# k1 ]* }/ C ?" B* Q. i, K你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。
4 O$ ~( {! T ~7 T; g* A
- d1 U* f- \* ~价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。
$ j4 Z3 d( b6 E; ^
" j6 T" s5 B4 l1 S! S2 C这个价格贵不贵?* |1 p |0 `% X* s# e+ Z
* o9 R7 w9 T3 g7 Y( _
对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。0 M; W. P$ R. g! H, ~
" [" o$ ?* N! e$ T# ~) {
Mythos Preview能发现那些工具发现不了的漏洞。6 Y5 a( E3 [9 f; s+ a/ b1 L
0 x1 t- o; b. E, y' R5 o. f
这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。
& k7 Q+ ^8 {- P: R1 s$ p# s0 S# u! E1 e2 R* Q* I- T4 T
另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。
& p5 T6 v- @' R, A6 S# U
- }9 I. V& g! Q1 _这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。3 J5 w. F( Q( l9 ~5 K; M
8 S$ |( v; c0 _7 J. \, y+ q G. \
FFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。) M" _0 ~9 M) g- E& f5 s1 r9 l. q
: G7 T% }8 V% m' Y' m; y还有一个细节,我觉得特别有意思。
7 \3 h2 T* ^2 F! k' \+ r/ c9 v& k- I/ a9 m& z7 F
漏洞发现之后,公开披露的时间是90天。" E. ^5 S. X9 v
5 u) d" O7 l0 m8 ^) f+ r
90天是什么概念?6 Y. f/ U7 i' @: v5 {# t: O& q0 Z
3 J' {+ m5 T/ r! x. U' b
行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
+ K* p( s& n0 Z
$ J9 ]0 P+ v$ W但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。$ z/ o" t! U8 K" z6 u1 S4 J- S
1 f/ e! X! g* |7 _Mythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。4 j4 K/ I3 T1 O: _/ D( c
i5 k2 D& K& W# `5 G. O8 Z7 F这意味着,漏洞披露的节奏,整个就变了。" J; V' a" y! @, ^
( j' `; U) E, T8 G5 I以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。
: v8 D4 ^ k: b* N r# F" A. Z+ ]- }. \) a& T" a; k# Q& J
厂商的补丁开发速度,能不能跟上AI的发现速度?
5 j, M' P r6 x% ~
, f4 N. G( E0 N) o5 h' V2 n这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。, v% Z" r6 l* i; C: U4 g' ?; n" W+ o: }
! \5 K9 x, V/ U/ L4 w写到这儿,我突然想到了一个更大的问题。
( V( `) G: {% ^0 y+ V2 Q' C% W4 u, _' I% W) H. C
Glasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。/ j7 D B1 A: V5 h" z
3 \1 C, c. N/ A# U透明,意味着隐藏的东西变可见了。
. u9 n% m, g* E! T6 w% q' g \- x" z( X8 [* r2 k
一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。0 K* p! w! I8 o' Q
1 H b' B" [2 I0 {! s. A这个意象,放在漏洞挖掘上,太精准了。: y: f! D0 { I- F. e6 I. Q
0 {9 x h: W6 P4 E6 m
代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。) {" a3 ~4 b$ s' V5 j" q$ B
7 M3 {9 u6 i) y. H
以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。8 _& N9 j, {8 y$ o0 ?
\- Z2 Z U# N' v但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
: |- X# D/ P! l; z0 n) K6 Z8 P6 C& x4 n* M3 y9 Z* K
代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。8 p0 ]6 U; c$ J' d) O8 o9 Z6 q" _$ f& @
/ E* t( T( o5 U! T0 p
这是一件好事吗?
7 h+ ]! r3 ?9 Y s: U
5 J3 F, A* `/ p6 u+ m1 n我觉得,短期内,这是一件非常非常好的事。
- C, s: M [$ u- x( m" i5 y( n7 l0 n% g1 G
全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?
: ~1 o0 Y- |9 A* q. z6 q7 b5 Y3 ^: f4 H$ @/ B
这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。4 \7 l/ @. z/ T1 k) s1 }
! {- c! N) |* z, m
AI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。7 s5 w& N3 m. O- K K; W
: E/ f i9 Z/ P, g& b; y
但长期呢?! I- L7 m* U+ Z0 b$ W* e) `
1 m, p" G2 v J& |- u; X, O
当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?
4 S1 N# q- p3 b; J
* @, E' b, [( m, b' {' A' d是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?" H! \. T5 ~/ z6 a: q0 y9 ?5 P
2 y3 }: G+ ~; e8 J9 B& Q我也不知道。
$ Q+ Y8 r9 @) G/ U- S7 d# e% [, O" J p0 s6 K
但有一件事我特别想强调。
5 k- o$ e' t/ i7 a
* f5 q+ e5 s! }1 B2 b' K这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。
C3 ]9 r$ R- T& E
2 f! k5 K' W- L) o他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。
& _; `# q3 ?) {/ i) Y
. S3 t$ H% E v1 P! U3 G. D3 |+ ~他们为什么还要加入这个联盟,用别人的AI?; y* Y$ i" C8 n6 u5 v/ `
0 y5 O' l* J' e7 ]
我大胆猜测一下:因为挖漏洞这件事,规模太大了。( ]; d; F9 }/ T3 N; a$ s
4 L A4 o0 ?9 J. I/ `. x: b4 \1 f
全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。& V0 F8 A# i+ v$ M3 q+ R6 v
% x. o' u N" Q vMythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。
, M9 X8 n6 Y+ H, u( V' e* E/ q
这是规模效应。8 A$ f% m: q( R4 Z4 ^, a
& f0 s( W" R! v2 S& j
就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。+ z7 f5 ^2 r: l
4 u; W; q4 L/ V- P# w
这个规模,是人类团队根本无法覆盖的。, p# _7 o: X7 ^, m: _- a
2 x* m: \! s/ g; |4 f
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。+ C* p( y! [, X6 O4 x6 k
" o1 x# N9 D6 i, ?7 ~3 G
什么意思?
L% E+ l2 R' F; A" u& |. a4 ~ ]+ a7 N2 H+ H
现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。
/ w1 B a" x( H0 V% Y5 ~! p: D7 _* ?% _, Q* {) S* H
类似现在的ISO认证,但针对的是代码安全。
9 V3 P. o4 h7 V5 w* I; s) y, e1 c! X9 N1 u. Y
想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。- l; I6 S. r! l& }% r
7 t& ]4 `, d, N5 P g
这不是不可能的。
' F; G/ x- A- j7 B0 U7 o
$ ]: m: U, d" P" W( k' a当然,路还很长。现在还只是第一步。但方向是对的。" ~/ p$ ^4 n" m$ p0 o0 A4 H
3 I K; k! V. x( Y9 e好了,写了这么多,让我最后说几句掏心窝的话。! F( H" W7 g7 G) {
- i& a3 B O5 _# \, D. D+ K9 ]
我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。
$ l4 L9 ?; T9 r* q
8 v' O7 f7 n o+ L5 {" H兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。) R- B6 a! w" ^* G4 t- ^. Z. A6 h( J" I
- `& s( ]& T9 k0 u3 z2 P这次不一样。这次是AI在帮我们发现自己的脆弱点。
0 m2 a' C, t z( W, L. n$ m+ j
5 y! l3 k6 z5 H这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。- E$ O d5 i2 ~4 M2 {
, B3 X! _2 C p9 c. v- w这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。
2 c; ~% d4 x v# A/ d
7 ~' l! a! A* h2 y我怕的是什么呢?
7 K4 N. n) ]% s/ `% C9 S p
$ T% {: ^% |6 f1 c1 Y. j5 g我怕的是,这个工具,只有大公司用得起。
7 s5 L) N: Q+ c7 X1 B: [, p3 D4 B5 ^5 a" D
AWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?
5 G1 p, I3 c+ n; y
3 V5 U; ]# m/ U/ w9 dAnthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?+ g# z! \% b4 ~, B* t. M
3 r) G( O) g$ K) t& Z/ Q/ E) ?这些问题,现在还没有答案。% [- g3 K, @$ v. x4 W0 w/ Q( B
) d! ~2 [6 ?% s3 w9 j/ i但有一点我特别想强调。
+ l2 ~4 Q, Z( d0 @2 k' v$ f) t$ u5 e: n
Glasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。* w5 ^( S8 ^! T! i7 {% ]% E
5 M8 w/ \% P/ d7 {7 a1 ]/ d- D以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。2 g! W8 B7 l8 e0 ~
' I, Q, y5 H! i- J" u) N& L7 b0 g9 k+ }
AI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。
( u+ R/ D7 `$ e1 _+ g
9 C' f$ F. A- V" t" g, J1 S' v当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。
! E" y4 R5 y- v! _2 o s9 R: B: R" c6 f; `5 ^
这一天什么时候来?我不知道。可能5年,可能10年。
8 Q h6 ^" k. N2 ] }) r( Q) L( d2 T6 v, p) K+ _! f9 ], m# ?; `
但Glasswing,让我第一次觉得,这件事不是痴人说梦了。 \) L0 _, ]! p; b1 \ m4 U& ^
|
评分
-
查看全部评分
|