TA的每日心情 | 开心 2020-4-8 10:45 |
|---|
签到天数: 227 天 [LV.7]分神
|
玻璃之翼降临——Glasswing计划与Claude的Mythos Preview: c6 @# a- }8 @1 Y8 x3 @
* O; M! B7 H0 c& o$ g0 ?: w
* u9 y: J) V% C; ?8 q* Q: t
一个预览版的AI大模型刚刚挖出了一个尘封27年的漏洞,然后11家科技巨头都坐不住了……
& H/ o, q4 F. _& l% Y2 h
1 \! V2 P q; C2 v+ N) a" A故事是这样的。
# l, m, T' x- h& C+ p
4 N R" j. v/ W8 n$ ?+ Q我今天看到这个新闻,看完之后愣了好几秒。
" ]5 Z6 w8 W5 z3 D+ ~
0 q0 \3 A; ]# p) H( b* |- a一家叫OpenBSD的公司——做操作系统的,算是安全领域的老前辈——他们有一个漏洞,在代码里躺了整整27年。1998年写进去的,没人发现。
$ W' @9 s$ }6 E1 x& F
! }& {2 N) |$ k: d3 P结果被一个AI模型给挖出来了。
. [" L( G) F/ J2 h1 {% b2 A
& A1 m' z: A1 C这肯定不是那种"我们用AI扫了一下代码库发现了问题"的挖出来。而是那种"这个漏洞藏在最核心的地方,所有传统工具都扫过5百万次,一次都没报过警"的条件下挖出来。
( }2 A- a/ A; `+ E }; _/ B! ^% k: H* N k4 C2 D4 }- p3 E G
然后,这个AI模型,顺手还把FFmpeg里一个16年的漏洞也给挖了。
3 c! _" u7 H4 U# @0 g3 Q' A
- H3 ? e5 p: _+ H# h& yFFmpeg,音视频处理领域最最最核心的基础设施。全世界的视频播放器、浏览器、直播平台,有几个不是建立在FFmpeg之上的?这个漏洞在里面藏了16年。5百万次自动化测试,没一次报过警。
1 Y. Y0 s# W( `" m
, I. N- K/ @5 a* J0 d6 m然后呢?
) q! _* G# |' {0 _: n; V: z6 V/ x3 j2 c5 f4 t
然后,11家全球最大的科技公司——Google、Microsoft、Apple、NVIDIA、CrowdStrike、JPMorganChase、Google等等——坐下来,说了一句话:我们一起出钱,让这个AI模型,能被全世界的安全研究员用上。3 W* x2 p9 f' h: I8 f; ~9 G1 ]( V
`) h) X) Q7 D, m! B! T; _
这个项目,叫Glasswing。
, y* }4 x4 N! L6 _, `+ x& ?
: [7 p( R4 R+ X* A7 A9 z* pglasswing7 Y1 K( Z: h( U4 a
K- a0 t2 T0 m+ @# T. l
4 S2 ^+ k1 a. a( \0 x先说清楚Glasswing是什么。8 y) Z& {# Z, L5 j
+ A: Z% F4 }* y9 H$ F9 y8 ?0 [
简单说,它是一个AI安全联盟。发起方是Anthropic,加入方是一堆哪怕是不关注技术领域也叫得出名字的科技巨头。它的核心,是一个叫Claude Mythos Preview的模型——注意是Preview(预览版),就是还没正式发布的那个版本——专门训练来挖漏洞的。
) [" m9 e9 V& t4 P, v" E: b1 Z# w& j
有多强呢?7 {5 R+ |6 f2 t2 q* s3 t
& G8 I5 e2 ?7 O/ v) U% x; XCyberGym基准测试,83.1%。作为对比,Claude Opus 4.6,得分是66.6%。不是Claude Opus 4.5,是Claude Opus 4.6,Anthropic目前最强模型。
" ?, Y$ `) ~* d5 @6 \- H7 t; t( X9 {1 P @5 T% A- O
SWE-bench Verified,93.9%。还是SWE-bench Verified,不是那个容易一点的版本。Claude Opus 4.6是80.8%。
7 x7 T, Y6 A5 h/ c* s
6 q2 O" O" `- z1 G差了13个百分点。
/ `% E n& E$ r a- l7 e' \) U4 e
3 E. w Q* `0 `+ ?你说这13个百分点意味着什么?
& Q- R# P8 r, d; D+ ^
8 p; v4 \2 c! l意味着,传统扫描工具漏掉的那些最刁钻的漏洞——那些藏在层层调用关系里、藏在异常分支里、藏在并发边界条件里的漏洞——Mythos Preview能找到。- G$ }. _ t8 z% Y
9 q7 L2 t+ N4 l6 {! X3 { {意味着,27年的OpenBSD,16年的FFmpeg,以后可能不会再有了。
2 J" K+ R$ R- g; e7 @2 N( A, J% _ _
或者说,这种级别的漏洞发现速度,会比以前快几个数量级。% I- Y# C3 ~# u4 ]8 p+ }
9 s% k. w% ~* b$ x8 [
说到这个OpenBSD的漏洞,我必须展开讲一下,因为这个例子太有意思了。
, Q5 a1 K( e" a: J- Q* k
* w# v6 n5 M0 S' bOpenBSD是个什么存在?) J! k' W4 _$ Z ~
( e/ R6 o$ l* ~' |9 F7 L2 q8 E4 c9 F0 J它是BSD操作系统的一个分支,最核心的设计哲学就是安全。代码审计之严格,在整个开源社区都是有名的。很多安全研究员的信仰级操作系统。+ d s- S! E' R& q4 l) y f
3 V8 h; F- Z8 Q* u9 n
这样的项目,代码审计了多少年了?二十多年。
5 S! D- `% h. @- f# M7 M; i, d/ Z
然后,一个漏洞,在里面躺了27年。
- M4 p! F) ^& U; g# e+ ?5 G3 E) V( ]) B
这说明什么?
M8 s5 [4 y/ P9 T+ C' `% [
9 b! ]2 v, ^* _ e不是OpenBSD的人不行,是传统的审计方式有盲区。任何人工审计,只要时间足够长、人足够累、代码足够复杂,就一定会有漏洞漏过去。这是人性的边界,不是能力的边界。+ A: ]8 s- C4 D7 n
- ~* W) Z% ^9 n) N但AI不一样。AI不会累。AI不会因为审了三个月之后注意力下降。AI可以在几个小时之内,把整个代码库的所有调用路径、所有边界条件全部穷举一遍。
/ q6 h8 t6 X. B2 ^+ P2 l8 I ?- m. K' n7 V0 a7 w* z0 I5 X
Mythos Preview发现的那个OpenBSD漏洞,是一个本地权限提升漏洞。攻击者如果已经拿到了一点点访问权限,可以利用这个漏洞进一步提升到root权限。
, B. [+ `3 e" u' s M: R) b8 [8 c7 A3 f* v
这种漏洞可怕在哪?
( m. c4 b! F3 L* g; b3 D9 `) r$ V5 |+ B
它不显眼。它不是那种"输入框里填个单引号就弹shell"的漏洞。它需要你对系统有相当深的理解,才能构造出触发条件。7 F- m; ]$ y/ Z& [
" G6 ~& }' l2 w6 H1 ]传统扫描工具扫不出来,是因为它的payload模式不在规则库里。AI不一样,AI学的是语义理解,它不是匹配特征,它是理解代码在"想什么"。
0 m2 J- c& F$ d0 e
# w. Z) \5 k7 _ {FFmpeg那个例子更让我震撼。5 Q/ C5 y5 \5 }, u* i5 }" r
) X7 C$ T5 S" D0 ^5 u/ `+ _4 k16年。
1 _5 v/ J, n; Q7 u! b4 E2 Q6 n' \% y, } W
FFmpeg上一次发现这种级别的漏洞是什么时候?2009年。
3 A' s) K9 B+ |* L
/ L* m) k( K8 C* g16年都没有人发现。然后Mythos Preview扫了一下,找到了。7 D5 f4 z/ Q, S( D
4 f/ z' @' t. c; _4 V2 {
注意这个"扫了一下"的背景。SWE-bench测试集里,有大量是真实世界里的bug修复历史。FFmpeg这个bug在历史上真实存在过,是某次修复的时候被记录下来的。这意味着,Mythos Preview不仅能做代码审计,它能做的是:从海量代码里,识别出"这个写法有问题,即使目前还没有人报告过"。+ ]8 t O0 ?$ Q. p- E/ @& {4 t: k8 N
& [+ B: n9 ^9 i
这是主动防御,不是被动响应。5 ~+ m: x6 ^$ |
3 ^1 ^1 _4 ]. j$ a: _5 l传统安全的方式是:出了事 → 分析样本 → 提取特征 → 更新规则库 → 下次能识别。. t; m- J+ U$ m. i6 `/ \
2 T% Q. K. e) Z( r' wAI安全的方式是:不需要样本。直接读代码,告诉你这里有个洞。
" J0 E2 m J& J& Y# N
2 _( f d, X7 J O' N% p+ D6 \这两者之间的差距,大概就是"等贼来了再装防盗门"和"在盖楼的时候看着图纸就告诉你这堵墙扛不住地震"的差距。4 ?! a$ F! j# `3 ]* u0 G& K
" ~, \4 j' p t4 Z. Z5 @
现在说说大家最关心的问题:谁能用到,怎么用,花多少钱。
3 v; ~) e1 j' g2 f% h# u8 ~0 Z8 q% u( ~6 M
Glasswing的AI能力,现在跑在三个平台上:Amazon Bedrock、Google Vertex AI、Microsoft Foundry。
$ p, M2 B7 e2 ~& U0 e Y7 J) S- e( k! ^* W5 E7 \
这三个平台,恰好是AWS、Google Cloud、Azure。全球三大云服务商。% a e- z8 ]3 @0 @. w, T$ A/ x
! p( R6 X+ ?3 ?& A( W$ X你在任何一个上面,都能调用Mythos Preview的漏洞检测能力。: n, {" z& \/ I
* C- b7 X6 K1 V' Z$ K3 f
价格呢?过了初始的credits之后,每百万token输入25美元,每百万token输出125美元。$ U. F) B% J' C7 h: a9 B( j! X/ b
$ G l& R! S, h) R. M$ |% c这个价格贵不贵?4 n: u7 S, Q- g& e9 o1 X
' _& b! H4 n9 `
对比一下就知道了。现在市面上做代码安全扫描的工具,像Snyk、Veracode这一类,商业扫描工具的报价大概是每个开发者每个月几十到几百美元不等。而且它们扫的是规则匹配,不是语义理解。5 Z6 w8 K, Y3 I* k
5 |' k! n- y; s7 W0 e
Mythos Preview能发现那些工具发现不了的漏洞。, }& ^* L) Z8 S3 o
7 d+ j& L% Z" ?. m1 D6 `& X; K
这不是贵不贵的问题了,这是"有没有意识到你以前省的那些钱其实在交更多的学费"的问题。 s" r8 W3 Y" m
, n0 C" m5 G& ]+ E: G+ s
另外,Anthropic自己掏了1个亿美元的使用额度,分给联盟成员和开源社区。还额外捐了400万,250万给Alpha-Omega/OpenSSF,150万给Apache软件基金会。
% X1 t$ I+ m+ I
) e0 k4 Z8 q: \2 s2 D这些钱是用来干什么的?让那些没有商业利益驱动的开源项目,也能用上最好的漏洞检测能力。" u- h& | a4 g& a+ w
4 N# P# M! h2 d' C8 ]+ t2 U3 M
FFmpeg就是开源的。OpenBSD也是开源的。这些项目没人给他们钱做安全审计,但他们的代码,运行在全球几十亿台设备上。$ b' {% _! i: {* K( B" @* h9 r B
2 g1 g6 A. a( t z4 a
还有一个细节,我觉得特别有意思。: K* H* ^7 ]" ?8 y y
+ O8 j) O: K' ?# w- w! Q
漏洞发现之后,公开披露的时间是90天。
. u/ Q9 i5 V# u# p- ~
- [! h, A3 v1 v( f3 }90天是什么概念?
( V* i; R4 _) c9 a" n
+ q" L. P! L" ]行业标准的漏洞披露窗口是90天。这个时间足够让厂商评估漏洞、制定修复方案、推送更新,但又不至于让漏洞在黑市上流通太久。
T( H' Q( s9 y1 T4 ?: o
1 K7 J$ v1 B* L& @, h; A, y1 e7 Y但这里有一个问题:90天是针对"有人发现了漏洞"这个前提来说的。+ V) x/ a8 i3 k; X% d2 t
5 {% K [: ]4 r- Z+ C' oMythos Preview现在能以前所未有的速度挖出漏洞。它一天挖出来的漏洞,可能比以前整个安全社区一个月挖的还多。
; Q( A6 V n* T3 o4 I' P6 L' o+ ]( w
这意味着,漏洞披露的节奏,整个就变了。
6 H) v& f9 ~; D \; q+ r9 j1 |, {' f2 [
以前是"挖到一个,披露一个"。现在是"AI在持续不断地挖,每90天披露一批"。( {6 P7 G) z+ ^+ G% z' w3 t
- F, S" ?* p* q5 p" t" m3 V
厂商的补丁开发速度,能不能跟上AI的发现速度?$ ~- i. x2 i; z1 h4 R: s
* Y' H8 s' n/ }/ @7 U" h这个,我说实话,不知道。但我觉得,这是整个Glasswing项目最值得观察的地方之一。1 G* v/ j7 X- d3 D, W
* r# `. G& {. _3 { J
写到这儿,我突然想到了一个更大的问题。
1 Z+ N& C: f0 V# a% e$ u+ p5 T7 ]1 W; @6 R) N/ m( A. i9 }
Glasswing这个名字,本身就是一只蝴蝶的名字。玻璃翼蝴蝶。它的翅膀是透明的,像玻璃一样。7 S& o9 o& A- Y/ h
' y1 D! T) E8 E, N1 z
透明,意味着隐藏的东西变可见了。' ]) M$ l+ A3 s& A* ]' N
8 F, W/ E* ~: Q5 e6 K! i2 {
一只蝴蝶的翅膀是透明的,它就隐藏不了任何东西了。它在哪里,飞向哪里,所有捕食者都看得清清楚楚。
, _& i; O: ?0 U- l* P
' ~: I; w5 n% W3 _8 {这个意象,放在漏洞挖掘上,太精准了。
* Y2 Y$ J4 J- d& `: ~3 ]" C6 Q6 [" }$ e1 i2 ~
代码里那些隐藏了几十年都没人发现的漏洞,在AI的"眼睛"之下,突然就透明了。6 e( p: G( R- ^2 _8 ^4 j: B" C
) D* N* x4 _: U0 i( Q+ l3 n3 {- |' @以前我们说"security through obscurity"——通过隐藏来保证安全。你的代码不公开,漏洞藏在暗处,攻击者找不到。
- `* t0 {+ R. [$ s$ n4 H% M
9 c9 w# x/ u {* V0 l$ k; h但现在,只要代码存在,AI就能读。Mythos Preview不需要你的代码是开源的,它只需要能接触到代码——不管是源码、还是编译后的二进制、还是运行时的行为轨迹。
4 ^. t( K4 w! ^2 n) n9 S
1 u/ Y$ y, I4 j2 t; n代码越来越难藏了。或者说,代码里的漏洞越来越难藏了。. ~6 v7 s4 u# D7 |
! m, V# [: N# U/ N6 M0 R! B# M
这是一件好事吗?
0 y3 _: X' ]! S3 |* k% H
9 v, O/ A5 _# }* M我觉得,短期内,这是一件非常非常好的事。
$ O# l$ b# L9 N
( ~6 ]3 ~0 S8 w全球互联网基础设施里,有多少代码是10年、20年、30年前写的?没人敢审计、没人敢动、出了问题就打补丁接着跑的,有多少?
# U! H- Z( x$ Q$ f: o9 N5 f4 u% ~- r/ |% z+ }
这些代码就像一颗颗定时炸弹,埋在整个数字世界的基础里。
5 E8 g" e5 f6 ^3 H1 R5 d* }- L
( z. F( U0 s* ]1 V# uAI能做的是,帮我们把这些炸弹找出来,一颗一颗地拆除。
* s6 g* z9 d) p$ U1 Y: M
! p3 t" o2 i6 S( Q* U& c$ _但长期呢?
8 q# N2 I' J8 L
/ i2 O! X! d6 m当所有可见的漏洞都被AI清除干净之后,剩下的,是什么样的世界?
4 R& L! T) ~1 I, j( d) N6 o: K8 |0 s( ]; l) `
是代码质量极高、安全性极强的一个世界?还是所有攻击者也在用同样的AI,攻击的速度和防守的速度同步提升的一个世界?
: y% b1 I' A, l+ C% D0 c1 Q H
) k+ o/ `1 A# p( J7 f0 R; d: r2 C我也不知道。# J0 z& l+ E) H" Q- E+ q
: d3 k, I2 g$ F' Y
但有一件事我特别想强调。% [6 F& C+ _) m, _ |
% L+ d# [/ B4 M! u% W4 K* z8 T; \这次Glasswing联盟里,有JPMorganChase,有CrowdStrike,有Palo Alto Networks。这些公司,是真正的安全重度用户。+ U+ d3 H6 ]& D* s
: {9 A. @ W* p1 w$ t
他们自己有能力挖漏洞吗?当然有。JPMorganChase的安全团队在全球排前列。CrowdStrike就是做安全的。
3 j( B* n, w$ b* I; \! h
9 U" n: S; m9 G/ O" Y* H9 a R他们为什么还要加入这个联盟,用别人的AI?5 I9 m- o; T3 }, ~
6 V4 c4 v5 g4 |0 Z, U) X+ b我大胆猜测一下:因为挖漏洞这件事,规模太大了。* [, Q& s( u/ H" l U
- S D5 T3 T% A( @0 T6 D
全球代码量太大了。每一家公司,即使安全团队再强,也只能覆盖自己的代码库。但外面的供应链、开源组件、合作伙伴的代码,你根本管不到。
5 n9 _( ]$ a. j7 L i4 `- Q( Z$ ~5 a" Z8 r) d, l
Mythos Preview的价值,不在于它比你的安全团队强。而在于它能同时扫所有地方。
! u' d4 t3 L" Q: B5 v' V6 v1 ]1 v! G+ X* E
这是规模效应。
3 r: i. E% q8 \& i
- O7 D% z: r0 e( m就像打补丁。手工打补丁,你只能打你知道的那些机器。自动化打补丁,你能打你所有的机器。AI扫漏洞,相当于在每一个代码提交的时候,就自动扫一遍。
6 |* Z. E R% h, N( N0 [" [6 g) M4 |# _2 q: L- s" U- k1 H7 ~
这个规模,是人类团队根本无法覆盖的。/ Y: r% ?* x9 `1 p: z5 j
: n) x4 I! D1 c, k
Glasswing这个项目,还有可能往一个方向发展——成为一个独立的第三方机构。
! n! b8 x( B: s+ ?! |5 q
% d: m8 J; E2 u' B什么意思?# \) s" Y" X v Y: K- ~1 H8 {
: @/ w0 V& N" M& ?# g. z7 C% W现在它还是Anthropic牵头、11家公司参与的联盟。但未来,它可能变成一个真正独立于任何商业公司的安全机构。它的评估结果,有公信力;它的漏洞报告,有权威性;它给出的安全评级,整个行业认。! g1 n- r% k" ~- S6 e9 b
0 _. N' T8 y$ a类似现在的ISO认证,但针对的是代码安全。
" v4 A+ @ ]/ V# o0 z( [
4 o6 P2 A0 ]. o想想这个画面。未来的软件采购,合同里可能不只要写"符合SOC2",还要写"通过Glasswing认证,漏洞数为0"。" S7 T/ \4 v8 t; D' T
' i) c/ i% G" q2 H2 Z
这不是不可能的。: F' Q l" ^- q! R7 J8 Y/ G* k4 `9 P
- K% x: W3 d0 ?% z
当然,路还很长。现在还只是第一步。但方向是对的。9 B& S8 o# X4 V
0 D: g: t5 e" Z9 [) t好了,写了这么多,让我最后说几句掏心窝的话。( m4 {' h1 b1 _3 |4 @% K
& ^1 t2 U4 J2 L* H
我这次看到Glasswing的新闻,第一个反应是兴奋,第二个反应是有点怕。
5 ~3 B& z' N4 J; l* _" }) m, n$ g+ {3 ^4 f: p% o9 Y
兴奋是因为,我真的觉得,这是AI在安全领域做的最有价值的一件事。以前我们聊AI安全,大家想的都是"AI能不能被攻击"——对抗样本、数据投毒、模型劫持。这些很重要,但离普通开发者很远。
) A. q! z9 _: W: m7 w
! H+ G+ T9 @/ p8 g" L! n4 F5 f7 x这次不一样。这次是AI在帮我们发现自己的脆弱点。
0 v9 K. G, v/ x* x$ V! @/ w8 x0 w& ~( f- b2 e, H
这种脆弱点,我们以前不知道,或者知道但没有能力发现。AI把它们挖出来,摆在阳光下,告诉你这里需要修。
! l! ?8 y" v8 j0 c& F* A: v5 x/ F5 _& q. j3 ]% x
这是AI在补人类的短板。不是在超越人类,是在帮助人类补上人类自己够不到的地方。+ a+ E: E% o3 d; S
6 q4 O. x; ^" q' p5 L* t9 n2 f
我怕的是什么呢?+ E; t" s- L0 A4 w
7 q9 w9 A8 K w. _我怕的是,这个工具,只有大公司用得起。
7 g: w: [$ m) D! Z
* j4 Z( m6 G6 W: p7 Y& NAWS、Google、Microsoft,Bedrock、Vertex AI、Foundry。这些平台,都是商业平台。Cloudflare这种中型公司,可能用起来没问题。但那些真正需要安全检测的——初创公司、开源项目、十几人的小团队——他们能用到吗?
/ F5 o# d* ~' c' k% Q. j! {5 x
* a9 h. }$ k, j5 s9 A5 rAnthropic捐的那1亿美元额度够用多久?分到全世界的开源项目上,每个项目能分到多少?
8 T, L6 ~! ^ Z" J: x7 f$ x# V" {7 V' P1 t3 z
这些问题,现在还没有答案。
' y: Y3 a' h6 a: N* B2 t" s" _
1 e3 X+ y, Y N, A0 c3 d但有一点我特别想强调。
. |. P2 \1 F6 z, R; K a5 ^$ C; [2 G2 z
Glasswing这个项目,让安全这件事,第一次真正有了一种"基础设施"的可能性。
. U9 P, q6 \% t) R
0 h* c7 v4 T6 b+ b# a: Y% K以前的安全,是奢侈品。你要么雇得起安全团队,要么买得起企业级扫描工具,要么你就裸奔。# P" d: o% J* E: u
, B# G) d% `1 t3 o7 gAI改变了这个等式。Mythos Preview能发现那些企业级工具发现不了的漏洞,但它的调用成本,并没有比那些工具贵多少。
4 x* c0 Q( \; d/ ]2 R. H k
! c3 O" a5 N6 x当漏洞挖掘的成本持续下降,当AI扫描变成每一个代码仓库的标配,我们或许真的会迎来一个更安全的互联网。4 p0 ]& M6 Y! K" x- S+ K4 y" K/ m
1 n) O9 \. }) n这一天什么时候来?我不知道。可能5年,可能10年。
$ h- |1 x- p0 m: M+ ~3 z' `; `; R! U- r( O- \
但Glasswing,让我第一次觉得,这件事不是痴人说梦了。
+ Z9 c1 ~" O4 U" E |
评分
-
查看全部评分
|