跳到正文
熱點事件持續更新

Anthropic評估GLM-5.3網路攻擊能力

2 篇報導2 個報導來源18 小時前更新

先了解這件事

AI 綜述

2026年9月30日,Anthropic釋出的評估結果顯示,智譜開源的GLM-5.3模型在漏洞利用和網路攻擊能力上幾乎趕上了Claude Mythos Preview。

  • 測試表明,GLM-5.3在ExploitBench和內部二進位制測試中表現接近,且由於其開源權重,安全防護極易通過技術手段被剝離。
  • 美國機構CAISI的獨立評估也指出,GLM-5.3是迄今為止網路能力最強的開源模型。
  • 同日,Simon Willison引用Anthropic前沿紅隊研究指出,在100項二進位制漏洞利用任務測試中,Claude Mythos Preview和GLM-5.3分別在6%和4%的試驗中實現了完全的控制流劫持,而早期模型如Claude Opus 4.6和GLM-5.2在此類任務中均未成功,表明前沿模型在高階網路能力上跨越了新門檻。

AI 根據報導生成 · 3 小時前更新

報導時間線

沿著報導,瞭解事件的不同面向。

9月30日
  1. The Decoder
    Anthropic 稱智譜開源 GLM-5.3 漏洞利用能力接近 Claude Mythos Preview

    Anthropic 評估顯示智譜的開源模型 GLM-5.3 在漏洞利用和網路攻擊能力上幾乎趕上了 Claude Mythos Preview。測試表明,GLM-5.3 在 ExploitBench 和內部二進位制測試中表現接近,且由於其開源權重,安全防護極易通過技術手段被剝離。美國機構 CAISI 的獨立評估也指出 GLM-5.3 是迄今為止網路能力最強的開源模型。

  2. Simon Willison
    Simon Willison 引用 Anthropic 前沿紅隊研究

    Simon Willison 引用 Anthropic 前沿紅隊研究指出,在 100 項二進位制漏洞利用任務測試中,Claude Mythos Preview 和 GLM-5.3 分別在 6% 和 4% 的試驗中實現了完全的控制流劫持。早期模型如 Claude Opus 4.6 和 GLM-5.2 在此類任務中均未成功,表明前沿模型在高階網路能力上跨越了新門檻。

本事件熱度趨勢

當前熱度 10·可比範圍峰值 11(10月1日 10:00)·近 24 小時可比範圍變化 –

05101510月1日10:0010月1日11:0010月1日11:0010月1日12:00

趨勢僅比較持續完整觀測到的相同主體,範圍可能小於當前熱度統計。移動指標或點選圖表檢視每小時熱度;鍵盤可用左右方向鍵切換。