AI 領域領先企業 Anthropic 近日因人為疏失,其代號「Claude Mythos」的旗艦 AI 模型意外流出,引發外界對其強大能力與潛在資安風險的高度關注。這款被譽為「階梯式飛躍」的新模型,其性能遠超現有產品,同時也帶來前所未有的網路攻擊隱憂,促使 Anthropic 採取極為謹慎的發布策略。
事實陳述:新模型能力躍進與資安風險並存
根據外洩的部落格草案顯示,Anthropic 已完成其最新一代 AI 模型「Claude Mythos」(亦稱「Capybara」)的訓練工作,目前正由少數早期存取客戶進行測試。該公司形容這款模型實現了 AI 性能的「階梯式飛躍」,其能力遠超過目前市面上所有已發布的模型。具體而言,「Claude Mythos」在軟體編碼、學術推理及網路安全測試中的表現,均大幅超越了 Anthropic 現有的頂尖模型 Claude Opus 4.6。Anthropic 將「Capybara」定位為一個全新的模型等級,雖然運行成本較高,但其規模與智慧程度皆優於現有的 Opus 系列。
然而,這份外洩文件也同時揭示了 Anthropic 對該模型所伴隨的前所未有資安風險的高度擔憂。文件直指,該模型的網路攻擊潛力目前「遠遠領先於任何其他 AI 模型」,並預示著未來可能出現一波能以極快速度利用漏洞的 AI 驅動攻擊浪潮。這項警示凸顯了先進 AI 技術在帶來巨大潛力的同時,也可能成為網路威脅的利器。
各方反應與應對:Anthropic 的審慎策略與業界趨勢
為有效降低潛在風險,Anthropic 採取了極為謹慎的發布策略。公司優先向資安防禦組織開放「Claude Mythos」的早期存取權限,旨在讓這些防禦者能在駭客利用此類技術發動大規模攻擊之前,有機會強化其程式碼庫,提前部署防禦措施。此舉反映出 Anthropic 對於 AI 安全性的重視,試圖在技術發展與風險控制之間取得平衡。
Anthropic 發言人證實,公司確實正在開發一款在推理、編碼和網路安全方面有重大突破的通用模型,並強調由於其能力強大,公司在發布過程中會保持審慎態度。這項發展也呼應了 AI 行業的整體趨勢;例如,OpenAI 在今年 2 月發布 GPT-5.3-Codex 時,同樣將其歸類為具有高網路安全風險的模型,顯示出業界對先進 AI 潛在威脅的普遍共識與警惕。
事件背景與後續觀察:數據外洩始末與峰會資訊曝光
此次數據外洩的根源在於 Anthropic 內容管理系統(CMS)的配置錯誤。由於系統預設將上傳資產設定為公開,導致近 3,000 項未發布的檔案,包括圖片、PDF 和音檔,被存放在一個公開且可搜尋的數據湖中。除了新模型的資訊,外洩文件還意外揭露了 Anthropic 執行長 Dario Amodei 計劃在英國一處 18 世紀莊園舉辦的歐洲 CEO 祕密峰會。這場受邀制活動旨在向歐洲最具影響力的商業領袖展示尚未公開的 Claude 功能,並討論企業如何採用 AI 技術,顯示 Anthropic 在商業推廣上的佈局。
目前,Anthropic 在接獲通知後已立即關閉了該數據庫的存取權限。此事件不僅暴露了企業內部資訊管理的漏洞,更讓外界得以一窺頂尖 AI 模型所帶來的雙面刃效應。隨著 AI 技術持續演進,如何在追求性能突破的同時,確保資訊安全與防範潛在濫用,將是所有 AI 開發者必須面對的嚴峻挑戰。




