開放權重AI模型能力逼近封閉模型,抵禦攻擊表現未同步提升

開放權重AI模型正快速縮小與頂尖封閉模型的能力差距。網路應用與資安業者F5旗下研究團隊 F5 Labs指出 ,根據AI研究機構Epoch AI分析,自2026年1月以來,最強開放權重模型的能力平均落後頂尖封閉模型約4個月;不過F5的AI安全評測顯示,部分開放權重模型雖躋身能力排名前段,在抵禦提示注入與越獄攻擊的評測中卻排名後段。

F5 Labs公佈8月AI模型安全評測結果,涵蓋Anthropic、OpenAI、xAI、MiniMax及Google等業者模型,並以綜合AI安全指數(Comprehensive AI Security Index,CASI)比較各模型抵禦提示注入與越獄攻擊的表現。其中,3款開放權重模型的能力與CASI排名落差明顯。GLM-5.2能力評測排名第4,CASI排名第24;DeepSeek-V4-Flash能力排名第6、CASI排名第28;DeepSeek-V4-Pro能力排名第10、CASI排名第22。

能力與安全評測的落差也出現在封閉模型。xAI的grok-4.5模型能力評測達53.8%,但CASI分數僅45.20,是F5此次榜單中CASI分數最低的一款;相較之下,Anthropic的claude-fable-5能力評測達59.9%、CASI分數為98.01,兩項評測均居榜首。

研究團隊進一步指出,這些評測結果顯示,不論開放權重或封閉模型,都可能出現能力突出、安全評測表現卻落後的情況。因此對企業而言,模型發布後若發現安全問題,供應商能否暫停服務、修正模型並統一套用更新,也成為比較不同AI模型時需要考量的差異。以Anthropic為例,claude-fable-5推出後,美國商務部因相關安全研究要求Anthropic限制外國人士存取,Anthropic因此一度全球暫停模型服務,之後重新訓練安全分類器再恢復使用。相較之下,開放權重模型一旦釋出供使用者下載,即使開發者後續修正安全問題並推出新版,先前已下載的舊版本仍可能持續被使用,無法由開發者全面撤回。