不同檔位 AI 模型安全梯度與防護盾牌的示意插圖

為什麼更強的模型,往往也更「守規矩」?

Anthropic 關於 Sonnet 5 的安全說明提示一個有用的分拆:中端模型在日常智能體場景可以更安全,但高風險網安技能與旗艦仍有巨大差距。