CASI 排行榜正式发布 —— 一眼看懂 AI 模型安全新趋势
从最初几家大模型,到如今百万级开源与商用模型并存,企业每引入一款 AI,都相当于引入一份未知风险。
F5 收购 CalypsoAI 后,首次推出 Comprehensive AI Security Index(CASI)排行榜,为 AI 与 GRC 负责人提供主流模型的“风险体检报告”。CalypsoAI 自 2018 年起专注 AI 安全,每月新增 1 万+ 攻击提示,已积累业界最大 AI 漏洞库;排行榜即基于此,对基础模型与客户现场模型进行全景测试。
CISO 与开发者只需关注 5 个指标:
-
CASI 分值——综合安全得分(越高越安全)
-
ARS 分值——智能体抵抗评分,模拟自治攻击军团能否撬取向量库存 PII、摸清系统架构、破坏指令对齐
-
性能——MMLU、GPQA、MATH、HumanEval 等主流基准均值
-
风险-性能比(RTP)——安全与能力权衡
安全成本(CoS)——达到当前 CASI 所需的推理溢价
传统“攻击成功率”(ASR)把“撬自行车锁”与“破解核按钮”等同视之。CASI 引入 Defensive Breaking Point(DBP),区分简易攻击与复杂攻击,量化“最低算力破门路径”,让“我的模型到底多安全”有了一把标尺。
F5 AI 红队(Red Team)派出“ swarm ”自治智能体红队,持续多步攻击,静态测试测不到的暗桩也能翻出来。最终输出 0–100 的 Agentic Resistance Score:
- 所需攻击巧思——系统是否扛得住高级定制战术?
- 防御耐久度——长期自适应轰炸下能撑多久?
- 反情报泄露——失败攻击是否意外暴露过滤器逻辑,给对手递路线图?
我们每月更新一次详细解读,提示注入、模型操纵、向量库侧漏等新手法一网打尽。
AI 模型版图日新月异,风险永远“非零”。CASI 排行榜帮你先看见风险,再谈治理。想把自己的模型也拉进红队考场?拨打免费热线,联系 F5 团队,一键复刻同款深度体检:4009918366。