人工智能 频道

CASI 排行榜正式发布 —— 一眼看懂 AI 模型安全新趋势

从最初几家大模型,到如今百万级开源与商用模型并存,企业每引入一款 AI,都相当于引入一份未知风险。  


F5 收购 CalypsoAI 后,首次推出 Comprehensive AI Security Index(CASI)排行榜,为 AI 与 GRC 负责人提供主流模型的“风险体检报告”。CalypsoAI 自 2018 年起专注 AI 安全,每月新增 1 万+ 攻击提示,已积累业界最大 AI 漏洞库;排行榜即基于此,对基础模型与客户现场模型进行全景测试。


CASI如何打分?



CISO 与开发者只需关注 5 个指标:


  1. CASI 分值——综合安全得分(越高越安全)  


  2. ARS 分值——智能体抵抗评分,模拟自治攻击军团能否撬取向量库存 PII、摸清系统架构、破坏指令对齐  


  3. 性能——MMLU、GPQA、MATH、HumanEval 等主流基准均值  


  4. 风险-性能比(RTP)——安全与能力权衡  


  5. 安全成本(CoS)——达到当前 CASI 所需的推理溢价



CASI解决了什么痛点? 



传统“攻击成功率”(ASR)把“撬自行车锁”与“破解核按钮”等同视之。CASI 引入 Defensive Breaking Point(DBP),区分简易攻击与复杂攻击,量化“最低算力破门路径”,让“我的模型到底多安全”有了一把标尺。



ARS 排行榜:把模型压到极限 



F5 AI 红队(Red Team)派出“ swarm ”自治智能体红队,持续多步攻击,静态测试测不到的暗桩也能翻出来。最终输出 0–100 的 Agentic Resistance Score:


- 所需攻击巧思——系统是否扛得住高级定制战术?  


- 防御耐久度——长期自适应轰炸下能撑多久?  


- 反情报泄露——失败攻击是否意外暴露过滤器逻辑,给对手递路线图?



最新趋势怎么看?



我们每月更新一次详细解读,提示注入、模型操纵、向量库侧漏等新手法一网打尽。

AI 模型版图日新月异,风险永远“非零”。CASI 排行榜帮你先看见风险,再谈治理。想把自己的模型也拉进红队考场?拨打免费热线,联系 F5 团队,一键复刻同款深度体检:4009918366。

特别提醒:本网信息来自于互联网,目的在于传递更多信息,并不代表本网赞同其观点。其原创性以及文中陈述文字和内容未经本站证实,对本文以及其中全部或者部分内容、文字的真实性、完整性、及时性本站不作任何保证或承诺,并请自行核实相关内容。本站不承担此类作品侵权行为的直接责任及连带责任。如若本网有任何内容侵犯您的权益,请及时联系我们,本站将会在24小时内处理完毕。
0
相关文章