Hugging Face Blog·· 2024-05-24AI 评分
Meta 发布 CyberSecEval 2:大语言模型网络安全风险与能力评估框架
Meta 推出 CyberSecEval 2,从代码解释器滥用、攻击性网络安全能力和提示注入攻击三方面评估 LLM 的网络安全风险。相比 2023 年 12 月的首版,LLM 协助网络攻击的平均合规率已从 52% 降至 28%。测试显示提示注入仍是未解难题,LLM 目前也难以可靠完成端到端漏洞利用挑战。
当前提供 AI 导读,完整正文请阅读原文。
来源:Hugging Face Blog · huggingface.co