实战解读：Llama Guard 3 & Prompt Guard

腾讯安全应急响应中心

于 2024-07-24 21:51:00 发布

阅读量4k

点赞数 14

CC 4.0 BY-SA版权

文章标签： llama prompt 网络安全

本文链接：https://blog.csdn.net/Tencent_SRC/article/details/140678489

前序研究：实战解读：Llama 3 安全性对抗分析

近日，腾讯朱雀实验室又针对 Llama 3.1 安全性做了进一步解读。

2024年7月23日晚，随着Llama3.1的发布，Meta正式提出了“Llama系统”的概念，通过系统级的安全组件对AI系统进行更好的控制。值得关注的是，去年12月成立的“Purple LLama”项目又新增三大安全组件：Llama Guard 3 、 Prompt Guard、CYBERSECEVAL 3，旨在“保护生成式人工智能时代开放信任和安全”。

Llama Guard 3‍

Llama Guard 3 是 Llama Guard 2 的升级版本，用于协助开发人员检测各种常见类型的违规内容。它通过微调 Meta-Llama 3.1-8B 模型构建的方式进行优化，可以执行 MLCommons 标准危害分类法的检测。Llama Guard 3 共支持8种语言，相比 Llama Guard 2新增了意大利语、法语等7种语言，同时，

最低0.47元/天解锁文章