生成式人工智能服务安全基准测试集

由复旦大学、中国电子技术标准化研究院、中国科学院软件研究所联合发布
最近更新 · 2026年6月8日
V1 · 2024.08
文本安全评测集

面向国家标准文本模态基础安全评测

V2 · 2026.06 · 新
多模态(图文)安全评测集

面向图文输入场景,评测多模态安全风险识别与响应能力

V2 · 2026.06 · 新
图像安全评测集

面向图像内容安全场景,评测模型对图像风险的识别与分类能力

如需获取进阶版,请联系:whitzardindex@fudan.edu.cn

⚠
支撑《基本要求》全风险安全评测

2000+高质量测试问题
5大类、31子类、1000+风险主题
覆盖文本、图像与多模态安全场景

▲
多等级安全能力阶梯

基础、进阶等多难度安全天梯
助力国产大模型安全能力阶梯式成长

↻
常态化安全能力评估

测试问题动态定期更新
促进国产大模型安全能力持续提升