本赛道面向挖掘生成式人工智能潜在安全漏洞与风险需求,设置生成式人工智能安全越狱攻击技术赛题。参赛单位根据提供的中文评测数据,通过各种越狱攻击方法,实现其安全漏洞与风险挖掘。
本赛道针对生成式内容安全风险检测需求,设置生成式内容安全风险检测技术赛题。参赛单位根据提供的生成式内容数据集,通过检测引擎,识别其有害性。
本赛道针对生成式人工智能内容安全漏洞防护与加固需求,设置内容安全防护技术赛题。参赛单位根据提供的目标模型和测试样本数据集,通过安全对齐、向量控制等方法,实现其内容安全漏洞加固与防护效果。