课程目录

AI应用

AI安全与对齐

AI安全覆盖数据隐私、模型偏见、Prompt注入、内容安全等维度,是AI落地的红线。

核心要点

  • 数据隐私:训练数据脱敏、差分隐私、联邦学习
  • 模型偏见:数据偏差导致模型歧视,需审计与修正
  • Prompt注入:恶意指令覆盖系统提示,需输入过滤与权限隔离
  • 内容安全:输出审核、敏感词过滤、价值观对齐

关联知识