指尖魔法屋
☰
文章
分类
标签
时间轴
关于
联系
🔍
对抗攻击
AI安全
内容过滤
对抗攻击
可控生成
从偏见走到可控:AI伦理与安全笔记
医疗问答内测全绿,真实用户用绕过 prompt 把模型带偏,产品经理当场脸绿。
醉月思
📁
技术实践
📅
2024-01-13
机器学习
模型鲁棒性
对抗攻击
安全
关于AI模型鲁棒性的几点记录
「模型在测试集上 92%,上线应该稳了吧?
醉月思
📁
技术实践
📅
2023-06-26
机器学习
对抗攻击
模型安全
AI鲁棒性:噪声与对抗防御笔记
AI鲁棒性:先看卡点
醉月思
📁
技术实践
📅
2022-03-04