大模型
模型训练
AI Agent
AIGC
多模态
AI安全
AI安全
大模型的安全水印:怎么在生成内容中嵌入不可见标记,追踪来源
2026年8月20日
AI安全
模型窃取(Model Extraction):通过 API 查询,复制一个闭源模型——能做到吗
2026年8月20日
AI安全
对抗样本(Adversarial Examples):加一点人眼看不见的噪点,AI 就把熊猫认成长臂猿
2026年8月20日
AI安全
社会偏见在 AI 中的表现:性别、种族、职业——为什么 AI 会歧视
2026年8月18日
AI安全
红队测试(Red Teaming):怎么系统地攻击大模型,找出安全漏洞
2026年8月16日
AI安全
多模态越狱:把有害指令藏在图片里,模型看到了不该看的东西
2026年8月16日
AI安全
著名的越狱攻击案例:DAN、Grandma Exploit、用 Base64 编码你的请求
2026年8月16日
AI安全
对抗性提示词(Adversarial Prompts)怎么让模型输出有危害的内容
2026年8月16日
AI安全
越狱(Jailbreaking)的技术原理:为什么精心设计的话术能绕过安全限制
2026年8月16日
AI安全
过度对齐(Over-Alignment):AI 太听话了,什么问题都拒绝回答——怎么平衡
2026年8月15日
AI安全
6 / 7
上一页
2
3
4
5
6
7
下一页