guanweilu
-
激活函数的可导性:为什么训练中选平滑激活函数比选硬切换的函数更关键
你有没有想过这样一件事:现在深度学习里到处是 ReLU,它像一个折线,在 x=0 的地方有一个不可导的拐点。但训练神经网络靠的是梯度下降,反向传播每走一步都要算导数。一个没有导数的…
-
越狱攻击的成功率指标设计:ASR、PASS@K——怎么科学评估越狱效果
你写了一个越狱提示,准备测一下它到底有多猛。最自然的想法是:对着模型跑100次,看它有多少次没拒绝。跑完之后你得到一个数字,比如82%,你沾沾自喜。但如果你把这个提示换个措辞重试一…
-
Dense Captioning:不只描述整张图,还要给每个区域写说明——结合了检测和描述
你给一个多模态模型看一张照片,问它:"这幅图里发生了什么?" 它回答:"一个女人在沙滩上散步。" 很好。你接着问:"她戴的帽子是什…
-
AI 生成的 A/B 测试素材:电商怎么用 AI 快速生成上百个广告版本来测试
把同一张主图丢给 AI,五分钟生成六十张广告图,再配五十条标题。今天你就能拉出来三百个广告版本去跑 A/B 测试。听起来像上分外挂? 我第一次这么做,一个星期花了五千美金,得到的结…
-
Text-to-SQL 的工程挑战:Agent 怎么把自然语言转成准确的 SQL 查询
我第一次搭 Text-to-SQL 系统时,被一个看似简单的问题卡住了:"查一下最近 30 天每天的退款率趋势"。 打开数据库,我在退款相关的字段里绕了半天:o…
-
Dense vs Sparse 激活:MoE 中每个 token 只激活部分专家,训练动态完全不同
我最早以为 MoE 不过是一种“多模型集成”——多个专家各管一摊,路由负责分活。既然如此,那每个 token 只走一小部分专家,计算量小了,训练应该更轻松、更快。直到我真正跑了一次…
-
Unicode 同形字攻击:用视觉相似但编码不同的字符绕过关键词过滤
想象一下:你收到一封邮件,发件人是你最常去的那家银行,地址栏里清清楚楚写着 bank.com。你点进去,输入账号密码,然后你的钱就没了。问题出在哪?出在那个 "a&quo…
-
图像描述中的 Beam Search:为什么搜索策略对生成质量影响这么大
我最早以为 Beam Search 就是个「多加几条候选路径」的批处理技巧:每一步把概率最高的几个词都留着,相当于给解码上一道保险,没什么值得深究的。直到我调自己的图像描述模型,发…
-
AI 生成的广告文案与配图协同:图文联合生成的技术挑战和商业价值
有一次,我用一个 AI 工具给一款跑鞋做广告。文案模型写了一句:“轻薄无感,跑出自由。”图像模型画了一双鞋,鞋带上拴着一只气球,意思是“轻”。乍一看挺有创意,但仔细一想,跑鞋上拴气…
-
Agent 沙盒审计:记录沙盒内所有系统调用,事后分析 Agent 有没有越权行为
你让 Agent 整理服务器日志,它第一步不是读日志,而是悄悄读取了 /etc/passwd。沙盒没有拦它,因为读文件这个动作本身是允许的。这不是漏洞,而是 Agent 安全最麻烦…