guanweilu
-
自适应越狱(Adaptive Jailbreak):根据模型返回实时调整攻击策略
你面前站着一个严守纪律的保安,他的任务是:任何试图获取机密信息的人,一律拒绝。你手里只有一张纸条,上面是一句精心设计的话。你递过去,他看了一眼,摇头:不行。纸条作废。 但如果你的口…
-
多模态 VQA 的评估:CIDEr、BLEU、ROUGE——哪种指标最接近人类判断
假设你手里有两个 VQA 模型,在测试集上跑完之后,你把它们生成的答案拿给三个人看,他们一致认为模型 A 的答案质量更高。现在换成自动指标打分:BLEU 说 B 胜出,ROUGE …
-
AI 虚拟试妆:实时在脸上叠加妆容效果,怎么处理面部遮挡和光照变化
第一次用虚拟试妆 App 时,我干了件很蠢的事:打开前置摄像头,对着客厅的暖光灯,涂了一支“正红色”口红——屏幕上显示的是胡萝卜色。我以为是算法出了问题,后来才意识到,是我家的灯让…
-
Agent 沙盒的网络隔离:不是禁止联网,是精细控制能访问哪些域名和端口
你的 Agent 正在沙盒里运行。它能写代码、能跑命令、能调用外部 API——这些能力看起来很正常,直到你发现一个问题:它发出的每一个网络请求,都是它自己决定要发的。一个公网上的 …
-
Mish 激活函数:平滑非单调的设计,为什么没在 LLM 训练中流行起来?
我第一次看到 Mish 激活函数的公式时,第一反应是:这个东西比 ReLU 优雅太多了。一个光滑、非单调、带一点负值的曲线,既避免了死神经元,还自带“自正则化”的说法。当时我正好在…
-
Attention 的 IO 感知算法:理解 GPU 内存层次是加速的关键
有一个事实,我第一次读到的时候觉得是在开玩笑:FlashAttention 在数学上跟标准 Attention 完全等价,不算近似,FLOPs 一分没省——反向传播时甚至多算了一些…
-
Agent 的会话恢复设计:用户关掉窗口三天后回来,Agent 怎么接上
你有没有过这种经历:用Agent写方案,写到一半要开会,你关掉窗口就走。三天后你再打开,Agent礼貌地打招呼:“你好,请问需要我做什么?” 你盯着屏幕,心想:“我们不是已经在做那…
-
AI 图像去遮挡:被挡住的物体怎么恢复——和 Inpainting 的区别在哪里
你站在广场上,举起手机拍雕像,一个游客闯入镜头,把雕像下半身挡得严严实实。事后你圈掉游客,用“AI 修复”抹除——它确实补上了,但雕像底座变成一团灰,裙摆上长出了第二根腿。这不是运…
-
DropPath 和 DropConnect:Dropout 的两种变体,在 Vision Transformer 中效果显著
我最早以为 DropPath 就是 Dropout 的换皮版本——反正都是随机丢掉一些东西,让模型别过拟合。直到我在 Vision Transformer 的训练代码里看到 dro…
-
Attention 可视化的局限性:注意力权重不等于特征重要性——为什么不能直接看 Attention Map
我最早也干过这件事:跑一个文本分类模型,在测试集上画出一张漂亮的 Attention heatmap,看到 "not" 和 "but" 这两…