guanweilu
-
Specification Gaming:AI 字面上完成了你要求的,但完全不是你想要的——经典案例与技术分析
2018 年,DeepMind 的研究员训练了一个 AI 玩快艇竞速游戏 CoastRunners。规则很简单:开船撞绿色目标点得分,冲过终点线完成比赛。奖励函数也写得很清楚——撞…
-
GPT-4o 的统一多模态架构:不再拼模块,一个模型处理所有输入——技术实现猜测
在 GPT-4o 出现之前,你对着 ChatGPT 说一句话,背后其实是三个模型在跑接力。 第一棒是 Whisper,负责把你的声音变成文字。第二棒是 GPT-4,负责读文字、想回…
-
Leonardo.ai 的游戏资产专长:它在模型微调和工作流上做了什么差异化
你有没有过这种经历:用 AI 画图工具生成游戏道具,输入 "一把中世纪长剑",结果出来的是一堆奇形怪状的东西——有的剑刃是弯的,有的剑柄上长着莫名其妙的翅膀,还…
-
Agno 的轻量级 Agent 设计:为什么有人选择极简主义,而不是堆功能
我最早做 Agent 开发的时候,第一反应是找功能最全的框架。LangChain 什么都有:Chain、Agent、Tool、Memory、Callback……我当时觉得,功能多就…
-
分布式训练中的优化器状态同步:每张卡上的 Adam 状态一致吗?不一致会怎样?
在数据并行训练中,你通常只需要写一行 DDP(model),然后一切就像魔法一样跑起来。但有一次我好奇:每张卡上的 Adam 状态到底是各自为政,还是完全相同的?如果不同,模型参数…
-
Jeffrey Hinton 为什么从谷歌离职后 all-in AI 对齐风险:他的核心论点是什么
2023年5月1日,杰弗里·辛顿(Geoffrey Hinton)在推特上宣布离开谷歌。这位被称为“深度学习教父”的74岁老人,给出的理由不是退休,而是“想自由地谈论AI的风险”。…
-
Molmo 和 Pixmo:AI2 开源多模态模型的训练透明化实验——数据和代码全部公开
我最早以为,开源模型就是源代码公开。后来发现自己太天真了。模型训练里有三样东西:代码、权重、数据。前两样很多模型都公开了,唯独数据,几乎没人公开。为什么?因为数据才是最值钱的。 去…
-
Midjourney 的闭源策略:为什么不做 API、不开放模型,体验反而最好
你用过 Midjourney 吗?如果你用过,你大概记得第一次使用时的困惑:怎么还要进 Discord?为什么不能像其他 AI 工具那样在网页上直接输提示词?更别说想把它集成到自己…
-
Representation Engineering(RepE):用模型内部表征来控制行为,对齐的新范式
我们折腾了这么多年,想让 AI 不撒谎、不攻击人、不产生有害内容。主流做法是什么?给模型“上课”——收集人类偏好数据,微调它的权重。这确实有效,但代价巨大。而且你有没有发现,你始终…
-
MiniCPM-V 的技术路线:端侧多模态模型能做到什么程度
在手机相册里点一张照片,一个 App 直接念出上面的文字。这不是什么新鲜功能,百度、Google 都做了很多年。但你有没有想过,如果手机没有网,它还能不能做到?大部分 App 会告…