大模型
模型训练
AI Agent
AIGC
多模态
AI安全
模型训练
Schedule-Free AdamW:把 warmup 和 cosine schedule 都省掉,效果反而更稳
2026年8月24日
模型训练
LoRA 的 rank 怎么选?rank 小了效果差,rank 大了跟全参微调有什么区别
2026年8月21日
模型训练
LoRA(低秩适配):为什么只改几百个参数就能微调整个大模型?
2026年8月21日
模型训练
INT8、INT4、NF4:不同的量化方案,在线性度和精度之间怎么取舍
2026年8月20日
模型训练
量化(Quantization):把模型从 16 位压到 4 位,精度损失多少?
2026年8月20日
模型训练
DeepSeek 的蒸馏实践:为什么他们的蒸馏模型效果这么好?
2026年8月20日
模型训练
奖励模型(Reward Model):RLHF 里最容易被忽略但其实最关键的一环
2026年8月18日
模型训练
RLHF(人类反馈强化学习):让模型学会看人眼色的那一步,完整流程拆解
2026年8月18日
模型训练
指令数据从哪来?Self-Instruct 和 Evol-Instruct 怎么让 AI 教 AI
2026年8月18日
模型训练
3D 并行:数据并行 + 张量并行 + 流水线并行——大模型训练的真正工程挑战
2026年8月17日
模型训练
5 / 6
上一页
1
2
3
4
5
6
下一页