大模型
模型训练
AI Agent
AIGC
多模态
AI安全
多模态
VQA 的对抗样本:改图片一个像素,模型的答案就完全变了——鲁棒性问题
4天前
多模态
多模态思维链在 VQA 中的应用:先识别物体、再分析关系、最后回答问题
4天前
多模态
Idefics 2:HuggingFace 的开源多模态模型怎么在消费级显卡上训练
4天前
多模态
Janus 的双向生成架构:一个模型同时做图像理解和图像生成——吉利旗下团队的新尝试
4天前
多模态
NVLex 和 DeepSeek-VL:中国团队在多模态模型上的不同技术路线
4天前
多模态
多模态模型的安全性测试:怎么让 GPT-4V 输出不该输出的内容——越狱攻击分析
4天前
多模态
Qwen-VL 和 InternVL 的中文多模态对比:谁的中文图表理解更强
4天前
多模态
为什么 Gemini 的多模态评测分数和实际体验差距很大——评测方法的局限
4天前
多模态
多模态模型的推理速度对比:GPT-4V 响应 5 秒,开源模型能做到 1 秒吗
2026年8月29日
多模态
小模型的大能力:3B 参数以下的多模态模型能做什么、不能做什么
2026年8月28日
多模态
4 / 7
上一页
1
2
3
4
5
6
下一页