大模型
模型训练
AI Agent
AIGC
多模态
AI安全
多模态
ARC-AGI 基准测试:为什么对人类来说简单的题,对 AI 却很难
2026年8月21日
多模态
为什么说AGI 快到了和AGI 还很远都可能是对的
2026年8月21日
多模态
当前的大模型离 AGI 还差什么?推理能力、世界模型、持续学习——三大缺口
2026年8月21日
多模态
多模态的 Tokenizer:文字有 BPE,图片有 ViT Patch,视频有 3D Patch——统一困难
2026年8月20日
多模态
多模态 RAG:不只检索文字,还能检索图片和视频——技术方案
2026年8月20日
多模态
多模态的模态对齐:不同模态的特征空间对齐,为什么是核心难题
2026年8月20日
多模态
视觉 Transformer(ViT):把图片切成小块当 Token,跟处理文字一样
2026年8月18日
多模态
SAM 2 的进步:从分割图片到分割视频——加了一个记忆机制
2026年8月18日
多模态
图像分割(SAM):Meta 的分割一切模型,为什么是计算机视觉的 GPT 时刻
2026年8月18日
多模态
多模态幻觉:多模态模型也会看图说话编造内容,为什么
2026年8月16日
多模态
6 / 7
上一页
2
3
4
5
6
7
下一页