大模型
模型训练
AI Agent
AIGC
多模态
AI安全
多模态
端到端语音模型:直接输入音频、输出音频——跳过语音转文字这一步
2026年8月16日
多模态
BLIP-2 的 Q-Former:怎么用可学习的查询把视觉特征压缩成大模型能懂的 Token
2026年8月14日
多模态
视觉-语言模型(VLM)的架构:视觉编码器 + 连接器 + 语言模型——为什么是这三件套
2026年8月14日
多模态
多模态大模型(MLLM)是什么?给大模型装上眼睛和耳朵
2026年8月14日
多模态
7 / 7
上一页
2
3
4
5
6
7