先说结论:
- Qwen3-VL 本身的从零预训练细节,官方目前还没完整公开(technical report 还在 “Paper is coming” 状态),只能通过 Qwen3 技术报告 + Qwen2 / Qwen2.5-VL 的论文和官方 README 反推大致训练流程。(GitHub)
- 真正开源、可以「从零」预训练类 Qwen-VL 的代码库里,最像 Qwen3-VL 的是 Open-Qwen2VL;此外有 Molmo、Prismatic VLMs 等工业级代码库,以及一批教学向「VLM from scratch」项目,我下面分层给你列出来并给出仓库地址。
1. Qwen3-VL 大致是怎么「从零」训练出来的?
虽然 Qwen3-VL 的专门技术报告还没放出来,但他们已经公开了:
- Qwen3 语言模型的技术报告(36T 文本 token 级别的大规模预训练)。(
订阅专栏 解锁全文

849

被折叠的 条评论
为什么被折叠?



