模型卡阅读法:7B、MoE 与选型档位
2026/8/23大约 2 分钟
AICon 2026 学习系列 · 阶段 0 · 大模型地基 · 第 5/43 篇 · 🚧 占位待学
上一篇:《本地跑通一个模型:参数量、量化与体验》
下一篇:《Prompt 三件套:system、few-shot 与 CoT》
学习大纲:《AICon 2026 学习总纲》
状态:待学习。 本文为占位文档:知识点清单、实验与验收标准已就绪,正文待按「先学习、先实验、再撰写」补全。
对应总纲单元:阶段 0 · 单元 0.5
一、本文要解决的问题
打开一个模型发布页,参数量、MoE、激活参数、license、上下文长度、对话模板——哪些信息决定「我能不能用、好不好用、贵不贵」?建立工程师视角的选型框架,AICon 里「模型同质化」的判断也从这里来。
二、知识点清单
- 参数量的档位感:1.5b / 7b / 32b / 72b / 更大,各自的能力台阶
- MoE:总参数大、激活参数小——能力与成本的解耦
- 上下文长度:标称长度 vs 实际有效长度的区别
- license 与商用的关系;对话模板(chat template)为什么各家不同
三、动手实验(学习时必须真跑)
- 收集三张不同量级模型的模型卡(如 qwen 系列三档),逐项对照填表
- 给三个业务场景(客服摘要 / 代码生成 / 端侧离线)各选一个模型并写理由
四、验收标准(全部通过才进入下一篇)
五、阶段验收(本篇是阶段 0收尾篇)
六、写作提示(补正文时遵守)
- 开篇问题驱动;结构走「是什么 → 为什么 → 怎么做 → 背景知识」
- 所有代码、命令、输出必须先在本机跑通再写入,不得杜撰
- 版本口径以总纲环境清单为准(Python 3.12 / Ollama / vLLM 与 SGLang 最新版 / Spring AI 1.x)
- 涉及版本敏感结论时标注出处与时间
本篇完成后,把文首导航块的「🚧 占位待学」去掉,并在总纲处打卡。