强代码模型是怎样炼出来的?先建立整体认识
讨论问题从通用底座到强代码模型,预训练、数据构建和后训练分别承担什么角色?一条完整训练路线需要哪些条件?
候选文献 4
- Qwen2.5-Coder Technical Report2024 · 完整案例
阅读抓手以文件级、仓库级预训练到指令与偏好训练的全流程,建立代码模型训练地图。
要回答的问题各阶段把模型从“读懂代码”推向哪些能力?哪些能力不能只靠增加代码语料获得?
阅读抓手以通用底座继续训练为例,连接代码、数学与自然语言数据,以及后训练。
要回答的问题专用代码能力如何建立在通用底座上?继续预训练与后训练怎样分工?
阅读抓手从可复现的数据流水线、预训练、退火到两阶段 SFT,理解建设代码模型需要什么。
要回答的问题有模型权重为什么还不等于能复现能力?团队必须掌握哪些训练资产?
阅读抓手以模型辅助数据建设和 instruct / reasoning 两条训练路径,比较不同能力目标的配方。
要回答的问题“会按要求写代码”和“会解难题”是否应采用同一训练路线?人工和模型各做什么?