摘要
Gensyn 发布 OPEN-1B:模型有 16.1 亿参数,使用 4000 亿 token 训练,每个优化步骤都记录状态哈希。固定顺序的算子、数据流和与拓扑无关的规约,使 CPU、CUDA 与 Metal 能复现完全一致的结果。项目公开完整语料、810 个 checkpoint、训练代码与审计回放工具。志愿者可在普通硬件上核验单个步骤,不必重跑整个训练任务。
为什么重要
对评估开源模型的团队来说,这在公开权重和训练配方之上增加了一层可验证性。审计者无需承担完整重训成本,也能发现未披露数据或训练过程变化。当前只有 1B 规模,且依赖定制确定性算子,更适合作为研究原型,而不是直接套用到前沿训练。
技术细节
| 模型 | 16.1 亿参数;非嵌入参数 10.8 亿 |
|---|---|
| 训练 | 400,004,481,024 token;80,957 个优化步骤;48 张 H100 |
| 审计 | CPU、CUDA 或 Metal 上逐 bit 回放;链式 BLAKE2b 状态哈希 |
| 产物 | 完整语料、810 个 checkpoint、代码、审计包与浏览器审计应用 |
| 许可证 | 代码仓库为 Apache-2.0 |
| 局限 | 仅验证 1B 规模;回放仍信任固定的编译算子与产物 |
标签
open-modeltrainingreproducibilityauditmodel-provenance