摘要

Gensyn 发布 OPEN-1B:模型有 16.1 亿参数,使用 4000 亿 token 训练,每个优化步骤都记录状态哈希。固定顺序的算子、数据流和与拓扑无关的规约,使 CPU、CUDA 与 Metal 能复现完全一致的结果。项目公开完整语料、810 个 checkpoint、训练代码与审计回放工具。志愿者可在普通硬件上核验单个步骤,不必重跑整个训练任务。

为什么重要
对评估开源模型的团队来说,这在公开权重和训练配方之上增加了一层可验证性。审计者无需承担完整重训成本,也能发现未披露数据或训练过程变化。当前只有 1B 规模,且依赖定制确定性算子,更适合作为研究原型,而不是直接套用到前沿训练。
技术细节
模型 16.1 亿参数;非嵌入参数 10.8 亿
训练 400,004,481,024 token;80,957 个优化步骤;48 张 H100
审计 CPU、CUDA 或 Metal 上逐 bit 回放;链式 BLAKE2b 状态哈希
产物 完整语料、810 个 checkpoint、代码、审计包与浏览器审计应用
许可证 代码仓库为 Apache-2.0
局限 仅验证 1B 规模;回放仍信任固定的编译算子与产物
标签
open-modeltrainingreproducibilityauditmodel-provenance