这是 v1 存档(2026-09-15,54,147 门,贪心、只用维基百科)。它会掉进 “the 2008 , the 2008” 这样的吸收环。现行版本见 impossible LLM v2。
一张 54,147 个 NAND 的组合网表,读 6 个 MiniCPM token、一次 step() 输出下一个 token。逐门求值在这一页的 Web Worker 里跑,没有后端、没有 API key。
A 54,147-NAND combinational netlist reads 6 MiniCPM tokens and emits the next one in a single step(), evaluated gate by gate in this page.
建议试试 suggested:The history of the Roman Empire —— 点生成,看网表逐 token 写下去。
| 门数 gates | 54,147 NAND · 0 LATCH |
| 接口 interface | 102 in(6 × 17 位 token id,最老在低位)/ 13 out(top-8192 码) |
| 蒸馏 distillation | MiniCPM5-2B BF16,argmax,1024-token 预热,16M 标注 |
| 一致率(同体裁) | 约 0.23 · 测试窗口与训练区同一语料体裁(基线约 0.07) |
| 一致率(跨体裁) | 约 0.11 · 测试窗口落在语料另一段体裁上(基线约 0.06)。这才是它面对陌生文本时的诚实数字。 |
| 教师 teacher | 同两个窗口上都是 约 0.49 —— 教师几乎不掉,所以掉的不是数据质量,是「背下来的表不泛化」 |
| 测量精度 | 同体裁内多个不相交 20 万 token 窗口的散布约 ±0.01;跨体裁比较必须说明体裁,否则散布看起来像 ±0.03(那是把两种体裁混在一起的假象)。小于 0.01 的差别不显著。 |
| 天花板 ceiling | 全表 0.339 / K=1M 截断 0.35186(均为近分布)· top-8192 覆盖 0.92225 |
| 每步 gas step | 133,993,004(1.91 个块,建模) |
| 流片 tape-out | 尚未流片 not taped out —— 12 片、实测 estimateGas 174,787,056、合计 0.011139 BNB |
| 已知缺陷 | 这一版的查表键是用一个有缺陷的哈希算的:numpy 的 uint64 移位超过 63 位返回 0,导致第 5、6 个 token 完全没进键、第 4 个只进了 17 位中的 13 位。所以尽管页面确实把 102 位喂进网表,深层的表实际上只区分约 3.76 个 token(铁证:W=6/5/4 三层的不同键数是 11,573,526 / 11,573,527 / 11,573,528,彼此差不到 2)。下面那些一致率是这张网表实测的,所以数字本身没错;修正键后的版本在部署体裁上约 0.214、满表天花板 0.288,正在重造,届时替换本页。 |
这一页暂时没有链上逐 token 对照——网表还没烧。已流片的 cid 285 / 286 / 287 有活的 eth_call 对照,见存档页
一步模型阶梯和逐字续写演示(两页已下线,保留为工程存档)。烧录后这一页会补上同样的一栏。