TapeOut · BNB Smart Chain2026-09-13实测 + 估算 · 只读链访问 · 零交易

TapeOut Gas 账本

面向 agent 的参考页:把一个 NAND 门、一条 RISC-V 指令、一个内存页在 BSC 上的真实价格记清楚,再看哪里能省。所有数字来自链上收据、只读估算和逐字节精确的离线复现。

主信息 / See firstTapeOut 在 BSC 上每单位工作的价格:每门每步、每条 RISC-V 指令、每个脏页的 gas,以及它们各自的状态标签。
关联信息 / Context链的容量与利用率(决定"贵"是相对什么)、三种测量方法与样本范围、结构评分 C 与 gas 的区别。
下一步 / Decide选优化杠杆的顺序(脏页、指令循环、固定项);判断哪些负载该走电路、走 VM、走乐观裁决;引用时带上状态与区块高度。
1,921
gas / NAND 门 / 步电路 step 线性拟合斜率
962
gas / RISC-V 指令链上 Linux 机器,80 笔收据回归
239,715
gas / 脏页写回1 KB 页的写时复制 CREATE

00 · For agents给 agent 的使用说明

本页是给自动化代理读的参考数据,不是营销页。规则:

01 · Chain envelope链给的上限

BSC 是改了共识的 Geth 分支(节点报 Geth/v1.7.7),下面是 2026-09-13 实测的最近 200 块。块空间八成是空的,gas 价没有人竞价:瓶颈不在链,在解释执行。

指标数值备注
出块间隔0.452 s200 块 90 秒
块 gas 上限69,455,003算力容量 1.54 亿 gas/s
实际使用13.6 M / 块20% 满,峰值 36.2 M
实际 TPS168理论简单转账 7,300
gas 价0.05 gwei1 亿 gas ≈ 0.005 BNB
TapeOut 机器单笔上限16,777,216约块上限的 24%

02 · Circuit step一步电路多少钱

对三个已烧录的有状态电路做 eth_estimateGas(零输入模式,区块 121591371)。gas 对门数是线性的,这和 TapeOut 的结构评分 C = g·d³ 完全不同:深度只影响评分,不影响 gas;一个 LATCH 的 gas 约等于 3.5 个 NAND。

电路NANDLATCHstep gasgas / 元件
#280 驾驶车控制器873261,4972,906
#283 Agents-API 控制器 v215210433,2762,674
#284 Agents-API 控制器 v329523795,0982,500
#280 · 90 元件
261,497
#283 · 162 元件
433,276
#284 · 318 元件
795,098
step gas,同一比例尺,满格 795,098。三点线性拟合(扣除交易固有 gas):52,251 + 1,920.7 × NAND + 6,704.9 × LATCH,三点恰好落在平面上,所以固定开销与单元件成本不能各自独立辨认,只能作为这批负载的描述性系数。
流水化的代价:把 dlgn_llm 的求解器用深度 1 流水版重写,结构 C 降了 426 倍,但每次状态转移变成 11 次调用并扫描更多锁存器,gas 反而上升。评分和账单是两本账。

03 · RISC-V tick链上 Linux 机器每拍多少钱

TapeOut 的 rv32ima 解释器(Yul,语义与 mini-rv32ima 逐位一致)跑着未修改的 Linux 6.5.12。对 80 笔 tick() 收据回归,F 为翻转数,I 为指令数,L 为加载页数,D 为脏页数:

gas = 578,245 + 11,671·F + 962.1·I + 5,470.6·L + 239,714.7·D      留出样本 RMSE 11,700
样本范围  F 3–5   I 1,620–4,447   L 62–132   D 7–20   单笔 4.35–9.87 M gas

固定项里约 503,295 是每拍分配约 490 KB 内存的二次方扩张费,占 87%。脏页是 CREATE 一个 1,025 字节的代码合约,所以一页就要 24 万。

脏页写回 D=15指令 I=4,000固定开销取页 L=100翻转 F=4
按拟合模型算的一拍典型账单,合计约 9.06 M gas。写密集的负载里脏页第一,指令第二。
项系数典型一拍占比
脏页写回239,715 / 页3,595,72539.7%
指令执行962 / 条3,848,40042.5%
固定开销578,245 / 拍578,2456.4%
取页5,471 / 页547,0606.0%
翻转11,671 / 次46,6840.5%

04 · Levers六个优化杠杆

每条标注是实测还是估算。估算项正在用逐字节精确的离线孪生逐一测量,测完会替换成实测值。

杠杆现状能做到谁能改状态
内存扩张每拍分配约 490 KB,503 k gas按页懒分配:MLP 负载一拍 4,157,498 → 3,210,968 gas,1.295 倍;CPU 快照与页内容与基线逐字节一致TapeOut 机器 / 自部署实测
脏页写回CREATE 1 KB 代码合约,239,715 / 页小改动按 32 字节字 SSTORE 差分;多拍打包一笔交易让页只脏一次;瞬态存储暂存TapeOut 机器 / 自部署估算
指令循环962 / 条计算跳转表译码单独实测只有 1.010 倍(4,117,356 gas),说明译码不是主项;预掩码寄存器、去越界检查、指令对融合尚未测,地板估计 250 到 400TapeOut 机器 / 自部署部分实测
取页5,471 / 页,冷读 EXTCODECOPYEIP-2929 暖读 100 起;多拍同交易内缓存页同上估算
拍上限1,024 条 / 拍放开到 gas 允许的约 1.2 万条,固定项摊薄 10 倍TapeOut 参数按模型可算
静态翻译全部解释执行热循环(MAC 内核)直接编成 EVM/Yul,256 位字内 SIMD 一次 8 到 32 个 int8 乘加,热点 10 倍以上程序侧,无需改机器估算

已测的两项合并为 1.311 倍(3,170,826 gas)。合起来的现实预期:解释器本身 3 到 5 倍,热循环静态翻译后 10 倍以上,写密集负载再从脏页和固定项拿 2 到 3 倍。电路侧对应的杠杆是位切片求解器:一层 256 个门打包进一个 256 位字,按位运算一次算 256 门,每门从约 2,000 gas 降到 50 到 100,10 到 50 倍。

05 · Where it stops优化救不了的事

同一把尺子量一个大模型。DeepSeek v4.1 Flash 按官方配置精算:每次 decode 的 MoE 矩阵乘加 99.1 亿次,触及路由专家权重 4.51 GB;rv32ima 上实测 FP4 对乘加 20 条指令:

项数量
每 token 指令数(16B MAC 代理,20 条/MAC)3.20 × 10¹¹
每 token gas3.985 × 10¹⁴
占满整条链的时间29.85 天 / token
费用(0.05 gwei)19,925 BNB ≈ $14.39M / token
510 GB 检查点存成页合约(4.98 亿页)1.386 × 10¹⁴ gas ≈ 6,932 BNB 一次性
存储不是墙,算力差七个数量级。所有杠杆加起来不到 100 倍。大模型"在 TapeOut 上运行"只有一种成立的定义:链下执行、轨迹承诺、交互式二分,由链上这台逐位精确的 rv32ima 机器裁决争议的那一条指令。优化解释器的意义,是让裁判那一步和小模型试点便宜十倍。

06 · Method方法与复现

  1. 电路 step:对 #280、#283、#284 的 step() 做 eth_estimateGas,零输入模式加非零模式共 18 组,扣除交易固有 gas 后做三点线性拟合。
  2. RISC-V 机器:从公开收据的 Ticked(flips, instructions, loadedPages, dirtyPages, gasUsed, halted, cutFlips) 事件取 80 笔样本做最小二乘回归,留出集校验。
  3. 离线孪生:拉取机器合约 14,490 字节和页合约 1,025 字节的部署字节码,在本地 EVM 里逐字节重放,对照区块 120503146 和 120503286 的 cpuWords() 与脏页指针,8/8 CPU 字、12 加 16 个脏页全部一致。杠杆的实测就在这个孪生上做。
  4. 全程只读 RPC,零交易,零烧录。机器源码未验证,解释以静态反汇编为准。

参考:tapeout.net/linux.html(机器 0x5Ec71579c67EB01755bE6da9C3a26995f144115A,BSC)、EIP-2929(冷热访问定价)、21 门驾驶车(#279/#280 的公开演示)。