# MiniMax H3 FL2VA 本站基线运行报告（W2-A / W2-B 共用前置）

- **协议依据：** [`01-requirements/site-reproduction-protocol.md`](https://github.com/TF6cool/minimaxh3tutorial/blob/main/01-requirements/site-reproduction-protocol.md) 0.2-draft
- **需求项：** Requirements 3.0 §7.2 第 1 项
- **实际执行：** 2026-08-20 03:11–06:03 UTC（America/Los_Angeles：2026-08-19 20:11–23:03 PDT）
- **测试台：** 自有双 RTX 3060 12GB 测试台；所有推理只使用物理 GPU0
- **报告状态：** `site_benchmark_completed`
- **结果范围：** FL2VA T2V 与 I2V 各 2 次独立正式成功运行；不含 Turbo LoRA

## 0. 结论与门禁状态

本站用同一张 RTX 3060 12GB、同一份 FL2VA INT8 ConvRot 权重，在 1344×768、124 帧、24fps、20 steps、原生音频开启、固定 seed `20260820` 下完成了四次正式运行：

| 任务 | Run 1 | Run 2 | 两次输出 |
|---|---:|---:|---|
| T2V | 2,175.5s（36:15.5） | 2,176.2s（36:16.2） | MP4 SHA-256 完全一致：`3d582cbcf88b…e802` |
| I2V | 2,373.7s（39:33.7） | 2,378.1s（39:38.1） | MP4 SHA-256 完全一致：`8681605254c0…b47f` |

协议规定单次耗时 ≥30 分钟的本站基准跑 2 次并分别公开原始值，不计算伪稳定均值；T2V 与 I2V 均满足。四次运行全部 `success`，`node_errors={}`，无失败、无污染、无温度中止。

门禁结论：

| 对象 | 结论 |
|---|---|
| W2-A T2V 页 | **已解锁**：T2V 基线双跑完成 |
| W2-A I2V 页 | **已解锁**：权重需求核对完成，I2V 基线双跑完成 |
| W2-B `/loras/turbo` | **第一项前置已完成**：干净的 FL2VA T2V 对照分母就位；仍须完成 Requirements §7.2 第 2 项 turbo on/off A/B，页面才解锁 |

本报告不把 T2V 与 I2V 的耗时差写成输入图成本，也不发布任何 Turbo 性能结论。两个任务是两张独立测试卡，不能跨任务作因果比较。

## 1. 上游模板与资产固定

### 1.1 官方模板 revision

本轮不跟随浮动的 `main`，固定使用与测试台现有 T2V 模板逐字匹配的 Comfy-Org revision：

`Comfy-Org/workflow_templates@7837633a31c1aa40495ed7f9171e9c97358a1d93`

仓库许可为 MIT。两个 UI 模板均来自该 revision：

| 资产 | SHA-256 | 字节数 | 固定来源 |
|---|---|---:|---|
| `video_minimax_h3_t2v.json` | `31ab33fdb053a7834cc866bd7aa08b887518fc656e4a796c89779c6b5e1786e6` | 42,197 | [pinned source](https://github.com/Comfy-Org/workflow_templates/blob/7837633a31c1aa40495ed7f9171e9c97358a1d93/templates/video_minimax_h3_t2v.json) |
| `video_minimax_h3_i2v.json` | `bb71aecdd3c0b62e56eafe03acb14d1cfeabec7072eaed9cbdf473c2aaf73009` | 44,684 | [pinned source](https://github.com/Comfy-Org/workflow_templates/blob/7837633a31c1aa40495ed7f9171e9c97358a1d93/templates/video_minimax_h3_i2v.json) |
| `transparent_rgb_gaming_mouse.png` | `49696748d2fff0e8c9b63c7173c6d6282b70eac0195def5b39402f9564410e75` | 1,383,312 | 同 revision 的官方 I2V 样例输入，1024×1024 RGBA |

### 1.2 I2V 权重需求核对

逐个读取 I2V 模板的 Loader 节点，并与 `/data/models` 和 manifest 对照。I2V 与 T2V 使用同一组四个权重文件；I2V 只多一张输入图，**不需要新增权重、Turbo LoRA 或自定义节点**：

| Loader 资产 | 字节数 | SHA-256 | 盘上状态 |
|---|---:|---|---|
| `diffusion_models/minimax_h3_fl2va_pruned_int8_convrot.safetensors` | 20,970,379,616 | `e889202c41dafb67b10d67b97f0d8541508036a6090af23425a5c2615d03c47a` | 存在，匹配 |
| `text_encoders/qwen3vl_32b_minimax_h3_nvfp4_awq.safetensors` | 15,687,142,551 | `35a88d51044231fe332301d7a62aa81e3f2cba62febeb446e2c1e3e0ef76f2c6` | 存在，匹配 |
| `vae/minimax_h3_video_vae_fp16.safetensors` | 5,207,808,496 | `7c1f131492e7eddacaac9069a61b81bdd39de5cc96561e677c5eab1cdce5e522` | 存在，匹配 |
| `vae/minimax_h3_audio_vae_fp32.safetensors` | 605,254,808 | `8e505d95dd1561d47abd43d4238fd40d9bb1ae9e147ed0a4cba778d76ae4db48` | 存在，匹配 |

大文件 SHA-256 沿用测试台 manifest 中此前已验证的指纹；本轮重新核对文件名、字节数与 Loader 映射。完整既有资产盘点见 [`03-dev/benchmarks/cache-nodes-2026-08-14.md`](https://github.com/TF6cool/minimaxh3tutorial/blob/main/03-dev/benchmarks/cache-nodes-2026-08-14.md)。

### 1.3 派生 API 工作流

UI 模板转为 ComfyUI API workflow 后，仅做冻结测试所需的机械变更：固定 seed；把画布、帧数直接写成最终值；固定输出前缀；保留官方 prompt、Loader、采样器、视频 VAE、音频 VAE 与音频 mux 链路。I2V 保留官方第一帧输入，T2V 不连接图片。

| 任务 | 正式 API workflow SHA-256 | 重复运行 |
|---|---|---|
| T2V | `1b083dfa1a4540b3805b998a66f5585f4337d5fbe14b441ca7ac0a2e1bf545a2` | Run 1 / Run 2 使用同一字节文件 |
| I2V | `22648d0a8d42cae3207e9d5b0e9def8e55afd2ae4f7d6a2b809271141de30e40` | Run 1 / Run 2 使用同一字节文件 |

正式工作流保存在测试台 `/opt/minimax-h3/data/user/bench/`，每个 run 目录另存 `workflow-api.json` 与哈希。

## 2. 环境指纹与隔离

| 字段 | 实测值 |
|---|---|
| GPU | 2× NVIDIA GeForce RTX 3060，12,288 MiB/卡，power limit 170W |
| 执行卡 | 物理 GPU0，UUID `GPU-30a405ba-3d3d-99ad-bed2-13df29763905` |
| 容器可见卡 | 仅 1 张；`NVIDIA_VISIBLE_DEVICES` 精确绑定 GPU0 UUID |
| PCIe（GPU0 负载 ≥50% 时） | gen3 x8 |
| CPU / VM | Intel Core i9-10850K；KVM；16 vCPU；VM RAM 48,153 MiB；无 swap |
| 主机物理内存 | 64GB（沿用既有测试台档案）；本轮 guest 可见约 47GiB |
| OS / kernel | Ubuntu 24.04；Linux 6.8.0-137-generic |
| Driver / CUDA | 580.173.02 / CUDA 13.0 |
| Python / PyTorch / Triton | 3.12.3 / 2.13.0+cu130 / 3.7.1 |
| ComfyUI | 0.31.0；commit `bf4c9a08fc854df6d3b2bef1b92b509e2ef2d2c9` |
| ComfyUI 启动 | `python /opt/ComfyUI-h3/main.py --listen 0.0.0.0 --port 8188 … --disable-auto-launch` |
| custom nodes | 空；本轮没有安装或加载第三方节点 |
| 优化开关 | Turbo LoRA=off；cache=none；SageAttention=absent；Torch compile=off；未增加专用优化 flag |
| 并行任务 | 1；禁止并行运行其他 `test_id` |

每次正式运行都由同一 runner 只重启 H3 容器，以清空进程内模型状态并归零 `cgroup memory.peak`；其他容器不重启。宿主页缓存未清理，因此 `cache_state` 统一记为 `mixed`：ComfyUI 进程/模型冷启动，宿主文件页缓存不受控。四次正式运行启动前 GPU0 均为 331 MiB，GPU1 均为 113 MiB。

污染判定：GPU1 在每次运行前后均为 `113 → 113 MiB`，变化 0 MiB，低于协议 200 MiB 阈值；四次均 `contaminated=false`。

## 3. 冻结工作负载

| 字段 | T2V | I2V |
|---|---|---|
| task | FL2VA T2V | FL2VA I2V（first frame） |
| 模板 | `video_minimax_h3_t2v.json` | `video_minimax_h3_i2v.json` |
| 输入素材 | 无图片 | `transparent_rgb_gaming_mouse.png`，SHA 见 §1.1 |
| prompt | 官方 pinned 模板原文，不改写 | 官方 pinned 模板原文，不改写 |
| prompt SHA-256 / bytes | `c628dfa9b3e7b4e6e406cf609d4ae7537566b8b69cf84d63322886de48803dc4` / 1,647 | `36569548f832ab5efd3d944467f37f708de95f1f0bee2aeef6922b19acb16e0d` / 1,503 |
| negative prompt | N/A，模板无此输入 | N/A，模板无此输入 |
| seed | `20260820` | `20260820` |
| width × height | 1344×768（1.032 MP） | 1344×768（1.032 MP） |
| frames / fps / nominal duration | 124 / 24 / 5.1667s | 124 / 24 / 5.1667s |
| steps / sampler / scheduler / denoise | 20 / `res_multistep` / `simple` / 1.0 | 同左 |
| guider / CFG / shift | `BasicGuider`；无显式 CFG；无 LoRA shift | 同左 |
| audio | on；保留 `VAEDecodeAudio → CreateVideo.audio` | 同左 |
| output prefix | `video/SITE-3060-FL2VA-T2V-GPU0-B1` | `video/SITE-3060-FL2VA-I2V-GPU0-B1` |

完整 prompt 不在报告中二次手抄，避免转义或 Unicode 归一化造成静默变化；权威文本是 §1.1 的 pinned UI 模板，工作流与 prompt 各自 SHA-256 已固定。

## 4. 冒烟门禁

SMOKE 仅验证模板、输入、音频链路、监控与温度中止机制，不进入正式基线统计，也不触发“小于 30 分钟基准跑 3 次”的规则。

| test_id | 工作负载 | ComfyUI wall | peak VRAM GPU0 | peak RAM | 状态 |
|---|---|---:|---:|---:|---|
| `SITE-3060-FL2VA-T2V-GPU0-SMOKE` | 512×288 / 22 帧 / audio on | 51.8s | 11,625 MiB | 42,511 MiB | success |
| `SITE-3060-FL2VA-I2V-GPU0-SMOKE` | 512×288 / 22 帧 / audio on | 54.1s | 11,689 MiB | 42,348 MiB | success |

## 5. T2V 正式双跑

| 字段 | Run 1 | Run 2 |
|---|---:|---:|
| `test_id` | `SITE-3060-FL2VA-T2V-GPU0-B1` | `SITE-3060-FL2VA-T2V-GPU0-B1-RUN2` |
| 提交 → 完成（UTC） | 03:18:51 → 03:55:12 | 04:05:32 → 04:41:52 |
| wall time（ComfyUI） | **2,175.5s** | **2,176.2s** |
| wall time（client） | 2,180.5s | 2,180.5s |
| peak VRAM GPU0 | 11,023 MiB（89.7%） | 10,863 MiB（88.4%） |
| peak VRAM GPU1 | 113 MiB | 113 MiB |
| peak RAM（cgroup） | 43,607 MiB | 43,880 MiB |
| ComfyUI VmHWM（辅助） | 43,993 MiB | 43,982 MiB |
| MemAvailable 最低（辅助） | 1,420 MiB | 1,375 MiB |
| GPU0 温度 / 功耗峰值 | 72℃ / 169.85W | 70℃ / 169.50W |
| PCIe under load | gen3 x8 | gen3 x8 |
| GPU1 before → after | 113 → 113 MiB | 113 → 113 MiB |
| `node_errors` / status | `{}` / success | `{}` / success |
| 输出字节数 | 1,374,374 | 1,374,374 |
| 输出 SHA-256 | `3d582cbcf88b3aa8d60e93cea4c65bba445ab475c8c3243591107c7dab4ee802` | 同左 |

两次 wall time 相差 0.7s；按协议只列原始值，不计算平均数或把它包装成跨设备结论。

## 6. I2V 正式双跑

| 字段 | Run 1 | Run 2 |
|---|---:|---:|
| `test_id` | `SITE-3060-FL2VA-I2V-GPU0-B1` | `SITE-3060-FL2VA-I2V-GPU0-B1-RUN2` |
| 提交 → 完成（UTC） | 04:43:04 → 05:22:39 | 05:24:01 → 06:03:42 |
| wall time（ComfyUI） | **2,373.7s** | **2,378.1s** |
| wall time（client） | 2,375.5s | 2,380.5s |
| peak VRAM GPU0 | 11,125 MiB（90.5%） | 11,637 MiB（94.7%） |
| peak VRAM GPU1 | 113 MiB | 113 MiB |
| peak RAM（cgroup） | 43,910 MiB | 43,907 MiB |
| ComfyUI VmHWM（辅助） | 43,998 MiB | 43,995 MiB |
| MemAvailable 最低（辅助） | 1,528 MiB | 1,366 MiB |
| GPU0 温度 / 功耗峰值 | 68℃ / 169.90W | 67℃ / 170.28W |
| PCIe under load | gen3 x8 | gen3 x8 |
| GPU1 before → after | 113 → 113 MiB | 113 → 113 MiB |
| `node_errors` / status | `{}` / success | `{}` / success |
| 输出字节数 | 1,106,161 | 1,106,161 |
| 输出 SHA-256 | `8681605254c00719f7af488c13adb0124136de177c0dde02e906b198cc5cb47f` | 同左 |

两次 wall time 相差 4.4s；同样只列原始值，不计算平均数。

## 7. 输出媒体核验

四个正式输出均用纯标准库 MP4 box parser 复核，另读取 sample entry codec 标识：

| 字段 | T2V Run 1 / Run 2 | I2V Run 1 / Run 2 |
|---|---|---|
| top-level boxes | `ftyp / moov / free / mdat` | 同左 |
| container duration | 5.167s | 5.167s |
| video | H.264 (`avc1`)，1344×768，124 samples，5.166667s | 同左 |
| audio | AAC (`mp4a`)，32,000 timescale，163 samples，5.198688s | 同左 |
| track count | 2（video + audio） | 2（video + audio） |
| 重复一致性 | 两个完整 MP4 字节级一致 | 两个完整 MP4 字节级一致 |

完整文件 SHA-256 一致比仅比较 `mdat` 更严格：视频/音频 payload 与容器 metadata 均一致。输出画面尚未进入公开发布流程；未来若在 W2-A 或 W2-B 展示帧/样片，仍须单独通过 [`03-dev/reviews/video-publish-checklist.md`](https://github.com/TF6cool/minimaxh3tutorial/blob/main/03-dev/reviews/video-publish-checklist.md) 与 Requirements §8.5 的生成物披露规则。

## 8. 原始证据与运行编排

每次 run 目录包含：`run.log`、`submit.json`、`workflow-api.json`、`artifact-sha256.txt`、`comfy-console.log`、`gpu-before.csv`、`gpu-after.csv`、`gpu.csv`、`mem.csv`、`temp-watchdog.csv`、`peaks.json`、容器与进程前后状态。

| test_id | 原始目录 |
|---|---|
| `SITE-3060-FL2VA-T2V-GPU0-B1` | `/opt/minimax-h3/bench/runs/SITE-3060-FL2VA-T2V-GPU0-B1/` |
| `SITE-3060-FL2VA-T2V-GPU0-B1-RUN2` | `/opt/minimax-h3/bench/runs/SITE-3060-FL2VA-T2V-GPU0-B1-RUN2/` |
| `SITE-3060-FL2VA-I2V-GPU0-B1` | `/opt/minimax-h3/bench/runs/SITE-3060-FL2VA-I2V-GPU0-B1/` |
| `SITE-3060-FL2VA-I2V-GPU0-B1-RUN2` | `/opt/minimax-h3/bench/runs/SITE-3060-FL2VA-I2V-GPU0-B1-RUN2/` |

runner 行为：只重启 H3 容器；等待 API 恢复；采集双卡前态；每 2 秒记录 GPU/RAM；GPU0 连续两次 ≥85℃ 时自动 `/interrupt`；从 ComfyUI `execution_start` / `execution_success` 计算权威 wall time；最后采集 cgroup RAM、VmHWM、最低 MemAvailable 与双卡后态。

正式推理失败数为 0，温度安全中止数为 0。收尾复核时 ComfyUI 队列为空；GPU0 因模型仍驻留显示 5,681 MiB、0% utilization，GPU1 113 MiB、0% utilization。没有停止其他容器，也没有使用 GPU1 推理。

## 9. 对 W2-A 与 W2-B 的可用口径

允许写入 W2-A / `/gpus` 的事实：

- `Tested by MiniMaxH3Tutorial.com on an RTX 3060 12GB on 2026-08-19.`
- T2V 两次原始值：2,175.5s / 2,176.2s；peak VRAM 11,023 / 10,863 MiB；peak RAM 43,607 / 43,880 MiB。
- I2V 两次原始值：2,373.7s / 2,378.1s；peak VRAM 11,125 / 11,637 MiB；peak RAM 43,910 / 43,907 MiB。
- 两个任务各自的重复输出完整 MP4 SHA-256 相同。
- I2V 模板只比 T2V 多输入图连接，四个 Loader 权重相同；盘上既有文件足够。

当前禁止写：

- 不把两个 raw value 平均成单一“标准耗时”。
- 不把 I2V 比 T2V 慢写成输入图的因果成本；两者 prompt、输入与执行图不同。
- 不把 12GB 单卡成功外推为 8GB、其他 GPU、其他量化或其他分辨率也能完成。
- 不宣称 Turbo 加速倍数或显存变化；§7.2 第 2 项 A/B 尚未执行。
- 不把本轮数据称为社区主张复现；`track=site_benchmark`。

## 10. 协议签核

| 检查项 | 结果 |
|---|---|
| 模板 revision、UI/API workflow SHA | PASS |
| 模型文件名、字节数、SHA 与 Loader 映射 | PASS |
| I2V 输入文件 SHA 与许可来源 | PASS |
| 固定 seed / prompt / 画布 / 帧数 / steps / sampler / scheduler / audio | PASS |
| GPU0 单卡、GPU1 污染判定、无并行任务 | PASS |
| 2 秒 GPU/RAM/温度采样与 85℃中止机制 | PASS |
| 每个 ≥30 分钟任务完成 2 次正式成功运行 | PASS |
| 完整控制台日志、工作流、监控 CSV、输出媒体保留 | PASS |
| 输出分辨率、帧数、时长、codec、音轨与 SHA 复核 | PASS |
| 失败运行保留 | N/A：本轮无推理失败或安全中止 |
| 结果状态 | `site_benchmark_completed` |
| reviewer / review date | Codex 日志、哈希与媒体元数据交叉复核 / 2026-08-19 PDT |

**最终裁决：Requirements 3.0 §7.2 第 1 项完成。W2-A 两个文件名页的实测前置全部满足；W2-B 的 baseline 前置满足，但页面仍受 §7.2 第 2 项 turbo on/off A/B 门禁约束。**
