From 0db2c904813c539dee284ed5ceb60845b4d403bd Mon Sep 17 00:00:00 2001 From: m3ultra Date: Sun, 19 Jul 2026 21:09:37 +1000 Subject: [PATCH] =?UTF-8?q?benchmarks:=20Qwen-Layered=20ladder=20=E2=80=94?= =?UTF-8?q?=2020=20steps=20holds=20quality,=203.2x=20to=20365.6s=20on=20m1?= =?UTF-8?q?ultra?= MIME-Version: 1.0 Content-Type: text/plain; charset=UTF-8 Content-Transfer-Encoding: 8bit Co-Authored-By: Claude Fable 5 --- BENCHMARKS.md | 13 +++++++++++++ 1 file changed, 13 insertions(+) diff --git a/BENCHMARKS.md b/BENCHMARKS.md index c14a17d..e688b12 100644 --- a/BENCHMARKS.md +++ b/BENCHMARKS.md @@ -349,3 +349,16 @@ to the MESHGOD prep frontline for hero assets. Optimization in progress: `mflux-save --quantize 8` pre-baked model → skips load+quant cost; timed gen-only rerun to follow. Next: 1024-res, q4/q6 quality ladder, m3ultra cross-bench. + +### Qwen-Image-Layered optimization ladder (m1ultra, 640, q8, 4 layers) + +| config | wall | note | +|---|---|---| +| cold: HF bf16 + on-the-fly q8, 50 steps | 1180.8 s | first smoke | +| baked q8 model, 50 steps | 1075.9 s | load cost was NOT dominant | +| **baked q8, 20 steps** | **365.6 s** | **quality held — figure cutout indistinguishable from 50-step. RECOMMENDED DEFAULT.** | + +3.2× end-to-end. Peak 36.6GB. Baked model: ~/qwen-layered-staging/qwen-layered-q8 (34GB). +Remaining ladder (untested): q6/q4 quality/speed, 1024-res, fewer-steps floor (10?), +m3ultra cross-bench (~1.4× compute but needs 34GB disk — m3 disk currently tight), +MODELBEAST operator wrapper (qwen_layered_local) once defaults settle.