Skip to content

Commit 73527a0

Browse files
committed
tooling(probe): report torch_cuda_reserved_gb to separate allocator pool from live use
1 parent 03e536b commit 73527a0

1 file changed

Lines changed: 6 additions & 0 deletions

File tree

scripts/probe_real_step_mem_20260601.py

Lines changed: 6 additions & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -139,6 +139,11 @@ def loss_fn(m, b):
139139
run_s = time.time() - t1
140140

141141
peak_gb = _peak_gb()
142+
torch_reserved_gb = (
143+
round(float(torch.cuda.max_memory_reserved()) / (1024**3), 3)
144+
if have_torch
145+
else None
146+
)
142147
torch_peak_gb = (
143148
round(float(torch.cuda.max_memory_allocated()) / (1024**3), 3)
144149
if have_torch
@@ -156,6 +161,7 @@ def loss_fn(m, b):
156161
"after_params_peak_gb": round(after_params_gb, 3),
157162
"mlx_peak_gb": round(peak_gb, 3),
158163
"torch_cuda_peak_gb": torch_peak_gb,
164+
"torch_cuda_reserved_gb": torch_reserved_gb,
159165
"rss_gb": round(_rss_gb(), 3),
160166
"loss": float(loss),
161167
}

0 commit comments

Comments
 (0)