Skip to content

Commit bd32f80

Browse files
committed
revert optimization from PR#4166
1 parent 9f9a6b2 commit bd32f80

2 files changed

Lines changed: 5 additions & 0 deletions

File tree

src/maxtext/kernels/ragged/ragged_sort.py

Lines changed: 4 additions & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -186,6 +186,8 @@ def _ring_ragged_sort_bwd(res, g_out):
186186
valid_rows_mask=valid_rows_mask,
187187
reduce_group_size=topk,
188188
enforce_fallback=enforce_gather_reduce_fallback,
189+
flops_override=gather_reduce_flops_override,
190+
bytes_accessed_override=gather_reduce_bytes_accessed_override,
189191
)
190192
else:
191193
# Buffering: g_x has size `local_buffer_size` (packed).
@@ -209,6 +211,8 @@ def _ring_ragged_sort_bwd(res, g_out):
209211
valid_rows_mask=valid_rows_mask,
210212
reduce_group_size=topk,
211213
enforce_fallback=enforce_gather_reduce_fallback,
214+
flops_override=gather_reduce_flops_override,
215+
bytes_accessed_override=gather_reduce_bytes_accessed_override,
212216
)
213217
return grad_hidden_states, None
214218

src/maxtext/layers/moe.py

Lines changed: 1 addition & 0 deletions
Original file line numberDiff line numberDiff line change
@@ -918,6 +918,7 @@ def permute(
918918
repeats=group_size,
919919
total_repeat_length=math.prod(selected_experts.shape),
920920
)
921+
921922
return (
922923
sorted_inputs,
923924
sorted_selected_experts,

0 commit comments

Comments
 (0)