_routed_experts_for
algorithm_adapter.py
routed_arr[:seq_len]
UNSET_ROUTED_EXPERT
np.concatenate
np.concatenate([p_arr, c_arr])
GRPOAdapter.create_trainer_payloads
force_on_policy_ratio
log_sampler_trainer_agreement
tunix/experimental/zero_tim_kernel
tunix/experimental/zero_tim_kernel/bench/qwen3
TunixTrajectoryMetadata
TrajectoryMetadata