Repository Analysis

alibaba/ROLL

An Efficient and User-Friendly Scaling Library for Reinforcement Learning with Large Language Models

17.3 Moderate AI signal View on GitHub

Analysis Overview

This report presents the forensic synthetic code analysis of alibaba/ROLL, a Python project with 3,300 GitHub stars. SynthScan v2.0 examined 156,322 lines of code across 842 source files, recording 1801 pattern matches distributed across 21 syntactic categories. The overall adjusted score of 17.3 places this repository in the Moderate AI signal band.

The scanner applied 160+ deterministic lexical heuristics, multi-line block detectors, abstract syntax tree depth profilers, and a cross-file Jaccard similarity matrix to construct a statistically normalised synthetic code estimate. All matches are individually weighted by severity coefficient and contextual multiplier before summation, and the resulting headline score is temporally discounted to account for the repository's development history relative to the commercial emergence of large language model coding tooling (November 2022 onward).

17.3
Adjusted Score
17.3
Raw Score
100%
Time Factor
2026-07-14
Last Push
3.3K
Stars
Python
Language
156.3K
Lines of Code
842
Files
1.8K
Pattern Hits
2026-07-14
Scan Date
0.10
HC Hit Rate

What These Metrics Mean

Adjusted Score
Primary synthetic code indicator. Raw score normalised per 1,000 lines of code and multiplied by the temporal discount factor. This is the definitive comparative metric — use it to rank repositories by AI authorship density.
Raw Score
The unmodified sum of all severity-weighted, context-multiplied pattern match scores before temporal discounting. Reflects the absolute signal strength independent of when the repository was last active.
Time Factor
The temporal discount multiplier (0–100%) applied to the raw score. Repositories last updated before ChatGPT's launch (Nov 2022) receive a 5% factor. Full signal is only assigned to repositories active in the post-adoption era (Jan 2024+).
Pattern Hits
Total count of individual pattern matches across all files and categories. A high hit count with a low score may indicate a very large codebase with isolated AI snippets; a low count with a high score indicates dense, concentrated AI signatures.
HC Hit Rate
High+Critical pattern hits per file, averaged across the repository. This orthogonal signal catches repositories where a few files are densely packed with high-severity AI tells — a strong indicator even when the normalised score appears moderate due to codebase size.
Lines of Code / Files
Total lines and files analysed. The scanner examines 94 file extensions. These denominators are used to normalise the score, enabling fair comparison between repositories of vastly different sizes.

Score History

This chart maps the temporal evolution of the adjusted synthetic code score across successive scan runs. An upward trajectory indicates ongoing incorporation of AI-generated code or expanding LLM-assisted scaffolding; a stable or declining trajectory may reflect active human refactoring, code removal, or the adoption of stricter authorship policies. The dashed secondary line (right axis) independently tracks total raw pattern hit count, which can diverge from the normalised score when codebase size changes significantly between scans.

Severity Breakdown

Classifies detected patterns by their diagnostic confidence and structural impact. CRITICAL patterns (coefficient 10) represent definitive synthetic signatures — hallucinated imports, explicit LLM attribution metadata — virtually never produced by human authors. HIGH (5) indicates strong structural tells such as cross-file repetition or cross-linguistic idioms. MEDIUM (2) covers recognisable conversational padding and AI-specific vocabulary. LOW (1) captures subtle indicators like tautological comments and generic boilerplate that require density to carry independent signal.

CRITICAL 12HIGH 70MEDIUM 200LOW 1519

Directory Score Breakdown

This horizontal bar chart decomposes the repository's raw synthetic code score by top-level directory, allowing you to pinpoint precisely which modules or components carry the highest AI authorship density. Directories with disproportionately high scores relative to their size warrant targeted manual review: concentrated AI signatures often trace back to mass-generated configuration layers, auto-ported test suites, LLM-scaffolded boilerplate classes, or entire subsystems authored under heavy copilot assistance. Use this view to prioritise your human code-review effort.

Pattern Findings

The scanner identified 1801 distinct pattern matches across 21 syntactic categories. Each entry below represents a discrete location in the source code where the engine recorded a statistically significant AI authorship indicator. Expand any category row to inspect the individual file paths, line numbers, code snippets, and the lexical context (CODE, COMMENT, or STRING) in which each match was detected.

Reading the findings table: The Severity column indicates the diagnostic confidence level (CRITICAL / HIGH / MEDIUM / LOW). The Context column identifies whether the match occurred inside executable code, an inline comment, or a string literal — comment-context matches receive a ×1.5 weight because LLMs systematically over-annotate. The ⚡ bolt icon marks clustered matches: three or more patterns within a 10-line window, each receiving an additional ×1.5 density multiplier as dense clusters constitute far stronger evidence of synthetic authorship than isolated hits.

Hyper-Verbose Identifiers482 hits · 490 pts
SeverityFileLineSnippetContext
LOWmcore_adapter/src/mcore_adapter/initialize.py16def is_distribute_initialized():CODE
LOWmcore_adapter/src/mcore_adapter/training_args.py425 def allow_variable_seq_lengths(self):CODE
LOWmcore_adapter/src/mcore_adapter/utils.py81def is_mcore_version_greater_than(content: str):CODE
LOWmcore_adapter/src/mcore_adapter/utils.py105def is_transformers_version_greater_than(content: str):CODE
LOWmcore_adapter/src/mcore_adapter/patcher.py31def patch_torch_find_nd_overlapping_shards():CODE
LOWmcore_adapter/src/mcore_adapter/patcher.py37 def _find_nd_overlapping_shards(shards: list[ShardMetadata], sharded_dims: list[int]) -> Optional[tuple[int, int]]:CODE
LOWmcore_adapter/src/mcore_adapter/patcher.py85def patch_torch_validate_global_plan():CODE
LOWmcore_adapter/src/mcore_adapter/patcher.py181def patch_megatron_preload_tensors_non_blocking(non_blocking: bool = False):CODE
LOWmcore_adapter/src/mcore_adapter/patcher.py214 def patched_get_save_function_and_args(self):CODE
LOWmcore_adapter/src/mcore_adapter/checkpointing.py18def get_checkpoint_tracker_filename(checkpoints_path):CODE
LOWmcore_adapter/src/mcore_adapter/checkpointing.py278def load_state_dict_from_checkpoint(checkpoint_dir, models = None):CODE
LOWmcore_adapter/src/mcore_adapter/checkpointing.py286def save_config_and_state_dict(save_directory, config, state_dict, ckpt_format: str = "legacy"):CODE
LOWmcore_adapter/src/mcore_adapter/checkpointing.py313def generate_model_state_dict(model, ckpt_format: str = "legacy"):CODE
LOWmcore_adapter/src/mcore_adapter/platforms/rocm.py53 def update_env_vars_for_visible_devices(cls, env_vars: dict, gpu_ranks: list) -> None:CODE
LOWmcore_adapter/src/mcore_adapter/platforms/rocm.py93 def get_vllm_run_time_env_vars(cls, gpu_rank: str) -> dict:CODE
LOWmcore_adapter/src/mcore_adapter/platforms/cpu.py37 def get_vllm_run_time_env_vars(cls, gpu_rank: str) -> dict:CODE
LOWmcore_adapter/src/mcore_adapter/platforms/npu.py67 def get_vllm_run_time_env_vars(cls, gpu_rank: str) -> dict:CODE
LOWmcore_adapter/src/mcore_adapter/platforms/platform.py126 def update_env_vars_for_visible_devices(cls, env_vars: dict, gpu_ranks: list) -> None:CODE
LOWmcore_adapter/src/mcore_adapter/platforms/platform.py162 def get_vllm_run_time_env_vars(cls, gpu_rank: str) -> dict:CODE
LOWmcore_adapter/src/mcore_adapter/platforms/cuda.py68 def get_vllm_run_time_env_vars(cls, gpu_rank: str) -> dict:CODE
LOWmcore_adapter/src/mcore_adapter/platforms/unknown.py68 def get_vllm_run_time_env_vars(cls, gpu_rank: str) -> dict:CODE
LOW…src/mcore_adapter/parallel_functions/vocab_parallel.py27 def vocab_range_from_per_partition_vocab_size(CODE
LOW…src/mcore_adapter/parallel_functions/vocab_parallel.py35 def vocab_range_from_global_vocab_size(global_vocab_size: int, rank: int, world_size: int) -> Sequence[int]:CODE
LOW…src/mcore_adapter/parallel_functions/vocab_parallel.py42 def calculate_predicted_logits(CODE
LOW…src/mcore_adapter/parallel_functions/vocab_parallel.py188def vocab_parallel_target_rank(vocab_parallel_logits: "torch.Tensor", target: "torch.Tensor") -> "torch.Tensor":CODE
LOW…dapter/parallel_functions/encoder_sequence_parallel.py12def _gather_and_reorder_along_first_dim(CODE
LOW…dapter/parallel_functions/encoder_sequence_parallel.py129def encoder_sequence_parallel_gather(input_, split_plan, input_size_list):CODE
LOW…dapter/parallel_functions/encoder_sequence_parallel.py133def encoder_small_batch_size_gather(input_):CODE
LOWmcore_adapter/src/mcore_adapter/models/model_utils.py125def _mca_lora_logits_postprocess(logits: "torch.Tensor"):CODE
LOWmcore_adapter/src/mcore_adapter/models/model_utils.py136def mca_lora_logits_postprocess_hook(module, input, output):CODE
LOWmcore_adapter/src/mcore_adapter/models/model_utils.py149def check_and_get_attention_backend_by_env(attention_backend: AttnBackend):CODE
LOWmcore_adapter/src/mcore_adapter/models/model_utils.py171def get_thd_data_on_this_cp_rank(CODE
LOWmcore_adapter/src/mcore_adapter/models/model_utils.py197def configure_resized_vocab_size(CODE
LOW…ter/src/mcore_adapter/models/sequence_packing_mixin.py86 def build_attention_mask_from_packed_seq_params(CODE
LOW…ter/src/mcore_adapter/models/sequence_packing_mixin.py208 def build_multimodal_embeddings(CODE
LOW…ter/src/mcore_adapter/models/sequence_packing_mixin.py286 def construct_multimodal_inputs(CODE
LOW…ter/src/mcore_adapter/models/sequence_packing_mixin.py472 def _compute_full_sequence_embedding(CODE
LOW…ter/src/mcore_adapter/models/sequence_packing_mixin.py518 def _pack_deepstack_visual_embeds(CODE
LOWmcore_adapter/src/mcore_adapter/models/model_factory.py199 def get_batch_on_this_cp_rank(self, *args, **kwargs):CODE
LOWmcore_adapter/src/mcore_adapter/models/model_factory.py288 def get_batch_on_this_cp_rank(self, batch: Dict[str, "torch.Tensor"], dim3_keys: List[str] = ["attention_mask"]):CODE
LOWmcore_adapter/src/mcore_adapter/models/model_factory.py325 def enable_input_require_grads(self):CODE
LOWmcore_adapter/src/mcore_adapter/models/model_factory.py331 def make_inputs_require_grads(module, input, output):CODE
LOWmcore_adapter/src/mcore_adapter/models/model_factory.py377 def _get_transformer_layer_spec(self, config: Optional["McaModelConfig"] = None):CODE
LOWmcore_adapter/src/mcore_adapter/models/model_factory.py414 def compute_language_model_loss(self, labels: torch.Tensor, logits: torch.Tensor) -> torch.Tensor:CODE
LOW…mcore_adapter/models/qwen3_next/modeling_qwen3_next.py12 def _get_transformer_layer_spec(self, config: Optional[Qwen3NextConfig] = None):CODE
LOW…r/src/mcore_adapter/models/converter/post_converter.py508 def _split_sharded_state_dict(self, sharded_state_dict: dict) -> list[dict]:CODE
LOW…r/src/mcore_adapter/models/converter/post_converter.py542 def _stream_dist_weights_from_shards(self, sharded_state_dict: dict):CODE
LOW…r/src/mcore_adapter/models/converter/post_converter.py722def convert_checkpoint_to_mca(CODE
LOW…r/src/mcore_adapter/models/converter/dist_converter.py327 def _get_num_layers_per_virtual_rank(self):CODE
LOW…r/src/mcore_adapter/models/converter/dist_converter.py604 def handle_grouped_duplicated(self, name: str, weights: Union["Tensor", list["Tensor"]]) -> dict[str, "Tensor"]:CODE
LOW…r/src/mcore_adapter/models/converter/dist_converter.py621 def _convert_te_grouped_column(self, name: str, weights: "Tensor"):CODE
LOW…r/src/mcore_adapter/models/converter/dist_converter.py631 def _revert_te_grouped_column(self, name: str, weights: list["Tensor"], moe_index_preprocessed: bool = False):CODE
LOW…r/src/mcore_adapter/models/converter/dist_converter.py869 def is_tensor_parallel_dup_weight(self, name: str) -> bool:CODE
LOW…r/src/mcore_adapter/models/converter/dist_converter.py873 def is_expert_parallel_weight(self, name: str) -> bool:CODE
LOW…adapter/src/mcore_adapter/models/converter/template.py473 def convert_hf_to_mca_config_kws(self, hf_config: "PretrainedConfig", **kw_args):CODE
LOW…er/src/mcore_adapter/models/converter/convert_utils.py149def remove_mca_mtp_weight_prefix(weight_name: str):CODE
LOW…er/src/mcore_adapter/models/converter/convert_utils.py309def _noisy_mean_initialization(embed_weight: "torch.Tensor", num_new_tokens: int) -> None:CODE
LOW…/src/mcore_adapter/models/converter/model_converter.py90 def load_mca_state_dict_from_hf(self, model_path: str, vp_stage: int):CODE
LOW…/src/mcore_adapter/models/converter/model_converter.py165 def _mca_named_params_with_vp_stage(self, models, params_group=None):CODE
LOW…/src/mcore_adapter/models/converter/model_converter.py238 def _convert_moe_weight_with_allgather(CODE
422 more matches not shown…
Unused Imports420 hits · 413 pts
SeverityFileLineSnippetContext
LOWmcore_adapter/src/mcore_adapter/initialize.py9CODE
LOWmcore_adapter/src/mcore_adapter/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/__init__.py2CODE
LOWmcore_adapter/src/mcore_adapter/__init__.py3CODE
LOWmcore_adapter/src/mcore_adapter/__init__.py3CODE
LOWmcore_adapter/src/mcore_adapter/checkpointing.py7CODE
LOW…apter/src/mcore_adapter/parallel_functions/__init__.py1CODE
LOW…apter/src/mcore_adapter/parallel_functions/__init__.py2CODE
LOW…apter/src/mcore_adapter/parallel_functions/__init__.py2CODE
LOW…apter/src/mcore_adapter/parallel_functions/__init__.py3CODE
LOW…src/mcore_adapter/parallel_functions/fused_logprobs.py16CODE
LOW…src/mcore_adapter/parallel_functions/fused_logprobs.py18CODE
LOW…src/mcore_adapter/parallel_functions/fused_logprobs.py18CODE
LOW…src/mcore_adapter/parallel_functions/fused_logprobs.py18CODE
LOW…src/mcore_adapter/parallel_functions/fused_logprobs.py18CODE
LOWmcore_adapter/src/mcore_adapter/models/model_utils.py16CODE
LOWmcore_adapter/src/mcore_adapter/models/model_utils.py175CODE
LOWmcore_adapter/src/mcore_adapter/models/model_config.py20CODE
LOWmcore_adapter/src/mcore_adapter/models/model_config.py27CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py1CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py21CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py21CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py22CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py23CODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py23CODE
LOWmcore_adapter/src/mcore_adapter/models/model_factory.py41CODE
LOW…dapter/src/mcore_adapter/models/qwen3_next/__init__.py25CODE
LOW…dapter/src/mcore_adapter/models/qwen3_next/__init__.py26CODE
LOW…e_adapter/src/mcore_adapter/models/mixtral/__init__.py3CODE
LOW…r/src/mcore_adapter/models/converter/post_converter.py7CODE
LOW…r/src/mcore_adapter/models/converter/post_converter.py32CODE
LOW…r/src/mcore_adapter/models/converter/post_converter.py45CODE
LOW…r/src/mcore_adapter/models/converter/post_converter.py46CODE
LOW…r/src/mcore_adapter/models/converter/post_converter.py47CODE
LOW…r/src/mcore_adapter/models/converter/post_converter.py48CODE
LOW…r/src/mcore_adapter/models/converter/dist_converter.py25CODE
LOW…r/src/mcore_adapter/models/converter/dist_converter.py27CODE
LOW…adapter/src/mcore_adapter/models/converter/template.py25CODE
LOW…adapter/src/mcore_adapter/models/converter/template.py26CODE
LOW…/src/mcore_adapter/models/converter/model_converter.py43CODE
LOW…/src/mcore_adapter/models/converter/model_converter.py45CODE
LOWmcore_adapter/src/mcore_adapter/models/auto/__init__.py1CODE
360 more matches not shown…
Modern AI Meta-Vocabulary87 hits · 276 pts
SeverityFileLineSnippetContext
MEDIUMREADME.md49| **[01/01/2026]** 🎉 Our [Let It Flow: Agentic Crafting on Rock and Roll](https://arxiv.org/abs/2512.24873) report releaCODE
MEDIUMREADME.md160- [Freshness-Aware-PER](https://arxiv.org/abs/2604.16918): A freshness-aware prioritized experience replay framework forCODE
MEDIUMREADME.md165- [STAgent](https://arxiv.org/abs/2512.24957): An agentic LLM specialized for spatio-temporal understanding and complex CODE
MEDIUMREADME.md168- [EARL](https://arxiv.org/abs/2510.05943): Efficient Agentic RL Systems for LLMs, introducing a dynamic parallelism selCODE
MEDIUMroll/pipeline/agentic/agentic_config.py187 # agentic relatedCOMMENT
MEDIUMroll/distributed/scheduler/router.py233 # In agentic pipeline (pure DP): rank == dp_rank, so directly access rank2devicesCOMMENT
MEDIUMtests/pipeline/agentic_pipeline_config.yaml24# project: roll-agenticCOMMENT
MEDIUMtests/pipeline/agentic_pipeline_config.yaml28# - agenticCOMMENT
MEDIUMtests/pipeline/agentic_pipeline_config.yaml35# project: roll-agenticCOMMENT
MEDIUMtests/pipeline/agentic_pipeline_config.yaml37# experiment_name: roll-agentic-examplesCOMMENT
MEDIUMtests/pipeline/agentic_pipeline_config.yaml40# - agenticCOMMENT
MEDIUM…2.5-7B-agentic_megatron/agentic_val_webshop_gigpo.yaml20# project: roll-agenticCOMMENT
MEDIUM…2.5-7B-agentic_megatron/agentic_val_webshop_gigpo.yaml24# - agenticCOMMENT
MEDIUM…2.5-7B-agentic_megatron/agentic_val_webshop_gigpo.yaml32# project: roll-agenticCOMMENT
MEDIUM…2.5-7B-agentic_megatron/agentic_val_webshop_gigpo.yaml37# - agenticCOMMENT
MEDIUM…en2.5-7B-agentic_megatron/agentic_val_webshop_amd.yaml20# project: roll-agenticCOMMENT
MEDIUM…en2.5-7B-agentic_megatron/agentic_val_webshop_amd.yaml24# - agenticCOMMENT
MEDIUM…s/qwen2.5-7B-agentic_megatron/agentic_val_webshop.yaml20# project: roll-agenticCOMMENT
MEDIUM…s/qwen2.5-7B-agentic_megatron/agentic_val_webshop.yaml24# - agenticCOMMENT
MEDIUM…s/qwen2.5-7B-agentic_megatron/agentic_val_webshop.yaml32# project: roll-agenticCOMMENT
MEDIUM…s/qwen2.5-7B-agentic_megatron/agentic_val_webshop.yaml37# - agenticCOMMENT
MEDIUM…en3-30BA3B-agentic_fsdp2/agentic_val_sokoban_30a3.yaml25# project: roll-agenticCOMMENT
MEDIUM…en3-30BA3B-agentic_fsdp2/agentic_val_sokoban_30a3.yaml29# - agenticCOMMENT
MEDIUMexamples/qwen2.5-vl-3B-agentic/agentic_val_sokoban.yaml20# project: roll-agenticCOMMENT
MEDIUMexamples/qwen2.5-vl-3B-agentic/agentic_val_sokoban.yaml24# - agenticCOMMENT
MEDIUM…es/qwen2.5-0.5B-agentic/agentic_val_sokoban_gigpo.yaml20# project: roll-agenticCOMMENT
MEDIUM…es/qwen2.5-0.5B-agentic/agentic_val_sokoban_gigpo.yaml24# - agenticCOMMENT
MEDIUM…B-agentic/agent_val_frozen_lake-pg_var_is_correct.yaml20# project: roll-agenticCOMMENT
MEDIUM…B-agentic/agent_val_frozen_lake-pg_var_is_correct.yaml24# - agenticCOMMENT
MEDIUM…0.5B-agentic/agentic_val_sokoban_dynamic_batching.yaml20# project: roll-agenticCOMMENT
MEDIUM…0.5B-agentic/agentic_val_sokoban_dynamic_batching.yaml24# - agenticCOMMENT
MEDIUM…/qwen2.5-0.5B-agentic/agent_val_frozen_lake_gigpo.yaml20# project: roll-agenticCOMMENT
MEDIUM…/qwen2.5-0.5B-agentic/agent_val_frozen_lake_gigpo.yaml24# - agenticCOMMENT
MEDIUM…n2.5-0.5B-agentic/agent_val_frozen_lake_async_amd.yaml20# project: roll-agenticCOMMENT
MEDIUM…n2.5-0.5B-agentic/agent_val_frozen_lake_async_amd.yaml24# - agenticCOMMENT
MEDIUM…/qwen2.5-0.5B-agentic/agentic_val_sokoban_sandbox.yaml20# project: roll-agenticCOMMENT
MEDIUM…/qwen2.5-0.5B-agentic/agentic_val_sokoban_sandbox.yaml24# - agenticCOMMENT
MEDIUM…qwen2.5-0.5B-agentic/agent_val_frozen_lake-pg_var.yaml20# project: roll-agenticCOMMENT
MEDIUM…qwen2.5-0.5B-agentic/agent_val_frozen_lake-pg_var.yaml24# - agenticCOMMENT
MEDIUM…les/qwen2.5-0.5B-agentic/agentic_val_sokoban_lora.yaml20# project: roll-agenticCOMMENT
MEDIUM…les/qwen2.5-0.5B-agentic/agentic_val_sokoban_lora.yaml24# - agenticCOMMENT
MEDIUM…s/qwen2.5-0.5B-agentic/agentic_val_sokoban_native.yaml20# project: roll-agenticCOMMENT
MEDIUM…s/qwen2.5-0.5B-agentic/agentic_val_sokoban_native.yaml24# - agenticCOMMENT
MEDIUM…ples/qwen2.5-0.5B-agentic/agentic_rollout_sokoban.yaml16# project: roll-agenticCOMMENT
MEDIUM…ples/qwen2.5-0.5B-agentic/agentic_rollout_sokoban.yaml20# - agenticCOMMENT
MEDIUMexamples/qwen2.5-0.5B-agentic/agentic_val_sokoban.yaml20# project: roll-agenticCOMMENT
MEDIUMexamples/qwen2.5-0.5B-agentic/agentic_val_sokoban.yaml24# - agenticCOMMENT
MEDIUM…es/qwen2.5-0.5B-agentic/agent_val_frozen_lake_amd.yaml20# project: roll-agenticCOMMENT
MEDIUM…es/qwen2.5-0.5B-agentic/agent_val_frozen_lake_amd.yaml24# - agenticCOMMENT
MEDIUM…amples/qwen2.5-0.5B-agentic/agent_val_frozen_lake.yaml20# project: roll-agenticCOMMENT
MEDIUM…amples/qwen2.5-0.5B-agentic/agent_val_frozen_lake.yaml24# - agenticCOMMENT
MEDIUM…/qwen2.5-0.5B-agentic/agent_val_frozen_lake_async.yaml20# project: roll-agenticCOMMENT
MEDIUM…/qwen2.5-0.5B-agentic/agent_val_frozen_lake_async.yaml24# - agenticCOMMENT
MEDIUM…2.5-0.5B-agentic/agentic_val_sokoban_agent_runner.yaml20# project: roll-agenticCOMMENT
MEDIUM…2.5-0.5B-agentic/agentic_val_sokoban_agent_runner.yaml24# - agenticCOMMENT
MEDIUMexamples/agentic_deepeyes/deepeyes.yaml10# pipeline_cls defaults to roll.pipeline.agentic.agentic_pipeline.AgenticPipelineCOMMENT
MEDIUM…entic_demo/agent_val_frozen_lake_multi_nodes_demo.yaml20# project: roll-agenticCOMMENT
MEDIUM…entic_demo/agent_val_frozen_lake_multi_nodes_demo.yaml24# - agenticCOMMENT
MEDIUMexamples/agentic_demo/agent_val_sokoban_sandbox.yaml20# project: roll-agenticCOMMENT
MEDIUMexamples/agentic_demo/agent_val_sokoban_sandbox.yaml24# - agenticCOMMENT
27 more matches not shown…
Decorative Section Separators66 hits · 216 pts
SeverityFileLineSnippetContext
MEDIUM…ter/src/mcore_adapter/models/sequence_packing_mixin.py77 # ------------------------------------------------------------------COMMENT
MEDIUM…ter/src/mcore_adapter/models/sequence_packing_mixin.py79 # ------------------------------------------------------------------COMMENT
MEDIUM…ter/src/mcore_adapter/models/sequence_packing_mixin.py308 # ------------------------------------------------------------------COMMENT
MEDIUM…ter/src/mcore_adapter/models/sequence_packing_mixin.py310 # ------------------------------------------------------------------COMMENT
MEDIUM…/pipeline/agentic/proxy/router/ingress_proxy_router.py85 # ------------------------------------------------------------------COMMENT
MEDIUM…/pipeline/agentic/proxy/router/ingress_proxy_router.py87 # ------------------------------------------------------------------COMMENT
MEDIUM…/pipeline/agentic/proxy/router/ingress_proxy_router.py197 # ------------------------------------------------------------------COMMENT
MEDIUM…/pipeline/agentic/proxy/router/ingress_proxy_router.py199 # ------------------------------------------------------------------COMMENT
MEDIUMroll/pipeline/agentic/proxy/router/alb_proxy_router.py1186# ---------------------------------------------------------------------------COMMENT
MEDIUMroll/pipeline/agentic/proxy/router/alb_proxy_router.py1188# ---------------------------------------------------------------------------COMMENT
MEDIUM…ipeline/agentic/agent_runner/rock/rock_agent_runner.py69 # ------------------------------------------------------------------COMMENT
MEDIUM…ipeline/agentic/agent_runner/rock/rock_agent_runner.py71 # ------------------------------------------------------------------COMMENT
MEDIUM…ipeline/agentic/agent_runner/rock/rock_agent_runner.py85 # ------------------------------------------------------------------COMMENT
MEDIUM…ipeline/agentic/agent_runner/rock/rock_agent_runner.py87 # ------------------------------------------------------------------COMMENT
MEDIUM…ipeline/agentic/agent_runner/rock/rock_agent_runner.py108 # ------------------------------------------------------------------COMMENT
MEDIUM…ipeline/agentic/agent_runner/rock/rock_agent_runner.py110 # ------------------------------------------------------------------COMMENT
MEDIUM…ipeline/agentic/agent_runner/rock/rock_agent_runner.py159 # ------------------------------------------------------------------COMMENT
MEDIUM…ipeline/agentic/agent_runner/rock/rock_agent_runner.py161 # ------------------------------------------------------------------COMMENT
MEDIUM…ipeline/agentic/agent_runner/rock/rock_agent_runner.py301 # ------------------------------------------------------------------COMMENT
MEDIUM…ipeline/agentic/agent_runner/rock/rock_agent_runner.py303 # ------------------------------------------------------------------COMMENT
MEDIUMroll/distributed/scheduler/remote_protocol.py254 # ============================================================================COMMENT
MEDIUMroll/distributed/scheduler/remote_protocol.py259 # ============================================================================COMMENT
MEDIUMroll/utils/fsdp_utils.py474# ============================================================================COMMENT
MEDIUMroll/utils/fsdp_utils.py481# ============================================================================COMMENT
MEDIUMroll/models/model_providers.py201 # ---------------------------------------------------------------------STRING
MEDIUMroll/third_party/fsdp2/tiled_mlp.py166# ============================================================================COMMENT
MEDIUMroll/third_party/fsdp2/tiled_mlp.py168# ============================================================================COMMENT
MEDIUMroll/third_party/vllm/gdn_patcher.py210 # ================================================================COMMENT
MEDIUMroll/third_party/vllm/gdn_patcher.py213 # ================================================================COMMENT
MEDIUMroll/third_party/vllm/gdn_patcher.py219 # ================================================================COMMENT
MEDIUMroll/third_party/megatron/mtp_patcher.py47 # ============================================================================COMMENT
MEDIUMroll/third_party/megatron/mtp_patcher.py49 # ============================================================================COMMENT
MEDIUMroll/third_party/megatron/mtp_patcher.py222 # ============================================================================COMMENT
MEDIUMroll/third_party/megatron/mtp_patcher.py224 # ============================================================================COMMENT
MEDIUMroll/third_party/megatron/mtp_patcher.py285 # ============================================================================COMMENT
MEDIUMroll/third_party/megatron/mtp_patcher.py287 # ============================================================================COMMENT
MEDIUMroll/third_party/megatron/util.py65 # ----------------------------------------------------------------------------COMMENT
MEDIUMroll/third_party/megatron/util.py68 # ----------------------------------------------------------------------------COMMENT
MEDIUMroll/third_party/megatron/util.py136 # -------------------------------------------------------------------------COMMENT
MEDIUMroll/third_party/megatron/util.py139 # -------------------------------------------------------------------------COMMENT
MEDIUM…ted/strategy/log_probs/test_fsdp_vlm_log_probs_perf.py72 # ------------------------------------------------------------------COMMENT
MEDIUM…ts/distributed/strategy/log_probs/apply_model_patch.py512# -----------------------------COMMENT
MEDIUM…ts/distributed/strategy/log_probs/apply_model_patch.py514# -----------------------------COMMENT
MEDIUM…ts/distributed/strategy/log_probs/apply_model_patch.py526 # -------------------------COMMENT
MEDIUM…ts/distributed/strategy/log_probs/apply_model_patch.py529 # -------------------------COMMENT
MEDIUM…ts/distributed/strategy/log_probs/apply_model_patch.py577 # -------------------------COMMENT
MEDIUM…ts/distributed/strategy/log_probs/apply_model_patch.py581 # -------------------------COMMENT
MEDIUM…tributed/strategy/log_probs/test_fsdp_vlm_log_probs.py43 # ------------------------------------------------------------------COMMENT
MEDIUMexamples/docs_examples/example_grpo.yaml38# --------------------------COMMENT
MEDIUMexamples/docs_examples/example_grpo.yaml73# --------------------------COMMENT
MEDIUMexamples/docs_examples/example_ppo.yaml38# --------------------------COMMENT
MEDIUMexamples/docs_examples/example_ppo.yaml44# --------------------------COMMENT
MEDIUMexamples/docs_examples/example_ppo.yaml77# --------------------------COMMENT
MEDIUMexamples/docs_examples/example_raft_pp.yaml38# --------------------------COMMENT
MEDIUMexamples/docs_examples/example_raft_pp.yaml73# --------------------------COMMENT
MEDIUMexamples/docs_examples/example_raft_pp.yaml91# --------------------------COMMENT
MEDIUMexamples/docs_examples/example_reinforce_pp.yaml38# --------------------------COMMENT
MEDIUMexamples/docs_examples/example_reinforce_pp.yaml73# --------------------------COMMENT
MEDIUMexamples/docs_examples/example_reinforce_pp.yaml91# --------------------------COMMENT
MEDIUMexamples/docs_examples/example_gspo.yaml38# --------------------------COMMENT
6 more matches not shown…
Excessive Try-Catch Wrapping188 hits · 215 pts
SeverityFileLineSnippetContext
LOWmcore_adapter/src/mcore_adapter/training_args.py281 except Exception as e:CODE
LOWmcore_adapter/src/mcore_adapter/utils.py76 except Exception:CODE
LOW…r/src/mcore_adapter/models/converter/post_converter.py159 except Exception as e:CODE
LOW…r/src/mcore_adapter/models/converter/post_converter.py784 except Exception as e:CODE
LOWroll/pipeline/base_pipeline.py183 except Exception as e:CODE
LOWroll/pipeline/rlvr/rlvr_pipeline.py446 except Exception as e:CODE
LOWroll/pipeline/rlvr/actor_worker.py187 except Exception as e:CODE
LOWroll/pipeline/rlvr/rewards/video_r1_reward_worker.py44 except Exception as e:CODE
MEDIUMroll/pipeline/rlvr/rewards/video_r1_reward_worker.py45 print(f"Error converting '{num_str}' to float: {e}")CODE
MEDIUMroll/pipeline/rlvr/rewards/video_r1_reward_worker.py40def normalize_number(num_str):CODE
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py1160 except Exception:CODE
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py1279 except Exception:CODE
LOW…vr/rewards/multiple_choice_boxed_rule_reward_worker.py143 except Exception as e:CODE
LOW…l/pipeline/rlvr/rewards/remote_reward_system_worker.py165 except Exception as e:CODE
LOW…l/pipeline/rlvr/rewards/remote_reward_system_worker.py211 except Exception as e:CODE
LOW…l/pipeline/rlvr/rewards/remote_reward_system_worker.py258 except Exception as e:CODE
LOWroll/pipeline/rlvr/rewards/ifeval_rule_reward_worker.py629 except Exception as e:CODE
LOWroll/pipeline/rlvr/rewards/math_rule_reward_worker.py179 except Exception as e:CODE
LOWroll/pipeline/rlvr/rewards/math_rule_reward_worker.py197 except Exception as e:CODE
LOWroll/pipeline/rlvr/rewards/math_rule_reward_worker.py292 except Exception as e:CODE
MEDIUMroll/pipeline/rlvr/rewards/math_rule_reward_worker.py126def _hf_verify_math_sample(response, answer, result, prompt):CODE
LOW…peline/rlvr/rewards/crossthinkqa_rule_reward_worker.py230 except Exception as e:CODE
LOW…ipeline/rlvr/rewards/general_val_rule_reward_worker.py164 except Exception as e:CODE
LOWroll/pipeline/rlvr/rewards/llm_judge_reward_worker.py99 except Exception as e:CODE
LOWroll/pipeline/rlvr/rewards/llm_judge_reward_worker.py148 except Exception as e:CODE
LOWroll/pipeline/rlvr/rewards/llm_judge_reward_worker.py162 except Exception as e:CODE
MEDIUM…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py621 print(f"Error executing test case: {e}")CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py200 except Exception as e:CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py249 except Exception as e:CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py288 except Exception as e:CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py354 except Exception as e: # Added specific exception typeCODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py525 except Exception as e:CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py586 except Exception as e:CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py620 except Exception as e:CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py704 except Exception as e:CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py770 except Exception as e:CODE
LOWroll/pipeline/distill/distill_vlm_pipeline.py66 except Exception as e:CODE
LOWroll/pipeline/agentic/utils.py55 except Exception as e:CODE
LOWroll/pipeline/agentic/utils.py277 except Exception as e:CODE
MEDIUMroll/pipeline/agentic/utils.py279 print(f"Error saving gif: {e}")CODE
LOWroll/pipeline/agentic/environment_worker.py124 except Exception as e:CODE
LOWroll/pipeline/agentic/tools/action_parser.py62 except Exception:CODE
LOWroll/pipeline/agentic/tools/action_parser.py75 except Exception:CODE
LOWroll/pipeline/agentic/tools/action_parser.py102 except Exception as e:CODE
LOWroll/pipeline/agentic/tools/action_parser.py131 except Exception as e:CODE
LOWroll/pipeline/agentic/tools/action_parser.py149 except Exception as e:CODE
LOWroll/pipeline/agentic/tools/mcp_tool.py128 except Exception as e:CODE
LOWroll/pipeline/agentic/tools/mcp_tool.py148 except Exception as e:CODE
LOWroll/pipeline/agentic/proxy/proxy_server.py82 except Exception as e:CODE
LOWroll/pipeline/agentic/proxy/proxy_server.py131 except Exception as e:CODE
LOW…/pipeline/agentic/proxy/router/ingress_proxy_router.py370 except Exception as e:CODE
MEDIUM…/pipeline/agentic/proxy/router/ingress_proxy_router.py371 print(f"Error: {e}")CODE
MEDIUMroll/pipeline/agentic/proxy/router/alb_proxy_router.py1182 print(f"Error: {e}")CODE
MEDIUMroll/pipeline/agentic/proxy/router/alb_proxy_router.py1131 print(f"Error occurred while listing rules: {error.message if hasattr(error, 'message') else str(error)}")CODE
LOWroll/pipeline/agentic/proxy/router/alb_proxy_router.py709 except Exception as e:CODE
LOWroll/pipeline/agentic/proxy/router/alb_proxy_router.py1181 except Exception as e:CODE
LOWroll/pipeline/agentic/proxy/router/alb_proxy_router.py440 except Exception as e:CODE
LOWroll/pipeline/agentic/proxy/router/alb_proxy_router.py498 except Exception as e:CODE
LOWroll/pipeline/agentic/proxy/router/alb_proxy_router.py617 except Exception as e:CODE
LOWroll/pipeline/agentic/proxy/router/alb_proxy_router.py762 except Exception as e:CODE
128 more matches not shown…
Deep Nesting189 hits · 181 pts
SeverityFileLineSnippetContext
LOWmcore_adapter/src/mcore_adapter/patcher.py85CODE
LOWmcore_adapter/src/mcore_adapter/patcher.py91CODE
LOWmcore_adapter/src/mcore_adapter/models/model_config.py54CODE
LOWmcore_adapter/src/mcore_adapter/models/model_factory.py58CODE
LOWmcore_adapter/src/mcore_adapter/models/model_factory.py92CODE
LOW…dapter/src/mcore_adapter/models/qwen3_next/__init__.py98CODE
LOW…r/src/mcore_adapter/models/converter/post_converter.py96CODE
LOW…r/src/mcore_adapter/models/converter/post_converter.py280CODE
LOW…r/src/mcore_adapter/models/converter/dist_converter.py552CODE
LOW…r/src/mcore_adapter/models/converter/dist_converter.py586CODE
LOW…adapter/src/mcore_adapter/models/converter/template.py96CODE
LOW…adapter/src/mcore_adapter/models/converter/template.py570CODE
LOW…/src/mcore_adapter/models/converter/model_converter.py138CODE
LOW…/src/mcore_adapter/models/converter/model_converter.py165CODE
LOW…mcore_adapter/models/qwen2_5_vl/modeling_qwen2_5_vl.py178CODE
LOW…apter/src/mcore_adapter/models/qwen3_5_moe/__init__.py83CODE
LOW…src/mcore_adapter/models/qwen2_vl/modeling_qwen2_vl.py177CODE
LOW…e_adapter/src/mcore_adapter/models/qwen3_5/__init__.py182CODE
LOW…src/mcore_adapter/models/qwen3_vl/transformer_block.py38CODE
LOW…src/mcore_adapter/models/qwen3_vl/transformer_block.py175CODE
LOW…dapter/src/mcore_adapter/models/qwen3_vl/rope_utils.py182CODE
LOWmcore_adapter/src/mcore_adapter/adapters/utils.py20CODE
LOWmcore_adapter/src/mcore_adapter/adapters/lora_layer.py531CODE
LOWmcore_adapter/src/mcore_adapter/adapters/lora_layer.py143CODE
LOWmcore_adapter/src/mcore_adapter/adapters/lora_layer.py207CODE
LOWmcore_adapter/src/mcore_adapter/adapters/lora_layer.py262CODE
LOWmcore_adapter/src/mcore_adapter/adapters/lora_layer.py352CODE
LOWmcore_adapter/src/mcore_adapter/trainer/trainer.py409CODE
LOWmcore_adapter/src/mcore_adapter/trainer/trainer.py627CODE
LOWmcore_adapter/src/mcore_adapter/trainer/trainer.py808CODE
LOWmcore_adapter/src/mcore_adapter/trainer/trainer.py949CODE
LOWmcore_adapter/src/mcore_adapter/trainer/dpo_trainer.py263CODE
LOWroll/pipeline/base_worker.py63CODE
LOWroll/pipeline/base_pipeline.py139CODE
LOWroll/pipeline/base_pipeline.py186CODE
LOWroll/pipeline/rlvr/rlvr_pipeline.py459CODE
LOWroll/pipeline/rlvr/actor_pg_worker.py26CODE
LOWroll/pipeline/rlvr/actor_pg_worker.py444CODE
LOWroll/pipeline/rlvr/rlvr_config.py157CODE
LOWroll/pipeline/rlvr/rlvr_vlm_pipeline.py329CODE
LOWroll/pipeline/rlvr/actor_worker.py169CODE
LOWroll/pipeline/rlvr/rewards/video_r1_reward_worker.py32CODE
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py1031CODE
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py1112CODE
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py214CODE
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py301CODE
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py673CODE
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py753CODE
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py1199CODE
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py1640CODE
LOW…l/pipeline/rlvr/rewards/remote_reward_system_worker.py185CODE
LOWroll/pipeline/rlvr/rewards/ifeval_rule_reward_worker.py44CODE
LOWroll/pipeline/rlvr/rewards/math_rule_reward_worker.py40CODE
LOWroll/pipeline/rlvr/rewards/math_rule_reward_worker.py184CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py37CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py479CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py536CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py656CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py143CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py206CODE
129 more matches not shown…
Docstring Block Structure32 hits · 160 pts
SeverityFileLineSnippetContext
HIGHmcore_adapter/src/mcore_adapter/platforms/platform.py163 Generate the runtime environment variables required for vLLM execution on the specified GPU rank. STRING
HIGH…src/mcore_adapter/parallel_functions/fused_logprobs.py261 Fused log_probs forward pass with in-place output tensors. Args: x: Input logits tensor of shape (M, NSTRING
HIGH…src/mcore_adapter/parallel_functions/fused_logprobs.py578 Entropy backward pass using fused kernel. This function computes the gradient of entropy with respect to the iSTRING
HIGH…l/pipeline/rlvr/rewards/remote_reward_system_worker.py410 Normalize various input data formats into a uniform reward reference format. Args: data (DSTRING
HIGHroll/pipeline/agentic/proxy/router/alb_proxy_router.py44 Select an ALB load balancer ID from a comma-separated list based on hash of job_name and listen_port. This funSTRING
HIGHroll/pipeline/agentic/proxy/router/alb_proxy_router.py98 Discover all ALBs in the current region and set them to environment variable ALB_LOAD_BALANCER_IDS. This functSTRING
HIGHroll/pipeline/agentic/proxy/router/alb_proxy_router.py400 Poll listener status until it reaches target state. Args: client: ALB client instance listenerSTRING
HIGHroll/pipeline/agentic/proxy/router/alb_proxy_router.py459 Poll server group status until it reaches target state. Args: client: ALB client instance servSTRING
HIGHroll/pipeline/agentic/proxy/router/alb_proxy_router.py803 Save server group ID or listener ID to a file in ALB_RESOURCE_CLEAN_DIR. Args: resource_id: Resource ISTRING
HIGHroll/pipeline/agentic/proxy/router/alb_proxy_router.py991 Poll rule status until it reaches target state. Args: client: ALB client instance rule_id: RulSTRING
HIGHroll/pipeline/agentic/llm_proxy/proxy_utils.py28 Generate text through proxy with support for multimodal inputs. This function formats messages using chat tempSTRING
HIGHroll/pipeline/agentic/env_manager/proxy_env_manager.py184 Core inference handler shared by Push (HTTP) and Pull (ModelService) modes. Args: body: PaSTRING
HIGHroll/platforms/platform.py167 Generate the runtime environment variables required for vLLM execution on the specified GPU rank. STRING
HIGHroll/distributed/scheduler/rollout_mock_mixin.py162 Load pre-recorded DataProto from disk (strict mode). Args: global_step: Current training sSTRING
HIGHroll/distributed/scheduler/protocol.py594 Slice the DataProto and return a new DataProto object. Args: start (int, optional): Start STRING
HIGHroll/distributed/scheduler/rollout_scheduler.py703Thin wrapper: Delegate shrink operation to RequestScheduler. v4.6 ARCHITECTURAL CHANGE: RolloutScheduler no lonSTRING
HIGHroll/distributed/scheduler/rollout_scheduler.py744Thin wrapper: Delegate expand operation to RequestScheduler. v4.6 ARCHITECTURAL CHANGE: RolloutScheduler no lonSTRING
HIGHroll/distributed/scheduler/router.py321Complete atomic shrink operation: validate → rebalance → offload → update routing. Orchestrates the full workerSTRING
HIGHroll/distributed/scheduler/router.py381Complete atomic expand operation: validate → load → rebalance → update routing. Orchestrates the full worker exSTRING
HIGHroll/distributed/scheduler/router.py1031Abort requests on shrinking workers, clear mappings for natural re-dispatch. Args: shrink_dp_ranks:STRING
HIGHroll/distributed/scheduler/router.py1066Internal implementation of shrink rebalancing. PRE-CONDITION: routing_lock MUST be held by caller (shrink_workeSTRING
HIGHroll/distributed/scheduler/router.py1137Add workers and rebalance via src_rank-level abort. Args: expand_dp_ranks: DP ranks to add to activSTRING
HIGHroll/distributed/scheduler/router.py1170Internal implementation of expand rebalancing. PRE-CONDITION: routing_lock MUST be held by caller (expand_workeSTRING
HIGHroll/distributed/strategy/strategy.py240 Compute divergence loss between student and teacher distributions with support for distributed training. STRING
HIGHroll/utils/sequence_packing.py129 Split mini_batch into micro batches with sequence packing strategy. This function: 1. CalculatSTRING
HIGHroll/utils/hash_utils.py7 Compute the SHA256 hash of a Python object. This function handles basic types, None, lists, tuples, dictionarieSTRING
HIGHroll/utils/qwen_vl_utils.py154calculate the number of frames for video used for model inputs. Args: ele (dict): a dict contains the confiSTRING
HIGHroll/utils/qwen_vl_utils.py244 Calculate the start and end frame indices based on the given time range. Args: ele (dict): A dictionarSTRING
HIGHroll/utils/config_utils.py16 Calculate the data parallel size for Megatron. Megatron uses: DP = Total_GPUs / (TP × PP × CP × EP) STRING
HIGHroll/third_party/megatron/fused_entropy.py450 Fused entropy forward pass with in-place output tensors. This function computes the entropy of each row in theSTRING
HIGHroll/third_party/megatron/fused_entropy.py781 Entropy backward pass using fused kernel. This function computes the gradient of entropy with respect to the iSTRING
HIGHroll/third_party/megatron/router_replay_utils.py169 Reorder and merge per-VPP layer blocks into a contiguous layer dimension. Given a tensor shaped as [bs*vpp_sizSTRING
Cross-File Repetition30 hits · 150 pts
SeverityFileLineSnippetContext
HIGHmcore_adapter/src/mcore_adapter/platforms/rocm.py0update environment variables to control device visibility. args: env_vars (dict): dictionary of current environment variSTRING
HIGHmcore_adapter/src/mcore_adapter/platforms/platform.py0update environment variables to control device visibility. args: env_vars (dict): dictionary of current environment variSTRING
HIGHroll/platforms/rocm.py0update environment variables to control device visibility. args: env_vars (dict): dictionary of current environment variSTRING
HIGHroll/platforms/platform.py0update environment variables to control device visibility. args: env_vars (dict): dictionary of current environment variSTRING
HIGH…mcore_adapter/models/qwen2_5_vl/modeling_qwen2_5_vl.py0inputs_embeds: [s, b, h] or [s/tp, b, h] when sequence parallel ranges: sequence rangeSTRING
HIGH…mcore_adapter/models/qwen3_omni/modeling_qwen3_omni.py0inputs_embeds: [s, b, h] or [s/tp, b, h] when sequence parallel ranges: sequence rangeSTRING
HIGH…src/mcore_adapter/models/qwen2_vl/modeling_qwen2_vl.py0inputs_embeds: [s, b, h] or [s/tp, b, h] when sequence parallel ranges: sequence rangeSTRING
HIGH…r/src/mcore_adapter/models/qwen3_5/modeling_qwen3_5.py0inputs_embeds: [s, b, h] or [s/tp, b, h] when sequence parallel ranges: sequence rangeSTRING
HIGH…mcore_adapter/models/qwen2_5_vl/modeling_qwen2_5_vl.py0calculate split plan and local data according to workload, assuming workload proportional to length args: input_lengths STRING
HIGH…src/mcore_adapter/models/qwen2_vl/modeling_qwen2_vl.py0calculate split plan and local data according to workload, assuming workload proportional to length args: input_lengths STRING
HIGH…r/src/mcore_adapter/models/qwen3_5/modeling_qwen3_5.py0calculate split plan and local data according to workload, assuming workload proportional to length args: input_lengths STRING
HIGH…src/mcore_adapter/models/qwen3_vl/modeling_qwen3_vl.py0calculate split plan and local data according to workload, assuming workload proportional to length args: input_lengths STRING
HIGHroll/pipeline/base_worker.py0loss func接口定义: data: dataproto, 由train_step透传 output_tensor: torch.tensor, model.forward()的输出tensorSTRING
HIGHroll/pipeline/rlvr/actor_pg_worker.py0loss func接口定义: data: dataproto, 由train_step透传 output_tensor: torch.tensor, model.forward()的输出tensorSTRING
HIGHroll/pipeline/rlvr/actor_worker.py0loss func接口定义: data: dataproto, 由train_step透传 output_tensor: torch.tensor, model.forward()的输出tensorSTRING
HIGHroll/pipeline/agentic/agentic_actor_pg_worker.py0loss func接口定义: data: dataproto, 由train_step透传 output_tensor: torch.tensor, model.forward()的输出tensorSTRING
HIGHroll/pipeline/agentic/agentic_actor_worker.py0loss func接口定义: data: dataproto, 由train_step透传 output_tensor: torch.tensor, model.forward()的输出tensorSTRING
HIGHroll/pipeline/dpo/actor_worker.py0loss func接口定义: data: dataproto, 由train_step透传 output_tensor: torch.tensor, model.forward()的输出tensorSTRING
HIGH…vr/rewards/multiple_choice_boxed_rule_reward_worker.py0提取输入字符串中最后一个"end_think"标签之后的内容, 并移除结果字符串开头的所有换行符。 args: input_string: 原始字符串。 returns: 提取并处理后的字符串。如果未找到"end_think"标签,则返回空STRING
HIGH…peline/rlvr/rewards/crossthinkqa_rule_reward_worker.py0提取输入字符串中最后一个"end_think"标签之后的内容, 并移除结果字符串开头的所有换行符。 args: input_string: 原始字符串。 returns: 提取并处理后的字符串。如果未找到"end_think"标签,则返回空STRING
HIGH…ipeline/rlvr/rewards/general_val_rule_reward_worker.py0提取输入字符串中最后一个"end_think"标签之后的内容, 并移除结果字符串开头的所有换行符。 args: input_string: 原始字符串。 returns: 提取并处理后的字符串。如果未找到"end_think"标签,则返回空STRING
HIGHroll/pipeline/rlvr/rewards/ifeval_rule_reward_worker.py0一个示例 reward worker,用于执行 ifeval 验证并把每个 func 的结果放到 output.tensors 中。 在此示例里,ground_truths的strSTRING
HIGH…peline/rlvr/rewards/crossthinkqa_rule_reward_worker.py0一个示例 reward worker,用于执行 ifeval 验证并把每个 func 的结果放到 output.tensors 中。 在此示例里,ground_truths的strSTRING
HIGH…ipeline/rlvr/rewards/general_val_rule_reward_worker.py0一个示例 reward worker,用于执行 ifeval 验证并把每个 func 的结果放到 output.tensors 中。 在此示例里,ground_truths的strSTRING
HIGHroll/pipeline/agentic/env_manager/base_env_manager.py01. each time run_rollout_loop is called, it will continuously play episodes until it receives a command that data collecSTRING
HIGHroll/pipeline/agentic/env_manager/traj_env_manager.py01. each time run_rollout_loop is called, it will continuously play episodes until it receives a command that data collecSTRING
HIGH…ll/pipeline/agentic/env_manager/vl_traj_env_manager.py01. each time run_rollout_loop is called, it will continuously play episodes until it receives a command that data collecSTRING
HIGHroll/distributed/strategy/megatron_strategy.py0input_ids [[p, p, r, r, r, 0, 0]] p: prompt, r: response, 0: pad response_mask [[0, 0, 1, 1, 1, 0, 0]]STRING
HIGHroll/distributed/strategy/fsdp2_strategy.py0input_ids [[p, p, r, r, r, 0, 0]] p: prompt, r: response, 0: pad response_mask [[0, 0, 1, 1, 1, 0, 0]]STRING
HIGHroll/models/func_providers.py0input_ids [[p, p, r, r, r, 0, 0]] p: prompt, r: response, 0: pad response_mask [[0, 0, 1, 1, 1, 0, 0]]STRING
Structural Annotation Overuse75 hits · 130 pts
SeverityFileLineSnippetContext
LOWroll/pipeline/agentic/agentic_pipeline.py268 # Step 0: active_dp_ranks initialized with all ranks {0,1,2,3}, no expand neededCOMMENT
LOWroll/pipeline/agentic/tools/mcp_tool.py339 # Step 1: Find the schema for the requested tool.STRING
LOWroll/pipeline/agentic/tools/mcp_tool.py347 # Step 2: Use the jsonschema library to validate the parameters.STRING
LOWroll/utils/sequence_packing.py206 # Step 4: Round up to be divisible by vp_sizeCOMMENT
LOWroll/utils/sequence_packing.py210 # Step 5: Calculate workload for load balancingCOMMENT
LOWroll/utils/sequence_packing.py215 # Step 6: Partition samples into micro batches with balanced workloadCOMMENT
LOWroll/utils/sequence_packing.py222 # Step 7: Sort and reorder for better pipeline schedulingCOMMENT
LOWroll/utils/sequence_packing.py179 # Step 2: Calculate initial number of micro batchesCOMMENT
LOWroll/utils/sequence_packing.py192 # Step 3: Synchronize across DP ranks (all ranks must have same count)COMMENT
LOWroll/utils/sequence_packing.py245 # Step 8: Generate micro batchesCOMMENT
LOWroll/configs/base_config.py690 # Step 1: Normalize teacher to _reference_configs dict (always Dict[str, WorkerConfig])COMMENT
LOWroll/configs/base_config.py711 # Step 2: Pure OPD modeCOMMENT
LOWroll/configs/base_config.py732 # Step 3: Mixed OPD modeCOMMENT
LOW…s_roll/docs/User Guides/Pipeline/dpo_pipeline_start.md188### Step 1: Configure SettingsCOMMENT
LOW…s_roll/docs/User Guides/Pipeline/dpo_pipeline_start.md198### Step 2: Prepare Environment and DependenciesCOMMENT
LOW…s_roll/docs/User Guides/Pipeline/dpo_pipeline_start.md210### Step 3: Launch the PipelineCOMMENT
LOW…s_roll/docs/User Guides/Pipeline/dpo_pipeline_start.md218### Step 4: MonitoringCOMMENT
LOW…s_roll/docs/User Guides/Pipeline/dpo_pipeline_start.md228### Step 5: Outputs and ResultsCOMMENT
LOW…ll/docs/User Guides/Pipeline/distill_pipeline_start.md193### Step 1: Configure SettingsCOMMENT
LOW…ll/docs/User Guides/Pipeline/distill_pipeline_start.md203### Step 2: Prepare Environment and DependenciesCOMMENT
LOW…ll/docs/User Guides/Pipeline/distill_pipeline_start.md215### Step 3: Launch the PipelineCOMMENT
LOW…ll/docs/User Guides/Pipeline/distill_pipeline_start.md223### Step 4: MonitoringCOMMENT
LOW…ll/docs/User Guides/Pipeline/distill_pipeline_start.md233### Step 5: Outputs and ResultsCOMMENT
LOW…ll/docs/User Guides/Pipeline/vl_rlvr_pipeline_start.md287### Step 1: Configure SettingsCOMMENT
LOW…ll/docs/User Guides/Pipeline/vl_rlvr_pipeline_start.md298### Step 2: Prepare Environment and DependenciesCOMMENT
LOW…ll/docs/User Guides/Pipeline/vl_rlvr_pipeline_start.md310### Step 3: Launch the PipelineCOMMENT
LOW…ll/docs/User Guides/Pipeline/vl_rlvr_pipeline_start.md318### Step 4: MonitoringCOMMENT
LOW…ll/docs/User Guides/Pipeline/vl_rlvr_pipeline_start.md328### Step 5: Outputs and ResultsCOMMENT
LOW…ll/docs/User Guides/Pipeline/agentic_pipeline_start.md205### Step 1: Configuration SetupCOMMENT
LOW…ll/docs/User Guides/Pipeline/agentic_pipeline_start.md216### Step 2: Environment and Dependency PreparationCOMMENT
LOW…ll/docs/User Guides/Pipeline/agentic_pipeline_start.md228### Step 3: Starting the PipelineCOMMENT
LOW…ll/docs/User Guides/Pipeline/agentic_pipeline_start.md236### Step 4: MonitoringCOMMENT
LOW…ll/docs/User Guides/Pipeline/agentic_pipeline_start.md246### Step 5: Output and ResultsCOMMENT
LOW…er Guides/Pipeline/on_policy_distill_pipeline_start.md348### Step 1: Configuration SetupCOMMENT
LOW…er Guides/Pipeline/on_policy_distill_pipeline_start.md359### Step 2: Prepare Environment and DependenciesCOMMENT
LOW…er Guides/Pipeline/on_policy_distill_pipeline_start.md371### Step 3: Launch the PipelineCOMMENT
LOW…er Guides/Pipeline/on_policy_distill_pipeline_start.md379### Step 4: MonitoringCOMMENT
LOW…er Guides/Pipeline/on_policy_distill_pipeline_start.md389### Step 5: Outputs and ResultsCOMMENT
LOW…s_roll/docs/User Guides/Pipeline/sft_pipeline_start.md215### Step 1: ConfigurationCOMMENT
LOW…s_roll/docs/User Guides/Pipeline/sft_pipeline_start.md228### Step 2: Prepare Environment and DependenciesCOMMENT
LOW…s_roll/docs/User Guides/Pipeline/sft_pipeline_start.md239### Step 3: Launch the PipelineCOMMENT
LOW…s_roll/docs/User Guides/Pipeline/sft_pipeline_start.md247### Step 4: MonitoringCOMMENT
LOW…s_roll/docs/User Guides/Pipeline/sft_pipeline_start.md256### Step 5: Outputs and ResultsCOMMENT
LOW…_roll/docs/User Guides/Pipeline/rlvr_pipeline_start.md301### Step 1: Configure SettingsCOMMENT
LOW…_roll/docs/User Guides/Pipeline/rlvr_pipeline_start.md312### Step 2: Prepare Environment and DependenciesCOMMENT
LOW…_roll/docs/User Guides/Pipeline/rlvr_pipeline_start.md324### Step 3: Launch the PipelineCOMMENT
LOW…_roll/docs/User Guides/Pipeline/rlvr_pipeline_start.md332### Step 4: MonitoringCOMMENT
LOW…_roll/docs/User Guides/Pipeline/rlvr_pipeline_start.md342### Step 5: Outputs and ResultsCOMMENT
LOW…l/docs/User Guides/Hardware Support/ascend_npu_rlvr.md15## Step 1: Environment SetupCOMMENT
LOW…l/docs/User Guides/Hardware Support/ascend_npu_rlvr.md96## Step 2: Data PreparationCOMMENT
LOW…l/docs/User Guides/Hardware Support/ascend_npu_rlvr.md185## Step 3: Model PreparationCOMMENT
LOW…l/docs/User Guides/Hardware Support/ascend_npu_rlvr.md219## Step 4: Write the NPU ConfigurationCOMMENT
LOW…l/docs/User Guides/Hardware Support/ascend_npu_rlvr.md465## Step 5: Launch TrainingCOMMENT
LOW…l/docs/User Guides/Hardware Support/ascend_npu_rlvr.md642## Step 6: Monitor & EvaluateCOMMENT
LOW…l/docs/User Guides/Hardware Support/ascend_npu_rlvr.md687## Step 7: Resume from CheckpointCOMMENT
LOW…cs/User Guides/Hardware Support/ascend_npu_examples.md32### Step 1: Start the ContainerCOMMENT
LOW…cs/User Guides/Hardware Support/ascend_npu_examples.md62### Step 2: Set Environment VariablesCOMMENT
LOW…cs/User Guides/Hardware Support/ascend_npu_examples.md99### Step 3: Create NPU Configuration FileCOMMENT
LOW…cs/User Guides/Hardware Support/ascend_npu_examples.md256### Step 4: LaunchCOMMENT
LOW…cs/User Guides/Hardware Support/ascend_npu_examples.md463### Step 1: Start Containers on All NodesCOMMENT
15 more matches not shown…
Hallucination Indicators12 hits · 120 pts
SeverityFileLineSnippetContext
CRITICALroll/pipeline/rlvr/rlvr_pipeline.py162 for domain in self.pipeline_config.actor_train.data_args.domain_interleave_probs.keys():CODE
CRITICALroll/pipeline/rlvr/rlvr_pipeline.py633 self.pipeline_config.actor_train.strategy_args.strategy_config.get("pipeline_model_paralCODE
CRITICALroll/pipeline/rlvr/rlvr_pipeline.py634 self.pipeline_config.actor_train.strategy_args.strategy_config.get("virtual_pipeline_modCODE
CRITICALroll/pipeline/rlvr/rlvr_pipeline.py788 self.pipeline_config.actor_train.strategy_args.strategy_config.get("pipeline_model_pCODE
CRITICALroll/pipeline/rlvr/rlvr_pipeline.py789 self.pipeline_config.actor_train.strategy_args.strategy_config.get("virtual_pipelineCODE
CRITICALroll/pipeline/rlvr/rlvr_rollout_pipeline.py35 assert self.pipeline_config.actor_infer.strategy_args.strategy_config.get("load_format", "dummy") != "dummy"CODE
CRITICALroll/pipeline/rlvr/rlvr_rollout_pipeline.py39 assert self.pipeline_config.actor_infer.strategy_args.strategy_config.get("sleep_level", 1) == 1, (CODE
CRITICALroll/pipeline/rlvr/rlvr_vlm_pipeline.py152 for domain in self.pipeline_config.actor_train.data_args.domain_interleave_probs.keys():CODE
CRITICALroll/pipeline/agentic/agentic_pipeline.py428 self.pipeline_config.actor_train.strategy_args.strategy_config.get("pipeline_model_pCODE
CRITICALroll/pipeline/agentic/agentic_pipeline.py429 self.pipeline_config.actor_train.strategy_args.strategy_config.get("virtual_pipelineCODE
CRITICALroll/pipeline/agentic/agentic_pipeline.py537 self.pipeline_config.actor_train.strategy_args.strategy_config.get("pipeline_model_pCODE
CRITICALroll/pipeline/agentic/agentic_pipeline.py538 self.pipeline_config.actor_train.strategy_args.strategy_config.get("virtual_pipelineCODE
Self-Referential Comments25 hits · 75 pts
SeverityFileLineSnippetContext
MEDIUM…src/mcore_adapter/parallel_functions/vocab_parallel.py56 # Create a mask of valid vocab ids (1 means it needs to be masked).COMMENT
MEDIUM…src/mcore_adapter/parallel_functions/vocab_parallel.py210 # Create a mask of valid vocab ids (1 means it needs to be masked).COMMENT
MEDIUMroll/pipeline/rlvr/rewards/detection_reward_worker.py1291 # Initialize COCO object for ground truthCOMMENT
MEDIUMroll/pipeline/rlvr/rewards/detection_reward_worker.py1315 # Initialize COCO object for ground truthCOMMENT
MEDIUMroll/distributed/scheduler/protocol.py620 # Create a slice objectCOMMENT
MEDIUMroll/distributed/strategy/megatron_strategy.py629 # Create a mock output tensor when the sample is empty to ensure the subsequent pipeline works correCOMMENT
MEDIUMroll/datasets/collator.py202 # Create a batched list from single object, differ with hf's single element listCOMMENT
MEDIUMroll/utils/local_code/testing_util.py2# This file is a slightly modified version of the original code from LiveCodeBench:COMMENT
MEDIUMroll/utils/context_parallel/ulysses_attention.py1# This file is modified from https://github.com/feifeibear/long-context-attentionCOMMENT
MEDIUMroll/utils/context_parallel/globals.py1# This file is modified from https://github.com/feifeibear/long-context-attentionCOMMENT
MEDIUMroll/utils/context_parallel/all_to_all.py1# This file is modified from https://github.com/feifeibear/long-context-attentionCOMMENT
MEDIUMroll/utils/context_parallel/hf_flash_attention_patch.py264 # Create a dummy that matches the query batch size.COMMENT
MEDIUMroll/third_party/vllm/ray_distributed_executor.py56 # Create the parallel GPU workers.COMMENT
MEDIUM…ird_party/vllm/vllm_0_12_0/ray_distributed_executor.py48 # Create the parallel GPU workers.COMMENT
MEDIUM…ird_party/vllm/vllm_0_10_2/ray_distributed_executor.py70 # Create the parallel GPU workers.COMMENT
MEDIUM…ird_party/vllm/vllm_0_10_2/ray_distributed_executor.py104 # Create the workers.COMMENT
MEDIUM…ird_party/vllm/vllm_0_11_0/ray_distributed_executor.py69 # Create the parallel GPU workers.COMMENT
MEDIUM…ird_party/vllm/vllm_0_11_0/ray_distributed_executor.py103 # Create the workers.COMMENT
MEDIUM…hird_party/vllm/vllm_0_8_4/ray_distributed_executor.py69 # Create the parallel GPU workers.COMMENT
MEDIUM…hird_party/vllm/vllm_0_8_4/ray_distributed_executor.py103 # Create the workers.COMMENT
MEDIUM…distributed/strategy/test_vllm_strategy_beam_search.py233 # Create a batch with dummy tensors to satisfy DataProto requirementsCOMMENT
MEDIUM…/distributed/strategy/grad_norm/test_grad_norm_unit.py20 # Create a parameter with known gradientCOMMENT
MEDIUM…/distributed/strategy/grad_norm/test_grad_norm_unit.py75 # Create a simple loss: L = w1[0]^2 + w1[1]^2 + w2[0]^2COMMENT
MEDIUM…distributed/strategy/grad_norm/test_fsdp2_grad_norm.py233 # Create a very simple model for easy verificationCOMMENT
MEDIUM…t_parallel/test_fsdp2_cp_qwen3_hf_rmpad_equivalence.py298 # Create a small packed input to probeCOMMENT
Magic Placeholder Names8 hits · 68 pts
SeverityFileLineSnippetContext
HIGHmcore_adapter/examples/data/dpo_zh_demo.json3735 "value": "创建一个完整的程序像这样将是一个复杂且漫长的过程,涉及图形和音频处理。然而,我可以指导您完成初始步骤,并为您提供资源,帮助您构建项目的简单文本版本。\n\n要获取天气数据,您可以使用OpenWeatherMaCODE
HIGHtests/pipeline/rlvr_megatron_config.yaml25# api_key: your_api_keyCOMMENT
HIGHtests/pipeline/agentic_pipeline_config.yaml23# api_key: your_api_keyCOMMENT
HIGHtests/pipeline/agentic_pipeline_config.yaml34# api_key: your_api_keyCOMMENT
HIGH…2.5-7B-agentic_megatron/agentic_val_webshop_gigpo.yaml31# api_key: your_api_keyCOMMENT
HIGH…s/qwen2.5-7B-agentic_megatron/agentic_val_webshop.yaml31# api_key: your_api_keyCOMMENT
HIGH…/User Guides/Tracker & Metrics/trackers_and_metrics.md61 api_key: your_api_key # Your SwanLab API keyCODE
HIGH…/User Guides/Tracker & Metrics/trackers_and_metrics.md61 api_key: your_api_key # 您的 SwanLab API 密钥CODE
AI Structural Patterns59 hits · 56 pts
SeverityFileLineSnippetContext
LOWmcore_adapter/src/mcore_adapter/checkpointing.py70CODE
LOWmcore_adapter/src/mcore_adapter/checkpointing.py115CODE
LOW…/src/mcore_adapter/models/converter/model_converter.py51CODE
LOW…mcore_adapter/models/qwen2_5_vl/modeling_qwen2_5_vl.py342CODE
LOW…apter/src/mcore_adapter/models/deepseek_v3/__init__.py89CODE
LOW…mcore_adapter/models/qwen3_omni/modeling_qwen3_omni.py225CODE
LOW…_adapter/src/mcore_adapter/models/glm4_moe/__init__.py80CODE
LOW…src/mcore_adapter/models/qwen2_vl/modeling_qwen2_vl.py322CODE
LOW…e_adapter/src/mcore_adapter/models/qwen3_5/__init__.py166CODE
LOW…r/src/mcore_adapter/models/qwen3_5/modeling_qwen3_5.py271CODE
LOW…src/mcore_adapter/models/qwen3_vl/transformer_block.py175CODE
LOW…src/mcore_adapter/models/qwen3_vl/modeling_qwen3_vl.py59CODE
LOW…src/mcore_adapter/models/qwen3_vl/modeling_qwen3_vl.py416CODE
LOWmcore_adapter/src/mcore_adapter/adapters/lora_layer.py38CODE
LOWroll/pipeline/base_worker.py127CODE
LOWroll/pipeline/base_worker.py348CODE
LOWroll/pipeline/base_worker.py524CODE
LOWroll/pipeline/base_worker.py650CODE
LOWroll/pipeline/base_worker.py712CODE
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py1717CODE
LOW…vr/rewards/multiple_choice_boxed_rule_reward_worker.py160CODE
LOW…l/pipeline/rlvr/rewards/remote_reward_system_worker.py528CODE
LOWroll/pipeline/rlvr/rewards/ifeval_rule_reward_worker.py665CODE
LOW…peline/rlvr/rewards/crossthinkqa_rule_reward_worker.py262CODE
LOW…ipeline/rlvr/rewards/general_val_rule_reward_worker.py185CODE
LOW…ll/pipeline/rlvr/rewards/code_sandbox_reward_worker.py864CODE
LOWroll/pipeline/distill/distill_worker.py106CODE
LOWroll/pipeline/distill/distill_worker.py156CODE
LOWroll/pipeline/distill/distill_worker.py182CODE
LOWroll/pipeline/distill/distill_worker.py512CODE
LOWroll/pipeline/dpo/actor_worker.py86CODE
LOWroll/pipeline/sft/sft_worker.py39CODE
LOWroll/pipeline/sft/sft_worker.py51CODE
LOWroll/pipeline/sft/sft_worker.py67CODE
LOWroll/distributed/scheduler/decorator.py253CODE
LOWroll/distributed/executor/worker.py208CODE
LOWroll/distributed/strategy/sglang_strategy.py316CODE
LOWroll/distributed/strategy/mock_strategy.py77CODE
LOWroll/distributed/strategy/vllm_strategy.py228CODE
LOWroll/distributed/strategy/vllm_strategy.py289CODE
LOWroll/distributed/strategy/fsdp2_strategy.py1259CODE
LOWroll/distributed/strategy/hf_strategy.py137CODE
LOWroll/utils/fsdp_utils.py388CODE
LOWroll/utils/fsdp_utils.py648CODE
LOWroll/utils/fsdp_utils.py686CODE
LOWroll/utils/collective/pg_utils.py11CODE
LOWroll/utils/context_parallel/ulysses_attention.py61CODE
LOWroll/utils/context_parallel/ulysses_attention.py361CODE
LOWroll/utils/context_parallel/ulysses_attention.py244CODE
LOWroll/models/model_providers.py381CODE
LOWroll/third_party/vllm/patch_transformers.py9CODE
LOWroll/third_party/vllm/patch_transformers.py85CODE
LOWroll/third_party/megatron/mtp_patcher.py50CODE
LOWroll/third_party/megatron/router_replay_utils.py205CODE
LOW…ts/distributed/strategy/log_probs/apply_model_patch.py45CODE
LOW…ts/distributed/strategy/log_probs/apply_model_patch.py174CODE
LOW…ts/distributed/strategy/log_probs/apply_model_patch.py532CODE
LOWtests/third_party/sglang/test_abort_http.py31CODE
LOWtests/third_party/sglang/test_abort_grpc.py32CODE
Modern Structural Boilerplate42 hits · 42 pts
SeverityFileLineSnippetContext
LOWmcore_adapter/src/mcore_adapter/__init__.py6__all__ = ["McaModelConfig", "McaGPTModel", "TrainingArguments", "Seq2SeqTrainingArguments", "McaTrainer"]CODE
LOWmcore_adapter/src/mcore_adapter/platforms/rocm.py28 def set_allocator_settings(cls, env: str) -> None:CODE
LOWmcore_adapter/src/mcore_adapter/platforms/rocm.py53 def update_env_vars_for_visible_devices(cls, env_vars: dict, gpu_ranks: list) -> None:CODE
LOWmcore_adapter/src/mcore_adapter/platforms/__init__.py55__all__ = [CODE
LOWmcore_adapter/src/mcore_adapter/platforms/npu.py26 def set_allocator_settings(cls, env: str) -> None:CODE
LOWmcore_adapter/src/mcore_adapter/platforms/platform.py111 def set_allocator_settings(cls, env: str) -> None:CODE
LOWmcore_adapter/src/mcore_adapter/platforms/platform.py126 def update_env_vars_for_visible_devices(cls, env_vars: dict, gpu_ranks: list) -> None:CODE
LOWmcore_adapter/src/mcore_adapter/platforms/cuda.py30 def set_allocator_settings(cls, env: str) -> None:CODE
LOWmcore_adapter/src/mcore_adapter/platforms/unknown.py24 def set_allocator_settings(cls, env: str) -> None:CODE
LOW…apter/src/mcore_adapter/parallel_functions/__init__.py6__all__ = ["context_parallel_gather", "encoder_sequence_parallel_gather", "encoder_small_batch_size_gather", "vocab_paraCODE
LOWmcore_adapter/src/mcore_adapter/models/__init__.py26__all__ = ["McaModelConfig", "McaGPTModel", "AutoConfig", "AutoModel", "VirtualModels"]CODE
LOW…dapter/src/mcore_adapter/models/qwen3_next/__init__.py220__all__ = ["Qwen3NextConfig", "Qwen3NextModel"]CODE
LOWmcore_adapter/src/mcore_adapter/models/auto/__init__.py5__all__ = ["AutoConfig", "AutoModel", "register_config", "register_model"]CODE
LOW…dapter/src/mcore_adapter/models/qwen2_5_vl/__init__.py83__all__ = ["Qwen2_5_VLConfig", "Qwen2_5_VLModel"]CODE
LOW…apter/src/mcore_adapter/models/deepseek_v3/__init__.py311__all__ = ["DeepSeekV3Model"]CODE
LOW…dapter/src/mcore_adapter/models/qwen3_omni/__init__.py143__all__ = ["Qwen3OmniMoeConfig", "Qwen3OmniMoeModel"]CODE
LOW…_adapter/src/mcore_adapter/models/qwen2_vl/__init__.py83__all__ = ["Qwen2VLConfig", "Qwen2VLModel"]CODE
LOW…e_adapter/src/mcore_adapter/models/qwen3_5/__init__.py312__all__ = ["Qwen3_5Config", "Qwen3_5Model"]CODE
LOW…ore_adapter/src/mcore_adapter/models/llama/__init__.py64__all__ = ["LlamaConfig", "LlamaModel"]CODE
LOW…_adapter/src/mcore_adapter/models/qwen3_vl/__init__.py92__all__ = ["Qwen3VLConfig", "Qwen3VLModel"]CODE
LOWmcore_adapter/src/mcore_adapter/adapters/__init__.py31__all__ = [CODE
LOWmcore_adapter/src/mcore_adapter/trainer/__init__.py6__all__ = ["McaTrainer", "DPOTrainer", "DPOConfig"]CODE
LOWroll/pipeline/agentic/proxy/proxy_server.py13logger = logging.getLogger(__name__)CODE
LOWroll/pipeline/agentic/proxy/router/__init__.py9__all__ = ["ProxyRouter", "ALBProxyRouter", "IngressProxyRouter", "batch_cleanup", "create_proxy_router"]CODE
LOWroll/pipeline/agentic/agent_runner/__init__.py3__all__ = ["AgentRunner", "EpisodeResult"]CODE
LOWroll/pipeline/agentic/agent_runner/rock/__init__.py5__all__ = ["RockAgentRunner", "PushModeRunner", "PullModeRunner"]CODE
LOWroll/pipeline/agentic/env_manager/message_tracker.py195 def update_tools(self, tools: List[dict]) -> None:CODE
LOWroll/platforms/rocm.py28 def set_allocator_settings(cls, env: str) -> None:CODE
LOWroll/platforms/rocm.py55 def update_env_vars_for_visible_devices(cls, env_vars: dict, gpu_ranks: list) -> None:CODE
LOWroll/platforms/__init__.py53__all__ = [CODE
LOWroll/platforms/npu.py29 def set_allocator_settings(cls, env: str) -> None:CODE
LOWroll/platforms/platform.py109 def set_allocator_settings(cls, env: str) -> None:CODE
LOWroll/platforms/platform.py130 def update_env_vars_for_visible_devices(cls, env_vars: dict, gpu_ranks: list) -> None:CODE
LOWroll/platforms/cuda.py28 def set_allocator_settings(cls, env: str) -> None:CODE
LOWroll/platforms/unknown.py23 def set_allocator_settings(cls, env: str) -> None:CODE
LOWroll/distributed/scheduler/transfer_backend.py224__all__ = ["init_transfer_backend", "put", "get", "delete"]CODE
LOWroll/utils/qwen_vl_utils.py43logger = logging.getLogger(__name__)CODE
LOWroll/utils/context_parallel/__init__.py4__all__ = ["set_upg_manager", "get_ulysses_group", "apply_ulysses_patch", "unapply_ulysses_patch"]CODE
LOWroll/third_party/vllm/gdn_patcher.py20logger = logging.getLogger(__name__)CODE
LOWroll/third_party/vllm/__init__.py148__all__ = ["create_async_llm"]CODE
LOWroll/third_party/vllm/vllm_0_8_4/__init__.py124__all__ = []CODE
LOWroll/third_party/megatron/optimizer.py14logger = logging.getLogger(__name__)CODE
Over-Commented Block40 hits · 40 pts
SeverityFileLineSnippetContext
LOWmcore_adapter/src/mcore_adapter/checkpointing.py41 if not release:COMMENT
LOWmcore_adapter/src/mcore_adapter/platforms/platform.py41 # available dispatch keys:COMMENT
LOW…src/mcore_adapter/models/qwen3_vl/transformer_block.py241 # size (mbs) == 1, since in this case, 'hidden_states.transpose()'COMMENT
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py441COMMENT
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py461 # maxDets - [1 10 100] M=3 thresholds on max detections per imageCOMMENT
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py481 # date - date evaluation was performedCOMMENT
LOW…l/pipeline/rlvr/rewards/remote_reward_system_worker.py1# Copyright 2025 alibaba-inc. and/or its affiliatesCOMMENT
LOWroll/pipeline/agentic/agentic_pipeline.py321COMMENT
LOWroll/platforms/platform.py41 # use "CPU" as a fallback for platforms not registered in PyTorchCOMMENT
LOWroll/distributed/strategy/fsdp2_strategy.py241COMMENT
LOWroll/utils/taskgroups.py1# borrow from cpythonCOMMENT
LOWroll/utils/taskgroups.py121 # # If this flag is set we *must* call uncancel().COMMENT
LOWroll/utils/taskgroups.py281 # "not cancelled" later in __aexit__. Example situation thatCOMMENT
LOWroll/third_party/fsdp2/tiled_mlp.py1# Copyright 2024 Bytedance Ltd. and/or its affiliatesCOMMENT
LOWroll/third_party/vllm/fp8.py21COMMENT
LOWroll/third_party/megatron/fused_entropy.py841 )COMMENT
LOWroll/third_party/megatron/fused_entropy.py861COMMENT
LOWtests/pipeline/rlvr_megatron_config.yaml181 std_threshold: 0COMMENT
LOWtests/pipeline/rlvr_megatron_config.yaml201# data_args:COMMENT
LOWtests/pipeline/agentic_pipeline_config.yaml21#track_with: wandbCOMMENT
LOW…distributed/strategy/log_probs/layer_states_capture.py61 returnCOMMENT
LOWtests/third_party/vllm/test_vllm_mem_oom.py61 # snapshot_last = tracemalloc.take_snapshot()COMMENT
LOWtests/third_party/vllm/test_vllm_mem_oom.py81 #COMMENT
LOW…2.5-7B-agentic_megatron/agentic_val_webshop_gigpo.yaml21# name: ${exp_name}_webshopCOMMENT
LOW…s/qwen2.5-7B-agentic_megatron/agentic_val_webshop.yaml21# name: ${exp_name}_webshopCOMMENT
LOW…vr_megatron/rlvr_config_8gpus_llm_as_judge_server.yaml81reward_pretrain: Qwen/Qwen2.5-7BCOMMENT
LOW…5-7B-rlvr_megatron/rlvr_config_8gpus_llm_as_judge.yaml81reward_pretrain: Qwen/Qwen2.5-7BCOMMENT
LOW…s/qwen3-next-80BA3B-rlvr_megatron/rlvr_config_amd.yaml81reward_pretrain: Qwen/Qwen3-Next-80B-A3B-InstructCOMMENT
LOW…mples/qwen3-next-80BA3B-rlvr_megatron/rlvr_config.yaml81reward_pretrain: Qwen/Qwen3-Next-80B-A3B-InstructCOMMENT
LOW…mples/qwen3-30BA3B-rlvr_megatron/rlvr_config_lora.yaml241 # # NOTE: llm as judge 也需要gpu, 不能和actor infer共享gpuCOMMENT
LOW…mples/qwen3-30BA3B-rlvr_megatron/rlvr_config_lora.yaml261 # strategy_args:COMMENT
LOWexamples/qwen3-omni/audio_test_80G.yaml41use_kl_loss: trueCOMMENT
LOWexamples/qwen3-omni/audio_test_80G.yaml81 # "audios": ["dafd0ef215384e8b45326f43ee868204.wav"],COMMENT
LOW…mples/agentic_demo/run_openreward_endless_terminals.sh1#!/bin/bashCOMMENT
LOWexamples/qwen3_agentic_gem/start_retrieval_server.sh1#!/bin/bashCOMMENT
LOWexamples/qwen2.5-7B-rlvr-offpolicy/rlvr_config.yaml21# tracker_kwargs:COMMENT
LOWexamples/qwen2.5-7B-rlvr-offpolicy/rlvr_config.yaml201 # crossthinkqa:COMMENT
LOWexamples/qwen2.5-7B-rlvr-offpolicy/rlvr_config.yaml221 # infer_batch_size: 4COMMENT
LOWexamples/qwen2.5-7B-rlvr-offpolicy/rlvr_config.yaml241 # judge_prompt: Qwen2.5-7B-Instruct-RLVR-promptCOMMENT
LOWexamples/qwen2.5-7B-rlvr-offpolicy/rlvr_config.yaml261 # strategy_config: nullCOMMENT
Redundant / Tautological Comments22 hits · 33 pts
SeverityFileLineSnippetContext
LOW…src/mcore_adapter/parallel_functions/vocab_parallel.py85 # Check if we can use fused kernel (only for TP=1)COMMENT
LOW…core_adapter/parallel_functions/fused_cross_entropy.py202 # Set loss to 0 if this index should be ignored, otherwise compute normallyCOMMENT
LOW…core_adapter/parallel_functions/fused_cross_entropy.py456 # Set dloss to 0 if this index should be ignoredCOMMENT
LOWmcore_adapter/src/mcore_adapter/trainer/trainer.py719 # Check if continuing training from a checkpointCOMMENT
LOWroll/pipeline/rlvr/rewards/detection_reward_worker.py1013 # Check if boxes overlapCOMMENT
LOWroll/pipeline/agentic/agentic_pipeline.py937 # Check if this DP rank's GPUs are NOT in the freed setCOMMENT
LOWroll/pipeline/agentic/utils.py489 # Check if this teacher has a routing mask (set by pipeline when needs_teacher_routing)COMMENT
LOWroll/pipeline/agentic/tools/mcp_tool.py374 # Check if the item is a text block and has non-empty textSTRING
LOWroll/pipeline/agentic/proxy/router/alb_proxy_router.py704 # Check if clean_dir is empty and remove it if soCOMMENT
LOWroll/pipeline/agentic/proxy/router/alb_proxy_router.py951 # Add rules to listener and save rule ids to fileCOMMENT
LOWroll/distributed/scheduler/protocol.py931 # Check if any data has this key, not just the first oneCOMMENT
LOWroll/distributed/scheduler/rollout_scheduler.py173 # Check if this episode has been submittedCOMMENT
LOWroll/distributed/strategy/vllm_strategy.py170 # Check if beam search is requestedCOMMENT
LOWroll/utils/functionals.py1117 # Check if this teacher has a routing mask (set by pipeline when needs_teacher_routing)COMMENT
LOWroll/utils/train_infer_corrections.py204 # Check if required fields are presentCOMMENT
LOWroll/utils/train_infer_corrections.py244 # Check if mask is already sliced (shape [B, T-1]) or full (shape [B, T])COMMENT
LOWroll/third_party/vllm/gdn_patcher.py47 # Check if already patched (has _original_build attribute)COMMENT
LOWroll/third_party/vllm/gdn_patcher.py52 # Check if the fix is already in the sourceCOMMENT
LOW…ted/strategy/log_probs/test_fsdp_vlm_log_probs_perf.py212 # Check if results are numerically equivalentCOMMENT
LOW…ributed/strategy/log_probs/analyze_layer_divergence.py40 # Check if it's a layer_states fileCOMMENT
LOW…ributed/strategy/log_probs/analyze_layer_divergence.py168 # Check if this is a nested structure (layer states) or flat (embeddings)COMMENT
LOW…ributed/strategy/log_probs/analyze_layer_divergence.py518 # Check if embeddings show significant divergenceCOMMENT
Verbosity Indicators13 hits · 21 pts
SeverityFileLineSnippetContext
LOWroll/pipeline/agentic/agentic_pipeline.py268 # Step 0: active_dp_ranks initialized with all ranks {0,1,2,3}, no expand neededCOMMENT
LOWroll/pipeline/agentic/tools/mcp_tool.py339 # Step 1: Find the schema for the requested tool.STRING
LOWroll/pipeline/agentic/tools/mcp_tool.py347 # Step 2: Use the jsonschema library to validate the parameters.STRING
LOWroll/utils/sequence_packing.py206 # Step 4: Round up to be divisible by vp_sizeCOMMENT
LOWroll/utils/sequence_packing.py210 # Step 5: Calculate workload for load balancingCOMMENT
LOWroll/utils/sequence_packing.py215 # Step 6: Partition samples into micro batches with balanced workloadCOMMENT
LOWroll/utils/sequence_packing.py222 # Step 7: Sort and reorder for better pipeline schedulingCOMMENT
LOWroll/utils/sequence_packing.py179 # Step 2: Calculate initial number of micro batchesCOMMENT
LOWroll/utils/sequence_packing.py192 # Step 3: Synchronize across DP ranks (all ranks must have same count)COMMENT
LOWroll/utils/sequence_packing.py245 # Step 8: Generate micro batchesCOMMENT
LOWroll/configs/base_config.py690 # Step 1: Normalize teacher to _reference_configs dict (always Dict[str, WorkerConfig])COMMENT
LOWroll/configs/base_config.py711 # Step 2: Pure OPD modeCOMMENT
LOWroll/configs/base_config.py732 # Step 3: Mixed OPD modeCOMMENT
AI Slop Vocabulary8 hits · 16 pts
SeverityFileLineSnippetContext
LOWmcore_adapter/src/mcore_adapter/trainer/trainer.py879 # if loss is nan or inf simply add the average of previous logged lossesCOMMENT
MEDIUMroll/pipeline/agentic/tools/mcp_tool.py213 """Generates a comprehensive prompt using the cached tool metadata."""STRING
LOWroll/third_party/vllm/ray_distributed_executor.py134 # No need to sort, just use the given resource order of the placement groupCOMMENT
LOW…ird_party/vllm/vllm_0_12_0/ray_distributed_executor.py112 # No need to sort, just use the given resource order of the placement groupCOMMENT
MEDIUM…ted/strategy/log_probs/test_fsdp_vlm_log_probs_perf.py273 """Test VLM logprobs with CP2 and comprehensive performance statistics."""STRING
MEDIUMtests/third_party/vllm/vllm_generate_test.py36 # "content": "Your role as an assistant involves thoroughly exploring questions through a systematic long thinkCOMMENT
MEDIUM…s/docusaurus-plugin-content-docs/current/ROLL_map.html24<script src="https://cdn.jsdelivr.net/npm/d3@7.9.0/dist/d3.min.js"></script><script src="https://cdn.jsdelivr.net/npm/maCODE
MEDIUM…s/docusaurus-plugin-content-docs/current/ROLL_map.html24<script src="https://cdn.jsdelivr.net/npm/d3@7.9.0/dist/d3.min.js"></script><script src="https://cdn.jsdelivr.net/npm/maCODE
Dead Code1 hit · 2 pts
SeverityFileLineSnippetContext
MEDIUMtests/distributed/executor/test_ray_debugger.py20CODE
Example Usage Blocks1 hit · 2 pts
SeverityFileLineSnippetContext
LOW…/openreward_endless_terminals_reinforce_qwen35_2b.yaml5# Usage:COMMENT
Fake / Example Data1 hit · 1 pts
SeverityFileLineSnippetContext
LOW…docs/current/User Guides/Agentic/prefix_aggregation.md139 [*base_chat_history, msg], # base_chat_history = [dummy_sys, dummy_user]CODE