Repository Analysis

kvcache-ai/ktransformers

A Flexible Framework for Experiencing Heterogeneous LLM Inference/Fine-tune Optimizations

15.8 Moderate AI signal View on GitHub

Analysis Overview

This report presents the forensic synthetic code analysis of kvcache-ai/ktransformers, a Python project with 17,432 GitHub stars. SynthScan v2.0 examined 377,740 lines of code across 1222 source files, recording 3690 pattern matches distributed across 24 syntactic categories. The overall adjusted score of 15.8 places this repository in the Moderate AI signal band.

The scanner applied 160+ deterministic lexical heuristics, multi-line block detectors, abstract syntax tree depth profilers, and a cross-file Jaccard similarity matrix to construct a statistically normalised synthetic code estimate. All matches are individually weighted by severity coefficient and contextual multiplier before summation, and the resulting headline score is temporally discounted to account for the repository's development history relative to the commercial emergence of large language model coding tooling (November 2022 onward).

15.8
Adjusted Score
15.8
Raw Score
100%
Time Factor
2026-07-10
Last Push
17.4K
Stars
Python
Language
377.7K
Lines of Code
1.2K
Files
3.7K
Pattern Hits
2026-07-14
Scan Date
0.36
HC Hit Rate

What These Metrics Mean

Adjusted Score
Primary synthetic code indicator. Raw score normalised per 1,000 lines of code and multiplied by the temporal discount factor. This is the definitive comparative metric — use it to rank repositories by AI authorship density.
Raw Score
The unmodified sum of all severity-weighted, context-multiplied pattern match scores before temporal discounting. Reflects the absolute signal strength independent of when the repository was last active.
Time Factor
The temporal discount multiplier (0–100%) applied to the raw score. Repositories last updated before ChatGPT's launch (Nov 2022) receive a 5% factor. Full signal is only assigned to repositories active in the post-adoption era (Jan 2024+).
Pattern Hits
Total count of individual pattern matches across all files and categories. A high hit count with a low score may indicate a very large codebase with isolated AI snippets; a low count with a high score indicates dense, concentrated AI signatures.
HC Hit Rate
High+Critical pattern hits per file, averaged across the repository. This orthogonal signal catches repositories where a few files are densely packed with high-severity AI tells — a strong indicator even when the normalised score appears moderate due to codebase size.
Lines of Code / Files
Total lines and files analysed. The scanner examines 94 file extensions. These denominators are used to normalise the score, enabling fair comparison between repositories of vastly different sizes.

Score History

This chart maps the temporal evolution of the adjusted synthetic code score across successive scan runs. An upward trajectory indicates ongoing incorporation of AI-generated code or expanding LLM-assisted scaffolding; a stable or declining trajectory may reflect active human refactoring, code removal, or the adoption of stricter authorship policies. The dashed secondary line (right axis) independently tracks total raw pattern hit count, which can diverge from the normalised score when codebase size changes significantly between scans.

Severity Breakdown

Classifies detected patterns by their diagnostic confidence and structural impact. CRITICAL patterns (coefficient 10) represent definitive synthetic signatures — hallucinated imports, explicit LLM attribution metadata — virtually never produced by human authors. HIGH (5) indicates strong structural tells such as cross-file repetition or cross-linguistic idioms. MEDIUM (2) covers recognisable conversational padding and AI-specific vocabulary. LOW (1) captures subtle indicators like tautological comments and generic boilerplate that require density to carry independent signal.

CRITICAL 3HIGH 440MEDIUM 212LOW 3035

Directory Score Breakdown

This horizontal bar chart decomposes the repository's raw synthetic code score by top-level directory, allowing you to pinpoint precisely which modules or components carry the highest AI authorship density. Directories with disproportionately high scores relative to their size warrant targeted manual review: concentrated AI signatures often trace back to mass-generated configuration layers, auto-ported test suites, LLM-scaffolded boilerplate classes, or entire subsystems authored under heavy copilot assistance. Use this view to prioritise your human code-review effort.

Pattern Findings

The scanner identified 3690 distinct pattern matches across 24 syntactic categories. Each entry below represents a discrete location in the source code where the engine recorded a statistically significant AI authorship indicator. Expand any category row to inspect the individual file paths, line numbers, code snippets, and the lexical context (CODE, COMMENT, or STRING) in which each match was detected.

Reading the findings table: The Severity column indicates the diagnostic confidence level (CRITICAL / HIGH / MEDIUM / LOW). The Context column identifies whether the match occurred inside executable code, an inline comment, or a string literal — comment-context matches receive a ×1.5 weight because LLMs systematically over-annotate. The ⚡ bolt icon marks clustered matches: three or more patterns within a 10-line window, each receiving an additional ×1.5 density multiplier as dense clusters constitute far stronger evidence of synthetic authorship than isolated hits.

Cross-File Repetition407 hits · 2035 pts
SeverityFileLineSnippetContext
HIGHarchive/merge_tensors/merge_safetensor_gguf.py0:param folder_path: folder path :return: key_to_file_mapSTRING
HIGHarchive/kt-sft/merge_tensors/merge_safetensor_gguf.py0:param folder_path: folder path :return: key_to_file_mapSTRING
HIGHkt-kernel/scripts/check.py0:param folder_path: folder path :return: key_to_file_mapSTRING
HIGHarchive/merge_tensors/merge_safetensor_gguf.py0# :param name: name of the tensor # :return: translated name #STRING
HIGHarchive/kt-sft/merge_tensors/merge_safetensor_gguf.py0# :param name: name of the tensor # :return: translated name #STRING
HIGHkt-kernel/scripts/check.py0# :param name: name of the tensor # :return: translated name #STRING
HIGHarchive/csrc/ktransformers_ext/bench/bench_moe_torch.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGH…kt-sft/csrc/ktransformers_ext/bench/bench_moe_torch.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHarchive/csrc/ktransformers_ext/bench/bench_moe.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGH…chive/kt-sft/csrc/ktransformers_ext/bench/bench_moe.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHkt-kernel/bench/bench_moe_kernel.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHkt-kernel/bench/bench_moe_amx.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHkt-kernel/bench/bench_moe_amx_k.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHkt-kernel/bench/bench_moe_kml.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHarchive/csrc/ktransformers_ext/examples/test_mlp.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGH…ive/kt-sft/csrc/ktransformers_ext/examples/test_mlp.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHkt-kernel/examples/test_mlp.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHarchive/csrc/ktransformers_ext/examples/test_moe.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGH…ft/csrc/ktransformers_ext/examples/test_sft_amx_moe.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGH…ive/kt-sft/csrc/ktransformers_ext/examples/test_moe.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGH…kt-sft/csrc/ktransformers_ext/examples/test_sft_moe.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHkt-kernel/examples/test_moe_kernel.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHkt-kernel/examples/test_moe_kml.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHarchive/csrc/ktransformers_ext/examples/test_linear.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGH…/kt-sft/csrc/ktransformers_ext/examples/test_linear.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHkt-kernel/examples/test_linear.py0description : author : chenht2022 date : 2024-07-25 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHarchive/csrc/ktransformers_ext/bench/bench_attention.py0description : author : jianwei dong date : 2024-08-28 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 2STRING
HIGH…/csrc/ktransformers_ext/bench/bench_attention_torch.py0description : author : jianwei dong date : 2024-08-28 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 2STRING
HIGH…kt-sft/csrc/ktransformers_ext/bench/bench_attention.py0description : author : jianwei dong date : 2024-08-28 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 2STRING
HIGH…/csrc/ktransformers_ext/bench/bench_attention_torch.py0description : author : jianwei dong date : 2024-08-28 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 2STRING
HIGHkt-kernel/bench/bench_attention.py0description : author : jianwei dong date : 2024-08-28 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 2STRING
HIGHkt-kernel/bench/bench_attention_torch.py0description : author : jianwei dong date : 2024-08-28 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 2STRING
HIGH…hive/csrc/ktransformers_ext/examples/test_attention.py0description : author : jianwei dong date : 2024-08-28 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 2STRING
HIGH…-sft/csrc/ktransformers_ext/examples/test_attention.py0description : author : jianwei dong date : 2024-08-28 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 2STRING
HIGHkt-kernel/examples/test_attention.py0description : author : jianwei dong date : 2024-08-28 10:32:05 version : 1.0.0 lasteditors : chenht2022 lastedittime : 2STRING
HIGHarchive/csrc/ktransformers_ext/bench/bench_mlp.py0description : author : chenht2022 date : 2024-07-16 10:43:18 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGH…chive/kt-sft/csrc/ktransformers_ext/bench/bench_mlp.py0description : author : chenht2022 date : 2024-07-16 10:43:18 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHkt-kernel/bench/bench_mlp.py0description : author : chenht2022 date : 2024-07-16 10:43:18 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHarchive/csrc/ktransformers_ext/bench/bench_linear.py0description : author : chenht2022 date : 2024-07-25 10:31:59 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGH…ve/kt-sft/csrc/ktransformers_ext/bench/bench_linear.py0description : author : chenht2022 date : 2024-07-25 10:31:59 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHkt-kernel/bench/bench_linear.py0description : author : chenht2022 date : 2024-07-25 10:31:59 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGH…ive/csrc/ktransformers_ext/bench/bench_linear_torch.py0description : author : chenht2022 date : 2024-07-25 10:31:59 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGH…sft/csrc/ktransformers_ext/bench/bench_linear_torch.py0description : author : chenht2022 date : 2024-07-25 10:31:59 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHkt-kernel/bench/bench_linear_torch.py0description : author : chenht2022 date : 2024-07-25 10:31:59 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHarchive/csrc/ktransformers_ext/bench/bench_mlp_torch.py0description : author : chenht2022 date : 2024-07-16 10:43:18 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGH…kt-sft/csrc/ktransformers_ext/bench/bench_mlp_torch.py0description : author : chenht2022 date : 2024-07-16 10:43:18 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHkt-kernel/bench/bench_mlp_torch.py0description : author : chenht2022 date : 2024-07-16 10:43:18 version : 1.0.0 lasteditors : chenht2022 lastedittime : 202STRING
HIGHarchive/csrc/custom_marlin/utils/format24.py0class for creating n:m sparsity masks. masks will be created using the n:m ratio, where for every block of m weights, n STRING
HIGHarchive/kt-sft/csrc/custom_marlin/utils/format24.py0class for creating n:m sparsity masks. masks will be created using the n:m ratio, where for every block of m weights, n STRING
HIGH…xt/operators/custom_marlin/quantize/utils/format_24.py0class for creating n:m sparsity masks. masks will be created using the n:m ratio, where for every block of m weights, n STRING
HIGH…xt/operators/custom_marlin/quantize/utils/format_24.py0class for creating n:m sparsity masks. masks will be created using the n:m ratio, where for every block of m weights, n STRING
HIGHarchive/kt-sft/ktransformers/local_chat.py0description : author : boxin zhang, azure-tang version : 0.1.0 copyright (c) 2024 by kvcache.ai, all rights reserved.STRING
HIGHarchive/kt-sft/ktransformers/optimize/optimize.py0description : author : boxin zhang, azure-tang version : 0.1.0 copyright (c) 2024 by kvcache.ai, all rights reserved.STRING
HIGHarchive/kt-sft/ktransformers/util/utils.py0description : author : boxin zhang, azure-tang version : 0.1.0 copyright (c) 2024 by kvcache.ai, all rights reserved.STRING
HIGHarchive/ktransformers/local_chat_test.py0description : author : boxin zhang, azure-tang version : 0.1.0 copyright (c) 2024 by kvcache.ai, all rights reserved.STRING
HIGHarchive/ktransformers/local_chat.py0description : author : boxin zhang, azure-tang version : 0.1.0 copyright (c) 2024 by kvcache.ai, all rights reserved.STRING
HIGHarchive/ktransformers/optimize/optimize.py0description : author : boxin zhang, azure-tang version : 0.1.0 copyright (c) 2024 by kvcache.ai, all rights reserved.STRING
HIGHarchive/ktransformers/util/utils.py0description : author : boxin zhang, azure-tang version : 0.1.0 copyright (c) 2024 by kvcache.ai, all rights reserved.STRING
HIGHarchive/kt-sft/ktransformers/local_chat.py0'): # end multi lines input line = line[:-3] # suffixSTRING
HIGHarchive/ktransformers/local_chat.py0'): # end multi lines input line = line[:-3] # suffixSTRING
347 more matches not shown…
Unused Imports920 hits · 892 pts
SeverityFileLineSnippetContext
LOWktransformers.py8CODE
LOWktransformers.py29CODE
LOW…chive/merge_tensors/merge_safetensor_gguf_for_qwen3.py18CODE
LOWarchive/merge_tensors/merge_safetensor_gguf.py5CODE
LOWarchive/csrc/ktransformers_ext/bench/bench_moe_torch.py12CODE
LOWarchive/csrc/ktransformers_ext/bench/bench_moe_torch.py12CODE
LOW…ive/csrc/ktransformers_ext/bench/bench_linear_torch.py12CODE
LOW…ive/csrc/ktransformers_ext/bench/bench_linear_torch.py12CODE
LOWarchive/csrc/ktransformers_ext/bench/bench_mlp_torch.py12CODE
LOWarchive/csrc/ktransformers_ext/bench/bench_mlp_torch.py12CODE
LOW…/csrc/ktransformers_ext/bench/bench_attention_torch.py16CODE
LOWarchive/csrc/ktransformers_ext/cuda/setup.py2CODE
LOWarchive/csrc/ktransformers_ext/cuda/setup.py3CODE
LOWarchive/csrc/ktransformers_ext/cuda/test_dequant.py1CODE
LOWarchive/csrc/ktransformers_ext/examples/test_mlp.py13CODE
LOWarchive/csrc/ktransformers_ext/examples/test_moe.py13CODE
LOW…hive/csrc/ktransformers_ext/examples/test_attention.py13CODE
LOWarchive/csrc/ktransformers_ext/examples/test_linear.py13CODE
LOWarchive/csrc/custom_marlin/setup.py1CODE
LOWarchive/csrc/custom_marlin/setup.py2CODE
LOWarchive/csrc/custom_marlin/test_cuda_graph.py1CODE
LOWarchive/csrc/custom_marlin/test_cuda_graph.py6CODE
LOWarchive/csrc/custom_marlin/utils/marlin_utils.py13CODE
LOWarchive/kt-sft/withoutKT_PEFT.py2CODE
LOWarchive/kt-sft/withoutKT_PEFT.py4CODE
LOWarchive/kt-sft/withoutKT_PEFT.py9CODE
LOWarchive/kt-sft/withoutKT_PEFT.py9CODE
LOWarchive/kt-sft/merge_tensors/merge_safetensor_gguf.py5CODE
LOW…kt-sft/csrc/ktransformers_ext/bench/bench_moe_torch.py12CODE
LOW…kt-sft/csrc/ktransformers_ext/bench/bench_moe_torch.py12CODE
LOW…sft/csrc/ktransformers_ext/bench/bench_linear_torch.py12CODE
LOW…sft/csrc/ktransformers_ext/bench/bench_linear_torch.py12CODE
LOW…kt-sft/csrc/ktransformers_ext/bench/bench_mlp_torch.py12CODE
LOW…kt-sft/csrc/ktransformers_ext/bench/bench_mlp_torch.py12CODE
LOW…/csrc/ktransformers_ext/bench/bench_attention_torch.py16CODE
LOWarchive/kt-sft/csrc/ktransformers_ext/cuda/setup.py2CODE
LOWarchive/kt-sft/csrc/ktransformers_ext/cuda/setup.py3CODE
LOW…ive/kt-sft/csrc/ktransformers_ext/cuda/test_dequant.py1CODE
LOW…ive/kt-sft/csrc/ktransformers_ext/examples/test_mlp.py13CODE
LOW…ive/kt-sft/csrc/ktransformers_ext/examples/test_moe.py13CODE
LOW…-sft/csrc/ktransformers_ext/examples/test_attention.py13CODE
LOW…/kt-sft/csrc/ktransformers_ext/examples/test_linear.py13CODE
LOWarchive/kt-sft/csrc/custom_marlin/setup.py1CODE
LOWarchive/kt-sft/csrc/custom_marlin/setup.py2CODE
LOWarchive/kt-sft/csrc/custom_marlin/test_cuda_graph.py1CODE
LOWarchive/kt-sft/csrc/custom_marlin/test_cuda_graph.py6CODE
LOWarchive/kt-sft/csrc/custom_marlin/utils/marlin_utils.py13CODE
LOWarchive/kt-sft/ktransformers/moe_test_module.py2CODE
LOWarchive/kt-sft/ktransformers/moe_test_module.py8CODE
LOWarchive/kt-sft/ktransformers/moe_test_module.py9CODE
LOWarchive/kt-sft/ktransformers/moe_test_module.py11CODE
LOWarchive/kt-sft/ktransformers/moe_test_module.py11CODE
LOWarchive/kt-sft/ktransformers/moe_test_module.py11CODE
LOWarchive/kt-sft/ktransformers/moe_test_module.py11CODE
LOWarchive/kt-sft/ktransformers/moe_test_module.py19CODE
LOWarchive/kt-sft/ktransformers/moe_test_module.py21CODE
LOWarchive/kt-sft/ktransformers/moe_test_module.py21CODE
LOWarchive/kt-sft/ktransformers/moe_test_module.py22CODE
LOWarchive/kt-sft/ktransformers/moe_test_module.py25CODE
LOWarchive/kt-sft/ktransformers/__init__.py18CODE
860 more matches not shown…
Over-Commented Block658 hits · 582 pts
SeverityFileLineSnippetContext
LOWdocker/docker-utils.sh1#!/usr/bin/env bashCOMMENT
LOWdocker/docker-utils.sh161################################################################################COMMENT
LOWdocker/build-docker-tar.sh1#!/usr/bin/env bashCOMMENT
LOWdocker/push-to-dockerhub.sh1#!/usr/bin/env bashCOMMENT
LOWdocker/push-to-dockerhub.sh581# - Automatic version detectionCOMMENT
LOW…chive/merge_tensors/merge_safetensor_gguf_for_qwen3.py1# coding=utf-8COMMENT
LOWarchive/csrc/ktransformers_ext/ext_bindings.cpp21#if defined(__x86_64__) && defined(__HAS_AVX512F__) && defined(__HAS_AMX__)COMMENT
LOWarchive/csrc/ktransformers_ext/vendors/musa.h1#pragma onceCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/musa.h21#define cublasDestroy mublasDestroyCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/musa.h41#define cudaEventCreateWithFlags musaEventCreateWithFlagsCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/musa.h61#define cudaMallocManaged musaMallocManagedCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/musa.h81#define cudaStreamWaitEvent musaStreamWaitEventCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/musa.h101#define cuMemGetAllocationGranularity muMemGetAllocationGranularityCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/musa.h121#define cudaGraphExecUpdate musaGraphExecUpdateCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/hip.h1#pragma onceCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/hip.h21#define CUBLAS_TF32_TENSOR_OP_MATH 0COMMENT
LOWarchive/csrc/ktransformers_ext/vendors/hip.h41#define cublasSgemm hipblasSgemmCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/hip.h61#define cudaGetDevice hipGetDeviceCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/hip.h81#define cudaMemset hipMemsetCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/hip.h101#define cudaStreamCreateWithFlags hipStreamCreateWithFlagsCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/hip.h121#define cudaGraphKernelNodeSetParams hipGraphKernelNodeSetParamsCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/hip.h141#define CUBLAS_STATUS_INTERNAL_ERROR HIPBLAS_STATUS_INTERNAL_ERRORCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/hip.h161#define RDNA2COMMENT
LOWarchive/csrc/ktransformers_ext/vendors/cuda.h1#pragma onceCOMMENT
LOWarchive/csrc/ktransformers_ext/vendors/vendor.h1#ifndef CPUINFER_VENDOR_VENDOR_HCOMMENT
LOW…ive/csrc/ktransformers_ext/operators/kvcache/kvcache.h21#include <fstream>COMMENT
LOWarchive/csrc/ktransformers_ext/operators/amx/la/amx.hpp21#include <sys/syscall.h>COMMENT
LOWarchive/csrc/ktransformers_ext/operators/amx/la/amx.hpp41namespace amx {COMMENT
LOWarchive/csrc/ktransformers_ext/cpu_backend/cpuinfer.h21 #ifdef KTRANSFORMERS_USE_CUDACOMMENT
LOW…hive/csrc/ktransformers_ext/cpu_backend/vendors/musa.h1#pragma onceCOMMENT
LOW…hive/csrc/ktransformers_ext/cpu_backend/vendors/musa.h21#define cublasDestroy mublasDestroyCOMMENT
LOW…hive/csrc/ktransformers_ext/cpu_backend/vendors/musa.h41#define cudaEventCreateWithFlags musaEventCreateWithFlagsCOMMENT
LOW…hive/csrc/ktransformers_ext/cpu_backend/vendors/musa.h61#define cudaMallocManaged musaMallocManagedCOMMENT
LOW…hive/csrc/ktransformers_ext/cpu_backend/vendors/musa.h81#define cudaStreamWaitEvent musaStreamWaitEventCOMMENT
LOW…hive/csrc/ktransformers_ext/cpu_backend/vendors/musa.h101#define cuMemGetAllocationGranularity muMemGetAllocationGranularityCOMMENT
LOW…hive/csrc/ktransformers_ext/cpu_backend/vendors/musa.h121#define cudaGraphExecUpdate musaGraphExecUpdateCOMMENT
LOW…chive/csrc/ktransformers_ext/cpu_backend/vendors/hip.h1#pragma onceCOMMENT
LOW…chive/csrc/ktransformers_ext/cpu_backend/vendors/hip.h21#define CUBLAS_TF32_TENSOR_OP_MATH 0COMMENT
LOW…chive/csrc/ktransformers_ext/cpu_backend/vendors/hip.h41#define cublasSgemm hipblasSgemmCOMMENT
LOW…chive/csrc/ktransformers_ext/cpu_backend/vendors/hip.h61#define cudaGetDevice hipGetDeviceCOMMENT
LOW…chive/csrc/ktransformers_ext/cpu_backend/vendors/hip.h81#define cudaMemset hipMemsetCOMMENT
LOW…chive/csrc/ktransformers_ext/cpu_backend/vendors/hip.h101#define cudaStreamCreateWithFlags hipStreamCreateWithFlagsCOMMENT
LOW…chive/csrc/ktransformers_ext/cpu_backend/vendors/hip.h121#define cudaGraphKernelNodeSetParams hipGraphKernelNodeSetParamsCOMMENT
LOW…chive/csrc/ktransformers_ext/cpu_backend/vendors/hip.h141#define CUBLAS_STATUS_INTERNAL_ERROR HIPBLAS_STATUS_INTERNAL_ERRORCOMMENT
LOW…chive/csrc/ktransformers_ext/cpu_backend/vendors/hip.h161#define RDNA2COMMENT
LOW…hive/csrc/ktransformers_ext/cpu_backend/vendors/cuda.h1#pragma onceCOMMENT
LOW…ve/csrc/ktransformers_ext/cpu_backend/vendors/vendor.h1#ifndef CPUINFER_VENDOR_VENDOR_HCOMMENT
LOWarchive/csrc/ktransformers_ext/cuda/binding.cpp1/**COMMENT
LOWarchive/csrc/ktransformers_ext/cuda/gptq_marlin/ops.h21COMMENT
LOWarchive/csrc/balance_serve/sched/scheduler.h1#pragma onceCOMMENT
LOWarchive/csrc/balance_serve/sched/scheduler.cpp1#define SPDLOG_ACTIVE_LEVEL SPDLOG_LEVEL_INFOCOMMENT
LOWarchive/csrc/balance_serve/sched/metrics.h1#ifndef Metrics_HCOMMENT
LOWarchive/csrc/balance_serve/sched/utils/all.hpp1#pragma onceCOMMENT
LOWarchive/csrc/balance_serve/kvc2/test/page_pool_test.cpp1COMMENT
LOW…ve/csrc/balance_serve/kvc2/test/kvc2test/lookup-mt.cpp61 // // common prefixCOMMENT
LOW…ve/csrc/balance_serve/kvc2/test/kvc2test/lookup-mt.cpp81 // // insert partly newCOMMENT
LOW…e/csrc/balance_serve/kvc2/test/kvc2test/lookup-gpu.cpp101 cmp_handle_data(k1, k_from_gpu, 3);COMMENT
LOW…e/csrc/balance_serve/kvc2/test/kvc2test/lookup-gpu.cpp121COMMENT
LOW…e/csrc/balance_serve/kvc2/test/kvc2test/lookup-gpu.cpp141 // auto ids2 = random_ids(10 * config.num_token_per_page, gen);COMMENT
LOWarchive/csrc/balance_serve/kvc2/src/async_store.cpp1COMMENT
598 more matches not shown…
Excessive Try-Catch Wrapping315 hits · 372 pts
SeverityFileLineSnippetContext
LOWktransformers.py30 except Exception:CODE
MEDIUMktransformers.py27def has_sft_support() -> bool:CODE
LOW…chive/merge_tensors/merge_safetensor_gguf_for_qwen3.py47 except Exception as e:CODE
MEDIUM…chive/merge_tensors/merge_safetensor_gguf_for_qwen3.py48 print(f"Error reading Safetensor file {file_path}: {e}")CODE
LOWarchive/merge_tensors/merge_safetensor_gguf.py48 except Exception as e:CODE
MEDIUMarchive/merge_tensors/merge_safetensor_gguf.py49 print(f"Error reading Safetensor file {file_path}: {e}")CODE
LOWarchive/kt-sft/setup.py45except Exception:CODE
LOWarchive/kt-sft/setup.py73 except Exception:CODE
LOWarchive/kt-sft/merge_tensors/merge_safetensor_gguf.py48 except Exception as e:CODE
MEDIUMarchive/kt-sft/merge_tensors/merge_safetensor_gguf.py49 print(f"Error reading Safetensor file {file_path}: {e}")CODE
LOWarchive/kt-sft/test_adapter/infer_with_adapter.py27 except Exception as e:CODE
LOWarchive/kt-sft/test_adapter/inspect_adapter.py60 except Exception as e:CODE
LOWarchive/kt-sft/test_adapter/inspect_adapter.py77 except Exception as e:CODE
LOWarchive/kt-sft/test_adapter/inspect_adapter.py94 except Exception as e:CODE
LOWarchive/kt-sft/ktransformers/local_chat.py224 except Exception as e:CODE
MEDIUMarchive/kt-sft/ktransformers/util/custom_loader.py71 print(f"Error opening Safetensor file {file_path}: {e}")CODE
MEDIUMarchive/kt-sft/ktransformers/util/custom_loader.py81 print(f"Error reading Safetensor file {file_path}: {e}")CODE
LOWarchive/kt-sft/ktransformers/util/custom_loader.py70 except Exception as e:CODE
LOWarchive/kt-sft/ktransformers/util/custom_loader.py80 except Exception as e:CODE
LOWarchive/kt-sft/ktransformers/util/custom_loader.py557 except Exception as e:CODE
LOWarchive/kt-sft/ktransformers/util/custom_loader.py566 except Exception as e:CODE
LOWarchive/kt-sft/ktransformers/util/utils.py74 except Exception:CODE
LOWarchive/kt-sft/ktransformers/util/weight_loader.py85 except Exception as e:CODE
MEDIUMarchive/kt-sft/ktransformers/util/weight_loader.py86 print(f"Error opening Safetensor file {file_path}: {e}")CODE
LOWarchive/kt-sft/ktransformers/util/weight_loader.py95 except Exception as e:CODE
MEDIUMarchive/kt-sft/ktransformers/util/weight_loader.py96 print(f"Error reading Safetensor file {file_path}: {e}")CODE
LOWarchive/kt-sft/ktransformers/tests/mmlu_pro_test.py150 except Exception as e:CODE
MEDIUMarchive/kt-sft/ktransformers/tests/mmlu_pro_test.py151 print(f"Error processing request {i}: {e}")CODE
LOWarchive/kt-sft/ktransformers/tests/mmlu_test_multi.py156 except Exception as e:CODE
MEDIUMarchive/kt-sft/ktransformers/tests/mmlu_test_multi.py157 print(f"Error processing request {index}: {e}")CODE
LOWarchive/kt-sft/ktransformers/tests/mmlu_test.py142 except Exception as e:CODE
MEDIUMarchive/kt-sft/ktransformers/tests/mmlu_test.py143 print(f"Error processing request {i}: {e}")CODE
LOWarchive/kt-sft/ktransformers/tests/test_speed.py116 except Exception as e:CODE
LOWarchive/kt-sft/ktransformers/tests/test_speed.py134 except Exception as e:CODE
MEDIUMarchive/kt-sft/ktransformers/tests/test_speed.py48def fetch_event_stream(session, request_id, prompt, max_tokens, model):CODE
LOWarchive/kt-sft/ktransformers/tests/test_client.py63 except Exception as e:CODE
LOWarchive/kt-sft/ktransformers/tests/test_client.py73 except Exception as e:CODE
MEDIUMarchive/kt-sft/ktransformers/tests/test_client.py15def fetch_event_stream(session, payload, request_id, stream):CODE
LOW…chive/kt-sft/ktransformers/tests/humaneval/eval_api.py75 except Exception as e:CODE
MEDIUM…chive/kt-sft/ktransformers/tests/humaneval/eval_api.py78 print(f"Error: {e}")CODE
LOW…chive/kt-sft/ktransformers/tests/AIME_2024/eval_api.py110 except Exception as e:CODE
LOWarchive/kt-sft/ktransformers/server/utils/sql_utils.py97 except Exception as e:CODE
LOWarchive/kt-sft/ktransformers/server/utils/sql_utils.py108 except Exception as e:CODE
LOWarchive/kt-sft/ktransformers/server/utils/sql_utils.py123 except Exception as e:CODE
LOW…kt-sft/ktransformers/server/balance_serve/sched_rpc.py98 except Exception as e:CODE
LOW…serve/inference/distributed/custom_all_reduce_utils.py244 except Exception as e:CODE
LOW…/balance_serve/inference/distributed/parallel_state.py1248 except Exception as e:CODE
MEDIUM…/balance_serve/inference/distributed/parallel_state.py1249 print("Error ignored in is_in_the_same_node: %s", e)CODE
LOW…lance_serve/inference/distributed/custom_all_reduce.py20except Exception:CODE
LOW…/balance_serve/inference/distributed/pynccl_wrapper.py193 except Exception as e:CODE
LOW…s/server/balance_serve/inference/distributed/pynccl.py62 except Exception:CODE
LOW…-sft/ktransformers/server/api/openai/endpoints/chat.py379 except Exception as e:STRING
LOWarchive/kt-sft/ktransformers/sft/lora.py150 except Exception:CODE
LOWarchive/kt-sft/ktransformers/sft/lora.py228 except Exception:CODE
LOWarchive/kt-sft/ktransformers/sft/lora.py327 except Exception:CODE
MEDIUM…hive/kt-sft/ktransformers/sft/peft_utils/peft_model.py153def active_adapters(self) -> list[str]:CODE
LOW…hive/kt-sft/ktransformers/sft/peft_utils/peft_model.py919 except Exception: # something went wrong, roll backCODE
LOW…t-sft/ktransformers/sft/flops_utils/lora_test_utils.py29 except Exception as e:CODE
LOW…t-sft/ktransformers/sft/flops_utils/lora_test_utils.py40 except Exception as e:CODE
LOW…t-sft/ktransformers/sft/flops_utils/lora_test_utils.py58 except Exception as e:CODE
255 more matches not shown…
Hyper-Verbose Identifiers339 hits · 346 pts
SeverityFileLineSnippetContext
LOWarchive/setup.py80 def get_musa_bare_metal_version(self, musa_dir):CODE
LOWarchive/setup.py90 def get_rocm_bare_metal_version(self, rocm_dir):CODE
LOWarchive/setup.py154 def get_cuda_bare_metal_version(self, cuda_dir):CODE
LOWarchive/setup.py163 def get_cuda_version_of_torch(self):CODE
LOWarchive/setup.py365def run_command_with_live_tail(ext: str, command: List[str], output_lines: int = 20,CODE
LOW…chive/merge_tensors/merge_safetensor_gguf_for_qwen3.py27def read_safetensor_keys_from_folder(folder_path) -> dict:CODE
LOWarchive/merge_tensors/merge_safetensor_gguf.py15def read_safetensor_keys_from_folder(folder_path)->dict:CODE
LOWarchive/csrc/custom_marlin/utils/format24.py21def _calculate_meta_reordering_scatter_offsets(m, meta_ncols, meta_dtype,CODE
LOWarchive/csrc/custom_marlin/utils/format24.py52def sparse_semi_structured_from_dense_cutlass(dense):CODE
LOWarchive/csrc/custom_marlin/utils/format24.py184def sparse_semi_structured_to_dense_cutlass(sparse, meta_reordered):CODE
LOWarchive/kt-sft/setup.py105 def get_musa_bare_metal_version(self, musa_dir):CODE
LOWarchive/kt-sft/setup.py115 def get_rocm_bare_metal_version(self, rocm_dir):CODE
LOWarchive/kt-sft/setup.py179 def get_cuda_bare_metal_version(self, cuda_dir):CODE
LOWarchive/kt-sft/setup.py188 def get_cuda_version_of_torch(self):CODE
LOWarchive/kt-sft/setup.py384def run_command_with_live_tail(ext: str, command: List[str], output_lines: int = 20,CODE
LOWarchive/kt-sft/merge_tensors/merge_safetensor_gguf.py15def read_safetensor_keys_from_folder(folder_path)->dict:CODE
LOW…kt-sft/csrc/ktransformers_ext/examples/test_sft_moe.py604def test_backward_one_vs_many_comparison():CODE
LOWarchive/kt-sft/csrc/custom_marlin/utils/format24.py21def _calculate_meta_reordering_scatter_offsets(m, meta_ncols, meta_dtype,CODE
LOWarchive/kt-sft/csrc/custom_marlin/utils/format24.py52def sparse_semi_structured_from_dense_cutlass(dense):CODE
LOWarchive/kt-sft/csrc/custom_marlin/utils/format24.py184def sparse_semi_structured_to_dense_cutlass(sparse, meta_reordered):CODE
LOWarchive/kt-sft/ktransformers/local_chat.py239 # def first_token_argmax_baseline(model, tokenizer, prompt_text, device):COMMENT
LOWarchive/kt-sft/ktransformers/operators/cpuinfer.py328 def update_importance_one_block(CODE
LOWarchive/kt-sft/ktransformers/operators/cpuinfer.py473 def clear_importance_all_layers(CODE
LOWarchive/kt-sft/ktransformers/operators/cpuinfer.py704 def get_all_kvcache_one_layer(CODE
LOW…ve/kt-sft/ktransformers/operators/dynamic_attention.py271 def get_preselect_block_table_and_attn_score(CODE
LOW…ive/kt-sft/ktransformers/operators/triton_attention.py165def _decode_grouped_att_m_fwd(CODE
LOW…ive/kt-sft/ktransformers/operators/triton_attention.py313def _decode_softmax_reducev_fwd(CODE
LOW…ive/kt-sft/ktransformers/operators/triton_attention.py358def decode_attention_fwd_grouped(CODE
LOWarchive/kt-sft/ktransformers/util/custom_gguf.py97def quant_shape_to_byte_shape(shape: Sequence[int], quant_type: GGMLQuantizationType):CODE
LOWarchive/kt-sft/ktransformers/util/custom_gguf.py635def translate_name_to_gguf_mixtral(name):CODE
LOWarchive/kt-sft/ktransformers/util/custom_gguf.py704def translate_adapter_name_to_gguf(name):CODE
LOW…chive/kt-sft/ktransformers/util/modeling_rope_utils.py29def _compute_default_rope_parameters(CODE
LOW…chive/kt-sft/ktransformers/util/modeling_rope_utils.py71def _compute_linear_scaling_rope_parameters(CODE
LOW…chive/kt-sft/ktransformers/util/modeling_rope_utils.py112def _compute_dynamic_ntk_parameters(CODE
LOW…chive/kt-sft/ktransformers/util/modeling_rope_utils.py259def _compute_longrope_parameters(CODE
LOW…chive/kt-sft/ktransformers/util/modeling_rope_utils.py407def _validate_default_rope_parameters(config: PretrainedConfig, ignore_keys: Optional[set] = None):CODE
LOW…chive/kt-sft/ktransformers/util/modeling_rope_utils.py415def _validate_linear_scaling_rope_parameters(config: PretrainedConfig, ignore_keys: Optional[set] = None):CODE
LOW…chive/kt-sft/ktransformers/util/modeling_rope_utils.py427def _validate_dynamic_scaling_rope_parameters(config: PretrainedConfig, ignore_keys: Optional[set] = None):CODE
LOW…chive/kt-sft/ktransformers/util/modeling_rope_utils.py441def _validate_yarn_parameters(config: PretrainedConfig, ignore_keys: Optional[set] = None):CODE
LOW…chive/kt-sft/ktransformers/util/modeling_rope_utils.py479def _validate_longrope_parameters(config: PretrainedConfig, ignore_keys: Optional[set] = None):CODE
LOWarchive/kt-sft/ktransformers/util/custom_loader.py389 def get_undequanted_tensor_and_ggml_type(self, name):CODE
LOWarchive/kt-sft/ktransformers/util/utils.py527def prefill_and_generate_capture(CODE
LOW…/kt-sft/ktransformers/server/utils/create_interface.py38def get_thread_context_manager() -> GlobalContextManager:CODE
LOW…kt-sft/ktransformers/server/backend/context_manager.py29 async def get_context_by_run_object(self, run: RunObject) -> ThreadContext:CODE
LOWarchive/kt-sft/ktransformers/server/backend/base.py57 def report_last_time_performance(self):CODE
LOW…transformers/server/backend/interfaces/transformers.py176 def format_and_tokenize_input_ids(self, thread_id: ObjectID, messages: List):CODE
LOW…ransformers/server/backend/interfaces/balance_serve.py94def report_last_time_performance(profiler: Profiler):CODE
LOW…ransformers/server/backend/interfaces/balance_serve.py411 def format_and_tokenize_input_ids(self, thread_id: ObjectID, messages: List):CODE
LOW…/ktransformers/server/schemas/assistants/assistants.py133 def get_related_threads_objects(self) -> List:CODE
LOW…ft/ktransformers/server/schemas/assistants/messages.py160 def stream_response_with_event(self, event: MessageBase.Status) -> MessageStreamResponse:CODE
LOW…t/ktransformers/server/schemas/assistants/streaming.py136def wrap_async_generator_into_queue(async_events: AsyncIterable) -> asyncio.Queue:CODE
LOW…kt-sft/ktransformers/server/schemas/assistants/runs.py105 def stream_response_with_event(self,event:RunBase.Status)->RunStreamResponse:CODE
LOW…kt-sft/ktransformers/server/schemas/assistants/runs.py123 def create_message_creation_step(self):CODE
LOW…kt-sft/ktransformers/server/balance_serve/sched_rpc.py179 def get_inference_context_raw(self):CODE
LOW…/balance_serve/inference/distributed/parallel_state.py891def init_model_parallel_group(CODE
LOW…/balance_serve/inference/distributed/parallel_state.py967def init_distributed_environment(CODE
LOW…/balance_serve/inference/distributed/parallel_state.py1014def initialize_model_parallel(CODE
LOW…/balance_serve/inference/distributed/parallel_state.py1091def ensure_model_parallel_initialized(CODE
LOW…/balance_serve/inference/distributed/parallel_state.py1120def model_parallel_is_initialized():CODE
LOW…/balance_serve/inference/distributed/parallel_state.py1129def patch_tensor_parallel_group(tp_group: GroupCoordinator):CODE
279 more matches not shown…
Deep Nesting334 hits · 308 pts
SeverityFileLineSnippetContext
LOWarchive/setup.py238CODE
LOWarchive/setup.py490CODE
LOW…chive/merge_tensors/merge_safetensor_gguf_for_qwen3.py27CODE
LOW…chive/merge_tensors/merge_safetensor_gguf_for_qwen3.py103CODE
LOWarchive/merge_tensors/merge_safetensor_gguf.py15CODE
LOWarchive/merge_tensors/merge_safetensor_gguf.py97CODE
LOWarchive/csrc/ktransformers_ext/bench/bench_moe_torch.py80CODE
LOWarchive/csrc/ktransformers_ext/bench/bench_moe.py31CODE
LOWarchive/csrc/ktransformers_ext/bench/bench_moe_amx.py29CODE
LOWarchive/csrc/ktransformers_ext/bench/bench_mlp.py28CODE
LOWarchive/csrc/ktransformers_ext/bench/bench_linear.py28CODE
LOW…ive/csrc/ktransformers_ext/bench/bench_linear_torch.py26CODE
LOWarchive/csrc/ktransformers_ext/bench/bench_mlp_torch.py47CODE
LOWarchive/kt-sft/setup.py259CODE
LOWarchive/kt-sft/setup.py509CODE
LOWarchive/kt-sft/merge_tensors/merge_safetensor_gguf.py15CODE
LOWarchive/kt-sft/merge_tensors/merge_safetensor_gguf.py97CODE
LOW…kt-sft/csrc/ktransformers_ext/bench/bench_moe_torch.py80CODE
LOW…chive/kt-sft/csrc/ktransformers_ext/bench/bench_moe.py31CODE
LOW…e/kt-sft/csrc/ktransformers_ext/bench/bench_moe_amx.py29CODE
LOW…chive/kt-sft/csrc/ktransformers_ext/bench/bench_mlp.py28CODE
LOW…ve/kt-sft/csrc/ktransformers_ext/bench/bench_linear.py28CODE
LOW…sft/csrc/ktransformers_ext/bench/bench_linear_torch.py26CODE
LOW…kt-sft/csrc/ktransformers_ext/bench/bench_mlp_torch.py47CODE
LOW…ft/csrc/ktransformers_ext/examples/test_sft_amx_moe.py476CODE
LOW…ft/csrc/ktransformers_ext/examples/test_sft_amx_moe.py501CODE
LOW…ft/csrc/ktransformers_ext/examples/test_sft_amx_moe.py536CODE
LOW…ft/csrc/ktransformers_ext/examples/test_sft_amx_moe.py551CODE
LOWarchive/kt-sft/ktransformers/local_chat.py87CODE
LOWarchive/kt-sft/ktransformers/optimize/optimize.py20CODE
LOWarchive/kt-sft/ktransformers/optimize/optimize.py55CODE
LOWarchive/kt-sft/ktransformers/operators/linear.py83CODE
LOWarchive/kt-sft/ktransformers/operators/cpuinfer.py30CODE
LOW…ve/kt-sft/ktransformers/operators/dynamic_attention.py271CODE
LOW…ve/kt-sft/ktransformers/operators/dynamic_attention.py605CODE
LOW…sft/ktransformers/operators/balance_serve_attention.py327CODE
LOWarchive/kt-sft/ktransformers/operators/experts.py88CODE
LOWarchive/kt-sft/ktransformers/operators/experts.py353CODE
LOWarchive/kt-sft/ktransformers/operators/experts.py799CODE
LOWarchive/kt-sft/ktransformers/operators/experts.py1022CODE
LOWarchive/kt-sft/ktransformers/operators/experts.py1069CODE
LOWarchive/kt-sft/ktransformers/util/custom_gguf.py170CODE
LOWarchive/kt-sft/ktransformers/util/vendors.py23CODE
LOWarchive/kt-sft/ktransformers/util/vendors.py75CODE
LOWarchive/kt-sft/ktransformers/util/custom_loader.py47CODE
LOWarchive/kt-sft/ktransformers/util/custom_loader.py100CODE
LOWarchive/kt-sft/ktransformers/util/custom_loader.py260CODE
LOWarchive/kt-sft/ktransformers/util/custom_loader.py296CODE
LOWarchive/kt-sft/ktransformers/util/custom_loader.py426CODE
LOWarchive/kt-sft/ktransformers/util/custom_loader.py508CODE
LOWarchive/kt-sft/ktransformers/util/utils.py166CODE
LOWarchive/kt-sft/ktransformers/util/utils.py61CODE
LOWarchive/kt-sft/ktransformers/util/weight_loader.py59CODE
LOWarchive/kt-sft/ktransformers/util/weight_loader.py190CODE
LOWarchive/kt-sft/ktransformers/tests/mmlu_test_multi.py115CODE
LOWarchive/kt-sft/ktransformers/tests/test_speed.py48CODE
LOWarchive/kt-sft/ktransformers/tests/test_client.py15CODE
LOW…chive/kt-sft/ktransformers/tests/humaneval/eval_api.py34CODE
LOW…/kt-sft/ktransformers/server/utils/create_interface.py19CODE
LOW…kt-sft/ktransformers/server/backend/context_manager.py29CODE
274 more matches not shown…
Decorative Section Separators83 hits · 291 pts
SeverityFileLineSnippetContext
MEDIUMinstall.sh47# ─── Helpers ───────────────────────────────────────────────────────────────────COMMENT
MEDIUMinstall.sh81# ─── Submodule init ────────────────────────────────────────────────────────────COMMENT
MEDIUMinstall.sh97# ─── sglang install ───────────────────────────────────────────────────────────COMMENT
MEDIUMinstall.sh126# ─── kt-kernel install ────────────────────────────────────────────────────────COMMENT
MEDIUMinstall.sh145# ─── deps install ─────────────────────────────────────────────────────────────COMMENT
MEDIUMinstall.sh161# ─── "all" subcommand ─────────────────────────────────────────────────────────COMMENT
MEDIUMinstall.sh212# ─── Subcommand dispatcher ────────────────────────────────────────────────────COMMENT
MEDIUM…/balance_serve/inference/distributed/parallel_state.py327 # --------------------------------------------COMMENT
MEDIUMarchive/third_party/llamafile/tinyblas_cpu.h30// ╚═╝ ╚═╝╚═╝ ╚═╝ ╚══╝ ╚═════╝ ╚═══╝╚═╝ ╚═╝╚═════╝COMMENT
MEDIUM…ive/ktransformers/operators/ascend/ascend_attention.py920 # -------------------------------------------------------COMMENT
MEDIUM…ive/ktransformers/operators/ascend/ascend_attention.py922 # -------------------------------------------------------COMMENT
MEDIUM…ive/ktransformers/operators/ascend/ascend_attention.py994 # -------------------------------------------------------COMMENT
MEDIUM…ive/ktransformers/operators/ascend/ascend_attention.py996 # -------------------------------------------------------COMMENT
MEDIUMarchive/ktransformers/tests/UT/test_kdeepseek_ln_npu.py12# ==========================COMMENT
MEDIUMarchive/ktransformers/tests/UT/test_kdeepseek_ln_npu.py14# ==========================COMMENT
MEDIUM…s/tests/UT/test_kdeepseek_attention_w8a8a2serve_npu.py221# ==========================COMMENT
MEDIUM…s/tests/UT/test_kdeepseek_attention_w8a8a2serve_npu.py223# ==========================COMMENT
MEDIUM…/balance_serve/inference/distributed/parallel_state.py327 # --------------------------------------------COMMENT
MEDIUM…sformers/models/ascend/custom_ascend_modeling_qwen3.py87 # ---------------------------------------------------COMMENT
MEDIUM…sformers/models/ascend/custom_ascend_modeling_qwen3.py89 # ---------------------------------------------------COMMENT
MEDIUMkt-kernel/setup.py63# -------------------------COMMENT
MEDIUMkt-kernel/setup.py65# -------------------------COMMENT
MEDIUMkt-kernel/bench/bench_write_buffer.py102# ==============================================================================COMMENT
MEDIUMkt-kernel/bench/bench_write_buffer.py104# ==============================================================================COMMENT
MEDIUMkt-kernel/bench/bench_write_buffer.py326# ==============================================================================COMMENT
MEDIUMkt-kernel/bench/bench_write_buffer.py328# ==============================================================================COMMENT
MEDIUMkt-kernel/bench/bench_write_buffer.py408# ==============================================================================COMMENT
MEDIUMkt-kernel/bench/bench_write_buffer.py410# ==============================================================================COMMENT
MEDIUMkt-kernel/test/test_native_moe_loader_auto_release.py79# ---------------------------------------------------------------------------COMMENT
MEDIUMkt-kernel/test/test_native_moe_loader_auto_release.py81# ---------------------------------------------------------------------------COMMENT
MEDIUMkt-kernel/test/test_native_moe_loader_auto_release.py199# ---------------------------------------------------------------------------COMMENT
MEDIUMkt-kernel/test/test_native_moe_loader_auto_release.py201# ---------------------------------------------------------------------------COMMENT
MEDIUMkt-kernel/python/experts.py303# =============================================================================COMMENT
MEDIUMkt-kernel/python/experts.py305# =============================================================================COMMENT
MEDIUMkt-kernel/python/cli/utils/model_registry.py377# ============================================================================COMMENT
MEDIUMkt-kernel/python/cli/utils/model_registry.py379# ============================================================================COMMENT
MEDIUMkt-kernel/python/sft/wrapper.py46# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/wrapper.py48# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/wrapper.py136# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/wrapper.py138# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/wrapper.py408# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/wrapper.py410# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/arch.py21# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/arch.py23# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/arch.py42# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/arch.py44# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/lora.py29# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/lora.py31# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/lora.py307# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/lora.py309# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/lora.py454# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/lora.py456# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/lora.py580# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/lora.py582# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/lora.py82# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/lora.py84# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/lora.py132# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/lora.py134# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/lora.py523# =============================================================================COMMENT
MEDIUMkt-kernel/python/sft/lora.py525# =============================================================================COMMENT
23 more matches not shown…
Structural Annotation Overuse125 hits · 201 pts
SeverityFileLineSnippetContext
LOWkt-kernel/operators/moe-sft-tp.hpp355 // Step 1: For each NUMA, allocate and copy partitioned weightsCOMMENT
LOWkt-kernel/operators/moe-sft-tp.hpp394 // Step 2: Set weight pointers BEFORE load_weights (Bug #24 fix)COMMENT
LOWkt-kernel/operators/moe-sft-tp.hpp402 // Step 3: Prepare backward weights (this also clears weight pointers)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1108 // Step 4: Quantize inputCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1114 // Step 5: Gate + Up GEMM (base projection)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1274 // Step 7: Quantize intermediate for down projectionCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1283 // Step 8: Down GEMMCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3751 // Step 1: intermediate = input @ lora_A^T (optimized with T_BLOCK=4, R_BLOCK=4)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3757 // Step 2: output += scale * (intermediate @ lora_B_transposed)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp4223 // Step 1: Zero per-expert grad_output buffersCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp4233 // Step 2: Scatter grad_output to per-expert BF16 buffersCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp4368 // Step 1: grad_output @ down_lora_B_transposed -> [local_num_tokens, rank]COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp4375 // Step 2: grad_times_b @ down_lora_A -> [local_num_tokens, inter_size] (AVX512)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp4385 // Step 5: LoRA gradient computation (parallelized across blocks)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp952 // Step 1: Expert routing (reuse base class logic)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp971 // Step 2: Buffer pool allocation (reuse base class logic)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1073 // Step 3: Copy input to expert buffersCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1219 // Step 6: Activation (silu(gate) * up)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1335 // Step 9: Weighted mergeCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1549 // Step 1: Down projection backwardCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1711 // Step 4: Compute grad_weights (gradient for routing weights)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3368 // Step 1: input @ lora_A^T -> lora_intermediateCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3400 // Step 2: Quantize lora_intermediate to BufferACOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3533 // Step 1: intermediate @ down_lora_A^T -> lora_intermediateCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3560 // Step 2: Quantize lora_intermediate to BufferACOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3812 // Step 1: intermediate = input @ lora_A^T (optimized with T_BLOCK=4, R_BLOCK=4)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3823 // Step 2: output += scale * (intermediate @ lora_B_transposed)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp4278 // Step 3: Quantize scattered grad_output to BufferACOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp5383 // Step 6: grad_A = G_B^T @ XCOMMENT
LOWkt-kernel/operators/amx/test/test_lora_fused_add.cpp1657 // Step 1: Reduce 512 -> 256 by adding high/low halves (8 ops)COMMENT
LOWkt-kernel/operators/amx/test/test_lora_fused_add.cpp1671 // Step 2: Pack pairs into single 512-bit vectorsCOMMENT
LOWkt-kernel/operators/amx/test/test_lora_fused_add.cpp1679 // Step 3: Reduce 256 -> 128 within each pairCOMMENT
LOWkt-kernel/operators/amx/test/test_lora_fused_add.cpp1686 // Step 4: Reduce 128 -> 64 -> 32 within eachCOMMENT
LOWkt-kernel/operators/amx/la/avx_kernels.hpp924 // Step 1: Interleave 16-bitCOMMENT
LOWkt-kernel/operators/amx/la/avx_kernels.hpp934 // Step 2: Interleave 32-bitCOMMENT
LOWkt-kernel/operators/amx/la/avx_kernels.hpp944 // Step 3: Interleave 64-bitCOMMENT
LOWkt-kernel/operators/amx/la/avx_kernels.hpp985 // Step 1: Interleave 16-bitCOMMENT
LOWkt-kernel/operators/amx/la/avx_kernels.hpp1003 // Step 2: Interleave 32-bitCOMMENT
LOWkt-kernel/operators/amx/la/avx_kernels.hpp1021 // Step 3: Interleave 64-bitCOMMENT
LOWkt-kernel/operators/amx/la/avx_kernels.hpp1039 // Step 4: Permute 128-bit lanesCOMMENT
LOWkt-kernel/python/cli/utils/quant_interactive.py245 # Step 1: Select modelCOMMENT
LOWkt-kernel/python/cli/utils/quant_interactive.py260 # Step 2: Configure quantization methodCOMMENT
LOWkt-kernel/python/cli/utils/quant_interactive.py263 # Step 3: Configure CPU parametersCOMMENT
LOWkt-kernel/python/cli/utils/quant_interactive.py266 # Step 4: Configure output pathCOMMENT
LOWkt-kernel/python/cli/utils/quant_interactive.py288 # Step 5: Calculate space requirements and check availabilityCOMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py893 # Step 1: Select modelCOMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py898 # Step 2: Select inference methodCOMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py993 # Step 3: Configure NUMA and CPUCOMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py996 # Step 4: Configure GPU expertsCOMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py999 # Step 5: Configure KV Cache (only for raw)COMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py1003 # Step 6: Select GPUs and TPCOMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py1008 # Step 7: Configure parsers (optional)COMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py1011 # Step 8: Configure host and portCOMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py1035 # Step 9: Save configurationCOMMENT
LOWkt-kernel/python/cli/commands/run.py330 # Step 2: Resolve modelCOMMENT
LOWkt-kernel/python/cli/commands/run.py390 # Step 3: Check quantized weights (only if explicitly requested)COMMENT
LOWkt-kernel/python/cli/commands/run.py414 # Step 4: Build commandCOMMENT
LOWkt-kernel/python/cli/commands/run.py514 # Step 5: Show configuration summaryCOMMENT
LOWkt-kernel/python/cli/commands/run.py544 # Step 6: Show or executeCOMMENT
LOWkt-kernel/python/cli/commands/model.py2583 # Step 1: Delete the corrupted/missing file if it existsCOMMENT
65 more matches not shown…
Redundant / Tautological Comments101 hits · 153 pts
SeverityFileLineSnippetContext
LOWdocker/docker-utils.sh106 # Check if image existsCOMMENT
LOWdocker/docker-utils.sh230# Check if Docker daemon is runningCOMMENT
LOWdocker/docker-utils.sh240# Check if user is logged into Docker registryCOMMENT
LOWdocker/docker-utils.sh297# Check if file/directory exists and is writableCOMMENT
LOWdocker/build-docker-tar.sh373 # Check if tar file already existsCOMMENT
LOWdocker/push-to-dockerhub.sh290 # Check if we should skip buildCOMMENT
LOWdocker/push-to-dockerhub.sh862 # Check if we should skip buildCOMMENT
LOWarchive/kt-sft/ktransformers/operators/experts.py470 # Check if we need to allocate or expand buffersCOMMENT
LOWarchive/kt-sft/ktransformers/util/weight_loader.py177 # Check if any safetensor files exist in the folderCOMMENT
LOWarchive/kt-sft/ktransformers/util/weight_loader.py197 # Check if path existsCOMMENT
LOWarchive/kt-sft/ktransformers/util/weight_loader.py362 # Check if any GGUF files exist in the folderCOMMENT
LOW…-sft/ktransformers/server/api/openai/endpoints/chat.py203 # Check if tools are presentSTRING
LOW…hive/kt-sft/ktransformers/sft/peft_utils/lora_layer.py571 fan_in_fan_out: bool = False, # Set this to True if the layer to replace stores weight like (fan_in, fan_out)CODE
LOW…hive/kt-sft/ktransformers/sft/peft_utils/lora_layer.py1021 fan_in_fan_out: bool = False, # Set this to True if the layer to replace stores weight like (fan_in, fan_out)CODE
LOWarchive/ktransformers/util/weight_loader.py177 # Check if any safetensor files exist in the folderCOMMENT
LOWarchive/ktransformers/util/weight_loader.py197 # Check if path existsCOMMENT
LOWarchive/ktransformers/util/weight_loader.py362 # Check if any GGUF files exist in the folderCOMMENT
LOW…hive/ktransformers/server/api/openai/endpoints/chat.py203 # Check if tools are presentSTRING
LOWkt-kernel/bench/bench_bf16_moe.py222 # Print resultsCOMMENT
LOWkt-kernel/bench/bench_fp8_perchannel_moe.py234 # Print resultsCOMMENT
LOWkt-kernel/bench/bench_fp8_moe.py243 # Print resultsCOMMENT
LOWkt-kernel/test/per_commit/test_moe_amx_bench_int8.py23# Check if dependencies are availableCOMMENT
LOWkt-kernel/test/per_commit/test_moe_amx_accuracy_int4.py19# Check if dependencies are availableCOMMENT
LOW…kernel/test/per_commit/test_moe_amx_accuracy_int4_1.py19# Check if dependencies are availableCOMMENT
LOWkt-kernel/test/per_commit/test_moe_amx_bench_int4.py23# Check if dependencies are availableCOMMENT
LOWkt-kernel/test/per_commit/test_basic_cpu.py17# Check if kt_kernel_ext is availableCOMMENT
LOW…ernel/test/per_commit/test_moe_amx_accuracy_int4_1k.py19# Check if dependencies are availableCOMMENT
LOWkt-kernel/test/per_commit/test_moe_amx_accuracy_int8.py19# Check if dependencies are availableCOMMENT
LOWkt-kernel/test/per_commit/test_moe_amx_bench_int4_1k.py24# Check if dependencies are availableCOMMENT
LOWkt-kernel/test/per_commit/test_moe_amx_bench_int4_1.py23# Check if dependencies are availableCOMMENT
LOWkt-kernel/python/_cpu_detect.py87 # Check if all required flags are presentCOMMENT
LOWkt-kernel/python/utils/llamafile.py84 # Check if intermediate_size is divisible by QK_KCOMMENT
LOWkt-kernel/python/utils/loader.py217 # Check if backward weights existCOMMENT
LOWkt-kernel/python/utils/loader.py345 # Check if any key matches this format patternCOMMENT
LOWkt-kernel/python/cli/main.py373 # Check if path exists or parent is writableCOMMENT
LOWkt-kernel/python/cli/main.py380 # Check if we can create it (parent writable)COMMENT
LOWkt-kernel/python/cli/main.py407 # Check if already installedCOMMENT
LOWkt-kernel/python/cli/main.py505 # Check if this is first runCOMMENT
LOWkt-kernel/python/cli/utils/console.py142 # Check if response matches a choice directlyCOMMENT
LOWkt-kernel/python/cli/utils/quant_interactive.py226 # Check if available space >= required * 1.2 (20% buffer)COMMENT
LOWkt-kernel/python/cli/utils/model_verifier.py28 # Read file in chunks to handle large filesCOMMENT
LOWkt-kernel/python/cli/utils/model_verifier.py671 # Check if already verifiedCOMMENT
LOWkt-kernel/python/cli/utils/model_verifier.py683 # Check if repo_id existsCOMMENT
LOWkt-kernel/python/cli/utils/model_scanner.py94 # Check if size meets minimum thresholdCOMMENT
LOWkt-kernel/python/cli/utils/model_scanner.py633 # Check if this root is a parent of any already selected rootCOMMENT
LOWkt-kernel/python/cli/utils/kv_cache_calculator.py67 # Check if it's MLA (Multi-head Latent Attention) modelCOMMENT
LOWkt-kernel/python/cli/utils/kv_cache_calculator.py96 # Check if it's NSA (Native Sparse Attention) modelCOMMENT
LOWkt-kernel/python/cli/utils/model_discovery.py101 # Check if already in registryCOMMENT
LOWkt-kernel/python/cli/utils/model_discovery.py105 # Check if already discovered in this sessionCOMMENT
LOWkt-kernel/python/cli/utils/tuna_engine.py202 # Check if process has outputCOMMENT
LOWkt-kernel/python/cli/utils/tuna_engine.py321 # Check if we got a valid responseCOMMENT
LOWkt-kernel/python/cli/utils/tuna_engine.py432 # Check if even 0 doesn't workCOMMENT
LOWkt-kernel/python/cli/utils/download_helper.py77 # Check if filename matches patternCOMMENT
LOWkt-kernel/python/cli/utils/environment.py117 # Check if venv is available (built into Python)COMMENT
LOWkt-kernel/python/cli/utils/environment.py146 # Check if env_name appears as a separate word in the outputCOMMENT
LOWkt-kernel/python/cli/utils/environment.py703 # Check if writableCOMMENT
LOWkt-kernel/python/cli/utils/environment.py742 # Check if parent exists for paths that don't exist yetCOMMENT
LOWkt-kernel/python/cli/utils/environment.py917 # Check if this directory is a modelCOMMENT
LOWkt-kernel/python/cli/utils/model_registry.py276 # Check if query is contained in nameCOMMENT
LOWkt-kernel/python/cli/utils/model_registry.py280 # Check if query is contained in aliasesCOMMENT
41 more matches not shown…
AI Structural Patterns145 hits · 140 pts
SeverityFileLineSnippetContext
LOWarchive/csrc/ktransformers_ext/examples/test_mlp.py39CODE
LOWarchive/csrc/ktransformers_ext/examples/test_moe.py42CODE
LOW…ft/csrc/ktransformers_ext/examples/test_sft_amx_moe.py107CODE
LOW…ive/kt-sft/csrc/ktransformers_ext/examples/test_mlp.py39CODE
LOW…ive/kt-sft/csrc/ktransformers_ext/examples/test_moe.py42CODE
LOW…kt-sft/csrc/ktransformers_ext/examples/test_sft_moe.py66CODE
LOWarchive/kt-sft/ktransformers/local_chat.py87CODE
LOWarchive/kt-sft/ktransformers/operators/layernorm.py72CODE
LOWarchive/kt-sft/ktransformers/operators/layernorm.py113CODE
LOWarchive/kt-sft/ktransformers/operators/layernorm.py157CODE
LOWarchive/kt-sft/ktransformers/operators/models.py215CODE
LOWarchive/kt-sft/ktransformers/operators/models.py577CODE
LOWarchive/kt-sft/ktransformers/operators/models.py1048CODE
LOWarchive/kt-sft/ktransformers/operators/models.py1501CODE
LOWarchive/kt-sft/ktransformers/operators/cpuinfer.py30CODE
LOW…ve/kt-sft/ktransformers/operators/dynamic_attention.py34CODE
LOWarchive/kt-sft/ktransformers/operators/RoPE.py276CODE
LOWarchive/kt-sft/ktransformers/util/utils.py344CODE
LOWarchive/kt-sft/ktransformers/util/utils.py527CODE
LOW…kt-sft/ktransformers/server/balance_serve/sched_rpc.py181CODE
LOW…formers/server/balance_serve/inference/model_runner.py59CODE
LOW…ormers/server/balance_serve/inference/forward_batch.py198CODE
LOW…ive/kt-sft/ktransformers/models/configuration_llama.py143CODE
LOWarchive/kt-sft/ktransformers/models/modeling_mixtral.py1124CODE
LOWarchive/kt-sft/ktransformers/models/modeling_mixtral.py1373CODE
LOWarchive/kt-sft/ktransformers/models/modeling_mixtral.py1563CODE
LOWarchive/kt-sft/ktransformers/models/modeling_mixtral.py1686CODE
LOW…hive/kt-sft/ktransformers/models/modeling_qwen3_moe.py345CODE
LOW…hive/kt-sft/ktransformers/models/modeling_qwen3_moe.py679CODE
LOW…hive/kt-sft/ktransformers/models/modeling_qwen3_moe.py1074CODE
LOW…hive/kt-sft/ktransformers/models/modeling_qwen3_moe.py1217CODE
LOW…hive/kt-sft/ktransformers/models/modeling_qwen3_moe.py1328CODE
LOW…hive/kt-sft/ktransformers/models/modeling_qwen3_moe.py1405CODE
LOW…kt-sft/ktransformers/models/configuration_qwen2_moe.py115CODE
LOW…ve/kt-sft/ktransformers/models/modeling_deepseek_v3.py268CODE
LOW…ve/kt-sft/ktransformers/models/modeling_deepseek_v3.py1390CODE
LOW…ve/kt-sft/ktransformers/models/modeling_deepseek_v3.py1638CODE
LOW…ve/kt-sft/ktransformers/models/modeling_deepseek_v3.py1844CODE
LOW…hive/kt-sft/ktransformers/models/modeling_qwen2_moe.py1115CODE
LOW…hive/kt-sft/ktransformers/models/modeling_qwen2_moe.py1364CODE
LOW…hive/kt-sft/ktransformers/models/modeling_qwen2_moe.py1593CODE
LOW…hive/kt-sft/ktransformers/models/modeling_qwen2_moe.py1716CODE
LOW…kt-sft/ktransformers/models/configuration_qwen3_moe.py161CODE
LOW…chive/kt-sft/ktransformers/models/modeling_deepseek.py259CODE
LOW…chive/kt-sft/ktransformers/models/modeling_deepseek.py1424CODE
LOW…chive/kt-sft/ktransformers/models/modeling_deepseek.py1679CODE
LOW…chive/kt-sft/ktransformers/models/modeling_deepseek.py1899CODE
LOWarchive/kt-sft/ktransformers/models/modeling_llama.py993CODE
LOWarchive/kt-sft/ktransformers/models/modeling_llama.py1271CODE
LOWarchive/kt-sft/ktransformers/models/modeling_llama.py1458CODE
LOWarchive/kt-sft/ktransformers/models/modeling_llama.py1587CODE
LOWarchive/kt-sft/ktransformers/models/modeling_llama.py1693CODE
LOW…-sft/ktransformers/models/configuration_deepseek_v3.py106CODE
LOW…/kt-sft/ktransformers/models/configuration_deepseek.py113CODE
LOW…formers/configs/model_config/configuration_deepseek.py115CODE
LOW…hive/kt-sft/ktransformers/sft/peft_utils/peft_model.py1403CODE
LOW…hive/kt-sft/ktransformers/sft/peft_utils/lora_layer.py475CODE
LOW…hive/kt-sft/ktransformers/sft/peft_utils/lora_layer.py564CODE
LOW…hive/kt-sft/ktransformers/sft/peft_utils/lora_layer.py1014CODE
LOWarchive/ktransformers/local_chat_test.py55CODE
85 more matches not shown…
Verbosity Indicators68 hits · 111 pts
SeverityFileLineSnippetContext
LOWkt-kernel/operators/moe-sft-tp.hpp355 // Step 1: For each NUMA, allocate and copy partitioned weightsCOMMENT
LOWkt-kernel/operators/moe-sft-tp.hpp394 // Step 2: Set weight pointers BEFORE load_weights (Bug #24 fix)COMMENT
LOWkt-kernel/operators/moe-sft-tp.hpp402 // Step 3: Prepare backward weights (this also clears weight pointers)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1108 // Step 4: Quantize inputCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1114 // Step 5: Gate + Up GEMM (base projection)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1274 // Step 7: Quantize intermediate for down projectionCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1283 // Step 8: Down GEMMCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3751 // Step 1: intermediate = input @ lora_A^T (optimized with T_BLOCK=4, R_BLOCK=4)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3757 // Step 2: output += scale * (intermediate @ lora_B_transposed)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp4223 // Step 1: Zero per-expert grad_output buffersCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp4233 // Step 2: Scatter grad_output to per-expert BF16 buffersCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp4368 // Step 1: grad_output @ down_lora_B_transposed -> [local_num_tokens, rank]COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp4375 // Step 2: grad_times_b @ down_lora_A -> [local_num_tokens, inter_size] (AVX512)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp4385 // Step 5: LoRA gradient computation (parallelized across blocks)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp952 // Step 1: Expert routing (reuse base class logic)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp971 // Step 2: Buffer pool allocation (reuse base class logic)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1073 // Step 3: Copy input to expert buffersCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1219 // Step 6: Activation (silu(gate) * up)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1335 // Step 9: Weighted mergeCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1549 // Step 1: Down projection backwardCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp1711 // Step 4: Compute grad_weights (gradient for routing weights)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3368 // Step 1: input @ lora_A^T -> lora_intermediateCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3400 // Step 2: Quantize lora_intermediate to BufferACOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3533 // Step 1: intermediate @ down_lora_A^T -> lora_intermediateCOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3560 // Step 2: Quantize lora_intermediate to BufferACOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3812 // Step 1: intermediate = input @ lora_A^T (optimized with T_BLOCK=4, R_BLOCK=4)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp3823 // Step 2: output += scale * (intermediate @ lora_B_transposed)COMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp4278 // Step 3: Quantize scattered grad_output to BufferACOMMENT
LOWkt-kernel/operators/amx/sft_moe.hpp5383 // Step 6: grad_A = G_B^T @ XCOMMENT
LOWkt-kernel/operators/amx/test/test_lora_fused_add.cpp1657 // Step 1: Reduce 512 -> 256 by adding high/low halves (8 ops)COMMENT
LOWkt-kernel/operators/amx/test/test_lora_fused_add.cpp1671 // Step 2: Pack pairs into single 512-bit vectorsCOMMENT
LOWkt-kernel/operators/amx/test/test_lora_fused_add.cpp1679 // Step 3: Reduce 256 -> 128 within each pairCOMMENT
LOWkt-kernel/operators/amx/test/test_lora_fused_add.cpp1686 // Step 4: Reduce 128 -> 64 -> 32 within eachCOMMENT
LOWkt-kernel/operators/amx/la/avx_kernels.hpp924 // Step 1: Interleave 16-bitCOMMENT
LOWkt-kernel/operators/amx/la/avx_kernels.hpp934 // Step 2: Interleave 32-bitCOMMENT
LOWkt-kernel/operators/amx/la/avx_kernels.hpp944 // Step 3: Interleave 64-bitCOMMENT
LOWkt-kernel/operators/amx/la/avx_kernels.hpp985 // Step 1: Interleave 16-bitCOMMENT
LOWkt-kernel/operators/amx/la/avx_kernels.hpp1003 // Step 2: Interleave 32-bitCOMMENT
LOWkt-kernel/operators/amx/la/avx_kernels.hpp1021 // Step 3: Interleave 64-bitCOMMENT
LOWkt-kernel/operators/amx/la/avx_kernels.hpp1039 // Step 4: Permute 128-bit lanesCOMMENT
LOWkt-kernel/python/cli/utils/quant_interactive.py245 # Step 1: Select modelCOMMENT
LOWkt-kernel/python/cli/utils/quant_interactive.py260 # Step 2: Configure quantization methodCOMMENT
LOWkt-kernel/python/cli/utils/quant_interactive.py263 # Step 3: Configure CPU parametersCOMMENT
LOWkt-kernel/python/cli/utils/quant_interactive.py266 # Step 4: Configure output pathCOMMENT
LOWkt-kernel/python/cli/utils/quant_interactive.py288 # Step 5: Calculate space requirements and check availabilityCOMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py893 # Step 1: Select modelCOMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py898 # Step 2: Select inference methodCOMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py993 # Step 3: Configure NUMA and CPUCOMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py996 # Step 4: Configure GPU expertsCOMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py999 # Step 5: Configure KV Cache (only for raw)COMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py1003 # Step 6: Select GPUs and TPCOMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py1008 # Step 7: Configure parsers (optional)COMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py1011 # Step 8: Configure host and portCOMMENT
LOWkt-kernel/python/cli/utils/run_interactive.py1035 # Step 9: Save configurationCOMMENT
LOWkt-kernel/python/cli/commands/run.py330 # Step 2: Resolve modelCOMMENT
LOWkt-kernel/python/cli/commands/run.py390 # Step 3: Check quantized weights (only if explicitly requested)COMMENT
LOWkt-kernel/python/cli/commands/run.py414 # Step 4: Build commandCOMMENT
LOWkt-kernel/python/cli/commands/run.py514 # Step 5: Show configuration summaryCOMMENT
LOWkt-kernel/python/cli/commands/run.py544 # Step 6: Show or executeCOMMENT
LOWkt-kernel/python/cli/commands/model.py2583 # Step 1: Delete the corrupted/missing file if it existsCOMMENT
8 more matches not shown…
Cross-Language Confusion16 hits · 78 pts
SeverityFileLineSnippetContext
HIGHarchive/csrc/custom_marlin/utils/format24.py142 -1, idxs0.unsqueeze(-1)) # type: ignore[possibly-undefined]CODE
HIGHarchive/csrc/custom_marlin/utils/format24.py149 k // 2) # type: ignore[possibly-undefined]CODE
HIGHarchive/csrc/custom_marlin/utils/format24.py172 (m * meta_ncols, )) # type: ignore[possibly-undefined]CODE
HIGHarchive/kt-sft/csrc/custom_marlin/utils/format24.py142 -1, idxs0.unsqueeze(-1)) # type: ignore[possibly-undefined]CODE
HIGHarchive/kt-sft/csrc/custom_marlin/utils/format24.py149 k // 2) # type: ignore[possibly-undefined]CODE
HIGHarchive/kt-sft/csrc/custom_marlin/utils/format24.py172 (m * meta_ncols, )) # type: ignore[possibly-undefined]CODE
HIGH…xt/operators/custom_marlin/quantize/utils/format_24.py142 -1, idxs0.unsqueeze(-1)) # type: ignore[possibly-undefined]CODE
HIGH…xt/operators/custom_marlin/quantize/utils/format_24.py149 k // 2) # type: ignore[possibly-undefined]CODE
HIGH…xt/operators/custom_marlin/quantize/utils/format_24.py172 (m * meta_ncols, )) # type: ignore[possibly-undefined]CODE
HIGH…hive/kt-sft/ktransformers/sft/peft_utils/peft_model.py1393 trainable params: 1843200 || all params: 775873280 || trainable%: 0.23756456724479544STRING
HIGH…xt/operators/custom_marlin/quantize/utils/format_24.py142 -1, idxs0.unsqueeze(-1)) # type: ignore[possibly-undefined]CODE
HIGH…xt/operators/custom_marlin/quantize/utils/format_24.py149 k // 2) # type: ignore[possibly-undefined]CODE
HIGH…xt/operators/custom_marlin/quantize/utils/format_24.py172 (m * meta_ncols, )) # type: ignore[possibly-undefined]CODE
HIGHkt-kernel/python/cli/i18n.py306 "sglang_recommend_source": "Recommend reinstalling with the kvcache-ai fork: pip uninstall sglang -y && pip instCODE
HIGHkt-kernel/python/cli/i18n.py926 "sglang_recommend_source": "建议重新安装 kvcache-ai 分支: pip uninstall sglang -y && pip install sglang-kt",CODE
HIGHkt-kernel/python/cli/commands/doctor.py426 kt_kernel_hint = "Reinstall SGLang: pip uninstall sglang -y && pip install sglang-kt (or run ./install.sh frCODE
Dead Code37 hits · 74 pts
SeverityFileLineSnippetContext
MEDIUM…chive/kt-sft/ktransformers/models/modeling_deepseek.py165CODE
MEDIUM…chive/kt-sft/ktransformers/models/modeling_deepseek.py166CODE
MEDIUM…chive/kt-sft/ktransformers/models/modeling_deepseek.py195CODE
MEDIUM…chive/kt-sft/ktransformers/models/modeling_deepseek.py196CODE
MEDIUMarchive/ktransformers/models/modeling_deepseek.py164CODE
MEDIUMarchive/ktransformers/models/modeling_deepseek.py165CODE
MEDIUMarchive/ktransformers/models/modeling_deepseek.py194CODE
MEDIUMarchive/ktransformers/models/modeling_deepseek.py195CODE
MEDIUMkt-kernel/python/cli/commands/bench.py131CODE
MEDIUMkt-kernel/python/cli/commands/bench.py133CODE
MEDIUMkt-kernel/python/cli/commands/bench.py137CODE
MEDIUMkt-kernel/python/cli/commands/bench.py140CODE
MEDIUMkt-kernel/python/cli/commands/bench.py148CODE
MEDIUMkt-kernel/python/cli/commands/bench.py149CODE
MEDIUMkt-kernel/python/cli/commands/bench.py154CODE
MEDIUMkt-kernel/python/cli/commands/bench.py155CODE
MEDIUMkt-kernel/python/cli/commands/bench.py160CODE
MEDIUMkt-kernel/python/cli/commands/bench.py173CODE
MEDIUMkt-kernel/python/cli/commands/bench.py176CODE
MEDIUMkt-kernel/python/cli/commands/bench.py177CODE
MEDIUMkt-kernel/python/cli/commands/bench.py179CODE
MEDIUMkt-kernel/examples/test_mla.py298CODE
MEDIUMkt-kernel/examples/test_mla.py300CODE
MEDIUMkt-kernel/examples/test_mla.py301CODE
MEDIUMkt-kernel/examples/test_mla.py302CODE
MEDIUMkt-kernel/examples/test_mla.py307CODE
MEDIUMkt-kernel/examples/test_mla.py309CODE
MEDIUMkt-kernel/examples/test_mla.py310CODE
MEDIUMkt-kernel/examples/test_mla.py311CODE
MEDIUMkt-kernel/examples/test_gate.py40CODE
MEDIUMkt-kernel/examples/test_gate.py42CODE
MEDIUMkt-kernel/examples/test_gate.py43CODE
MEDIUMkt-kernel/examples/test_gate.py44CODE
MEDIUMkt-kernel/examples/test_mla_quant.py32CODE
MEDIUMkt-kernel/examples/test_mla_quant.py34CODE
MEDIUMkt-kernel/examples/test_mla_quant.py35CODE
MEDIUMkt-kernel/examples/test_mla_quant.py36CODE
Self-Referential Comments22 hits · 66 pts
SeverityFileLineSnippetContext
MEDIUMarchive/csrc/balance_serve/kvc2/test/pytest_load.py8# Create a kvc2 instanceCOMMENT
MEDIUM…/balance_serve/kvc2/test/pytest_raw_insert_and_read.py8# Create a kvc2 instanceCOMMENT
MEDIUMarchive/csrc/balance_serve/kvc2/test/pytest_mem_read.py8# Create a kvc2 instanceCOMMENT
MEDIUM…csrc/balance_serve/kvc2/test/pytest_mem_prefix_test.py8# Create a kvc2 instanceCOMMENT
MEDIUMarchive/csrc/custom_marlin/utils/quant_utils.py41 # Create a tensor for bitwise right shift operationCOMMENT
MEDIUMarchive/kt-sft/csrc/custom_marlin/utils/quant_utils.py41 # Create a tensor for bitwise right shift operationCOMMENT
MEDIUMarchive/kt-sft/ktransformers/util/custom_loader.py552 # Create the appropriate loader based on detected file typesCOMMENT
MEDIUMarchive/kt-sft/ktransformers/util/utils.py266 # This function is to check if we run this model on XPU with FP16 dtypeCOMMENT
MEDIUM…/balance_serve/inference/distributed/pynccl_wrapper.py1# This file is a pure Python wrapper for the NCCL library.COMMENT
MEDIUMarchive/ktransformers/util/custom_loader.py579 # Create the appropriate loader based on detected file typesCOMMENT
MEDIUMarchive/ktransformers/util/utils.py324 # This function is to check if we run this model on XPU with FP16 dtypeCOMMENT
MEDIUM…/balance_serve/inference/distributed/pynccl_wrapper.py1# This file is a pure Python wrapper for the NCCL library.COMMENT
MEDIUMkt-kernel/python/experts.py82 # Create a mask where experts 0, 2, 5 are on GPUSTRING
MEDIUMkt-kernel/python/experts_base.py288 # Create a new pinned tensor and copy data into itCOMMENT
MEDIUMkt-kernel/python/utils/llamafile.py122 # Initialize base classCOMMENT
MEDIUMkt-kernel/python/utils/moe_kernel.py86 # Initialize base classCOMMENT
MEDIUMkt-kernel/python/utils/amx.py281 # Initialize base classCOMMENT
MEDIUMkt-kernel/python/cli/main.py47# Create main app with dynamic helpCOMMENT
MEDIUMkt-kernel/python/cli/utils/user_model_registry.py88 self.save() # Create the fileCODE
MEDIUMkt-kernel/python/cli/commands/model.py899 # Create a sub-row with empty cells except for the first column (7 columns total with #)COMMENT
MEDIUMkt-kernel/python/cli/commands/model.py948 # Create a sub-row with empty cells except for the first columnCOMMENT
MEDIUMkt-kernel/python/sft/weights.py171 # Create a CPU tensor with the correct shape but NO physical memory.COMMENT
Docstring Block Structure13 hits · 65 pts
SeverityFileLineSnippetContext
HIGHarchive/kt-sft/ktransformers/util/custom_loader.py509 Create a model loader for the given path by detecting the model format. The function checks for the preSTRING
HIGH…-sft/ktransformers/ktransformers_ext/triton/fp8gemm.py86 Dequantizes the given weight tensor using the provided scale tensor. Args: x (torch.Tensor): The quantSTRING
HIGH…hive/kt-sft/ktransformers/sft/peft_utils/peft_model.py935Get the status of each adapter layer in the model. This method returns a list of `TunerLayerStatus` dataclass iSTRING
HIGH…hive/kt-sft/ktransformers/sft/peft_utils/peft_model.py965Get the status of tuners of the model. This method returns a `TunerModelStatus` dataclass instance, which contaSTRING
HIGH…hive/kt-sft/ktransformers/sft/peft_utils/peft_model.py1663Get the status of each adapter layer in the model. This function returns a list of `TunerLayerStatus` dataclass insSTRING
HIGH…hive/kt-sft/ktransformers/sft/peft_utils/peft_model.py1781Get the status of tuners of the model. This function returns a `TunerModelStatus` dataclass instance, which containSTRING
HIGHarchive/ktransformers/util/custom_loader.py536 Create a model loader for the given path by detecting the model format. The function checks for the preSTRING
HIGH…hive/ktransformers/ktransformers_ext/triton/fp8gemm.py86 Dequantizes the given weight tensor using the provided scale tensor. Args: x (torch.Tensor): The quantSTRING
HIGHkt-kernel/python/_cpu_detect.py166 Load the appropriate kt_kernel_ext variant. Tries to import the specified variant, with automatic fallback to STRING
HIGHkt-kernel/python/experts.py157 Factory method to create the appropriate backend implementation. Args: layer_idx: Layer inSTRING
HIGHkt-kernel/python/cli/utils/tuna_engine.py21 Get the number of experts per layer from model config. Args: model_path: Path to the model directory STRING
HIGHkt-kernel/python/cli/utils/tuna_engine.py397 Run tuna auto-tuning to find optimal num_gpu_experts. Args: model_path: Path to the model tensSTRING
HIGHkt-kernel/python/sft/arch.py63 Get MoE architecture configuration based on model type. Args: config: HuggingFace model configuration STRING
AI Slop Vocabulary19 hits · 52 pts
SeverityFileLineSnippetContext
MEDIUM…hive/kt-sft/ktransformers/sft/peft_utils/peft_model.py831 # TODO: consider replacing this patching of methods with a more robust mechanism: setting a flag andCOMMENT
LOW…hive/kt-sft/ktransformers/sft/peft_utils/lora_model.py128 # model, just add a `peft_config` dict attribute to your model.COMMENT
LOW…ive/ktransformers/operators/ascend/ascend_attention.py215 # FIXME this is wrong in random choose pages for sched, currently just use kv without historyCOMMENT
MEDIUMarchive/ktransformers/models/modeling_smallthinker.py1051# "unexpected if using padding tokens in conjunction with `inputs_embeds.`"COMMENT
MEDIUMkt-kernel/bench/compare_moe_performance.py291 """Get comprehensive system information"""STRING
MEDIUMkt-kernel/operators/amx/sft_moe.hpp93// Check BF16 buffer for NaN/Inf (using robust v != v check)COMMENT
MEDIUMkt-kernel/operators/amx/sft_moe.hpp98 // Use val != val for robust NaN detectionCOMMENT
MEDIUMkt-kernel/operators/amx/sft_moe.hpp120// Check FP32 buffer for NaN/Inf (using robust v != v check)COMMENT
MEDIUMkt-kernel/operators/amx/sft_moe.hpp125 // Use val != val for robust NaN detectionCOMMENT
MEDIUMkt-kernel/operators/amx/sft_moe.hpp1437 // Use v != v for robust NaN detectionCOMMENT
MEDIUMkt-kernel/operators/amx/sft_moe.hpp1789 // Use v != v for robust NaN detectionCOMMENT
MEDIUMkt-kernel/operators/amx/sft_moe.hpp1829 // Use fv != fv for robust NaN detectionCOMMENT
MEDIUMkt-kernel/operators/amx/sft_moe.hpp1949 // Use v != v for robust NaN detectionCOMMENT
MEDIUMkt-kernel/operators/amx/test/mmq.cpp689 // pack again with 128 to fully utilize vector lengthCOMMENT
MEDIUMkt-kernel/operators/amx/test/mmq.cpp731 // pack again with 128 to fully utilize vector lengthCOMMENT
MEDIUMkt-kernel/operators/amx/test/mmq.cpp833 // pack again with 128 to fully utilize vector lengthCOMMENT
MEDIUMkt-kernel/operators/amx/test/mmq-test.cpp693 // pack again with 128 to fully utilize vector lengthCOMMENT
MEDIUMkt-kernel/operators/amx/test/mmq-test.cpp735 // pack again with 128 to fully utilize vector lengthCOMMENT
MEDIUMkt-kernel/operators/amx/test/mmq-test.cpp837 // pack again with 128 to fully utilize vector lengthCOMMENT
Hallucination Indicators3 hits · 45 pts
SeverityFileLineSnippetContext
CRITICAL…sformers/models/ascend/custom_ascend_modeling_qwen3.py70 self.model.embed_tokens.weight.data = self.model.embed_tokens.weight.data.to(torch.float16)CODE
CRITICAL…sformers/models/ascend/custom_ascend_modeling_qwen3.py73 self.model.norm.weight.data = self.model.norm.weight.data.to(torch.float16)CODE
CRITICAL…sformers/models/ascend/custom_ascend_modeling_qwen3.py75 self.model.norm.bias.data = self.model.norm.bias.data.to(torch.float16)CODE
Modern Structural Boilerplate42 hits · 41 pts
SeverityFileLineSnippetContext
LOWktransformers.py35__all__ = ["__version__", "has_sft_support"]CODE
LOWarchive/kt-sft/ktransformers/operators/layernorm.py40logger = logging.getLogger(__name__)CODE
LOW…serve/inference/distributed/custom_all_reduce_utils.py266__all__ = ["gpu_p2p_access_check"]CODE
LOW…/balance_serve/inference/distributed/pynccl_wrapper.py273__all__ = [CODE
LOW…ers/server/balance_serve/inference/sampling/sampler.py18logger = logging.getLogger(__name__)CODE
LOW…alance_serve/inference/sampling/penaltylib/__init__.py7__all__ = [CODE
LOW…hive/kt-sft/ktransformers/models/modeling_qwen3_moe.py1466__all__ = [STRING
LOW…kt-sft/ktransformers/models/configuration_qwen3_moe.py233__all__ = ["Qwen3MoeConfig"]CODE
LOW…hive/kt-sft/ktransformers/sft/peft_utils/peft_model.py1268 def set_adapter(self, adapter_name: str) -> None:CODE
LOW…hive/kt-sft/ktransformers/sft/peft_utils/lora_layer.py168 def set_adapter(self, adapter_names: str | list[str]) -> None:CODE
LOW…hive/kt-sft/ktransformers/sft/peft_utils/lora_model.py38logger = logging.getLogger(__name__)CODE
LOW…hive/kt-sft/ktransformers/sft/peft_utils/lora_model.py375 def _set_adapter_layers(self, enabled: bool = True) -> None:STRING
LOW…hive/kt-sft/ktransformers/sft/peft_utils/lora_model.py397 # def set_adapter(self, adapter_names: str | list[str]) -> None:STRING
LOWarchive/ktransformers/operators/layernorm.py43logger = logging.getLogger(__name__)CODE
LOW…serve/inference/distributed/custom_all_reduce_utils.py266__all__ = ["gpu_p2p_access_check"]CODE
LOW…/balance_serve/inference/distributed/pynccl_wrapper.py273__all__ = [CODE
LOW…ers/server/balance_serve/inference/sampling/sampler.py23logger = logging.getLogger(__name__)CODE
LOW…alance_serve/inference/sampling/penaltylib/__init__.py7__all__ = [CODE
LOWarchive/ktransformers/models/modeling_smallthinker.py1214__all__ = [CODE
LOWarchive/ktransformers/models/modeling_qwen3_moe.py1465__all__ = [STRING
LOWarchive/ktransformers/models/modeling_glm4_moe.py649__all__ = ["Glm4MoePreTrainedModel", "Glm4MoeModel", "Glm4MoeForCausalLM"]CODE
LOWarchive/ktransformers/models/configuration_glm4_moe.py242__all__ = ["Glm4MoeConfig"]CODE
LOW…chive/ktransformers/models/configuration_qwen3_next.py263__all__ = ["Qwen3NextConfig"]STRING
LOWarchive/ktransformers/models/configuration_qwen3_moe.py233__all__ = ["Qwen3MoeConfig"]CODE
LOW…ive/ktransformers/models/configuration_smallthinker.py180__all__ = ["SmallthinkerConfig"]CODE
LOWarchive/ktransformers/models/modeling_qwen3_next.py1280__all__ = [CODE
LOWkt-kernel/bench/compare_moe_performance.py26logger = logging.getLogger(__name__)CODE
LOWkt-kernel/python/__init__.py96__all__ = ["KTMoEWrapper", "AMXSFTMoEWrapper", "generate_gpu_experts_masks", "kt_kernel_ext", "__cpu_variant__", "__versCODE
LOWkt-kernel/python/utils/__init__.py11__all__ = [CODE
LOWkt-kernel/python/utils/amx.py8logger = logging.getLogger(__name__)CODE
LOWkt-kernel/python/cli/i18n.py1336def set_lang(lang: str) -> None:CODE
LOWkt-kernel/python/cli/main.py57def _update_help_texts() -> None:CODE
LOWkt-kernel/python/cli/config/__init__.py7__all__ = ["Settings", "get_settings"]CODE
LOWkt-kernel/python/sft/wrapper.py32logger = logging.getLogger(__name__)CODE
LOWkt-kernel/python/sft/arch.py18logger = logging.getLogger(__name__)CODE
LOWkt-kernel/python/sft/__init__.py48__all__ = [CODE
LOWkt-kernel/python/sft/autograd.py21logger = logging.getLogger(__name__)CODE
LOWkt-kernel/python/sft/layer.py32logger = logging.getLogger(__name__)CODE
LOWkt-kernel/python/sft/lora.py26logger = logging.getLogger(__name__)CODE
LOWkt-kernel/python/sft/weights.py19logger = logging.getLogger(__name__)CODE
LOWkt-kernel/python/sft/base.py226 def update_lora_weights(self) -> None:CODE
LOWkt-kernel/python/sft/amx.py467 def update_lora_weights(self) -> None:CODE
Slop Phrases25 hits · 35 pts
SeverityFileLineSnippetContext
LOWarchive/kt-sft/ktransformers/operators/experts.py969 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOWarchive/kt-sft/ktransformers/operators/experts.py1126 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOWarchive/kt-sft/ktransformers/operators/experts.py1475 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOWarchive/kt-sft/ktransformers/operators/experts.py1771 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOWarchive/kt-sft/ktransformers/models/modeling_mixtral.py878 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOWarchive/kt-sft/ktransformers/models/modeling_mixtral.py1465 loss += self.router_aux_loss_coef * aux_loss.to(loss.device) # make sure to reside in the same deviceCODE
LOW…hive/kt-sft/ktransformers/models/modeling_qwen3_moe.py292 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOW…hive/kt-sft/ktransformers/models/modeling_qwen3_moe.py1166 loss += self.router_aux_loss_coef * aux_loss.to(loss.device) # make sure to reside in the same deviceCODE
LOW…hive/kt-sft/ktransformers/models/modeling_qwen2_moe.py848 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOW…hive/kt-sft/ktransformers/models/modeling_qwen2_moe.py1455 loss += self.router_aux_loss_coef * aux_loss.to(loss.device) # make sure to reside in the same deviceCODE
LOWarchive/ktransformers/operators/experts.py547 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOWarchive/ktransformers/operators/experts.py665 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOWarchive/ktransformers/operators/experts.py863 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOWarchive/ktransformers/operators/experts.py1161 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOWarchive/ktransformers/models/modeling_smallthinker.py116 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOWarchive/ktransformers/models/modeling_smallthinker.py956 loss += self.router_aux_loss_coef * aux_loss.to(loss.device) # make sure to reside in the same deviceCODE
LOWarchive/ktransformers/models/modeling_mixtral.py877 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOWarchive/ktransformers/models/modeling_mixtral.py1464 loss += self.router_aux_loss_coef * aux_loss.to(loss.device) # make sure to reside in the same deviceCODE
LOWarchive/ktransformers/models/modeling_qwen3_moe.py291 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOWarchive/ktransformers/models/modeling_qwen3_moe.py1165 loss += self.router_aux_loss_coef * aux_loss.to(loss.device) # make sure to reside in the same deviceCODE
LOWarchive/ktransformers/models/modeling_qwen2_moe.py847 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOWarchive/ktransformers/models/modeling_qwen2_moe.py1454 loss += self.router_aux_loss_coef * aux_loss.to(loss.device) # make sure to reside in the same deviceCODE
MEDIUMarchive/ktransformers/models/custom_cache.py372 # you can use following code as checkCOMMENT
LOWarchive/ktransformers/models/modeling_qwen3_next.py853 # the current expert. We need to make sure to multiply the output hiddenCOMMENT
LOWarchive/ktransformers/models/modeling_qwen3_next.py1255 loss += self.router_aux_loss_coef * aux_loss.to(loss.device) # make sure to reside in the same deviceCODE
Modern AI Meta-Vocabulary8 hits · 27 pts
SeverityFileLineSnippetContext
MEDIUM…c/ktransformers_ext/operators/kvcache/kvcache_attn.cpp2248 // window_size=(-1, -1), # -1 means infinite context windowCOMMENT
MEDIUM…ive/csrc/ktransformers_ext/operators/kvcache/kvcache.h708 // window_size=(-1, -1), # -1 means infinite context windowCOMMENT
MEDIUM…c/ktransformers_ext/operators/kvcache/kvcache_attn.cpp2248 // window_size=(-1, -1), # -1 means infinite context windowCOMMENT
MEDIUM…sft/csrc/ktransformers_ext/operators/kvcache/kvcache.h708 // window_size=(-1, -1), # -1 means infinite context windowCOMMENT
MEDIUMarchive/kt-sft/ktransformers/util/custom_gguf.py710 # NOT fine-tun embedding modelCOMMENT
MEDIUMarchive/kt-sft/ktransformers/util/custom_gguf.py710 # NOT fine-tun embedding modelCOMMENT
MEDIUMkt-kernel/operators/kvcache/kvcache_attn.cpp1602 // window_size=(-1, -1), # -1 means infinite context windowCOMMENT
MEDIUMkt-kernel/operators/kvcache/kvcache.h619 // window_size=(-1, -1), # -1 means infinite context windowCOMMENT
AI Response Leakage2 hits · 15 pts
SeverityFileLineSnippetContext
HIGHarchive/setup.py551 # In this example, we pass in the version to C++. You might not need to.COMMENT
HIGHarchive/kt-sft/setup.py568 # In this example, we pass in the version to C++. You might not need to.COMMENT
Synthetic Comment Markers2 hits · 15 pts
SeverityFileLineSnippetContext
HIGHkt-kernel/examples/test_moe_amx.py428 # Only test BF16 and INT8 as requestedCOMMENT
HIGHkt-kernel/examples/test_moe_amx.py486 # Only test BF16 and INT8 as requestedCOMMENT
Example Usage Blocks4 hits · 6 pts
SeverityFileLineSnippetContext
LOWdocker/build-docker-tar.sh15# Usage:COMMENT
LOWdocker/push-to-dockerhub.sh16# Usage:COMMENT
LOWdocker/push-to-dockerhub.sh588# Usage:COMMENT
LOW…hive/csrc/balance_serve/kvc2/test/test_cuda_stream.cpp86// Example usageCOMMENT
Fake / Example Data2 hits · 2 pts
SeverityFileLineSnippetContext
LOW…chive/kt-sft/ktransformers/tests/function_call_test.py12 api_key="placeholder",CODE
LOWarchive/ktransformers/tests/function_call_test.py12 api_key="placeholder",CODE