↓ 3 callersFunctionquant_matmul_248(input, qweight, scales, qzeros, g_idx, bits, maxq)
inference/compression/dependencies/AutoGPTQ/auto_gptq/nn_modules/triton_utils/kernels.py:286
↓ 2 callersMethod__init__(
self, dataset_path: str, dataset_name: Optional[str] = None, *, version_override: Optional[str] = No
inference/efficiency/dependencies/efficiency-pentathlon/efficiency_benchmark/tasks/efficiency_benchmark.py:36
↓ 2 callersMethod__init__(
self, dataset_path: str, dataset_name: Optional[str] = None, *, version_override: Optional[str] = No
inference/efficiency/dependencies/previous_version/efficiency_benchmark/tasks/efficiency_benchmark.py:36