Fix and improve the gemm quant pipeline infrastructure (#3245)

2026-04-20 06:49:15 +00:00 · 2025-11-26 18:04:27 -08:00
parent 79aae7c7f7
commit a38aeceb21
11 changed files with 96 additions and 272 deletions
--- a/include/ck_tile/ops/gemm_quant/kernel/gemm_quant_kernel.hpp
+++ b/include/ck_tile/ops/gemm_quant/kernel/gemm_quant_kernel.hpp
@@ -786,8 +786,8 @@ struct QuantGemmKernel
                    using QuantGroupSize = remove_cvref_t<typename GemmPipeline::QuantGroupSize>;
                    return make_naive_tensor_view<address_space_enum::global>(
                        bq_ptr,
-                        make_tuple(kargs.QK_B, integer_divide_ceil(kargs.N, QuantGroupSize::kN)),
-                        make_tuple(1, kargs.stride_BQ),
+                        make_tuple(integer_divide_ceil(kargs.N, QuantGroupSize::kN), kargs.QK_B),
+                        make_tuple(kargs.stride_BQ, 1),
                        number<GemmPipeline::GetVectorSizeBQ()>{},
                        number<1>{});
                }
@@ -1030,9 +1030,9 @@ struct QuantGemmKernel
                    using QuantGroupSize = remove_cvref_t<typename GemmPipeline::QuantGroupSize>;
                    return make_tile_window(
                        bq_pad_view,
-                        make_tuple(number<TilePartitioner::KPerBlock / QuantGroupSize::kK>{},
-                                   number<TilePartitioner::NPerBlock / QuantGroupSize::kN>{}),
-                        {0, i_n / QuantGroupSize::kN});
+                        make_tuple(number<TilePartitioner::NPerBlock / QuantGroupSize::kN>{},
+                                   number<TilePartitioner::KPerBlock / QuantGroupSize::kK>{}),
+                        {i_n / QuantGroupSize::kN, 0});
                }
            }
            else