Use LLM optimized rowwise quantization kernel #6124
fbgemm_gpu_benchmark_cpu.yml
on: pull_request
Matrix: build_artifact
Matrix: benchmark_artifact
Artifacts
Produced during runtime
| Name | Size | Digest | |
|---|---|---|---|
|
fbgemm_gpu_nightly_cpu_arm_gcc_py3.13.whl
Expired
|
4.33 MB |
sha256:42741857ddf7844a62d624c2e56180be2d77483086be8279df249f5bc24d8661
|
|
|
fbgemm_gpu_nightly_cpu_x86_gcc_py3.13.whl
Expired
|
5.54 MB |
sha256:6dad91f5e8c2477432e857db57ef17ad348b52f6399972dc77ba8f2c1c8b4bb2
|
|
|
fbgemm_gpu_traces_arm_gcc_py3.13_cpu.zip
Expired
|
237 KB |
sha256:9b922181a01441e709828ea7d50122a31d77a73fc5c01bd14fe050779d28d727
|
|
|
fbgemm_gpu_traces_x86_gcc_py3.13_cpu.zip
Expired
|
237 KB |
sha256:51e1d0a1db15ef0fbecfd1c5157df89cb59fcd3b986d7dca35dfc0da6f3f2e83
|
|