Skip to content

Use LLM optimized rowwise quantization kernel #6124

Use LLM optimized rowwise quantization kernel

Use LLM optimized rowwise quantization kernel #6124

Triggered via pull request November 7, 2025 20:31
Status Success
Total duration 18m 39s
Artifacts 4

fbgemm_gpu_benchmark_cpu.yml

on: pull_request
Matrix: build_artifact
Matrix: benchmark_artifact
Fit to window
Zoom out
Zoom in

Artifacts

Produced during runtime
Name Size Digest
fbgemm_gpu_nightly_cpu_arm_gcc_py3.13.whl Expired
4.33 MB
sha256:42741857ddf7844a62d624c2e56180be2d77483086be8279df249f5bc24d8661
fbgemm_gpu_nightly_cpu_x86_gcc_py3.13.whl Expired
5.54 MB
sha256:6dad91f5e8c2477432e857db57ef17ad348b52f6399972dc77ba8f2c1c8b4bb2
fbgemm_gpu_traces_arm_gcc_py3.13_cpu.zip Expired
237 KB
sha256:9b922181a01441e709828ea7d50122a31d77a73fc5c01bd14fe050779d28d727
fbgemm_gpu_traces_x86_gcc_py3.13_cpu.zip Expired
237 KB
sha256:51e1d0a1db15ef0fbecfd1c5157df89cb59fcd3b986d7dca35dfc0da6f3f2e83