# Easily Build and Share ROCm Kernels with Hugging Face

DevFeed: [Easily Build and Share ROCm Kernels with Hugging Face](<https://devfeed.tech/articles/easily-build-and-share-rocm-kernels-with-hugging-face-7133.md>)

Original publisher: [Read original article](<https://huggingface.co/blog/build-rocm-kernels>)

Author: Abdennacer Badaoui; Daniel Huang; colorswind; Zesen Liu

Published: 2025-11-17T00:00:00Z

Content type: tutorial

Language: en

Sources: [Hugging Face - Blog](<https://devfeed.tech/sources/hugging-face-blog.md>)

Topics: [kernels](<https://devfeed.tech/topics/kernels.md>), [rocm](<https://devfeed.tech/topics/rocm.md>), [hugging face](<https://devfeed.tech/topics/hugging-face.md>), [PyTorch](<https://devfeed.tech/topics/pytorch.md>), [Deep learning](<https://devfeed.tech/topics/deep-learning.md>), [Open Source](<https://devfeed.tech/topics/open-source.md>), [benchmarking](<https://devfeed.tech/topics/benchmarking.md>), [CUDA](<https://devfeed.tech/topics/cuda.md>)

Tags: [amd](<https://devfeed.tech/tags/amd.md>), [architectures](<https://devfeed.tech/tags/architectures.md>), [best-practices](<https://devfeed.tech/tags/best-practices.md>), [build](<https://devfeed.tech/tags/build.md>), [building](<https://devfeed.tech/tags/building.md>), [compiler](<https://devfeed.tech/tags/compiler.md>), [compute](<https://devfeed.tech/tags/compute.md>), [core](<https://devfeed.tech/tags/core.md>), [cuda](<https://devfeed.tech/tags/cuda.md>), [deep-learning](<https://devfeed.tech/tags/deep-learning.md>), [deployment](<https://devfeed.tech/tags/deployment.md>), [developer](<https://devfeed.tech/tags/developer.md>), [gpu](<https://devfeed.tech/tags/gpu.md>), [hardware](<https://devfeed.tech/tags/hardware.md>), [hugging-face](<https://devfeed.tech/tags/hugging-face.md>), [innovation](<https://devfeed.tech/tags/innovation.md>), [kernels](<https://devfeed.tech/tags/kernels.md>), [open-source](<https://devfeed.tech/tags/open-source.md>), [pytorch](<https://devfeed.tech/tags/pytorch.md>), [rocm](<https://devfeed.tech/tags/rocm.md>)

## AI overview

This tutorial explains how to build, test, package, deploy, and share ROCm-compatible GPU kernels with Hugging Face's kernels library and kernel-builder. It focuses on integrating kernels with PyTorch and optimizing them for AMD GPUs, using a high-performance FP8 GEMM kernel for the AMD Instinct MI300X as an example.

## Source excerpt

We're on a journey to advance and democratize artificial intelligence through open source and open science.