# Tricks from OpenAI gpt-oss YOU 🫵 can use with transformers

DevFeed: [Tricks from OpenAI gpt-oss YOU 🫵 can use with transformers](<https://devfeed.tech/articles/tricks-from-openai-gpt-oss-you-can-use-with-transformers-7193.md>)

Original publisher: [Read original article](<https://huggingface.co/blog/faster-transformers>)

Author: Aritra Roy Gosthipaty; Sergio Paniego; Vaibhav Srivastav; Pedro Cuenca; Arthur Zucker; Nathan Habib; Cyril Vallez

Published: 2025-09-11T00:00:00Z

Content type: article

Language: en

Sources: [Hugging Face - Blog](<https://devfeed.tech/sources/hugging-face-blog.md>)

Topics: [Transformers](<https://devfeed.tech/topics/transformers.md>), [gpt-oss](<https://devfeed.tech/topics/gpt-oss.md>), [Mixture of Experts (MoE)](<https://devfeed.tech/topics/mixture-of-experts-moe.md>), [CUDA](<https://devfeed.tech/topics/cuda.md>), [Large Language Model](<https://devfeed.tech/topics/llm.md>), [OpenAI](<https://devfeed.tech/topics/openai.md>), [PyTorch](<https://devfeed.tech/topics/pytorch.md>), [Open Source](<https://devfeed.tech/topics/open-source.md>), [C++](<https://devfeed.tech/topics/c-plus-plus.md>), [Python](<https://devfeed.tech/topics/python.md>)

Tags: [c-plus-plus](<https://devfeed.tech/tags/c-plus-plus.md>), [cuda](<https://devfeed.tech/tags/cuda.md>), [gpt-oss](<https://devfeed.tech/tags/gpt-oss.md>), [guide](<https://devfeed.tech/tags/guide.md>), [llms](<https://devfeed.tech/tags/llms.md>), [mixture-of-experts-moe](<https://devfeed.tech/tags/mixture-of-experts-moe.md>), [open-source](<https://devfeed.tech/tags/open-source.md>), [openai](<https://devfeed.tech/tags/openai.md>), [optimization](<https://devfeed.tech/tags/optimization.md>), [python](<https://devfeed.tech/tags/python.md>), [pytorch](<https://devfeed.tech/tags/pytorch.md>), [transformers](<https://devfeed.tech/tags/transformers.md>)

## AI overview

This article explains performance improvements in the Transformers toolkit, including specialized kernels, kernel fusion, Flash Attention, and pre-built kernel binaries. It highlights how GPT-OSS, a Mixture of Experts model, uses custom kernels distributed through the Hub.

## Source excerpt

We're on a journey to advance and democratize artificial intelligence through open source and open science.