# OpenAI partners with Cerebras

DevFeed: [OpenAI partners with Cerebras](<https://devfeed.tech/articles/openai-partners-with-cerebras-6328.md>)

Original publisher: [Read original article](<https://openai.com/index/cerebras-partnership>)

Published: 2026-01-14T14:00:00Z

Content type: news

Language: en

Sources: [OpenAI News](<https://devfeed.tech/sources/openai-news.md>)

Topics: [OpenAI](<https://devfeed.tech/topics/openai.md>), [Inference Performance](<https://devfeed.tech/topics/inference-performance.md>), [Low-Latency Inference](<https://devfeed.tech/topics/low-latency-inference.md>), [real-time](<https://devfeed.tech/topics/real-time.md>), [AI Models](<https://devfeed.tech/topics/ai-models.md>), [Hardware](<https://devfeed.tech/topics/hardware.md>), [Artificial Intelligence](<https://devfeed.tech/topics/ai.md>), [ChatGPT](<https://devfeed.tech/topics/chatgpt.md>)

Tags: [ai-models](<https://devfeed.tech/tags/ai-models.md>), [compute](<https://devfeed.tech/tags/compute.md>), [global-affairs](<https://devfeed.tech/tags/global-affairs.md>), [hardware](<https://devfeed.tech/tags/hardware.md>), [inference](<https://devfeed.tech/tags/inference.md>), [latency](<https://devfeed.tech/tags/latency.md>), [low-latency](<https://devfeed.tech/tags/low-latency.md>), [low-latency-inference](<https://devfeed.tech/tags/low-latency-inference.md>), [models](<https://devfeed.tech/tags/models.md>), [openai](<https://devfeed.tech/tags/openai.md>), [platform](<https://devfeed.tech/tags/platform.md>), [real-time](<https://devfeed.tech/tags/real-time.md>), [scale](<https://devfeed.tech/tags/scale.md>)

## AI overview

OpenAI partners with Cerebras to add high-speed AI compute, targeting lower inference latency and faster responses for real-time AI workloads. The capacity will be integrated into OpenAI's inference stack in phases and come online through 2028.

## Source excerpt

OpenAI partners with Cerebras to add 750MW of high-speed AI compute, reducing inference latency and making ChatGPT faster for real-time AI workloads.