# Benchmarking Language Model Performance on 5th Gen Xeon at GCP

DevFeed: [Benchmarking Language Model Performance on 5th Gen Xeon at GCP](<https://devfeed.tech/articles/benchmarking-language-model-performance-on-5th-gen-xeon-at-gcp-7290.md>)

Original publisher: [Read original article](<https://huggingface.co/blog/intel-gcp-c4>)

Author: Matrix Yao; Ke Ding; Ilyas Moutawwakil

Published: 2024-12-17T00:00:00Z

Content type: article

Language: en

Sources: [Hugging Face - Blog](<https://devfeed.tech/sources/hugging-face-blog.md>)

Topics: [benchmarking](<https://devfeed.tech/topics/benchmarking.md>), [LLM evaluation / benchmarking](<https://devfeed.tech/topics/llm-evaluation-benchmarking.md>), [cpu](<https://devfeed.tech/topics/cpu.md>), [Google Cloud Platform (GCP)](<https://devfeed.tech/topics/google-cloud.md>), [intel](<https://devfeed.tech/topics/intel.md>), [text-generation](<https://devfeed.tech/topics/text-generation.md>), [AI Agent](<https://devfeed.tech/topics/ai-agent.md>), [llama3](<https://devfeed.tech/topics/llama3.md>)

Tags: [agentic-ai](<https://devfeed.tech/tags/agentic-ai.md>), [ai](<https://devfeed.tech/tags/ai.md>), [ai-agent](<https://devfeed.tech/tags/ai-agent.md>), [architectures](<https://devfeed.tech/tags/architectures.md>), [artificial-intelligence](<https://devfeed.tech/tags/artificial-intelligence.md>), [backend](<https://devfeed.tech/tags/backend.md>), [benchmark](<https://devfeed.tech/tags/benchmark.md>), [benchmarking](<https://devfeed.tech/tags/benchmarking.md>), [compute](<https://devfeed.tech/tags/compute.md>), [cpu](<https://devfeed.tech/tags/cpu.md>), [embedding](<https://devfeed.tech/tags/embedding.md>), [function-calling](<https://devfeed.tech/tags/function-calling.md>), [gcp](<https://devfeed.tech/tags/gcp.md>), [google](<https://devfeed.tech/tags/google.md>), [google-cloud](<https://devfeed.tech/tags/google-cloud.md>), [hardware](<https://devfeed.tech/tags/hardware.md>), [intel](<https://devfeed.tech/tags/intel.md>), [llama3](<https://devfeed.tech/tags/llama3.md>), [llm](<https://devfeed.tech/tags/llm.md>), [performance](<https://devfeed.tech/tags/performance.md>), [text-generation](<https://devfeed.tech/tags/text-generation.md>)

## AI overview

This article benchmarks language-model performance on Google Cloud Compute Engine C4 and N2 instances powered by different generations of Intel Xeon processors. It compares text embedding and text generation for agentic AI workloads, focusing on the benefits of Intel Advanced Matrix Extensions (AMX) and CPU-based hosting of systems using small language models such as Meta's 1B and 3B Llama 3.2 models.

## Source excerpt

We're on a journey to advance and democratize artificial intelligence through open source and open science.