# Hugging Face — Bringing serverless GPU inference to Hugging Face users

- Company: Hugging Face (huggingface.co)
- Announced: 2024-04-02T00:00:00+00:00
- Category: developer-tool-release
- Subject: Platform
- Models affected: Meta Llama 2 7B, Hermes 2 Pro on Mistral 7B, Llama, Gemma, Mistral
- Pricing: pay-per-request pricing model
- Source: https://huggingface.co/blog/cloudflare-workers-ai
- Record: https://forck.live/items/1917-bringing-serverless-gpu-inference-to-hugging-face-users

Hugging Face announces a new integration with Cloudflare Workers AI, allowing users to deploy open models as a serverless API with pay-per-request pricing, powered by GPUs in Cloudflare edge data centers.

## Evidence

Verbatim from https://huggingface.co/blog/cloudflare-workers-ai:

> Today, we are thrilled to announce the launch of
> Deploy on Cloudflare Workers AI
> , a new integration on the Hugging Face Hub. Deploy on Cloudflare Workers AI makes using open models as a serverless API easy, powered by state-of-the-art GPUs deployed in Cloudflare edge data centers.

---

Record: https://forck.live/items/1917-bringing-serverless-gpu-inference-to-hugging-face-users
Catalogue: https://forck.live/llms.txt
Feed: https://forck.live/feed.md
