Should you use qwen3-30b-a3b-fp8?
qwen3-30b-a3b-fp8 is listed for chat workloads and supports a 8K context window.
Use it when Cloudflare Workers AI's free tier is enough for evaluation, demos, or light production traffic.
https://api.cloudflare.com/client/v4/accounts/{account_id}/ai/run @cf/qwen/qwen3-30b-a3b-fp8 qwen3-30b-a3b-fp8 is listed for chat workloads and supports a 8K context window.
Use it when Cloudflare Workers AI's free tier is enough for evaluation, demos, or light production traffic.
We found 2 provider listings for qwen3-30b-a3b. Check model ID, quota, pricing, and API format before switching providers.
| Provider | Model listing | Access | Context | API | Limits |
|---|---|---|---|---|---|
| | @cf/qwen/qwen3-30b-a3b-fp8 | Free tier | 8K | Native | Varies |
| | Qwen/Qwen3-30B-A3B | Free tier | 8K | Native | Varies |
| Model | Provider | Context | Access |
|---|---|---|---|
| Qwen/Qwen3-30B-A3B | ModelScope | 8K | Free tier |
| Mistral 7B | Cloudflare Workers AI | 33K | Free tier |
| Qwen 1.5 7B | Cloudflare Workers AI | 33K | Free tier |
| @cf/meta/llama-3.3-70b-instruct-fp8-fast | Cloudflare Workers AI | 131K | Free tier |
| @cf/meta/llama-4-scout-17b-16e-instruct | Cloudflare Workers AI | 10.0M | Free tier |
qwen3-30b-a3b-fp8 is tagged for chat in this catalog and works with OpenAI-compatible client libraries.
qwen3-30b-a3b-fp8 is listed with free API access on Cloudflare Workers AI, subject to the provider's quota and account policy.
The model ID shown in this catalog is @cf/qwen/qwen3-30b-a3b-fp8.
The listed context window is 8K tokens with up to 4K output tokens.
Sparse MoE Qwen model with 3B active parameters for efficient chat and reasoning
For API keys, setup steps, and provider-level limits, see the Cloudflare Workers AI provider page.