Prerequisites
- A Fireworks API key (
fw_...) - LiteLLM installed (
pip install litellm)
Configure Fireworks models
Create aconfig.yaml with one entry per model you want to expose. Use the fireworks_ai/ provider prefix and the full Fireworks model or router ID:
Always use full resource paths (for example
accounts/fireworks/models/glm-5p2 or accounts/fireworks/routers/firerouter). LiteLLM rewrites short names to accounts/fireworks/models/..., which breaks router endpoints like FireRouter.https://api.fireworks.ai/inference/v1 by default. See the LiteLLM Fireworks AI provider docs for direct-route deployments and other options.
Start the proxy
Call a model
Clients authenticate to LiteLLM with a virtual key:API key layout
A common pattern is one Fireworks service-account API key on the LiteLLM server, with per-developer virtual keys for access control and attribution.
FireRouter
To add automatic routing between closed-source and open models, register FireRouter in the samemodel_list. FireRouter requires an Anthropic API key for pass-through — see FireRouter with LiteLLM.
Related
- LiteLLM Proxy quick start
- LiteLLM Fireworks AI provider
- FireRouter: managed routing between open and closed-source models
- OpenAI compatibility: Fireworks inference API reference