Download litellm_config.yaml from mikeee/litellm2: direct link, hf CLI and curl.
- Browser
- Download file 4.78 kB
-
https://huggingface.co/spaces/mikeee/litellm2/resolve/main/litellm_config.yaml
- Command line
-
hf download hf://spaces/mikeee/litellm2/litellm_config.yaml
-
curl -L -o litellm_config.yaml https://huggingface.co/spaces/mikeee/litellm2/resolve/main/litellm_config.yaml
4.78 kB
| model_list: | |
| # - model_name: "anthropic/*" | |
| # litellm_params: | |
| # model: "openrouter/qwen/qwen3-coder" # Qwen/Qwen3-Coder-480B-A35B-Instruct | |
| # max_tokens: 65536 | |
| # repetition_penalty: 1.05 | |
| # temperature: 0.7 | |
| # top_k: 20 | |
| # top_p: 0.8 | |
| # cpa in hf | |
| # gemini-2.5-pro | |
| # gemini-2.5-flash | |
| # gemini-3-pro-preview | |
| # gemini-2.5-flash-lite | |
| # gemini-3-flash-preview | |
| # - model_name: gemini-2.5-pro | |
| # litellm_params: | |
| # model: openai/gemini-2.5-pro | |
| # api_base: https://cpa.applane.qzz.io/v1 | |
| # api_key: os.environ/CPAHF_API_KEY | |
| - model_name: gpt-5.4 | |
| litellm_params: | |
| model: openai/gpt-5.4 | |
| api_base: https://cpa.applane.qzz.io/v1 | |
| api_key: os.environ/CPAHF_API_KEY | |
| - model_name: gpt-5.3-codex | |
| litellm_params: | |
| model: openai/gpt-5.3-codex | |
| api_base: https://cpa.applane.qzz.io/v1 | |
| api_key: os.environ/CPAHF_API_KEY | |
| - model_name: gpt-5.2-codex | |
| litellm_params: | |
| model: openai/gpt-5.2-codex | |
| api_base: https://cpa.applane.qzz.io/v1 | |
| api_key: os.environ/CPAHF_API_KEY | |
| - model_name: gpt-5.2-codex | |
| litellm_params: | |
| model: openai/gpt-5.2-codex | |
| api_base: https://cpa.applane.qzz.io/v1 | |
| api_key: os.environ/CPAHF_API_KEY | |
| # curl -s http://acone:11434/v1/models | jq -r .data[].id | |
| # glm-5.1:cloud | |
| # deepseek-v4-flash:cloud | |
| # kimi-k2.6:cloud | |
| # kimi-k2.5:cloud | |
| # deepseek-v3.2:cloud | |
| # gemini-3-flash-preview:cloud | |
| # gemma4:31b-cloud | |
| # minimax-m2.7:cloud | |
| # gpt-oss:120b-cloud | |
| - model_name: deepseek-v3.2:cloud | |
| litellm_params: | |
| model: openai/deepseek-v3.2:cloud | |
| api_base: https://newapi.applane.qzz.io/v1 | |
| api_key: os.environ/NEWAPI_API_KEY_SVIP | |
| - model_name: gemini-3-flash-preview:cloud | |
| litellm_params: | |
| model: openai/gemini-3-flash-preview:cloud | |
| api_base: https://newapi.applane.qzz.io/v1 | |
| api_key: os.environ/NEWAPI_API_KEY_SVIP | |
| - model_name: gemma4:31b-cloud | |
| litellm_params: | |
| model: openai/gemma4:31b-cloud | |
| api_base: https://newapi.applane.qzz.io/v1 | |
| api_key: os.environ/NEWAPI_API_KEY_SVIP | |
| - model_name: minimax-m2.7:cloud | |
| litellm_params: | |
| model: openai/minimax-m2.7:cloud | |
| api_base: https://newapi.applane.qzz.io/v1 | |
| api_key: os.environ/NEWAPI_API_KEY_SVIP | |
| - model_name: minimax-m2.5:cloud | |
| litellm_params: | |
| model: openai/minimax-m2.5:cloud | |
| api_base: https://newapi.applane.qzz.io/v1 | |
| api_key: os.environ/NEWAPI_API_KEY_SVIP | |
| - model_name: gpt-oss:120b-cloud | |
| litellm_params: | |
| model: openai/gpt-oss:120b-cloud | |
| api_base: https://newapi.applane.qzz.io/v1 | |
| api_key: os.environ/NEWAPI_API_KEY_SVIP | |
| - model_name: gpt-oss:20b-cloud | |
| litellm_params: | |
| model: openai/gpt-oss:20b-cloud | |
| api_base: https://newapi.applane.qzz.io/v1 | |
| api_key: os.environ/NEWAPI_API_KEY_SVIP | |
| - model_name: gemma4-e4b-uncensored | |
| litellm_params: | |
| model: openai/gemma4-e4b-uncensored | |
| api_base: https://newapi.applane.qzz.io/v1 | |
| api_key: os.environ/NEWAPI_API_KEY_SVIP | |
| - model_name: mimo-v2.5-pro | |
| litellm_params: | |
| model: openai/mimo-v2.5-pro | |
| api_base: https://newapi.applane.qzz.io/v1 | |
| api_key: os.environ/NEWAPI_API_KEY_SVIP | |
| general_settings: | |
| # master_key: "sk-1234" # Disabled for easy testing | |
| # master_key: ${LITELLM_MASTER_KEY} | |
| master_key: os.environ/LITELLM_MASTER_KEY | |
| # litellm --config parent_config.yaml --detailed_debug/--debug | |
| # os.environ["LITELLM_LOG"] = "INFO" os.environ["LITELLM_LOG"] = "DEBUG" | |
| # https://docs.litellm.ai/docs/proxy/config_settings | |
| litellm_settings: | |
| # set_verbose: true # deprecated, use `os.environ['LITELLM_LOG'] = 'DEBUG' | |
| request_timeout: 180 | |
| drop_params: true | |
| router_settings: | |
| model_group_alias: | |
| gpt-4o: gpt-5.3-codex | |
| gpt-4.1-mini: gpt-5.3-codex | |
| gemma4:31b: gemma4:31b-cloud | |
| minimax-m2.7: minimax-m2.7:cloud | |
| deepseek-v3.2: deepseek-v3.2:cloud | |
| minimax-m2.5: minimax-m2.5:cloud | |
| gemini-3-flash: gemini-3-flash-preview:cloud | |
| gpt-oss:120b: gpt-oss:120b-cloud | |
| gpt-oss:20b: gpt-oss:20b-cloud | |
| # gpt-5-codex: claude-4.5-sonnet | |
| # gpt-5.1-codex: claude-4.5-sonnet | |
| # List[Dict[str, List[str]]]: Fallback model for all errors | |
| fallbacks: | |
| - gpt-5.4: | |
| - gemma4:31b-cloud | |
| - gemma4-e4b-uncensored | |
| - mimo-v2.5-pro: | |
| - gemma4-e4b-uncensored | |
| # curl http://127.0.0.1:7860/router/settings -H "accept: application/json" -H "x-litellm-api-key: %LITELLM_MASTER_KEY%" | jq . | |
| # need database for this to work | |
| # curl -X 'POST' \ | |
| # 'http://127.0.0.1:7860/fallback' \ | |
| # -H 'accept: application/json' \ | |
| # -H 'x-litellm-api-key: sk-...' \ | |
| # -H 'Content-Type: application/json' \ | |
| # -d '{ | |
| # "model": "gpt-5.3-codex", | |
| # "fallback_models": ["gpt-5.4"], | |
| # "fallback_type": "general" | |
| # }' |