From 09ee36014cf2b3210fd63d3e92798d80b734d221 Mon Sep 17 00:00:00 2001 From: inference-bot Date: Wed, 23 Sep 2026 20:10:18 -0600 Subject: [PATCH] Add GreenPT models (greenpt/green-r, greenpt/green-l) via provider/model naming convention --- config.yaml | 23 +++++++++++++++++++++++ 1 file changed, 23 insertions(+) diff --git a/config.yaml b/config.yaml index 8cfba99..3ab36c8 100644 --- a/config.yaml +++ b/config.yaml @@ -45,6 +45,29 @@ model_list: output_cost_per_token: 0.00000125 cache_read_input_token_cost: 0.00000010 + # --- GreenPT (renewable energy) --- + # OpenAI-compatible, EU-hosted on 100% renewable energy. No TEE proxy needed — + # LiteLLM talks to GreenPT directly. Pricing from GreenPT /v1/pricing endpoint. + # green-r: $0.35 in / $0.95 out per 1M (128k ctx) + # green-l: $0.25 in / $0.80 out per 1M (128k ctx) + - model_name: greenpt/green-r + litellm_params: + model: openai/green-r + api_base: https://api.greenpt.ai/v1 + api_key: os.environ/GREENPT_API_KEY + model_info: + input_cost_per_token: 0.00000035 + output_cost_per_token: 0.00000095 + + - model_name: greenpt/green-l + litellm_params: + model: openai/green-l + api_base: https://api.greenpt.ai/v1 + api_key: os.environ/GREENPT_API_KEY + model_info: + input_cost_per_token: 0.00000025 + output_cost_per_token: 0.00000080 + # Fallback: if DeepSeek is down, use GPT-OSS # NOTE: DeepSeek V4.1 Flash is a reasoning model — generations routinely run # longer than 30s. A 30s timeout caused LiteLLM to abandon in-flight DeepSeek