Skip to content
5 changes: 5 additions & 0 deletions llm_inference/model_inference.py
Original file line number Diff line number Diff line change
Expand Up @@ -138,6 +138,7 @@ def _get_provider(self, model_name: str) -> str:
"gpt-5-chat-latest": "openai",
"gpt-5-mini": "openai",
"gpt-5-nano": "openai",
"gpt-5": "openai",
# Anthropic models
"claude-3-haiku-20240307": "anthropic",
"claude-3-7-sonnet-20250219": "anthropic",
Expand All @@ -156,6 +157,8 @@ def _get_provider(self, model_name: str) -> str:
"open-mistral-nemo": "mistral",
# DeepSeek models
"deepseek-coder": "deepseek",
"deepseek-reasoner": "deepseek",
"deepseek/deepseek-v4-pro": "deepseek",
# Together AI models
"meta-llama/Meta-Llama-3.1-70B-Instruct-Turbo": "together",
"meta-llama/Meta-Llama-3-70B-Instruct-Turbo": "together",
Expand All @@ -180,6 +183,8 @@ def _get_provider(self, model_name: str) -> str:
"mistralai/devstral-2512:free": "openrouter",
"meta-llama/llama-3.3-70b-instruct": "openrouter",
"meta-llama/llama-3.1-405b-instruct": "openrouter",
"qwen/qwen3.5-9b": "openrouter",
"qwen/qwen3-coder-30b-a3b-instruct": "openrouter",
# Replicate
"meta/codellama-34b-instruct": "replicate",
# AWS Bedrock
Expand Down
11 changes: 11 additions & 0 deletions router_inference/config/cross-router.json
Original file line number Diff line number Diff line change
@@ -0,0 +1,11 @@
{
"pipeline_params": {
"router_name": "cross-router",
"router_cls_name": "CrossRouter",
"models": [
"google/gemini-3.1-flash-lite",
"deepseek/deepseek-v4-flash",
"deepseek/deepseek-v4-pro"
]
}
}
Loading
Loading