Providers with known public APIs use their official endpoints: - meta-llama → api.llama.com/v1 - microsoft → models.inference.ai.azure.com (GitHub Models) - ibm-granite → us-south.ml.cloud.ibm.com/ml/v1 (watsonx) - tencent → api.hunyuan.cloud.tencent.com/v1 - morph → api.morphllm.com/v1 16 remaining providers without known public APIs route through OpenRouter (base_url = openrouter.ai/api/v1, OPENROUTER_API_KEY). sync-pricing.py updated with PROVIDER_API mapping.
39 lines
832 B
TOML
39 lines
832 B
TOML
# xiaomi — auto-generated from OpenRouter API
|
|
|
|
[provider]
|
|
id = "xiaomi"
|
|
display_name = "Xiaomi"
|
|
api_key_env = "XIAOMI_ACCESS_KEY_ID"
|
|
base_url = "https://cnbj3-cloud-ml.api.xiaomi.net"
|
|
key_required = true
|
|
|
|
[[models]]
|
|
id = "mimo-v2-flash"
|
|
display_name = "Xiaomi: MiMo-V2-Flash"
|
|
tier = "fast"
|
|
context_window = 262144
|
|
max_output_tokens = 65536
|
|
input_cost_per_m = 0.09
|
|
output_cost_per_m = 0.29
|
|
supports_streaming = true
|
|
|
|
[[models]]
|
|
id = "mimo-v2-omni"
|
|
display_name = "Xiaomi: MiMo-V2-Omni"
|
|
tier = "fast"
|
|
context_window = 262144
|
|
max_output_tokens = 65536
|
|
input_cost_per_m = 0.4
|
|
output_cost_per_m = 2.0
|
|
supports_streaming = true
|
|
|
|
[[models]]
|
|
id = "mimo-v2-pro"
|
|
display_name = "Xiaomi: MiMo-V2-Pro"
|
|
tier = "smart"
|
|
context_window = 1048576
|
|
max_output_tokens = 131072
|
|
input_cost_per_m = 1.0
|
|
output_cost_per_m = 3.0
|
|
supports_streaming = true
|