MLLM-AIOS / MODELS

模型中心

统一接入、路由与监控所有云端和本地大模型

在线模型8 / 9可用率 98.7%
平均延迟432 ms较上周 -8.2%
今日调用12,4825 个供应商
本月成本¥4,826预算使用 62%
模型 / Provider状态上下文能力成本 / M Token延迟质量操作
GPT-5openai · gpt-5在线400K¥1.25 / ¥10421ms98
DeepSeek V3deepseek · deepseek-chat在线128K¥0.27 / ¥1.1437ms91
Qwen Maxqwen · qwen-max在线128K¥0.4 / ¥1.2426ms90
Qwen3 Localollama · qwen3:8b未配置33K¥0 / ¥0473ms78
Mango Mock 1mock · mango-mock-1在线33K¥0 / ¥0393ms78
智能模型路由已启用

系统会根据任务复杂度、延迟、成本、隐私级别和所需能力自动选择模型,并在失败时切换备用模型。