通过统一的 OpenAI 兼容端点调用 MiniMax-M2.5-highspeed —— 一个密钥、无需单独注册厂商账号、无需自行对接多上游。
MiniMax文本对话推理代码价格单位:美元 / 百万 token · ¥6.6 = $1 · 以人民币结算
MiniMax M2.5 极速版(与 M2.5 同能力、推理提速约 100 tps):多语言代码精通、精准代码重构,低延迟高吞吐,适合生产高频调用,204.8K 上下文、131K 最大输出。
MiniMax 系列为吞吐而设计。极速版专门针对低延迟调优,适合「响应速度比基准分数更重要」的交互型产品。
from openai import OpenAI
client = OpenAI(
base_url="https://starseaapi.com/v1",
api_key="sk-your-key"
)
r = client.chat.completions.create(
model="MiniMax-M2.5-highspeed",
messages=[{"role": "user", "content": "Explain prefix caching in one paragraph"}]
)
print(r.choices[0].message.content)| 模型 | 输入 $/M | 输出 $/M | 智能指数 | 编程指数 |
|---|---|---|---|---|
| MiniMax-M2 | $0.32 | $1.27 | — | — |
| MiniMax-M2.1 | $0.32 | $1.27 | — | — |
| MiniMax-M2.5 | $0.32 | $1.27 | — | — |
| MiniMax-M2.7 | $0.32 | $1.27 | — | 52.6 |
| MiniMax-M2.1-highspeed | $0.64 | $2.55 | — | — |
| MiniMax-M2.7-highspeed | $0.64 | $2.55 | — | — |
| minimax-m3 | $0.64 | $2.55 | 35.7 | 58.6 |