推理模型 API、思维链
推理模型会在作答前额外消耗 token,这是实打实的成本与延迟,因此只有在任务存在可验证答案时才划算——数学、代码、多步抽取、排错。纯摘要或改写通常不该用它,更便宜的对话模型能给出同样结果。另需注意思考 token 按输出计费,因此一次推理调用的实际成本往往是标称输出单价的数倍。
价格单位:美元 / 百万 token · ¥6.6 = $1
56
54
37
4
47
19
12
57