通过统一的 OpenAI 兼容端点调用 gemini-3.6-flash —— 一个密钥、无需单独注册厂商账号、无需自行对接多上游。
Google文本对话推理代码视觉理解价格单位:美元 / 百万 token · ¥6.6 = $1 · 以人民币结算
Google Gemini 3.6 Flash(2026-07-21 发布):系列主力高效模型(workhorse),1M 输入、64K 最大输出,文本/图像/视频/音频/PDF 多模态输入;编码与知识工作较 3.5 Flash 再提升(SWE-Bench Pro 58.7%),输出 token 用量省约 17%,四档思考,Agentic 工作流与计算机使用(OSWorld 83.0%)表现出色,速度与成本均衡。
Gemini 系列兼具原生多模态输入与超大上下文窗口,除 OpenAI 兼容端点外,还可通过 Gemini 风格路径直接调用。
from openai import OpenAI
client = OpenAI(
base_url="https://starseaapi.com/v1",
api_key="sk-your-key"
)
r = client.chat.completions.create(
model="gemini-3.6-flash",
messages=[{"role": "user", "content": "Explain prefix caching in one paragraph"}]
)
print(r.choices[0].message.content)| 模型 | 输入 $/M | 输出 $/M | 智能指数 | 编程指数 |
|---|---|---|---|---|
| gemini-3.1-pro-preview | $2.00 | $12.00 | 36.7 | 68.8 |
| gemini-3.1-pro-preview-thinking-128 | $2.00 | $12.00 | — | — |