通过统一的 OpenAI 兼容端点调用 gemini-3.5-flash —— 一个密钥、无需单独注册厂商账号、无需自行对接多家服务商。
Google文本对话推理代码视觉理解价格单位:美元 / 百万 token · ¥6.6 = $1 · 以人民币结算
Google Gemini 3.5 Flash:Gemini 3.5 家族首款模型,专为智能体工作流、编码与多模态推理优化的高效 Flash,多项 Agentic 与编码基准超过上代 Pro 档,速度与成本均衡,1M 上下文、64K 最大输出。
Gemini 系列兼具原生多模态输入与超大上下文窗口,除 OpenAI 兼容端点外,还可通过 Gemini 风格路径直接调用。
from openai import OpenAI
client = OpenAI(
base_url="https://starseaapi.com/v1",
api_key="sk-your-key"
)
r = client.chat.completions.create(
model="gemini-3.5-flash",
messages=[{"role": "user", "content": "Explain prefix caching in one paragraph"}]
)
print(r.choices[0].message.content)| 模型 | 输入 $/M | 输出 $/M | 智能指数 | 编程指数 |
|---|---|---|---|---|
| gemini-3-flash | $0.50 | $3.00 | — | — |
| gemini-3.6-flash | $1.50 | $7.50 | 40.3 | 69.2 |
| gemini-3.1-pro | $2.00 | $12.00 | — | — |
| gemini-3.1-pro-preview | $2.00 | $12.00 | 36.7 | 68.8 |
| gemini-3.1-pro-preview-thinking-128 | $2.00 | $12.00 | — | — |