通过 模驿API 调用 Gemini 3.1 Pro Preview,当前折扣 2.8 折,。
Google: Gemini 3.1 Pro Preview
Gemini 3.1 Pro Preview 面向高级开发和 Agent 系统设计,提升了长程稳定性和工具编排能力,同时提高了 token 效率,并新增 medium 思考档以更好地平衡成本、速度与表现。该模型擅长 Agent 编码、结构化规划、多模态分析和流程自动化,适合自主 Agent、金融建模、表格自动化以及高上下文的企业级任务。作为 Google 的前沿推理模型,它在复杂工作流中带来更强的软件工程表现、更可靠的 Agent 执行和更高的 token 使用效率;依托 Gemini 3 系列的多模态底座,它能在文本、图像、视频、音频和代码之间做高精度推理,并具备 100 万 token 上下文窗口。
多模态能力
输入 / 输出价格
2.8 折$0.556 / $3.336$2 / $12per 1M
上下文
1M
发布时间
2026年2月19日
供应商
模驿API 在您设置的折扣区间和供应商列表内按健康度与成本自动路由。任一供应商报错时会立刻切到次优供应商,请求里不需要指定。 配置折扣区间
需要自行选择供应商的组合?
| 供应商 | 上下文 | 输入价格 | 输出价格 | 缓存价格 | 首字时延(TTFT) | 输出速度(TPS) | 可用率(SLA) | 数据安全 |
|---|---|---|---|---|---|---|---|---|
| Google AI | 1M | $2$0.556 | $12$3.336 | $0.2$0.0556 | — | — | — | 不用于训练 |
| Google Vertex | 1M | $2$0.556 | $12$3.336 | $0.2$0.0556 | — | — | — | 不用于训练 |
| 第三方供应商 | 1M | $2$0.556 | $12$3.336 | $0.2$0.0556 | — | — | — | 不用于训练 |
实时折扣
各供应商的平均成交折扣,每小时更新。
该模型近 24 小时暂无折扣数据。
性能
首字时延与输出速度按网关侧实际请求统计。
首字时延(TTFT)
从请求发出到收到首个输出 Token 所需的时间,按供应商分别统计。
首字时延 · 模驿API 网关
输出速度(TPS)
收到首个输出 Token 后,后续每秒能生成的 Token 数,按供应商分别统计。
输出速度 · 模驿API 网关
可用率
网关持续探测每个供应商,某个供应商报错时自动切到次优供应商,因此 模驿API 可用率是在 模驿API 调用模型的整体可用性,而不是单一上游的可用性。
可用率(24 小时)
—
可用率(3 天)
—
近 3 天可用性
—
近 24 小时可用性
每个上游供应商各一条曲线。模驿API 那条只看每个请求的最后一次尝试,衡量的是经过所有降级之后端到端的最终结果。
可用率 · 近 24 小时 · 模驿API 网关
数据安全
快速接入
from google import genai
from google.genai import types
client = genai.Client(
api_key="<MOYIAPI_API_KEY>",
http_options=types.HttpOptions(base_url="https://api.moyiapi.com"),
)
response = client.models.generate_content(
model="gemini-3.1-pro-preview",
contents="Hello",
)
print(response.text)Endpoint: https://api.moyiapi.com