模型广场

通过 模驿API 调用 Gemini 3.5 Flash Lite,当前折扣 2.9 折,

GoogleGoogle: Gemini 3.5 Flash Lite

不用于训练

Gemini 3.5 Flash Lite 是 Google 的高效模型,Agent 能力有所升级,适合在复杂的多 Agent 工作流中执行聚焦任务的子 Agent。

多模态能力

输入 / 输出价格

2.9 折

$0.087 / $0.725$0.3 / $2.5per 1M

上下文

1M

发布时间

2026年7月21日

供应商

模驿API 在您设置的折扣区间和供应商列表内按健康度与成本自动路由。任一供应商报错时会立刻切到次优供应商,请求里不需要指定。 配置折扣区间

需要自行选择供应商的组合?

供应商上下文输入价格输出价格缓存价格首字时延(TTFT)输出速度(TPS)数据安全
GoogleGoogle AI1M$0.3$0.087$2.5$0.725$0.03$0.0087不用于训练
VertexAIGoogle Vertex1M$0.3$0.087$2.5$0.725$0.03$0.0087不用于训练
第三方供应商1M$0.3$0.087$2.5$0.725$0.03$0.0087不用于训练

实时折扣

各供应商的平均成交折扣,每小时更新。

该模型近 24 小时暂无折扣数据。

性能

首字时延与输出速度按网关侧实际请求统计。

首字时延(TTFT)

从请求发出到收到首个输出 Token 所需的时间,按供应商分别统计。

    首字时延 · 模驿API 网关

    输出速度(TPS)

    收到首个输出 Token 后,后续每秒能生成的 Token 数,按供应商分别统计。

      输出速度 · 模驿API 网关

      可用率

      网关持续探测每个供应商,某个供应商报错时自动切到次优供应商,因此 模驿API 可用率是在 模驿API 调用模型的整体可用性,而不是单一上游的可用性。

      可用率(24 小时)

      可用率(3 天)

      近 3 天可用性

      -72h-48h-24h现在

      近 24 小时可用性

      每个上游供应商各一条曲线。模驿API 那条只看每个请求的最后一次尝试,衡量的是经过所有降级之后端到端的最终结果。

        可用率 · 近 24 小时 · 模驿API 网关

        数据安全

        该模型供应商中,Google AI、Google Vertex不使用用户数据用于模型训练。

        关于数据安全政策,详情查看文档

        如需自定义选择供应商,

        快速接入

        from google import genai
        from google.genai import types
        
        client = genai.Client(
            api_key="<MOYIAPI_API_KEY>",
            http_options=types.HttpOptions(base_url="https://api.moyiapi.com"),
        )
        response = client.models.generate_content(
            model="gemini-3.5-flash-lite",
            contents="Hello",
        )
        print(response.text)
        查看文档

        Endpoint: https://api.moyiapi.com

        Gemini 3.5 Flash Lite 价格、性能与可用率