模型广场

通过 模驿API 调用 DeepSeek V4 Pro 正式版,当前折扣 6.1 折,

DeepSeekDeepSeek: DeepSeek V4 Pro 正式版

不用于训练

DeepSeek V4 Pro 是 DeepSeek 的大规模混合专家(MoE)模型,总参数 1.6 万亿、激活参数 490 亿,支持 100 万 token 上下文窗口。它面向高级推理、编码和长程 Agent 工作流设计,在知识、数学和软件工程等基准上表现优异。该模型与 DeepSeek V4 Flash 同架构,并引入混合注意力机制以高效处理长上下文。

多模态能力

输入 / 输出价格

6.1 折

$0.4019 / $1.2058$0.66 / $1.98per 1M

上下文

1M

发布时间

2026年8月13日

供应商

模驿API 在您设置的折扣区间和供应商列表内按健康度与成本自动路由。任一供应商报错时会立刻切到次优供应商,请求里不需要指定。 配置折扣区间

需要自行选择供应商的组合?

供应商上下文输入价格输出价格缓存价格首字时延(TTFT)输出速度(TPS)数据安全
DeepSeek深度求索1M$0.66$0.4019$1.98$1.2058$0.022$0.0134不用于训练
BaiduCloud百度智能云1M$0.66$0.4019$1.98$1.2058$0.022$0.0134不用于训练
Volcengine火山引擎1M$0.66$0.4019$1.98$1.2058$0.022$0.0134不用于训练
TencentCloud腾讯云1M$0.66$0.4019$1.98$1.2058$0.022$0.0134不用于训练
第三方供应商1M$0.66$0.4019$1.98$1.2058$0.022$0.0134不用于训练

实时折扣

各供应商的平均成交折扣,每小时更新。

该模型近 24 小时暂无折扣数据。

性能

首字时延与输出速度按网关侧实际请求统计。

首字时延(TTFT)

从请求发出到收到首个输出 Token 所需的时间,按供应商分别统计。

    首字时延 · 模驿API 网关

    输出速度(TPS)

    收到首个输出 Token 后,后续每秒能生成的 Token 数,按供应商分别统计。

      输出速度 · 模驿API 网关

      可用率

      网关持续探测每个供应商,某个供应商报错时自动切到次优供应商,因此 模驿API 可用率是在 模驿API 调用模型的整体可用性,而不是单一上游的可用性。

      可用率(24 小时)

      可用率(3 天)

      近 3 天可用性

      -72h-48h-24h现在

      近 24 小时可用性

      每个上游供应商各一条曲线。模驿API 那条只看每个请求的最后一次尝试,衡量的是经过所有降级之后端到端的最终结果。

        可用率 · 近 24 小时 · 模驿API 网关

        数据安全

        该模型供应商中,深度求索、百度智能云、火山引擎、腾讯云不使用用户数据用于模型训练。

        关于数据安全政策,详情查看文档

        如需自定义选择供应商,

        快速接入

        from openai import OpenAI
        
        client = OpenAI(
            base_url="https://api.moyiapi.com/v1",  # 只改这一行
            api_key="<MOYIAPI_API_KEY>",
        )
        response = client.chat.completions.create(
            model="deepseek-v4-pro",
            messages=[{"role": "user", "content": "Hello"}],
        )
        print(response.choices[0].message.content)
        查看文档

        Endpoint: https://api.moyiapi.com/v1

        DeepSeek V4 Pro 正式版 价格、性能与可用率