通过 模驿API 调用 Claude Haiku 4.5,当前折扣 1.4 折,。
Anthropic: Claude Haiku 4.5
Claude Haiku 4.5 是 Anthropic 最快、最高效的模型,以远低于大模型的成本和延迟提供接近前沿的智能水平。它在推理、编码和计算机操作任务上达到 Claude Sonnet 4 的水平,把前沿级能力带到实时与高并发应用中。该型号首次为 Haiku 系列引入扩展思考,支持可控的推理深度、summarized 或交错的思考输出,以及配合编码、bash、网页搜索和计算机操作工具的工作流。它在 SWE-bench Verified 上得分超过 73%,跻身全球最强编码模型之列,同时保持极高响应速度,适合子 Agent、并行执行和规模化部署。
多模态能力
输入 / 输出价格
1.4 折$0.141 / $0.705$1 / $5per 1M
上下文
200K
发布时间
2025年10月1日
供应商
模驿API 在您设置的折扣区间和供应商列表内按健康度与成本自动路由。任一供应商报错时会立刻切到次优供应商,请求里不需要指定。 配置折扣区间
需要自行选择供应商的组合?
| 供应商 | 上下文 | 输入价格 | 输出价格 | 缓存价格 | 首字时延(TTFT) | 输出速度(TPS) | 可用率(SLA) | 数据安全 |
|---|---|---|---|---|---|---|---|---|
| Anthropic | 200K | $1$0.141 | $5$0.705 | $0.1$0.0141 | — | — | — | 不用于训练 |
| AWS Bedrock | 200K | $1$0.141 | $5$0.705 | $0.1$0.0141 | — | — | — | 不用于训练 |
实时折扣
各供应商的平均成交折扣,每小时更新。
该模型近 24 小时暂无折扣数据。
性能
首字时延与输出速度按网关侧实际请求统计。
首字时延(TTFT)
从请求发出到收到首个输出 Token 所需的时间,按供应商分别统计。
首字时延 · 模驿API 网关
输出速度(TPS)
收到首个输出 Token 后,后续每秒能生成的 Token 数,按供应商分别统计。
输出速度 · 模驿API 网关
可用率
网关持续探测每个供应商,某个供应商报错时自动切到次优供应商,因此 模驿API 可用率是在 模驿API 调用模型的整体可用性,而不是单一上游的可用性。
可用率(24 小时)
—
可用率(3 天)
—
近 3 天可用性
—
近 24 小时可用性
每个上游供应商各一条曲线。模驿API 那条只看每个请求的最后一次尝试,衡量的是经过所有降级之后端到端的最终结果。
可用率 · 近 24 小时 · 模驿API 网关
数据安全
快速接入
from anthropic import Anthropic
client = Anthropic(
base_url="https://api.moyiapi.com", # 只改这一行
api_key="<MOYIAPI_API_KEY>",
)
message = client.messages.create(
model="claude-haiku-4-5",
max_tokens=1024,
messages=[{"role": "user", "content": "Hello"}],
)
print(message.content[0].text)Endpoint: https://api.moyiapi.com