AWS官方版本,服务稳定

服务正常Chat & Reasoning输入 $0.65/1M输出 $3.25/1M-35%较官方对比可商用数据隐私

输入

输出

在左侧发送消息,回复会显示在这里。

价格

该模型按下列计费维度收费。 查看全部价格.

价格以 USD 展示,实际费用还取决于 API Key 绑定的计费分组。

计费维度输入tokenclaude-haiku-4-5-aws
$0.65每 1M1/1M
计费维度输出tokenclaude-haiku-4-5-aws
$3.25每 1M5/1M
计费维度缓存读tokenclaude-haiku-4-5-aws
$0.065每 1M0.1/1M
计费维度缓存写tokenclaude-haiku-4-5-aws
$0.8125每 1M1.25/1M

API

POST/v1/messages
const BASE_URL = "https://api.dreamtoai.com";
const API_KEY = process.env.MIX_API_KEY;

const headers = {
  "Authorization": `Bearer ${API_KEY}`,
  "Content-Type": "application/json",
};

const payload = {
  "model": "claude-haiku-4-5-aws",
  "messages": [
    {
      "content": "你好,世界",
      "role": "user"
    }
  ],
  "system_instruction": "请用简洁中文回答。",
  "max_tokens": 4096,
  "temperature": 0.7,
  "top_p": 0.95,
  "top_k": 40,
  "thinking": {
    "budget_tokens": 1024,
    "type": "enabled"
  },
  "tools": [],
  "tool_choice": "auto",
  "stream": false,
  "stop_sequences": [
    "\n\nHuman:"
  ],
  "metadata": {
    "user_id": "user-xxx"
  },
  "output_config": {
    "effort": "high"
  },
  "cache_control": {
    "ttl": "5m",
    "type": "ephemeral"
  }
};

const submit = await fetch(`${BASE_URL}/v1/jobs`, {
  method: "POST",
  headers,
  body: JSON.stringify(payload),
}).then((r) => r.json());

const status = await fetch(`${BASE_URL}/v1/jobs/${submit.id}`, { headers })
  .then((r) => r.json());
console.log(status);

在控制台 → API Keys 创建密钥,并替换示例中的占位符。

README

claude-haiku-4-5-aws

AWS官方版本,服务稳定

为什么选择它?

语言与推理
一个模型即可胜任写作、分析、编程和多轮对话。
按 token 计费
输入每 100 万 token $0.65,输出每 100 万 token $3.25,无需订阅。
提示词缓存
缓存输入按每 100 万 token $0.07 计费,重复上下文的成本大幅降低。
兼容现有 SDK
支持 Anthropic Messages / OpenAI Chat Completions 格式调用,现有客户端只需更换 Base URL 和密钥。
一个密钥调用所有模型
同一个 API 密钥可调用 dreamtoai 上的所有模型。

参数

参数必填说明
messagesarray必填对话历史,由 role 和 content 组成的消息列表。
system_instructionstring可选设定助手行为的指令。
max_tokensinteger可选最多生成的 token 数。 默认: 4096.
temperaturenumber可选采样温度。越低越稳定,越高越多样。 默认: 0.7.
top_pnumber可选核采样阈值。
top_kinteger可选Top K
thinkingobject可选扩展思考
toolsarray可选工具列表
tool_choicestring可选工具选择
streamboolean可选以服务器推送事件(SSE)流式返回回复。 默认: false.
stop_sequencesarray可选停止序列
metadataobject可选元数据
output_configobject可选输出配置
cache_controlobject可选提示词缓存控制

使用方法

  1. 先在这里试用 — 登录后在上方 Playground 运行模型,写代码前先确认输出效果。
  2. 创建 API 密钥 — 打开 控制台 → API 密钥 创建密钥。同一个密钥适用于所有模型。
  3. 编写消息 — 把任务和上下文放进 messages 数组;用 system 提示词设定助手行为。
  4. 设置可选参数 — 调整上方列出的可选参数来控制输出。
  5. 发送请求 — 调用 POST /v1/messages,模型 ID 填 claude-haiku-4-5-aws。
  6. 读取回复 — 回复和 token 用量会在响应中返回,并记录在控制台。

如何写好提示词

指令越清晰,回答越好。告诉模型它是谁、你需要什么、答案应该是什么样子。

1. 设定角色和目标

开头说明模型扮演谁、任务是什么。始终不变的规则放进 system 提示词。

你是一名资深 Python 代码审查员。请检查下面函数中的缺陷和可读性问题。

2. 提供上下文

贴上答案所依赖的材料:文档、代码、数据或之前的决定。用标题或标签把各部分分开。

3. 指定输出

说明格式、长度和语气:表格、指定键名的 JSON、五个要点、200 字摘要。

4. 给出示例

一两个输入输出示例,比冗长的描述更快定下风格。

5. 迭代

回答不理想时,把缺失的约束补进提示词,而不是从头再来。

提示词
弱写写我们的产品。
强你是一名 B2B 文案。为我们面向小型会计事务所的开票 API 写三条 40 字左右的领英帖子。语气:自信、平实,不用表情符号。每条以一个问题结尾。

价格

计费项价格官方价
输入token$0.65 每 1M$1.00/1M
输出token$3.25 每 1M$5.00/1M
缓存读token$0.065 每 1M$0.10/1M
缓存写token$0.8125 每 1M$1.25/1M

比官方标价低 35%。

示例:一次输入 10,000 token、输出 1,000 token 的请求约花费 $0.0097。

价格以 USD 展示,实际费用还取决于 API Key 绑定的计费分组。 查看全部价格

最佳使用场景

  • 编程助手 — 生成、审查和重构代码,或解读陌生的代码库。
  • 智能体与自动化 — 规划多步骤任务,并在你自己的工作流中调用工具。
  • 知识工作 — 总结报告、起草文档,并基于你自己的内容回答问题。
  • 客户支持 — 驱动客服机器人,并以一致的语气起草回复。
  • 数据提取 — 把非结构化文本转成结构化 JSON,供下游系统使用。
  • 翻译与本地化 — 跨语言翻译和改写文案。

专业技巧

  • 稳定不变的指令放在 system 提示词里,user 消息只写具体任务。
  • 设置 max_tokens,限制每次回复的长度和费用。
  • 让多次请求的长前缀保持一致,重复的输入就会按缓存价计费。
  • 需要程序读取答案时,要求输出 JSON 并写明所需键名。
  • 先在上方 Playground 测试提示词,再接入代码。
  • 在控制台查看 token 用量,找出费用异常的提示词。

浏览全部大模型浏览模型广场

FAQ

claude-haiku-4-5-aws 是什么?

AWS官方版本,服务稳定

如何调用 claude-haiku-4-5-aws API?

使用你的 API 密钥发送 POST /v1/messages,模型 ID 填 claude-haiku-4-5-aws。上方 API 部分有可直接运行的示例。

费用如何计算?

请求按上方列出的价格计费,并从钱包余额扣除;最终费用取决于输入输出用量和 API Key 绑定的分组。

在哪里获取 API Key?

在控制台 → API Keys 创建密钥,同一个密钥可调用平台上的所有模型。

生成的内容可以商用吗?

可以。你生成的内容可用于商业项目,但需遵守模型提供方的条款。

dreamtoai 上的 claude-haiku-4-5-aws

AWS官方版本,服务稳定

相关模型

下一步