AWS官方版本,服务稳定

OperativoChat & ReasoningEntrada $0.65/1MSalida $3.25/1M-35%vs. oficialUso comercialPrivacidad de datos

Entrada

Salida

Envía un mensaje a la izquierda. La respuesta aparecerá aquí.

Precios

Este modelo se cobra según las dimensiones de uso indicadas aquí. Comparar todos los precios.

Precios de lista en USD. Tu precio efectivo también depende del grupo de facturación de tu clave API.

Criterio输入tokenclaude-haiku-4-5-aws
$0.65por 1 M1/1M
Criterio输出tokenclaude-haiku-4-5-aws
$3.25por 1 M5/1M
Criterio缓存读tokenclaude-haiku-4-5-aws
$0.065por 1 M0.1/1M
Criterio缓存写tokenclaude-haiku-4-5-aws
$0.8125por 1 M1.25/1M

API

POST/v1/messages
const BASE_URL = "https://api.dreamtoai.com";
const API_KEY = process.env.MIX_API_KEY;

const headers = {
  "Authorization": `Bearer ${API_KEY}`,
  "Content-Type": "application/json",
};

const payload = {
  "model": "claude-haiku-4-5-aws",
  "messages": [
    {
      "content": "你好,世界",
      "role": "user"
    }
  ],
  "system_instruction": "请用简洁中文回答。",
  "max_tokens": 4096,
  "temperature": 0.7,
  "top_p": 0.95,
  "top_k": 40,
  "thinking": {
    "budget_tokens": 1024,
    "type": "enabled"
  },
  "tools": [],
  "tool_choice": "auto",
  "stream": false,
  "stop_sequences": [
    "\n\nHuman:"
  ],
  "metadata": {
    "user_id": "user-xxx"
  },
  "output_config": {
    "effort": "high"
  },
  "cache_control": {
    "ttl": "5m",
    "type": "ephemeral"
  }
};

const submit = await fetch(`${BASE_URL}/v1/jobs`, {
  method: "POST",
  headers,
  body: JSON.stringify(payload),
}).then((r) => r.json());

const status = await fetch(`${BASE_URL}/v1/jobs/${submit.id}`, { headers })
  .then((r) => r.json());
console.log(status);

Crea una clave en Consola → Claves API y reemplaza el marcador del ejemplo.

README

claude-haiku-4-5-aws

AWS官方版本,服务稳定

¿Por qué elegirlo?

Lenguaje y razonamiento
Redacción, análisis, programación y conversación de varios turnos en un solo modelo.
Pago por token
$0.65 por 1M de tokens de entrada y $3.25 por 1M de tokens de salida, sin suscripción.
Caché de prompts
La entrada en caché se cobra a $0.07 por 1M de tokens, lo que reduce el coste del contexto repetido.
Compatible con tu SDK actual
Llámalo en formato Anthropic Messages / OpenAI Chat Completions: los clientes existentes solo necesitan una nueva URL base y una clave.
Una clave para todos los modelos
La misma clave de API sirve para todos los modelos de dreamtoai.

Parámetros

ParámetroObligatorioDescripción
messagesarrayObligatorioHistorial de la conversación como lista de mensajes con role y content.
system_instructionstringOpcionalInstrucciones que definen el comportamiento del asistente.
max_tokensintegerOpcionalNúmero máximo de tokens que se generan. Predeterminado: 4096.
temperaturenumberOpcionalTemperatura de muestreo. Más baja es más precisa; más alta, más variada. Predeterminado: 0.7.
top_pnumberOpcionalUmbral de muestreo nucleus.
top_kintegerOpcionalTop K
thinkingobjectOpcional扩展思考
toolsarrayOpcional工具列表
tool_choicestringOpcional工具选择
streambooleanOpcionalTransmite la respuesta como eventos enviados por el servidor (SSE). Predeterminado: false.
stop_sequencesarrayOpcional停止序列
metadataobjectOpcional元数据
output_configobjectOpcional输出配置
cache_controlobjectOpcional提示词缓存控制

Cómo usarlo

  1. Pruébalo aquí primero — Inicia sesión y ejecuta el modelo en el playground de arriba para revisar el resultado antes de escribir código.
  2. Crea una clave de API — Abre Consola → Claves de API y crea una clave. La misma clave sirve para todos los modelos.
  3. Escribe tus mensajes — Pon la tarea y su contexto en el arreglo messages; añade un prompt de sistema para definir el comportamiento del asistente.
  4. Configura los parámetros opcionales — Ajusta los parámetros opcionales de arriba para controlar la salida.
  5. Envía la solicitud — Llama a POST /v1/messages con el ID de modelo claude-haiku-4-5-aws.
  6. Lee la respuesta — La respuesta y su uso de tokens llegan en la respuesta y quedan registrados en la consola.

Cómo escribir prompts eficaces

Instrucciones claras dan mejores respuestas. Dile al modelo quién es, qué necesitas y cómo debe ser la respuesta.

1. Define el rol y el objetivo

Empieza indicando qué papel asume el modelo y cuál es la tarea. Las reglas que nunca cambian van en el prompt de sistema.

Eres un revisor sénior de Python. Revisa la función siguiente en busca de errores y problemas de legibilidad.

2. Da el contexto

Pega aquello de lo que depende la respuesta: documentos, código, datos o decisiones previas. Separa cada parte con un título o etiqueta.

3. Especifica la salida

Indica formato, extensión y tono: una tabla, JSON con claves concretas, cinco viñetas, un resumen de 200 palabras.

4. Muestra un ejemplo

Uno o dos ejemplos de entrada y salida fijan el estilo más rápido que una descripción larga.

5. Itera

Si la respuesta no acierta, añade la restricción que falta al prompt en lugar de empezar de cero.

Prompt
DébilEscribe sobre nuestro producto.
SólidoEres redactor B2B. Escribe tres publicaciones de LinkedIn de 40 palabras que anuncien nuestra API de facturación para pequeñas gestorías contables. Tono: seguro, lenguaje sencillo, sin emojis. Termina cada publicación con una pregunta.

Precios

Concepto facturadoPrecioPrecio oficial
输入token$0.65 por 1 M$1.00/1M
输出token$3.25 por 1 M$5.00/1M
缓存读token$0.065 por 1 M$0.10/1M
缓存写token$0.8125 por 1 M$1.25/1M

Es un 35% menos que el precio oficial de lista.

Ejemplo: una solicitud con 10.000 tokens de entrada y 1.000 de salida cuesta unos $0.0097.

Precios de lista en USD. Tu precio efectivo también depende del grupo de facturación de tu clave API. Comparar todos los precios

Mejores casos de uso

  • Asistentes de programación — Genera, revisa y refactoriza código, o explica un código desconocido.
  • Agentes y automatización — Planifica tareas de varios pasos y llama herramientas desde tus propios flujos.
  • Trabajo del conocimiento — Resume informes, redacta documentos y responde preguntas sobre tu propio contenido.
  • Atención al cliente — Impulsa bots de soporte y redacta respuestas con un tono coherente.
  • Extracción de datos — Convierte texto no estructurado en JSON estructurado para otros sistemas.
  • Traducción y localización — Traduce y adapta textos entre idiomas.

Consejos avanzados

  • Pon las instrucciones estables en el prompt de sistema y deja los mensajes de usuario para la tarea en sí.
  • Configura max_tokens para limitar la extensión y el coste de cada respuesta.
  • Mantén idéntico un prefijo largo compartido entre solicitudes para que la entrada repetida se cobre al precio de caché.
  • Pide JSON con las claves exactas que necesitas cuando un programa lea la respuesta.
  • Prueba los prompts en el playground de arriba antes de integrarlos en el código.
  • Revisa el uso de tokens en la consola para detectar prompts inusualmente caros.

Ver todos los LLMExplorar API Market

FAQ

¿Qué es claude-haiku-4-5-aws?

AWS官方版本,服务稳定

¿Cómo llamo a la API de claude-haiku-4-5-aws?

Envía POST /v1/messages con el ID de modelo claude-haiku-4-5-aws y tu clave de API. En la sección API de arriba hay ejemplos listos para ejecutar.

¿Cómo se calcula la facturación?

Las solicitudes se facturan a los precios indicados arriba y se cargan a tu cartera. El coste final depende del uso y del grupo de facturación asociado a tu clave API.

¿Dónde consigo una clave API?

Créala en Consola → Claves API. La misma clave sirve para todos los modelos del gateway.

¿Puedo usar el resultado con fines comerciales?

Sí. Puedes usar lo que generes en proyectos comerciales, sujeto a los términos del proveedor del modelo.

Acerca de claude-haiku-4-5-aws en dreamtoai

AWS官方版本,服务稳定

Modelos relacionados

Próximos pasos