Claude/claude-opus-4-6-aws
AWS官方版本,服务稳定
Saída
Envie uma mensagem à esquerda. A resposta aparece aqui.
Preços
Este modelo é cobrado pelas dimensões de uso listadas aqui. Comparar todos os preços.
Preços de tabela em USD. Seu preço efetivo também depende do grupo de faturamento da sua chave de API.
claude-opus-4-6-awsclaude-opus-4-6-awsclaude-opus-4-6-awsclaude-opus-4-6-awsAPI
/v1/messagesconst BASE_URL = "https://api.dreamtoai.com";
const API_KEY = process.env.MIX_API_KEY;
const headers = {
"Authorization": `Bearer ${API_KEY}`,
"Content-Type": "application/json",
};
const payload = {
"model": "claude-opus-4-6-aws",
"messages": [
{
"content": "你好,世界",
"role": "user"
}
],
"system_instruction": "请用简洁中文回答。",
"max_tokens": 4096,
"temperature": 0.7,
"top_p": 0.95,
"top_k": 40,
"thinking": {
"budget_tokens": 1024,
"type": "enabled"
},
"tools": [],
"tool_choice": "auto",
"stream": false,
"stop_sequences": [
"\n\nHuman:"
],
"metadata": {
"user_id": "user-xxx"
},
"output_config": {
"effort": "high"
},
"cache_control": {
"ttl": "5m",
"type": "ephemeral"
}
};
const submit = await fetch(`${BASE_URL}/v1/jobs`, {
method: "POST",
headers,
body: JSON.stringify(payload),
}).then((r) => r.json());
const status = await fetch(`${BASE_URL}/v1/jobs/${submit.id}`, { headers })
.then((r) => r.json());
console.log(status);
Crie uma chave em Console → Chaves de API e substitua o espaço reservado no exemplo.
README
claude-opus-4-6-aws
AWS官方版本,服务稳定
Por que escolher?
- Linguagem e raciocínio
- Escrita, análise, programação e conversa em vários turnos em um só modelo.
- Pague por token
- $3.25 por 1M de tokens de entrada e $16.25 por 1M de tokens de saída, sem assinatura.
- Cache de prompt
- A entrada em cache custa $0.33 por 1M de tokens, reduzindo o custo de contexto repetido.
- Funciona com seu SDK
- Chame no formato Anthropic Messages / OpenAI Chat Completions: clientes existentes só precisam de uma nova URL base e chave.
- Uma chave para todos os modelos
- A mesma chave de API funciona para todos os modelos da dreamtoai.
Parâmetros
| Parâmetro | Obrigatório | Descrição |
|---|---|---|
messagesarray | Obrigatório | Histórico da conversa como uma lista de mensagens com role e content. |
system_instructionstring | Opcional | Instruções que definem o comportamento do assistente. |
max_tokensinteger | Opcional | Número máximo de tokens a gerar. Padrão: 4096. |
temperaturenumber | Opcional | Temperatura de amostragem. Mais baixa é mais focada; mais alta, mais variada. Padrão: 0.7. |
top_pnumber | Opcional | Limite de amostragem nucleus. |
top_kinteger | Opcional | Top K |
thinkingobject | Opcional | 扩展思考 |
toolsarray | Opcional | 工具列表 |
tool_choicestring | Opcional | 工具选择 |
streamboolean | Opcional | Transmite a resposta como server-sent events. Padrão: false. |
stop_sequencesarray | Opcional | 停止序列 |
metadataobject | Opcional | 元数据 |
output_configobject | Opcional | 输出配置 |
cache_controlobject | Opcional | 提示词缓存控制 |
Como usar
- Teste aqui primeiro — Entre e rode o modelo no playground acima para conferir o resultado antes de escrever código.
- Crie uma chave de API — Abra Console → Chaves de API e crie uma chave. A mesma chave funciona para todos os modelos.
- Escreva suas mensagens — Coloque a tarefa e o contexto no array messages; adicione um prompt de sistema para definir o comportamento do assistente.
- Defina os parâmetros opcionais — Ajuste os parâmetros opcionais listados acima para controlar a saída.
- Envie a requisição — Chame POST /v1/messages com o ID de modelo claude-opus-4-6-aws.
- Leia a resposta — A resposta e o uso de tokens voltam no retorno e ficam registrados no console.
Como escrever prompts eficazes
Instruções claras geram respostas melhores. Diga ao modelo quem ele é, o que você precisa e como a resposta deve ser.
1. Defina o papel e o objetivo
Comece dizendo quem o modelo deve ser e qual é a tarefa. Regras que nunca mudam vão no prompt de sistema.
Você é um revisor sênior de Python. Revise a função abaixo em busca de bugs e problemas de legibilidade.
2. Dê o contexto
Cole aquilo de que a resposta depende: documentos, código, dados ou decisões anteriores. Separe cada parte com um título ou tag.
3. Especifique a saída
Diga o formato, o tamanho e o tom: uma tabela, JSON com chaves definidas, cinco tópicos, um resumo de 200 palavras.
4. Mostre um exemplo
Um ou dois exemplos de entrada e saída definem o estilo mais rápido do que uma descrição longa.
5. Itere
Quando a resposta erra, adicione a restrição que falta ao prompt em vez de recomeçar.
| Prompt | |
|---|---|
| Fraco | Escreva sobre nosso produto. |
| Forte | Você é redator B2B. Escreva três posts de 40 palavras para o LinkedIn anunciando nossa API de faturamento para pequenos escritórios de contabilidade. Tom: confiante, linguagem simples, sem emojis. Termine cada post com uma pergunta. |
Preços
| Item cobrado | Preço | Preço oficial |
|---|---|---|
| 输入token | $3.25 por 1 M | |
| 输出token | $16.25 por 1 M | |
| 缓存读token | $0.325 por 1 M | |
| 缓存写token | $4.0625 por 1 M |
Isso é 35% abaixo do preço oficial de tabela.
Exemplo: uma requisição com 10.000 tokens de entrada e 1.000 de saída custa cerca de $0.05.
Preços de tabela em USD. Seu preço efetivo também depende do grupo de faturamento da sua chave de API. Comparar todos os preços
Melhores casos de uso
- Assistentes de programação — Gere, revise e refatore código, ou explique uma base de código desconhecida.
- Agentes e automação — Planeje tarefas em várias etapas e chame ferramentas a partir dos seus fluxos.
- Trabalho intelectual — Resuma relatórios, rascunhe documentos e responda perguntas sobre seu próprio conteúdo.
- Atendimento ao cliente — Alimente bots de suporte e rascunhe respostas com tom consistente.
- Extração de dados — Transforme texto não estruturado em JSON estruturado para outros sistemas.
- Tradução e localização — Traduza e adapte textos entre idiomas.
Dicas avançadas
- Coloque instruções estáveis no prompt de sistema e deixe as mensagens do usuário para a tarefa em si.
- Defina max_tokens para limitar o tamanho e o custo de cada resposta.
- Mantenha idêntico um prefixo longo compartilhado entre as requisições para que a entrada repetida seja cobrada pelo preço de cache.
- Peça JSON com as chaves exatas quando um programa for ler a resposta.
- Teste prompts no playground acima antes de integrá-los ao código.
- Acompanhe o uso de tokens no console para identificar prompts caros demais.
Modelos relacionados
- claude-opus-4-6
- claude-opus-4-6-fast
- Claude Opus 4.7 —
claude-opus-4-7 - Claude Sonnet 4.6 —
claude-sonnet-4-6 - Claude Haiku 4.5 —
claude-haiku-4-5
Ver todos os LLMsExplorar o API Market
FAQ
O que é claude-opus-4-6-aws?
AWS官方版本,服务稳定
Como chamo a API do claude-opus-4-6-aws?
Envie POST /v1/messages com o ID de modelo claude-opus-4-6-aws e sua chave de API. Há exemplos prontos para rodar na seção API acima.
Como a cobrança é calculada?
As solicitações são cobradas pelos preços acima e debitadas da sua carteira. O custo final depende do uso e do grupo de faturamento vinculado à sua chave de API.
Onde consigo uma chave de API?
Crie em Console → Chaves de API. A mesma chave funciona para todos os modelos do gateway.
Posso usar o resultado comercialmente?
Sim. Você pode usar o que gerar em projetos comerciais, sujeito aos termos do provedor do modelo.
Sobre claude-opus-4-6-aws na dreamtoai
AWS官方版本,服务稳定