Claude/claude-haiku-4-5-aws
AWS官方版本,服务稳定
Output
Kirim pesan di sebelah kiri. Balasannya muncul di sini.
Harga
Model ini ditagih berdasarkan dimensi penggunaan yang tercantum di sini. Bandingkan semua harga.
Harga daftar dalam USD. Harga efektif Anda juga bergantung pada grup penagihan kunci API Anda.
claude-haiku-4-5-awsclaude-haiku-4-5-awsclaude-haiku-4-5-awsclaude-haiku-4-5-awsAPI
/v1/messagesconst BASE_URL = "https://api.dreamtoai.com";
const API_KEY = process.env.MIX_API_KEY;
const headers = {
"Authorization": `Bearer ${API_KEY}`,
"Content-Type": "application/json",
};
const payload = {
"model": "claude-haiku-4-5-aws",
"messages": [
{
"content": "你好,世界",
"role": "user"
}
],
"system_instruction": "请用简洁中文回答。",
"max_tokens": 4096,
"temperature": 0.7,
"top_p": 0.95,
"top_k": 40,
"thinking": {
"budget_tokens": 1024,
"type": "enabled"
},
"tools": [],
"tool_choice": "auto",
"stream": false,
"stop_sequences": [
"\n\nHuman:"
],
"metadata": {
"user_id": "user-xxx"
},
"output_config": {
"effort": "high"
},
"cache_control": {
"ttl": "5m",
"type": "ephemeral"
}
};
const submit = await fetch(`${BASE_URL}/v1/jobs`, {
method: "POST",
headers,
body: JSON.stringify(payload),
}).then((r) => r.json());
const status = await fetch(`${BASE_URL}/v1/jobs/${submit.id}`, { headers })
.then((r) => r.json());
console.log(status);
Buat kunci di Konsol → Kunci API dan ganti placeholder pada contoh.
README
claude-haiku-4-5-aws
AWS官方版本,服务稳定
Mengapa memilih ini?
- Bahasa dan penalaran
- Menulis, menganalisis, coding, dan percakapan multi-giliran dalam satu model.
- Bayar per token
- $0.65 per 1 juta token input dan $3.25 per 1 juta token output, tanpa langganan.
- Caching prompt
- Input yang di-cache ditagih $0.07 per 1 juta token, sehingga biaya konteks berulang lebih rendah.
- Bekerja dengan SDK Anda
- Panggil dalam format Anthropic Messages / OpenAI Chat Completions, sehingga klien yang ada hanya perlu base URL dan kunci baru.
- Satu kunci untuk semua model
- Kunci API yang sama berlaku untuk semua model di dreamtoai.
Parameter
| Parameter | Wajib | Deskripsi |
|---|---|---|
messagesarray | Wajib | Riwayat percakapan berupa daftar pesan dengan role dan content. |
system_instructionstring | Opsional | Instruksi yang mengatur perilaku asisten. |
max_tokensinteger | Opsional | Jumlah maksimum token yang dihasilkan. Default: 4096. |
temperaturenumber | Opsional | Suhu sampling. Lebih rendah lebih fokus, lebih tinggi lebih bervariasi. Default: 0.7. |
top_pnumber | Opsional | Ambang nucleus sampling. |
top_kinteger | Opsional | Top K |
thinkingobject | Opsional | 扩展思考 |
toolsarray | Opsional | 工具列表 |
tool_choicestring | Opsional | 工具选择 |
streamboolean | Opsional | Mengalirkan balasan sebagai server-sent events. Default: false. |
stop_sequencesarray | Opsional | 停止序列 |
metadataobject | Opsional | 元数据 |
output_configobject | Opsional | 输出配置 |
cache_controlobject | Opsional | 提示词缓存控制 |
Cara menggunakan
- Coba di sini dulu — Masuk dan jalankan model di playground di atas untuk memeriksa hasil sebelum menulis kode.
- Buat kunci API — Buka Konsol → Kunci API dan buat kunci. Kunci yang sama berlaku untuk semua model.
- Tulis pesan Anda — Masukkan tugas dan konteksnya ke array messages; tambahkan system prompt untuk mengatur perilaku asisten.
- Atur parameter opsional — Sesuaikan parameter opsional yang tercantum di atas untuk mengendalikan keluaran.
- Kirim permintaan — Panggil POST /v1/messages dengan ID model claude-haiku-4-5-aws.
- Baca balasan — Balasan dan pemakaian tokennya kembali di respons dan tercatat di konsol.
Menulis prompt yang efektif
Instruksi yang jelas menghasilkan jawaban yang lebih baik. Beri tahu model siapa dirinya, apa yang Anda butuhkan, dan seperti apa jawabannya.
1. Tetapkan peran dan tujuan
Mulailah dengan peran model dan tugasnya. Aturan yang tidak pernah berubah taruh di system prompt.
Anda reviewer Python senior. Tinjau fungsi di bawah untuk bug dan keterbacaan.
2. Berikan konteks
Tempelkan hal yang menjadi dasar jawaban: dokumen, kode, data, atau keputusan sebelumnya. Pisahkan tiap bagian dengan judul atau tag.
3. Tentukan keluaran
Sebutkan format, panjang, dan nada: tabel, JSON dengan kunci tertentu, lima poin, ringkasan 200 kata.
4. Tunjukkan contoh
Satu atau dua contoh input dan output menetapkan gaya lebih cepat daripada deskripsi panjang.
5. Iterasi
Jika jawaban meleset, tambahkan batasan yang kurang ke prompt alih-alih mulai dari awal.
| Prompt | |
|---|---|
| Lemah | Tulis tentang produk kami. |
| Kuat | Anda seorang copywriter B2B. Tulis tiga posting LinkedIn 40 kata yang mengumumkan API penagihan kami untuk kantor akuntan kecil. Nada: percaya diri, bahasa sederhana, tanpa emoji. Akhiri setiap posting dengan pertanyaan. |
Harga
| Item tagihan | Harga | Harga resmi |
|---|---|---|
| 输入token | $0.65 per 1 jt | |
| 输出token | $3.25 per 1 jt | |
| 缓存读token | $0.065 per 1 jt | |
| 缓存写token | $0.8125 per 1 jt |
Itu 35% lebih murah dari harga resmi.
Contoh: permintaan dengan 10.000 token input dan 1.000 token output berbiaya sekitar $0.0097.
Harga daftar dalam USD. Harga efektif Anda juga bergantung pada grup penagihan kunci API Anda. Bandingkan semua harga
Kasus penggunaan terbaik
- Asisten coding — Buat, tinjau, dan refaktor kode, atau jelaskan codebase yang asing.
- Agen dan otomasi — Rencanakan tugas multi-langkah dan panggil tool dari alur kerja Anda.
- Pekerjaan pengetahuan — Ringkas laporan, susun draf dokumen, dan jawab pertanyaan dari konten Anda sendiri.
- Dukungan pelanggan — Jalankan bot help desk dan susun balasan dengan nada konsisten.
- Ekstraksi data — Ubah teks tak terstruktur menjadi JSON terstruktur untuk sistem hilir.
- Terjemahan dan lokalisasi — Terjemahkan dan sesuaikan teks antarbahasa.
Tips pro
- Taruh instruksi tetap di system prompt dan gunakan pesan user untuk tugasnya saja.
- Atur max_tokens untuk membatasi panjang dan biaya setiap balasan.
- Pertahankan awalan panjang yang sama di setiap permintaan agar input berulang ditagih dengan harga cache.
- Minta JSON dengan kunci persis yang dibutuhkan saat program membaca jawabannya.
- Uji prompt di playground di atas sebelum memasangnya ke kode.
- Periksa pemakaian token di konsol untuk menemukan prompt yang sangat mahal.
Model terkait
- claude-haiku-4-5
- claude-haiku-4-5-fast
- Claude Opus 4.7 —
claude-opus-4-7 - Claude Opus 4.6 —
claude-opus-4-6 - Claude Sonnet 4.6 —
claude-sonnet-4-6
Lihat semua LLMJelajahi API Market
FAQ
Apa itu claude-haiku-4-5-aws?
AWS官方版本,服务稳定
Bagaimana cara memanggil API claude-haiku-4-5-aws?
Kirim POST /v1/messages dengan ID model claude-haiku-4-5-aws dan kunci API Anda. Contoh siap jalan ada di bagian API di atas.
Bagaimana penagihan dihitung?
Permintaan ditagih sesuai harga di atas dan dibebankan ke dompet Anda. Biaya akhir bergantung pada pemakaian dan grup penagihan yang terkait dengan kunci API Anda.
Di mana saya mendapatkan kunci API?
Buat di Konsol → Kunci API. Kunci yang sama berlaku untuk semua model di gateway.
Bolehkah hasilnya dipakai untuk komersial?
Ya. Anda dapat memakai hasil yang dibuat dalam proyek komersial, sesuai ketentuan penyedia model.
Tentang claude-haiku-4-5-aws di dreamtoai
AWS官方版本,服务稳定