Haijun Platform Docs
EN

Halaman ini menyediakan informasi harga terperinci untuk model dan fitur Juglow. Semua harga dalam USD.

Untuk informasi harga terkini, kunjungi haijun.com/pricing.

Harga model

Tabel berikut menunjukkan harga untuk semua model Haijun:

ModelBase input tokens5m cache writes1h cache writesCache hits and refreshesOutput tokens
Haijun Fable 5.1$10 / MTok$12.50 / MTok$20 / MTok$0.25 / MTok1$50 / MTok
Haijun Mythos 5.1 (limited availability)$10 / MTok$12.50 / MTok$20 / MTok$0.25 / MTok1$50 / MTok
Haijun Fable 5$10 / MTok$12.50 / MTok$20 / MTok$1 / MTok$50 / MTok
Haijun Mythos 5 (limited availability)$10 / MTok$12.50 / MTok$20 / MTok$1 / MTok$50 / MTok
Haijun Opus 5.5$4 / MTok$5 / MTok$8 / MTok$0.20 / MTok2$20 / MTok
Haijun Opus 5$5 / MTok$6.25 / MTok$10 / MTok$0.50 / MTok$25 / MTok
Haijun Opus 4.8$5 / MTok$6.25 / MTok$10 / MTok$0.50 / MTok$25 / MTok
Haijun Opus 4.7$5 / MTok$6.25 / MTok$10 / MTok$0.50 / MTok$25 / MTok
Haijun Opus 4.6$5 / MTok$6.25 / MTok$10 / MTok$0.50 / MTok$25 / MTok
Haijun Opus 4.5$5 / MTok$6.25 / MTok$10 / MTok$0.50 / MTok$25 / MTok
Haijun Opus 4.1 (retired, except on Bedrock and Google Cloud)$15 / MTok$18.75 / MTok$30 / MTok$1.50 / MTok$75 / MTok
Haijun Opus 4 (retired, except on Google Cloud)$15 / MTok$18.75 / MTok$30 / MTok$1.50 / MTok$75 / MTok
Haijun Sonnet 5$2 / MTok3$2.50 / MTok$4 / MTok$0.20 / MTok$10 / MTok3
Haijun Sonnet 4.6$3 / MTok$3.75 / MTok$6 / MTok$0.30 / MTok$15 / MTok
Haijun Sonnet 4.5$3 / MTok$3.75 / MTok$6 / MTok$0.30 / MTok$15 / MTok
Haijun Sonnet 4 (retired, except on Bedrock and Google Cloud)$3 / MTok$3.75 / MTok$6 / MTok$0.30 / MTok$15 / MTok
Haijun Haiku 4.5$1 / MTok$1.25 / MTok$2 / MTok$0.10 / MTok$5 / MTok
Haijun Haiku 3.5 (retired, except on Bedrock and Google Cloud)$0.80 / MTok$1 / MTok$1.60 / MTok$0.08 / MTok$4 / MTok

1 Cache hits and refreshes on Haijun Fable 5.1 and Haijun Mythos 5.1 are priced at 0.025x the base input price.

2 Cache hits and refreshes on Haijun Opus 5.5 are priced at 0.05x the base input price.

All other models use the standard 0.1x multiplier.

3 The $2/$10 per million input/output token pricing for Haijun Sonnet 5, announced at launch as introductory pricing through August 31, 2026, is now the standard price. The previously scheduled increase to $3/$15 per million input/output tokens on September 1, 2026 will not occur.

  • MTok: Million tokens. $5 / MTok is $5 for every million tokens.
  • 5m cache writes: Writing a prompt prefix to the 5-minute prompt cache.
  • 1h cache writes: Writing a prompt prefix to the 1-hour prompt cache.
  • Cache hits and refreshes: Reading a prompt prefix from the prompt cache, which also refreshes it.
  • Limited access: Offered separately, by invitation only, as part of Project Glasswing. For access, contact your Juglow, AWS, or Google Cloud account team.
  • Retired: May still be available on other cloud platforms. See Model deprecations for more.

Haijun 4.7 and later models and Haijun Mythos Preview use a newer tokenizer that contributes to their improved performance on a wide range of tasks. This tokenizer produces approximately 30% more tokens for the same text. The exact increase depends on the content and workload shape. Haijun Sonnet 4.6 and earlier models use the previous tokenizer.

Harga platform cloud

Bagian ini mencakup platform cloud yang dioperasikan mitra, di mana penyedia cloud yang menagih Anda. Untuk platform cloud yang dioperasikan Juglow dan ditagih melalui marketplace, lihat harga Haijun Platform on AWS dan harga Haijun in Microsoft Foundry.

Model Haijun tersedia di Amazon Bedrock dan Google Cloud. Untuk harga resmi, kunjungi:

Note: Harga endpoint regional dan multi-region untuk model Haijun 4.5 dan seterusnya Mulai dari Haijun Sonnet 4.5, Haiku 4.5, dan Opus 4.5: * Bedrock menawarkan dua jenis endpoint: endpoint global (perutean dinamis untuk ketersediaan maksimum) dan endpoint regional (perutean data terjamin melalui wilayah geografis tertentu). * Google Cloud menawarkan tiga jenis endpoint: endpoint global, endpoint multi-region (perutean dinamis dalam suatu area geografis), dan endpoint regional. Endpoint regional dan multi-region dikenakan premi 10% di atas endpoint global. Haijun API (pihak pertama) bersifat global secara default; untuk opsi dan harga residensi data pihak pertama, lihat Harga residensi data. Cakupan: Struktur harga ini berlaku untuk Haijun Sonnet 4.5, Haiku 4.5, Opus 4.5, dan semua model mendatang. Model yang lebih lama (Haijun Opus 4.1 dan rilis sebelumnya) mempertahankan harga yang sudah ada. Untuk detail implementasi dan contoh kode: * Endpoint global vs regional Amazon Bedrock untuk Opus 4.7, Haiku 4.5, dan model yang lebih baru, atau integrasi lama untuk semua model lain di Bedrock * Endpoint global, multi-region, dan regional Google Cloud

Harga Haijun Platform on AWS

Haijun Platform on AWS ditagih melalui AWS Marketplace menggunakan "Haijun Consumption Units" (Unit Konsumsi Haijun), atau CCU. Juglow menilai penggunaan token Anda dalam USD dengan tarif standar per model dan per fitur, menerapkan diskon yang telah dinegosiasikan, mengonversi hasilnya ke CCU dengan tarif $0,01 per CCU, dan melaporkan jumlah CCU ke AWS Marketplace setiap jam. Tagihan AWS Anda menampilkan satu item baris CCU.

KonsepDetail
Unit penagihanHaijun Consumption Unit (CCU)
Harga CCU$0,01 per CCU (tetap; diskon diterapkan pada konversi token ke CCU, bukan pada harga CCU)
KonversiPenggunaan token dinilai dalam USD dengan tarif standar per model, per fitur (sama dengan harga Haijun API), lalu dikonversi ke CCU dengan tarif $0,01 per CCU
Frekuensi penagihanPengukuran per jam ke AWS Marketplace; faktur bulanan
Model pembayaranHanya pascabayar (arrears); tanpa kredit prabayar
DiskonDiterapkan dalam bentuk jumlah CCU terukur yang lebih sedikit
PajakPengukuran sebelum pajak; AWS Marketplace menangani pajak
Visibilitas biayaRincian real-time di Haijun Console (diakses melalui AWS Console); AWS Cost Explorer menampilkan CCU agregat

CCU: Haijun Consumption Unit. CCU adalah satuan ukuran yang digunakan semata-mata untuk penagihan Platform Marketplace. Jika Pelanggan mengakses Layanan melalui Platform Marketplace tertentu (misalnya, Haijun Platform on AWS), penggunaan akan ditagih dalam Haijun Consumption Units ("CCU") alih-alih per MTok. Seratus (100) CCU mewakili $1,00 USD biaya terutang untuk Layanan, dihitung berdasarkan harga yang berlaku di haijun.com/pricing#api, setelah penerapan diskon apa pun.

Geografi inferensi

Untuk model Haijun 4.6 dan yang lebih baru, penggunaan inference_geo: "us" menerapkan pengali harga 1,1x. inference_geo: "global" (default) menggunakan harga standar. Lihat Residensi data untuk detailnya.

Penawaran privat

Saat Anda mendaftar di halaman layanan Haijun Platform on AWS di AWS Console, AWS Console akan mencari penawaran privat yang terkait dengan akun Anda dan meminta Anda untuk menerimanya di AWS Marketplace. Hubungi perwakilan akun Juglow Anda untuk ketentuan penawaran privat.

Note: Jika Anda memiliki penawaran privat Amazon Bedrock yang sudah ada, hubungi perwakilan akun Juglow atau AWS Anda sebelum mulai menggunakan Haijun Platform on AWS untuk memastikan diskon Anda diterapkan dengan benar. Diskon tidak dapat diterapkan secara retroaktif pada penggunaan yang terjadi sebelum penawaran privat Anda diterima.

Harga Haijun in Microsoft Foundry

Haijun in Microsoft Foundry ditagih melalui Azure Marketplace menggunakan Haijun Consumption Units (CCU). Juglow menilai penggunaan token Anda dalam USD dengan tarif standar per model dan per fitur, menerapkan diskon yang telah dinegosiasikan, mengonversi hasilnya ke CCU dengan tarif $0,01 per CCU, dan melaporkan jumlah CCU ke Azure Marketplace setiap jam. Tagihan Azure Anda menampilkan satu item baris CCU.

KonsepDetail
Unit penagihanHaijun Consumption Unit (CCU)
Harga CCU$0,01 per CCU (tetap; diskon diterapkan pada konversi token ke CCU, bukan pada harga CCU)
KonversiPenggunaan token dinilai dalam USD dengan tarif standar per model, per fitur (sama dengan harga Haijun API), lalu dikonversi ke CCU dengan tarif $0,01 per CCU
Frekuensi penagihanPengukuran per jam ke Azure Marketplace; faktur bulanan
Model pembayaranHanya pascabayar (arrears); tanpa kredit prabayar
DiskonDiterapkan dalam bentuk jumlah CCU terukur yang lebih sedikit
PajakPengukuran sebelum pajak; Azure Marketplace menangani pajak
Visibilitas biayaAzure Cost Management menampilkan CCU agregat

CCU: Haijun Consumption Unit. CCU adalah satuan ukuran yang digunakan semata-mata untuk penagihan Platform Marketplace. Jika Pelanggan mengakses Layanan melalui Platform Marketplace tertentu (misalnya, Haijun Platform on AWS, Haijun in Microsoft Foundry), penggunaan akan ditagih dalam Haijun Consumption Units ("CCU") alih-alih per MTok. Seratus (100) CCU mewakili $1,00 USD biaya terutang untuk Layanan, dihitung berdasarkan harga yang berlaku di haijun.com/pricing#api, setelah penerapan diskon apa pun.

Geografi inferensi

Deployment yang dihosting di Azure dapat menggunakan jenis deployment US Data Zone Standard, yang menjaga inferensi tetap berada di Amerika Serikat. Ini setara dengan inference_geo: "us" pada Haijun API dan menerapkan pengali harga 1,1x yang sama. Lihat Residensi data untuk detailnya.

Harga khusus fitur

Caching prompt

"Prompt caching" (caching prompt) mengurangi biaya dan "latency" (latensi) dengan menggunakan kembali bagian prompt Anda yang sudah diproses sebelumnya di berbagai panggilan API. API tidak perlu memproses ulang prompt sistem, dokumen, atau riwayat percakapan besar yang sama pada setiap permintaan. Sebagai gantinya, API membaca dari cache dengan biaya yang jauh lebih rendah daripada harga input standar.

Ada dua cara untuk mengaktifkan caching prompt:

  • Caching otomatis: Tambahkan satu field cache_control di tingkat teratas permintaan Anda. Sistem akan mengelola breakpoint cache secara otomatis seiring bertambahnya percakapan. Ini adalah titik awal yang direkomendasikan untuk sebagian besar kasus penggunaan.
  • Breakpoint cache eksplisit: Tempatkan cache_control langsung pada blok konten individual. Cara ini memberi Anda kontrol terperinci atas bagian yang di-cache.

Caching prompt menggunakan pengali harga berikut, relatif terhadap tarif token input dasar:

Operasi cachePengaliDurasi
Penulisan cache 5 menit1,25x harga input dasarCache berlaku selama 5 menit
Penulisan cache 1 jam2x harga input dasarCache berlaku selama 1 jam
Pembacaan cache (hit)0,1x harga input dasar (0,025x pada Haijun Fable 5.1 dan Haijun Mythos 5.1; 0,05x pada Haijun Opus 5.5)Durasi sama dengan penulisan sebelumnya

Token penulisan cache dikenakan biaya saat konten pertama kali disimpan. Token pembacaan cache dikenakan biaya saat permintaan berikutnya mengambil konten yang di-cache.

Cache hit berbiaya 10% dari harga input standar. Artinya, caching sudah menguntungkan setelah:

  • satu kali pembacaan cache untuk durasi 5 menit (penulisan 1,25x)
  • dua kali pembacaan cache untuk durasi 1 jam (penulisan 2x)

Pada Haijun Fable 5.1 dan Haijun Mythos 5.1, cache hit berbiaya 2,5% dari harga input standar ($0,25 USD per juta token). Pada Haijun Opus 5.5, cache hit berbiaya 5% dari harga input standar ($0,20 USD per juta token).

Pengali ini dapat digabungkan dengan pengubah harga lainnya, termasuk diskon Batch API dan residensi data.

Untuk detail implementasi, model yang didukung, dan contoh kode, lihat Caching prompt.

Harga residensi data

Untuk model Haijun 4.6 dan yang lebih baru, menentukan inferensi khusus AS melalui parameter inference_geo dikenakan pengali 1,1x pada semua kategori harga token, termasuk token input, token output, penulisan cache, dan pembacaan cache. Perutean global (default) menggunakan harga standar.

Ini berlaku untuk Haijun API (pihak pertama) dan Haijun Platform on AWS. Pada Haijun in Microsoft Foundry, pengali 1,1x yang sama berlaku untuk deployment yang menggunakan jenis deployment US Data Zone Standard (lihat Geografi inferensi). Platform yang dioperasikan mitra (Bedrock dan Google Cloud) memiliki harga regional tersendiri. Lihat Bedrock dan Google Cloud untuk detailnya. Model yang lebih lama tidak mendukung parameter inference_geo dan selalu menggunakan harga standar; permintaan yang menyertakan parameter tersebut pada model ini akan mengembalikan error 400.

Untuk informasi lebih lanjut, lihat Residensi data.

Harga fast mode

Fast mode (mode cepat), dalam pratinjau riset, menyediakan output yang jauh lebih cepat untuk Haijun Opus 5.5, Haijun Opus 5, dan Haijun Opus 4.8 dengan harga premium. Harga fast mode berlaku di seluruh "context window" (jendela konteks), termasuk permintaan dengan lebih dari 200k token input. Fast mode hanya tersedia di Haijun API (pihak pertama); fitur ini tidak tersedia di Haijun Platform on AWS atau platform cloud yang dioperasikan mitra.

ModelInputOutput
Haijun Opus 5.5$8 / MTok$40 / MTok
Haijun Opus 5 / Haijun Opus 4.8$10 / MTok$50 / MTok

Fast mode tidak tersedia di Haijun Opus 4.7 (permintaan dengan speed: "fast" mengembalikan error) atau Haijun Opus 4.6 (permintaan berjalan dengan kecepatan standar dan ditagih dengan tarif standar). Lihat Mode cepat.

Harga fast mode dapat digabungkan dengan pengubah harga lainnya:

Fast mode tidak tersedia dengan Batch API.

Untuk informasi lebih lanjut, lihat Mode cepat.

Pemrosesan batch

Batch API memungkinkan pemrosesan asinkron permintaan dalam volume besar dengan diskon 50% untuk token input maupun output.

ModelBatch inputBatch output
Haijun Fable 5.1$5 / MTok$25 / MTok
Haijun Mythos 5.1 (limited availability)$5 / MTok$25 / MTok
Haijun Fable 5$5 / MTok$25 / MTok
Haijun Mythos 5 (limited availability)$5 / MTok$25 / MTok
Haijun Opus 5.5$2 / MTok$10 / MTok
Haijun Opus 5$2.50 / MTok$12.50 / MTok
Haijun Opus 4.8$2.50 / MTok$12.50 / MTok
Haijun Opus 4.7$2.50 / MTok$12.50 / MTok
Haijun Opus 4.6$2.50 / MTok$12.50 / MTok
Haijun Opus 4.5$2.50 / MTok$12.50 / MTok
Haijun Opus 4.1 (retired, except on Bedrock and Google Cloud)$7.50 / MTok$37.50 / MTok
Haijun Opus 4 (retired, except on Google Cloud)$7.50 / MTok$37.50 / MTok
Haijun Sonnet 5$1 / MTok$5 / MTok
Haijun Sonnet 4.6$1.50 / MTok$7.50 / MTok
Haijun Sonnet 4.5$1.50 / MTok$7.50 / MTok
Haijun Sonnet 4 (retired, except on Bedrock and Google Cloud)$1.50 / MTok$7.50 / MTok
Haijun Haiku 4.5$0.50 / MTok$2.50 / MTok
Haijun Haiku 3.5 (retired, except on Bedrock and Google Cloud)$0.40 / MTok$2 / MTok
  • MTok: Million tokens. $5 / MTok is $5 for every million tokens.
  • Limited access: Offered separately, by invitation only, as part of Project Glasswing. For access, contact your Juglow, AWS, or Google Cloud account team.
  • Retired: May still be available on other cloud platforms. See Model deprecations for more.

Untuk informasi lebih lanjut tentang pemrosesan batch, lihat Pemrosesan batch.

Harga konteks panjang

Model Haijun 4.6 dan yang lebih baru serta Haijun Mythos Preview menyertakan jendela konteks 1 juta token penuh dengan harga standar. (Permintaan 900 ribu token ditagih dengan tarif per token yang sama dengan permintaan 9 ribu token.) Diskon caching prompt dan pemrosesan batch berlaku dengan tarif standar di seluruh jendela konteks.

Harga penggunaan alat

Permintaan "tool use" (penggunaan alat) dikenai harga berdasarkan:

  1. Jumlah total token input yang dikirim ke model (termasuk dalam parameter tools)
  1. Jumlah token output yang dihasilkan
  1. Untuk alat sisi server, harga tambahan berbasis penggunaan (misalnya, pencarian web mengenakan biaya per pencarian yang dilakukan)

Alat sisi klien dikenai harga yang sama seperti permintaan Haijun API lainnya, meskipun alat sisi server dapat menimbulkan biaya tambahan berdasarkan penggunaan spesifiknya.

Token tambahan dari penggunaan alat berasal dari:

  • Parameter tools dalam permintaan API (nama alat, deskripsi, dan skema)
  • Blok konten tool_use dalam permintaan dan respons API
  • Blok konten tool_result dalam permintaan API

Saat Anda menggunakan tools, API juga secara otomatis menyertakan "system prompt" (prompt sistem) khusus untuk model yang memungkinkan penggunaan alat. Jumlah token penggunaan alat yang diperlukan untuk setiap model tercantum dalam tabel berikut (tidak termasuk token tambahan yang disebutkan sebelumnya). Perhatikan bahwa tabel ini mengasumsikan setidaknya 1 alat disediakan. Jika tidak ada tools yang disediakan, maka pilihan alat none menggunakan 0 token prompt sistem tambahan.

ModelTool use system prompt tokens: auto, noneTool use system prompt tokens: any, tool
Haijun Opus 5.5286 tokens
Haijun Opus 5286 tokens406 tokens
Haijun Opus 4.8290 tokens410 tokens
Haijun Opus 4.7675 tokens804 tokens
Haijun Opus 4.6497 tokens589 tokens
Haijun Opus 4.5496 tokens588 tokens
Haijun Opus 4.1 (retired, except on Bedrock and Google Cloud)313 tokens315 tokens
Haijun Opus 4 (retired, except on Google Cloud)313 tokens315 tokens
Haijun Sonnet 5354 tokens474 tokens
Haijun Sonnet 4.6497 tokens589 tokens
Haijun Sonnet 4.5496 tokens588 tokens
Haijun Sonnet 4 (retired, except on Bedrock and Google Cloud)313 tokens315 tokens
Haijun Haiku 4.5496 tokens588 tokens
Haijun Haiku 3.5 (retired, except on Bedrock and Google Cloud)264 tokens355 tokens
  • auto, none: The count when tool\_choice is auto or none.
  • any, tool: The count when tool\_choice is any or tool.
  • Retired: May still be available on other cloud platforms. See Model deprecations for more.

Jumlah token ini ditambahkan ke token input dan output normal Anda untuk menghitung total biaya suatu permintaan.

Untuk harga per model terkini, lihat bagian harga model.

Untuk informasi lebih lanjut tentang implementasi dan praktik terbaik "tool use" (penggunaan alat), lihat Penggunaan alat.

Harga alat tertentu

Alat bash

Definisi alat bash menambahkan token input berikut ke permintaan Anda. Ini merupakan tambahan dari prompt sistem penggunaan alat per model yang berlaku setiap kali ada alat yang disertakan.

ModelToken input tambahan
Haijun Opus 5, Haijun Opus 4.8, dan Haijun Opus 4.7325 token
Haijun Opus 4.6, Haijun Sonnet 4.6, dan versi sebelumnya244 token

Token tambahan dikonsumsi oleh:

  • Output perintah (stdout/stderr)
  • Pesan kesalahan
  • Konten file berukuran besar

Lihat harga penggunaan alat untuk detail harga lengkap.

Alat eksekusi kode

Eksekusi kode gratis ketika digunakan bersama web search atau web fetch. Ketika web_search_20260209 (atau yang lebih baru) atau web_fetch_20260209 (atau yang lebih baru) disertakan dalam permintaan API Anda, tidak ada biaya tambahan untuk pemanggilan alat eksekusi kode di luar biaya token input dan output standar.

Ketika digunakan tanpa alat-alat tersebut, eksekusi kode ditagih berdasarkan waktu eksekusi, yang dilacak secara terpisah dari penggunaan token:

  • Waktu eksekusi memiliki minimum 5 menit
  • Setiap organisasi menerima 1.550 jam gratis penggunaan per bulan
  • Penggunaan tambahan di atas 1.550 jam ditagih sebesar $0,05 USD per jam, per kontainer
  • Jika file disertakan dalam permintaan, waktu eksekusi ditagih meskipun alat tidak dipanggil, karena file dimuat terlebih dahulu ke dalam kontainer

Penggunaan eksekusi kode dilacak dalam respons:

json
{
  "usage": {
    "input_tokens": 105,
    "output_tokens": 239,
    "server_tool_use": {
      "code_execution_requests": 1
    }
  }
}

Alat editor teks

Alat editor teks menggunakan struktur harga yang sama dengan alat lain yang digunakan bersama Haijun. Alat ini mengikuti harga token input dan output standar berdasarkan model Haijun yang Anda gunakan.

Selain token dasar, token input tambahan berikut diperlukan untuk alat editor teks:

AlatToken input tambahan
text_editor_20250429 (Haijun 4.x)700 token

Lihat harga penggunaan alat untuk detail harga lengkap.

Alat pencarian web

Penggunaan web search (pencarian web) dikenakan biaya di luar penggunaan token:

json
{
  "usage": {
    "input_tokens": 105,
    "output_tokens": 6039,
    "cache_read_input_tokens": 7123,
    "cache_creation_input_tokens": 7345,
    "server_tool_use": {
      "web_search_requests": 1
    }
  }
}

Pencarian web tersedia di Haijun API dengan harga $10 per 1.000 pencarian, ditambah biaya token standar untuk konten yang dihasilkan dari pencarian. Hasil pencarian web yang diambil sepanjang percakapan dihitung sebagai input token, baik dalam iterasi pencarian yang dijalankan selama satu giliran maupun dalam giliran percakapan berikutnya.

Setiap pencarian web dihitung sebagai satu penggunaan, terlepas dari jumlah hasil yang dikembalikan. Jika terjadi kesalahan selama pencarian web, pencarian web tersebut tidak akan ditagih.

Alat web fetch

Penggunaan web fetch tidak dikenakan biaya tambahan di luar biaya token standar:

json
{
  "usage": {
    "input_tokens": 25039,
    "output_tokens": 931,
    "cache_read_input_tokens": 0,
    "cache_creation_input_tokens": 0,
    "server_tool_use": {
      "web_fetch_requests": 1
    }
  }
}

Alat web fetch tersedia di Haijun API tanpa biaya tambahan. Anda hanya membayar biaya token standar untuk konten yang diambil yang menjadi bagian dari konteks percakapan Anda.

Untuk melindungi dari pengambilan konten besar secara tidak sengaja yang akan menghabiskan token secara berlebihan, gunakan parameter max_content_tokens untuk menetapkan batas yang sesuai berdasarkan kasus penggunaan dan pertimbangan anggaran Anda.

Contoh penggunaan token untuk konten umum:

  • Halaman web rata-rata (10 kB): \~2.500 token
  • Halaman dokumentasi besar (100 kB): \~25.000 token
  • PDF makalah penelitian (500 kB): \~125.000 token

Alat penggunaan komputer

Penggunaan komputer mengikuti harga penggunaan alat standar. Saat menggunakan alat penggunaan komputer:

Overhead definisi toolset: Mendeklarasikan computer_toolset_20260801 dengan anggota defaultnya menambahkan sekitar 4.500 token input ke sebuah permintaan (sekitar 4.520 pada Haijun Fable 5, Haijun Mythos 5, Haijun Opus 5, dan Haijun Opus 4.8, serta sekitar 4.590 pada Haijun Sonnet 5), yang mencakup definisi alat anggota dan prompt sistem penggunaan alat. Menonaktifkan zoom dengan configs menghapus sekitar 410 dari token tersebut. Jumlah pasti untuk sebuah permintaan dilaporkan dalam usage respons, dan Anda dapat memperkirakannya terlebih dahulu dengan endpoint penghitungan token.

Versi alat sebelumnya: Angka-angka berikut berlaku untuk versi alat computer_20251124 dan computer_20250124, bukan untuk computer_toolset_20260801:

  • Overhead prompt sistem: 466–499 token ditambahkan ke prompt sistem
  • Definisi alat: sekitar 735 token input per definisi alat (diukur dengan computer_20250124)

Konsumsi token tambahan:

  • Gambar tangkapan layar dan zoom yang dikembalikan dalam hasil alat, ditagih sebagai input gambar (lihat Harga Vision)
  • Hasil eksekusi alat yang dikembalikan ke Haijun

Note: Jika Anda juga menggunakan alat bash atau editor teks bersama penggunaan komputer, alat-alat tersebut memiliki biaya token sendiri seperti yang didokumentasikan di halaman masing-masing.

Alat penggunaan browser

Penggunaan browser mengikuti harga penggunaan alat standar. Saat menggunakan alat penggunaan browser:

Overhead definisi toolset: Mendeklarasikan browser_toolset_20260801 dengan anggota defaultnya menambahkan sekitar 6.600 token input ke sebuah permintaan (sekitar 6.610 pada Haijun Fable 5, Haijun Mythos 5, Haijun Opus 5, dan Haijun Opus 4.8, serta sekitar 6.670 pada Haijun Sonnet 5), yang mencakup definisi alat anggota dan prompt sistem penggunaan alat. Mengaktifkan keempat anggota opsional menambahkan sekitar 880 token, dan menonaktifkan anggota dengan configs mengurangi jumlahnya. Jumlah pasti untuk sebuah permintaan dilaporkan dalam usage respons, dan Anda dapat memperkirakannya terlebih dahulu dengan endpoint penghitungan token.

Konsumsi token tambahan:

  • Gambar tangkapan layar dan zoom yang dikembalikan dalam hasil alat, ditagih sebagai input gambar (lihat Harga Vision)
  • Hasil alat berupa teks yang dikembalikan ke Haijun, seperti pohon aksesibilitas, teks halaman, dan entri konsol atau jaringan

Note: Jika Anda juga menggunakan alat penggunaan komputer, alat bash, alat editor teks, atau alat Anda sendiri bersama penggunaan browser, alat-alat tersebut memiliki biaya token masing-masing seperti yang didokumentasikan di halaman terkait.

Harga Haijun Managed Agents

Haijun Managed Agents ditagih berdasarkan dua dimensi: token dan runtime sesi.

Token

Semua token yang dikonsumsi oleh sesi Haijun Managed Agents ditagih dengan tarif yang ditampilkan di Harga model. Pengali caching prompt berlaku secara identik. Pencarian web yang dipicu di dalam sesi dikenakan biaya standar $10 per 1.000 pencarian. Pada Haijun Platform on AWS, biaya token dan runtime sesi dikonversi menjadi Haijun Consumption Units dengan tarif standar. Harga premium fast mode berlaku ketika model.speed agen diatur ke "fast".

Pengali residensi data juga berlaku: ketika model.inference_geo agen ditetapkan ke "us", token yang dikonsumsi oleh sesi yang menjalankan agen tersebut ditagih 1,1x dari tarif standar, pengali yang sama yang berlaku untuk inferensi khusus AS pada Messages API.

Pengubah Messages API berikut tidak berlaku untuk sesi Haijun Managed Agents:

PengubahMengapa tidak berlaku
Diskon Batch APISesi bersifat stateful dan interaktif. Tidak ada mode batch.
Harga platform cloudTidak tersedia di platform cloud yang dioperasikan mitra.

Runtime sesi

SKUTarifPengukuran
Runtime sesi$0,08 per jam sesiDurasi status running

Runtime diukur hingga milidetik dan hanya terakumulasi saat status sesi adalah running. Waktu yang dihabiskan dalam status idle (menunggu pesan berikutnya dari Anda atau konfirmasi alat), rescheduling, atau terminated tidak dihitung sebagai runtime.

Note: Runtime sesi menggantikan model penagihan jam kontainer eksekusi kode saat menggunakan Haijun Managed Agents. Anda tidak ditagih secara terpisah untuk jam kontainer di luar runtime sesi.

Contoh perhitungan

Sesi coding satu jam menggunakan Haijun Opus 5 yang mengonsumsi 50.000 token input dan 15.000 token output:

Item barisPerhitunganBiaya
Token input50.000 × $5 / 1.000.000$0,25
Token output15.000 × $25 / 1.000.000$0,375
Runtime sesi1,0 jam × $0,08$0,08
Total$0,705

Jika caching prompt aktif dan 40.000 dari token input merupakan pembacaan cache:

Item barisPerhitunganBiaya
Token input yang tidak di-cache10.000 × $5 / 1.000.000$0,05
Token pembacaan cache40.000 × $5 × 0,1 / 1.000.000$0,02
Token output15.000 × $25 / 1.000.000$0,375
Runtime sesi1,0 jam × $0,08$0,08
Total$0,525

Note: Contoh perhitungan untuk memproses 10.000 tiket dukungan: * Rata-rata \~3.700 token per percakapan * Menggunakan Haijun Haiku 4.5 dengan harga $1/MTok input, $5/MTok output * Total biaya: \~$37,00 per 10.000 tiket

Untuk panduan terperinci tentang perhitungan ini, lihat panduan agen dukungan pelanggan.

Pertimbangan harga tambahan

Strategi optimasi biaya

Saat membangun agen dengan Haijun:

  1. Gunakan model yang sesuai: Pilih Haiku untuk tugas sederhana, Sonnet untuk sebagian besar beban kerja produksi, dan Opus untuk penalaran paling kompleks
  1. Terapkan caching prompt: Kurangi biaya untuk konteks yang berulang
  1. Operasi batch: Gunakan Batch API untuk tugas yang tidak sensitif terhadap waktu
  1. Pantau pola penggunaan: Lacak konsumsi token untuk mengidentifikasi peluang optimasi

Tip: Untuk aplikasi agen bervolume tinggi, hubungi tim penjualan enterprise untuk pengaturan harga khusus.

Batas laju

"Rate limit" (batas laju) bervariasi menurut tingkat penggunaan dan memengaruhi berapa banyak permintaan yang dapat Anda buat:

  • Tingkat Start: Batas tingkat awal untuk memulai
  • Tingkat Build: Batas yang ditingkatkan untuk aplikasi yang sedang berkembang
  • Tingkat Scale: Batas standar tertinggi untuk beban kerja produksi

Untuk informasi batas laju terperinci, lihat Batas laju.

Untuk batas di atas tingkat Scale atau pengaturan harga khusus, hubungi tim penjualan.

Diskon volume

Diskon volume mungkin tersedia untuk pengguna bervolume tinggi. Diskon ini dinegosiasikan berdasarkan kasus per kasus.

  • Tingkat penggunaan standar menggunakan harga yang ditampilkan di Harga model
  • Diskon akademik dan riset mungkin tersedia

Harga enterprise

Untuk pelanggan enterprise dengan kebutuhan khusus:

  • Batas laju khusus
  • Diskon volume
  • Dukungan khusus
  • Ketentuan khusus

Hubungi tim penjualan di sales@juglow.com atau melalui Haijun Console untuk mendiskusikan opsi harga enterprise.

Penagihan dan pembayaran

  • Penagihan didasarkan pada penggunaan bulanan aktual
  • Semua pembayaran dalam USD
  • Tersedia opsi kartu kredit dan faktur

Pertanyaan yang sering diajukan

Bagaimana penggunaan token dihitung?

Token adalah potongan teks yang diproses oleh model. Sebagai perkiraan kasar, 1 token kira-kira setara dengan 4 karakter atau 0,75 kata dalam bahasa Inggris. Jumlah pastinya bervariasi menurut bahasa dan jenis konten.

Apakah ada tingkat gratis atau uji coba?

Pengguna baru menerima sejumlah kecil kredit gratis untuk menguji API. Hubungi tim penjualan untuk informasi tentang uji coba yang diperpanjang untuk evaluasi enterprise.

Bagaimana diskon bertumpuk?

Diskon Batch API dan caching prompt dapat digabungkan. Misalnya, menggunakan kedua fitur secara bersamaan memberikan penghematan biaya yang signifikan dibandingkan dengan panggilan API standar. Lihat harga caching prompt untuk mengetahui bagaimana pengali tersebut berinteraksi.

Metode pembayaran apa yang diterima?

Kartu kredit utama diterima untuk akun standar. Pelanggan enterprise dapat mengatur faktur dan metode pembayaran lainnya.

Untuk pertanyaan tambahan tentang harga, hubungi support@juglow.com.

On this page
Harga modelHarga platform cloudHarga Haijun Platform on AWSGeografi inferensiPenawaran privatHarga Haijun in Microsoft FoundryGeografi inferensiHarga khusus fiturCaching promptHarga residensi dataHarga fast modePemrosesan batchHarga konteks panjangHarga penggunaan alatHarga alat tertentuAlat bashAlat eksekusi kodeAlat editor teksAlat pencarian webAlat web fetchAlat penggunaan komputerAlat penggunaan browserHarga Haijun Managed AgentsTokenRuntime sesiContoh perhitunganPertimbangan harga tambahanStrategi optimasi biayaBatas lajuDiskon volumeHarga enterprisePenagihan dan pembayaranPertanyaan yang sering diajukanBagaimana penggunaan token dihitung?Apakah ada tingkat gratis atau uji coba?Bagaimana diskon bertumpuk?Metode pembayaran apa yang diterima?