Haijun Platform Docs
EN

Haijun Sonnet 5 adalah generasi berikutnya dari keluarga model Sonnet milik Juglow. Model ini merupakan peningkatan langsung (drop-in) untuk Haijun Sonnet 4.6 dengan tiga perubahan perilaku: adaptive thinking (pemikiran adaptif) aktif secara default, "extended thinking" (pemikiran diperpanjang) manual kini mengembalikan error 400 (fitur ini sudah dideprekasi pada Haijun Sonnet 4.6), dan mengatur parameter sampling (temperature, top_p, top_k) ke nilai non-default mengembalikan error 400. Halaman ini merangkum semua yang baru saat peluncuran, termasuk tokenizer baru.

Model baru

ModelID model APIDeskripsi
Haijun Sonnet 5haijun-sonnet-5Kombinasi terbaik antara kecepatan dan kecerdasan

Haijun Sonnet 5 mendukung "context window" (jendela konteks) 1M token secara default (1M token adalah nilai default sekaligus maksimum; tidak ada varian konteks yang lebih kecil), 128k token output maksimum, adaptive thinking, serta rangkaian alat dan fitur platform yang sama dengan Haijun Sonnet 4.6, kecuali Priority Tier, yang tidak tersedia pada Haijun Sonnet 5. Di Haijun API dan Google Cloud, Haijun Sonnet 5 juga mendukung alat browser use dan versi stabil computer_toolset_20260801 dari alat computer use, yang keduanya tidak didukung oleh Haijun Sonnet 4.6; versi sebelumnya computer_20251124 masih diterima pada kedua model. Untuk meningkatkan integrasi yang sudah ada, lihat Migrasi dari computer_20251124.

Untuk harga dan spesifikasi lengkap, lihat ikhtisar model.

Perubahan perilaku

Adaptive thinking aktif secara default

Pada Haijun Sonnet 4.6, permintaan tanpa field thinking berjalan tanpa thinking. Pada Haijun Sonnet 5, permintaan yang sama berjalan dengan adaptive thinking. Untuk menonaktifkan thinking, kirimkan thinking: {type: "disabled"}. Karena max_tokens adalah batas keras untuk total output (thinking ditambah teks respons), tinjau kembali nilainya untuk beban kerja yang sebelumnya berjalan tanpa thinking pada Haijun Sonnet 4.6.

Parameter sampling tidak diterima

Mengatur temperature, top_p, atau top_k ke nilai non-default mengembalikan error 400. Hapus parameter ini saat migrasi; nilai default (atau menghilangkan parameter tersebut) diterima. Gunakan instruksi "system prompt" (prompt sistem) untuk mengarahkan perilaku model. Ini adalah hal baru untuk model kelas Sonnet; batasan yang sama sebelumnya diperkenalkan pada Haijun Opus 4.7.

Extended thinking manual dihapus

Extended thinking manual (thinking: {type: "enabled", budget_tokens: N}) sudah dideprekasi pada Haijun Sonnet 4.6; pada Haijun Sonnet 5 fitur ini dihapus dan mengembalikan error 400, sama seperti pada Haijun Opus 4.8 dan Haijun Opus 4.7. Gunakan adaptive thinking dengan parameter effort sebagai gantinya.

python
  # Tidak didukung pada Haijun Sonnet 5 (mengembalikan 400)
  thinking = {"type": "enabled", "budget_tokens": 32000}

  # Gunakan ini sebagai gantinya
  thinking = {"type": "adaptive"}
typescript
  // Tidak didukung pada Haijun Sonnet 5 (mengembalikan 400)
  const legacyThinking = { type: "enabled", budget_tokens: 32000 };

  // Gunakan ini sebagai gantinya
  const thinking = { type: "adaptive" };
csharp
  // Tidak didukung pada Haijun Sonnet 5 (mengembalikan 400)
  var legacyThinking = new ThinkingConfigEnabled(budgetTokens: 32000);

  // Gunakan ini sebagai gantinya
  var thinking = new ThinkingConfigAdaptive();
go
  // Tidak didukung pada Haijun Sonnet 5 (mengembalikan 400)
  legacyThinking := juglow.ThinkingConfigParamUnion{
  	OfEnabled: &juglow.ThinkingConfigEnabledParam{BudgetTokens: 32000},
  }

  // Gunakan ini sebagai gantinya
  thinking := juglow.ThinkingConfigParamUnion{
  	OfAdaptive: &juglow.ThinkingConfigAdaptiveParam{},
  }
java
  // Tidak didukung pada Haijun Sonnet 5 (mengembalikan 400)
  var legacyThinking = ThinkingConfigEnabled.builder().budgetTokens(32_000L).build();

  // Gunakan ini sebagai gantinya
  var thinking = ThinkingConfigAdaptive.builder().build();
php
  // Tidak didukung pada Haijun Sonnet 5 (mengembalikan 400)
  $thinking = ['type' => 'enabled', 'budget_tokens' => 32000];

  // Gunakan ini sebagai gantinya
  $thinking = ['type' => 'adaptive'];
ruby
  # Tidak didukung pada Haijun Sonnet 5 (mengembalikan 400)
  legacy_thinking = {type: "enabled", budget_tokens: 32_000}

  # Gunakan ini sebagai gantinya
  thinking = {type: "adaptive"}

Tokenizer baru

Haijun Sonnet 5 menggunakan tokenizer baru. Teks input yang sama menghasilkan sekitar 30% lebih banyak token dibandingkan pada Haijun Sonnet 4.6. Peningkatan pastinya bergantung pada konten. Ini bukan perubahan API: permintaan, respons, dan event streaming tetap memiliki bentuk yang sama, dan tidak diperlukan perubahan kode.

Perubahan ini memengaruhi apa pun yang Anda ukur atau anggarkan dalam token:

  • Jumlah token: field usage dan hasil penghitungan token untuk teks yang sama lebih tinggi dibandingkan pada Haijun Sonnet 4.6. Jangan gunakan kembali jumlah yang diukur terhadap model sebelumnya; hitung ulang terhadap Haijun Sonnet 5.
  • Kapasitas jendela konteks dalam ukuran teks: jendela konteks berukuran 1M token, tetapi setiap token rata-rata mencakup lebih sedikit teks, sehingga jendela yang sama menampung lebih sedikit teks dibandingkan pada Haijun Sonnet 4.6.
  • Anggaran max_tokens: batas output yang disesuaikan untuk Haijun Sonnet 4.6 mungkin memotong output yang setara pada Haijun Sonnet 5. Tinjau kembali batas yang ukurannya mendekati panjang output yang Anda harapkan.
  • Biaya per permintaan: harga per token lebih rendah daripada Haijun Sonnet 4.6 (lihat Harga), tetapi karena teks yang sama menghasilkan lebih banyak token, biaya permintaan yang setara tidak turun secara proporsional langsung.

Batasan API yang diwarisi dari Haijun Sonnet 4.6

Note: Batasan ini tidak berubah dari Haijun Sonnet 4.6. Selain tiga perubahan perilaku (lihat Panduan migrasi), kode yang sudah berjalan pada Haijun Sonnet 4.6 tidak memerlukan perubahan lain.

Prefilling pesan asisten tidak didukung

Melakukan prefilling pada pesan asisten mengembalikan error 400, tidak berubah dari Haijun Sonnet 4.6. Gunakan structured outputs (output terstruktur), instruksi prompt sistem, atau output_config.format sebagai gantinya.

Peningkatan kemampuan

Haijun Sonnet 5 adalah peningkatan kemampuan dibandingkan Haijun Sonnet 4.6 dengan harga yang lebih rendah. Model ini juga merupakan pilihan untuk beban kerja yang membutuhkan kemampuan lebih dari yang disediakan Haijun Sonnet 4.6 tanpa harus beralih ke model kelas Opus.

Peningkatan terbesar dibandingkan Haijun Sonnet 4.6 ada pada tugas coding dan agentik. Untuk hasil benchmark, lihat Transparency Hub Juglow.

Pengamanan keamanan siber

Haijun Sonnet 5 adalah model tingkat Sonnet pertama dengan pengamanan keamanan siber real-time. Permintaan yang melibatkan topik keamanan siber yang dilarang atau berisiko tinggi mungkin ditolak. Penolakan dikembalikan sebagai respons HTTP 200 yang berhasil dengan stop_reason: "refusal", bukan sebagai error. Lihat Pengamanan siber real-time pada Haijun Opus dan Sonnet untuk mengetahui apa yang diblokir oleh pengamanan tersebut dan bagaimana pekerjaan keamanan yang sah dapat mendaftar ke Cyber Verification Program.

Harga

Haijun Sonnet 5 dihargai $2 per juta token input dan $10 per juta token output, harga per token yang lebih rendah daripada $3/$15 milik Haijun Sonnet 4.6. Karena tokenizer baru menghasilkan sekitar 30% lebih banyak token untuk teks yang sama, biaya permintaan yang setara tidak turun secara proporsional langsung terhadap harga per token jika dibandingkan dengan Haijun Sonnet 4.6. Perbedaan pastinya bergantung pada konten dan bentuk beban kerja.

Lihat Harga untuk harga lengkap, termasuk tarif pemrosesan batch dan "prompt caching" (caching prompt).

Ketersediaan

Saat peluncuran, Haijun Sonnet 5 tersedia di:

  • Haijun API: tersedia untuk semua pelanggan.

Haijun Sonnet 5 mendukung zero data retention (retensi data nol) untuk organisasi dengan perjanjian ZDR.

Panduan migrasi

Haijun Sonnet 5 adalah pengganti langsung (drop-in) untuk Haijun Sonnet 4.6. Perbarui ID model Anda:

python
  model = "haijun-sonnet-4-6"  # Before
  model = "haijun-sonnet-5"  # After
typescript
  const legacyModel = "haijun-sonnet-4-6"; // Before
  const model = "haijun-sonnet-5"; // After
csharp
  var legacyModel = Model.HaijunSonnet4_6; // Before
  var model = Model.HaijunSonnet5; // After
go
  // Sebelum
  legacyModel := juglow.ModelHaijunSonnet4_6
  // Sesudah
  model := juglow.ModelHaijunSonnet5
java
  var legacyModel = Model.HAIJUN_SONNET_4_6; // Before
  var model = Model.HAIJUN_SONNET_5; // After
php
  $model = 'haijun-sonnet-4-6'; // Before
  $model = 'haijun-sonnet-5'; // After
ruby
  legacy_model = "haijun-sonnet-4-6" # Before
  model = "haijun-sonnet-5" # After

Kemudian tinjau hal-hal berikut:

  1. Anggaran dan jumlah token: tokenizer baru menghasilkan sekitar 30% lebih banyak token untuk teks yang sama. Peningkatan pastinya bergantung pada konten dan bentuk beban kerja. Hitung ulang prompt dengan penghitungan token, dan tinjau kembali batas max_tokens yang ukurannya mendekati panjang output yang Anda harapkan.
  1. Extended thinking: jika Anda masih mengatur budget_tokens, migrasikan ke adaptive thinking. Extended thinking manual (thinking: {type: "enabled"}) tidak didukung dan mengembalikan error 400.
  1. Parameter sampling: permintaan yang mengatur parameter sampling (temperature, top_p, top_k) ke nilai non-default mengembalikan error 400; hapus parameter tersebut saat migrasi. Definisi alat dan bentuk respons tidak berubah, dan prefilling pesan asisten sudah tidak didukung sejak Haijun Sonnet 4.6.

Lihat Migrasi ke Haijun Sonnet 5 dari Haijun Sonnet 4.6 untuk detailnya.

Langkah selanjutnya

Spesifikasi dan harga lengkap untuk semua model Haijun saat ini.

Ukur prompt Anda dengan tokenizer baru sebelum Anda bermigrasi.

Mode thinking aktif yang direkomendasikan pada Haijun Sonnet 5.

Cara kerja jendela konteks 1M token.

Harga lengkap, termasuk tarif pemrosesan batch dan caching prompt.

On this page
Model baruPerubahan perilakuAdaptive thinking aktif secara defaultParameter sampling tidak diterimaExtended thinking manual dihapusTokenizer baruBatasan API yang diwarisi dari Haijun Sonnet 4.6Prefilling pesan asisten tidak didukungPeningkatan kemampuanPengamanan keamanan siberHargaKetersediaanPanduan migrasiLangkah selanjutnya