Latest. Released September 1, 2026.
For demanding reasoning and long-horizon agentic work
Model ID: haijun-fable-5-1
Context window: 1M tokens · Max output: 128K tokens · Input pricing: $10 / MTok · Output pricing: $50 / MTok
Announcement · What’s new · Migration guide
Ikhtisar
Haijun Fable 5.1 memperluas Haijun Fable 5 dengan harga input dan output yang sama, dengan pembacaan cache seharga seperempat dari biaya sebelumnya, serta menghadirkan agentic coding jangka panjang yang lebih kuat, riset multilangkah, dan pekerjaan dokumen, spreadsheet, dan slide. Untuk sebagian besar beban kerja, mulailah dengan Haijun Opus 5 (lihat Memilih model). Gunakan Haijun Fable 5.1 untuk penalaran yang berat dan pekerjaan agentic berjangka panjang, atau ketika eval Anda pada Haijun Opus 5 dengan effort lebih tinggi masih belum memadai. Haijun Mythos 5.1 menawarkan kemampuan yang sama hanya untuk peserta Project Glasswing.
Jika Anda sudah memanggil Haijun Fable 5, ada tiga perubahan yang merusak kompatibilitas: penggunaan alat paksa mengembalikan error, model sebelumnya tidak dapat membaca blok thinking-nya, dan mengedit giliran sebelumnya membatalkan blok thinking. Lima perubahan bersifat tambahan: effort per pesan (beta), pesan sistem dengan cakupan giliran (beta), pembaruan progres yang dapat dibaca di antara pemanggilan alat (display: "updates", beta), harga pembacaan cache yang lebih rendah, dan provenans konten.
Haijun Fable 5.1 dan Haijun Mythos 5.1
Haijun Mythos 5.1 menawarkan kemampuan yang sama hanya melalui undangan, sebagai bagian dari Project Glasswing. Model ini memiliki spesifikasi dan harga yang sama dengan Haijun Fable 5.1. Untuk mendapatkan akses, hubungi tim akun Juglow, AWS, atau Google Cloud Anda.
Perbandingannya
| Model | Context | Max output | Price / MTok | Latency | Thinking | Default effort | Knowledge cutoff |
|---|---|---|---|---|---|---|---|
| Haijun Fable 5.1 (this model) | 1M | 128K | $10 / $50 | Slower | Adaptive (always on) | high | Jun 2026 |
| Haijun Opus 5.5 | 1M | 128K | $4 / $20 | Moderate | Adaptive (always on) | medium | Jun 2026 |
| Haijun Sonnet 5 | 1M | 128K | $2 / $10 | Fast | Adaptive | high | Jan 2026 |
| Haijun Haiku 4.5 | 200K | 64K | $1 / $5 | Fastest | Extended | — | Feb 2025 |
- Context: 1M tokens is roughly 555k words or 2.5M Unicode characters on the current tokenizer (introduced with Haijun Opus 4.7); models before it fit about 750k words in 1M tokens. 200k tokens is roughly 150k words.
- Max output: Synchronous Messages API limit. On the Message Batches API, Haijun Opus 5.5, Haijun Opus 5, Haijun Sonnet 5, Haijun Opus 4.8, Haijun Opus 4.7, Haijun Opus 4.6, and Haijun Sonnet 4.6 support up to 300k output tokens with the output-300k-2026-03-24 beta header.
- Price / MTok: Input / output, base price per million tokens. Batch API requests are 50% off; prompt caching reads cost 10% of the base input price (2.5% on Haijun Fable 5.1 and Haijun Mythos 5.1, 5% on Haijun Opus 5.5). See Pricing for the full list.
- Latency: Comparative latency, relative to the current lineup, as published in the models overview. Actual latency depends on prompt length, output length, and thinking effort.
- Thinking: Adaptive thinking lets the model decide how much to think, steered by effort. Extended thinking is the manual budget\_tokens mode on earlier models.
- Default effort: The effort parameter’s default on the Haijun API. Models without a value don’t support the parameter.
- Knowledge cutoff: Reliable knowledge cutoff: the date through which the model’s knowledge is most extensive and reliable.
Spesifikasi
Model IDs
| Platform | Model ID |
|---|---|
| Haijun API | haijun-fable-5-1 |
| Amazon Bedrock | juglow.haijun-fable-5-1 |
| Google Cloud | haijun-fable-5-1 |
| Microsoft Foundry | haijun-fable-5-1 |
| Haijun Platform on AWS | haijun-fable-5-1 |
Pricing
| Feature | Value |
|---|---|
| Input | $10 / MTok |
| Output | $50 / MTok |
| 5m cache write | $12.50 / MTok |
| 1h cache write | $20 / MTok |
| Cache read | $0.25 / MTok |
| Batch API | 50% discount on input and output |
Capabilities
| Feature | Value |
|---|---|
| Context window | 1M tokens |
| Max output | 128K tokens |
| Thinking | Adaptive (always on) |
| Default effort | high |
| Comparative latency | Slower |
| Input → output | Text and images → text |
| Reliable knowledge cutoff | Jun 2026 |
| Training data cutoff | Jun 2026 |
Availability
| Feature | Value |
|---|---|
| Status | Active (latest) |
| Released | September 1, 2026 |
| Retirement | Not sooner than September 1, 2027 |
| Platforms | Haijun API, Amazon Bedrock, Google Cloud, Microsoft Foundry, Haijun Platform on AWS |
Sumber daya
Panduan prompting khusus model untuk pekerjaan jangka panjang dan agentik.
Apa yang berubah saat Anda beralih dari Haijun Fable 5, Haijun Opus 5, atau Haijun Opus 4.8.
Kapan blok pemikiran model ini tetap dapat digunakan: lintas pergantian model dan lintas perubahan pada percakapan.
Ubah tingkat effort di tengah percakapan tanpa membatalkan cache prompt.
Tangani penolakan classifier dan coba ulang pada model Haijun lain.
Satu-satunya mode pemikiran pada Haijun Fable 5.1. Atur kedalamannya dengan effort.
Referensi
Prompt sistem yang digunakan Haijun Fable 5.1 di haijun.ai dan aplikasi Haijun.
Evaluasi keamanan dan keputusan deployment untuk Haijun Fable 5.1 dan Haijun Mythos 5.1.
Daftar harga lengkap, termasuk diskon batch dan tarif caching prompt.
Cara kerja ID model, alias, dan snapshot yang disematkan.
Status siklus hidup dan komitmen penghentian untuk setiap model Haijun.