Analisis Menyeluruh Claude Fable 5.1: Tolok Ukur, Peningkatan, Harga, dan Kecepatan
Hasil lengkap Claude Fable 5.1 pada 7 kategori benchmark utama, dibandingkan satu per satu dengan Fable 5, Opus 5, dan GPT-5.6 Sol, serta penjelasan tentang tugas jangka panjang, panggilan alat, biaya cache, kecepatan, batasan paket, dan perubahan migrasi pada 5.1.

Claude Fable 5.1 telah resmi dirilis pada 1 September 2026. Simpulan utama: ini bukan peningkatan model reguler untuk tanya jawab umum, melainkan model unggulan berbiaya tinggi yang disiapkan untuk pemrograman jangka panjang, riset rumit, pemanggilan alat lintas aplikasi, dan Agen tanpa pengawasan. Dalam 7 kategori tolok ukur utama yang diumumkan Anthropic, Fable 5.1 semuanya mengungguli Fable 5; tetapi harga satuan API-nya masih dua kali lipat Opus 5, dan pihak resmi juga menandai latensi relatifnya sebagai "lebih lambat".
Jika tugas Anda hanya mengubah satu file, menulis paragraf pendek, atau menjawab pertanyaan umum, Anthropic tetap menyarankan memulai dari Opus 5. Fable 5.1 lebih cocok untuk tugas berantai panjang yang masih belum dapat diselesaikan secara stabil oleh model biasa bahkan dengan effort tinggi. Artikel ini menyatukan data rilis resmi, makna setiap tolok ukur, peningkatan spesifik 5.1, harga, kecepatan, serta batasan migrasi, agar tidak hanya melihat satu bagan skor "siapa yang menang".
Spesifikasi Fable 5.1 dalam Satu Tabel
| Aspek | Claude Fable 5.1 | Claude Opus 5 | Claude Sonnet 5 |
|---|---|---|---|
| Jendela konteks | 1M token | 1M token | 1M token |
| Output maksimum | 128K token | 128K token | 128K token |
| Harga input | $10 / MTok | $5 / MTok | $2 / MTok |
| Harga output | $50 / MTok | $25 / MTok | $10 / MTok |
| Latensi relatif | Lebih lambat | Sedang | Cepat |
| Thinking | Adaptive, selalu aktif | Adaptive | Adaptive |
| Effort default | High | High | High |
| Batas pengetahuan andal | Juni 2026 | Mei 2026 | Januari 2026 |
"Lebih lambat" di sini berasal dari katalog model Anthropic, yang menunjukkan tingkat latensi relatif, bukan jumlah token per detik yang tetap. Berapa lama waktu yang dibutuhkan untuk menyelesaikan suatu tugas sebenarnya juga bergantung pada effort, jumlah putaran pemanggilan alat, rasio cache hit, panjang konteks, dan berapa kali percobaan ulang setelah kegagalan.
Tabel Lengkap Tolok Ukur Utama Fable 5.1
Tabel di bawah ini langsung mengambil tabel utama dari halaman rilis Anthropic tanggal 1 September 2026. Untuk menghindari salah baca, persentase, skor mentah GDPval-AA, partial/strict OSWorld, serta hasil HLE dengan alat/tanpa alat dicantumkan secara terpisah. Setiap tolok ukur mempertahankan nama resmi bahasa Inggrisnya dan menampilkan nama bahasa Indonesia di baris berikutnya; versi bahasa lain juga akan menampilkan nama terjemahan bahasa terkait di bawah nama Inggrisnya.
| Kemampuan | Tolok ukur | Fable 5.1 | Fable 5 | Opus 5 | GPT-5.6 Sol | 5.1 vs Fable 5 |
|---|---|---|---|---|---|---|
| Riset ilmiah agen | Terminal-Bench-Science 0.1 Tolok ukur terminal riset ilmiah agen |
52.6% | 24.7% | 29.0% | 22.4% | +27.9 poin persentase |
| Pemrograman terminal agen | Terminal-Bench 4.0 Tolok ukur pemrograman terminal agen |
55.8% | 42.0% | 52.3% | 37.3% | +13.8 poin persentase |
| Pekerjaan pengetahuan profesional | GDPval-AA v2 Tolok ukur tugas profesional bernilai ekonomi nyata |
1853 | 1723 | 1824 | 1711 | +130 poin |
| Operasi komputer | OSWorld 2.0 — Partial Tolok ukur operasi komputer nyata: skor penyelesaian parsial |
77.9% | 72.9% | 75.4% | — | +5.0 poin persentase |
| Operasi komputer | OSWorld 2.0 — Strict Tolok ukur operasi komputer nyata: tingkat penyelesaian ketat |
41.7% | 36.1% | 39.6% | — | +5.6 poin persentase |
| Penalaran multidisiplin | Humanity's Last Exam — No tools Ujian Terakhir Umat Manusia: tanpa alat |
60.9% | 57.8% | 56.6% | — | +3.1 poin persentase |
| Penalaran multidisiplin | Humanity's Last Exam — With tools Ujian Terakhir Umat Manusia: dengan alat |
65.0% | 63.8% | 63.6% | — | +1.2 poin persentase |
| Alur kerja bisnis | AutomationBench Tolok ukur alur kerja otomasi bisnis lintas aplikasi |
31.4% | 17.1% | 26.9% | 19.6% | +14.3 poin persentase |
| Pemrograman agen | CursorBench 3.2.0 Tolok ukur tugas pemrograman multi-file nyata |
73.4% | 70.5% | 70.0% | 67.2% | +2.9 poin persentase |
— berarti tabel utama Anthropic ini tidak menyediakan skor terkait; itu tidak berarti model tersebut tidak dapat menyelesaikan tugas. Pada Terminal-Bench 4.0, Mythos 5.1 yang memiliki lebih sedikit batasan dan hanya tersedia untuk program tepercaya memperoleh skor 60.9%; artikel ini berfokus pada Fable 5.1 yang tersedia bagi pengguna umum dan tidak mencampurkan hasil Mythos ke dalam kolom Fable.
Apa yang Diukur Terminal-Bench-Science 0.1
Terminal-Bench-Science 0.1 mencakup 70 alur kerja riset nyata di lima bidang utama: ilmu hayati, ilmu fisika, ilmu kebumian, matematika, dan teknik. Tugasnya bukan pilihan ganda, melainkan mengharuskan Agen menyelesaikan analisis data, inferensi statistik, simulasi, optimasi, pembuktian teorema, rekonstruksi citra, atau pembelajaran mesin ilmiah di dalam terminal, lalu memeriksa hasilnya dengan pengujian yang dapat direproduksi.
Skor 52.6% milik Fable 5.1 dibandingkan 24.7% milik Fable 5 dalam eksperimen reproduksi resmi merupakan peningkatan 27.9 poin persentase, lompatan paling mencolok di seluruh tabel. Namun, pihak resmi juga menandai galat baku sekitar ±3.5–4.5 poin persentase untuk setiap model, jadi angka satu desimal tidak boleh dianggap sebagai peringkat yang mutlak presisi.
Apa yang Diukur Terminal-Bench 4.0 dan CursorBench 3.2.0
Terminal-Bench membuat Agen menangani tugas kompleks di lingkungan terminal nyata, dengan fokus pada apakah ia dapat memahami lingkungan, memanggil alat, mengubah file, dan akhirnya lolos verifikasi. Fable 5.1 memperoleh 55.8%, lebih tinggi 13.8 poin persentase dari Fable 5, dan juga melampaui Opus 5 yang mencapai 52.3%.
CursorBench 3.2 berasal dari tugas multi-file yang samar dalam sesi Cursor nyata; versi 3.2 menambahkan soal kepatuhan terhadap instruksi dan penggunaan alat tingkat lanjut. Fable 5.1 Max memperoleh 73.4%; selisihnya tidak sebesar Terminal-Bench-Science, tetapi rata-rata memakai 72,060 token dan biaya $9.64 per tugas, sedangkan Fable 5 Max memakai 103,525 token dan $17.32. Yang lebih layak diperhatikan di sini adalah penurunan token dan biaya saat menyelesaikan jenis tugas yang sama, bukan angka 2.9 poin persentase itu sendiri.
Apa yang Diukur GDPval-AA v2
GDPval-AA v2 menggunakan 220 tugas yang dirancang oleh para profesional industri, mencakup 44 jenis pekerjaan dan 9 sektor industri, untuk mengevaluasi kemampuan model dalam menangani pekerjaan pengetahuan nyata yang bernilai ekonomis. Angka 1853 adalah skor gabungan, bukan 1853%. Hasil ini menunjukkan Fable 5.1 mengungguli Fable 5 pada dokumen, analisis, dan deliverables profesional, serta sedikit mengungguli Opus 5.
Mengapa OSWorld 2.0 Memiliki Dua Skor
OSWorld 2.0 memuat 108 alur kerja operasi komputer berantai panjang, dengan median waktu penyelesaian manusia sekitar 1.6 jam per tugas. Partial memberikan skor parsial berdasarkan beberapa titik pemeriksaan (checkpoint); Strict hanya menganggap tugas berhasil bila tujuannya tercapai sepenuhnya.
Jadi 77.9% partial dan 41.7% strict milik Fable 5.1 tidaklah kontradiktif: ia sering mampu menyelesaikan sebagian besar langkah, tetapi masih ada sebagian tugas yang tidak tuntas dari ujung ke ujung. Ini juga mengingatkan kita bahwa "tampak terus-menerus beroperasi" dari Agen komputer tidak sama dengan tugas yang sudah berhasil.
Apa yang Diukur Humanity's Last Exam
Humanity's Last Exam dibuat oleh Center for AI Safety dan Scale AI, berisi 2,500 soal lintas disiplin setingkat ahli yang sulit dijawab hanya dengan pencarian sederhana. Fable 5.1 lebih tinggi 3.1 poin persentase dari Fable 5 dalam kondisi tanpa alat; setelah alat diizinkan, hanya lebih tinggi 1.2 poin persentase. Ia memang lebih kuat, tetapi tidak semua tolok ukur mengalami peningkatan berlipat ganda.
Apa yang Diukur AutomationBench
AutomationBench memeriksa apakah Agen mampu menyelesaikan alur kerja penjualan, pemasaran, operasional, layanan pelanggan, keuangan, dan SDM di berbagai alat SaaS simulasi seperti CRM, email, kalender, pesan, dan manajemen proyek. Peningkatan Fable 5.1 dari 17.1% menjadi 31.4% berarti kenaikan relatif sekitar 84%, menunjukkan bahwa 5.1 mengalami kemajuan nyata dalam pengelolaan status multi-aplikasi dan eksekusi langkah panjang; tetapi 31.4% juga menunjukkan bahwa otomasi bisnis tanpa pengawasan semacam ini masih jauh dari tuntas.
Apa Saja Peningkatan Fable 5.1 Dibandingkan Fable 5
1. Tugas Jangka Panjang Tidak Mudah Mengambil Jalan Pintas
Anthropic memposisikan Fable 5.1 sebagai model Agen jangka panjang: merencanakan terlebih dahulu, lalu menggunakan alat, memulihkan diri setelah kegagalan, memverifikasi hasil, dan secara proaktif melaporkan kemajuan. Model ini lebih menekankan perbaikan akar masalah daripada melakukan jalan pintas parsial hanya agar satu pengujian cepat berubah hijau. Skenario target yang disebutkan pihak resmi mencakup fitur lintas basis kode, peninjauan kode, optimasi performa, sesi otonom berhari-hari, riset, dokumentasi, spreadsheet, dan slide.
2. Effort Rendah pun Bisa Mendekati Hasil Berbiaya Tinggi Generasi Sebelumnya
Fable 5.1 menambahkan kemampuan untuk menyesuaikan effort per pesan. Kurva biaya resmi menunjukkan bahwa effort Low atau Medium pada sejumlah tugas dapat mencapai atau melampaui Fable 5, sekaligus menurunkan token dan biaya. Claude Code menggunakan High effort secara default; Claude.ai dan Cowork menggunakan Medium secara default. Saat membandingkan model, effort harus dipastikan terlebih dahulu; hasil dari tingkatan yang berbeda tidak boleh langsung disandingkan.
3. Kemajuan yang Dapat Dibaca Bisa Ditampilkan di Antara Pemanggilan Alat
API menambahkan kemampuan uji display: "updates" yang memungkinkan model memberikan pembaruan kemajuan yang ditujukan kepada pengguna di antara pemanggilan alat. Untuk tugas yang berjalan berjam-jam, ini memudahkan untuk menilai apa yang sedang dilakukan model dan apakah ia menyimpang dari tujuan, dibandingkan hanya melihat kartu alat bermunculan terus-menerus.
4. Penulisan, Verifikasi Visual, dan Pengujian Mandiri Lebih Lengkap
Pihak resmi menyatakan 5.1 secara proaktif menulis pengujian untuk memverifikasi perubahannya sendiri dan memanfaatkan kemampuan visual untuk memeriksa keluaran terhadap tujuan desain. Penilaian mitra juga berfokus pada kemajuan yang lebih ringkas, jawaban yang lebih lengkap untuk pertanyaan multi-bagian, pelacakan rantai pemanggilan di berbagai layanan, serta keterbacaan yang tetap terjaga setelah berjalan lama. Ini adalah umpan balik kualitatif dan tidak boleh dianggap sebagai kesimpulan tolok ukur yang seragam.
5. Intersepsi Keamanan Lebih Presisi, tetapi Tidak Hilang
Kesalahan positif palsu pada perlindungan keamanan siber Fable 5.1 berkurang sekitar 60% dibandingkan saat Fable 5 dirilis, dan frekuensi pemicu penurunan layanan (downgrade) pada soal biologi serta kedokteran dasar turun sekitar 85%. Model ini kini dapat digunakan untuk menemukan kerentanan perangkat lunak, tetapi tugas penggunaan ganda seperti pengujian penetrasi, pembuatan kode eksploitasi, dan pemindaian kerentanan biner masih dapat dialihkan ke Opus. Jika dialihkan, biaya tidak dikenakan sesuai harga Fable.
6. Penanda Asal Konten Baru
Fable 5.1 memperkenalkan content provenance. Teks yang dihasilkan dapat membawa tanda air statistik yang bisa diverifikasi melalui alat pemeriksaan konten milik Anthropic. Model ini tidak menambahkan penanda kasatmata pada permukaan teks, tetapi bagi platform konten, pendidikan, dan audit perusahaan, ini adalah perilaku baru yang perlu dipahami lebih dahulu.
Bagaimana Biaya Fable 5.1 Dihitung
| Komponen penagihan | Harga Fable 5.1 | Perbandingan dengan Fable 5 |
|---|---|---|
| Input | $10 / 1 juta token | Sama |
| Output | $50 / 1 juta token | Sama |
| Penulisan cache 5 menit | $12.50 / 1 juta token | Tingkatan yang sama |
| Penulisan cache 1 jam | $20 / 1 juta token | Tingkatan yang sama |
| Pembacaan cache | $0.25 / 1 juta token | Turun 75% |
| Batch API | 50% dari harga input dan output | Sesuai aturan Batch |
Misalkan satu tugas panjang membaca total 10 juta token cache, menghasilkan 200 ribu token input baru dan 50 ribu token output, tanpa memperhitungkan penulisan cache:
缓存读取:10 × $0.25 = $2.50
新输入:0.2 × $10 = $2.00
输出:0.05 × $50 = $2.50
合计:$7.00Pembacaan cache 10 juta token yang sama pada Fable 5 sekitar $10, jadi hanya dari item ini saja selisihnya $7.50. Berdasarkan hal ini, Anthropic memperkirakan biaya aktual tugas berbayar per token yang tipikal dapat turun sekitar 25%, dan untuk tugas yang sangat bersifat agen serta sering menggunakan ulang konteks panjang, penurunannya maksimal sekitar 45%. Ini bukan penurunan harga tercantum API secara menyeluruh, melainkan semakin banyak cache hit, semakin jelas penghematannya.
Pelanggan Berlangganan Belum Tentu Langsung Mendapatkan Penurunan Harga Cache API
Premium seat pada Max serta Team/Enterprise dapat menggunakan hingga 50% dari jatah mingguan untuk model Fable; Pro dan kursi standar sejak awal menggunakan usage credits. Rincian pemakaian aktual mengacu pada halaman Usage di akun. Penurunan harga pembacaan cache terutama merupakan perubahan pada skenario penagihan per token; penurunan harga cache API sebesar 75% tidak dapat langsung dikonversi menjadi "paket Max jadi empat kali lebih banyak".
Sebenarnya Cepat atau Tidak Fable 5.1
Jawabannya: respons satu putaran cenderung lebih lambat, tetapi total waktu penyelesaian tugas kompleks bisa lebih singkat.
- Katalog model Anthropic menandai Fable 5.1 sebagai
Slower, Opus 5 sebagaiModerate, dan Sonnet 5 sebagaiFast. - Claude Code menggunakan High effort secara default, yang secara alami memakai lebih banyak waktu penalaran dibandingkan Low atau Medium.
- Every menyebutkan pada beban kerja mereka sendiri bahwa Fable 5.1 sekitar dua kali lebih cepat dari Opus 5 dan memakai separuh token; ini adalah pengujian spesifik dari mitra, bukan jaminan kecepatan umum.
- Pada CursorBench, Fable 5.1 Max rata-rata 70 langkah dan 72,060 token; Fable 5 Max juga 72 langkah tetapi memakai 103,525 token. Keunggulan 5.1 lebih mirip "lebih sedikit memutar, lebih sedikit menghabiskan token" dan tidak selalu tampak sebagai waktu hingga token pertama yang lebih cepat.
Oleh karena itu, untuk obrolan, kode pendek, dan interaksi yang sering, prioritaskan Sonnet 5 atau Opus 5; untuk penelusuran kesalahan lintas basis kode, riset panjang, dan tugas tanpa pengawasan yang perlu memverifikasi sendiri, barulah pertimbangkan Fable 5.1.
Perubahan Kompatibilitas yang Wajib Ditangani Sebelum Upgrade ke Fable 5.1
Upgrade Claude Code Minimal ke Versi 2.1.250
Penjelasan paket dan ketersediaan dari Anthropic mensyaratkan Claude Code 2.1.250 atau lebih baru. Jika Fable 5.1 tidak terlihat, periksa dulu:
claude --versionLalu perbarui dengan cara upgrade resmi Claude Code, kemudian mulai ulang sesi. ID model API untuk Fable 5.1 adalah:
claude-fable-5-1Forced Tool Use Berpotensi Langsung Error
Jika permintaan memaksa model untuk memanggil alat tertentu, Fable 5.1 dapat mengembalikan error. Sebelum migrasi, periksa tool_choice dan alur pemaksaan alat pada Agen yang Anda bangun sendiri; jangan berasumsi perilaku Fable 5 sepenuhnya kompatibel.
Blok Thinking Tidak Boleh Dipakai Ulang Sembarangan lintas Model
Model yang lebih lama tidak dapat membaca thinking blocks milik Fable 5.1. Saat berpindah model, biarkan SDK menangani blok-blok ini sesuai aturan resmi, jangan menyodorkannya apa adanya ke model lain.
Mengubah Riwayat Lama Dapat Menyebabkan Error 400
Untuk akun API baru yang dibuat setelah 31 Agustus 2026, thinking blocks hanya valid dalam prefiks percakapan asli tempat blok tersebut dibuat. Memutar ulang thinking blocks setelah mengubah system, tools, atau pesan yang lebih lama dapat mengembalikan 400. Pihak resmi menyarankan agar riwayat bersifat append-only; jika perlu diringkas, ganti seluruh riwayat lama dengan satu ringkasan baru, jangan mengubah putaran lama sambil tetap mempertahankan thinking blocks aslinya. Mode terperinci lihat Panduan prompt dan migrasi Fable 5.1.
Kapan Sebaiknya Memilih Fable 5.1
Cocok untuk:
- Tugas panjang yang melintasi banyak repositori, layanan, atau aplikasi;
- Agen yang perlu berjalan berjam-jam dan memulihkan diri sendiri dari kegagalan;
- Riset ilmiah, analisis data kompleks, dan deliverables profesional bertahap;
- Masalah sistem yang sulit direproduksi, optimasi performa, dan investigasi akar masalah;
- Beban kerja API dengan banyak penggunaan ulang konteks panjang dan porsi pembacaan cache yang tinggi.
Tidak cocok untuk:
- Obrolan sederhana, teks pendek, atau perubahan kecil pada satu file;
- Interaksi real-time yang sangat sensitif terhadap latensi token pertama;
- Tugas beroutput besar dengan anggaran tetap tetapi tanpa penggunaan ulang cache;
- Skenario yang tidak dapat menerima retensi data pemantauan keamanan default 30 hari dan tidak memenuhi ketentuan pengecualian perusahaan;
- Alur kerja yang menginginkan semua permintaan keamanan siber atau ilmu hayati tidak memicu penurunan layanan.
Cara Memantau Tugas Panjang dari Jarak Jauh
Nilai Fable 5.1 sering muncul pada tugas yang berlangsung berjam-jam bahkan berhari-hari, tetapi itu tidak berarti seseorang harus terus-menerus menjaga mesin pengembangan. Pastikan dulu Fable 5.1 tersedia di Claude Code 2.1.250+ pada mesin lokal, lalu melalui PandaNpc Agent lihat sesi Claude Code di mesin pengembangan yang sama dari peramban, desktop, atau ponsel, tangani interaksi, dan lanjutkan memberikan perintah.
Yang berubah di sini hanyalah titik masuk kontrol; kode, alat, dan proses build tetap berjalan di mesin pengembangan Anda. Anda dapat membaca dulu Panduan akses jarak jauh Claude Code dan Tutorial menghubungkan ponsel ke Claude Code, lalu serahkan tugas panjang kepada Fable 5.1 setelah jalur jarak jauh dipastikan berfungsi.
FAQ: Pertanyaan yang Sering Diajukan
Seberapa Unggul Fable 5.1 Dibandingkan Fable 5?
Perbedaannya sangat bervariasi antar tugas. Terminal-Bench-Science naik 27.9 poin persentase, AutomationBench naik 14.3 poin persentase; pada HLE dengan penggunaan alat hanya naik 1.2 poin persentase. Peningkatan terbesar tunggal tidak dapat mewakili semua tugas.
Apakah Fable 5.1 Lebih Cepat dari Opus 5?
Dalam tabel latensi relatif resmi, Fable 5.1 termasuk "lebih lambat" dan Opus 5 "sedang". Sebagian mitra mengamati Fable 5.1 lebih cepat pada keseluruhan tugas karena memakai lebih sedikit token dan lebih sedikit pengerjaan ulang. Kedua kesimpulan ini tidak mengukur hal yang sama.
Apakah Fable 5.1 Lebih Cocok untuk Pemrograman daripada GPT-5.6 Sol?
Dalam tabel rilis Anthropic, Fable 5.1 lebih tinggi pada Terminal-Bench-Science, Terminal-Bench, AutomationBench, dan CursorBench; tetapi model yang berbeda menggunakan harness Agen, effort, alat, dan harga yang berbeda, sehingga hal ini tidak dapat dijadikan dasar untuk menyatakan bahwa semua repositori nyata dimenangkan Fable. Anda dapat merujuk Tutorial konfigurasi konteks 1M GPT-5.6 Sol, lalu melakukan pengujian A/B dengan tugas representatif Anda sendiri.
Mengapa Fable 5.1 Tiba-tiba Berpindah ke Opus?
Sebagian permintaan keamanan siber dan ilmu hayati akan dirutekan ke Opus oleh safeguards. Perpindahan model tidak selalu berarti gangguan; Anthropic menyatakan permintaan yang dialihkan semacam ini tidak ditagih dengan harga Fable.
Apakah Fable 5.1 Memiliki Tanda Air?
Ada mekanisme content provenance yang bersifat statistik, tetapi tidak menambahkan label kasatmata pada permukaan teks. Ini tidak sama dengan tanda air terlihat di sudut gambar.
Ringkasan
Kemajuan paling jelas Claude Fable 5.1 terkonsentrasi pada riset ilmiah, tugas terminal, dan alur kerja bisnis lintas aplikasi: model ini lebih mampu mengeksekusi secara berkelanjutan, memulihkan kegagalan, memverifikasi hasil, dan juga menurunkan biaya tugas panjang melalui pembacaan cache yang lebih murah. Namun, harganya tetap mahal, latensi satu putaran cenderung lebih lambat, dan membawa perubahan kompatibilitas terkait thinking blocks, pemaksaan pemanggilan alat, serta pengeditan riwayat.
Pertanyaan yang tepat untuk memilihnya bukanlah "apakah ia peringkat pertama dalam skor", melainkan: apakah tugas Anda cukup panjang, cukup kompleks, dan apakah biaya kegagalan serta pengerjaan ulang cukup tinggi sehingga layak menggunakan Fable 5.1. Jika jawabannya tidak, memulai dari Opus 5 atau Sonnet 5 biasanya lebih tepat.
Panduan terkait

Codex Mengaktifkan Konteks 1M GPT-5.6 Sol: Tutorial Konfigurasi 3 Baris `config.toml`
GPT-5.6 Sol secara resmi mendukung konteks 1,05 juta token. Cukup tambahkan 3 baris konfigurasi di bagian atas config.toml Codex untuk menjalankannya dengan jendela 1 juta token, dan secara otomatis memampatkan riwayat pada sekitar 900 ribu token. Sekaligus menyertakan konfigurasi permanen, perintah sekali jalan, verifikasi, dan pengingat biaya.
Baca artikel →
Bagaimana Cara Menggunakan Claude Code Remote Control? Kontrol Jarak Jauh dari Ponsel, Batasan Resmi, dan Alternatifnya (2026)
Bagaimana cara mengaktifkan Claude Code Remote Control? Artikel ini memberikan tiga penggunaan resmi: claude remote-control, claude --remote-control, dan /remote-control, menjelaskan koneksi ponsel dan browser, persyaratan akun, metode verifikasi, dan kesalahan umum, serta membandingkan skema PandaNpc dalam skenario model kustom, Codex, dan multi-mesin.
Baca artikel →
Menghubungkan Claude Code ke Ponsel: Alat untuk Melihat Sesi dan Menyetujui di iOS Kapan Saja
Artikel ini ditujukan untuk pengembang, berbagi praktik terbaik menghubungkan Claude Code dengan ponsel. Melalui aplikasi PandaNpc iOS, Anda dapat melihat sesi secara real-time, menyetujui pemanggilan alat, dan menjawab pertanyaan. Dengan bantuan pandapaw dan iOS Live Activity, Anda dapat melakukan kendali jarak jauh yang efisien dan meningkatkan fleksibilitas pengodean.
Baca artikel →