Claude Fable 5 Tips Bocor, Efek 6 Jam Diukur, Benar-benar Gila?
Fable 5 baru saja diluncurkan, dan kata-kata promosi sistemnya sudah bocor:

Setelah membaca kata-kata petunjuk ini, ada beberapa poin yang cukup penting:
- Pertama, Fable telah menambahkan API penyimpanan permanen (
window.storage) untuk Artifact. Artifact merupakan konten unik yang dihasilkan oleh kode Claude, seperti halaman HTML, komponen React, dan sebagainya. Sebelumnya, data Artifact tidak dapat disimpan, sehingga lebih seperti demo yang hanya digunakan sekali saja. Kini, data tersebut dapat disimpan antar sesi, yang memungkinkan pengembangan alat bantu (tool) yang “mengingat” informasi sebelumnya, seperti tangga lagu, alat pencatat kehadiran, buku harian, dan sebagainya.
- Kedua, Fable telah menyempurnakan logika lengkap dari konektor MCP App. Jika Anda ingin terhubung ke layanan eksternal (pemesanan, taksi, musik, dll.), Fable akan pertama-tama memeriksa katalog layanan yang tersedia, kemudian menawarkan opsi tersebut kepada Anda untuk dikonfirmasi. Terutama untuk layanan yang memerlukan pembayaran, Fable telah membuat serangkaian aturan opt-in yang terperinci.
Dan juga:
- Ketiga, ketika Fable mendeteksi kebutuhan terkait keamanan jaringan, biokimia, dan distilasi, ia akan secara otomatis menyerahkan tanggapan tersebut ke model dengan kemampuan lebih rendah, yaitu Opus 4.8, untuk diproses, dan memberitahu pengguna tentang penurunan kualitas layanan.
- Keempat, Fable menambahkan fitur long_conversation_reminder (peringatan percakapan panjang). Ketika sebuah percakapan menjadi terlalu panjang, Fable akan menambahkan peringatan tersebut di akhir informasi pengguna, untuk mengingatkan model agar tidak melupakan percakapan asli yang telah berlangsung sebelumnya, karena percakapan tersebut berlangsung terlalu lama.
Tautan repositori:
https://github.com/elder-plinius/CL4R1T4S/blob/main/ANTHROPIC/CLAUDE-FABLE-5.md
Meskipun penurunan kualitas produk untuk versi komersial (Mythos) sudah diperkirakan sebelumnya, dari pesan yang muncul di sistem ini, masih terlihat bahwa Anthropic sangat memperhatikan aspek keamanan.
Perlu dicatat bahwa dalam ketentuan Fable mengenai syarat-syarat perilaku, bagian yang membahas kesehatan mental mendapatkan perhatian yang cukup besar. Mengingat gugatan terkait pembunuhan diri yang dilakukan oleh chatbot dalam satu atau dua tahun terakhir, tidak sulit untuk memahami mengapa bagian ini ditulis dengan begitu rinci...
Ini adalah contoh teks yang perlu diterjemahkan ke dalam bahasa Indonesia: text Berikut adalah beberapa contoh kalimat dalam bahasa Indonesia: text

Terjemahan adalah sebagai berikut:
Claude peduli dengan kesehatan fisik dan mental orang-orang, dan berusaha untuk tidak mendorong atau mempromosikan perilaku yang merusak diri sendiri, seperti kecanduan, kekerasan terhadap diri sendiri, gangguan pola makan atau olahraga, serta pola pikir dan kritik diri yang sangat negatif.
Meskipun pengguna secara aktif meminta, Claude juga dapat menghindari membuat konten yang mungkin mendukung atau memperkuat tindakan penghancuran diri.
Ketika berbicara dengan orang yang memiliki pikiran untuk bunuh diri atau dorongan untuk menyakiti diri sendiri tentang "metode pembatasan bahaya" atau "rencana keamanan", Claude tidak akan menyebutkan nama secara spesifik, membuat daftar, atau mendeskripsikannya secara rinci. Bahkan jika tujuannya adalah untuk memberitahu orang tersebut apa yang harus dihindari, Claude tidak akan mengatakannya secara langsung, karena menyebutkan hal-hal tersebut bisa secara tidak sengaja memicu reaksi negatif dari orang tersebut.
Mari kita lihat hasil pengujian aktual untuk Fable 5.
Ini adalah demo yang dibuat oleh netizen menggunakan Fable 5 dan fitur Old Scrolls:

Fable memanggil skenario hutan 3D yang dibangun oleh ThreeJ:

Memiliki simulasi ruang yang mencakup 5000 objek:

Demonstrasi Siluet Kota New York:

Kota Gotik tenggelam oleh ombak laut:

Pengguna internet Victor Taelin menggunakan sebuah proyek nyata untuk melakukan pengujian.

HVM5 Ini adalah sebuah sistem dasar yang terkait dengan komputasi berkinerja tinggi. Sebelumnya, ia telah digunakan oleh beberapa orang. 32 agen GPT-5 berjalan selama sekitar 20 jam, dan meskipun ada percepatan hingga 2 kali lipat, kualitas kode menjadi buruk akibat pembesaran ukuran kode. Kemudian, optimisasi menggunakan Opus 4.8 dan GPT-5.5 dilakukan selama 8 jam, di mana Opus memberikan percepatan yang efektif sebesar 6% hingga 34%, namun hasil yang dihasilkan oleh GPT tidak dapat digunakan.

Hasilnya, Fable 5 hanya membutuhkan waktu 2 jam untuk meningkatkan kinerjanya, dengan peningkatan sebesar 1770% pada satu benchmark, dan peningkatan lebih dari 100% dengan tambahan sekitar 22% pada 4 benchmark lainnya.
Reaksi pertama para netizen adalah tidak percaya, dan mereka menduga apakah hasil benchmark tersebut merupakan hasil dari “pengkodean keras” (hardcoding), karena sebelumnya mereka pernah mengalami masalah serupa dengan alat seperti GPT.

Setelah membaca penjelasannya, dia menyadari bahwa arah pengoptimalan Fable memang masuk akal.
Karena HVM5 memproses node pemetaan pola dinamis, banyak cabang yang tidak berguna juga dibawa ke proses pemulihan memori (garbage collection), sehingga menyebabkan pemborosan waktu yang signifikan. Sebelumnya, para pengguna hanya mengoptimalkan proses pemetaan pola statis, dan tidak mengoptimalkan proses pemetaan pola dinamis. Fable menemukan hal ini, sehingga hasil pengujian menjadi sangat berlebihan (exaggerated).
Ini adalah analisis penyebab bug HVM5 yang diberikan oleh Fable 5:

Pengguna internet asal Turki, Alican Kiraz, telah melakukan serangkaian uji perbandingan antara Fable 5 dan GPT 5.5.
Kesimpulannya adalah, Fable 5 membutuhkan biaya yang lebih tinggi, yaitu 360,55 dolar Amerika, untuk dijalankan; sedangkan GPT-5.5 hanya membutuhkan biaya 6 dolar Amerika. Namun, jika dilihat dari aspek optimisasi detailnya, Fable 5 memang telah melakukan optimisasi yang lebih mendasar, lebih “keras” (dari segi teknis), dan lebih sesuai dengan pola pikir seorang insinyur kinerja (performance engineer).

Inilah kesimpulan ujiannya:

Berdasarkan pengujian tugas nyata dengan alat pemrograman pihak ketiga Augment Code, kemampuan pemrograman Fable 5 sangat kuat.
Dalam pengujian yang dilakukan, masing-masing tugas pemrograman dijalankan sebanyak 489 kali, dan Fable 5 menunjukkan kinerja serta tingkat keakuratan yang jauh lebih unggul. Total skor Fable 5 meningkat sebesar +0,224, sedangkan tingkat keakuratannya meningkat sebesar +0,191.

Namun, ada juga contoh kekecewaan dari hasil pengujian yang sebenarnya. Seorang pengguna internet bernama Ryan R. Hughes mengirimkan sebuah PR (Pull Request) yang terdiri dari 74 file untuk ditinjau oleh Fable 5. Proses peninjauannya memakan waktu sekitar 34 menit, dan menggunakan 42% dari total waktu yang dialokasikan untuk sesi kode Claude selama 5 jam, hanya untuk menghasilkan 16 temuan (penyimpangan atau masalah).

Contoh seperti ini tidak jarang terjadi; Fable 5 harganya agak terlalu mahal.

Beberapa orang berpendapat bahwa, berdasarkan pengujian yang dilakukan, kemampuan Fable 5 dalam memproses teks panjang cukup lemah:

Lebih banyak ulasan negatif terfokus pada operasi penurunan kualitas model:

Harga API untuk Fable 5 saat ini adalah $10 per juta token input dan $50 per juta token output.

Dibandingkan secara horizontal, harga ini kira-kira dua kali lipat dari Opus 4.8 dan lebih dari tiga kali lipat dari Sonnet 4.6. Biaya aktual untuk satu alur kerja yang kompleks jelas lebih tinggi daripada model Claude generasi sebelumnya.
Dan tingkat sensitifitasnya juga telah ditingkatkan: pagar pengaman secara keseluruhan menjadi lebih konservatif; lebih memilih untuk tidak melukai siapa pun daripada mengambil langkah yang terlalu berisiko demi keamanan.
Mengenai masalah biaya yang terlalu tinggi, saya telah mengumpulkan hasil pengujian dari netizen-netizen berikut, yang tidak hanya dapat membantu semua orang menghemat uang, tetapi juga memberikan hasil yang sangat baik: solusi penggunaan model campuran:
Di IDE seperti Cursor yang mendukung model campuran, berbagai model dapat digunakan secara bertahap di platform tersebut:
Tahap Pertama: Pemeriksaan kode dan analisis awal proyek, digunakan untuk mempersiapkan konteks dan memahami struktur proyek. Salah satunya adalah menggunakan GPT-5.5, MiniMax M3, Kimi K2.6, atau Composer 2.5.
Tahap Kedua: Merumuskan rencana proyek, menggunakan GPT-5.5 Very High atau Opus 4.8 untuk menyusun rencana proyek.
Tahap Ketiga: Menganalisis Penggunaan Rencana Proyek Fable 5, meninjau rencana proyek untuk menemukan bagian-bagian yang mungkin salah. Jika perlu memodifikasi rencana, gunakan GPT-5.5 dengan tingkat kepentingan Very High.
Tahap Keempat: Pelaksanaan dan Penggunaan Rencana Proyek dengan Implementasi MiniMax M3, DeepSeek V4, Max, Composer 2.5, atau Sonnet 4.6.
Tahap Kelima: Peninjauan Akhir, menggunakan kode GPT-5.5 untuk meninjau hasil akhir peninjauan kode, dan memeriksa apakah implementasinya sesuai dengan rencana awal.
Menggunakan kekuatan yang paling mahal di tempat yang paling tepat adalah cara yang benar untuk memulai permainan Fable 5.
Efek dari membunuh karakter Claude Fable 5 dalam game “Claude Fable 5” apakah akan membuatnya menjadi gila atau tidak, itu tergantung pada pandangan masing-masing orang—bagi mereka yang penuh belas kasihan, mungkin akan berbeda pendapat dengan mereka yang lebih bijaksana.
Dengan adanya alat ini, kecepatan konsumsi token menjadi sangat jelas, benar-benar luar biasa.
Artikel ini berasal dari akun WeChat resmi “JackCui”, ditulis oleh “JackCui”.
Tautan artikel:https://www.airai.cc/id/%E6%9C%AA%E5%91%BD%E5%90%8D/7/
Apakah ini membantu?