Anthropic Lancarkan Claude Fable 5: Model Paling Berkuasa Dalam Sejarah Dibahagikan Kepada Versi "Awam" dan "Kawalan", Tadbir Urus Keselamatan AI Memasuki Fasa Baharu

Pada 9 Jun, Anthropic melancarkan dua model serentak: Claude Fable 5 yang boleh digunakan oleh semua orang, dan Claude Mythos 5 yang hanya dibuka kepada unit keselamatan siber dan penyelidikan biologi tertentu. Keputusan untuk memecahkan keupayaan yang sama kepada dua versi ini mungkin lebih wajar diberi perhatian oleh pembaca berbanding kehebatan model itu sendiri.

Pada petang 9 Jun, seorang rakan jurutera yang melakukan aplikasi AI di Taipei menghantar mesej kepada saya dengan hanya satu ayat: "Ia telah mengeluarkan model itu dalam dua versi, adakah anda melihatnya?" Saya mengklik pengumuman Anthropic dan terkedu selama beberapa saat—fokus sebenarnya bukanlah pada tanda penanda aras (benchmark). Syarikat ini telah membahagikan keupayaan generasi terkuat yang sama kepada dua versi: satu dipanggil Claude Fable 5, yang boleh anda dan saya gunakan; satu lagi dipanggil Claude Mythos 5, yang hanya diberikan kepada unit tertentu yang telah lulus semakan.

Dalam pemerhatian arah aliran saya selama ini, saya telah melihat terlalu banyak pelancaran "model terkuat dalam sejarah". Tetapi pendekatan seperti "keupayaan yang sama, tetapi sama ada anda boleh mendapatkan versi penuh bergantung pada identiti pengguna anda" didedahkan secara terang-terangan buat kali pertama. Kepentingan perkara ini jauh melangkaui kemenangan beberapa mata dalam carta tertentu.

Latar Belakang Peristiwa

Anthropic ialah syarikat di sebalik siri model Claude, dan kepentingannya dalam kalangan perusahaan dan pemaju semakin meningkat sejak setahun dua ini—ramai orang menulis kod, melakukan carian soal jawab, dan membina ejen AI dengan Claude disambungkan di bahagian belakang. Pada lewat bulan Mei, ia baru sahaja melengkapkan pusingan pembiayaan berskala besar yang mengejutkan, dengan penilaian melonjak hampir kepada paras satu trilion dolar (seperti yang kami bincangkan sebelum ini dalam artikel Pembiayaan Besar-besaran Siri H Anthropic). Apabila dana dan kuasa pengkomputeran tersedia, langkah seterusnya ialah mengeluarkan model generasi seterusnya.

Apa yang dikeluarkan kali ini agak berbeza. Pada masa lalu, pelancaran model paling banyak dibahagikan kepada "saiz besar, sederhana dan kecil" — keupayaannya adalah sama, bezanya hanyalah pada kelajuan dan harga. Perbezaan antara Fable 5 dan Mythos 5 berada pada dimensi yang lain: ia bukan dibahagikan mengikut prestasi, tetapi mengikut risiko. Fable 5 ialah versi yang telah melalui pemprosesan keselamatan dan sesuai untuk kegunaan am; manakala Mythos 5 pula melonggarkan beberapa sekatan keselamatan dan hanya dibuka kepada rakan kongsi keselamatan siber yang telah lulus semakan (projek yang dinamakan "Project Glasswing" oleh Anthropic) serta segelintir penyelidik dalam bidang biologi.

Dalam erti kata lain, Anthropic telah memutuskan bahawa keupayaan generasi model ini sangat kuat sehingga membuka sepenuhnya "mengandungi risiko", jadi mereka telah menyimpan bahagian yang paling tajam dan hanya menyerahkannya kepada mereka yang dipercayai dan benar-benar memerlukannya.

Perkara Utama Kali Ini

Menurut pengumuman rasmi Anthropic dan keluaran serentak AWS, maklumat penting bagi pelancaran kali ini adalah seperti berikut:

  • Pelepasan Dwi-Versi: Claude Fable 5 (untuk awam dan kegunaan am) dan Claude Mythos 5 (terkawal, terhad kepada unit keselamatan siber dan penyelidikan biologi yang telah lulus semakan).
  • Harga Berganda: Harga API untuk Fable 5 ialah $10 USD bagi setiap juta token input dan $50 USD bagi setiap juta token output — kira-kira dua kali ganda daripada model flagship generasi sebelumnya, Opus 4.8. Dengan peningkatan keupayaan, bajet anda juga perlu meningkat.
  • Percubaan Percuma Terhad Masa: Dari 9 hingga 22 Jun, pelan perusahaan Pro, Max, Team dan pelan kerusi terpilih boleh menggunakan Fable 5 secara percuma; mulai 23 Jun, kuota penggunaan (credits) akan mula digunakan. Pelan perusahaan berasaskan bayar mengikut guna (pay-as-you-go) mula dikenakan bayaran sejak hari pelancaran.
  • Pelancaran Serentak Awan: Fable 5 dilancarkan di AWS pada hari pelancaran, menjadikannya sangat mudah untuk pasukan yang sudah berada dalam ekosistem AWS.
  • Penanda Aras Rasmi: Dalam pengumuman tersebut, Anthropic secara khusus menyebut penarafan kod FrontierCode Cognition, menyatakan bahawa Fable 5 menunjukkan prestasi terbaik di kalangan model frontier. Mengenai angka "80.3% pada SWE-Bench Pro" yang tersear di luar, perlu dijelaskan — ia disusun oleh agensi penarafan pihak ketiga (seperti Vellum) dan bukan kandungan pengumuman rasmi Anthropic. Sila ambil perhatian tentang sumber apabila melihatnya.

Saya amat ingin mengingatkan tentang perkara terakhir ini. Sebaik sahaja model dilancarkan, pelbagai tangkapan skrin penanda aras berterbangan di mana-mana, tetapi apa yang dikatakan oleh pihak rasmi adalah berbeza daripada apa yang diuji oleh pihak ketiga. Mengambil angka pihak ketiga sebagai jaminan rasmi adalah perangkap paling mudah untuk dimasuki apabila membaca berita AI.

Analisis Kesan Pasaran

Bagi pengguna umum di Taiwan, perasaan paling langsung ada dua: lebih pintar, tetapi lebih mahal. Jika anda seorang pelanggan Pro atau Max Claude, pastikan anda menggunakan peluang tetingkap percuma sebelum 22 Jun untuk mencuba Fable 5 — terutamanya untuk menjalankan tugas sukar yang anda rasa ChatGPT atau Gemini tidak dapat kendalikan dengan baik, dan bandingkan perbezaannya. Tetapi jangan biasakan diri menggunakan "model paling mahal untuk segala-galanya"; tugas harian sudah cukup dengan model murah, dan simpan Fable 5 untuk cabaran yang benar-benar memerlukannya.

Bagi aplikasi perusahaan, harga yang berganda adalah realiti yang perlu dikira dalam perakaunan. Jika sebuah syarikat menyambungkan Claude kepada perkhidmatan pelanggan, pemprosesan dokumen, dan alat dalaman, dengan volum panggilan yang besar, harga $50 USD bagi setiap juta token output akan sangat dirasai pada bil akhir bulan. Cadangan saya adalah: jangan tergesa-gesa menukar semuanya kepada Fable 5, lakukan pengkelasan terlebih dahulu — tugas mudah menggunakan model murah, dan hanya gunakan Fable 5 untuk pautan yang benar-benar memerlukan keupayaan tinggi. Ini konsisten dengan pemerhatian kami sebelum ini semasa membincangkan model MAI buatan sendiri Microsoft: strategi AI perusahaan pada tahun 2026 terasnya adalah "mencampur dan memadankan pelbagai model, diperuntukkan mengikut tugas", dan bukannya setia buta tuli kepada satu jenama sahaja.

Bagi pembangun, mekanisme "semakan baharu diberikan" pada Mythos 5 adalah isyarat yang patut diberi perhatian. Jika anda membina alat keselamatan siber, ujian penembusan (penetration testing), atau pasukan merah (red team), jika anda ingin mendapatkan "kuasa penuh" model pada masa hadapan, anda mungkin perlu lulus semakan kelayakan pembekal terlebih dahulu. Ini adalah ambang yang munasabah untuk penyelidikan keselamatan siber yang sah, tetapi ia juga bermaksud bahawa pemerolehan keupayaan model sedang beralih daripada "bayar dan anda dapat" kepada "layak baru dapat". Menyambungkan Fable 5 dalam alat pembangunan seperti Cursor membolehkan anda menikmati keupayaan versi awam; bahagian yang benar-benar melonggarkan sekatan bukanlah sesuatu yang boleh diperoleh oleh semua orang.

Arah Aliran Pembangunan Masa Depan

Saya percaya bahawa tontonan sebenar pelancaran kali ini ialah "tadbir urus pengkelasan keselamatan AI" mula beralih daripada teori kepada produk. Pada masa lalu, perbincangan tentang AI keselamatan kebanyakannya kekal pada kertas putih dan pengisytiharan prinsip; Fable 5 / Mythos 5 telah mengubahnya menjadi keputusan produk sebenar — membahagikan versi mengikut keupayaan dan menyemak mengikut identiti, yang ditulis terus ke dalam proses pelepasan.

Adalah dijangka bahawa syarikat model frontier lain akan mengikuti pendekatan yang serupa. Apabila model itu menjadi sangat kuat sehingga ke tahap tertentu, risiko politik dan undang-undang "pembukaan penuh" adalah terlalu tinggi, dan "pelepasan berlapis mengikut risiko dan identiti" perlahan-lahan akan menjadi konvensyen industri. Bagi pengguna, ini bermakna "model terkuat" yang anda perolehi sebenarnya mungkin "versi keselamatan yang dikasi (castrated) daripada model terkuat"; bagi pengawal selia, ini memberikan antara muka pengurusan yang boleh dilaksanakan.

Satu lagi trend ialah keahlian yang menyahgandingkan harga dan keupayaan. Tetingkap percuma, beralih kepada kuota kemudian, pengecasan penggunaan perusahaan — Anthropic telah memperhalusi kaedah "cuba dahulu, bayar kemudian". Strategi ini akan menjadikan pengguna lebih terbiasa "membayar tambahan untuk keupayaan tahap atas", dan juga menjadikan pembahagian buruh antara "model mampu milik untuk urusan harian, model flagship untuk cabaran sukar" semakin jelas.

Kesimpulan dan Ulasan Akademi TheAI

Sejujurnya, tidak kira betapa tinggi skor penanda aras Fable 5, ia akan diliputi oleh model seterusnya dalam masa setengah tahun, dan itu bukanlah fokus berita ini. Fokusnya ialah Anthropic telah menunjukkan peraturan permainan yang sedang dibentuk melalui satu pelancaran: "Lebih kuat keupayaannya, lebih banyak pelepasan harus dikelaskan".

Apabila "model terkuat" mula menentukan berapa banyak yang boleh diberikan kepada anda berdasarkan identiti anda, apa yang kita bincangkan bukan lagi sekadar teknologi, tetapi siapa yang layak menyentuh api ini.

Cadangan khusus untuk pembaca adalah sangat praktikal: Pertama, jangan lepaskan peluang tetingkap percuma sebelum 22 Jun, ambil tugas paling sukar di tangan anda untuk menguji Fable 5 secara langsung, dan rasai sendiri sama ada ia berbaloi dengan dua kali ganda harga; Kedua, jika anda atau syarikat anda sangat bergantung pada Claude, sudah tiba masanya untuk duduk dan melakukan "pengkelasan model" — mengalirkan tugas ke model dengan julat harga yang berbeza mengikut kesukaran, dan jangan biarkan bil anda tidak terkawal; Ketiga, pembangun yang melakukan keselamatan siber dan ejen patut mula memberi perhatian kepada trend pelbagai pihak "hanya memberikan keupayaan penuh selepas semakan", dan memahami ambang kelayakan lebih awal. Menjadi semakin berupaya adalah perkara yang baik, tetapi cara menggunakannya dengan bijak dan mampu membelinya adalah kemahiran sebenar.

Sumber

(Artikel ini disusun berdasarkan maklumat awam. Harga model, masa ketersediaan, dan fungsi tertakluk kepada pengumuman rasmi terkini Anthropic; angka penilaian pihak ketiga dalam artikel telah ditanda dengan sumber, sila semak sendiri sebelum memetik.)

Soalan Lazim

Apakah perbezaan antara Claude Fable 5 dan Mythos 5?

Kedua-duanya adalah versi berbeza bagi generasi keupayaan yang sama, di mana perbezaannya terletak pada "tahap risiko dan keterbukaan" dan bukannya prestasi. Fable 5 adalah versi awam yang telah diproses dari segi keselamatan dan ditujukan kepada pengguna umum; manakala Mythos 5 melonggarkan beberapa sekatan keselamatan dan hanya dibuka kepada rakan kongsi keselamatan siber tertentu yang lulus semakan Anthropic (Projek Glasswing) serta segelintir penyelidik dalam bidang biologi, di mana orang awam tidak boleh mendapatkannya.

Berapakah harga Claude Fable 5? Adakah ia mahal?

Harga API yang diumumkan secara rasmi adalah USD 10 bagi setiap juta token input dan USD 50 bagi setiap juta token output, iaitu kira-kira dua kali ganda berbanding model flagship generasi sebelumnya, Opus 4.8. Untuk aplikasi perusahaan yang mempunyai panggilan berat, kos output akan jelas kelihatan pada bil. Adalah disyorkan untuk melaksanakan penggredan model dan mengagihkan tugas mengikut tahap kesukaran, daripada menggunakan versi paling mahal untuk kesemuanya.

Bolehkah saya mencuba Claude Fable 5 secara percuma?

Dalam tempoh dari 9 hingga 22 Jun 2026, pelan perusahaan Pro, Max, Team dan sebahagian pelan berasaskan tempat duduk (seat-based) Claude boleh menggunakan Fable 5 secara percuma; mulai 23 Jun, kredit penggunaan akan ditolak. Pelan perusahaan bayar ikut guna (usage-based) pula akan dikenakan bayaran bermula dari hari ia dilancarkan. Gunakan peluang tempoh percuma ini untuk menguji masalah sukar bagi mendapatkan nilai terbaik.

Adakah angka SWE-Bench Pro 80.3% yang diperkatakan oleh pihak luar merupakan angka rasmi?

Bukan. Pengumuman rasmi Anthropic menumpukan pada prestasi dalam penilaian pengaturcaraan FrontierCode oleh Cognition; manakala angka seperti "SWE-Bench Pro 80.3% " datang daripada rumusan agensi penarafan pihak ketiga dan bukannya kandungan pengumuman rasmi. Apabila melihat markah penarafan (benchmark), pastikan anda membezakan antara sumber rasmi dan pihak ketiga bagi mengelakkan daripada menganggap angka pihak ketiga sebagai jaminan rasmi.

繁體中文版 →