Inilabas ng Anthropic ang Claude Fable 5: Ang pinakamalakas na modelo sa kasaysayan, hinati sa "Public" at "Controlled" na bersyon, pumapasok na sa bagong yugto ang AI safety governance

Noong Hunyo 9, sabay na inilabas ng Anthropic ang dalawang modelo: ang Claude Fable 5 na magagamit ng lahat, at ang Claude Mythos 5 na para lamang sa mga partikular na institusyon ng cybersecurity at biological research. Ang desisyong hatiin sa dalawang bersyon ang parehong kakayahan ay maaaring mas karapat-dapat pagtuunan ng pansin ng mga mambabasa kaysa sa kung gaano kalakas ang modelo.

Noong Hunyo 9 ng gabi, nagpadala sa akin ng mensahe ang isang kaibigan kong engineer na gumagawa ng mga AI application sa Taipei. Isang linya lang ang sabi: "Inilabas nila ang modelo sa dalawang bersyon, nakita mo na ba?" Binuksan ko ang anunsyo ng Anthropic at natigilan ako nang ilang segundo—ang talagang punto ay wala sa mga benchmark score. Hinati ng kumpanyang ito ang pinakamalakas na kakayahan ng parehong henerasyon sa dalawang bersyon: ang isa ay tinatawag na Claude Fable 5, na magagamit nating dalawa; ang isa naman ay tinatawag na Claude Mythos 5, na ibinibigay lamang sa mga partikular na unit na nakapasa sa screening.

Sa pag-obserba ko sa mga uso nitong mga nakaraang taon, nakita ko na ang napakaraming paglulunsad ng "pinakamalakas na modelo sa kasaysayan." Ngunit ang ganitong diskarte na—"ang parehong kakayahan, ngunit ang iyong pagkakakilanlan bilang gumagamit ang magpapasya kung makukuha mo ang buong bersyon"—ay sa unang pagkakataon na tahasang inilantad sa publiko. Ang kahalagahan ng bagay na ito ay higit pa sa kung ilang puntos ang napanalunan nito sa isang tiyak na leaderboard.

Background ng Kaganapan

Ang Anthropic ay ang kumpanya sa likod ng serye ng mga modelong Claude, at ang kanilang impluwensya sa lupon ng mga negosyo at developer ay dumarami nitong nakaraang isa o dalawang taon—maraming tao ang sumusulat ng code, gumagawa ng retrieval QA, at nagtatayo ng mga AI agent na ang ilalim ay nakakonekta sa Claude. Noong huling bahagi ng Mayo, katatapos lamang nitong kumpletuhin ang isang nakakagulat na laki ng fundraising, na nagtulak sa valuation nito malapit sa antas ng isang trilyong dolyar (tinalakay natin ito noon sa artikulong Malaking Pondo ng Anthropic). Kapag naabot na ang pondo at compute power, ang susunod na hakbang ay ilabas ang susunod na henerasyon ng modelo.

Ang inilabas sa pagkakataong ito ay medyo naiiba. Noong nakaraan, kapag naglulunsad ng mga modelo, kadalasan ay hinahati lang ito sa "malaki, gitna, at maliit"—pare-pareho ang kakayahan, ang pinagkaiba lang ay bilis at presyo. Ang paraan ng paghahati sa pagitan ng Fable 5 at Mythos 5 ay nasa ibang dimensyon:hindi ito hinati ayon sa performance, kundi hinati ayon sa panganib. Ang Fable 5 ay isang bersyon na dumaan sa safety processing at angkop para sa pangkalahatang paggamit; habang ang Mythos 5 naman ay nag-alis ng ilang restriksyon sa kaligtasan at bukas lamang sa mga na-screen na cybersecurity partner (isang proyekto na tinatawag ng Anthropic na "Project Glasswing") at sa ilang piling mananaliksik sa larangan ng biyolohiya.

Sa madaling salita, natukoy ng Anthropic na ang kakayahan ng henerasyong ito ng modelo ay napakalakas na kaya nitong magdala ng panganib kung "bubuksan nang lubusan," kaya itinago nila ang pinakamatalim na bahagi at ibinigay lamang ito sa mga taong pinagkakatiwalaan nila at talagang gumagamit nito.

Mga Pangunahing Punto sa Pagkakataong Ito

Ayon sa opisyal na anunsyo ng Anthropic at sa sabay-sabay na pagpapalabas ng AWS, ang mga pangunahing impormasyon ng paglulunsad na ito ay ang mga sumusunod:

  • Paglabas ng Dalawang Bersyon: Claude Fable 5 (pampubliko, pangkalahatang paggamit) at Claude Mythos 5 (may kontrol, limitado sa mga na-screen na yunit ng cybersecurity at pananaliksik sa biyolohiya).
  • Dobleng Presyo: Ang presyo ng API ng Fable 5 ay $10 bawat milyong input token at $50 bawat milyong output token—humigit-kumulang dalawang beses kaysa sa nakaraang flagship na Opus 4.8. Kasabay ng pag-upgrade ng kakayahan ay ang pagtaas din ng gagastusin sa bulsa.
  • Limitadong Panahon ng Libreng Pagsubok: Mula Hunyo 9 hanggang Hunyo 22, maaaring gamitin nang libre ng mga Pro, Max, Team, at ilang mga planong nakabatay sa upuan ng negosyo ang Fable 5; simula Hunyo 23, kakailanganing gamitin ang mga credit sa paggamit. Ang mga planong pang-negosyo na nakabatay sa paggamit ay sisingilin na simula pa lamang sa araw ng paglulunsad.
  • Sabay-sabay na Pag-upload sa Cloud: Inilunsad ang Fable 5 sa AWS sa mismong araw ng pagpapalabas, na napaka-maginhawa para sa mga koponang nasa loob na ng ekosistema ng AWS.
  • Opisyal na Itinatampok na Benchmark: Ang tinukoy ng Anthropic sa kanilang anunsyo ay ang pagsusuri sa code na FrontierCode ng Cognition, na nagsasabing ang Fable 5 ang nagpakita ng pinakamahusay na pagganap sa mga front-end na modelo. Tungkol naman sa bilang na "nakuha ang 80.3% sa SWE-Bench Pro" na kumakalat sa labas, kailangang linawin—ito ay pinagsama-sama ng mga third-party testing organization (tulad ng Vellum) at hindi opisyal na nilalaman ng anunsyo ng Anthropic, kaya mangyaring mag-ingat sa pinagmulan kapag nakita ito.

Gusto kong lalo nang ipaalala ang huling puntong ito. Paglabas ng modelo, naglipana ang iba't ibang screenshot ng mga benchmark, ngunit magkaiba ang sinasabi ng opisyal at ang sinusukat ng third party. Ang pagkuha sa mga numero ng third party bilang opisyal na garantiya ang pinakamadaling bitag na maaaring apakan sa pagbabasa ng balita sa AI.

Pagsusuri sa Epekto sa Merkado

Para sa mga ordinaryong gumagamit sa Taiwan, ang pinaka-direktang mararamdaman ay dalawa: mas matalino, at mas mahal. Kung ikaw ay isang Pro o Max subscriber ng Claude, siguraduhing samantalahin ang libreng window bago ang Hunyo 22 para subukan ang Fable 5—lalo na kung gagamitin mo ito para patakbuhin ang mga mahihirap na gawain na sa palagay mo ay hindi sapat na nahawakan ng ChatGPT o Gemini, upang maikumpara ang pagkakaiba. Ngunit huwag sanaying gamitin ang "pinakamahal na modelo sa bawat bagay," sapat na ang murang modelo para sa mga pang-araw-araw na aberya, at iwanan ang Fable 5 para sa mga mahihirap na suliranin na talagang nangangailangan nito.

Para sa mga aplikasyon sa negosyo, ang dobleng presyo ay isang realidad na kailangang isama sa kuwenta. Kung ang isang kumpanya ay ikinakonekta ang Claude sa serbisyo sa customer, pagpoproseso ng dokumento, at mga panloob na kasangkapan, kapag lumaki ang dami ng tawag, ang presyong $50 bawat milyong output token ay magiging napakalaking pasanin sa singil sa katapusan ng buwan. Ang aking suhestiyon ay: huwag agad lumipat nang buo sa Fable 5, kumuha muna ng pag-uuri—ang mga simpleng gawain ay dumaan sa murang modelo, at ang Fable 5 lamang ang gamitin sa mga bahaging talagang nangangailangan ng kakayahan. Ito ay naaayon sa ating naunang obserbasyon noong tinalakay natin ang mga sariling gawang modelo ng MAI ng Microsoft: sa 2026, ang pinakalundayan ng diskarte sa AI ng negosyo ay "pag-mix at pag-match ng maraming modelo, at paglalaan ayon sa gawain," sa halip na maging tapat sa isang solong kumpanya.

Para sa mga developer, ang mekanismo ng Mythos 5 na "ibinibigay lamang kapag na-screen" ay isang senyales na karapat-dapat bantayan. Kung ang iyong ginagawa ay mga kasangkapan tulad ng cybersecurity, penetration testing, at red team, sa hinaharap upang makuha ang "buong kapangyarihan" ng modelo, maaaring kailanganin mo munang makapasa sa kwalipikasyon ng supplier. Ito ay isang makatwirang hadlang para sa lehitimong pananaliksik sa cybersecurity, ngunit nangangahulugan din ito na: ang pagkuha ng mga kakayahan ng modelo ay lumilipat mula sa "pagbabayad para makuha ito" patungo sa "pagiging karapat-dapat para makuha ito." Sa mga kasangkapang pang-develop tulad ng Cursor sa pag-connect sa Fable 5, ang tinatamasa ay ang kakayahan ng pampublikong bersyon; ang bahaging iyon na tunay na nag-aalis ng mga restriksyon ay hindi madaling makuha ng lahat.

Mga Uso sa Hinaharap na Pag-unlad

Naniniwala ako na ang tunay na dapat abangan sa paglulunsad na ito ay ang pagsisimula ng "AI safety tiered governance" mula sa teorya patungo sa produkto. Noon, ang pag-uusap tungkol sa kaligtasan ng AI ay kadalasang nananatili sa mga whitepaper at deklarasyon ng prinsipyo; ginawa itong aktwal na desisyon sa produkto ng Fable 5 / Mythos 5—sa pamamagitan ng paghahati ng bersyon ayon sa kakayahan at pagsusuri ng pagkakakilanlan, tuwirang isinulat ito sa proseso ng pagpapalabas.

Maaasahan na ang ibang mga kumpanya ng front-end na modelo ay susunod sa katulad na pamamaraan. Kapag ang isang modelo ay naging napakalakas hanggang sa isang tiyak na antas, ang pampulitika at legal na panganib ng "ganap na bukas" ay napakataas, at ang "pagpapalabas ayon sa panganib at pagkakakilanlan" ay dahan-dahang magiging kaugalian sa industriya. Para sa gumagamit, nangangahulugan ito na ang "pinakamalakas na modelo" na iyong nakuha ay maaaring talagang isang "ligtas na kinapon na bersyon ng pinakamalakas na modelo"; para sa mga tagapangasiwa, nagbibigay ito ng interface ng pamamahala na maaaring pagtuunan ng pansin.

Ang isa pang uso ay ang membership system kung saan hiwalay ang presyo at kakayahan. Libreng window, pagkatapos ay paglipat sa paggamit ng mga credit, at pagbabayad batay sa paggamit ng negosyo—pinaglaruan nang husto ng Anthropic ang "subukan muna bago magbayad." Ang estratehiyang ito ay gagawing mas sanay ang mga gumagamit sa "pagbabayad nang hiwalay para sa pinakamataas na kakayahan," at ginagawang mas malinaw ang dibisyon ng paggawa kung saan ang "mababang presyong modelo ang namamahala sa pang-araw-araw, at ang flagship na modelo ang namamahala sa mga mahirap na suliranin."

Buod at Puna ng TheAI學院

Sa totoo lang, gaano man kataas ang mga benchmark score ng Fable 5, tatakpan ito ng susunod na modelo sa loob ng kalahating taon, at hindi ito ang punto ng balitang ito. Ang punto ay ipinakita ng Anthropic sa pamamagitan ng isang paglulunsad ang umiiral na patakaran ng laro na "mas malakas ang kakayahan, mas kailangang uriin ang pagpapalabas."

Kapag ang "pinakamalakas na modelo" ay nagsimulang magpasya kung magkano ang maibibigay sa iyo batay sa iyong pagkakakilanlan, ang pinag-uusapan natin ay hindi na lamang teknolohiya, kundi kung sino ang may kwalipikasyon na humawak sa apoy na ito.

Ang mga tiyak na suhestiyon para sa mga mambabasa sa Taiwan ay napaka-praktikal: una, huwag sayangin ang libreng window bago ang Hunyo 22, dalhin ang pinakamahirap na gawain na nasa iyong mga kamay upang isagawa ang aktwal na pagsusuri sa Fable 5, at madama mo mismo kung sulit ito sa dobleng presyo; ikalawa, kung ikaw o ang iyong kumpanya ay labis na umaasa sa Claude, ngayon na ang oras upang maupo at magsagawa ng "pag-uri ng modelo"—hatiin ang mga gawain sa iba't ibang modelo ng presyo ayon sa hirap, at huwag hayaang mawalan ng kontrol ang singil; ikatlo, ang mga developer na gumagawa ng cybersecurity at mga agent, simulan nang bantayan ang uso ng bawat isa na "ibinibigay lamang ang buong kakayahan pagkatapos ng screening," at maagang unawain ang mga hadlang sa kwalipikasyon. Ang pagiging mas malakas at mas malakas ng kakayahan ay isang mabuting bagay, ngunit ang matalinong paggamit nito at ang pagkakaroon ng kakayahang bayaran ito ang tunay na husay.

Pinagmulan ng Verdad

(Ang artikulong ito ay isinaayos ayon sa pampublikong impormasyon, ang pagpepresyo ng modelo, magagamit na oras at mga tampok ay napapailalim sa pinakabagong opisyal na anunsyo ng Anthropic; ang mga numero ng third-party testing sa teksto ay minarkahan ng pinagmulan, mangyaring suriin nang mag-isa bago sumipi.)

Mga Madalas Itanong

Ano ang pagkakaiba ng Claude Fable 5 at Mythos 5?

Sila ay magkaibang bersyon ng parehong henerasyon ng kakayahan, at ang pagkakaiba ay nasa "antas ng panganib at openness" at hindi sa performance. Ang Fable 5 ay ang public version na dumaan sa safety processing para sa general users; ang Mythos 5 naman ay may pinaluwag na safety limits at eksklusibo lamang sa mga aprubadong cybersecurity partners ng Anthropic (Project Glasswing) at piling bio-researchers, kaya hindi ito ma-access ng publiko.

Magkano ang Claude Fable 5? Mahal ba ito?

Ang opisyal na presyo ng API ay $10 bawat milyong input tokens at $50 bawat milyong output tokens, na halos doble ng nakaraang flagship na Opus 4.8. Para sa mga enterprise applications na may heavy API calls, mararamdaman ang gastusing ito sa bill. Inirerekomenda ang paggamit ng model tiering at pag-assign ng mga modelo ayon sa hirap ng gawain sa halip na gamitin ang pinakamahal na bersyon sa lahat.

Pwede ko bang subukan ang Claude Fable 5 nang libre?

Mula Hunyo 9 hanggang 22, 2026, ang mga may Pro, Max, Team, at piling enterprise plans ay maaaring gumamit ng Fable 5 nang libre; simula Hunyo 23, kakailanganing gamitin ang credits. Ang mga planong nakabatay sa konsumo ay sinisingil na simula sa araw ng launch. Mas magandang gamitin ang libreng period para i-test ito sa mga mahihirap na task.

Opisyal ba ang sinasabi ng iba na 80.3% sa SWE-Bench Pro?

Hindi. Ang opisyal na inianunsyo ng Anthropic ay ang performance nito sa FrontierCode coding benchmark ng Cognition; ang mga numerong tulad ng "SWE-Bench Pro 80.3%" ay galing sa mga third-party benchmarking organizations at hindi opisyal na inilabas ng kumpanya. Kapag tumitingin ng benchmarks, siguraduhing alamin kung ito ay opisyal o third-party para maiwasang ituring na opisyal na garantiya ang huli.

繁體中文版 →