Gemini 3.5 Pro Inilunsad sa Hunyo: 200 Milyong Token at Deep Think, Itinira ng Google ang 'Pinakamalakas' sa Huli
Sa I/O 2026, inuna muna ng Google ilabas ang 3.5 Flash at itinira ang flagship na Pro hanggang Hunyo. Ngayon, dumating na ang 3.5 Pro sa Vertex AI enterprise preview na may dalang 2 million token context at Deep Think reasoning, ngunit halos sampung beses ang presyo kaysa sa Flash. Paano dapat harapin ng mga developer at negosyo sa Taiwan ang diskarteng ito na "libre muna, saka sisingilin"?
Gemini 3.5 Pro Binuksan na sa Hunyo: 200 Milyong Token at Deep Think, Ibinigay ng Google ang "Pinakamalakas" sa Huling Sandali
Noong Mayo 19, nakatutok ako sa live stream ng Google I/O 2026 sa opisina ko sa Taipei, naghihintay sa bali-balitang Gemini 3.5 Pro. Ang ibinigay lang ng Google ay ang 3.5 Flash, at pagkatapos banggitin ng engineering lead sa main stage ang ilang detalye, mabilis niyang nilagpasan ang Pro: "Sinisikap din naming i-polish nang husto ang 3.5 Pro, ginagamit na ito sa loob ng kumpanya, at inaasahan naming ilabas ito sa susunod na buwan." Ang "susunod na buwan" na ito ay natupad na ngayon—sa Hunyo, dumating ang Gemini 3.5 Pro na may numerong tiyak na magpapabuntong-hininga sa marami: 200 milyong token na context window.
Sinadya kong paghiwalayin ang usaping ito dahil ang mismong pacing ng paglulunsad ng Google ay isang balita na rin. Unang ikinalat ang libreng Flash sa mahigit isang bilyong tao sa buong mundo, at pagkatapos ay inilaan ang Pro—na kumakain ng malaking hardware at may bayad—isang buwan ang lumipas, na inilabas sa dalawang yugto. Hindi ito isyu ng teknolohiya, kundi komersyal na ritmo—at kung susundin ng mga koponan sa Taiwan ang lumang gawi na "maghintay hanggang sa lumabas ang pinakamalakas," malamang na magkakamali sila sa pagtatantya ng timeline.
Background ng Kaganapan
Ayusin muna natin ang timeline. Ang Gemini 3.5 series ay opisyal na inilabas sa Google I/O 2026 noong Mayo 19, oras sa Taiwan, kung saan ang 3.5 Flash ang unang lumabas at naging available sa buong mundo sa parehong araw. Magagamit ito ng mga libreng gumagamit sa pamamagitan ng Gemini App at AI mode ng Google Search, habang ang mga developer ay dumadaan sa Gemini API, Google AI Studio, at Antigravity. Ang pamagat ng opisyal na blog ng Google noong araw na iyon ay tinukoy bilang "frontier intelligence with action" — binibigyang-diin na ang henerasyong ito ng mga modelo ay hindi lamang sumasagot kundi "kumikilos," na nakatuon sa mga kakayahang agentic (ahente) at mga mahahabang proseso ng gawain.
Para naman sa punonggalingang 3.5 Pro, malinaw na sinabi ng Google sa press release na "ilalabas ito sa susunod na buwan." Sa kalagitnaan ng Hunyo, ganito ang sitwasyon: hanggang Hunyo 19, ang 3.5 Pro ay nasa limitadong preview stage pa rin para sa mga customer ng Vertex AI enterprise, at hindi pa nakakarating sa Gemini App ng pangkalahatang mamimili, Google AI Studio, o personal na subscription plans. Sa madaling salita, malamang na Flash pa rin ang ginagamit mo sa iyong mobile app ngayon, hindi Pro.
Mahalaga ang agwat na ito. Maraming artikulo sa merkado ang direktang itinuturing ang "paglulunsad sa I/O" bilang "magagamit ng lahat," ngunit sa katotohanan, bukas lamang ang Pro sa mga umiiral nang Vertex AI enterprise account sa ngayon, at wala pang pampublikong entrance para sa self-registration; kailangan itong talakayin sa account manager ng Google Cloud. Sa proseso ng aking pag-verify, nakita ko ang ilang mga site na may halong espekulasyon na ikinukumpara ito sa mga bali-balita ng mga kakumpitensya; hindi ko gagamitin ang mga bahaging iyon na hindi kumpirmado ng opisyal — ang mga magkakatugmang katotohanan lamang ang aking tatalakayin.
Mga Pangunahing Punto ng Pagkakataong Ito
- 200 Milyong Token Context Window. Ito ay dalawang beses kaysa sa Flash (100 milyon), at isa rin sa pinakamalaking context window sa kasalukuyang inihayag na mass-produced frontier models. Kung iko-convert sa teksto, nangangahulugan ito na ang ilang milyong salita ay maaaring basahin nang sabay-sabay, at ang buong hanay ng mga batas, buong codebase, at daan-daang pahina ng mga ulat sa pananalapi ay maaaring ibigay dito nang sabay-sabay.
- Deep Think Reasoning Mode. Kapansin-pansin ang paraan ng pagpapatupad nito: Ang Deep Think ay hindi isang hiwalay na model endpoint, kundi isang parameter switch (thinkingConfig) sa API. Ang parehong model ID (na iniulat bilang gemini-3.5-pro-preview-06) ay sabay na humahawak sa mga karaniwang kahilingan at malalim na kahilingan sa pag-iisip (deep reasoning), at ang pagkakaiba ay kung binuksan mo ang switch o hindi. Isa itong disenyo na nakakatipid sa oras para sa mga developer, ngunit nangangahulugan din ito na kailangan mong kontrolin ang gastos sa token ng malalim na pag-iisip nang mag-isa.
- Dalawang Yugto ng Paglulunsad: Flash Muna, Bago ang Pro. Ang Flash ay inilunsad nang libre sa buong mundo sa parehong araw, habang ang Pro ay ipinagpaliban ng isang buwan at ibinigay muna sa mga negosyo. Epektibong hinati ng Google ang "mura, sapat ang bilis, at malawak" at ang "pinakamalakas, pinakamahal, at naglilingkod sa mga nagbabayag negosyo muna" sa dalawang magkaibang linya.
- Mga Pangunahing Sukat ng Flash. Ipinapakita ng opisyal na data na nakakuha ang 3.5 Flash ng 76.2% sa Terminal-Bench 2.1, 1656 Elo sa GDPval-AA, at 83.6% sa MCP Atlas. Ang bilis ng output nito ay sinasabing apat na beses na mas mabilis kaysa sa iba pang mga frontier model, at tinalo nito ang nakaraang henerasyong 3.1 Pro sa maraming coding at agent benchmarks.
- Ang Presyo ay Halos Sampung Beses Kaysa sa Flash. Ang pagpepresyo ng Pro na binanggit ng ilang media ay nasa pagitan ng humigit-kumulang $15 bawat milyong input token at $60 para sa output, na humigit-kumulang sampung beses kaysa sa 3.5 Flash. Ang mga unang makakaranas ng Pro ay ang mga subscriber ng buwanang $20 Pro plan at $250 Ultra plan ng Google.
Pagsusuri sa Epekto sa Merkado
Para sa Mga Karaniwang Gumagamit sa Taiwan: Sa totoo lang, sa maikling panahon, hindi mo kailangang mabalisa sa katotohanan na "hindi pa na-upload ang Pro sa App." Para sa pang-araw-araw na paghahanap ng impormasyon, pagsusulat ng mga email, pagsasalin, at pag-aayos ng mga tala sa pagpupulong, libre at mabilis na sapat ang 3.5 Flash—ito ang default na halaga sa App, at ginagamit mo ito sa sandaling buksan mo ito. Ang tunay na senaryo na nangangailangan ng 200 milyong token ay ang mga matitinding pangangailangan kung saan kailangan mong ilagay ang isang buong libro, isang buong kontrata, o isang buong taon ng mga pag-uusap nang sabay-sabay para sa pagsusuri, na bihirang maranasan ng karaniwang tao nang ilang beses sa isang linggo. Ang aking mungkahi ay: pamilyarin muna ang libreng Flash, at maghintay hanggang pumasok ang Pro sa $20 plan bago suriin kung kinakailangang mag-upgrade, nang hindi nagmamadaling sakupin ang enterprise preview ngayon.
Para sa mga Aplikasyon ng Negosyo sa Taiwan: Ito ang tunay na larangan ng digmaan ng paglulunsad na ito. Ang 200 milyong token ay isang tiyak na insentibo para sa pagpoproseso ng mga teknikal na dokumento sa batas, accounting, at pagmamanupaktura — nababasa nito ang buong hanay ng mga SOP, isang buong batch ng mga dokumento ng paghahabol, at ang buong kasaysayan ng mga email ng proyekto nang sabay-sabay nang hindi kinakailangang hatiin at pagdurugtungin ang mga ito. Ngunit may dalawang katotohanan na kailangang isipin nang maaga. Una, ang Pro ay kasalukuyang nakatali sa pagkakakilanlan ng Vertex AI enterprise at walang pampublikong self-service path; kailangan mong makipag-usap sa account manager ng Google Cloud, at ang oras ng pag-setup bago ang pagpapatupad ay dapat isama sa iskedyul ng proyekto. Pangalawa, ang halos sampung beses na mas mataas na presyo ay nangangahulugan na "kung ano ang maaaring malutas ng Flash, huwag pilitin ang Pro." Ang mas pragmatikong arkitektura ay layering: ang malaki at simpleng mga kahilingan ay dumadaan sa Flash, habang ang mga talagang nangangailangan ng malalim na pag-iisip o sobrang habang konteksto ay nire-route sa Pro, upang mapanatili ang mga gastos sa pinakamababang antas.
Para sa mga Developer sa Taiwan: Ang katotohanan na ang Deep Think ay ginawa bilang isang parameter switch ay magandang balita para sa pagpapatupad ng engineering — hindi na kailangang mapanatili ang dalawang set ng mga model route, at ang isang ID ay maaaring gamitin para sa lahat. Ngunit ang "maginhawang pagbukas" ay nangangahulugan din na "madaling makalimutang isara." Ang malalim na pag-iisip ay kapansin-pansing kumakain ng mas maraming token, at ang curve ng gastos ay magiging mas matarik kaysa sa iyong inaasahan. Iminumungkahi ko na itakda ang Deep Think sa sistema upang ma-trigger lamang kapag natugunan ang mga tiyak na kondisyon, sa halip na palaging bukas bilang default. Bilang karagdagan, ang API sa panahon ng preview ng Pro ay maaaring magbago pa, kaya huwag mahigpit na itali ang mga pangunahing proseso ng production environment sa preview version bago ang opisyal na GA. Para sa mga gustong mag-ensayo muna, maaari nilang gamitin ang GA-ed nang Gemini API at Google AI Studio upang i-set up muna ang proseso ng paghawak ng mahabang konteksto, at lumipat nang walang putol kapag binuksan na ang Pro.
Mga Trend sa Hinaharap na Pag-unlad
Naniniwala ako na ang tatlong direksyon ay unti-unting magiging malinaw sa ikalawang kalahati ng taon.
Una, ang arms race ng "haba ng konteksto" ay lilipat mula sa pagpapakita ng galing patungo sa pagiging praktikal. Ang 200 milyong token ay mukhang nakakatakot, ngunit ang tunay na pagsubok ay ang "katumpakan ng pagbawi ng mahabang konteksto" — ang pagkasiksik dito ay hindi nangangahulugang tumpak na mahahanap ito. Ang susunod na lalabanan ng iba't ibang kumpanya ay kung maaari pa rin nilang tumpak na mahanap ang impormasyon sa ilalim ng sobrang habang teksto, sa halip na ang laki lamang ng window.
Pangalawa, ang "hiwalay na paglulunsad" ay magiging karaniwang estratehiya ng mga pangunahing kumpanya. Unang gamitin ang libre at sapat na maliit na modelo upang sakupin ang mga gawi ng gumagamit, at pagkatapos ay ireserba ang punonggalingang modelo para sa mga nagbabayad na negosyo — malinaw itong ipinakita ng Google sa pagkakataong ito. Para sa mga kalaban tulad ng ChatGPT, Claude, at Perplexity, ang panahon ng simpleng paghahambing ng mga parameter ay nagtatapos; ang pinaglalabanan ngayon ay "kung maganda bang gamitin ang libreng tier" at "kung sulit ba ang binabayarang tier."
Pangatlo, ang mga kakayahang agentic (agentic capabilities) ang magiging susunod na dibisyon. Paulit-ulit na binigyang-diin ng Google sa pagkakataong ito ang "intelligence with action," na nangangahulugang ang modelo ay dapat na magawang patakbuhin ang mga multi-step workflow nang mag-isa, tumawag ng mga tool, at tapusin ang mga gawain. Sinuman ang makakapagpagawa sa AI na "tapusin ang trabaho" nang matatag sa halip na "tapusin lamang ang pagsasalita" ang hahawak sa badyet ng negosyo.
Buod at Puna ng TheAI學院
Ang pagbubukas ng Gemini 3.5 Pro sa Hunyo ay sa ibabaw ay isang paglulunsad ng modelo, ngunit sa ilalim ay ang ritmo ng Google: paggamit ng libreng Flash upang palaganapin ang saklaw, at paggamit ng may bayad na Pro upang kumita sa mga negosyo. Ang 200 milyong token at Deep Think ay tunay na kakayahan, ngunit ang "kasalukuyang nasa Vertex AI enterprise preview lamang" ay isa ring tunay na katotohanan; huwag malinlang sa pamagat na "inilabas na sa I/O" at isiping magagamit ito ng lahat.
Puna: Ang pinakamahalagang matutunan ng mga mambabasa sa Taiwan sa pagkakataong ito ay hindi "Naglabas na naman ang Google ng mas malakas na modelo," kundi "Ang parehong kumpanya ay naglabas ng libreng bersyon at ng punonggalingang bersyon na may agwat na isang buong buwan." Para sa mga indibidwal, gamitin ang libreng Flash hanggang sa limitasyon nito; para sa mga negosyo, alamin muna ang hadlang sa pagpapatupad at layered cost ng Vertex AI bago magpasya kung hahabulin ang Pro. Ang mga koponan na marunong mag-save at mag-differentiate ay hindi nananalo dahil sa modelo, kundi dahil sa paggamit.
Mga tiyak na mungkahi para sa mga mambabasa sa Taiwan: Una, gamitin ang libreng Gemini Flash para sa mga pang-araw-araw na pangangailangan ngayon, nang hindi na naghihintay. Pangalawa, kung nais ng isang negosyo ang Pro, suriin muna kung ang 200 milyong token ay talagang kinakailangan, o kung malulutas na ito ng Flash, upang hindi magbayad ng sampung beses na presyo para sa habang hindi naman gagamitin. Pangangatlo, sanayin muna ng mga developer ang proseso ng mahabang konteksto sa GA-ed API. Para sa higit pang paghahambing ng mga tool at paghahati-hati ng mga gawain, maaari mong tingnan ang aming /tools at /tasks.
Ang artikulong ito ay may kaugnayan sa pagpepresyo at mga tampok ng produkto ng third-party. Ang aktwal na nilaborasyon ay batay sa opisyal na anunsyo ng Google, at hindi ito bumubuo ng anumang payo sa pamumuhunan o pagkuha.
Pinagmulan ng Datos
- Gemini 3.5: frontier intelligence with action — Opisyal na Blog ng Google
- Google launches Gemini 3 Flash / Gemini 3.5 serye ng ulat — TechCrunch
- Google's Gemini Omni turns images, audio, and text into video — TechCrunch
Inayos ayon sa pampublikong impormasyon, batay sa opisyal.
Mga Madalas Itanong
Magagamit na ba ng ordinaryong tao ang Gemini 3.5 Pro ngayon?
Hanggang kalagitnaan ng Hunyo 2026, ang 3.5 Pro ay para lamang sa Vertex AI enterprise preview at hindi pa nakakarating sa consumer version ng Gemini App, Google AI Studio, o mga personal subscription plan. Karamihan sa ginagamit ng mga ordinaryong user sa App ay ang 3.5 Flash na nailabas na nang libre sa buong mundo.
Para saan ang 2 million token context ng Gemini 3.5 Pro?
Ang 2 million token ay katumbas ng ilang milyong salita, na maaaring basahin nang sabay-sabay ang buong hanay ng mga batas, buong codebase, o daan-daang pahina ng dokumento. Angkop ito sa mga larangan tulad ng batas, accounting, at pagmamanupaktura na kailangang mag-proseso ng napakahabang dokumento. Dalawang beses itong mas malaki kaysa sa Flash (1 million token) at isa sa pinakamalaking context sa kasalukuyang mga na-publish na production frontier model.
Paano gumagana ang Deep Think mode?
Ang Deep Think ay hindi ibang modelo, kundi isang parameter switch (thinkingConfig) sa API. Ang parehong model ID ay naglilipat sa pagitan ng standard o deep reasoning depende kung naka-on ito. Maginhawa ito, ngunit ang deep reasoning ay malaking magdaragdag sa gastusin sa token, kaya inirerekomendang magtakda ng mga kondisyon para sa pag-trigger nito sa halip na laging naka-on.
Ano ang pinagkaiba ng 3.5 Flash at 3.5 Pro, at alin ang dapat kong gamitin?
Ang Flash ay libre nang nailabas sa buong mundo, mabilis, at angkop sa karamihan ng mga pang-araw-araw at maramihang request; ang Pro ang pinakamalakas at may pinakamahabang context, ngunit ang presyo ay halos sampung beses kaysa sa Flash at kasalukuyang para lamang sa enterprise preview. Ang praktikal na paraan ay ang paghahati-hati: gamitin ang Flash para sa mga simpleng request, at i-route lang sa Pro kapag kailangan talaga ang deep reasoning o napakahabang context.