AI NPC at Interaktibong Kuwento: Panimula sa Disenyo ng Usapan para "Mabuhay" ang mga Character sa Laro

Posible nang teknikal na hayaang mag-react agad ang NPC sa bawat sinasabi ng player, pero ang hamon ay ang gastos, lag, at pagpapatahimik sa character kapag kailangan. Alamin ang 4 na bloke ng LLM NPC, ang pagpili sa pagitan ng Convai at Inworld, prompt template para sa personalidad, at kung paano kuwentahin ang araw-araw na gastos bawat player sa isang komprehensibong gabay.

Noong Miyerkules ng hapon, sa conference room ng isang 20-person game studio sa Neihu, Taipei, iniabot ng narrative designer na si Lin Zi-xuan ang controller sa producer. Sa demo, sinabi ng player sa may-ari ng tavern: "Yung utang ng kapatid mo, binayaran ko na." Dalawang segundong natahimik ang may-ari, lumambot ang boses, at binagsak sa kalahati ang presyo ng alak—ang pag-usapang ito ay wala sa anumang script; agad itong binuo ng language model. Tatlong segundong natahimik ang conference room, at ang unang sinabi ng producer ay hindi "Astig nito!", kundi: "Magkano ang gastos para sa ganitong linya?"

Ang dalawang reaksyong ito ay ang buong larawan ng LLM NPCs ngayong 2026: sa karanasan, isa talaga itong mahika; sa bayarin, kailangan talaga itong kalkulahin nang husto. Tatalakayin ng artikulong ito ang mga prinsipyo, tool, pagsusulat ng prompt, at ang mga gastusin at delay na ayaw pag-usapan ng iba.

Apat na bloke ng gusali ng LLM NPC: Persona, Memory, Kaalaman, at Guardrails

Ang pag-saksak ng ChatGPT sa isang laro ay hindi nangangahulugang AI NPC na ito. Ang isang LLM NPC na handang i-launch ay may hindi bababa sa apat na layer. Ang system prompt (persona card) ay nagdedefina kung sino ang character, tono ng pagsasalita, alam nito, at kung ano ang hinding-hindi nito gagawin. Naaalala ng memory ang ginawa ng player noong nakaraan—sa praktika, ito ay ang pag-save ng chat summary at pagbabalik nito sa context sa tuwing tatawagin, kung hindi ay magiging parang amnesiac ang NPC. Gumagamit ang knowledge base ng RAG para i-connect ang setting ng mundo. Kapag nagtanong ang player na "Sino ang nanalo sa digmaan sa hilaga?", ang sagot ay kinukuha mula sa setting document sa halip na paggawa-gawang kwento ng model, katulad ng prinsipyo ngAno ang RAG.

Ang guardrails ang pinakamahalaga at madalas makaligtaan: hindi pwedeng mag-spoiler ang NPC sa main story, hindi pwedeng madaya ng player para makuha ang solusyon ng quest, at hindi pwedeng mahikayat na magsabi ng mga bawal na content. Nag-aquire din ang Steam ng mekanismo ng pag-report ng player para sa real-time generated content—ang guardrails ay hindi opsyonal, ito ay kundisyon para makapag-publish.

Paano pumili ng tools: Mas madali ang integration suites, mas mura kung ikaw ang mag-aayos

Kung gusto mo ng boses, lip-sync, at engine integration na sabay-sabay, tingnan ang dalawang ito.Nag-aalok ang Convai ng SDK para sa Unity at Unreal na kasama ang usapan, kilos, at boses, at may libreng plano; ang indie developer plan ay nagkakahalaga ng $29 bawat buwan para sa tatlong libong pakikipag-ugnayan (kung saan ang 1,500 ay pwedeng gamitin para sa flagship models)—sapat na para sa prototyping, pero kailangang kalkulahin muli para sa opisyal na operasyon. Ang Inworld AI ay lumipat sa real-time voice AI at agent execution framework sa nakaraang dalawang taon, at lumipat sa pay-as-you-go pricing, na may voice synthesis na nagsisimula sa $5 bawat milyong characters at latency na binaba sa ilalim ng 200 milliseconds. Ang Microsoft at Disney ay mga investor, kaya angkop ito para sa mga koponang malakas ang kakayahan sa engineering.

Para sa mga interactive dramas na nakatuon sa naratibo, maaari mong tingnan ang Charisma AI, na gumagamit ng hybrid na paraan ng plot trees at AI improvisation. Tungkol naman sa Character.AI, maaari itong gamitin sa pagsubok ng pakiramdam ng persona at pagkuha ng inspirasyon sa usapan, pero huwag umasang ikokonekta ito sa mga pormal na produkto.

Madali ring ikonekta ang mga text-based NPC sa pamamagitan ng pag-call ng API:OpenRouter para magpalit ng mga modelo gamit ang isang susi,Groq para sa bilis ng pag-iisip na angkop sa real-time chat, at ang offline single-player games ay maaari pang gumamit ng Ollama para magpatakbo ng maliliit na modelo sa computer ng player nang walang gastos sa API. Para sa multi-model management, maaari mong gamitin ang LiteLLM para sa pinag-isang interface. Bago magsimula, maaari mong basahin ang AI Agent Toolchain Practical Combat.

Disenyo ng Prompt: Panatilihin ang Persona ng Character

Ang pinakamalaking pagkakaiba sa pagitan ng NPC prompt at chatbot prompt: ang hindi mo kailangan ay ang pagsagot sa lahat, kundi ang "hindi pagsagot sa dapat hindi sagutin." Ganito ang hitsura ng isang praktikal na istruktura:

Ikaw si Maldita, ang may-ari ng "Iron Anchor Tavern," 52 taong gulang, balo, diretsong magsalita na may puntong pantalan, may delikadesa pero malambot ang puso.

【Ang alam mo】Mga tsismis sa tavern, mga tsismis tungkol sa smuggling sa pantalan (ibinubunyag lamang sa mga suki), at ang utang ng namatay mong asawa sa kapitan.
【Ang hindi mo alam】Pulitika sa royal city, mga prinsipyo ng mahika, o anumang pangalan ng lugar na hindi mo pa kailanman narinig—kung itatanong, sabihin na hindi mo alam, at huwag gumawa-gawa.
【Mahigpit na Ipinagbabawal】I-reveal ang sekreto sa silong (maliban na lang kung ipapakita ng player ang singsing ng kapitan), pag-usapan ang mundo sa labas ng laro, o aminin sa anumang paraan na ikaw ay isang AI.

【Format ng Output】Ibalik ang JSON:
{"dialogue": "linya, wala pang 50 salita", "emotion": "pumili sa warm/neutral/hostile",
"action": "give_discount/refuse_service/none pumili ng isa"}

Pabor ng Player: {{affinity}}/100. Mas mababa sa 30, ang tono ay malamig at mag-iingat.

Tatlong natutunan mula sa aktwal na paggamit. Una, ang pag-output ng structured JSON ay nagpapahintulot sa game logic na basahin ang emotion at action fields para i-drive ang mga ekspresyon at kilos, na mas maaasahan kaysa sa pag-parse ng natural language. Pangalawa, ang "sabihin na hindi mo alam ang mga bagay na hindi mo alam" ay kailangang isulat nang malinaw; kung hindi ito isusulat, tiyak na gagawa ang modelo. Pangtatlo, ang bawat guardrails ay dapat may kasamang mga kondisyon ng eksepsiyon, kung hindi ay hawak na ng player ang singsing at nagkukunwari pa rin ang may-ari ng tavern. Para sa higit pang mga template ng character persona, maaari mong bisitahin ang Prompt Library.

Gastos at Delay: Kalkulahin muna ang Benta, Pagkatapos ay Mangarap

Magkalkula tayo. Ang isang tawag sa NPC dialogue, kasama ang persona card, memory summary, at chat history, ay may input na humigit-kumulang 1,500 tokens at output na humigit-kumulang 150 tokens. Gamit ang flagship model, ang gastos sa bawat beses ay mga NT$0.2 hanggang NT$0.5, na mukhang mura; kapag pinarami ito sa "sandaang libong players, bawat isa ay nakikipag-usap sa NPC ng 30 beses araw-araw," ito ay nagiging daan-daang libong piso na bayarin araw-araw. Ang komersyal na solusyon sa laro ay ang paghahati-hati sa mga layer: 90% ng walang kwentang usapan ay gumagamit ng mura at mabilis na maliliit na modelo (open-source models sa Groq, murang APIs tulad ng DeepSeek), habang ang mga pangunahing NPC sa kwento ay gumagamit ng flagship; ang mga madalas itanong ay direktang kina-cache, at ang player na nagtatanong kung "Nasaan ako" ay hindi kailangang magsunog ng tokens sa bawat pagkakataon.

Ang delay ay isa pang pader. Sa text chat, kayang tiisin ng player ang isang segundo; sa voice chat, ang higit sa 500 milliseconds ay magsisimula nang maging awkward. Ang kumpletong linya ay binubuo ng tatlong bahagi: speech recognition, LLM, at speech synthesis, at ang bawat bahagi ay kailangang i-stream: ang LLM ay naglalabas ng bawat token, ang TTS ay nagsasalita ng bawat pangungusap, at huwag hintaying matapos ang buong teksto bago magsalita. Para sa mga sitwasyon na masama ang network o sira ang server, maghanda ng pre-written dialogue bilang fallback—kapag nadiskonekta ang LLM, ang NPC ay bababa man lang sa canned lines at hindi tatayo nang diretso at mag-crash.

Ang pangunahing sagot sa 2026 ay ang hybrid na disenyo: ang main storyline ay manu-mano pa ring isinusulat para mapanatili ang kalidad ng naratibo; ang LLM ay responsable para sa side quests, environmental reactions, at malayang pagtatanong ng player. Hayaang punan ng AI ang "pakiramdam ng pagiging buhay," sa halip na palitan ang mga writer.

TheAI Academy Buod at Puna

Ang teknolohiya ng LLM NPC ay narito na; ang mahirap ay ang discipline sa disenyo: ang persona card ay kailangang magsulat kung "ano ang hindi alam," ang guardrails ay dapat may mga exception conditions, ang mga gastos ay dapat i-layer, ang latency ay dapat i-stream, at ang pag-crash ay dapat may fallback. Sa pagitan ng kamangha-manghang demo at ng katatagan ng pag-launch, nakatayo ang limang gawaing ito sa engineering. Para sa mga gustong magsimula, gumamit muna ng text-based NPC at sariling koneksyon sa API para patakbuhin ang isang character, pagkatapos ay magpasya kung gagamit ng integrated platform. Para sa sining at pangkalahatang pag-unlad, samahan ito ng AI Game Art Assets Guide at Solo Game Dev Roadmap.

Isang pangungusap na puna: Ang pinakamahirap sa AI NPC ay hindi ang pagpapareho sa character na makapag-usap tungkol sa lahat, kundi ang pagpapasara nito kapag "dapat nang tumahimik"—ang disenyo ng guardrails ay ang totoong husay.

Mga tiyak na mungkahi para sa mga mambabasa: Ang mga indie developer ay nagsisimula sa single-player text NPC, gumagamit ng Ollama para patakbuhin ang maliit na modelo sa lokal na makina nang walang gastos para mag-ensayo; ang mga katamtamang koponan ay gumagamit muna ng libreng plano ng Convai para gumawa ng isang vertical slice, i-verify na ang mga player ay talagang makikipag-usap nang malalim sa NPC, at saka pag-usapan ang pagpapalaki nito; sa pagkalkula ng gastos, gamitin ang "gastos sa pakikipag-usap ng bawat player bawat araw," at huwag aliwin ang sarili sa pamamagitan ng pagtingin sa solong gastos ng demo.

Mga Madalas Itanong

Mahal ba ang magpatakbo ng AI NPC?

Nasa ilang sentimo o piso lang ang bawat usapan, pero lumalaki ito kapag dumami ang players at messages. Ang karaniwang solusyon ay layering: maliit na modelo para sa tsika, flagship model para sa mahahalagang eksena, at caching para sa mga paulit-ulit na tanong.

Kailangan ba talagang gamitin ang Convai o Inworld sa paggawa ng AI NPC?

Hindi naman. Pwedeng gumawa ng text-based NPC sa pamamagitan ng pag-connect sa mga API (OpenRouter, Groq); pero kung kailangan ng boses, lip-sync, at malalim na integrasyon sa game engine, mas makakatipid sa oras ang mga platform na ito.

Paano pipigilan ang mga player na "sirain" o abusuhin ang NPC?

Ilagay nang malinaw ang mga bawal at exception sa persona prompt, ipasa ang output sa structured JSON para ma-check ng game logic, mag-red team test bago mag-launch, at nag-aatas din ang Steam ng report mechanism para sa real-time generated content.

Pwede bang gumawa ng AI NPC sa mga offline o single-player game?

Pwede. Gamitin ang Ollama para magpatakbo ng quantized small model sa PC ng player nang offline, zero API cost pa; ang kapalit lang ay medyo mahina sila sumunod sa persona kaya mas mahigpit na guardrails ang kailangan, at maghanda rin ng pre-written dialogues bilang backup.

繁體中文版 →