Trying Out Matt Pocock's /grill-me Skill in Hermes Agent
สรุปย่อ
ประเด็นสำคัญจากวิดีโอ
- **ช่อง:** Tonbi's AI Garage · **ความยาว:** ~18 นาที · **ลิงก์:** https://www.youtube.com/watch?v=HYlcTeH9VXE
# สรุป: Trying Out Matt Pocock's /grill-me Skill in Hermes Agent - **ช่อง:** Tonbi's AI Garage · **ความยาว:** ~18 นาที · **ลิงก์:** https://www.youtube.com/watch?v=HYlcTeH9VXE ## ประเด็นหลัก - /grill-me เป็น skill ยอดนิยมจาก repo mattskills ของ Matt Pocock (อดีตพนักงาน Vercel และผู้ดูแล AI Hero.dev) ที่ไว้ใช้ "ตั้งคำถามไล่เลียง" (grill) ผู้ใช้ก่อนเริ่มโปรเจกต์ - วัตถุประสงค์หลักคือทำให้ผู้ใช้และ agent มี "วิสัยทัศน์และโฟกัสเดียวกัน" (alignment) ก่อนที่จะเริ่ม implement - มีสองเวอร์ชัน: /grill-me สำหรับไอเดียทั่วไป และ grill-with-docs ซึ่งเพิ่มการสร้าง doc, ADR และ glossary ระหว่างทำ - Tonbi ทดลองใช้ /grill-me กับโปรเจกต์จริงคือเกมจำลอง AI lab ชื่อ "Frontier Labs" ที่ผู้เล่นต้องสร้างสมดุลทรัพยากร และเรียนรู้เรื่อง AI ไปด้วย - skill ถามคำถามทีละข้อ พร้อมคำแนะนำ โดยเริ่มจาก gameplay ไล่ไปถึง tech stack และโมเดลธุรกิจ - รวมทั้งหมด 71 คำถาม ใช้เวลาประมาณ 42 นาที เพื่อให้ได้ shared understanding ของโปรเจกต์ - skill มีตัวจับเวลา 120 วินาทีต่อคำถาม หากผู้ใช้ไม่ตอบจะเลือกตามคำแนะนำให้ - โมเดลจดจำคำตอบทุกข้อได้ และสามารถตรวจจับข้อขัดแย้งระหว่างคำตอบเก่ากับใหม่ได้ - skill ไม่ได้สร้าง implementation plan อัตโนมัติ ต้องขออย่างชัดเจนถึงจะสร้างให้ - เมื่อขอแล้ว skill จะสร้างแผนในไฟล์ markdown ที่มี task timeline ละเอียดครบถ้วน - เหมาะกับโปรเจกต์ที่ต้องการความชัดเจนตั้งแต่ต้น แต่ต้องเผื่อเวลาไว้สักชั่วโมงเพราะต้องคิดและตอบเยอะ ## ความเห็นสรุป /grill-me skill มีประโยชน์มากสำหรับโปรเจกต์ที่ยังไม่มีวิสัยทัศน์ชัดเจน เพราะช่วยขับให้เราตัดสินใจเรื่องสำคัญตั้งแต่ตอนเริ่ม และทำให้เรากับ agent เข้าใจตรงกัน อย่างไรก็ตามต้องเผื่อเวลาและความอดทน เพราะการถามตอบอาจยาวนานกว่าที่คิด ในภาพรวมถือว่าคุ้มค่าสำหรับโปรเจกต์ที่ต้องการการวางแผนที่ดีตั้งแต่แรกครับ
คำแปลเต็ม
แปลตามบทสนทนาต้นฉบับ ปรับเป็นภาษาไทยธรรมชาติ
skill สำหรับ agent ที่กำลังเป็นที่นิยมมากที่สุดอันหนึ่งตอนนี้อยู่ใน repo นี้ครับ และนี่เป็นของ Matt Pocock เขาเป็นคนที่ดูแลเว็บไซต์ AI Hero.dev ที่ให้เรียนรู้เกี่ยวกับ AI engineering และเคยเป็นพนักงานเก่าของ Vercel มาก่อน เขามี repo ยอดนิยมบน GitHub ชื่อว่า mattskills ซึ่งมี skill หลายตัวด้วยกัน ตัวที่เป็นที่นิยมที่สุดและเป็นตัวที่เราจะมาลองใช้กันวันนี้ก็คือ grill-me skill ครับ
เขาอธิบายเรื่องนี้ไว้ข้างล่างนะครับ มีตัวเลือกหลายตัว แต่ที่คนพูดถึงกันมากที่สุดก็คือ /grill-me หรือ grill-with-docs ซึ่งคล้ายกันแต่จะก้าวหน้ากว่านิดหน่อย เขาบอกว่า skill เหล่านี้ช่วยให้เรา "align" หรือสามัคคีความเข้าใจกับ agent ก่อนเริ่มโปรเจกต์ และช่วยให้คิดให้ลึกซึ้งขึ้นเกี่ยวกับการเปลี่ยนแปลงที่กำลังจะทำ
คีย์เวิร์ดสำคัญตรงนี้ก็คือ align หรือ alignment ครับ เขาบอกว่า "skill นี้มีประโยชน์หลักในการทำให้แน่ใจว่าคุณในฐานะ dev และ agent รู้ว่ากำลังทำอะไรอยู่ มีวิสัยทัศน์และโฟกัสเดียวกัน" ซึ่งผมว่ามีประโยชน์มากครับ เวลาเริ่มโปรเจกต์ใช่ไหมครับ หลายครั้ง agent จะรีบวิ่งเข้าไปเริ่มสร้างของเลยโดยไม่มีวิสัยทัศน์ร่วมที่ชัดเจน แล้วเราก็เสียเวลาและเสีย token ไปเยอะมากในช่วงแรก แค่พยายามจะทำความเข้าใจกันและดึงกันให้อยู่ในหน้าเดียวกัน
ผมเลยสนใจอยากลองใช้ดูครับ และในวิดีโอนี้ผมจะเอาไปใช้กับโปรเจกต์จริงที่กำลังทำอยู่ เราจะมาดูกันว่าเป็นยังไง เริ่มกันเลย
สำหรับใครที่เอา agent ไปใช้เองและอยากเข้าถึง LLM wiki ที่ผมเองใช้ทำวิดีโอเหล่านี้เพื่อค้นคว้าและสร้างเนื้อหาจริง ๆ ลองแวะดูโปรเจกต์ของผมได้ที่ agentwiks.com นะครับ ผมให้ wiki เหล่านี้ทั้งหมดฟรีในหัวข้อต่าง ๆ มากมาย และก็สมัคร pro account ได้ในราคา 9.99 ดอลลาร์ต่อเดือน จะได้เข้าถึง wiki ขนาดใหญ่พิเศษที่มีหน้ามากกว่าและรายละเอียดเยอะกว่าในแต่ละหัวข้อ
กลับเข้าสู่วิดีโอครับ อย่างที่เห็นใน repo หน้า skills ภายใต้หมวด productivity ผมคิดว่า คือ grill-me agent skill ครับ และมันพัฒนามาจาก grilling ซึ่งเป็นอีก skill หนึ่ง คำอธิบายคือมันจะ "ตั้งคำถามไล่เลียงผู้ใช้อย่างไม่ยั้ง" เกี่ยวกับแผน การตัดสินใจ หรือไอเดีย ให้ใช้เมื่อผู้ใช้ต้องการทดสอบความคิดของตัวเอง หรือเมื่อใช้ trigger phrase ที่เกี่ยวกับการ grill ดังนั้นไม่จำเป็นต้องใช้ตอนเริ่มโปรเจกต์เสมอไป เวลาตัดสินใจหรือปรับทิศทางอะไรบางอย่างก็เอามาใช้ได้เหมือนกันครับ
พวกนี้อยู่ในหมวด productivity ครับ ส่วนในหมวด engineering จะมี grill-with-docs ซึ่งเป็นการสัมภาษณ์อย่างไม่ยั้งเพื่อลับแผนหรือดีไซน์ให้คมขึ้น และยังสร้าง doc, ADR (Architecture Decision Record) และ glossary ไปด้วยระหว่างทำ ตัวนี้เหมาะมากเวลาอยากแชร์ศัพท์เฉพาะทางและภาษากับ agent ไปเรื่อย ๆ ซึ่งน่าจะมีประโยชน์มากครับ มันเลยใช้ควบคู่กับ domain-modeling skill ที่ใช้สร้างและลับ domain model ของโปรเจกต์ เรามาเริ่มกันเลย
เราจะทำสิ่งนี้ใน Hermes Agent ด้วย GPT-5.6 Sol นะครับ มาดูกัน เริ่มรันแล้วตรงนี้ ผมพิมพ์ว่าให้ติดตั้ง grill skill จาก repo นี้ได้ไหม ระหว่างที่มันกำลังทำอยู่ ขออธิบายก่อนว่าโปรเจกต์นี้คืออะไร มันชื่อชั่วคราวว่า Frontier Labs ครับ ผมมีไอเดียอยากทำเกมจำลองสถานการณ์แบบ Sim City ยกเว้นว่าผู้เล่นจะเป็น AI lab ที่ต้องแข่งขันกับ AI lab อื่น ๆ และต้องสร้างสมดุลระหว่างทรัพยากรต่าง ๆ เห็นได้ชัดว่าต้องรักษาสมดุลงบประมาณ ว่าจะลงทุนด้านการตลาดเท่าไหร่ เทียบกับ compute เทียบกับการเทรนโมเดล แนวคิดคือให้เป็นเกมที่สนุกในฐานะเกมจำลองสถานการณ์ แต่ก็สอนเรื่อง AI ไปด้วยได้ เพราะส่วนหนึ่งของการเทรนคือเราเลือกโมเดลประเภทต่าง ๆ และวิธีการเทรนที่ต่างกันได้ เช่น จะเทรน image model ได้ แล้วผ่านกระบวนการนั้นก็จะได้เรียนรู้เรื่อง diffusion model เป็นต้น
เอาล่า ติดตั้งเสร็จแล้วครับ ได้เรียนรู้เรื่องโมเดลต่าง ๆ แบบนี้นะครับ นั่นคือแนวคิดครับ ให้เป็นเกมแต่ก็มีสาระการศึกษาไปด้วย ตอนนี้มันขึ้นมาแล้ว ผมไม่ต้องใช้ reload skills เสียด้วยซ้ำ งั้นมาลอง grill-me กัน เรียก skill ได้เลย ในหมวด productivity หัวข้อ grilling มาเริ่มกันเลยครับ "คุณอยากให้ผมตั้งคำถามไล่เลียงเรื่องแผน ดีไซน์ การตัดสินใจ หรือไอเดียอะไน"
ผมก็ใส่ prompt อธิบายไอเดียเกมจำลองสถานการณ์ที่มี แค่เป็นคำตอบกลับแบบกว้าง ๆ ครับ Hermes ถามต่อว่าใครคือผู้เล่นกลุ่มเป้าหมายหลัก คงไม่ใช่คนเทคนิคหรอก ผมว่าน่าจะเป็นผู้ใหญ่ทั่วไปที่ไม่ใช่สายเทคนิค และนักเรียนที่โตแล้วมากกว่า ตัวเลือกที่มันแนะนำก็คือตัวนี้แหละ ใช้อันนั้นครับ คำถามต่อมา: อะไรคือนิยามของการชนะในรอบมาตรฐาน ผมคิดว่านี่คงเป็นรูปแบบการ grill ใช่ไหมครับ คือถามไปเรื่อย ๆ หรือถ้าใครเคยใช้ Claude Code ก็จะคุ้นเจอคำถามประมาณนี้บ้างเป็นบางครั้ง "อะไรคือนิยามของการชนะในรอบมาตรฐาน" ส่วนตัวผมคิดว่า "สมดุลย์สูงสุด" ก็คือคะแนนสมดุลที่ดี รวมกำไร ความสามารถ ความปลอดภัย และชื่อเสียง น่าจะดีที่สุดใช่ไหมครับ เพราะเราอยากให้สมดุล ไม่ใช่แค่ส่วนแบ่งตลาดอย่างเดียว เวลาในเกมควรจะเดินไปอย่างไร น่าจะเป็นแบบ turn-based ครับ ไม่รู้ว่ามันจะถามกี่คำถาม แคมเปญค่าเริ่มต้นควรยาวแค่ไหน ลองใช้คำแนะนำดูครับ ห้าปี ซึ่งเป็นเวลานานมากในวงการ AI เลยนะ เกมจำลองสถานการณ์ควรใช้บริษัทจริงหรือ AI lab สมมติ ผมบอกว่าเป็นเกมจำลองสถานการณ์นะ ไม่อยากเจอปัญหาเรื่อง IP เลยครับ
ผู้เล่นควรควบคุมการพัฒนาโมเดลมากแค่ไหน ผมเลือก strategic control เพิ่มชั้นเทคนิคที่มีความหมายอีกไม่กี่ชั้นต่อโมเดล การจัดการทรัพยากรควรละเอียดขนาดไหน เลือกแบบ layered ครับ มีทรัพยากรหลักห้าตัว แล้วมีตัวอื่น ๆ โผล่ขึ้นมาตามบริบท คำถามต่อมา โปรเจกต์โมเดลควรพัฒนาจากไอเดียสู่ผลิตภัณฑ์อย่างไร ผมว่าเราอยากได้ pipeline ที่มองเห็นได้นะครับ scope, prepare data, train, evaluate, launch, operate ไล่ไปแบบนี้ แล้วก็ตั้งคำถามว่า "ส่วนแบ่งตลาดหมายถึงอะไรในเชิงกลไกเกม" ตอนนี้เราถามมากี่คำถามแล้วนะ มัน grill จริง ๆ เนี่ย
โอเค นั่นคือ 10 คำถามครับ ผมจะไม่พาดูทุกคำถามเพราะอาจจะน่าเบื่อ แต่จะมาบอกเมื่อมันถามจบ ตอนนี้เราอยู่ที่ 15 คำถามแล้ว และยังพูดกันแค่ในส่วนของ gameplay ยังไม่มีอะไรเกี่ยวกับการสร้างเกมในเชิงเทคนิคเลย แต่สิ่งที่ค่อนข้างดีและผมชอบก็คือ ไอเดียนี้ไม่ใช่แค่สิ่งที่คุณได้ยินผมอธิบายไปตอนต้นใช่ไหมครับ มันยังไม่ได้มีรายละเอียดเต็มที่ แต่มันกำลังเจาะเข้าไปในรายละเอียดของตัว gameplay เองที่ผมยังไม่ได้คิด และมันกำลังบังคับให้ผมตัดสินใจเรื่องพวกนี้ตั้งแต่ตอนเริ่ม ซึ่งก็ดีจริง ๆ ปกติผมจะปล่อยให้มันกว้าง ๆ ไว้แล้วปล่อยให้ agent หรือโมเดลเป็นคนหาทางออกเอง แต่ตัวนี้ค่อนข้างบังคับให้ผมกลั่นกรองวิสัยทัศน์ให้คมขึ้นอีกก่อนที่จะมีการสร้างอะไรจริงจัง
จะเห็นว่าหลังแต่ละคำถามมันจะมีคำแนะนำประกอบเสมอ และโดยรวม ตอนนี้ผมผ่านมาเกือบ 20 คำถามแล้ว คำแนะนำมักจะค่อนข้างดีครับ และเราใช้ GPT-5.6 Sol อยู่ แต่ส่วนใหญ่ผมเลือกตามคำแนะนำในเคสส่วนใหญ่ครับ
ตอนนี้อยู่ที่คำถามที่ 24 แล้ว เริ่มเข้าสู่ส่วนที่เป็นเทคนิคหรือนอก gameplay มากขึ้นแล้ว มันถามว่าแพลตฟอร์มแรกที่จะ release ควรเป็นอะไร และคำตอบคือเกมบนเว็บ ครับ เริ่มออกจากรายละเอียดของตัวเกมเองและเข้าสู่ด้านเทคนิคจริง ๆ ของตัวเกมมากขึ้น คำถามถัดไป: เกมควรมีหน้าตาและความรู้สึกแบบไหนแบบ real-time? มันแนะนำแบบ hybrid command center — dashboard สำหรับทรัพยากรและตลาด, visual pipeline สำหรับโปรเจกต์, และ model card ที่แตกต่างกันชัดเจน
ผมไม่แน่ใจเท่าไหร่ อ้าว หมดเวลาไปแล้วครับ มันมีตัวจับเวลาอยู่นะครับ ผมยุ่งคุยและดูของอยู่ แต่เพราะเราไม่อยากติดอยู่กับคำถามเดิมนานเกินไป หลังจาก 120 วินาที agent จะตัดสินใจเอง โดยเลือกไปตามคำแนะนำ มันเลือกแบบ hybrid command center ซึ่งผมก็ปรับแก้ได้ภายหลังถ้าต้องการครับ โอเค งั้น milestone แรกของการพัฒนาควรเป็นอะไร milestone แรกของเราจะเป็น paper ที่เราต้องการ คือเกมบนเว็บที่ฟีเจอร์ครบ ขัดเกลา เป็น public demo ที่สื่อถึงประสบการณ์สุดท้ายที่ต้องการ ผมว่าทำแบบ demo ขั้นต่ำก็พอ
ผมรู้สึกเหมือนว่า agent พยายามจะทำงานน้อยที่สุดเสมอ มักจะอยากสร้าง MVP แทนที่จะสร้างผลิตภัณฑ์จริง ตอนนี้เลยเริ่มเจาะเข้าไปที่การขัดเกลา deliverable ตัว MVP มากขึ้น มีเคสที่น่าสนใจนะครับ ตอนที่ถามเรื่องกลุ่มลูกค้า มันแนะนำกลุ่มที่แคบกว่า แต่ผมบอกว่าทำทั้ง 6 กลุ่มเลย แล้วคำถามถัดไปมันบอกว่านั่นขัดกับวัตถุประสงค์ของ vertical slice ที่แคบ มันเลยพยายามดึงผมเข้าหาคำแนะนำของมัน
เริ่มทำอย่างอื่นแล้ว จบคำถามหรือยังนะ อ่อ ยังครับ เริ่มเข้าสู่ส่วน tech stack แล้ว ตอนต้นเราคุยกันเรื่อง gameplay แล้วก็ปรับขอบเขตของ MVP demo และตอนนี้เรามาถึง tech stack นี่คือคำถามที่ 33 ครับ สำหรับใครที่ติดตามอยู่บ้าน ต้องบอกว่าคำแนะนำบางข้อค่อนข้างคิดมาดีเลยนะครับ จริง ๆ มันไม่ได้ขี้เกียจเลย ผมเคยบอกว่ามันอาจจะขี้เกียจก็จริง แต่แทนที่จะเลือกทางง่ายสุด อันนี้ถามว่า dimension ของความสามารถควรวัดอะไร แทนที่จะดูแค่ benchmark เฉย ๆ คำแนะนำของมันซึ่งผมก็เห็นด้วยก็คือ ให้เป็นความสามารถที่มีประโยชน์แบบถ่วงน้ำหนักตามตลาด กระจายไปทั่ว portfolio ซึ่งจะป้องกันไม่ให้โมเดลที่เก่งแค่ benchmark เดียวมาครองคะแนน และให้รางวัลกับความเชี่ยวชาญที่มีความหมายจริง ๆ คำแนะนำของมันค่อนข้างคิดมาดีจริง ๆ ครับ
นี่เป็นอีกเคสที่มันจับข้อขัดแย้งในการออกแบบได้ เพราะก่อนหน้านี้หลายสิบคำถามมาแล้ว ผมบอกว่า MVP หรือ vertical slice ที่เรียงว่าอยากแค่ภาษาเท่านั้น แต่ในคำถามล่าสุดผมบอกว่าอยากให้เกมสอนความแตกต่างทางสถาปัตยกรรมระหว่างโมเดลภาษา ภาพ และเสียง มันเลยกำลังจะแก้ข้อขัดแย้งนั้น ซึ่งน่าสนใจมากครับ โมเดลสามารถจดจำคำตอบของทุกคำถามได้ และมาชี้ให้เห็นเมื่อมีข้อขัดแย้งแบบนี้ได้
ตอนนี้เราอยู่ที่คำถามที่ 52 ครับ ค่อนข้างละเอียดมาก ตอนนี้คำถามที่ 70 และเริ่มเข้าสู่โมเดลธุรกิจของเกมที่ผมต้องการ มันแนะนำให้เป็น prototype สาธารณะฟรี โดยตัดสินใจเรื่องโมเดลธุรกิจทีหลังหลังจาก validation แล้ว ผมว่าน่าจะถูกต้องครับ ตัวเกมจะฟรีเอง แต่ถ้าผมต้องทำให้มัน monetize ได้ในภายหลังเพื่อหาทุน ค่อยหาทางทีหลังก็ได้ อาจจะมีฟีเจอร์ premium เล็ก ๆ น้อย ๆ บางอย่าง
โอเค เราผ่านคำถามมา 70 ข้อแล้ว และอย่างที่เห็นตอนนี้เข้าสู่นาทีที่ 40 กว่า ๆ แล้ว ผมตัดส่วนที่ซ้ำ ๆ ออกไปเยอะ แต่ก็เป็นคำถามแนวเดียวกัน แต่เจาะลึกเข้าไปในรายละเอียดของเกมและ gameplay และ tech stack เลย อันนี้ยังถามด้วยว่าเราจะเก็บข้อมูลจาก public playtest ได้อย่างไรโดยไม่มี backend หรือระบบบัญชี คำตอบคือทำเป็น opt-in
ตอนนี้มาถึงคำถามที่ 71 แล้ว มันถามว่า "เราถึงความเข้าใจร่วมกันของเกมและ vertical slice แล้วหรือยัง" คำแนะนำคือ "ใช่ ถ้านี่สะท้อนถึงผลิตภัณฑ์ที่ตั้งใจจะทำ การยืนยันจะเป็นการจบช่วง grilling แต่ผมจะไม่เริ่ม implement จนกว่าคุณจะขอให้ผมทำต่างหาก" ดังนั้นถ้าตอบ "ใช่" มันก็จะจบ นี่คือความเข้าใจร่วมกันของเรา ผมว่าตอนนี้เรามีวิสัยทัศน์ที่ค่อนข้างชัดเจนแล้วนะครับ ทั้งหมดนี้คือ 71 คำถาม ใช้เวลา 42 นาที ถ้าเลือกที่จะให้มัน grill ต่อหรือแก้ไขก็ทำได้ แต่ผมว่าที่ได้มานี่ดีพอแล้วครับ
นี่ครับ การ grill จบลงแล้ว เราถึงความเข้าใจร่วมกันแล้ว ถ้าผมเลือกที่จะให้มัน grill ต่อไปเรื่อย ๆ มันก็คงถามไปไม่รู้จบ แต่ 71 คำถามและ 42 นาที ผมว่านานพอแล้ว และตอนนี้เรามีวิสัยทัศน์ที่ค่อนข้างชัดเจนแล้ว เป็นเกมกลยุทธ์จำลองสถานการณ์ AI lab แบบผู้เล่นคนเดียวบน desktop เป็นหลัก เรากำหนดความยาวของแคมเปญได้แล้ว องค์ประกอบการจัดการกลยุทธ์ต่าง ๆ รวมถึง gameplay และ tech stack ซึ่งไม่ใช่โฟกัสหลักหรอกครับ โฟกัสหลักคือว่าผมอยากให้ตัวเกมเล่นยังไง อยากได้สมดุลแบบไหนระหว่างองค์ประกอบต่าง ๆ เป็นต้น
ยังไม่มีการเริ่ม implement อะไรเลยครับ เราเพียงแค่ถึงความเข้าใจร่วมกัน ผมเลยถามว่ามันสร้างแผนจากสิ่งที่คุยกันได้หรือเปล่า ปรากฏว่าไม่ได้สร้างครับ มันสร้างแค่สรุปความเข้าใจร่วมกันแบบละเอียดไว้ในบทสนทนา แต่ไม่ได้สร้าง formal implementation plan grill skill กำหนดชัดเจนว่าห้ามลงมือทำอะไรจนกว่าผมจะยืนยันความเข้าใจร่วมกัน ตอนนี้ผมยืนยันแล้ว ขั้นถัดไปคือเอาการตัดสินใจเหล่านั้นมาทำเป็นแผนและควรบันทึกไว้ด้วย
ผมเลยบอกให้บันทึกการตัดสินใจเหล่านั้นเป็นแผน เพราะอยากแน่ใจว่าเก็บไว้ครบ แต่มันจะไม่ทำจนกว่าเราจะขอให้มันทำอย่างชัดเจนนะครับ คำถามทั้งหมดที่ผ่านมาก็เป็นแค่คำถามใช่ไหมครับ มันไม่ได้เขียนอะไรเลย ไม่มี tool call สำหรับการเขียนอะไรเลย แล้วลองเปิดดูใน grill skill md จะเห็นว่ามันบอกเหมือนกันว่า "ถามคำถามทีละข้อ รอ feedback ของแต่ละข้อก่อนค่อยถามข้อถัดไป ถ้าหาข้อมูลได้จากการสำรวจ environment ก็ให้ดูขึ้นมาเอง แทนที่จะมาถามผม แต่การตัดสินใจเป็นของผม" ครับ
โอเค แผนถูกบันทึกไว้ตรงนี้แล้ว และมีทุกอย่างที่ตัดสินใจไว้ คงจะยาวมากใช่ไหมครับ อยู่ในไฟล์ markdown นี่ไง ยาวมากครับ เห็นได้ว่ามันรวบรวมทุกอย่างเอาไว้ มีโครงสร้าง implementation plan ทั้งหมดนี้สร้างจากบทสนทนาอันยาวนานใน grill-me session นะครับ มี task ทั้งหมดที่ต้องการ เหมือนเป็น timeline หรือแผนเต็มรูปแบบสำหรับการสร้างเกมนี้ขึ้นมา ค่อนข้างละเอียดเลยครับ
ผมว่าผมชอบสิ่งนี้นะครับ สำหรับโปรเจกต์แบบนี้ ผมชอบที่มันมี task เหล่านี้ให้ผมติดตามความคืบหน้าได้ โดยเฉพาะที่ผมมักจะสร้างโปรเจกต์พวกนี้ข้ามหลายวัน หลายสัปดาห์ หรือบางทีหลายเดือน ขึ้นอยู่กับว่าผมมีโปรเจกต์อะไรทำอยู่หลายอย่าง ก็เลยดีที่มี timeline ที่เฉพาะเจาะจงแบบนี้ ว่า task 15 ทำเสร็จแล้ว task 16 อยู่ แล้วไล่ลงมาแบบนี้ครับ
โดยรวมแล้ว ผมค่อนข้างพอใจกับ grill-me skill ครับ ถ้าใครจะใช้ ขอแนะนำให้เผื่อเวลาไว้สักชั่วโมงหนึ่งนะครับ เพราะมันจะต้องอ่านและคิดเรื่องโปรเจกต์ของคุณเยอะมาก อย่างโปรเจกต์นี้ผมตั้งใจค่อนข้างกว้าง ๆ ผมยอมรับว่ายังไม่มีวิสัยทัศน์ที่ชัดเจนนัก แต่มันช่วยให้ผมกลั่นกรองสิ่งที่ต้องการได้จริง ๆ และคำถามที่มันถามมาค่อนข้างดี มันเจาะเป็นรายละเอียดที่สำคัญต่อตัวเกมและสิ่งที่ผมอยากสร้าง ไม่ใช่แค่คำถามสุ่ม ๆ ครับ
ก็เลยค่อนข้างมีประโยชน์ครับ ถ้าใครใช้งานอยู่ บอกกันบ้างนะครับว่าประสบการณ์เป็นยังไง นี่คือ grill-me skill ของ Matt Pocock อีกครั้งครับ มันมีเวอร์ชันก้าวหน้ากว่าชื่อ grill-with-docs อยู่ด้วย ถ้าคนดูชอบวิดีโอนี้และสนใจ skill นี้ บางทีผมอาจจะทำตอนต่อไปด้วย grill-with-docs ก็ได้ครับ แต่เป็นอันจบวิดีโอนี้ไปแล้ว
ฝากคอมเมนต์ด้วยนะครับ บอกกันหน่อยว่าคิดยังไงกับ skill นี้ หรือถ้าใครลองใช้เองแล้ว กด like และ subscribe ช่องด้วยนะครับ แล้วพบกันใหม่วิดีโอหน้า ขอบคุณที่รับชมครับ
หมายเหตุการแปล
ความโปร่งใสเกี่ยวกับความไม่แน่นอนในต้นฉบับ
- ## `[ฟังไม่ชัด]` segments
อภิธานศัพท์เทคนิค
คำศัพท์และชื่อผลิตภัณฑ์ที่คงรูปภาษาอังกฤษ
| ศัพท์ | คำแปล / คำอธิบาย |
|---|---|
| /grill-me | skill ของ Matt Pocock สำหรับตั้งคำถามไล่เลียงผู้ใช้ก่อนเริ่มโปรเจกต์ เพื่อสร้าง shared understanding |
| grill-with-docs | รุ่นก้าวหน้าของ grill-me เพิ่มการสร้าง doc, ADR และ glossary ระหว่างทำ |
| grill / grilling | การตั้งคำถามอย่างไม่ยั้งเพื่อทดสอบความคิดหรือแผน |
| alignment | การสร้างความเข้าใจตรงกันระหว่างผู้ใช้และ agent |
| Hermes Agent | ตัวแทน AI ที่ Tonbi ใช้ทดสอบในวิดีโอนี้ |
| GPT-5.6 Sol | โมเดลที่ใช้ขับเคลื่อน Hermes Agent ในวิดีโอนี้ |
| skill | ทักษะ/ความสามารถเฉพาะทางที่เพิ่มเข้าไปใน agent เพื่อใช้ตามบริบท |
| agent | ตัวแทน AI ที่ช่วยทำงานตามคำสั่ง |
| MVP | Minimum Viable Product — ผลิตภัณฑ์ขั้นต่ำที่ใช้ได้จริงเพื่อทดสอบทิศทาง |
| vertical slice | ส่วนย่อยแคบ ๆ ของผลิตภัณฑ์ที่ครอบคลุมตั้งแต่ต้นน้ำถึงปลายน้ำ |
| implementation plan | แผนปฏิบัติการที่ละเอียดสำหรับสร้างผลิตภัณฑ์ |
| shared understanding | ความเข้าใจร่วมกันระหว่างผู้ใช้และ agent |
| ADR | Architecture Decision Record — เอกสารบันทึกการตัดสินใจทางสถาปัตยกรรม |
| domain-modeling skill | skill ที่ใช้สร้างและลับ domain model ของโปรเจกต์ ใช้คู่กับ grill-with-docs |
| token | หน่วยนับการใช้งานโมเดลภาษา |
| turn-based | ระบบเล่นตามรอบ (เล่นทีละฝั่ง) |
| diffusion model | โมเดล AI สำหรับสร้างภาพ |
| compute | พลังประมวลผลที่ใช้เทรนหรือรันโมเดล |
| benchmark | เกณฑ์มาตรฐานสำหรับวัดความสามารถของโมเดล |
| model card | การ์ดแสดงข้อมูลและคุณสมบัติของโมเดล |
| MVP demo | ตัวอย่าง MVP ที่ใช้สาธิต |
| Matt Pocock | ผู้สร้าง repo mattskills และเว็บไซต์ AI Hero.dev เป็นอดีตพนักงาน Vercel |
| agentwiks.com | โปรเจกต์ของ Tonbi ที่รวบรวม LLM wiki ฟรีในหัวข้อต่าง ๆ |
| Claude Code | เครื่องมือ AI สำหรับเขียนโค้ด |
| Vercel | บริษัทที่ Matt Pocock เคยทำงานด้วย |
| opt-in | ผู้ใช้ต้องเลือกยินยอมเองจึงจะร่วม |
| public playtest | การทดลองเล่นสาธารณะ |
| Frontier Labs | ชื่อชั่วคราวของเกมจำลอง AI lab ที่ Tonbi กำลังพัฒนา |
ซับไตเติ้ลภาษาไทย
ดาวน์โหลดหรือดูซับทั้งหมด
1 00:00:00,000 --> 00:00:06,080 skill สำหรับ agent ที่กำลังเป็นที่นิยมมากที่สุดอันหนึ่งตอนนี้อยู่ใน 2 00:00:06,080 --> 00:00:11,798 repo นี้ครับ และนี่เป็นของ Matt Pocock เขาเป็นคนที่ดูแลเว็บไซต์ 3 00:00:11,798 --> 00:00:16,335 AI Hero.dev ที่ให้เรียนรู้เกี่ยวกับ AI engineering 4 00:00:16,335 --> 00:00:20,782 และเคยเป็นพนักงานเก่าของ Vercel มาก่อน เขามี repo
เปิดดูซับไตเติ้ลทั้งหมด (199 segments)
1 00:00:00,000 --> 00:00:06,080 skill สำหรับ agent ที่กำลังเป็นที่นิยมมากที่สุดอันหนึ่งตอนนี้อยู่ใน 2 00:00:06,080 --> 00:00:11,798 repo นี้ครับ และนี่เป็นของ Matt Pocock เขาเป็นคนที่ดูแลเว็บไซต์ 3 00:00:11,798 --> 00:00:16,335 AI Hero.dev ที่ให้เรียนรู้เกี่ยวกับ AI engineering 4 00:00:16,335 --> 00:00:20,782 และเคยเป็นพนักงานเก่าของ Vercel มาก่อน เขามี repo 5 00:00:20,782 --> 00:00:25,138 ยอดนิยมบน GitHub ชื่อว่า mattskills ซึ่งมี skill 6 00:00:25,138 --> 00:00:32,217 หลายตัวด้วยกัน ตัวที่เป็นที่นิยมที่สุดและเป็นตัวที่เราจะมาลองใช้กันวันนี้ก็คือ 7 00:00:32,217 --> 00:00:37,209 grill-me skill ครับ เขาอธิบายเรื่องนี้ไว้ข้างล่างนะครับ 8 00:00:37,209 --> 00:00:41,655 มีตัวเลือกหลายตัว แต่ที่คนพูดถึงกันมากที่สุดก็คือ 9 00:00:41,655 --> 00:00:47,827 /grill-me หรือ grill-with-docs ซึ่งคล้ายกันแต่จะก้าวหน้ากว่านิดหน่อย 10 00:00:47,827 --> 00:00:53,907 เขาบอกว่า skill เหล่านี้ช่วยให้เรา "align" หรือสามัคคีความเข้าใจกับ 11 00:00:53,907 --> 00:01:01,712 agent ก่อนเริ่มโปรเจกต์ และช่วยให้คิดให้ลึกซึ้งขึ้นเกี่ยวกับการเปลี่ยนแปลงที่กำลังจะทำ 12 00:01:01,712 --> 00:01:05,977 คีย์เวิร์ดสำคัญตรงนี้ก็คือ align หรือ alignment 13 00:01:05,977 --> 00:01:11,967 ครับ เขาบอกว่า "skill นี้มีประโยชน์หลักในการทำให้แน่ใจว่าคุณในฐานะ 14 00:01:11,967 --> 00:01:17,866 dev และ agent รู้ว่ากำลังทำอะไรอยู่ มีวิสัยทัศน์และโฟกัสเดียวกัน" 15 00:01:17,866 --> 00:01:22,766 ซึ่งผมว่ามีประโยชน์มากครับ เวลาเริ่มโปรเจกต์ใช่ไหมครับ 16 00:01:22,766 --> 00:01:29,845 หลายครั้ง agent จะรีบวิ่งเข้าไปเริ่มสร้างของเลยโดยไม่มีวิสัยทัศน์ร่วมที่ชัดเจน 17 00:01:29,845 --> 00:01:34,292 แล้วเราก็เสียเวลาและเสีย token ไปเยอะมากในช่วงแรก 18 00:01:34,292 --> 00:01:39,374 แค่พยายามจะทำความเข้าใจกันและดึงกันให้อยู่ในหน้าเดียวกัน 19 00:01:39,374 --> 00:01:46,725 ผมเลยสนใจอยากลองใช้ดูครับ และในวิดีโอนี้ผมจะเอาไปใช้กับโปรเจกต์จริงที่กำลังทำอยู่ 20 00:01:46,725 --> 00:01:51,444 เราจะมาดูกันว่าเป็นยังไง เริ่มกันเลย สำหรับใครที่เอา 21 00:01:51,444 --> 00:02:00,156 agent ไปใช้เองและอยากเข้าถึง LLM wiki ที่ผมเองใช้ทำวิดีโอเหล่านี้เพื่อค้นคว้าและสร้างเนื้อหาจริง 22 00:02:00,156 --> 00:02:04,694 ๆ ลองแวะดูโปรเจกต์ของผมได้ที่ agentwiks.com นะครับ 23 00:02:04,694 --> 00:02:09,232 ผมให้ wiki เหล่านี้ทั้งหมดฟรีในหัวข้อต่าง ๆ มากมาย 24 00:02:09,232 --> 00:02:14,041 และก็สมัคร pro account ได้ในราคา 9.99 ดอลลาร์ต่อเดือน 25 00:02:14,041 --> 00:02:21,392 จะได้เข้าถึง wiki ขนาดใหญ่พิเศษที่มีหน้ามากกว่าและรายละเอียดเยอะกว่าในแต่ละหัวข้อ 26 00:02:21,392 --> 00:02:26,202 กลับเข้าสู่วิดีโอครับ อย่างที่เห็นใน repo หน้า skills 27 00:02:26,202 --> 00:02:30,831 ภายใต้หมวด productivity ผมคิดว่า คือ grill-me agent 28 00:02:30,831 --> 00:02:35,187 skill ครับ และมันพัฒนามาจาก grilling ซึ่งเป็นอีก 29 00:02:35,187 --> 00:02:41,176 skill หนึ่ง คำอธิบายคือมันจะ "ตั้งคำถามไล่เลียงผู้ใช้อย่างไม่ยั้ง" 30 00:02:41,176 --> 00:02:48,527 เกี่ยวกับแผน การตัดสินใจ หรือไอเดีย ให้ใช้เมื่อผู้ใช้ต้องการทดสอบความคิดของตัวเอง 31 00:02:48,527 --> 00:02:52,974 หรือเมื่อใช้ trigger phrase ที่เกี่ยวกับการ grill 32 00:02:52,974 --> 00:03:02,957 ดังนั้นไม่จำเป็นต้องใช้ตอนเริ่มโปรเจกต์เสมอไป เวลาตัดสินใจหรือปรับทิศทางอะไรบางอย่างก็เอามาใช้ได้เหมือนกันครับ 33 00:03:02,957 --> 00:03:08,130 พวกนี้อยู่ในหมวด productivity ครับ ส่วนในหมวด engineering 34 00:03:08,130 --> 00:03:15,572 จะมี grill-with-docs ซึ่งเป็นการสัมภาษณ์อย่างไม่ยั้งเพื่อลับแผนหรือดีไซน์ให้คมขึ้น 35 00:03:15,572 --> 00:03:20,200 และยังสร้าง doc, ADR (Architecture Decision Record) 36 00:03:20,200 --> 00:03:27,279 และ glossary ไปด้วยระหว่างทำ ตัวนี้เหมาะมากเวลาอยากแชร์ศัพท์เฉพาะทางและภาษากับ 37 00:03:27,279 --> 00:03:32,905 agent ไปเรื่อย ๆ ซึ่งน่าจะมีประโยชน์มากครับ มันเลยใช้ควบคู่กับ 38 00:03:32,905 --> 00:03:37,625 domain-modeling skill ที่ใช้สร้างและลับ domain model 39 00:03:37,625 --> 00:03:42,344 ของโปรเจกต์ เรามาเริ่มกันเลย เราจะทำสิ่งนี้ใน Hermes 40 00:03:42,344 --> 00:03:47,426 Agent ด้วย GPT-5.6 Sol นะครับ มาดูกัน เริ่มรันแล้วตรงนี้ 41 00:03:47,426 --> 00:03:52,054 ผมพิมพ์ว่าให้ติดตั้ง grill skill จาก repo นี้ได้ไหม 42 00:03:52,054 --> 00:03:57,318 ระหว่างที่มันกำลังทำอยู่ ขออธิบายก่อนว่าโปรเจกต์นี้คืออะไร 43 00:03:57,318 --> 00:04:04,033 มันชื่อชั่วคราวว่า Frontier Labs ครับ ผมมีไอเดียอยากทำเกมจำลองสถานการณ์แบบ 44 00:04:04,033 --> 00:04:09,116 Sim City ยกเว้นว่าผู้เล่นจะเป็น AI lab ที่ต้องแข่งขันกับ 45 00:04:09,116 --> 00:04:13,653 AI lab อื่น ๆ และต้องสร้างสมดุลระหว่างทรัพยากรต่าง 46 00:04:13,653 --> 00:04:19,734 ๆ เห็นได้ชัดว่าต้องรักษาสมดุลงบประมาณ ว่าจะลงทุนด้านการตลาดเท่าไหร่ 47 00:04:19,734 --> 00:04:27,629 เทียบกับ compute เทียบกับการเทรนโมเดล แนวคิดคือให้เป็นเกมที่สนุกในฐานะเกมจำลองสถานการณ์ 48 00:04:27,629 --> 00:04:34,708 แต่ก็สอนเรื่อง AI ไปด้วยได้ เพราะส่วนหนึ่งของการเทรนคือเราเลือกโมเดลประเภทต่าง 49 00:04:34,708 --> 00:04:38,973 ๆ และวิธีการเทรนที่ต่างกันได้ เช่น จะเทรน image 50 00:04:38,973 --> 00:04:43,692 model ได้ แล้วผ่านกระบวนการนั้นก็จะได้เรียนรู้เรื่อง 51 00:04:43,692 --> 00:04:48,321 diffusion model เป็นต้น เอาล่า ติดตั้งเสร็จแล้วครับ 52 00:04:48,321 --> 00:04:53,675 ได้เรียนรู้เรื่องโมเดลต่าง ๆ แบบนี้นะครับ นั่นคือแนวคิดครับ 53 00:04:53,675 --> 00:04:58,667 ให้เป็นเกมแต่ก็มีสาระการศึกษาไปด้วย ตอนนี้มันขึ้นมาแล้ว 54 00:04:58,667 --> 00:05:03,023 ผมไม่ต้องใช้ reload skills เสียด้วยซ้ำ งั้นมาลอง 55 00:05:03,023 --> 00:05:07,651 grill-me กัน เรียก skill ได้เลย ในหมวด productivity 56 00:05:07,651 --> 00:05:14,276 หัวข้อ grilling มาเริ่มกันเลยครับ "คุณอยากให้ผมตั้งคำถามไล่เลียงเรื่องแผน 57 00:05:14,276 --> 00:05:18,723 ดีไซน์ การตัดสินใจ หรือไอเดียอะไน" ผมก็ใส่ prompt 58 00:05:18,723 --> 00:05:24,077 อธิบายไอเดียเกมจำลองสถานการณ์ที่มี แค่เป็นคำตอบกลับแบบกว้าง 59 00:05:24,077 --> 00:05:28,887 ๆ ครับ Hermes ถามต่อว่าใครคือผู้เล่นกลุ่มเป้าหมายหลัก 60 00:05:28,887 --> 00:05:34,877 คงไม่ใช่คนเทคนิคหรอก ผมว่าน่าจะเป็นผู้ใหญ่ทั่วไปที่ไม่ใช่สายเทคนิค 61 00:05:34,877 --> 00:05:40,503 และนักเรียนที่โตแล้วมากกว่า ตัวเลือกที่มันแนะนำก็คือตัวนี้แหละ 62 00:05:40,503 --> 00:05:45,949 ใช้อันนั้นครับ คำถามต่อมา: อะไรคือนิยามของการชนะในรอบมาตรฐาน 63 00:05:45,949 --> 00:05:51,212 ผมคิดว่านี่คงเป็นรูปแบบการ grill ใช่ไหมครับ คือถามไปเรื่อย 64 00:05:51,212 --> 00:05:57,746 ๆ หรือถ้าใครเคยใช้ Claude Code ก็จะคุ้นเจอคำถามประมาณนี้บ้างเป็นบางครั้ง 65 00:05:57,746 --> 00:06:02,375 "อะไรคือนิยามของการชนะในรอบมาตรฐาน" ส่วนตัวผมคิดว่า 66 00:06:02,375 --> 00:06:07,366 "สมดุลย์สูงสุด" ก็คือคะแนนสมดุลที่ดี รวมกำไร ความสามารถ 67 00:06:07,366 --> 00:06:11,722 ความปลอดภัย และชื่อเสียง น่าจะดีที่สุดใช่ไหมครับ 68 00:06:11,722 --> 00:06:16,441 เพราะเราอยากให้สมดุล ไม่ใช่แค่ส่วนแบ่งตลาดอย่างเดียว 69 00:06:16,441 --> 00:06:21,070 เวลาในเกมควรจะเดินไปอย่างไร น่าจะเป็นแบบ turn-based 70 00:06:21,070 --> 00:06:26,515 ครับ ไม่รู้ว่ามันจะถามกี่คำถาม แคมเปญค่าเริ่มต้นควรยาวแค่ไหน 71 00:06:26,515 --> 00:06:31,143 ลองใช้คำแนะนำดูครับ ห้าปี ซึ่งเป็นเวลานานมากในวงการ 72 00:06:31,143 --> 00:06:35,590 AI เลยนะ เกมจำลองสถานการณ์ควรใช้บริษัทจริงหรือ AI 73 00:06:35,590 --> 00:06:41,308 lab สมมติ ผมบอกว่าเป็นเกมจำลองสถานการณ์นะ ไม่อยากเจอปัญหาเรื่อง 74 00:06:41,308 --> 00:06:45,754 IP เลยครับ ผู้เล่นควรควบคุมการพัฒนาโมเดลมากแค่ไหน 75 00:06:45,754 --> 00:06:52,561 ผมเลือก strategic control เพิ่มชั้นเทคนิคที่มีความหมายอีกไม่กี่ชั้นต่อโมเดล 76 00:06:52,561 --> 00:06:57,189 การจัดการทรัพยากรควรละเอียดขนาดไหน เลือกแบบ layered 77 00:06:57,189 --> 00:07:02,634 ครับ มีทรัพยากรหลักห้าตัว แล้วมีตัวอื่น ๆ โผล่ขึ้นมาตามบริบท 78 00:07:02,634 --> 00:07:08,080 คำถามต่อมา โปรเจกต์โมเดลควรพัฒนาจากไอเดียสู่ผลิตภัณฑ์อย่างไร 79 00:07:08,080 --> 00:07:12,708 ผมว่าเราอยากได้ pipeline ที่มองเห็นได้นะครับ scope, 80 00:07:12,708 --> 00:07:17,972 prepare data, train, evaluate, launch, operate ไล่ไปแบบนี้ 81 00:07:17,972 --> 00:07:23,145 แล้วก็ตั้งคำถามว่า "ส่วนแบ่งตลาดหมายถึงอะไรในเชิงกลไกเกม" 82 00:07:23,145 --> 00:07:27,773 ตอนนี้เราถามมากี่คำถามแล้วนะ มัน grill จริง ๆ เนี่ย 83 00:07:27,773 --> 00:07:33,490 โอเค นั่นคือ 10 คำถามครับ ผมจะไม่พาดูทุกคำถามเพราะอาจจะน่าเบื่อ 84 00:07:33,490 --> 00:07:38,300 แต่จะมาบอกเมื่อมันถามจบ ตอนนี้เราอยู่ที่ 15 คำถามแล้ว 85 00:07:38,300 --> 00:07:45,651 และยังพูดกันแค่ในส่วนของ gameplay ยังไม่มีอะไรเกี่ยวกับการสร้างเกมในเชิงเทคนิคเลย 86 00:07:45,651 --> 00:07:54,182 แต่สิ่งที่ค่อนข้างดีและผมชอบก็คือ ไอเดียนี้ไม่ใช่แค่สิ่งที่คุณได้ยินผมอธิบายไปตอนต้นใช่ไหมครับ 87 00:07:54,182 --> 00:08:00,625 มันยังไม่ได้มีรายละเอียดเต็มที่ แต่มันกำลังเจาะเข้าไปในรายละเอียดของตัว 88 00:08:00,625 --> 00:08:08,521 gameplay เองที่ผมยังไม่ได้คิด และมันกำลังบังคับให้ผมตัดสินใจเรื่องพวกนี้ตั้งแต่ตอนเริ่ม 89 00:08:08,521 --> 00:08:13,694 ซึ่งก็ดีจริง ๆ ปกติผมจะปล่อยให้มันกว้าง ๆ ไว้แล้วปล่อยให้ 90 00:08:13,694 --> 00:08:24,765 agent หรือโมเดลเป็นคนหาทางออกเอง แต่ตัวนี้ค่อนข้างบังคับให้ผมกลั่นกรองวิสัยทัศน์ให้คมขึ้นอีกก่อนที่จะมีการสร้างอะไรจริงจัง 91 00:08:24,765 --> 00:08:29,031 จะเห็นว่าหลังแต่ละคำถามมันจะมีคำแนะนำประกอบเสมอ 92 00:08:29,031 --> 00:08:35,293 และโดยรวม ตอนนี้ผมผ่านมาเกือบ 20 คำถามแล้ว คำแนะนำมักจะค่อนข้างดีครับ 93 00:08:35,293 --> 00:08:41,827 และเราใช้ GPT-5.6 Sol อยู่ แต่ส่วนใหญ่ผมเลือกตามคำแนะนำในเคสส่วนใหญ่ครับ 94 00:08:41,827 --> 00:08:47,817 ตอนนี้อยู่ที่คำถามที่ 24 แล้ว เริ่มเข้าสู่ส่วนที่เป็นเทคนิคหรือนอก 95 00:08:47,817 --> 00:08:52,082 gameplay มากขึ้นแล้ว มันถามว่าแพลตฟอร์มแรกที่จะ 96 00:08:52,082 --> 00:09:01,429 release ควรเป็นอะไร และคำตอบคือเกมบนเว็บ ครับ เริ่มออกจากรายละเอียดของตัวเกมเองและเข้าสู่ด้านเทคนิคจริง 97 00:09:01,429 --> 00:09:07,510 ๆ ของตัวเกมมากขึ้น คำถามถัดไป: เกมควรมีหน้าตาและความรู้สึกแบบไหนแบบ 98 00:09:07,510 --> 00:09:12,592 real-time? มันแนะนำแบบ hybrid command center — dashboard 99 00:09:12,592 --> 00:09:17,493 สำหรับทรัพยากรและตลาด, visual pipeline สำหรับโปรเจกต์, 100 00:09:17,493 --> 00:09:22,303 และ model card ที่แตกต่างกันชัดเจน ผมไม่แน่ใจเท่าไหร่ 101 00:09:22,303 --> 00:09:26,659 อ้าว หมดเวลาไปแล้วครับ มันมีตัวจับเวลาอยู่นะครับ 102 00:09:26,659 --> 00:09:32,830 ผมยุ่งคุยและดูของอยู่ แต่เพราะเราไม่อยากติดอยู่กับคำถามเดิมนานเกินไป 103 00:09:32,830 --> 00:09:38,184 หลังจาก 120 วินาที agent จะตัดสินใจเอง โดยเลือกไปตามคำแนะนำ 104 00:09:38,184 --> 00:09:44,809 มันเลือกแบบ hybrid command center ซึ่งผมก็ปรับแก้ได้ภายหลังถ้าต้องการครับ 105 00:09:44,809 --> 00:09:49,801 โอเค งั้น milestone แรกของการพัฒนาควรเป็นอะไร milestone 106 00:09:49,801 --> 00:09:55,336 แรกของเราจะเป็น paper ที่เราต้องการ คือเกมบนเว็บที่ฟีเจอร์ครบ 107 00:09:55,336 --> 00:10:00,963 ขัดเกลา เป็น public demo ที่สื่อถึงประสบการณ์สุดท้ายที่ต้องการ 108 00:10:00,963 --> 00:10:05,591 ผมว่าทำแบบ demo ขั้นต่ำก็พอ ผมรู้สึกเหมือนว่า agent 109 00:10:05,591 --> 00:10:12,216 พยายามจะทำงานน้อยที่สุดเสมอ มักจะอยากสร้าง MVP แทนที่จะสร้างผลิตภัณฑ์จริง 110 00:10:12,216 --> 00:10:16,663 ตอนนี้เลยเริ่มเจาะเข้าไปที่การขัดเกลา deliverable 111 00:10:16,663 --> 00:10:22,471 ตัว MVP มากขึ้น มีเคสที่น่าสนใจนะครับ ตอนที่ถามเรื่องกลุ่มลูกค้า 112 00:10:22,471 --> 00:10:27,191 มันแนะนำกลุ่มที่แคบกว่า แต่ผมบอกว่าทำทั้ง 6 กลุ่มเลย 113 00:10:27,191 --> 00:10:31,547 แล้วคำถามถัดไปมันบอกว่านั่นขัดกับวัตถุประสงค์ของ 114 00:10:31,547 --> 00:10:36,810 vertical slice ที่แคบ มันเลยพยายามดึงผมเข้าหาคำแนะนำของมัน 115 00:10:36,810 --> 00:10:41,257 เริ่มทำอย่างอื่นแล้ว จบคำถามหรือยังนะ อ่อ ยังครับ 116 00:10:41,257 --> 00:10:46,158 เริ่มเข้าสู่ส่วน tech stack แล้ว ตอนต้นเราคุยกันเรื่อง 117 00:10:46,158 --> 00:10:51,149 gameplay แล้วก็ปรับขอบเขตของ MVP demo และตอนนี้เรามาถึง 118 00:10:51,149 --> 00:10:56,594 tech stack นี่คือคำถามที่ 33 ครับ สำหรับใครที่ติดตามอยู่บ้าน 119 00:10:56,594 --> 00:11:00,860 ต้องบอกว่าคำแนะนำบางข้อค่อนข้างคิดมาดีเลยนะครับ 120 00:11:00,860 --> 00:11:06,396 จริง ๆ มันไม่ได้ขี้เกียจเลย ผมเคยบอกว่ามันอาจจะขี้เกียจก็จริง 121 00:11:06,396 --> 00:11:10,843 แต่แทนที่จะเลือกทางง่ายสุด อันนี้ถามว่า dimension 122 00:11:10,843 --> 00:11:15,108 ของความสามารถควรวัดอะไร แทนที่จะดูแค่ benchmark 123 00:11:15,108 --> 00:11:23,457 เฉย ๆ คำแนะนำของมันซึ่งผมก็เห็นด้วยก็คือ ให้เป็นความสามารถที่มีประโยชน์แบบถ่วงน้ำหนักตามตลาด 124 00:11:23,457 --> 00:11:28,630 กระจายไปทั่ว portfolio ซึ่งจะป้องกันไม่ให้โมเดลที่เก่งแค่ 125 00:11:28,630 --> 00:11:35,164 benchmark เดียวมาครองคะแนน และให้รางวัลกับความเชี่ยวชาญที่มีความหมายจริง 126 00:11:35,164 --> 00:11:43,150 ๆ คำแนะนำของมันค่อนข้างคิดมาดีจริง ๆ ครับ นี่เป็นอีกเคสที่มันจับข้อขัดแย้งในการออกแบบได้ 127 00:11:43,150 --> 00:11:47,416 เพราะก่อนหน้านี้หลายสิบคำถามมาแล้ว ผมบอกว่า MVP 128 00:11:47,416 --> 00:11:51,953 หรือ vertical slice ที่เรียงว่าอยากแค่ภาษาเท่านั้น 129 00:11:51,953 --> 00:11:59,032 แต่ในคำถามล่าสุดผมบอกว่าอยากให้เกมสอนความแตกต่างทางสถาปัตยกรรมระหว่างโมเดลภาษา 130 00:11:59,032 --> 00:12:04,659 ภาพ และเสียง มันเลยกำลังจะแก้ข้อขัดแย้งนั้น ซึ่งน่าสนใจมากครับ 131 00:12:04,659 --> 00:12:11,556 โมเดลสามารถจดจำคำตอบของทุกคำถามได้ และมาชี้ให้เห็นเมื่อมีข้อขัดแย้งแบบนี้ได้ 132 00:12:11,556 --> 00:12:16,184 ตอนนี้เราอยู่ที่คำถามที่ 52 ครับ ค่อนข้างละเอียดมาก 133 00:12:16,184 --> 00:12:21,811 ตอนนี้คำถามที่ 70 และเริ่มเข้าสู่โมเดลธุรกิจของเกมที่ผมต้องการ 134 00:12:21,811 --> 00:12:28,890 มันแนะนำให้เป็น prototype สาธารณะฟรี โดยตัดสินใจเรื่องโมเดลธุรกิจทีหลังหลังจาก 135 00:12:28,890 --> 00:12:33,609 validation แล้ว ผมว่าน่าจะถูกต้องครับ ตัวเกมจะฟรีเอง 136 00:12:33,609 --> 00:12:38,328 แต่ถ้าผมต้องทำให้มัน monetize ได้ในภายหลังเพื่อหาทุน 137 00:12:38,328 --> 00:12:42,684 ค่อยหาทางทีหลังก็ได้ อาจจะมีฟีเจอร์ premium เล็ก 138 00:12:42,684 --> 00:12:47,040 ๆ น้อย ๆ บางอย่าง โอเค เราผ่านคำถามมา 70 ข้อแล้ว 139 00:12:47,040 --> 00:12:51,578 และอย่างที่เห็นตอนนี้เข้าสู่นาทีที่ 40 กว่า ๆ แล้ว 140 00:12:51,578 --> 00:12:56,388 ผมตัดส่วนที่ซ้ำ ๆ ออกไปเยอะ แต่ก็เป็นคำถามแนวเดียวกัน 141 00:12:56,388 --> 00:13:00,925 แต่เจาะลึกเข้าไปในรายละเอียดของเกมและ gameplay และ 142 00:13:00,925 --> 00:13:05,644 tech stack เลย อันนี้ยังถามด้วยว่าเราจะเก็บข้อมูลจาก 143 00:13:05,644 --> 00:13:10,727 public playtest ได้อย่างไรโดยไม่มี backend หรือระบบบัญชี 144 00:13:10,727 --> 00:13:15,173 คำตอบคือทำเป็น opt-in ตอนนี้มาถึงคำถามที่ 71 แล้ว 145 00:13:15,173 --> 00:13:19,893 มันถามว่า "เราถึงความเข้าใจร่วมกันของเกมและ vertical 146 00:13:19,893 --> 00:13:26,427 slice แล้วหรือยัง" คำแนะนำคือ "ใช่ ถ้านี่สะท้อนถึงผลิตภัณฑ์ที่ตั้งใจจะทำ 147 00:13:26,427 --> 00:13:30,874 การยืนยันจะเป็นการจบช่วง grilling แต่ผมจะไม่เริ่ม 148 00:13:30,874 --> 00:13:35,593 implement จนกว่าคุณจะขอให้ผมทำต่างหาก" ดังนั้นถ้าตอบ 149 00:13:35,593 --> 00:13:44,577 "ใช่" มันก็จะจบ นี่คือความเข้าใจร่วมกันของเรา ผมว่าตอนนี้เรามีวิสัยทัศน์ที่ค่อนข้างชัดเจนแล้วนะครับ 150 00:13:44,577 --> 00:13:49,841 ทั้งหมดนี้คือ 71 คำถาม ใช้เวลา 42 นาที ถ้าเลือกที่จะให้มัน 151 00:13:49,841 --> 00:13:55,014 grill ต่อหรือแก้ไขก็ทำได้ แต่ผมว่าที่ได้มานี่ดีพอแล้วครับ 152 00:13:55,014 --> 00:13:59,914 นี่ครับ การ grill จบลงแล้ว เราถึงความเข้าใจร่วมกันแล้ว 153 00:13:59,914 --> 00:14:05,541 ถ้าผมเลือกที่จะให้มัน grill ต่อไปเรื่อย ๆ มันก็คงถามไปไม่รู้จบ 154 00:14:05,541 --> 00:14:13,164 แต่ 71 คำถามและ 42 นาที ผมว่านานพอแล้ว และตอนนี้เรามีวิสัยทัศน์ที่ค่อนข้างชัดเจนแล้ว 155 00:14:13,164 --> 00:14:18,156 เป็นเกมกลยุทธ์จำลองสถานการณ์ AI lab แบบผู้เล่นคนเดียวบน 156 00:14:18,156 --> 00:14:22,512 desktop เป็นหลัก เรากำหนดความยาวของแคมเปญได้แล้ว 157 00:14:22,512 --> 00:14:26,868 องค์ประกอบการจัดการกลยุทธ์ต่าง ๆ รวมถึง gameplay 158 00:14:26,868 --> 00:14:34,310 และ tech stack ซึ่งไม่ใช่โฟกัสหลักหรอกครับ โฟกัสหลักคือว่าผมอยากให้ตัวเกมเล่นยังไง 159 00:14:34,310 --> 00:14:38,757 อยากได้สมดุลแบบไหนระหว่างองค์ประกอบต่าง ๆ เป็นต้น 160 00:14:38,757 --> 00:14:45,109 ยังไม่มีการเริ่ม implement อะไรเลยครับ เราเพียงแค่ถึงความเข้าใจร่วมกัน 161 00:14:45,109 --> 00:14:49,647 ผมเลยถามว่ามันสร้างแผนจากสิ่งที่คุยกันได้หรือเปล่า 162 00:14:49,647 --> 00:14:56,726 ปรากฏว่าไม่ได้สร้างครับ มันสร้างแค่สรุปความเข้าใจร่วมกันแบบละเอียดไว้ในบทสนทนา 163 00:14:56,726 --> 00:15:00,991 แต่ไม่ได้สร้าง formal implementation plan grill 164 00:15:00,991 --> 00:15:07,162 skill กำหนดชัดเจนว่าห้ามลงมือทำอะไรจนกว่าผมจะยืนยันความเข้าใจร่วมกัน 165 00:15:07,162 --> 00:15:14,785 ตอนนี้ผมยืนยันแล้ว ขั้นถัดไปคือเอาการตัดสินใจเหล่านั้นมาทำเป็นแผนและควรบันทึกไว้ด้วย 166 00:15:14,785 --> 00:15:21,319 ผมเลยบอกให้บันทึกการตัดสินใจเหล่านั้นเป็นแผน เพราะอยากแน่ใจว่าเก็บไว้ครบ 167 00:15:21,319 --> 00:15:25,948 แต่มันจะไม่ทำจนกว่าเราจะขอให้มันทำอย่างชัดเจนนะครับ 168 00:15:25,948 --> 00:15:32,028 คำถามทั้งหมดที่ผ่านมาก็เป็นแค่คำถามใช่ไหมครับ มันไม่ได้เขียนอะไรเลย 169 00:15:32,028 --> 00:15:36,838 ไม่มี tool call สำหรับการเขียนอะไรเลย แล้วลองเปิดดูใน 170 00:15:36,838 --> 00:15:42,193 grill skill md จะเห็นว่ามันบอกเหมือนกันว่า "ถามคำถามทีละข้อ 171 00:15:42,193 --> 00:15:48,364 รอ feedback ของแต่ละข้อก่อนค่อยถามข้อถัดไป ถ้าหาข้อมูลได้จากการสำรวจ 172 00:15:48,364 --> 00:15:54,626 environment ก็ให้ดูขึ้นมาเอง แทนที่จะมาถามผม แต่การตัดสินใจเป็นของผม" 173 00:15:54,626 --> 00:16:00,343 ครับ โอเค แผนถูกบันทึกไว้ตรงนี้แล้ว และมีทุกอย่างที่ตัดสินใจไว้ 174 00:16:00,343 --> 00:16:05,516 คงจะยาวมากใช่ไหมครับ อยู่ในไฟล์ markdown นี่ไง ยาวมากครับ 175 00:16:05,516 --> 00:16:10,961 เห็นได้ว่ามันรวบรวมทุกอย่างเอาไว้ มีโครงสร้าง implementation 176 00:16:10,961 --> 00:16:15,499 plan ทั้งหมดนี้สร้างจากบทสนทนาอันยาวนานใน grill-me 177 00:16:15,499 --> 00:16:20,127 session นะครับ มี task ทั้งหมดที่ต้องการ เหมือนเป็น 178 00:16:20,127 --> 00:16:24,846 timeline หรือแผนเต็มรูปแบบสำหรับการสร้างเกมนี้ขึ้นมา 179 00:16:24,846 --> 00:16:30,927 ค่อนข้างละเอียดเลยครับ ผมว่าผมชอบสิ่งนี้นะครับ สำหรับโปรเจกต์แบบนี้ 180 00:16:30,927 --> 00:16:35,646 ผมชอบที่มันมี task เหล่านี้ให้ผมติดตามความคืบหน้าได้ 181 00:16:35,646 --> 00:16:40,002 โดยเฉพาะที่ผมมักจะสร้างโปรเจกต์พวกนี้ข้ามหลายวัน 182 00:16:40,002 --> 00:16:46,899 หลายสัปดาห์ หรือบางทีหลายเดือน ขึ้นอยู่กับว่าผมมีโปรเจกต์อะไรทำอยู่หลายอย่าง 183 00:16:46,899 --> 00:16:51,527 ก็เลยดีที่มี timeline ที่เฉพาะเจาะจงแบบนี้ ว่า task 184 00:16:51,527 --> 00:16:55,974 15 ทำเสร็จแล้ว task 16 อยู่ แล้วไล่ลงมาแบบนี้ครับ 185 00:16:55,974 --> 00:17:00,330 โดยรวมแล้ว ผมค่อนข้างพอใจกับ grill-me skill ครับ 186 00:17:00,330 --> 00:17:05,322 ถ้าใครจะใช้ ขอแนะนำให้เผื่อเวลาไว้สักชั่วโมงหนึ่งนะครับ 187 00:17:05,322 --> 00:17:09,950 เพราะมันจะต้องอ่านและคิดเรื่องโปรเจกต์ของคุณเยอะมาก 188 00:17:09,950 --> 00:17:17,301 อย่างโปรเจกต์นี้ผมตั้งใจค่อนข้างกว้าง ๆ ผมยอมรับว่ายังไม่มีวิสัยทัศน์ที่ชัดเจนนัก 189 00:17:17,301 --> 00:17:21,567 แต่มันช่วยให้ผมกลั่นกรองสิ่งที่ต้องการได้จริง ๆ 190 00:17:21,567 --> 00:17:29,644 และคำถามที่มันถามมาค่อนข้างดี มันเจาะเป็นรายละเอียดที่สำคัญต่อตัวเกมและสิ่งที่ผมอยากสร้าง 191 00:17:29,644 --> 00:17:34,453 ไม่ใช่แค่คำถามสุ่ม ๆ ครับ ก็เลยค่อนข้างมีประโยชน์ครับ 192 00:17:34,453 --> 00:17:39,445 ถ้าใครใช้งานอยู่ บอกกันบ้างนะครับว่าประสบการณ์เป็นยังไง 193 00:17:39,445 --> 00:17:43,982 นี่คือ grill-me skill ของ Matt Pocock อีกครั้งครับ 194 00:17:43,982 --> 00:17:48,883 มันมีเวอร์ชันก้าวหน้ากว่าชื่อ grill-with-docs อยู่ด้วย 195 00:17:48,883 --> 00:17:54,600 ถ้าคนดูชอบวิดีโอนี้และสนใจ skill นี้ บางทีผมอาจจะทำตอนต่อไปด้วย 196 00:17:54,600 --> 00:17:59,410 grill-with-docs ก็ได้ครับ แต่เป็นอันจบวิดีโอนี้ไปแล้ว 197 00:17:59,410 --> 00:18:03,676 ฝากคอมเมนต์ด้วยนะครับ บอกกันหน่อยว่าคิดยังไงกับ 198 00:18:03,676 --> 00:18:08,667 skill นี้ หรือถ้าใครลองใช้เองแล้ว กด like และ subscribe 199 00:18:08,667 --> 00:18:13,840 ช่องด้วยนะครับ แล้วพบกันใหม่วิดีโอหน้า ขอบคุณที่รับชมครับ