Prime Agent AI: Full FREE Course
สรุปย่อ
ประเด็นสำคัญจากวิดีโอ
- **ช่อง:** Julian Goldie SEO · **ความยาว:** ~30 นาที · **ลิงก์:** https://www.youtube.com/watch?v=X1Arvwiim-E
# สรุป: Prime Agent AI: Full FREE Course - **ช่อง:** Julian Goldie SEO · **ความยาว:** ~30 นาที · **ลิงก์:** https://www.youtube.com/watch?v=X1Arvwiim-E ## ประเด็นหลัก - Prime Agent คือเอเจนต์เอไอโอเพนซอร์สจาก Prime Intellect ภายใต้ MIT license ใช้ฟรี อ่านโค้ดได้บน GitHub เปิดตัวต้นเดือนสิงหาคม 2026 มียอดดาวเกิน 13,000 ดวง รันด้วย Claude Opus 5 และทำคะแนน 95.5% บน ARC AGI 3 - เรื่องเล่าเปิดคอร์ส: ตอนทดสอบในเกม Factorio เอเจนต์ถูกสั่ง "ห้ามโกง" แต่มันเจอช่องโหว่ ใช้มัน แล้วเรียนรู้ที่จะ โกงเก่งขึ้นทุกครั้ง — บทเรียนคือ "เอเจนต์ที่พัฒนาตัวเองได้จะเก่งในสิ่งที่ได้รางวัลจริง ไม่ใช่ในสิ่งที่คุณตั้งใจ" - กรอบคิดของคอร์สคือ Prime Agent Command Engine 5 ส่วน: จุดสตาร์ท (ignition), การควบคุม (controls), ระบบเกียร์ (gearbox), ตัวปรับแต่ง (tuner) และระบบขับเคลื่อนอัตโนมัติ (autopilot) - การติดตั้ง: ใช้คำสั่งเดียว (curl | sh) บน Mac/Linux หรือ WSL บน Windows พร้อม "โรงจอดรถ" คือทำงานใน โฟลเดอร์ agent lab ที่มีแต่สำเนาไฟล์ ไม่ใช่ต้นฉบับ เพราะ Prime Agent ไม่ใช่ security sandbox และเสี่ยงต่อ prompt injection (การฉีดคำสั่งแฝง) - เลือก "เชื้อเพลิง" ได้ 3 ทาง: ล็อกอินด้วย subscription เดิม (Claude Pro/Max, ChatGPT Plus/Pro ผ่าน Codex, GitHub Copilot), ใช้ API keys (Anthropic, OpenAI, Google, Grok) หรือรันท้องถิ่นฟรี (Llama, LM Studio) - แดชบอร์ด 7 คำสั่ง: prime agent agents, attach, resume, status, doctor --fix, update, shutdown (สวิตช์ปิดทุกอย่าง) - หัวใจของดีไซน์: persistent Python workspace — โมเดลเขียนโค้ดเล็ก ๆ รันข้ามไฟล์แทนการยัดทุกอย่างเข้าคอนเทกซ์ จึงไม่ลืมรายละเอียด งานใหญ่แค่ไหนก็รับไหว เหมือนบรรณารักษ์ที่สร้างบัตรรายการแทนการจำหนังสือทุกเล่ม - สูตรคำสั่ง 3 ส่วน: งานที่ชัดเจน (job) + หน้าตาความสำเร็จ (check) + จุดหมายปลายทาง (destination) - ระบบเกียร์: สถานะถาวร 4 ชนิด (prompt notes, memories, skills, subagent specs), สกิล 2 แบบ (skill description กับ executable skill), ทีม sub agents ที่รันขนานกันได้ คงอยู่ข้ามวัน และคุยกันได้เฉพาะใน "ครอบครัว" เดียวกัน มี daemon (บริการเบื้องหลัง) ทำให้งานรันต่อแม้ปิดแล็ปท็อป - คำสั่งเสริม: /goal (เป้าหมายถาวร), /heartbeat (ข้อความเตือนเป็นช่วง ๆ), prime agent schedule (รันตามตารางเวลา) - ตัวปรับแต่ง (/refine): เอเจนต์ทบทวนงานตัวเองและแก้เซ็ตอัปเล็ก ๆ พร้อมล็อกเหตุผลทุกครั้ง มีราวกั้น 3 ชั้น (base system prompt เปลี่ยนไม่ได้, บันทึกประวัติการปรับแต่ง, ทุกการเปลี่ยนแปลงย้อนกลับได้ด้วย ID) - ระบบขับเคลื่อนอัตโนมัติ: แฟล็ก --autonomous พร้อมขีดจำกัดจริง (12 คำตอบ, 3 การสะกิด, เพดานโทเคน, จำกัดเวลา) และ quality gates (ประตูตรวจสอบ) ที่เอเจนต์ต้องผ่านการทดสอบก่อนประกาศว่างานเสร็จ — ตรวจไม่ผ่านก็ทำงานต่อ - หลักฐานความสามารถ: Prime Agent สร้าง hardware emulator ที่ใช้งานได้สำหรับ Sega Genesis และ Game Boy Color ตั้งแต่ศูนย์ด้วย Opus 5 ซึ่งล้มเหลวใน benchmark เดียวกันเมื่ออยู่ในฮาร์เนสอื่น - ข้อจำกัด (พูดตรง ๆ): ผล benchmark ผสม — GM 5.2 ชนะ 8/9 กับเฟรมเวิร์กคู่แข่ง, Opus 5 ชนะ Claude Code 6/9, GPT 5.6 ชนะ Codex 6/9 แต่ไม่กวาดเรียบ และตัวเลข ARC AGI 3 เป็นผลดีสุดจาก 3 รัน เทียบกับตัวเลขที่เผยแพร่ - เปรียบเทียบ Hermes agent: Hermes อยู่ทุกที่ (Telegram, Slack, WhatsApp, อีเมล) เรียนรู้อัตโนมัติแบบ handoff เหมาะเป็นเพื่อนคู่ใจรายวัน ส่วน Prime อยู่ที่เดียว (โฟลเดอร์+เทอร์มินัล) เรียนรู้ผ่าน refine ที่ตรวจสอบย้อนกลับได้ เหมาะกับงานยาว หนัก และต้องการหลักฐานการตรวจสอบ ## ความเห็นสรุป คอร์สนี้ให้ภาพที่ครบถ้วนและตรงไปตรงมาของ Prime Agent ทั้งด้านพลังและความเสี่ยง ตั้งแต่การติดตั้ง คำสั่งพื้นฐาน การสร้างสกิลและทีม sub agents ไปจนถึงโหมดอัตโนมัติพร้อม quality gates ซึ่งเป็นฟีเจอร์ที่ผู้พูดเน้นว่าไม่มีใน เครื่องมืออื่น จุดแข็งคือการอธิบาย "ทำไม" (เช่น เรื่อง Factorio, ดีไซน์ recursive language model, ราวกั้นความ ปลอดภัยของ refine) ไม่ใช่แค่ "ทำอย่างไร" และยอมรับข้อจำกัดจริงของ benchmark อย่างซื่อสัตย์ ผู้ชมที่สนใจเอเจนต์ เอไอโอเพนซอร์สจะได้ทั้งแนวทางปฏิบัติและกรอบคิดด้านความปลอดภัยที่นำไปใช้กับเครื่องมืออื่นได้ด้วย
คำแปลเต็ม
แปลตามบทสนทนาต้นฉบับ ปรับเป็นภาษาไทยธรรมชาติ
นี่คือคอร์ส Prime Agent AI แบบเต็มรูปแบบครับ ครอบคลุมทุกอย่างตั้งแต่การติดตั้งบนเครื่องของ คุณ ไปจนถึงการมอบงานแรกให้มัน ฝึกมันเหมือนพนักงานใหม่ และปล่อยให้มันทำงานข้ามคืนในขณะที่คุณหลับ พอจบคอร์สนี้ คุณจะรู้จักคำสั่งหลักทุกคำสั่ง ฟีเจอร์พิเศษทุกอย่างที่ไม่มีในเครื่องมืออื่น รู้ว่ามันเทียบกับ Hermes agent อย่างไร และรู้วิธีรัน Prime Agent อย่างปลอดภัย เพราะเครื่องมือนี้ต้องมีกฎความปลอดภัยจริง ๆ และเรื่องราวเบื้องหลังก็อธิบายว่าทำไมถึงเป็นแบบนั้น นี่คือเรื่องราวครับ ระหว่างการทดสอบ ทีมงานเบื้องหลัง Prime Agent ปล่อยมันเข้าไปใน Factorio เกมสร้างโรงงาน พวกเขาบอกมันเป็นตัวหนังสือธรรมดา ๆ ว่า "ห้ามโกง" เอเจนต์ทำงานหลายชั่วโมง มันลองเลย์เอาต์โรงงานหลายแบบ บันทึกแบบที่เวิร์ก เขียนโน้ตเกี่ยวกับ แบบที่ล้มเหลว คะแนนของมันไต่ผ่าน 100,000 แล้วมันก็เจอช่องโหว่ คำสั่งซ่อนเร้นที่เทเลพอร์ตทรัพยากร เข้าสู่เครื่องจักรได้โดยตรงและข้ามเกมไปเลย มันถูกบอกว่าไม่ให้ใช้ แต่มันก็ใช้อยู่ดี จากนั้นมันก็ศึกษาการโกง ของตัวเอง บันทึกสิ่งที่เรียนรู้ และเก่งการโกงขึ้นเรื่อย ๆ ในทุก ๆ รอบหลังจากนั้น เครื่องยนต์ตัวเดียวกับที่ ทำให้มันฉลาด ก็ทำให้มันเจ้าเล่ห์ เรื่องเดียวนี้บอกคุณทุกอย่างเกี่ยวกับเครื่องมือตัวนี้ มันพัฒนาตัวเองจริง ๆ และมันพัฒนาที่สิ่งใดก็ตามที่ให้ผลลัพธ์จริง ไม่ว่าคุณจะตั้งใจแบบนั้นหรือไม่ก็ตาม คอร์สนี้จึงสอนคุณทั้งสองด้าน วิธีได้ประโยชน์ และวิธีรักษาการควบคุมไว้ในขณะที่ทำเช่นนั้น
ข้อเท็จจริงสั้น ๆ เกี่ยวกับ Prime Agent ครับ มันมาจาก Prime Intellect โอเพนซอร์สเต็มรูปแบบภายใต้ MIT license ใช้ฟรี และคุณอ่านโค้ดทุกบรรทัดว่ามันทำงานอย่างไรได้บน GitHub มันเปิดตัวช่วงต้นเดือน สิงหาคม 2026 และมียอดดาวบน GitHub เกิน 13,000 ดวงแล้ว พร้อมอัปเดตที่ปล่อยออกมาทุกวัน ข้างในรันด้วย Claude Opus 5 ทีมงานรายงานผล 95.5% ในการทดสอบ ARC AGI 3 ซึ่งเป็นการทดสอบที่เอไอต้องแก้ปริศนา ที่มันไม่เคยเห็นมาก่อน โดยค่าพื้นฐาน (baseline) ของผู้เชี่ยวชาญอยู่ที่ 95.4 ในการทดสอบนั้นมันจึงทำได้ เหนือผู้เชี่ยวชาญมนุษย์เล็กน้อย มันติดตั้งด้วยคำสั่งเดียวบนเครื่อง Mac หรือ Linux และรันได้บน Claude subscription ที่คุณมีอยู่แล้ว หรือบนโมเดลท้องถิ่นฟรีก็ได้
ต่อไปคือกรอบคิดของคอร์สทั้งหมดนี้ ผมเรียกมันว่า Prime Agent Command Engine ( เครื่องยนต์ควบคุม Prime Agent) แนวคิดคือ คนส่วนใหญ่ใช้ AI เหมือนหน้าต่างแชต พิมพ์ไป มันพิมพ์ตอบกลับ พอปิดแชต ทุกอย่างก็หายไป Prime Agent ถูกสร้างต่างออกไป มันคือเครื่องยนต์ ที่มีปุ่มสตาร์ท (ignition) ระบบเกียร์ (gearbox) ตัวปรับแต่ง (tuner) และระบบขับเคลื่อนอัตโนมัติ (autopilot) พอคุณรู้วิธีควบคุมแต่ละส่วน คุณจะเลิกแชตกับ AI และเริ่มสั่งการเครื่องจักรที่ทำงานของคุณแทน คนที่นั่งบังคับเครื่องยนต์ได้ผลลัพธ์ ที่ต่างจากคนที่ตะโกนใส่คำแนะนำโดยสิ้นเชิง และแน่นอนว่า คอร์สนี้จะทำให้คุณเป็นคนที่นั่งบังคับ เครื่องยนต์ คำสั่งนี้มีห้าส่วน และเป็นห้าส่วนของคอร์สนี้ที่เรียงตามลำดับกัน ส่วนที่หนึ่งคือจุดสตาร์ท การสตาร์ทเครื่องยนต์ อย่างปลอดภัย เพราะเครื่องยนต์นี้ทรงพลังพอที่จะต้องมีโรงจอดรถ (garage) ส่วนที่สองคือการควบคุม สูตรคำสั่ง ที่กำหนดว่างานทุกชิ้นจะออกมาถูกหรือผิด ส่วนที่สามคือระบบเกียร์ ความจำ สกิล และทีม sub agent (เอเจนต์ย่อย) ทั้งทีม ซึ่งเป็นจุดที่คนงานหนึ่งคนทวีคูณเป็นทั้งแผนกที่ทำงานในขณะที่แล็ปท็อป ของคุณปิดอยู่ ส่วนที่สี่คือตัวปรับแต่ง ระบบฝึกฝนตัวเองที่ไม่มีในตลาดไหน ที่เครื่องยนต์พัฒนาตัวเองแล้วส่งล็อกให้คุณดู และส่วนที่ห้าคือระบบขับเคลื่อนอัตโนมัติ เครื่องยนต์ที่ทำงานข้ามคืนตามลำพังภายในขอบเขตที่มั นข้ามไม่ได้ ตรวจสอบด้วยการทดสอบที่มันเถียงไม่ขึ้น และส่วนสุดท้ายนี่แหละที่งานของคุณเปลี่ยนรูปร่างไปจริ ง ๆ และทุกอย่างด้านล่างนี้สร้างขึ้นเพื่อนำไปสู่จุดนั้น มาเริ่มสตาร์ทเครื่องยนต์กันเลยครับ
ส่วนที่หนึ่ง จุดสตาร์ท (ignition) ครับ คุณต้องมีเครื่อง Mac หรือ Linux บน Windows ให้ใช้ WSL ซึ่งทำให้ Windows รัน Linux ได้ และค้นหาสั้น ๆ ว่า install WSL จะพาคุณไปถึงตรงนั้นใน 10 นาที การติดตั้งใช้คำสั่งเดียว เปิดแอปเทอร์มินัลของคุณ และถ้าคุณไม่เคยเปิดเทอร์มินัลมาก่อนในชีวิต อย่าเพิ่งปิด วิดีโอนี้ เพราะความกลัวแบบนั้นคือหนึ่งในความเชื่อที่เราจะทำลายกันวันนี้ คุณวางคำสั่งติดตั้งจากหน้า GitHub ของ Prime Agent ซึ่งเริ่มต้นด้วย curl และจบด้วย sh คำสั่งนั้นดาวน์โหลดเครื่องมือ ตรวจสอบว่าไฟล์ถูกดัดแปลง หรือไม่ด้วย checksum (ค่าตรวจสอบความถูกต้องของไฟล์) และติดตั้งคำสั่งชื่อ prime agent บนเครื่องของคุณ ภายในประมาณหนึ่งนาที
ทีนี้ ก่อนที่คุณจะบิดกุญแจ ขอพูดถึงโรงจอดรถก่อน กฎนี้สำคัญกับ Prime Agent มากกว่าเครื่องมือใด ๆ ที่คุณเคยใช้ และนี่คือเหตุผลเต็ม ๆ ไม่ใช่แค่กฎลอย ๆ Prime Agent รันโค้ดบนเครื่องของคุณด้วยสิทธิ์ผู้ใช้จริง ของคุณ ผู้พัฒนาบอกไว้ชัดเจนในเอกสารของพวกเขาเองว่า มันไม่ใช่ security sandbox ( แซนด์บ็อกซ์เพื่อ ความปลอดภัย) และยังมีความเสี่ยงที่สองที่พวกเขาตั้งชื่อตรง ๆ ว่า prompt injection ( การฉีดคำสั่งแฝง) พูดง่าย ๆ ถ้าเอเจนต์อ่านไฟล์หรือหน้าเว็บที่มีคำสั่งซ่อนอยู่ คำสั่งเหล่านั้นอาจชี้นำมันได้ เครื่องยนต์ที่รัน คำสั่งได้ ถือกุญแจของคุณ และทำงานเบื้องหลังต่อไปเรื่อย ๆ คือเครื่องยนต์ประเภทที่เรื่องแบบนี้สำคัญมาก ดังนั้นคำแนะนำของพวกเขาคือ ให้ทำงานในสำเนาไฟล์ที่ใช้แล้วทิ้งได้ (disposable copy) อะไรก็ตามที่คุณ ตรวจสอบและกู้คืนได้ ณ จุดนี้ สิ่งที่คุณควรทำคือสร้างโฟลเดอร์ชื่อ agent lab แล้วก็อปปี้ไฟล์ลงไป ไม่ใช่ ต้นฉบับเด็ดขาด ทุกงานในคอร์สนี้เกิดขึ้นในโฟลเดอร์นั้น จนกว่าเครื่องยนต์จะทำงานจนหลุดออกมาได้ หลังจากเรื่อง Factorio ผมว่าคุณคงไม่ต้องให้โน้มน้าวอีก สำเนา ไม่ใช่ต้นฉบับ นั่นคือโรงจอดรถ
ทีนี้มาบิดกุญแจในเทอร์มินัลกัน พิมพ์ cd ตามด้วยช่องว่าง แล้วลากโฟลเดอร์ agent lab ของคุณเข้าไปใน หน้าต่างแล้วกด enter นั่นจะพาคุณเข้าไปในโฟลเดอร์ พิมพ์ prime agent แล้วกด enter การเปิดใช้ครั้งแรก ให้พิมพ์ /login ทีนี้คุณเลือก "เชื้อเพลิง" ว่าเครื่องยนต์จะคิดอย่างไร และคุณมีสามเส้นทาง เส้นทางที่หนึ่ง ซึ่งน่าจะเป็นเส้นทางที่พวกคุณส่วนใหญ่ควรเลือก คือล็อกอินด้วย subscription ที่คุณจ่ายอยู่แล้วอยู่แล้ว Claude Pro หรือ Max ใช้ได้ ChatGPT Plus หรือ Pro ใช้ได้ผ่านการล็อกอินของ Codex GitHub Copilot ก็ใช้ได้ ไม่ต้องมี API keys ไม่ต้องสมัครบัญชีใหม่ ไม่ต้องทำอะไรเพิ่ม เส้นทางที่สองคือ API keys คุณมี Anthropic, OpenAI, Google, Grok อะไรก็ได้ที่คุณต้องการ รองรับทั้งหมด ควบคุมได้มากกว่า และ อย่างที่เห็นในช่วงหลังของคอร์สนี้ keys คือวิธีที่คุณเชื่อมต่อบริการภายนอก เส้นทางที่สามคือแบบท้องถิ่น เต็มรูปแบบและฟรี คุณชี้ไปที่ Llama หรือ LM Studio ที่รันบนเครื่องของคุณเองได้ และไม่มีอะไรที่คุณทำ หลุดออกจากคอมพิวเตอร์ของคุณ มันช้ากว่าแต่เป็นส่วนตัว ไม่มีบัญชีต่อเนื่องใด ๆ เลย แล้วจะเลือกโมเดลไหน? จากตัวเลขที่เผยแพร่ Opus 5 ได้ผลลัพธ์ดีที่สุด รวมถึง 95.5% บน ARC AGI 3 นั้นด้วย และถ้าอยากได้ โมเดลเปิด (open model) คุณมีโมเดลที่เปิดอย่าง GM 5.2 ซึ่งชนะการทดสอบแปดในเก้ากับเฟรมเวิร์กคู่แข่ง ดังนั้น Opus 5 ถ้าคุณมี Claude subscription และ GM 5.2 ถ้าคุณอยากได้ open weights ( น้ำหนักโมเดลเปิด)
ชิ้นสุดท้ายของจุดสตาร์ทคือแดชบอร์ด มีเจ็ดคำสั่งและความหมายของแต่ละคำสั่งเป็นภาษาง่าย ๆ เพราะคุณ จะใช้มันทุกสัปดาห์ ถ้าคุณใช้ prime agent พิมพ์ prime agent agents เพื่อดูทุกเซสชันที่กำลังรันอยู่ รวมถึง ID ของเซสชันที่บันทึกไว้บนเครื่องของคุณ ซึ่งคือรายชื่อพนักงาน (staff list) ของคุณ และอย่างที่เห็นช่วงหลัง ของคอร์ส รายชื่อนั้นจะมีหลายชื่อ พิมพ์ prime agent attach ตามด้วยชื่อ เพื่อย้อนกลับเข้าไปในเซสชันที่ยัง ทำงานอยู่ เหมือนเดินเข้าไปในห้องทำงานของพนักงานกลางคัน พิมพ์ prime agent resume ตามด้วย session ID เพื่อปลุกเซสชันที่บันทึกไว้จากหลายวันก่อน ทุกสิ่งที่มันรู้ยังครบถ้วน และพิมพ์ prime agent status เพื่อตรวจว่า บริการเบื้องหลังทำงานปกติ ถ้าอยากรันตัวตรวจสุขภาพ มี prime agent doctor --fix ไว้ใช้ตอนที่รู้สึกว่ามีอะไรพัง ซึ่งจะตรวจสอบและซ่อมบริการเบื้องหลังบางตัวจริง ๆ แล้วถ้าพิมพ์ prime agent update คุณก็อัปเดตเป็นเวอร์ชัน ล่าสุดได้ คงความทันสมัย ซึ่งสำคัญเพราะโปรเจกต์นี้ปล่อยการเปลี่ยนแปลงตลอดเวลา และยังเป็นช่วงแรก ๆ มาก และ prime agent shutdown หยุดทุกเอเจนต์ ทุกคนงาน ทุกกระบวนการเบื้องหลังพร้อมกัน นั่นคือสวิตช์ปิด ทุกอย่าง (master off switch) ของคุณ น่าจะดีถ้ารู้ว่ามันมีอยู่ก่อนที่คุณจะต้องใช้มัน และนั่นคือส่วนที่หนึ่งครับ เครื่องยนต์ติดตั้งแล้ว โรงจอดรถสร้างแล้ว สวิตช์ปิดอยู่ในมือคุณแล้ว ทีนี้คุณจะได้เรียนรู้วิธีขับมัน
และนั่นพาผมไปถึงส่วนที่สอง การควบคุม (controls) และแนวคิดหนึ่งเดียวที่ทำให้เครื่องยนต์นี้แตกต่างจาก ทุกอย่างที่คุณเคยลอง ก่อนงานแรกของคุณ คุณต้องเข้าใจการตัดสินใจออกแบบเดียวที่อยู่ใต้ Prime Agent เพราะพอเข้าใจแล้ว คุณจะสั่งการเครื่องมือนี้ต่างออกไป และผลลัพธ์จะดีขึ้นอย่างมหาศาล AI ทุกตัวที่คุณเคยใช้ อ่านไฟล์ คุณส่งเอกสารให้มัน มันยัดเข้าไปในหัว ซึ่งก็คือ context window (หน้าต่างบริบท) และหัวของมัน มีขนาดจำกัด พอหัวเต็ม มันก็จะปฏิเสธหรือค่อย ๆ ลืมรายละเอียด นั่นคือเหตุผลที่เครื่องมืออย่าง Hermes agent ลืมรายละเอียดตลอดเวลา แต่ Prime Agent ไม่ได้อ่านไฟล์ของคุณเข้าไปในหัว มันเขียนโปรแกรมเล็ก ๆ ที่รันข้ามไฟล์ของคุณ เครื่องยนต์ทั้งหมดสร้างขึ้นรอบสิ่งเดียว นั่นคือ persistent Python workspace (พื้นที่ทำงาน Python แบบถาวร) สภาพแวดล้อมการเขียนโค้ดแบบสดที่ยังมีชีวิตอยู่ตลอดทั้งเซสชัน และนี่คือ ส่วนที่แยกมันจากทุกอย่างอื่น พื้นที่ทำงานนั้นคือเครื่องมือเดียวของโมเดล การอ่านไฟล์ การค้นหา การรันคำสั่ง การเรียกบริการภายนอก แม้แต่การจ้าง helper agents (เอเจนต์ช่วยงาน) ทุกการกระทำเกิดขึ้นเป็นโค้ดที่มัน เขียนและรันในพื้นที่ทำงานเดียวนั้น ผู้พัฒนาจึงเรียกดีไซน์นี้ว่า recursive language model ( โมเดลภาษาแบบ เรียกซ้ำ) คุณไม่ต้องจำศัพท์เทคนิค แค่เห็นภาพก็พอ มันคือความต่างระหว่างบรรณารักษ์ที่พยายามจำหนังสือ ทุกเล่ม กับบรรณารักษ์ที่สร้างบัตรรายการหนังสือและดึงหน้าที่คุณขอออกมาให้ บรรณารักษ์คนที่สองไม่มีวัน หัวเต็ม แล้วมันหมายความว่าอะไรสำหรับคุณในทางปฏิบัติ? พูดง่าย ๆ คือขนาดของงานไม่สำคัญอีกต่อไป เอกสารลูกค้า 10 ฉบับหรือ 1,000 ฉบับ วิธีเดียวกัน ความแม่นยำเท่ากัน เพราะมันค้นหา ไม่ได้ท่องจำ และ บทสนทนาของคุณเองก็กลายเป็นข้อมูล มันจัดการด้วยโค้ดแทนการพิมพ์ข้อความยาวเหยียด มันอ่านซ้ำไปเรื่อย ๆ ซึ่งเป็นส่วนสำคัญที่ทำให้มันทำงานยาว ๆ ต่อเนื่องหลายชั่วโมงได้
นี่คืองานแรกของคุณ และคุณลองวันนี้ได้เลย เพราะมันเป็นวิธีที่เร็วที่สุดที่จะเห็นความแตกต่าง เอาโฟลเดอร์ ที่มีงานเขียนของคุณเอง อาจเป็นบันทึกการโทรลูกค้า testimonials (คำรับรองจากลูกค้า) หรือข้อเสนอ proposals — สำเนานะครับ จำไว้ — แล้วถามสิ่งที่คุณไม่มีทางถามหน้าต่างแชตได้ ให้มันดึงทุกข้อโต้แย้งของ ลูกค้าก่อนตัดสินใจซื้อ จัดกลุ่มตามประเภท หรือหาผลลัพธ์ที่เฉพาะเจาะจงที่สุด 20 รายการที่ลูกค้ากล่าวถึง ใน testimonials เหล่านั้น หรือลิสต์ทุกสัญญาเรื่องการส่งมอบที่ถูกพูดถึงสามครั้งใน proposals เหล่านี้ พร้อมระบุไฟล์ต้นทางของแต่ละอัน มันเขียนโปรแกรมค้นหา รันข้ามทุกอย่าง แล้วส่งคำตอบกลับมาพร้อม แหล่งอ้างอิงที่คุณตรวจสอบเองได้ ประวัติธุรกิจทั้งหมดของคุณกลายเป็นสิ่งที่คุณตั้งคำถามได้
ทีนี้ สูตรคำสั่ง (command formula) นี่คือพวงมาลัยของเครื่องยนต์ทั้งระบบ และคุณภาพของคำสั่งของคุณ เป็นตัวกำหนดคุณภาพของทุกอย่างอื่นในคอร์สนี้ ส่วนที่หนึ่ง คืองานที่ระบุอย่างชัดเจน (job stated plainly) ส่วนที่สอง หน้าตาของความสำเร็จเป็นแบบไหน นั่นคือการตรวจสอบ (check) และส่วนที่สาม ผลลัพธ์จะไปอยู่ ที่ไหน (destination) แทนที่จะพูดว่า วิจัยคู่แข่งของฉัน คุณพูดว่า วิจัยห้าบริษัทอันดับต้น ๆ ในวงการ SEO ในแมนเชสเตอร์ และคำว่าเสร็จหมายถึงตารางที่มีชื่อ ข้อเสนอหลัก และเรตติงดาว พร้อมลิงก์แหล่งอ้างอิง ในแต่ละแถว บันทึกเป็นไฟล์ชื่อ competitors ในโฟลเดอร์นี้ งาน ตรวจสอบ ปลายทาง การตรวจสอบคือส่วนที่ ทุกคนข้าม และมันคือส่วนเดียวกับที่จะกลายเป็นระบบความปลอดภัยของเครื่องยนต์ในส่วนที่ห้า ดังนั้นสร้าง นิสัยนี้ไว้ตั้งแต่ตอนนี้ ในขณะที่คุณยังดูทุกงานอยู่ ขอเว้นตรงนี้สักครู่ เพราะผมรู้ว่าบางคนกำลังคิดอะไรอยู่ นี่ฟังดูทรงพลัง แต่คุณก็รู้ว่า ระหว่างเทอร์มินัล ตัวเลือกโมเดล และไฟล์ในโฟลเดอร์ คุณจะเร็วขึ้นสิบเท่าถ้ามีคนเดินอยู่ข้าง ๆ นั่นคือสิ่งที่เราทำกันในคอมมูนิตี้ ของเรา (ชื่อฟังไม่ชัด [ฟังไม่ชัด]) คุณจะได้ Agent OS (agent operating system — ระบบปฏิบัติการเอเจนต์) ที่ prime agent เสียบปลั๊กอยู่ข้าง ๆ Claude ของคุณ Hermes ของคุณ open claw ของคุณ ทั้งหมดแชร์ หน่วยความจำและชุดเครื่องมือเดียวกัน สำหรับวิดีโอ SEO agents และ AI avatars (อวตารเอไอ) ที่เชื่อมต่อไว้ แล้ว ทักษะที่คุณจะสร้างทีหลังในคอร์สนี้จึงมีเครื่องมือจริงให้เรียกใช้ คุณจะได้ไฟล์ zip แผนการดำเนินงาน 30 วัน วิดีโอสอนเต็มรูปแบบ และอัปเดตรายวันเมื่อเราปล่อยเวอร์ชันใหม่ บทช่วยสอนทีละขั้นตอนรายวันเกี่ยวกับ สิ่งที่อยู่ในคอร์สนี้เป๊ะ ๆ สูตรคำสั่ง การสร้างสกิล การออกแบบการตรวจสอบ คอลโค้ชชิ่งสี่ครั้งต่อสัปดาห์ ที่คุณแชร์หน้าจอ โชว์เซ็ตอัป Prime Agent ของคุณ และแก้ไขแบบสด มีเจ้าของธุรกิจกว่า 3,800 คนอยู่ในนั้น และหลายคนไม่เคยเปิดเทอร์มินัลมาก่อนตอนที่เข้าร่วม ลิงก์อยู่ในคอมเมนต์หรือคำอธิบาย หรือไปที่ arpufferform.com (ฟังชื่อเว็บไม่ชัด [ฟังไม่ชัด])
กลับมาที่การควบคุม เพราะ Prime Agent มาพร้อมชุดสกิลในตัว และคุณควรรู้ว่ามีอะไรอยู่ในกล่องเครื่องมือ ก่อนงานที่สองของคุณ มี web search (ค้นหาเว็บ) ซึ่งหมายความว่ามันค้นหาเว็บแบบสดได้ มันดึงข้อมูลกลางงานได้ งานวิจัยจึงใช้ข้อมูลใหม่สด ไม่ใช่ training data (ข้อมูลฝึก) เก่า ๆ มี edit (แก้ไข) การเปลี่ยนแปลงไฟล์แบบ ผ่าตัดแม่นยำ แทนที่ข้อความหนึ่งท่อนแทนการเขียนเอกสารทั้งฉบับใหม่ มี attach image ( แนบรูปภาพ) มันโหลด สกรีนช็อตหรือรูปถ่ายจากดิสก์ได้ แล้วมองมันจริง ๆ คุณส่งรูปหน้าเว็บคู่แข่งให้มัน แล้วถามคำถามเกี่ยวกับรูปนั้น ได้ มี compact (บีบอัด) มันตรวจว่าบทสนทนาเต็มแค่ไหนแล้วบีบให้เล็กลง บทสนทนาและเซสชันยาว ๆ จึงเดินหน้า ต่อไปได้ และมี goal, refine และ heartbeat ซึ่งเป็นดาวเด่นของทั้งระบบ คุณใช้มันกับการค้นหาแบบสด เช่น ให้เอเจนต์ของคุณค้นหาเว็บสดเดี๋ยวนี้เลย
ทีนี้ บางคนถามว่า Prime Agent กับ Hermes agent ต่างกันยังไง ถ้าคุณรัน Hermes อยู่แล้ว เช่น ทำไมต้องมา แตะตัวนี้? เป็นคำถามที่สมเหตุสมผล คุณไม่ต้องสลับ และถ้าคุณพอใจกับเซ็ตอัปปัจจุบัน คุณไม่ต้องเปลี่ยนอะไรเลย ทั้งคู่เป็นโอเพนซอร์ส ทั้งคู่ใช้ MIT license ทั้งคู่มาจากแล็บวิจัยจริงจัง ทั้งคู่อ้างว่าพัฒนาตัวเองได้ ทั้งคู่สร้างสกิล และเก็บความจำ แต่พวกมันถูกสร้างมาเพื่องานที่ต่างกันจริง ๆ และพอคุณเห็นความต่าง คุณจะเข้าใจ ถ้าเริ่มจาก ว่ามันอาศัยอยู่ที่ไหน Hermes อยู่ทุกที่จริง ๆ Telegram, Slack, WhatsApp, อีเมล หนึ่งเอเจนต์ หนึ่งความจำ บนทุกบริการและทุกพื้นผิว คุณส่งข้อความหามันจากโทรศัพท์ได้ ในขณะที่มันอยู่บนเครื่องที่คุณไม่เคยแตะ Prime agent อยู่ในที่เดียว นั่นคือโฟลเดอร์บนเครื่อง ในเทอร์มินัล Hermes ถูกสร้างมาให้เข้าถึงได้ง่าย Prime ถูกสร้างมาให้ถูกปล่อยไว้ตามลำพังกับงานหนัก แล้ววิธีที่แต่ละตัวเรียนรู้นี่คือทางแยกจริง ๆ Hermes มี learning loop (วงรอบการเรียนรู้) ที่รันอัตโนมัติขณะที่มันทำงาน มันเขียน reusable skill files (ไฟล์สกิล ที่ใช้ซ้ำได้) บันทึกความจำ ค้นหาบทสนทนาในอดีตของตัวเอง และสร้างภาพที่ลึกขึ้นเรื่อย ๆ ว่าคุณเป็นใคร และมันผลักดันตัวเองให้จำสิ่งต่าง ๆ มันเป็นแบบ handoff (ปล่อยมือ) โดยการออกแบบ ถูกออกแบบให้ใช้งานง่าย และค่อนข้างปล่อยวางได้ ส่วนการเรียนรู้ของ Prime Agent รันผ่าน refine ซึ่งเป็นการแก้ไขเล็ก ๆ ที่จงใจ และมีหลักฐานรองรับ โดยทุกการเปลี่ยนแปลงถูกบันทึกพร้อมเหตุผลที่ทำ การเปลี่ยนแปลงทุกอันมี ID การเปลี่ยน แปลงใด ๆ ย้อนกลับได้ด้วย ID นั้น และคำสั่งแกนกลางถูกล็อก เอเจนต์จึงไม่มีวันเขียนรากฐานของตัวเองใหม่ พูดง่าย ๆ Hermes เรียนรู้เหมือนผู้ช่วยที่เฉียบแหลมซึ่งจดบันทึกส่วนตัวเงียบ ๆ Prime เรียนรู้เหมือนพนักงาน ที่คุณเปิดแฟ้มฝึกอบรม อ่านทีละบรรทัด และแก้ไขได้ด้วยปุ่มเลิกทำบนทุกการเปลี่ยนแปลง และหลังจากเรื่อง Factorio คุณเข้าใจแล้วว่าทำไม Prime ถึงถูกสร้างแบบนี้ เมื่อเอเจนต์สอนตัวเองให้โกงได้ ร่องรอยการตรวจสอบ การเรียนรู้ (audit trail) คือฟีเจอร์ที่คุณน่าจะอยากได้
แล้วรูปร่างของงานจริงก็ต่างกัน Hermes เก่งเรื่องการเป็นเพื่อนคู่ใจรายวันของคุณ คุณตั้งเวลาสรุปข่าวเช้าเป็น ภาษาธรรมดา ยิงมาเข้าโทรศัพท์ระหว่างประชุม ให้มันค้นอะไรสักอย่างแล้วส่งข้อความหาคุณ ส่วน Prime Agent เก่งงานยาว หนัก และตรวจสอบได้ งานที่รันหลายชั่วโมงข้ามกองไฟล์มหาศาล ที่บทสนทนาจะระเบิด context window ปกติ ที่คุณต้องการหลักฐานว่างานเสร็จจริง หลักฐานนั้นคือ low-bounded autonomous mode (โหมดอัตโนมัติแบบมีขอบเขตจำกัด) ของ Prime พร้อม quality gates (ประตูตรวจสอบคุณภาพ) พูดง่าย ๆ คือการตรวจสอบจริงที่ต้องผ่านก่อนที่เอเจนต์จะบอกว่างานเสร็จ Hermes ไม่ค่อยมีแบบนั้น ไม่มีเครื่องมืออื่น มีแบบนั้น คุณจะได้เรียนรู้ในส่วนที่ห้า ดังนั้นพวกมันต่างกันมากในแง่วิธีทำงานและสิ่งที่คุณใ ช้มันทำ
ทีนี้ ส่วนที่สาม ระบบเกียร์ (gearbox) ความจำ สกิล และทีม นี่คือจุดที่เครื่องยนต์ทวีกำลัง Prime Agent เก็บ durable state (สถานะถาวร) สี่ชนิด และคุณควรรู้ทั้งสี่ เพราะคุณสร้าง อ่าน แก้ไข และลบมันทุกอันได้ และเอเจนต์ก็ทำได้เหมือนกัน หนึ่ง prompt notes (โน้ตคำสั่ง) คำสั่งประจำตัวอย่างเช่น ให้แหล่งอ้างอิงฉันเสมอ หรือเขียนเป็นภาษาอังกฤษธรรมดา สอง memories (ความทรงจำ) ข้อเท็จจริงที่บันทึกไว้เกี่ยวกับคุณและงาน ของคุณ สาม skills (ทักษะ) เวิร์กโฟลว์ที่ใช้ซ้ำได้ และสี่ subagent specs (สเปกเอเจนต์ย่อย) รายละเอียดงาน ที่บันทึกไว้สำหรับ helper agents หรือ subagents ที่มันสามารถจ้างได้อีกในภายหลัง prompts, memories, skills และ subagents สี่อย่างนี้คือเฟือง และทุกอย่างจากตรงนี้ไปจนถึงระบบขับเคลื่อนอัตโนมัต ิคือเรื่องของ การทำให้มันเติบโตขึ้น
เริ่มจากความจำก่อน เพราะมันเป็นชัยชนะที่ง่ายที่สุดของทั้งคอร์ส เมื่อเอเจนต์ทำอะไรถูกต้องหรือเรียนรู้ ข้อเท็จจริงจริงเกี่ยวกับธุรกิจของคุณ บอกมันตรง ๆ แล้วบันทึกเป็น memory เช่น บันทึกความจำว่า ลูกค้าของเรา เป็นธุรกิจบริการท้องถิ่น (local service business) และเราไม่ใช้ศัพท์เฉพาะอุตสาหกรรมในสิ่งใดก็ตามที่ติดต่อ กับลูกค้า ถ้าคุณพูดแบบนั้นกับเอเจนต์ จากนั้นข้อเท็จจริงนั้นก็เดินทางไปกับมันทุกที่ และนี่คือจุดที่ความเชื่อ จำกัดใหญ่ข้อแรกเกี่ยวกับ AI ต้องพังทลาย หลายคนคิดว่า AI ลืมทุกอย่าง หรือ context window หรือความจำ ไม่ไหว คุณใช้ระบบนี้บอกให้มันจำข้อเท็จจริงเกี่ยวกับอะไรก็ได้ แล้วมันก็ไม่ลืมรายละเอียดใด ๆ
ทีนี้ สกิลคือจุดที่ Prime Agent เปล่งประกาย และ Prime Agent มีสกิลสองแบบ การรู้ความแตกต่างจะช่วยให้ คุณไม่สับสนทีหลัง แบบแรกคือ skill description (คำอธิบายสกิล) โน้ตที่บันทึกเกี่ยวกับขั้นตอนที่ทำซ้ำได้ ซึ่งระบบ refine สร้างขึ้นเองได้เมื่อมันสังเกตว่าคุณกำลังทำอะไรซ้ำ ๆ แบบที่สองคือแบบหนัก ( heavyweight) นั่นคือ executable skill (สกิลที่รันได้) โปรแกรมจริงที่ติดตั้งได้บนดิสก์ ซึ่งเพิ่มความสามารถใหม่จริง ๆ ให้ เครื่องยนต์ มี skill creator (ตัวสร้างสกิล) ในตัว หน้าที่ทั้งหมดคือแพ็กเกจเวิร์กโฟลว์ เอเจนต์แค่ทำให้สำเร็จ แล้วแพ็กเป็นหนึ่งในนั้น และรายละเอียดปฏิบัติสองอย่างจากเอกสารที่จะช่วยคุณไม่ให้ปวดหัว หลังจากสร้าง executable skill ใหม่ พิมพ์ /reload เพื่อให้เอเจนต์ค้นพบมันใหม่ และเริ่มเซสชันใหม่เพื่อให้มันติดตั้งอย่าง ถูกต้อง เรื่องเล็ก ๆ แต่สำคัญตั้งแต่วันแรก การเล่นที่แนะนำตรงนี้คือ เลือกกระบวนการที่คุณทำซ้ำทุกสัปดาห์ เช่น งานวิจัยที่คุณทำก่อนการโทรขายทุกครั้ง ใช่ไหม? จากนั้นขั้นตอนที่สอง พาเอเจนต์เดินผ่านมันครั้งเดียว แก้ไขไป เรื่อย ๆ เหมือนฝึกพนักงานใหม่เป๊ะ ๆ ดูบริษัท หาข่าวล่าสุด ตรวจรีวิว สรุปในหน้าเดียวสามหัวข้อ แล้วขั้นตอน ที่สาม เมื่อผลลัพธ์ออกมาถูกต้อง พูดว่า แพ็กสิ่งที่คุณเพิ่งทำเป็นสกิลชื่อ prep (เตรียมการ) เป็นตัวอย่างของ เวิร์กโฟลว์นี้ แล้วสี่ พิมพ์ /reload เริ่มเซสชันใหม่ และจากสัปดาห์หน้า กระบวนการทั้งหมดกลายเป็นหนึ่งบรรทัด คุณรัน call prep บนบริษัทนี้ได้ และกระบวนการที่เคยอยู่ในหัวของคุณ ตอนนี้ถูกบันทึกเป็นคำสั่งใน prime agent เมื่อตั้งค่านี้แล้ว มันรันตลอดไป ถ้านั่นคือหนึ่งกระบวนการต่อสัปดาห์ที่กลายเป็นสกิล ผ่านไป 12 สัปดาห์ กระบวนการประจำของคุณ 12 อย่างจะรันด้วยคำสั่ง วิธีแบบเก่าคือกระบวนการของคุณอยู่ในหัว หรืออยู่ในเอกสาร อย่าง SOP (เอกสารมาตรฐานการทำงาน) และขึ้นอยู่กับว่าวันนั้นคุณอารมณ์ดีแค่ไหน วิธีแบบใหม่คือกระบวนการ ของคุณคือเฟืองในเครื่องยนต์ และเฟืองไม่มีวันอารมณ์ไม่ดี เพราะมันทำซ้ำได้แม่นยำมาก
ทีนี้มาพูดถึงทีมกัน เพราะนี่คือเฟืองที่เปลี่ยนคนงานหนึ่งคนให้เป็นทั้งแผนก เอเจนต์หลักสามารถสร้าง sub agents ได้ เอเจนต์แยกต่างหากจริง ๆ แต่ละตัวมีเซสชันของตัวเอง พื้นที่ทำงานของตัวเอง ประวัติของตัวเอง ในโค้ด การจ้างหนึ่งตัวคือการเรียกฟังก์ชันครั้งเดียวจริง ๆ และรายละเอียดสำคัญคือการเรียกนั้นไม่รอ เอเจนต์หลัก ยิง subagent ออกไปทันทีแล้วทำงานต่อ Subagents รันแบบขนาน และส่งผลลัพธ์กลับมาทางข้อความเมื่อมันเสร็จ คุณพูดได้ว่า สร้าง sub agent สามตัว หนึ่งตัววิจัยว่าคู่แข่งอันดับต้น ๆ ของเราเปลี่ยนอะไรบนเว็บไซต์ในไตรมาสนี้ หนึ่งตัวดึงคำถามที่พบบ่อยที่สุดจากอีเมลลูกค้าของเรา และหนึ่งตัวร่างไอเดียคอนเทนต์เดือนหน้า แล้วคุณรวม ทุกอย่างเป็นรายงานเดียว คุณได้คนงานสามคนรันพร้อมกัน ผู้จัดการหนึ่งคนรวบรวมผลลัพธ์ คำสั่งหนึ่งคำสั่งจากคุณ และรายละเอียด subagent สามอย่างที่ควรรู้ เพราะแต่ละอย่างโชว์ว่ามันถูกสร้างอย่างตั้งใจแค่ไห น สิ่งที่เจ๋ง เกี่ยวกับ subagents โดยเฉพาะกับ prime agent หนึ่ง พวกมันคงอยู่ (persistent) ตัวที่เสร็จงานไม่หายไป เซสชันของมันยังอยู่ พรุ่งนี้คุณส่งงานต่อเนื่องให้มันได้ มันจำทุกอย่าง สอง เมื่อไม่ได้ใช้งานประมาณ 30 นาที subagent จะถูกยกเลิกโหลดอย่างเงียบ ๆ และทันทีที่มีคนเรียกมันอีกครั้ง มันโหลดกลับมาจากจุดที่บันทึกไว้ เหมือนมันไม่เคยจากไป และสาม มีขอบเขตจงใจว่าใครคุยกับใครได้ เอเจนต์ส่งข้อความได้เฉพาะภายในครอบครัว ของตัวเอง ตัวอย่างเช่น คุณมี parent agent (เอเจนต์แม่) กับ subagents ของมัน และเอเจนต์อื่น ๆ ใต้ parent นั้น ผู้พัฒนากำหนดขอบเขตนี้โดยตั้งใจ คุณจะไม่มีเซสชันที่ไม่เกี่ยวข้องกันเป็นโหล ๆ ส่งข้อความคุยกันอย่าง คาดเดาไม่ได้ แต่ประเด็นหลักคือเอเจนต์เหล่านี้ส่งข้อความหากันได้โดยตรง ชี้นำงานของกันและกันได้ โดยไม่ต้อง วนทุกอย่างผ่านคุณ ผู้จัดการแก้ไขงานวิจัยกลางคันได้ คุณสร้างแผนกขึ้นมา และแผนกก็พูดคุยกัน
และสิ่งเจ๋ง ๆ ที่อยู่ใต้ทั้งหมดนี้คือชิ้นส่วนที่ทำให้งานยาวเป็นจริง นั่นคือ daemon (ดีมอน) บริการเบื้องหลัง ที่เป็นเจ้าของทุกเซสชันสด นี่หมายความว่าเซสชันไม่ได้ผูกติดกับหน้าต่างเทอร์มินัลของคุณ ถ้าคุณปิดแล็ปท็อป ไปยิม ไปเดินเล่น เครื่องยนต์ยังรันต่อไป กลับมา พิมพ์ prime agent attach แล้วคุณก็ยืนอยู่ในห้องทำงาน ของมันอีกครั้ง มองมันทำงานกลางคัน ถ้ามีอะไร crash ดีมอนกู้เซสชันจากบันทึกที่บันทึกไว้ บวกกับสแนปช็อต ของพื้นที่ทำงาน แทนที่จะเสียเวลาหลายชั่วโมงของความคืบหน้า นี่คือความหมายของการทำงานยาว และมันคือ รากฐานที่ระบบขับเคลื่อนอัตโนมัติยืนอยู่
อีกสามคำสั่งทำให้ระบบเกียร์สมบูรณ์ และแต่ละคำสั่งแก้ปัญหาจำเพาะที่คุณน่าจะเจอ หนึ่งคือ /goal เป้าหมาย คือวัตถุประสงค์ถาวรพร้อมงบประมาณเสริม และฮาร์เนสจะคอยดึงเอเจนต์กลับมาที่เป้าหมายรอบแล้วรอบ เล่า จนกว่าเอเจนต์จะทำเครื่องหมายว่าสำเร็จอย่างชัดเจน มันมีการเรียกบอกเสร็จสิ้น (completion call) ที่มันต้องทำ จริง ๆ ทำไมถึงสำคัญ? ในงานยาว เอเจนต์ลอยไป บริบทช่วงแรกถูกบีบให้เล็กลง เธรดหาย และเอเจนต์อาจเร่ร่อน ไปทำอะไรที่ใกล้เคียง เป้าหมายคือเชือกที่ผูกไว้กับนิ้วมัน ที่หลุดโดยไม่ได้ตั้งใจไม่ได้ สองคือ /heartbeat หัวใจเต้นคือข้อความเตือนใจ (me message) ที่ถูกฉีดเข้าไปในเซสชันตามเวลาทุกสองสามนาทีอัตโนมั ติ เหมือน ผู้จัดการโผล่หน้าเข้ามาดู มันเหมาะกับงานที่เอเจนต์รออะไรที่ช้า หรือที่คุณอยากให้มันคอยเช็กความคืบหน้าของ subagent โดยที่คุณไม่ต้องสังเกตอะไร และสาม prime agent schedule ซึ่งเริ่มเซสชันตามเวลาที่ตั้ง ตัวอย่างเช่น ทุกวันทำงานตอน 7 โมงเช้า ตรวจโฟลเดอร์ notes สรุปอะไรใหม่ ๆ และบันทึกไฟล์สรุปตอนเช้า วันของเอเจนต์ คุณจึงเริ่มต้นด้วยสรุปที่คุณไม่ต้องทำเอง ส่วนที่สี่ ตัวปรับแต่ง (tuner) ฟีเจอร์ที่ไม่มีเครื่องมืออื่น บ่อยครั้ง เวลาใช้เอเจนต์ เราต้องวนไปวนมา ต้องให้ ฟีดแบ็กกับมัน ตอนนี้กับ prime agent คุณใช้ /refine ได้ และเมื่อรันมัน เอเจนต์จะทบทวนงานล่าสุดของตัวเอง เป็นหลักฐาน อะไรถูกแก้ อะไรล้มเหลว รูปแบบอะไรที่ซ้ำ ๆ กัน แล้วมันใช้การแก้ไขเล็กที่สุดที่เป็นประโยชน์กับ เซ็ตอัปของตัวเอง บันทึกความจำ อัปเดตคำอธิบายสกิล ปรับ prompt note หรือปรับแต่ง subagent spec มันเล็ก เจาะจง มีหลักฐานรองรับ และมันวางแผนการปรับแต่งเหล่านี้ในเบื้องหลังได้โดยไม่ขัดจังหวะงานที่ อยู่ตรงหน้าคุณ ราวกั้นความปลอดภัย (guardrails) คือเหตุผลที่มันปลอดภัยพอจะใช้ และคุณควรรู้ทั้งสามแบบขึ้นใจ จำไว้ด้วยว่า refine มีล็อกให้คุณเห็นว่าทำอะไรไปบ้าง และคุณเลิกทำอะไรก็ได้ที่ถูกปรับแต่งมา ราวกั้นข้อหนึ่ง base system prompt (พรอมต์ระบบพื้นฐาน) เปลี่ยนไม่ได้ Refine แก้ได้แค่ชั้นรอบแกนกลาง เอเจนต์ไม่มีวันเขียนรากฐานของ ตัวเองใหม่ ไม่ว่ามันจะเรียนรู้อะไร สอง ทุกการเปลี่ยนแปลงถูกบันทึกใน refinement history ( ประวัติการปรับแต่ง) พร้อมเหตุผลที่ทำ คุณเปิดประวัติและอ่านเป็นข้อความธรรมดาว่าเครื่องยนต์ของคุณตัดสินใจเปลี่ยน อะไรเกี่ยวกับ ตัวเองและทำไม สาม ทุกการเปลี่ยนแปลงมี ID และอัปเดตที่แย่สามารถย้อนกลับด้วย ID นั้น มีการบันทึก สแนปช็อตเพื่อรองรับการย้อนกลับโดยเฉพาะ ถ้ามันเรียนรู้บทเรียนที่ไม่ดี คุณเลิกบทเรียนนั้นแบบผ่าตัดได้โดยไม่ แตะต้องอย่างอื่นที่มันเรียนรู้
คุณตั้งกิจวัตรรายสัปดาห์ได้ ให้เอเจนต์ทำงานจริง แก้มันแบบที่คุณแก้พนักงานใหม่ เจาะจง ไม่คลุมเครือ ไม่ใช่ "อันนี้ผิด" แต่ "ห้ามใช้สามวลีนี้" และ "ให้มีสามแหล่งอ้างอิงเสมอ" ทำแบบนั้นสักสองสามงาน รัน /refine แล้ว อย่าข้ามขั้นนี้ เปิดประวัติและอ่านสิ่งที่มันเขียนเกี่ยวกับตัวเอง แล้วส่งงานคล้าย ๆ กันให้มัน แล้วดูมันนำบทเรียน ไปใช้โดยไม่ต้องบอก การแก้ไขของคุณทบต้นเมื่อเวลาผ่านไป สัปดาห์แรกมันอาจยังพลาดบ้างเป็นครั้งคราว แต่ สัปดาห์ที่สาม งานมาถึงโดยทำตามกฎของคุณแล้ว และคุณยังต้องแน่ใจว่าความจำในระบบเจาะจงจริง ๆ
ทีนี้ refine เป็นฟีเจอร์หลัก แต่มีสองเรื่องที่ต้องพูดตรง ๆ หนึ่ง คนที่ขุดซอร์สโค้ดพบว่าขั้นตอนการทบทวน (review) ทำโดยโมเดล AI อีกตัว และถึงแม้มันจะบันทึกว่าคาดหวังผลลัพธ์อะไรจากการเปลี่ยนแปลงแต ่ละครั้ง มันก็ไม่ได้วนกลับมาตรวจสอบทีหลังว่าการเปลี่ยนแปลงช่วยจริงหรือไม่ การตรวจสอบนั้นเป็นงานของคุณ และใช้เวลา ห้านาทีต่อสัปดาห์ คุณควรอ่านประวัติ ทดสอบบทเรียนกับงานใหม่ ย้อนกลับอะไรก็ตามที่ดูไม่ดี และสอง ประเด็น ที่ลึกกว่า ฮาร์เนสที่พัฒนาตัวเองได้สามารถรักษาสมมติฐานที่ผิดได้อย่างมีประสิทธิภาพพอ ๆ กับสมมติฐานที่ดี ความคงอยู่เป็นดาบสองคม นั่นคือเหตุผลที่ล็อกและการย้อนกลับไม่ใช่ของฟุ่มเฟือย มันคือเหตุผลทั้งหมดที่ตัว ปรับแต่งปลอดภัยพอจะรัน
ทีนี้มาพูดถึงระบบขับเคลื่อนอัตโนมัติในส่วนที่ห้ากัน ทุกอย่างในคอร์สนี้สร้างมาสู่จุดนี้ และทุกส่วนของ command engine ปรากฏในส่วนนี้ โรงจอดรถจากส่วนที่หนึ่ง งาน ตรวจสอบ ปลายทาง จากส่วนที่สอง สกิลและทีม จากส่วนที่สาม พฤติกรรมที่ถูกปรับแต่งจากส่วนที่สี่ และตอนนี้เครื่องยนต์รันโดยไม่มีคุณ ภายในกล่องที่คุณวาด ตรวจสอบด้วยการทดสอบที่มันเถียงไม่ขึ้น ระบบขับเคลื่อนอัตโนมัติรันตรงจากบรรทัดคำสั่งด้วยแฟล็ ก --autonomous คุณตั้งเป้าหมายและขีดจำกัดในคำสั่งเดียวกันได้ และขีดจำกัดนั้นจริง มีค่าเริ่มต้นจริงที่คุณเปลี่ยน ได้ เพดานจำนวนการตอบสนองที่เอเจนต์สร้างได้ 12 โดยค่าเริ่มต้น เพดานจำนวนโทเคนรวมที่มันใช้จ่ายได้ เพดาน จำนวนการสะกิดติดตาม (follow-up nudges) ที่ระบบฉีดเองได้ สามโดยค่าเริ่มต้น ขีดจำกัดเวลาอีกชั้น เครื่องยนต์ รันตลอดไปไม่ได้ และมันรันในกล่องที่คุณเป็นคนวาด แต่ขีดจำกัดไม่ใช่ส่วนพิเศษจริง ๆ ประตูตรวจสอบ (gates) ต่างหาก คือมี gate ซึ่งเป็นฟีเจอร์ที่ผมเห็นแค่จาก prime agent เท่านั้น พูดง่าย ๆ คือมันสร้างการทดสอบที่ เอเจนต์ต้องผ่าน ก่อนที่มันจะถูกอนุญาตให้บอกว่างานเสร็จ มันค่อนข้างเคร่ง ถ้า gate ล้มเหลว ความล้มเหลวจะถูก ป้อนกลับเข้าไปในเซสชัน เอเจนต์ต้องทำงานต่อ แต่ละ gate มีขีดจำกัดการลองใหม่ สามครั้งโดยค่าเริ่มต้น และ timeout ห้านาทีต่อการตรวจ ตรวจที่ติดค้างจึงไม่ทำให้ทั้งรันค้าง คุณซ้อนหลาย gate บนงานเดียวได้ และมันรัน ตามลำดับ เอเจนต์ประกาศชัยชนะไม่ได้ งานต้องผ่านการตรวจ หรืองานนั้นไม่เสร็จ พูดง่าย ๆ มันวนไปวนมาได้ และเอเจนต์แกล้งทำเป็นเสร็จไม่ได้ มันต้องวนต่อไปเรื่อย ๆ
ทีนี้มาปิดวงรอบเรื่อง Factorio เพราะบทเรียนเต็ม ๆ ควรอยู่ตรงนี้ที่ระบบขับเคลื่อนอัตโนมัติ เอเจนต์นั้นถูกบอก เป็นลายลักษณ์อักษรซ้ำ ๆ ว่าห้ามโกง มันโกงอยู่ดี และวงรอบการพัฒนาตัวเองทำให้มันเป็นนักโกงที่ดีขึ้น เพราะ จากมุมมองของระบบ การโกงสร้างผลลัพธ์ที่ควรค่าแก่การจำ บทเรียนคือหนึ่งประโยค และมันเป็นประโยคที่สำคัญ ที่สุดในคอร์สนี้ เอเจนต์ที่พัฒนาตัวเองได้จะเก่งขึ้นในสิ่งใดก็ตามที่ได้รางวัลจริง ไม่ใช่ในสิ่งที่คุณตั้งใจ นั่นหมาย ความว่าวิธีที่คุณตรวจงานตอนนี้สำคัญกว่าที่เคยเป็นมาในประวัติศาสตร์ของเครื่องมือเหล่านี้ คุณจึงต้องแน่ใจว่า มีเกณฑ์ชัดเจนมากว่าผลงานและความสำเร็จหน้าตาเป็นแบบไหน อย่าทั่วไป อย่าคลุมเครือ และยังต้องตรวจล็อก ตรวจสิ่งที่มันทำ
ถ้าคุณอยากได้หลักฐานว่าระบบขับเคลื่อนอัตโนมัติรับงานขนาดไหน ผู้พัฒนารัน benchmark ( การวัดประสิทธิภาพ) จริงที่เอเจนต์ต้องสร้าง hardware emulator (อีมูเลเตอร์ฮาร์ดแวร์) ที่ใช้งานได้จากศูนย์โดยสมบูรณ์ ไม่มี reference implementation (โค้ดอ้างอิง) ตรวจยืนยันด้วยโปรแกรมวินิจฉัยที่เทียบพฤติกรรมกับฮาร ์ดแวร์จริง และ Prime Agent สร้างอีมูเลเตอร์ที่ใช้งานได้สำหรับ Sega Genesis และ Game Boy Color รุ่นดั้งเดิม ปกติ นั่นคืองานวิศวกรรมหลายวัน แต่ทำแบบอัตโนมัติและยืนยันด้วยการตรวจสอบ และทำด้วย Opus 5 หนึ่งในโมเดล ที่แข็งแกร่งที่สุดที่มีอยู่ ซึ่งล้มเหลวใน benchmark เดียวกันในฮาร์เนสอื่น ถึงแม้แต่ละขั้นตอนของมันจะดูประสบ ความสำเร็จระหว่างทาง สมองเดียวกัน แค่ฮาร์เนสต่าง ผลลัพธ์ตรงข้าม เครื่องยนต์ที่อยู่รอบโมเดลเป็นตัวกำหนดว่า โมเดลจะทำงานอะไรให้สำเร็จได้จริง นั่นคือเหตุผลทั้งหมดที่เครื่องมือนี้มีอยู่
นี่คือ command engine เต็มรูปแบบที่รัน end-to-end โดยใช้ทุกอย่างในคอร์สนี้ คุณมีเซสชันตามตารางเวลาที่เริ่ม กลางคืน เป้าหมาย: ผลิตรายงานคู่แข่งรายสัปดาห์ มันรัน call prep และสกิลงานวิจัยของคุณจากส่วนที่สาม มัน สร้าง sub agent สองตัวทำงานแหล่งข้อมูลแบบขนาน heartbeat ตรวจความคืบหน้าทุกสองสามนาที gate มาตรฐาน สองตัว ทางออก: ไฟล์รายงานต้องมีอยู่ และทุกรายการต้องมีลิงก์แหล่งอ้างอิง ลองใหม่สามครั้งต่อตัว แล้วรันก็หยุด แทนที่จะส่งของเสียออกมา คุณตื่นขึ้น อ่านรายงานเหมือนเจ้าของที่ทบทวนงานพนักงาน แก้หนึ่งหรือสองจุด รัน /refine ให้การแก้ไขติด และดู refinement history สิบห้านาทีของความสนใจคุณ งานหลายชั่วโมงเสร็จ และ เครื่องยนต์ทั้งระบบปรับแต่งเก่งกว่าวันเมื่อวานเล็กน้อย นั่นคือ Prime Agent Command Engine ที่ประกอบเสร็จ สมบูรณ์
ทีนี้มาพูดถึงข้อจำกัดบางอย่าง benchmark ผลลัพธ์ผสมกันในชุดทดสอบ long context (บริบทยาว) Prime agent กับ GM 5.2 ชนะแปดในเก้าการทดสอบกับเฟรมเวิร์กคู่แข่ง ด้วย Opus 5 มันชนะ Claude Code เฉียด ๆ หกในเก้า ด้วย GPT 5.6 มันชนะ Codex หกในเก้า แต่ไม่ได้กวาดเรียบทุกอย่าง เครื่องมือที่ตั้งหลักแล้วยังชนะบางหมวดหมู่ ขาดลอย และตัวเลขไฮไลต์ ARC AGI 3 เป็นผลดีที่สุดจากสามรัน เปรียบเทียบกับตัวเลขที่เผยแพร่ของเครื่องมืออื่น แทนที่จะเป็นการแข่งขันตัวต่อตัวที่ควบคุมเต็มรูปแบบ เพราะการจำลองเซ็ตอัปคู่แข่งของทีมเองออกมาต่ำกว่าตัวเลข ทางการ และพวกเขาเลือกการเปรียบเทียบที่ยุติธรรมกว่า
หมายเหตุการแปล
ความโปร่งใสเกี่ยวกับความไม่แน่นอนในต้นฉบับ
- | "GPT 5.6 Soul" | GPT 5.6 (คำว่า "Soul" ไม่ชัด อาจเป็นชื่อรุ่นย่อยหรือคำเพี้ยน — เก็บเป็น "GPT 5.6") |
- ## จุดที่ฟังไม่ชัด ([ฟังไม่ชัด])
- agent operating system") ไม่สามารถระบุชื่อจริงได้ แปลเป็น "คอมมูนิตี้ของเรา (ชื่อฟังไม่ชัด [ฟังไม่ชัด])"
- 2. **ชื่อเว็บไซต์** — คำบรรยายเขียน "arpufferform.com" ฟังไม่ชัด เก็บตามที่ได้ยินพร้อมวงเล็บ
- (ฟังชื่อเว็บไม่ชัด [ฟังไม่ชัด]) อย่าเดาเป็นชื่ออื่น
- "low bounded autonomous mode" — คำบรรยายไม่ชัด แปลตามบริบทเป็น "โหมดอัตโนมัติแบบมีขอบเขตจำกัด"
- "aircraft volume" และ "arpufferform.com" — ตามข้อ [ฟังไม่ชัด] ข้างต้น
อภิธานศัพท์เทคนิค
คำศัพท์และชื่อผลิตภัณฑ์ที่คงรูปภาษาอังกฤษ
| ศัพท์ | คำแปล / คำอธิบาย |
|---|---|
| Prime Agent | เอเจนต์เอไอโอเพนซอร์สจาก Prime Intellect ตัวเอกของวิดีโอนี้ |
| Prime Intellect | บริษัท/ทีมผู้พัฒนา Prime Agent |
| Hermes agent | เอเจนต์เอไอโอเพนซอร์สอีกตัวที่นำมาเปรียบเทียบ (อยู่ทุกแพลตฟอร์ม เรียนรู้อัตโนมัติ) |
| MIT license | สัญญาอนุญาตโอเพนซอร์สแบบเปิดกว้าง |
| Claude Opus 5 / Opus 5 | โมเดล AI ของ Anthropic ที่ใช้รัน Prime Agent ในวิดีโอ |
| Claude Pro / Max | แพ็กเกจสมาชิกของ Claude |
| ChatGPT Plus / Pro | แพ็กเกจสมาชิกของ ChatGPT |
| Codex | เครื่องมือ/บริการเขียนโค้ดของ OpenAI (ใช้ล็อกอินเชื่อมต่อได้) |
| GitHub Copilot | ผู้ช่วยเขียนโค้ดของ GitHub (เชื่อมต่อเป็น fuel ได้) |
| API keys | คีย์สำหรับเชื่อมต่อบริการภายนอก (Anthropic, OpenAI, Google, Grok ฯลฯ) |
| GM 5.2 | โมเดลเปิดของ Google (คำบรรยายอัตโนมัติฟังเป็น GM 5.2 น่าจะเป็น Gemini 5.2) |
| GPT 5.6 | โมเดลของ OpenAI (คำบรรยายฟังเป็น "GPT 5.6 Soul" — ชื่อรุ่นไม่ชัดเจน) |
| Grok | โมเดล AI ของ xAI |
| ARC AGI 3 | ชุดทดสอบที่เอไอต้องแก้ปริศนาที่ไม่เคยเห็นมาก่อน |
| WSL | Windows Subsystem for Linux — เครื่องมือให้ Windows รัน Linux ได้ |
| curl / sh | คำสั่งติดตั้ง: curl ดาวน์โหลด, sh รันสคริปต์ |
| checksum | ค่าตรวจสอบความถูกต้องของไฟล์ (กันการถูกดัดแปลง) |
| agent lab | โฟลเดอร์ "ห้องทดลอง" ที่แนะนำให้ทำงานทุกอย่าง (ใส่สำเนาไฟล์ ไม่ใช่ต้นฉบับ) |
| security sandbox | แซนด์บ็อกซ์เพื่อความปลอดภัย — Prime Agent ไม่ใช่สิ่งนี้ |
| prompt injection | การฉีดคำสั่งแฝง — คำสั่งซ่อนในไฟล์/หน้าเว็บที่อาจชี้นำเอเจนต์ |
| disposable copy | สำเนาไฟล์ที่ใช้แล้วทิ้งได้ ตรวจสอบและกู้คืนได้ |
| prime agent (command) | คำสั่งหลักสำหรับเรียกใช้เครื่องมือ |
| /login | คำสั่งล็อกอินครั้งแรก |
| prime agent agents | ดูทุกเซสชันที่กำลังรันและ ID ที่บันทึกไว้ |
| prime agent attach | ย้อนกลับเข้าเซสชันที่ยังทำงานอยู่ |
| prime agent resume | ปลุกเซสชันเก่าที่บันทึกไว้ |
| prime agent status | ตรวจสุขภาพบริการเบื้องหลัง |
| prime agent doctor --fix | ตรวจสอบและซ่อมบริการเบื้องหลัง |
| prime agent update | อัปเดตเป็นเวอร์ชันล่าสุด |
| prime agent shutdown | หยุดทุกเอเจนต์/กระบวนการพร้อมกัน (สวิตช์ปิดทุกอย่าง) |
| master off switch | สวิตช์ปิดทุกอย่าง |
| context window | หน้าต่างบริบท — ขอบเขตความจำของโมเดลต่อบทสนทนา |
| persistent Python workspace | พื้นที่ทำงาน Python แบบถาวรที่อยู่ตลอดเซสชัน — หัวใจของดีไซน์ Prime Agent |
| recursive language model | โมเดลภาษาแบบเรียกซ้ำ — เขียนโค้ดเป็นเครื่องมือเดียวในการทำงาน |
| helper agents | เอเจนต์ช่วยงาน |
| command formula | สูตรคำสั่ง 3 ส่วน: งาน (job) + การตรวจ (check) + ปลายทาง (destination) |
| web search / edit / attach image / compact | สกิลในตัว: ค้นหาเว็บ / แก้ไขไฟล์แม่นยำ / แนบรูป / บีบอัดบทสนทนา |
| goal (/goal) | เป้าหมายถาวรที่ฮาร์เนสคอยดึงเอเจนต์กลับมา |
| refine (/refine) | ระบบปรับแต่งตัวเอง — ทบทวนงานและแก้เซ็ตอัปเล็ก ๆ พร้อมล็อกเหตุผล |
| heartbeat (/heartbeat) | ข้อความเตือนใจที่ฉีดเข้าสู่เซสชันเป็นช่วง ๆ อัตโนมัติ |
| /reload | โหลดเอเจนต์ใหม่ให้ค้นพบสกิลที่สร้างใหม่ |
| prime agent schedule | เริ่มเซสชันตามเวลาที่ตั้งไว้ |
| sub agent / subagent | เอเจนต์ย่อยที่เอเจนต์หลักจ้างมาทำงานขนานกัน |
| parent agent | เอเจนต์แม่/หลักที่คุม subagents |
| subagent specs | รายละเอียดงาน (สเปก) ที่บันทึกไว้สำหรับจ้าง subagents ซ้ำ |
| prompt notes | โน้ตคำสั่งประจำตัว (standing instructions) |
| memories | ความทรงจำ — ข้อเท็จจริงที่บันทึกเกี่ยวกับคุณและงาน |
| skills | ทักษะ — เวิร์กโฟลว์ที่ใช้ซ้ำได้ |
| skill description | คำอธิบายสกิลแบบเบา (สร้างเองโดยระบบ refine) |
| executable skill | สกิลแบบหนัก — โปรแกรมจริงที่ติดตั้งบนดิสก์ |
| skill creator | ตัวสร้างสกิลในตัว |
| call prep | ตัวอย่างสกิล "เตรียมการโทร" ที่ผู้พูดสาธิต |
| SOP | เอกสารมาตรฐานการทำงาน (Standard Operating Procedure) |
| daemon | ดีมอน — บริการเบื้องหลังที่ดูแลทุกเซสชันสด |
| durable state | สถานะถาวร 4 ชนิด: prompt notes, memories, skills, subagent specs |
| learning loop | วงรอบการเรียนรู้ที่รันอัตโนมัติ (ของ Hermes) |
| reusable skill files | ไฟล์สกิลที่ใช้ซ้ำได้ |
| handoff | แบบปล่อยมือ — ตั้งค่าแล้วทำงานเอง (ของ Hermes) |
| audit trail | ร่องรอยการตรวจสอบการเปลี่ยนแปลง (ของ Prime) |
| low-bounded autonomous mode | โหมดอัตโนมัติแบบมีขอบเขตจำกัด (คำบรรยายฟังไม่ชัด — น่าจะหมายถึง bounded) |
| quality gates | ประตูตรวจสอบคุณภาพ — การทดสอบที่เอเจนต์ต้องผ่านก่อนประกาศว่างานเสร็จ |
| --autonomous | แฟล็กเรียกโหมดอัตโนมัติจากบรรทัดคำสั่ง |
| follow-up nudges | การสะกิดติดตามที่ระบบฉีดเอง (ค่าเริ่มต้น 3 ครั้ง) |
| completion call | การเรียกบอกเสร็จสิ้นที่เอเจนต์ต้องทำเมื่อจบเป้าหมาย |
| base system prompt | พรอมต์ระบบพื้นฐานที่แก้ไม่ได้ (immutable) |
| refinement history | ประวัติการปรับแต่ง — บันทึกทุกการเปลี่ยนแปลงพร้อมเหตุผลและ ID |
| guardrails | ราวกั้นความปลอดภัยของระบบ refine |
| benchmark | การวัดประสิทธิภาพ/การทดสอบเปรียบเทียบ |
| hardware emulator | อีมูเลเตอร์ฮาร์ดแวร์ (ตัวอย่าง: Sega Genesis, Game Boy Color) |
| reference implementation | โค้ด/การใช้งานอ้างอิง |
| long context suite | ชุดทดสอบบริบทยาว |
| Claude Code | เครื่องมือเขียนโค้ดด้วย AI ของ Anthropic (คู่แข่งที่ถูกเทียบ) |
| Factorio | เกมสร้างโรงงาน ที่เอเจนต์ถูกทดสอบและแอบโกง (คำบรรยายฟังเป็น "Factorial") |
| staff list | รายชื่อพนักงาน (เอเจนต์) ที่บันทึกบนเครื่อง |
| session ID | หมายเลขประจำเซสชัน |
| open weights | น้ำหนักโมเดลเปิด (ดาวน์โหลดและรันเองได้) |
| Agent OS | ระบบปฏิบัติการเอเจนต์ — สินค้าคอมมูนิตี้ที่ผู้พูดโปรโมต (ชื่อฟังไม่ชัด) |
| arpufferform.com | เว็บไซต์ที่ผู้พูดกล่าวถึง (ฟังชื่อเว็บไม่ชัด) |
ซับไตเติ้ลภาษาไทย
ดาวน์โหลดหรือดูซับทั้งหมด
1 00:00:00,000 --> 00:00:02,924 นี่คือคอร์ส Prime Agent AI แบบเต็มรูปแบบครับ 2 00:00:02,924 --> 00:00:05,915 ครอบคลุมทุกอย่างตั้งแต่การติดตั้งบนเครื่องของ 3 00:00:05,915 --> 00:00:07,842 คุณ ไปจนถึงการมอบงานแรกให้มัน 4 00:00:07,842 --> 00:00:09,371 ฝึกมันเหมือนพนักงานใหม่
เปิดดูซับไตเติ้ลทั้งหมด (661 segments)
1 00:00:00,000 --> 00:00:02,924 นี่คือคอร์ส Prime Agent AI แบบเต็มรูปแบบครับ 2 00:00:02,924 --> 00:00:05,915 ครอบคลุมทุกอย่างตั้งแต่การติดตั้งบนเครื่องของ 3 00:00:05,915 --> 00:00:07,842 คุณ ไปจนถึงการมอบงานแรกให้มัน 4 00:00:07,842 --> 00:00:09,371 ฝึกมันเหมือนพนักงานใหม่ 5 00:00:09,371 --> 00:00:12,095 และปล่อยให้มันทำงานข้ามคืนในขณะที่คุณหลับ 6 00:00:12,095 --> 00:00:14,953 พอจบคอร์สนี้ คุณจะรู้จักคำสั่งหลักทุกคำสั่ง 7 00:00:14,953 --> 00:00:17,877 ฟีเจอร์พิเศษทุกอย่างที่ไม่มีในเครื่องมืออื่น 8 00:00:17,877 --> 00:00:20,403 รู้ว่ามันเทียบกับ Hermes agent อย่างไร 9 00:00:20,403 --> 00:00:22,928 และรู้วิธีรัน Prime Agent อย่างปลอดภัย 10 00:00:22,928 --> 00:00:25,786 เพราะเครื่องมือนี้ต้องมีกฎความปลอดภัยจริง ๆ 11 00:00:25,786 --> 00:00:29,175 และเรื่องราวเบื้องหลังก็อธิบายว่าทำไมถึงเป็นแบบนั้น 12 00:00:29,175 --> 00:00:31,501 นี่คือเรื่องราวครับ ระหว่างการทดสอบ 13 00:00:31,501 --> 00:00:34,492 ทีมงานเบื้องหลัง Prime Agent ปล่อยมันเข้าไปใน 14 00:00:34,492 --> 00:00:36,020 Factorio เกมสร้างโรงงาน 15 00:00:36,020 --> 00:00:38,546 พวกเขาบอกมันเป็นตัวหนังสือธรรมดา ๆ ว่า 16 00:00:38,546 --> 00:00:40,739 "ห้ามโกง" เอเจนต์ทำงานหลายชั่วโมง 17 00:00:40,739 --> 00:00:42,600 มันลองเลย์เอาต์โรงงานหลายแบบ 18 00:00:42,600 --> 00:00:45,059 บันทึกแบบที่เวิร์ก เขียนโน้ตเกี่ยวกับ 19 00:00:45,059 --> 00:00:47,717 แบบที่ล้มเหลว คะแนนของมันไต่ผ่าน 100,000 20 00:00:47,717 --> 00:00:49,046 แล้วมันก็เจอช่องโหว่ 21 00:00:49,046 --> 00:00:51,306 คำสั่งซ่อนเร้นที่เทเลพอร์ตทรัพยากร 22 00:00:51,306 --> 00:00:54,097 เข้าสู่เครื่องจักรได้โดยตรงและข้ามเกมไปเลย 23 00:00:54,097 --> 00:00:56,689 มันถูกบอกว่าไม่ให้ใช้ แต่มันก็ใช้อยู่ดี 24 00:00:56,689 --> 00:00:58,882 จากนั้นมันก็ศึกษาการโกง ของตัวเอง 25 00:00:58,882 --> 00:01:01,873 บันทึกสิ่งที่เรียนรู้ และเก่งการโกงขึ้นเรื่อย 26 00:01:01,873 --> 00:01:03,468 ๆ ในทุก ๆ รอบหลังจากนั้น 27 00:01:03,468 --> 00:01:05,993 เครื่องยนต์ตัวเดียวกับที่ ทำให้มันฉลาด 28 00:01:05,993 --> 00:01:07,256 ก็ทำให้มันเจ้าเล่ห์ 29 00:01:07,256 --> 00:01:10,778 เรื่องเดียวนี้บอกคุณทุกอย่างเกี่ยวกับเครื่องมือตัวนี้ 30 00:01:10,778 --> 00:01:12,107 มันพัฒนาตัวเองจริง ๆ 31 00:01:12,107 --> 00:01:14,898 และมันพัฒนาที่สิ่งใดก็ตามที่ให้ผลลัพธ์จริง 32 00:01:14,898 --> 00:01:17,291 ไม่ว่าคุณจะตั้งใจแบบนั้นหรือไม่ก็ตาม 33 00:01:17,291 --> 00:01:20,215 คอร์สนี้จึงสอนคุณทั้งสองด้าน วิธีได้ประโยชน์ 34 00:01:20,215 --> 00:01:23,006 และวิธีรักษาการควบคุมไว้ในขณะที่ทำเช่นนั้น 35 00:01:23,006 --> 00:01:25,930 ข้อเท็จจริงสั้น ๆ เกี่ยวกับ Prime Agent ครับ 36 00:01:25,930 --> 00:01:27,525 มันมาจาก Prime Intellect 37 00:01:27,525 --> 00:01:30,516 โอเพนซอร์สเต็มรูปแบบภายใต้ MIT license ใช้ฟรี 38 00:01:30,516 --> 00:01:33,573 และคุณอ่านโค้ดทุกบรรทัดว่ามันทำงานอย่างไรได้บน 39 00:01:33,573 --> 00:01:36,364 GitHub มันเปิดตัวช่วงต้นเดือน สิงหาคม 2026 40 00:01:36,364 --> 00:01:39,023 และมียอดดาวบน GitHub เกิน 13,000 ดวงแล้ว 41 00:01:39,023 --> 00:01:41,947 พร้อมอัปเดตที่ปล่อยออกมาทุกวัน ข้างในรันด้วย 42 00:01:41,947 --> 00:01:44,937 Claude Opus 5 ทีมงานรายงานผล 95.5% ในการทดสอบ 43 00:01:44,937 --> 00:01:47,994 ARC AGI 3 ซึ่งเป็นการทดสอบที่เอไอต้องแก้ปริศนา 44 00:01:47,994 --> 00:01:50,387 ที่มันไม่เคยเห็นมาก่อน โดยค่าพื้นฐาน 45 00:01:50,387 --> 00:01:52,912 (baseline) ของผู้เชี่ยวชาญอยู่ที่ 95.4 46 00:01:52,912 --> 00:01:54,574 ในการทดสอบนั้นมันจึงทำได้ 47 00:01:54,574 --> 00:01:56,634 เหนือผู้เชี่ยวชาญมนุษย์เล็กน้อย 48 00:01:56,634 --> 00:01:59,492 มันติดตั้งด้วยคำสั่งเดียวบนเครื่อง Mac หรือ 49 00:01:59,492 --> 00:02:01,951 Linux และรันได้บน Claude subscription 50 00:02:01,951 --> 00:02:04,875 ที่คุณมีอยู่แล้ว หรือบนโมเดลท้องถิ่นฟรีก็ได้ 51 00:02:04,875 --> 00:02:07,068 ต่อไปคือกรอบคิดของคอร์สทั้งหมดนี้ 52 00:02:07,068 --> 00:02:09,859 ผมเรียกมันว่า Prime Agent Command Engine ( 53 00:02:09,859 --> 00:02:12,518 เครื่องยนต์ควบคุม Prime Agent) แนวคิดคือ 54 00:02:12,518 --> 00:02:15,309 คนส่วนใหญ่ใช้ AI เหมือนหน้าต่างแชต พิมพ์ไป 55 00:02:15,309 --> 00:02:18,366 มันพิมพ์ตอบกลับ พอปิดแชต ทุกอย่างก็หายไป Prime 56 00:02:18,366 --> 00:02:21,091 Agent ถูกสร้างต่างออกไป มันคือเครื่องยนต์ 57 00:02:21,091 --> 00:02:23,550 ที่มีปุ่มสตาร์ท (ignition) ระบบเกียร์ 58 00:02:23,550 --> 00:02:25,477 (gearbox) ตัวปรับแต่ง (tuner) 59 00:02:25,477 --> 00:02:28,002 และระบบขับเคลื่อนอัตโนมัติ (autopilot) 60 00:02:28,002 --> 00:02:31,059 พอคุณรู้วิธีควบคุมแต่ละส่วน คุณจะเลิกแชตกับ AI 61 00:02:31,059 --> 00:02:33,917 และเริ่มสั่งการเครื่องจักรที่ทำงานของคุณแทน 62 00:02:33,917 --> 00:02:36,310 คนที่นั่งบังคับเครื่องยนต์ได้ผลลัพธ์ 63 00:02:36,310 --> 00:02:39,034 ที่ต่างจากคนที่ตะโกนใส่คำแนะนำโดยสิ้นเชิง 64 00:02:39,034 --> 00:02:40,125 และแน่นอนว่า 65 00:02:40,125 --> 00:02:42,584 คอร์สนี้จะทำให้คุณเป็นคนที่นั่งบังคับ 66 00:02:42,584 --> 00:02:44,578 เครื่องยนต์ คำสั่งนี้มีห้าส่วน 67 00:02:44,578 --> 00:02:47,502 และเป็นห้าส่วนของคอร์สนี้ที่เรียงตามลำดับกัน 68 00:02:47,502 --> 00:02:50,493 ส่วนที่หนึ่งคือจุดสตาร์ท การสตาร์ทเครื่องยนต์ 69 00:02:50,493 --> 00:02:51,584 อย่างปลอดภัย 70 00:02:51,584 --> 00:02:54,708 เพราะเครื่องยนต์นี้ทรงพลังพอที่จะต้องมีโรงจอดรถ 71 00:02:54,708 --> 00:02:57,499 (garage) ส่วนที่สองคือการควบคุม สูตรคำสั่ง 72 00:02:57,499 --> 00:03:00,024 ที่กำหนดว่างานทุกชิ้นจะออกมาถูกหรือผิด 73 00:03:00,024 --> 00:03:03,081 ส่วนที่สามคือระบบเกียร์ ความจำ สกิล และทีม sub 74 00:03:03,081 --> 00:03:04,876 agent (เอเจนต์ย่อย) ทั้งทีม 75 00:03:04,876 --> 00:03:09,395 ซึ่งเป็นจุดที่คนงานหนึ่งคนทวีคูณเป็นทั้งแผนกที่ทำงานในขณะที่แล็ปท็อป 76 00:03:09,395 --> 00:03:11,920 ของคุณปิดอยู่ ส่วนที่สี่คือตัวปรับแต่ง 77 00:03:11,920 --> 00:03:14,047 ระบบฝึกฝนตัวเองที่ไม่มีในตลาดไหน 78 00:03:14,047 --> 00:03:16,971 ที่เครื่องยนต์พัฒนาตัวเองแล้วส่งล็อกให้คุณดู 79 00:03:16,971 --> 00:03:19,563 และส่วนที่ห้าคือระบบขับเคลื่อนอัตโนมัติ 80 00:03:19,563 --> 00:03:22,886 เครื่องยนต์ที่ทำงานข้ามคืนตามลำพังภายในขอบเขตที่มั 81 00:03:22,886 --> 00:03:23,977 นข้ามไม่ได้ 82 00:03:23,977 --> 00:03:26,436 ตรวจสอบด้วยการทดสอบที่มันเถียงไม่ขึ้น 83 00:03:26,436 --> 00:03:29,892 และส่วนสุดท้ายนี่แหละที่งานของคุณเปลี่ยนรูปร่างไปจริ 84 00:03:29,892 --> 00:03:30,983 ง ๆ 85 00:03:30,983 --> 00:03:34,306 และทุกอย่างด้านล่างนี้สร้างขึ้นเพื่อนำไปสู่จุดนั้น 86 00:03:34,306 --> 00:03:36,566 มาเริ่มสตาร์ทเครื่องยนต์กันเลยครับ 87 00:03:36,566 --> 00:03:39,091 ส่วนที่หนึ่ง จุดสตาร์ท (ignition) ครับ 88 00:03:39,091 --> 00:03:41,882 คุณต้องมีเครื่อง Mac หรือ Linux บน Windows 89 00:03:41,882 --> 00:03:44,673 ให้ใช้ WSL ซึ่งทำให้ Windows รัน Linux ได้ 90 00:03:44,673 --> 00:03:46,667 และค้นหาสั้น ๆ ว่า install WSL 91 00:03:46,667 --> 00:03:48,594 จะพาคุณไปถึงตรงนั้นใน 10 นาที 92 00:03:48,594 --> 00:03:50,189 การติดตั้งใช้คำสั่งเดียว 93 00:03:50,189 --> 00:03:51,718 เปิดแอปเทอร์มินัลของคุณ 94 00:03:51,718 --> 00:03:54,509 และถ้าคุณไม่เคยเปิดเทอร์มินัลมาก่อนในชีวิต 95 00:03:54,509 --> 00:03:55,971 อย่าเพิ่งปิด วิดีโอนี้ 96 00:03:55,971 --> 00:04:00,025 เพราะความกลัวแบบนั้นคือหนึ่งในความเชื่อที่เราจะทำลายกันวันนี้ 97 00:04:00,025 --> 00:04:02,883 คุณวางคำสั่งติดตั้งจากหน้า GitHub ของ Prime 98 00:04:02,883 --> 00:04:05,541 Agent ซึ่งเริ่มต้นด้วย curl และจบด้วย sh 99 00:04:05,541 --> 00:04:07,469 คำสั่งนั้นดาวน์โหลดเครื่องมือ 100 00:04:07,469 --> 00:04:10,459 ตรวจสอบว่าไฟล์ถูกดัดแปลง หรือไม่ด้วย checksum 101 00:04:10,459 --> 00:04:12,453 (ค่าตรวจสอบความถูกต้องของไฟล์) 102 00:04:12,453 --> 00:04:14,580 และติดตั้งคำสั่งชื่อ prime agent 103 00:04:14,580 --> 00:04:17,371 บนเครื่องของคุณ ภายในประมาณหนึ่งนาที ทีนี้ 104 00:04:17,371 --> 00:04:20,096 ก่อนที่คุณจะบิดกุญแจ ขอพูดถึงโรงจอดรถก่อน 105 00:04:20,096 --> 00:04:23,086 กฎนี้สำคัญกับ Prime Agent มากกว่าเครื่องมือใด 106 00:04:23,086 --> 00:04:25,479 ๆ ที่คุณเคยใช้ และนี่คือเหตุผลเต็ม ๆ 107 00:04:25,479 --> 00:04:27,340 ไม่ใช่แค่กฎลอย ๆ Prime Agent 108 00:04:27,340 --> 00:04:30,131 รันโค้ดบนเครื่องของคุณด้วยสิทธิ์ผู้ใช้จริง 109 00:04:30,131 --> 00:04:31,222 ของคุณ 110 00:04:31,222 --> 00:04:34,080 ผู้พัฒนาบอกไว้ชัดเจนในเอกสารของพวกเขาเองว่า 111 00:04:34,080 --> 00:04:37,070 มันไม่ใช่ security sandbox ( แซนด์บ็อกซ์เพื่อ 112 00:04:37,070 --> 00:04:38,161 ความปลอดภัย) 113 00:04:38,161 --> 00:04:41,219 และยังมีความเสี่ยงที่สองที่พวกเขาตั้งชื่อตรง ๆ 114 00:04:41,219 --> 00:04:44,475 ว่า prompt injection ( การฉีดคำสั่งแฝง) พูดง่าย ๆ 115 00:04:44,475 --> 00:04:47,731 ถ้าเอเจนต์อ่านไฟล์หรือหน้าเว็บที่มีคำสั่งซ่อนอยู่ 116 00:04:47,731 --> 00:04:49,659 คำสั่งเหล่านั้นอาจชี้นำมันได้ 117 00:04:49,659 --> 00:04:52,450 เครื่องยนต์ที่รัน คำสั่งได้ ถือกุญแจของคุณ 118 00:04:52,450 --> 00:04:54,510 และทำงานเบื้องหลังต่อไปเรื่อย ๆ 119 00:04:54,510 --> 00:06:03,294 คือเครื่องยนต์ประเภทที่เรื่องแบบนี้สำคัญมาก ดังนั้นคำแนะนำของพวกเขาคือ ให้ทำงานในสำเนาไฟล์ที่ใช้แล้วทิ้งได้ (disposable copy) อะไรก็ตามที่คุณ ตรวจสอบและกู้คืนได้ ณ จุดนี้ สิ่งที่คุณควรทำคือสร้างโฟลเดอร์ชื่อ agent lab แล้วก็อปปี้ไฟล์ลงไป ไม่ใช่ ต้นฉบับเด็ดขาด ทุกงานในคอร์สนี้เกิดขึ้นในโฟลเดอร์นั้น จนกว่าเครื่องยนต์จะทำงานจนหลุดออกมาได้ หลังจากเรื่อง Factorio ผมว่าคุณคงไม่ต้องให้โน้มน้าวอีก สำเนา ไม่ใช่ต้นฉบับ นั่นคือโรงจอดรถ ทีนี้มาบิดกุญแจในเทอร์มินัลกัน พิมพ์ cd ตามด้วยช่องว่าง แล้วลากโฟลเดอร์ agent lab ของคุณเข้าไปใน หน้าต่างแล้วกด enter นั่นจะพาคุณเข้าไปในโฟลเดอร์ พิมพ์ prime agent แล้วกด enter การเปิดใช้ครั้งแรก ให้พิมพ์ /login ทีนี้คุณเลือก "เชื้อเพลิง" ว่าเครื่องยนต์จะคิดอย่างไร และคุณมีสามเส้นทาง เส้นทางที่หนึ่ง ซึ่งน่าจะเป็นเส้นทางที่พวกคุณส่วนใหญ่ควรเลือก คือล็อกอินด้วย subscription ที่คุณจ่ายอยู่แล้วอยู่แล้ว Claude Pro หรือ Max ใช้ได้ ChatGPT Plus หรือ Pro ใช้ได้ผ่านการล็อกอินของ Codex GitHub Copilot ก็ใช้ได้ ไม่ต้องมี API keys ไม่ต้องสมัครบัญชีใหม่ ไม่ต้องทำอะไรเพิ่ม เส้นทางที่สองคือ API keys คุณมี Anthropic, 120 00:06:03,294 --> 00:06:04,385 OpenAI, Google, 121 00:06:04,385 --> 00:06:26,981 Grok อะไรก็ได้ที่คุณต้องการ รองรับทั้งหมด ควบคุมได้มากกว่า และ อย่างที่เห็นในช่วงหลังของคอร์สนี้ keys คือวิธีที่คุณเชื่อมต่อบริการภายนอก เส้นทางที่สามคือแบบท้องถิ่น เต็มรูปแบบและฟรี คุณชี้ไปที่ Llama หรือ LM Studio ที่รันบนเครื่องของคุณเองได้ และไม่มีอะไรที่คุณทำ หลุดออกจากคอมพิวเตอร์ของคุณ มันช้ากว่าแต่เป็นส่วนตัว ไม่มีบัญชีต่อเนื่องใด ๆ 122 00:06:26,981 --> 00:06:29,905 เลย แล้วจะเลือกโมเดลไหน? จากตัวเลขที่เผยแพร่ 123 00:06:29,905 --> 00:06:32,896 Opus 5 ได้ผลลัพธ์ดีที่สุด รวมถึง 95.5% บน ARC 124 00:06:32,896 --> 00:06:35,820 AGI 3 นั้นด้วย และถ้าอยากได้ โมเดลเปิด (open 125 00:06:35,820 --> 00:06:38,213 model) คุณมีโมเดลที่เปิดอย่าง GM 5.2 126 00:06:38,213 --> 00:06:41,137 ซึ่งชนะการทดสอบแปดในเก้ากับเฟรมเวิร์กคู่แข่ง 127 00:06:41,137 --> 00:06:43,995 ดังนั้น Opus 5 ถ้าคุณมี Claude subscription 128 00:06:43,995 --> 00:06:46,586 และ GM 5.2 ถ้าคุณอยากได้ open weights ( 129 00:06:46,586 --> 00:06:47,716 น้ำหนักโมเดลเปิด) 130 00:06:47,716 --> 00:06:49,976 ชิ้นสุดท้ายของจุดสตาร์ทคือแดชบอร์ด 131 00:06:49,976 --> 00:06:53,232 มีเจ็ดคำสั่งและความหมายของแต่ละคำสั่งเป็นภาษาง่าย 132 00:06:53,232 --> 00:06:56,223 ๆ เพราะคุณ จะใช้มันทุกสัปดาห์ ถ้าคุณใช้ prime 133 00:06:56,223 --> 00:06:58,217 agent พิมพ์ prime agent agents 134 00:06:58,217 --> 00:07:00,941 เพื่อดูทุกเซสชันที่กำลังรันอยู่ รวมถึง ID 135 00:07:00,941 --> 00:07:03,334 ของเซสชันที่บันทึกไว้บนเครื่องของคุณ 136 00:07:03,334 --> 00:07:06,059 ซึ่งคือรายชื่อพนักงาน (staff list) ของคุณ 137 00:07:06,059 --> 00:07:08,185 และอย่างที่เห็นช่วงหลัง ของคอร์ส 138 00:07:08,185 --> 00:07:10,910 รายชื่อนั้นจะมีหลายชื่อ พิมพ์ prime agent 139 00:07:10,910 --> 00:07:12,106 attach ตามด้วยชื่อ 140 00:07:12,106 --> 00:07:14,964 เพื่อย้อนกลับเข้าไปในเซสชันที่ยัง ทำงานอยู่ 141 00:07:14,964 --> 00:07:17,888 เหมือนเดินเข้าไปในห้องทำงานของพนักงานกลางคัน 142 00:07:17,888 --> 00:07:20,746 พิมพ์ prime agent resume ตามด้วย session ID 143 00:07:20,746 --> 00:07:23,471 เพื่อปลุกเซสชันที่บันทึกไว้จากหลายวันก่อน 144 00:07:23,471 --> 00:07:26,195 ทุกสิ่งที่มันรู้ยังครบถ้วน และพิมพ์ prime 145 00:07:26,195 --> 00:07:27,857 agent status เพื่อตรวจว่า 146 00:07:27,857 --> 00:07:29,518 บริการเบื้องหลังทำงานปกติ 147 00:07:29,518 --> 00:07:32,509 ถ้าอยากรันตัวตรวจสุขภาพ มี prime agent doctor 148 00:07:32,509 --> 00:07:34,901 --fix ไว้ใช้ตอนที่รู้สึกว่ามีอะไรพัง 149 00:07:34,901 --> 00:07:37,959 ซึ่งจะตรวจสอบและซ่อมบริการเบื้องหลังบางตัวจริง 150 00:07:37,959 --> 00:07:40,152 ๆ แล้วถ้าพิมพ์ prime agent update 151 00:07:40,152 --> 00:07:42,345 คุณก็อัปเดตเป็นเวอร์ชัน ล่าสุดได้ 152 00:07:42,345 --> 00:07:43,436 คงความทันสมัย 153 00:07:43,436 --> 00:07:46,892 ซึ่งสำคัญเพราะโปรเจกต์นี้ปล่อยการเปลี่ยนแปลงตลอดเวลา 154 00:07:46,892 --> 00:07:49,484 และยังเป็นช่วงแรก ๆ มาก และ prime agent 155 00:07:49,484 --> 00:07:51,610 shutdown หยุดทุกเอเจนต์ ทุกคนงาน 156 00:07:51,610 --> 00:07:53,604 ทุกกระบวนการเบื้องหลังพร้อมกัน 157 00:07:53,604 --> 00:07:56,595 นั่นคือสวิตช์ปิด ทุกอย่าง (master off switch) 158 00:07:56,595 --> 00:07:57,686 ของคุณ 159 00:07:57,686 --> 00:08:00,809 น่าจะดีถ้ารู้ว่ามันมีอยู่ก่อนที่คุณจะต้องใช้มัน 160 00:08:00,809 --> 00:08:02,537 และนั่นคือส่วนที่หนึ่งครับ 161 00:08:02,537 --> 00:08:05,196 เครื่องยนต์ติดตั้งแล้ว โรงจอดรถสร้างแล้ว 162 00:08:05,196 --> 00:08:06,857 สวิตช์ปิดอยู่ในมือคุณแล้ว 163 00:08:06,857 --> 00:08:08,917 ทีนี้คุณจะได้เรียนรู้วิธีขับมัน 164 00:08:08,917 --> 00:08:11,310 และนั่นพาผมไปถึงส่วนที่สอง การควบคุม 165 00:08:11,310 --> 00:08:12,401 (controls) 166 00:08:12,401 --> 00:08:15,790 และแนวคิดหนึ่งเดียวที่ทำให้เครื่องยนต์นี้แตกต่างจาก 167 00:08:15,790 --> 00:08:18,249 ทุกอย่างที่คุณเคยลอง ก่อนงานแรกของคุณ 168 00:08:18,249 --> 00:08:21,240 คุณต้องเข้าใจการตัดสินใจออกแบบเดียวที่อยู่ใต้ 169 00:08:21,240 --> 00:08:23,167 Prime Agent เพราะพอเข้าใจแล้ว 170 00:08:23,167 --> 00:08:25,427 คุณจะสั่งการเครื่องมือนี้ต่างออกไป 171 00:08:25,427 --> 00:08:27,553 และผลลัพธ์จะดีขึ้นอย่างมหาศาล AI 172 00:08:27,553 --> 00:08:30,610 ทุกตัวที่คุณเคยใช้ อ่านไฟล์ คุณส่งเอกสารให้มัน 173 00:08:30,610 --> 00:08:33,402 มันยัดเข้าไปในหัว ซึ่งก็คือ context window 174 00:08:33,402 --> 00:08:36,060 (หน้าต่างบริบท) และหัวของมัน มีขนาดจำกัด 175 00:08:36,060 --> 00:08:38,253 พอหัวเต็ม มันก็จะปฏิเสธหรือค่อย ๆ 176 00:08:38,253 --> 00:08:41,244 ลืมรายละเอียด นั่นคือเหตุผลที่เครื่องมืออย่าง 177 00:08:41,244 --> 00:08:44,168 Hermes agent ลืมรายละเอียดตลอดเวลา แต่ Prime 178 00:08:44,168 --> 00:08:46,627 Agent ไม่ได้อ่านไฟล์ของคุณเข้าไปในหัว 179 00:08:46,627 --> 00:08:49,418 มันเขียนโปรแกรมเล็ก ๆ ที่รันข้ามไฟล์ของคุณ 180 00:08:49,418 --> 00:08:52,010 เครื่องยนต์ทั้งหมดสร้างขึ้นรอบสิ่งเดียว 181 00:08:52,010 --> 00:08:54,336 นั่นคือ persistent Python workspace 182 00:08:54,336 --> 00:08:56,263 (พื้นที่ทำงาน Python แบบถาวร) 183 00:08:56,263 --> 00:09:00,184 สภาพแวดล้อมการเขียนโค้ดแบบสดที่ยังมีชีวิตอยู่ตลอดทั้งเซสชัน 184 00:09:00,184 --> 00:09:02,710 และนี่คือ ส่วนที่แยกมันจากทุกอย่างอื่น 185 00:09:02,710 --> 00:09:05,501 พื้นที่ทำงานนั้นคือเครื่องมือเดียวของโมเดล 186 00:09:05,501 --> 00:09:07,694 การอ่านไฟล์ การค้นหา การรันคำสั่ง 187 00:09:07,694 --> 00:09:10,419 การเรียกบริการภายนอก แม้แต่การจ้าง helper 188 00:09:10,419 --> 00:09:11,947 agents (เอเจนต์ช่วยงาน) 189 00:09:11,947 --> 00:09:14,141 ทุกการกระทำเกิดขึ้นเป็นโค้ดที่มัน 190 00:09:14,141 --> 00:09:16,400 เขียนและรันในพื้นที่ทำงานเดียวนั้น 191 00:09:16,400 --> 00:09:18,925 ผู้พัฒนาจึงเรียกดีไซน์นี้ว่า recursive 192 00:09:18,925 --> 00:09:21,517 language model ( โมเดลภาษาแบบ เรียกซ้ำ) 193 00:09:21,517 --> 00:09:24,043 คุณไม่ต้องจำศัพท์เทคนิค แค่เห็นภาพก็พอ 194 00:09:24,043 --> 00:09:27,299 มันคือความต่างระหว่างบรรณารักษ์ที่พยายามจำหนังสือ 195 00:09:27,299 --> 00:09:28,390 ทุกเล่ม 196 00:09:28,390 --> 00:09:32,644 กับบรรณารักษ์ที่สร้างบัตรรายการหนังสือและดึงหน้าที่คุณขอออกมาให้ 197 00:09:32,644 --> 00:09:34,903 บรรณารักษ์คนที่สองไม่มีวัน หัวเต็ม 198 00:09:34,903 --> 00:09:37,827 แล้วมันหมายความว่าอะไรสำหรับคุณในทางปฏิบัติ? 199 00:09:37,827 --> 00:09:40,419 พูดง่าย ๆ คือขนาดของงานไม่สำคัญอีกต่อไป 200 00:09:40,419 --> 00:09:42,745 เอกสารลูกค้า 10 ฉบับหรือ 1,000 ฉบับ 201 00:09:42,745 --> 00:09:45,670 วิธีเดียวกัน ความแม่นยำเท่ากัน เพราะมันค้นหา 202 00:09:45,670 --> 00:09:46,761 ไม่ได้ท่องจำ และ 203 00:09:46,761 --> 00:09:48,887 บทสนทนาของคุณเองก็กลายเป็นข้อมูล 204 00:09:48,887 --> 00:09:51,811 มันจัดการด้วยโค้ดแทนการพิมพ์ข้อความยาวเหยียด 205 00:09:51,811 --> 00:09:53,141 มันอ่านซ้ำไปเรื่อย ๆ 206 00:09:53,141 --> 00:09:55,666 ซึ่งเป็นส่วนสำคัญที่ทำให้มันทำงานยาว ๆ 207 00:09:55,666 --> 00:09:58,457 ต่อเนื่องหลายชั่วโมงได้ นี่คืองานแรกของคุณ 208 00:09:58,457 --> 00:09:59,853 และคุณลองวันนี้ได้เลย 209 00:09:59,853 --> 00:10:03,109 เพราะมันเป็นวิธีที่เร็วที่สุดที่จะเห็นความแตกต่าง 210 00:10:03,109 --> 00:10:05,369 เอาโฟลเดอร์ ที่มีงานเขียนของคุณเอง 211 00:10:05,369 --> 00:10:07,894 อาจเป็นบันทึกการโทรลูกค้า testimonials 212 00:10:07,894 --> 00:10:10,752 (คำรับรองจากลูกค้า) หรือข้อเสนอ proposals — 213 00:10:10,752 --> 00:10:12,015 สำเนานะครับ จำไว้ — 214 00:10:12,015 --> 00:10:14,806 แล้วถามสิ่งที่คุณไม่มีทางถามหน้าต่างแชตได้ 215 00:10:14,806 --> 00:10:16,467 ให้มันดึงทุกข้อโต้แย้งของ 216 00:10:16,467 --> 00:10:19,126 ลูกค้าก่อนตัดสินใจซื้อ จัดกลุ่มตามประเภท 217 00:10:19,126 --> 00:10:21,518 หรือหาผลลัพธ์ที่เฉพาะเจาะจงที่สุด 20 218 00:10:21,518 --> 00:10:24,110 รายการที่ลูกค้ากล่าวถึง ใน testimonials 219 00:10:24,110 --> 00:10:25,201 เหล่านั้น 220 00:10:25,201 --> 00:10:28,790 หรือลิสต์ทุกสัญญาเรื่องการส่งมอบที่ถูกพูดถึงสามครั้งใน 221 00:10:28,790 --> 00:10:29,986 proposals เหล่านี้ 222 00:10:29,986 --> 00:10:31,980 พร้อมระบุไฟล์ต้นทางของแต่ละอัน 223 00:10:31,980 --> 00:10:34,373 มันเขียนโปรแกรมค้นหา รันข้ามทุกอย่าง 224 00:10:34,373 --> 00:10:35,901 แล้วส่งคำตอบกลับมาพร้อม 225 00:10:35,901 --> 00:10:37,961 แหล่งอ้างอิงที่คุณตรวจสอบเองได้ 226 00:10:37,961 --> 00:10:41,683 ประวัติธุรกิจทั้งหมดของคุณกลายเป็นสิ่งที่คุณตั้งคำถามได้ 227 00:10:41,683 --> 00:10:43,943 ทีนี้ สูตรคำสั่ง (command formula) 228 00:10:43,943 --> 00:10:46,335 นี่คือพวงมาลัยของเครื่องยนต์ทั้งระบบ 229 00:10:46,335 --> 00:10:47,930 และคุณภาพของคำสั่งของคุณ 230 00:10:47,930 --> 00:10:50,788 เป็นตัวกำหนดคุณภาพของทุกอย่างอื่นในคอร์สนี้ 231 00:10:50,788 --> 00:10:53,579 ส่วนที่หนึ่ง คืองานที่ระบุอย่างชัดเจน (job 232 00:10:53,579 --> 00:10:55,307 stated plainly) ส่วนที่สอง 233 00:10:55,307 --> 00:10:57,234 หน้าตาของความสำเร็จเป็นแบบไหน 234 00:10:57,234 --> 00:10:59,826 นั่นคือการตรวจสอบ (check) และส่วนที่สาม 235 00:10:59,826 --> 00:11:02,218 ผลลัพธ์จะไปอยู่ ที่ไหน (destination) 236 00:11:02,218 --> 00:11:05,076 แทนที่จะพูดว่า วิจัยคู่แข่งของฉัน คุณพูดว่า 237 00:11:05,076 --> 00:11:07,535 วิจัยห้าบริษัทอันดับต้น ๆ ในวงการ SEO 238 00:11:07,535 --> 00:11:08,626 ในแมนเชสเตอร์ 239 00:11:08,626 --> 00:11:11,683 และคำว่าเสร็จหมายถึงตารางที่มีชื่อ ข้อเสนอหลัก 240 00:11:11,683 --> 00:11:14,740 และเรตติงดาว พร้อมลิงก์แหล่งอ้างอิง ในแต่ละแถว 241 00:11:14,740 --> 00:11:17,665 บันทึกเป็นไฟล์ชื่อ competitors ในโฟลเดอร์นี้ 242 00:11:17,665 --> 00:11:20,323 งาน ตรวจสอบ ปลายทาง การตรวจสอบคือส่วนที่ 243 00:11:20,323 --> 00:11:21,414 ทุกคนข้าม 244 00:11:21,414 --> 00:11:26,398 และมันคือส่วนเดียวกับที่จะกลายเป็นระบบความปลอดภัยของเครื่องยนต์ในส่วนที่ห้า 245 00:11:26,398 --> 00:11:28,857 ดังนั้นสร้าง นิสัยนี้ไว้ตั้งแต่ตอนนี้ 246 00:11:28,857 --> 00:11:31,915 ในขณะที่คุณยังดูทุกงานอยู่ ขอเว้นตรงนี้สักครู่ 247 00:11:31,915 --> 00:11:34,174 เพราะผมรู้ว่าบางคนกำลังคิดอะไรอยู่ 248 00:11:34,174 --> 00:11:36,168 นี่ฟังดูทรงพลัง แต่คุณก็รู้ว่า 249 00:11:36,168 --> 00:11:38,228 ระหว่างเทอร์มินัล ตัวเลือกโมเดล 250 00:11:38,228 --> 00:11:39,358 และไฟล์ในโฟลเดอร์ 251 00:11:39,358 --> 00:11:42,083 คุณจะเร็วขึ้นสิบเท่าถ้ามีคนเดินอยู่ข้าง ๆ 252 00:11:42,083 --> 00:11:44,807 นั่นคือสิ่งที่เราทำกันในคอมมูนิตี้ ของเรา 253 00:11:44,807 --> 00:11:47,798 (ชื่อฟังไม่ชัด [ฟังไม่ชัด]) คุณจะได้ Agent OS 254 00:11:47,798 --> 00:11:49,459 (agent operating system — 255 00:11:49,459 --> 00:11:51,985 ระบบปฏิบัติการเอเจนต์) ที่ prime agent 256 00:11:51,985 --> 00:11:54,710 เสียบปลั๊กอยู่ข้าง ๆ Claude ของคุณ Hermes 257 00:11:54,710 --> 00:11:57,036 ของคุณ open claw ของคุณ ทั้งหมดแชร์ 258 00:11:57,036 --> 00:11:59,362 หน่วยความจำและชุดเครื่องมือเดียวกัน 259 00:11:59,362 --> 00:12:01,887 สำหรับวิดีโอ SEO agents และ AI avatars 260 00:12:01,887 --> 00:12:04,014 (อวตารเอไอ) ที่เชื่อมต่อไว้ แล้ว 261 00:12:04,014 --> 00:12:08,267 ทักษะที่คุณจะสร้างทีหลังในคอร์สนี้จึงมีเครื่องมือจริงให้เรียกใช้ 262 00:12:08,267 --> 00:12:10,859 คุณจะได้ไฟล์ zip แผนการดำเนินงาน 30 วัน 263 00:12:10,859 --> 00:12:12,122 วิดีโอสอนเต็มรูปแบบ 264 00:12:12,122 --> 00:12:14,780 และอัปเดตรายวันเมื่อเราปล่อยเวอร์ชันใหม่ 265 00:12:14,780 --> 00:12:17,106 บทช่วยสอนทีละขั้นตอนรายวันเกี่ยวกับ 266 00:12:17,106 --> 00:12:19,631 สิ่งที่อยู่ในคอร์สนี้เป๊ะ ๆ สูตรคำสั่ง 267 00:12:19,631 --> 00:12:21,758 การสร้างสกิล การออกแบบการตรวจสอบ 268 00:12:21,758 --> 00:12:24,815 คอลโค้ชชิ่งสี่ครั้งต่อสัปดาห์ ที่คุณแชร์หน้าจอ 269 00:12:24,815 --> 00:12:27,739 โชว์เซ็ตอัป Prime Agent ของคุณ และแก้ไขแบบสด 270 00:12:27,739 --> 00:12:30,265 มีเจ้าของธุรกิจกว่า 3,800 คนอยู่ในนั้น 271 00:12:30,265 --> 00:12:33,521 และหลายคนไม่เคยเปิดเทอร์มินัลมาก่อนตอนที่เข้าร่วม 272 00:12:33,521 --> 00:12:36,246 ลิงก์อยู่ในคอมเมนต์หรือคำอธิบาย หรือไปที่ 273 00:12:36,246 --> 00:12:38,572 arpufferform.com (ฟังชื่อเว็บไม่ชัด 274 00:12:38,572 --> 00:12:41,430 [ฟังไม่ชัด]) กลับมาที่การควบคุม เพราะ Prime 275 00:12:41,430 --> 00:12:43,091 Agent มาพร้อมชุดสกิลในตัว 276 00:12:43,091 --> 00:12:45,882 และคุณควรรู้ว่ามีอะไรอยู่ในกล่องเครื่องมือ 277 00:12:45,882 --> 00:12:48,873 ก่อนงานที่สองของคุณ มี web search (ค้นหาเว็บ) 278 00:12:48,873 --> 00:12:51,199 ซึ่งหมายความว่ามันค้นหาเว็บแบบสดได้ 279 00:12:51,199 --> 00:12:52,661 มันดึงข้อมูลกลางงานได้ 280 00:12:52,661 --> 00:12:55,452 งานวิจัยจึงใช้ข้อมูลใหม่สด ไม่ใช่ training 281 00:12:55,452 --> 00:12:58,044 data (ข้อมูลฝึก) เก่า ๆ มี edit (แก้ไข) 282 00:12:58,044 --> 00:13:00,304 การเปลี่ยนแปลงไฟล์แบบ ผ่าตัดแม่นยำ 283 00:13:00,304 --> 00:13:03,693 แทนที่ข้อความหนึ่งท่อนแทนการเขียนเอกสารทั้งฉบับใหม่ 284 00:13:03,693 --> 00:13:06,086 มี attach image ( แนบรูปภาพ) มันโหลด 285 00:13:06,086 --> 00:13:09,143 สกรีนช็อตหรือรูปถ่ายจากดิสก์ได้ แล้วมองมันจริง 286 00:13:09,143 --> 00:13:11,269 ๆ คุณส่งรูปหน้าเว็บคู่แข่งให้มัน 287 00:13:11,269 --> 00:13:14,127 แล้วถามคำถามเกี่ยวกับรูปนั้น ได้ มี compact 288 00:13:14,127 --> 00:13:15,218 (บีบอัด) 289 00:13:15,218 --> 00:13:18,076 มันตรวจว่าบทสนทนาเต็มแค่ไหนแล้วบีบให้เล็กลง 290 00:13:18,076 --> 00:13:19,472 บทสนทนาและเซสชันยาว ๆ 291 00:13:19,472 --> 00:13:21,598 จึงเดินหน้า ต่อไปได้ และมี goal, 292 00:13:21,598 --> 00:13:36,950 refine และ heartbeat ซึ่งเป็นดาวเด่นของทั้งระบบ คุณใช้มันกับการค้นหาแบบสด เช่น ให้เอเจนต์ของคุณค้นหาเว็บสดเดี๋ยวนี้เลย ทีนี้ บางคนถามว่า Prime Agent กับ Hermes agent ต่างกันยังไง ถ้าคุณรัน Hermes อยู่แล้ว เช่น ทำไมต้องมา แตะตัวนี้? 293 00:13:36,950 --> 00:13:39,409 เป็นคำถามที่สมเหตุสมผล คุณไม่ต้องสลับ 294 00:13:39,409 --> 00:13:41,469 และถ้าคุณพอใจกับเซ็ตอัปปัจจุบัน 295 00:13:41,469 --> 00:13:44,526 คุณไม่ต้องเปลี่ยนอะไรเลย ทั้งคู่เป็นโอเพนซอร์ส 296 00:13:44,526 --> 00:13:45,988 ทั้งคู่ใช้ MIT license 297 00:13:45,988 --> 00:13:47,849 ทั้งคู่มาจากแล็บวิจัยจริงจัง 298 00:13:47,849 --> 00:13:50,840 ทั้งคู่อ้างว่าพัฒนาตัวเองได้ ทั้งคู่สร้างสกิล 299 00:13:50,840 --> 00:13:51,931 และเก็บความจำ 300 00:13:51,931 --> 00:13:54,789 แต่พวกมันถูกสร้างมาเพื่องานที่ต่างกันจริง ๆ 301 00:13:54,789 --> 00:14:00,770 และพอคุณเห็นความต่าง คุณจะเข้าใจ ถ้าเริ่มจาก ว่ามันอาศัยอยู่ที่ไหน Hermes อยู่ทุกที่จริง ๆ 302 00:14:00,770 --> 00:14:02,498 Telegram, Slack, WhatsApp, 303 00:14:02,498 --> 00:14:23,964 อีเมล หนึ่งเอเจนต์ หนึ่งความจำ บนทุกบริการและทุกพื้นผิว คุณส่งข้อความหามันจากโทรศัพท์ได้ ในขณะที่มันอยู่บนเครื่องที่คุณไม่เคยแตะ Prime agent อยู่ในที่เดียว นั่นคือโฟลเดอร์บนเครื่อง ในเทอร์มินัล Hermes ถูกสร้างมาให้เข้าถึงได้ง่าย Prime ถูกสร้างมาให้ถูกปล่อยไว้ตามลำพังกับงานหนัก แล้ววิธีที่แต่ละตัวเรียนรู้นี่คือทางแยกจริง ๆ 304 00:14:23,964 --> 00:14:26,755 Hermes มี learning loop (วงรอบการเรียนรู้) 305 00:14:26,755 --> 00:14:29,280 ที่รันอัตโนมัติขณะที่มันทำงาน มันเขียน 306 00:14:29,280 --> 00:14:32,205 reusable skill files (ไฟล์สกิล ที่ใช้ซ้ำได้) 307 00:14:32,205 --> 00:14:34,863 บันทึกความจำ ค้นหาบทสนทนาในอดีตของตัวเอง 308 00:14:34,863 --> 00:14:36,790 และสร้างภาพที่ลึกขึ้นเรื่อย ๆ 309 00:14:36,790 --> 00:14:39,980 ว่าคุณเป็นใคร และมันผลักดันตัวเองให้จำสิ่งต่าง ๆ 310 00:14:39,980 --> 00:14:42,771 มันเป็นแบบ handoff (ปล่อยมือ) โดยการออกแบบ 311 00:14:42,771 --> 00:14:45,762 ถูกออกแบบให้ใช้งานง่าย และค่อนข้างปล่อยวางได้ 312 00:14:45,762 --> 00:14:48,753 ส่วนการเรียนรู้ของ Prime Agent รันผ่าน refine 313 00:14:48,753 --> 00:14:50,746 ซึ่งเป็นการแก้ไขเล็ก ๆ ที่จงใจ 314 00:14:50,746 --> 00:14:51,943 และมีหลักฐานรองรับ 315 00:14:51,943 --> 00:14:54,933 โดยทุกการเปลี่ยนแปลงถูกบันทึกพร้อมเหตุผลที่ทำ 316 00:14:54,933 --> 00:14:57,924 การเปลี่ยนแปลงทุกอันมี ID การเปลี่ยน แปลงใด ๆ 317 00:14:57,924 --> 00:14:59,452 ย้อนกลับได้ด้วย ID นั้น 318 00:14:59,452 --> 00:15:00,981 และคำสั่งแกนกลางถูกล็อก 319 00:15:00,981 --> 00:15:03,772 เอเจนต์จึงไม่มีวันเขียนรากฐานของตัวเองใหม่ 320 00:15:03,772 --> 00:15:04,863 พูดง่าย ๆ 321 00:15:04,863 --> 00:15:09,250 Hermes เรียนรู้เหมือนผู้ช่วยที่เฉียบแหลมซึ่งจดบันทึกส่วนตัวเงียบ ๆ 322 00:15:09,250 --> 00:15:11,044 Prime เรียนรู้เหมือนพนักงาน 323 00:15:11,044 --> 00:15:13,437 ที่คุณเปิดแฟ้มฝึกอบรม อ่านทีละบรรทัด 324 00:15:13,437 --> 00:15:16,361 และแก้ไขได้ด้วยปุ่มเลิกทำบนทุกการเปลี่ยนแปลง 325 00:15:16,361 --> 00:15:19,418 และหลังจากเรื่อง Factorio คุณเข้าใจแล้วว่าทำไม 326 00:15:19,418 --> 00:15:20,946 Prime ถึงถูกสร้างแบบนี้ 327 00:15:20,946 --> 00:15:22,940 เมื่อเอเจนต์สอนตัวเองให้โกงได้ 328 00:15:22,940 --> 00:15:25,798 ร่องรอยการตรวจสอบ การเรียนรู้ (audit trail) 329 00:15:25,798 --> 00:15:27,659 คือฟีเจอร์ที่คุณน่าจะอยากได้ 330 00:15:27,659 --> 00:15:30,118 แล้วรูปร่างของงานจริงก็ต่างกัน Hermes 331 00:15:30,118 --> 00:15:32,776 เก่งเรื่องการเป็นเพื่อนคู่ใจรายวันของคุณ 332 00:15:32,776 --> 00:15:35,301 คุณตั้งเวลาสรุปข่าวเช้าเป็น ภาษาธรรมดา 333 00:15:35,301 --> 00:15:37,295 ยิงมาเข้าโทรศัพท์ระหว่างประชุม 334 00:15:37,295 --> 00:15:40,286 ให้มันค้นอะไรสักอย่างแล้วส่งข้อความหาคุณ ส่วน 335 00:15:40,286 --> 00:15:43,010 Prime Agent เก่งงานยาว หนัก และตรวจสอบได้ 336 00:15:43,010 --> 00:15:45,469 งานที่รันหลายชั่วโมงข้ามกองไฟล์มหาศาล 337 00:15:45,469 --> 00:15:47,995 ที่บทสนทนาจะระเบิด context window ปกติ 338 00:15:47,995 --> 00:15:50,321 ที่คุณต้องการหลักฐานว่างานเสร็จจริง 339 00:15:50,321 --> 00:15:53,112 หลักฐานนั้นคือ low-bounded autonomous mode 340 00:15:53,112 --> 00:15:55,837 (โหมดอัตโนมัติแบบมีขอบเขตจำกัด) ของ Prime 341 00:15:55,837 --> 00:15:58,495 พร้อม quality gates (ประตูตรวจสอบคุณภาพ) 342 00:15:58,495 --> 00:15:59,586 พูดง่าย ๆ 343 00:15:59,586 --> 00:16:52,753 คือการตรวจสอบจริงที่ต้องผ่านก่อนที่เอเจนต์จะบอกว่างานเสร็จ Hermes ไม่ค่อยมีแบบนั้น ไม่มีเครื่องมืออื่น มีแบบนั้น คุณจะได้เรียนรู้ในส่วนที่ห้า ดังนั้นพวกมันต่างกันมากในแง่วิธีทำงานและสิ่งที่คุณใ ช้มันทำ ทีนี้ ส่วนที่สาม ระบบเกียร์ (gearbox) ความจำ สกิล และทีม นี่คือจุดที่เครื่องยนต์ทวีกำลัง Prime Agent เก็บ durable state (สถานะถาวร) สี่ชนิด และคุณควรรู้ทั้งสี่ เพราะคุณสร้าง อ่าน แก้ไข และลบมันทุกอันได้ และเอเจนต์ก็ทำได้เหมือนกัน หนึ่ง prompt notes (โน้ตคำสั่ง) คำสั่งประจำตัวอย่างเช่น ให้แหล่งอ้างอิงฉันเสมอ หรือเขียนเป็นภาษาอังกฤษธรรมดา สอง memories (ความทรงจำ) ข้อเท็จจริงที่บันทึกไว้เกี่ยวกับคุณและงาน ของคุณ สาม skills (ทักษะ) เวิร์กโฟลว์ที่ใช้ซ้ำได้ และสี่ subagent specs (สเปกเอเจนต์ย่อย) รายละเอียดงาน ที่บันทึกไว้สำหรับ helper agents หรือ subagents ที่มันสามารถจ้างได้อีกในภายหลัง prompts, 344 00:16:52,753 --> 00:16:53,844 memories, 345 00:16:53,844 --> 00:17:12,186 skills และ subagents สี่อย่างนี้คือเฟือง และทุกอย่างจากตรงนี้ไปจนถึงระบบขับเคลื่อนอัตโนมัต ิคือเรื่องของ การทำให้มันเติบโตขึ้น เริ่มจากความจำก่อน เพราะมันเป็นชัยชนะที่ง่ายที่สุดของทั้งคอร์ส เมื่อเอเจนต์ทำอะไรถูกต้องหรือเรียนรู้ ข้อเท็จจริงจริงเกี่ยวกับธุรกิจของคุณ บอกมันตรง ๆ 346 00:17:12,186 --> 00:17:14,978 แล้วบันทึกเป็น memory เช่น บันทึกความจำว่า 347 00:17:14,978 --> 00:17:17,902 ลูกค้าของเรา เป็นธุรกิจบริการท้องถิ่น (local 348 00:17:17,902 --> 00:17:19,032 service business) 349 00:17:19,032 --> 00:17:22,620 และเราไม่ใช้ศัพท์เฉพาะอุตสาหกรรมในสิ่งใดก็ตามที่ติดต่อ 350 00:17:22,620 --> 00:17:25,013 กับลูกค้า ถ้าคุณพูดแบบนั้นกับเอเจนต์ 351 00:17:25,013 --> 00:17:28,003 จากนั้นข้อเท็จจริงนั้นก็เดินทางไปกับมันทุกที่ 352 00:17:28,003 --> 00:17:29,598 และนี่คือจุดที่ความเชื่อ 353 00:17:29,598 --> 00:17:32,190 จำกัดใหญ่ข้อแรกเกี่ยวกับ AI ต้องพังทลาย 354 00:17:32,190 --> 00:17:34,849 หลายคนคิดว่า AI ลืมทุกอย่าง หรือ context 355 00:17:34,849 --> 00:17:36,444 window หรือความจำ ไม่ไหว 356 00:17:36,444 --> 00:17:39,966 คุณใช้ระบบนี้บอกให้มันจำข้อเท็จจริงเกี่ยวกับอะไรก็ได้ 357 00:17:39,966 --> 00:17:42,292 แล้วมันก็ไม่ลืมรายละเอียดใด ๆ ทีนี้ 358 00:17:42,292 --> 00:17:45,017 สกิลคือจุดที่ Prime Agent เปล่งประกาย และ 359 00:17:45,017 --> 00:17:46,612 Prime Agent มีสกิลสองแบบ 360 00:17:46,612 --> 00:17:49,536 การรู้ความแตกต่างจะช่วยให้ คุณไม่สับสนทีหลัง 361 00:17:49,536 --> 00:17:52,327 แบบแรกคือ skill description (คำอธิบายสกิล) 362 00:17:52,327 --> 00:17:54,985 โน้ตที่บันทึกเกี่ยวกับขั้นตอนที่ทำซ้ำได้ 363 00:17:54,985 --> 00:17:56,077 ซึ่งระบบ refine 364 00:17:56,077 --> 00:17:59,333 สร้างขึ้นเองได้เมื่อมันสังเกตว่าคุณกำลังทำอะไรซ้ำ 365 00:17:59,333 --> 00:18:02,257 ๆ แบบที่สองคือแบบหนัก ( heavyweight) นั่นคือ 366 00:18:02,257 --> 00:18:04,384 executable skill (สกิลที่รันได้) 367 00:18:04,384 --> 00:18:06,444 โปรแกรมจริงที่ติดตั้งได้บนดิสก์ 368 00:18:06,444 --> 00:18:09,435 ซึ่งเพิ่มความสามารถใหม่จริง ๆ ให้ เครื่องยนต์ 369 00:18:09,435 --> 00:18:11,894 มี skill creator (ตัวสร้างสกิล) ในตัว 370 00:18:11,894 --> 00:18:14,220 หน้าที่ทั้งหมดคือแพ็กเกจเวิร์กโฟลว์ 371 00:18:14,220 --> 00:18:17,210 เอเจนต์แค่ทำให้สำเร็จ แล้วแพ็กเป็นหนึ่งในนั้น 372 00:18:17,210 --> 00:18:21,264 และรายละเอียดปฏิบัติสองอย่างจากเอกสารที่จะช่วยคุณไม่ให้ปวดหัว 373 00:18:21,264 --> 00:18:23,923 หลังจากสร้าง executable skill ใหม่ พิมพ์ 374 00:18:23,923 --> 00:18:26,249 /reload เพื่อให้เอเจนต์ค้นพบมันใหม่ 375 00:18:26,249 --> 00:18:28,973 และเริ่มเซสชันใหม่เพื่อให้มันติดตั้งอย่าง 376 00:18:28,973 --> 00:18:31,765 ถูกต้อง เรื่องเล็ก ๆ แต่สำคัญตั้งแต่วันแรก 377 00:18:31,765 --> 00:18:33,360 การเล่นที่แนะนำตรงนี้คือ 378 00:18:33,360 --> 00:18:36,018 เลือกกระบวนการที่คุณทำซ้ำทุกสัปดาห์ เช่น 379 00:18:36,018 --> 00:18:39,009 งานวิจัยที่คุณทำก่อนการโทรขายทุกครั้ง ใช่ไหม? 380 00:18:39,009 --> 00:18:43,528 จากนั้นขั้นตอนที่สอง พาเอเจนต์เดินผ่านมันครั้งเดียว แก้ไขไป เรื่อย ๆ 381 00:18:43,528 --> 00:18:45,854 เหมือนฝึกพนักงานใหม่เป๊ะ ๆ ดูบริษัท 382 00:18:45,854 --> 00:18:47,316 หาข่าวล่าสุด ตรวจรีวิว 383 00:18:47,316 --> 00:18:50,174 สรุปในหน้าเดียวสามหัวข้อ แล้วขั้นตอน ที่สาม 384 00:18:50,174 --> 00:18:52,234 เมื่อผลลัพธ์ออกมาถูกต้อง พูดว่า 385 00:18:52,234 --> 00:18:54,759 แพ็กสิ่งที่คุณเพิ่งทำเป็นสกิลชื่อ prep 386 00:18:54,759 --> 00:18:57,550 (เตรียมการ) เป็นตัวอย่างของ เวิร์กโฟลว์นี้ 387 00:18:57,550 --> 00:19:00,009 แล้วสี่ พิมพ์ /reload เริ่มเซสชันใหม่ 388 00:19:00,009 --> 00:19:01,139 และจากสัปดาห์หน้า 389 00:19:01,139 --> 00:19:03,930 กระบวนการทั้งหมดกลายเป็นหนึ่งบรรทัด คุณรัน 390 00:19:03,930 --> 00:19:05,525 call prep บนบริษัทนี้ได้ 391 00:19:05,525 --> 00:19:07,719 และกระบวนการที่เคยอยู่ในหัวของคุณ 392 00:19:07,719 --> 00:19:10,310 ตอนนี้ถูกบันทึกเป็นคำสั่งใน prime agent 393 00:19:10,310 --> 00:19:12,437 เมื่อตั้งค่านี้แล้ว มันรันตลอดไป 394 00:19:12,437 --> 00:19:15,693 ถ้านั่นคือหนึ่งกระบวนการต่อสัปดาห์ที่กลายเป็นสกิล 395 00:19:15,693 --> 00:19:18,418 ผ่านไป 12 สัปดาห์ กระบวนการประจำของคุณ 12 396 00:19:18,418 --> 00:19:19,747 อย่างจะรันด้วยคำสั่ง 397 00:19:19,747 --> 00:19:22,273 วิธีแบบเก่าคือกระบวนการของคุณอยู่ในหัว 398 00:19:22,273 --> 00:19:24,001 หรืออยู่ในเอกสาร อย่าง SOP 399 00:19:24,001 --> 00:19:25,529 (เอกสารมาตรฐานการทำงาน) 400 00:19:25,529 --> 00:19:28,254 และขึ้นอยู่กับว่าวันนั้นคุณอารมณ์ดีแค่ไหน 401 00:19:28,254 --> 00:19:29,783 วิธีแบบใหม่คือกระบวนการ 402 00:19:29,783 --> 00:19:31,577 ของคุณคือเฟืองในเครื่องยนต์ 403 00:19:31,577 --> 00:19:33,371 และเฟืองไม่มีวันอารมณ์ไม่ดี 404 00:19:33,371 --> 00:19:36,362 เพราะมันทำซ้ำได้แม่นยำมาก ทีนี้มาพูดถึงทีมกัน 405 00:19:36,362 --> 00:19:39,884 เพราะนี่คือเฟืองที่เปลี่ยนคนงานหนึ่งคนให้เป็นทั้งแผนก 406 00:19:39,884 --> 00:19:42,343 เอเจนต์หลักสามารถสร้าง sub agents ได้ 407 00:19:42,343 --> 00:19:43,872 เอเจนต์แยกต่างหากจริง ๆ 408 00:19:43,872 --> 00:19:45,533 แต่ละตัวมีเซสชันของตัวเอง 409 00:19:45,533 --> 00:19:48,524 พื้นที่ทำงานของตัวเอง ประวัติของตัวเอง ในโค้ด 410 00:19:48,524 --> 00:19:51,714 การจ้างหนึ่งตัวคือการเรียกฟังก์ชันครั้งเดียวจริง 411 00:19:51,714 --> 00:19:54,372 ๆ และรายละเอียดสำคัญคือการเรียกนั้นไม่รอ 412 00:19:54,372 --> 00:19:55,967 เอเจนต์หลัก ยิง subagent 413 00:19:55,967 --> 00:19:58,825 ออกไปทันทีแล้วทำงานต่อ Subagents รันแบบขนาน 414 00:19:58,825 --> 00:20:01,616 และส่งผลลัพธ์กลับมาทางข้อความเมื่อมันเสร็จ 415 00:20:01,616 --> 00:20:03,942 คุณพูดได้ว่า สร้าง sub agent สามตัว 416 00:20:03,942 --> 00:20:06,202 หนึ่งตัววิจัยว่าคู่แข่งอันดับต้น ๆ 417 00:20:06,202 --> 00:20:08,727 ของเราเปลี่ยนอะไรบนเว็บไซต์ในไตรมาสนี้ 418 00:20:08,727 --> 00:20:12,116 หนึ่งตัวดึงคำถามที่พบบ่อยที่สุดจากอีเมลลูกค้าของเรา 419 00:20:12,116 --> 00:20:14,642 และหนึ่งตัวร่างไอเดียคอนเทนต์เดือนหน้า 420 00:20:14,642 --> 00:20:16,901 แล้วคุณรวม ทุกอย่างเป็นรายงานเดียว 421 00:20:16,901 --> 00:20:18,696 คุณได้คนงานสามคนรันพร้อมกัน 422 00:20:18,696 --> 00:20:20,623 ผู้จัดการหนึ่งคนรวบรวมผลลัพธ์ 423 00:20:20,623 --> 00:20:23,680 คำสั่งหนึ่งคำสั่งจากคุณ และรายละเอียด subagent 424 00:20:23,680 --> 00:20:24,810 สามอย่างที่ควรรู้ 425 00:20:24,810 --> 00:20:28,066 เพราะแต่ละอย่างโชว์ว่ามันถูกสร้างอย่างตั้งใจแค่ไห 426 00:20:28,066 --> 00:20:31,057 น สิ่งที่เจ๋ง เกี่ยวกับ subagents โดยเฉพาะกับ 427 00:20:31,057 --> 00:20:33,915 prime agent หนึ่ง พวกมันคงอยู่ (persistent) 428 00:20:33,915 --> 00:20:36,706 ตัวที่เสร็จงานไม่หายไป เซสชันของมันยังอยู่ 429 00:20:36,706 --> 00:20:39,032 พรุ่งนี้คุณส่งงานต่อเนื่องให้มันได้ 430 00:20:39,032 --> 00:20:41,956 มันจำทุกอย่าง สอง เมื่อไม่ได้ใช้งานประมาณ 30 431 00:20:41,956 --> 00:20:44,681 นาที subagent จะถูกยกเลิกโหลดอย่างเงียบ ๆ 432 00:20:44,681 --> 00:20:46,741 และทันทีที่มีคนเรียกมันอีกครั้ง 433 00:20:46,741 --> 00:20:48,801 มันโหลดกลับมาจากจุดที่บันทึกไว้ 434 00:20:48,801 --> 00:20:50,596 เหมือนมันไม่เคยจากไป และสาม 435 00:20:50,596 --> 00:20:52,589 มีขอบเขตจงใจว่าใครคุยกับใครได้ 436 00:20:52,589 --> 00:20:55,115 เอเจนต์ส่งข้อความได้เฉพาะภายในครอบครัว 437 00:20:55,115 --> 00:20:57,840 ของตัวเอง ตัวอย่างเช่น คุณมี parent agent 438 00:20:57,840 --> 00:21:00,033 (เอเจนต์แม่) กับ subagents ของมัน 439 00:21:00,033 --> 00:21:01,124 และเอเจนต์อื่น ๆ 440 00:21:01,124 --> 00:21:07,238 ใต้ parent นั้น ผู้พัฒนากำหนดขอบเขตนี้โดยตั้งใจ คุณจะไม่มีเซสชันที่ไม่เกี่ยวข้องกันเป็นโหล ๆ 441 00:21:07,238 --> 00:21:09,498 ส่งข้อความคุยกันอย่าง คาดเดาไม่ได้ 442 00:21:09,498 --> 00:21:13,219 แต่ประเด็นหลักคือเอเจนต์เหล่านี้ส่งข้อความหากันได้โดยตรง 443 00:21:13,219 --> 00:21:15,479 ชี้นำงานของกันและกันได้ โดยไม่ต้อง 444 00:21:15,479 --> 00:21:16,609 วนทุกอย่างผ่านคุณ 445 00:21:16,609 --> 00:21:18,735 ผู้จัดการแก้ไขงานวิจัยกลางคันได้ 446 00:21:18,735 --> 00:21:21,194 คุณสร้างแผนกขึ้นมา และแผนกก็พูดคุยกัน 447 00:21:21,194 --> 00:21:22,285 และสิ่งเจ๋ง ๆ 448 00:21:22,285 --> 00:21:25,808 ที่อยู่ใต้ทั้งหมดนี้คือชิ้นส่วนที่ทำให้งานยาวเป็นจริง 449 00:21:25,808 --> 00:21:28,400 นั่นคือ daemon (ดีมอน) บริการเบื้องหลัง 450 00:21:28,400 --> 00:21:30,061 ที่เป็นเจ้าของทุกเซสชันสด 451 00:21:30,061 --> 00:21:33,982 นี่หมายความว่าเซสชันไม่ได้ผูกติดกับหน้าต่างเทอร์มินัลของคุณ 452 00:21:33,982 --> 00:21:36,242 ถ้าคุณปิดแล็ปท็อป ไปยิม ไปเดินเล่น 453 00:21:36,242 --> 00:21:38,966 เครื่องยนต์ยังรันต่อไป กลับมา พิมพ์ prime 454 00:21:38,966 --> 00:21:41,625 agent attach แล้วคุณก็ยืนอยู่ในห้องทำงาน 455 00:21:41,625 --> 00:21:44,482 ของมันอีกครั้ง มองมันทำงานกลางคัน ถ้ามีอะไร 456 00:21:44,482 --> 00:21:47,207 crash ดีมอนกู้เซสชันจากบันทึกที่บันทึกไว้ 457 00:21:47,207 --> 00:21:49,201 บวกกับสแนปช็อต ของพื้นที่ทำงาน 458 00:21:49,201 --> 00:21:51,926 แทนที่จะเสียเวลาหลายชั่วโมงของความคืบหน้า 459 00:21:51,926 --> 00:21:54,451 นี่คือความหมายของการทำงานยาว และมันคือ 460 00:21:54,451 --> 00:21:57,043 รากฐานที่ระบบขับเคลื่อนอัตโนมัติยืนอยู่ 461 00:21:57,043 --> 00:21:59,303 อีกสามคำสั่งทำให้ระบบเกียร์สมบูรณ์ 462 00:21:59,303 --> 00:22:02,094 และแต่ละคำสั่งแก้ปัญหาจำเพาะที่คุณน่าจะเจอ 463 00:22:02,094 --> 00:22:03,622 หนึ่งคือ /goal เป้าหมาย 464 00:22:03,622 --> 00:22:06,081 คือวัตถุประสงค์ถาวรพร้อมงบประมาณเสริม 465 00:22:06,081 --> 00:22:09,537 และฮาร์เนสจะคอยดึงเอเจนต์กลับมาที่เป้าหมายรอบแล้วรอบ 466 00:22:09,537 --> 00:22:10,628 เล่า 467 00:22:10,628 --> 00:22:13,818 จนกว่าเอเจนต์จะทำเครื่องหมายว่าสำเร็จอย่างชัดเจน 468 00:22:13,818 --> 00:22:16,676 มันมีการเรียกบอกเสร็จสิ้น (completion call) 469 00:22:16,676 --> 00:22:19,467 ที่มันต้องทำ จริง ๆ ทำไมถึงสำคัญ? ในงานยาว 470 00:22:19,467 --> 00:22:22,126 เอเจนต์ลอยไป บริบทช่วงแรกถูกบีบให้เล็กลง 471 00:22:22,126 --> 00:22:23,986 เธรดหาย และเอเจนต์อาจเร่ร่อน 472 00:22:23,986 --> 00:22:25,316 ไปทำอะไรที่ใกล้เคียง 473 00:22:25,316 --> 00:22:27,642 เป้าหมายคือเชือกที่ผูกไว้กับนิ้วมัน 474 00:22:27,642 --> 00:22:30,699 ที่หลุดโดยไม่ได้ตั้งใจไม่ได้ สองคือ /heartbeat 475 00:22:30,699 --> 00:22:33,291 หัวใจเต้นคือข้อความเตือนใจ (me message) 476 00:22:33,291 --> 00:22:36,613 ที่ถูกฉีดเข้าไปในเซสชันตามเวลาทุกสองสามนาทีอัตโนมั 477 00:22:36,613 --> 00:22:38,940 ติ เหมือน ผู้จัดการโผล่หน้าเข้ามาดู 478 00:22:38,940 --> 00:22:41,332 มันเหมาะกับงานที่เอเจนต์รออะไรที่ช้า 479 00:22:41,332 --> 00:22:44,057 หรือที่คุณอยากให้มันคอยเช็กความคืบหน้าของ 480 00:22:44,057 --> 00:22:46,848 subagent โดยที่คุณไม่ต้องสังเกตอะไร และสาม 481 00:22:46,848 --> 00:22:48,177 prime agent schedule 482 00:22:48,177 --> 00:22:50,968 ซึ่งเริ่มเซสชันตามเวลาที่ตั้ง ตัวอย่างเช่น 483 00:22:50,968 --> 00:22:53,826 ทุกวันทำงานตอน 7 โมงเช้า ตรวจโฟลเดอร์ notes 484 00:22:53,826 --> 00:22:56,418 สรุปอะไรใหม่ ๆ และบันทึกไฟล์สรุปตอนเช้า 485 00:22:56,418 --> 00:22:57,509 วันของเอเจนต์ 486 00:22:57,509 --> 00:23:00,168 คุณจึงเริ่มต้นด้วยสรุปที่คุณไม่ต้องทำเอง 487 00:23:00,168 --> 00:23:02,161 ส่วนที่สี่ ตัวปรับแต่ง (tuner) 488 00:23:02,161 --> 00:23:04,753 ฟีเจอร์ที่ไม่มีเครื่องมืออื่น บ่อยครั้ง 489 00:23:04,753 --> 00:23:07,279 เวลาใช้เอเจนต์ เราต้องวนไปวนมา ต้องให้ 490 00:23:07,279 --> 00:23:10,070 ฟีดแบ็กกับมัน ตอนนี้กับ prime agent คุณใช้ 491 00:23:10,070 --> 00:23:11,798 /refine ได้ และเมื่อรันมัน 492 00:23:11,798 --> 00:23:14,722 เอเจนต์จะทบทวนงานล่าสุดของตัวเอง เป็นหลักฐาน 493 00:23:14,722 --> 00:23:17,712 อะไรถูกแก้ อะไรล้มเหลว รูปแบบอะไรที่ซ้ำ ๆ กัน 494 00:23:17,712 --> 00:23:20,770 แล้วมันใช้การแก้ไขเล็กที่สุดที่เป็นประโยชน์กับ 495 00:23:20,770 --> 00:23:22,697 เซ็ตอัปของตัวเอง บันทึกความจำ 496 00:23:22,697 --> 00:23:25,023 อัปเดตคำอธิบายสกิล ปรับ prompt note 497 00:23:25,023 --> 00:23:27,748 หรือปรับแต่ง subagent spec มันเล็ก เจาะจง 498 00:23:27,748 --> 00:23:28,839 มีหลักฐานรองรับ 499 00:23:28,839 --> 00:23:33,292 และมันวางแผนการปรับแต่งเหล่านี้ในเบื้องหลังได้โดยไม่ขัดจังหวะงานที่ 500 00:23:33,292 --> 00:23:36,349 อยู่ตรงหน้าคุณ ราวกั้นความปลอดภัย (guardrails) 501 00:23:36,349 --> 00:23:38,276 คือเหตุผลที่มันปลอดภัยพอจะใช้ 502 00:23:38,276 --> 00:23:41,001 และคุณควรรู้ทั้งสามแบบขึ้นใจ จำไว้ด้วยว่า 503 00:23:41,001 --> 00:23:43,526 refine มีล็อกให้คุณเห็นว่าทำอะไรไปบ้าง 504 00:23:43,526 --> 00:23:45,985 และคุณเลิกทำอะไรก็ได้ที่ถูกปรับแต่งมา 505 00:23:45,985 --> 00:23:48,245 ราวกั้นข้อหนึ่ง base system prompt 506 00:23:48,245 --> 00:23:50,903 (พรอมต์ระบบพื้นฐาน) เปลี่ยนไม่ได้ Refine 507 00:23:50,903 --> 00:23:52,431 แก้ได้แค่ชั้นรอบแกนกลาง 508 00:23:52,431 --> 00:23:55,090 เอเจนต์ไม่มีวันเขียนรากฐานของ ตัวเองใหม่ 509 00:23:55,090 --> 00:23:56,884 ไม่ว่ามันจะเรียนรู้อะไร สอง 510 00:23:56,884 --> 00:23:59,476 ทุกการเปลี่ยนแปลงถูกบันทึกใน refinement 511 00:23:59,476 --> 00:24:02,533 history ( ประวัติการปรับแต่ง) พร้อมเหตุผลที่ทำ 512 00:24:02,533 --> 00:24:07,385 คุณเปิดประวัติและอ่านเป็นข้อความธรรมดาว่าเครื่องยนต์ของคุณตัดสินใจเปลี่ยน 513 00:24:07,385 --> 00:24:09,445 อะไรเกี่ยวกับ ตัวเองและทำไม สาม 514 00:24:09,445 --> 00:24:10,907 ทุกการเปลี่ยนแปลงมี ID 515 00:24:10,907 --> 00:24:13,632 และอัปเดตที่แย่สามารถย้อนกลับด้วย ID นั้น 516 00:24:13,632 --> 00:24:14,723 มีการบันทึก 517 00:24:14,723 --> 00:24:17,248 สแนปช็อตเพื่อรองรับการย้อนกลับโดยเฉพาะ 518 00:24:17,248 --> 00:24:19,175 ถ้ามันเรียนรู้บทเรียนที่ไม่ดี 519 00:24:19,175 --> 00:24:21,568 คุณเลิกบทเรียนนั้นแบบผ่าตัดได้โดยไม่ 520 00:24:21,568 --> 00:24:23,562 แตะต้องอย่างอื่นที่มันเรียนรู้ 521 00:24:23,562 --> 00:24:25,356 คุณตั้งกิจวัตรรายสัปดาห์ได้ 522 00:24:25,356 --> 00:24:26,619 ให้เอเจนต์ทำงานจริง 523 00:24:26,619 --> 00:24:29,011 แก้มันแบบที่คุณแก้พนักงานใหม่ เจาะจง 524 00:24:29,011 --> 00:24:31,337 ไม่คลุมเครือ ไม่ใช่ "อันนี้ผิด" แต่ 525 00:24:31,337 --> 00:24:32,799 "ห้ามใช้สามวลีนี้" และ 526 00:24:32,799 --> 00:24:34,527 "ให้มีสามแหล่งอ้างอิงเสมอ" 527 00:24:34,527 --> 00:24:37,053 ทำแบบนั้นสักสองสามงาน รัน /refine แล้ว 528 00:24:37,053 --> 00:24:38,144 อย่าข้ามขั้นนี้ 529 00:24:38,144 --> 00:24:41,334 เปิดประวัติและอ่านสิ่งที่มันเขียนเกี่ยวกับตัวเอง 530 00:24:41,334 --> 00:24:44,391 แล้วส่งงานคล้าย ๆ กันให้มัน แล้วดูมันนำบทเรียน 531 00:24:44,391 --> 00:24:45,587 ไปใช้โดยไม่ต้องบอก 532 00:24:45,587 --> 00:24:47,847 การแก้ไขของคุณทบต้นเมื่อเวลาผ่านไป 533 00:24:47,847 --> 00:24:50,771 สัปดาห์แรกมันอาจยังพลาดบ้างเป็นครั้งคราว แต่ 534 00:24:50,771 --> 00:24:53,562 สัปดาห์ที่สาม งานมาถึงโดยทำตามกฎของคุณแล้ว 535 00:24:53,562 --> 00:24:56,553 และคุณยังต้องแน่ใจว่าความจำในระบบเจาะจงจริง ๆ 536 00:24:56,553 --> 00:25:00,407 ทีนี้ refine เป็นฟีเจอร์หลัก แต่มีสองเรื่องที่ต้องพูดตรง ๆ 537 00:25:00,407 --> 00:25:03,265 หนึ่ง คนที่ขุดซอร์สโค้ดพบว่าขั้นตอนการทบทวน 538 00:25:03,265 --> 00:25:05,192 (review) ทำโดยโมเดล AI อีกตัว 539 00:25:05,192 --> 00:25:09,180 และถึงแม้มันจะบันทึกว่าคาดหวังผลลัพธ์อะไรจากการเปลี่ยนแปลงแต 540 00:25:09,180 --> 00:25:10,271 ่ละครั้ง 541 00:25:10,271 --> 00:25:14,524 มันก็ไม่ได้วนกลับมาตรวจสอบทีหลังว่าการเปลี่ยนแปลงช่วยจริงหรือไม่ 542 00:25:14,524 --> 00:25:17,050 การตรวจสอบนั้นเป็นงานของคุณ และใช้เวลา 543 00:25:17,050 --> 00:25:19,376 ห้านาทีต่อสัปดาห์ คุณควรอ่านประวัติ 544 00:25:19,376 --> 00:25:20,838 ทดสอบบทเรียนกับงานใหม่ 545 00:25:20,838 --> 00:25:23,629 ย้อนกลับอะไรก็ตามที่ดูไม่ดี และสอง ประเด็น 546 00:25:23,629 --> 00:25:24,720 ที่ลึกกว่า 547 00:25:24,720 --> 00:25:29,505 ฮาร์เนสที่พัฒนาตัวเองได้สามารถรักษาสมมติฐานที่ผิดได้อย่างมีประสิทธิภาพพอ 548 00:25:29,505 --> 00:25:32,230 ๆ กับสมมติฐานที่ดี ความคงอยู่เป็นดาบสองคม 549 00:25:32,230 --> 00:25:35,686 นั่นคือเหตุผลที่ล็อกและการย้อนกลับไม่ใช่ของฟุ่มเฟือย 550 00:25:35,686 --> 00:25:37,347 มันคือเหตุผลทั้งหมดที่ตัว 551 00:25:37,347 --> 00:25:38,809 ปรับแต่งปลอดภัยพอจะรัน 552 00:25:38,809 --> 00:25:42,199 ทีนี้มาพูดถึงระบบขับเคลื่อนอัตโนมัติในส่วนที่ห้ากัน 553 00:25:42,199 --> 00:25:44,458 ทุกอย่างในคอร์สนี้สร้างมาสู่จุดนี้ 554 00:25:44,458 --> 00:25:47,316 และทุกส่วนของ command engine ปรากฏในส่วนนี้ 555 00:25:47,316 --> 00:25:50,174 โรงจอดรถจากส่วนที่หนึ่ง งาน ตรวจสอบ ปลายทาง 556 00:25:50,174 --> 00:25:52,699 จากส่วนที่สอง สกิลและทีม จากส่วนที่สาม 557 00:25:52,699 --> 00:25:55,025 พฤติกรรมที่ถูกปรับแต่งจากส่วนที่สี่ 558 00:25:55,025 --> 00:25:57,285 และตอนนี้เครื่องยนต์รันโดยไม่มีคุณ 559 00:25:57,285 --> 00:25:58,547 ภายในกล่องที่คุณวาด 560 00:25:58,547 --> 00:26:01,006 ตรวจสอบด้วยการทดสอบที่มันเถียงไม่ขึ้น 561 00:26:01,006 --> 00:26:04,462 ระบบขับเคลื่อนอัตโนมัติรันตรงจากบรรทัดคำสั่งด้วยแฟล็ 562 00:26:04,462 --> 00:26:05,553 ก --autonomous 563 00:26:05,553 --> 00:26:08,544 คุณตั้งเป้าหมายและขีดจำกัดในคำสั่งเดียวกันได้ 564 00:26:08,544 --> 00:26:09,807 และขีดจำกัดนั้นจริง 565 00:26:09,807 --> 00:26:12,066 มีค่าเริ่มต้นจริงที่คุณเปลี่ยน ได้ 566 00:26:12,066 --> 00:26:14,791 เพดานจำนวนการตอบสนองที่เอเจนต์สร้างได้ 12 567 00:26:14,791 --> 00:26:15,882 โดยค่าเริ่มต้น 568 00:26:15,882 --> 00:26:18,541 เพดานจำนวนโทเคนรวมที่มันใช้จ่ายได้ เพดาน 569 00:26:18,541 --> 00:26:21,066 จำนวนการสะกิดติดตาม (follow-up nudges) 570 00:26:21,066 --> 00:26:23,326 ที่ระบบฉีดเองได้ สามโดยค่าเริ่มต้น 571 00:26:23,326 --> 00:26:25,386 ขีดจำกัดเวลาอีกชั้น เครื่องยนต์ 572 00:26:25,386 --> 00:26:26,477 รันตลอดไปไม่ได้ 573 00:26:26,477 --> 00:26:28,537 และมันรันในกล่องที่คุณเป็นคนวาด 574 00:26:28,537 --> 00:26:31,528 แต่ขีดจำกัดไม่ใช่ส่วนพิเศษจริง ๆ ประตูตรวจสอบ 575 00:26:31,528 --> 00:26:33,256 (gates) ต่างหาก คือมี gate 576 00:26:33,256 --> 00:26:36,047 ซึ่งเป็นฟีเจอร์ที่ผมเห็นแค่จาก prime agent 577 00:26:36,047 --> 00:26:38,772 เท่านั้น พูดง่าย ๆ คือมันสร้างการทดสอบที่ 578 00:26:38,772 --> 00:26:39,863 เอเจนต์ต้องผ่าน 579 00:26:39,863 --> 00:26:42,388 ก่อนที่มันจะถูกอนุญาตให้บอกว่างานเสร็จ 580 00:26:42,388 --> 00:26:44,581 มันค่อนข้างเคร่ง ถ้า gate ล้มเหลว 581 00:26:44,581 --> 00:26:47,173 ความล้มเหลวจะถูก ป้อนกลับเข้าไปในเซสชัน 582 00:26:47,173 --> 00:26:49,167 เอเจนต์ต้องทำงานต่อ แต่ละ gate 583 00:26:49,167 --> 00:26:52,025 มีขีดจำกัดการลองใหม่ สามครั้งโดยค่าเริ่มต้น 584 00:26:52,025 --> 00:26:53,952 และ timeout ห้านาทีต่อการตรวจ 585 00:26:53,952 --> 00:26:56,344 ตรวจที่ติดค้างจึงไม่ทำให้ทั้งรันค้าง 586 00:26:56,344 --> 00:26:59,003 คุณซ้อนหลาย gate บนงานเดียวได้ และมันรัน 587 00:26:59,003 --> 00:27:01,262 ตามลำดับ เอเจนต์ประกาศชัยชนะไม่ได้ 588 00:27:01,262 --> 00:27:04,319 งานต้องผ่านการตรวจ หรืองานนั้นไม่เสร็จ พูดง่าย 589 00:27:04,319 --> 00:27:05,411 ๆ 590 00:27:05,411 --> 00:27:10,063 มันวนไปวนมาได้ และเอเจนต์แกล้งทำเป็นเสร็จไม่ได้ มันต้องวนต่อไปเรื่อย ๆ 591 00:27:10,063 --> 00:27:13,319 ทีนี้มาปิดวงรอบเรื่อง Factorio เพราะบทเรียนเต็ม ๆ 592 00:27:13,319 --> 00:27:18,702 ควรอยู่ตรงนี้ที่ระบบขับเคลื่อนอัตโนมัติ เอเจนต์นั้นถูกบอก เป็นลายลักษณ์อักษรซ้ำ ๆ 593 00:27:18,702 --> 00:27:20,231 ว่าห้ามโกง มันโกงอยู่ดี 594 00:27:20,231 --> 00:27:23,487 และวงรอบการพัฒนาตัวเองทำให้มันเป็นนักโกงที่ดีขึ้น 595 00:27:23,487 --> 00:27:24,949 เพราะ จากมุมมองของระบบ 596 00:27:24,949 --> 00:27:27,275 การโกงสร้างผลลัพธ์ที่ควรค่าแก่การจำ 597 00:27:27,275 --> 00:27:30,332 บทเรียนคือหนึ่งประโยค และมันเป็นประโยคที่สำคัญ 598 00:27:30,332 --> 00:27:31,424 ที่สุดในคอร์สนี้ 599 00:27:31,424 --> 00:27:35,610 เอเจนต์ที่พัฒนาตัวเองได้จะเก่งขึ้นในสิ่งใดก็ตามที่ได้รางวัลจริง 600 00:27:35,610 --> 00:27:37,804 ไม่ใช่ในสิ่งที่คุณตั้งใจ นั่นหมาย 601 00:27:37,804 --> 00:27:43,585 ความว่าวิธีที่คุณตรวจงานตอนนี้สำคัญกว่าที่เคยเป็นมาในประวัติศาสตร์ของเครื่องมือเหล่านี้ 602 00:27:43,585 --> 00:27:44,782 คุณจึงต้องแน่ใจว่า 603 00:27:44,782 --> 00:27:48,304 มีเกณฑ์ชัดเจนมากว่าผลงานและความสำเร็จหน้าตาเป็นแบบไหน 604 00:27:48,304 --> 00:27:51,162 อย่าทั่วไป อย่าคลุมเครือ และยังต้องตรวจล็อก 605 00:27:51,162 --> 00:27:52,253 ตรวจสิ่งที่มันทำ 606 00:27:52,253 --> 00:27:56,174 ถ้าคุณอยากได้หลักฐานว่าระบบขับเคลื่อนอัตโนมัติรับงานขนาดไหน 607 00:27:56,174 --> 00:27:58,965 ผู้พัฒนารัน benchmark ( การวัดประสิทธิภาพ) 608 00:27:58,965 --> 00:28:01,690 จริงที่เอเจนต์ต้องสร้าง hardware emulator 609 00:28:01,690 --> 00:28:03,152 (อีมูเลเตอร์ฮาร์ดแวร์) 610 00:28:03,152 --> 00:28:06,209 ที่ใช้งานได้จากศูนย์โดยสมบูรณ์ ไม่มี reference 611 00:28:06,209 --> 00:28:08,070 implementation (โค้ดอ้างอิง) 612 00:28:08,070 --> 00:28:11,459 ตรวจยืนยันด้วยโปรแกรมวินิจฉัยที่เทียบพฤติกรรมกับฮาร 613 00:28:11,459 --> 00:28:13,187 ์ดแวร์จริง และ Prime Agent 614 00:28:13,187 --> 00:28:15,779 สร้างอีมูเลเตอร์ที่ใช้งานได้สำหรับ Sega 615 00:28:15,779 --> 00:28:18,703 Genesis และ Game Boy Color รุ่นดั้งเดิม ปกติ 616 00:28:18,703 --> 00:28:20,365 นั่นคืองานวิศวกรรมหลายวัน 617 00:28:20,365 --> 00:28:23,023 แต่ทำแบบอัตโนมัติและยืนยันด้วยการตรวจสอบ 618 00:28:23,023 --> 00:28:24,950 และทำด้วย Opus 5 หนึ่งในโมเดล 619 00:28:24,950 --> 00:28:27,675 ที่แข็งแกร่งที่สุดที่มีอยู่ ซึ่งล้มเหลวใน 620 00:28:27,675 --> 00:28:29,735 benchmark เดียวกันในฮาร์เนสอื่น 621 00:28:29,735 --> 00:28:31,928 ถึงแม้แต่ละขั้นตอนของมันจะดูประสบ 622 00:28:31,928 --> 00:28:34,121 ความสำเร็จระหว่างทาง สมองเดียวกัน 623 00:28:34,121 --> 00:28:36,049 แค่ฮาร์เนสต่าง ผลลัพธ์ตรงข้าม 624 00:28:36,049 --> 00:28:38,774 เครื่องยนต์ที่อยู่รอบโมเดลเป็นตัวกำหนดว่า 625 00:28:38,774 --> 00:28:40,900 โมเดลจะทำงานอะไรให้สำเร็จได้จริง 626 00:28:40,900 --> 00:28:43,691 นั่นคือเหตุผลทั้งหมดที่เครื่องมือนี้มีอยู่ 627 00:28:43,691 --> 00:28:46,217 นี่คือ command engine เต็มรูปแบบที่รัน 628 00:28:46,217 --> 00:28:48,543 end-to-end โดยใช้ทุกอย่างในคอร์สนี้ 629 00:28:48,543 --> 00:28:51,135 คุณมีเซสชันตามตารางเวลาที่เริ่ม กลางคืน 630 00:28:51,135 --> 00:28:54,059 เป้าหมาย: ผลิตรายงานคู่แข่งรายสัปดาห์ มันรัน 631 00:28:54,059 --> 00:28:56,983 call prep และสกิลงานวิจัยของคุณจากส่วนที่สาม 632 00:28:56,983 --> 00:28:58,246 มัน สร้าง sub agent 633 00:28:58,246 --> 00:29:00,838 สองตัวทำงานแหล่งข้อมูลแบบขนาน heartbeat 634 00:29:00,838 --> 00:29:03,562 ตรวจความคืบหน้าทุกสองสามนาที gate มาตรฐาน 635 00:29:03,562 --> 00:29:05,888 สองตัว ทางออก: ไฟล์รายงานต้องมีอยู่ 636 00:29:05,888 --> 00:29:08,214 และทุกรายการต้องมีลิงก์แหล่งอ้างอิง 637 00:29:08,214 --> 00:29:10,541 ลองใหม่สามครั้งต่อตัว แล้วรันก็หยุด 638 00:29:10,541 --> 00:29:12,867 แทนที่จะส่งของเสียออกมา คุณตื่นขึ้น 639 00:29:12,867 --> 00:29:15,591 อ่านรายงานเหมือนเจ้าของที่ทบทวนงานพนักงาน 640 00:29:15,591 --> 00:29:18,582 แก้หนึ่งหรือสองจุด รัน /refine ให้การแก้ไขติด 641 00:29:18,582 --> 00:29:20,177 และดู refinement history 642 00:29:20,177 --> 00:29:23,101 สิบห้านาทีของความสนใจคุณ งานหลายชั่วโมงเสร็จ 643 00:29:23,101 --> 00:29:24,192 และ 644 00:29:24,192 --> 00:29:27,781 เครื่องยนต์ทั้งระบบปรับแต่งเก่งกว่าวันเมื่อวานเล็กน้อย 645 00:29:27,781 --> 00:29:30,041 นั่นคือ Prime Agent Command Engine 646 00:29:30,041 --> 00:29:31,503 ที่ประกอบเสร็จ สมบูรณ์ 647 00:29:31,503 --> 00:29:34,095 ทีนี้มาพูดถึงข้อจำกัดบางอย่าง benchmark 648 00:29:34,095 --> 00:29:36,487 ผลลัพธ์ผสมกันในชุดทดสอบ long context 649 00:29:36,487 --> 00:29:38,680 (บริบทยาว) Prime agent กับ GM 5.2 650 00:29:38,680 --> 00:29:41,671 ชนะแปดในเก้าการทดสอบกับเฟรมเวิร์กคู่แข่ง ด้วย 651 00:29:41,671 --> 00:29:44,462 Opus 5 มันชนะ Claude Code เฉียด ๆ หกในเก้า 652 00:29:44,462 --> 00:29:46,722 ด้วย GPT 5.6 มันชนะ Codex หกในเก้า 653 00:29:46,722 --> 00:29:48,450 แต่ไม่ได้กวาดเรียบทุกอย่าง 654 00:29:48,450 --> 00:29:51,241 เครื่องมือที่ตั้งหลักแล้วยังชนะบางหมวดหมู่ 655 00:29:51,241 --> 00:29:53,367 ขาดลอย และตัวเลขไฮไลต์ ARC AGI 3 656 00:29:53,367 --> 00:29:54,896 เป็นผลดีที่สุดจากสามรัน 657 00:29:54,896 --> 00:29:58,019 เปรียบเทียบกับตัวเลขที่เผยแพร่ของเครื่องมืออื่น 658 00:29:58,019 --> 00:30:01,342 แทนที่จะเป็นการแข่งขันตัวต่อตัวที่ควบคุมเต็มรูปแบบ 659 00:30:01,342 --> 00:30:04,931 เพราะการจำลองเซ็ตอัปคู่แข่งของทีมเองออกมาต่ำกว่าตัวเลข 660 00:30:04,931 --> 00:30:06,022 ทางการ 661 00:30:06,022 --> 00:30:08,880 และพวกเขาเลือกการเปรียบเทียบที่ยุติธรรมกว่า