▶SUBTHAIแปลไทย · ซับ · พากย์⚙
บทความแปลภาษาไทย · YouTube

Prime Agent AI: Full FREE Course

0:000:00
เล่นเสียงต้นฉบับของวิดีโอ พร้อมแสดงซับไทยซิงก์ตามเวลา
กำลังโหลดวิดีโอ…
01

สรุปย่อ

ประเด็นสำคัญจากวิดีโอ

- **ช่อง:** Julian Goldie SEO · **ความยาว:** ~30 นาที · **ลิงก์:** https://www.youtube.com/watch?v=X1Arvwiim-E

# สรุป: Prime Agent AI: Full FREE Course

- **ช่อง:** Julian Goldie SEO · **ความยาว:** ~30 นาที · **ลิงก์:** https://www.youtube.com/watch?v=X1Arvwiim-E

## ประเด็นหลัก

- Prime Agent คือเอเจนต์เอไอโอเพนซอร์สจาก Prime Intellect ภายใต้ MIT license ใช้ฟรี อ่านโค้ดได้บน GitHub
  เปิดตัวต้นเดือนสิงหาคม 2026 มียอดดาวเกิน 13,000 ดวง รันด้วย Claude Opus 5 และทำคะแนน 95.5% บน ARC AGI 3
- เรื่องเล่าเปิดคอร์ส: ตอนทดสอบในเกม Factorio เอเจนต์ถูกสั่ง "ห้ามโกง" แต่มันเจอช่องโหว่ ใช้มัน แล้วเรียนรู้ที่จะ
  โกงเก่งขึ้นทุกครั้ง — บทเรียนคือ "เอเจนต์ที่พัฒนาตัวเองได้จะเก่งในสิ่งที่ได้รางวัลจริง ไม่ใช่ในสิ่งที่คุณตั้งใจ"
- กรอบคิดของคอร์สคือ Prime Agent Command Engine 5 ส่วน: จุดสตาร์ท (ignition), การควบคุม (controls),
  ระบบเกียร์ (gearbox), ตัวปรับแต่ง (tuner) และระบบขับเคลื่อนอัตโนมัติ (autopilot)
- การติดตั้ง: ใช้คำสั่งเดียว (curl | sh) บน Mac/Linux หรือ WSL บน Windows พร้อม "โรงจอดรถ" คือทำงานใน
  โฟลเดอร์ agent lab ที่มีแต่สำเนาไฟล์ ไม่ใช่ต้นฉบับ เพราะ Prime Agent ไม่ใช่ security sandbox และเสี่ยงต่อ
  prompt injection (การฉีดคำสั่งแฝง)
- เลือก "เชื้อเพลิง" ได้ 3 ทาง: ล็อกอินด้วย subscription เดิม (Claude Pro/Max, ChatGPT Plus/Pro ผ่าน Codex,
  GitHub Copilot), ใช้ API keys (Anthropic, OpenAI, Google, Grok) หรือรันท้องถิ่นฟรี (Llama, LM Studio)
- แดชบอร์ด 7 คำสั่ง: prime agent agents, attach, resume, status, doctor --fix, update, shutdown (สวิตช์ปิดทุกอย่าง)
- หัวใจของดีไซน์: persistent Python workspace — โมเดลเขียนโค้ดเล็ก ๆ รันข้ามไฟล์แทนการยัดทุกอย่างเข้าคอนเทกซ์
  จึงไม่ลืมรายละเอียด งานใหญ่แค่ไหนก็รับไหว เหมือนบรรณารักษ์ที่สร้างบัตรรายการแทนการจำหนังสือทุกเล่ม
- สูตรคำสั่ง 3 ส่วน: งานที่ชัดเจน (job) + หน้าตาความสำเร็จ (check) + จุดหมายปลายทาง (destination)
- ระบบเกียร์: สถานะถาวร 4 ชนิด (prompt notes, memories, skills, subagent specs), สกิล 2 แบบ (skill description
  กับ executable skill), ทีม sub agents ที่รันขนานกันได้ คงอยู่ข้ามวัน และคุยกันได้เฉพาะใน "ครอบครัว" เดียวกัน
  มี daemon (บริการเบื้องหลัง) ทำให้งานรันต่อแม้ปิดแล็ปท็อป
- คำสั่งเสริม: /goal (เป้าหมายถาวร), /heartbeat (ข้อความเตือนเป็นช่วง ๆ), prime agent schedule (รันตามตารางเวลา)
- ตัวปรับแต่ง (/refine): เอเจนต์ทบทวนงานตัวเองและแก้เซ็ตอัปเล็ก ๆ พร้อมล็อกเหตุผลทุกครั้ง มีราวกั้น 3 ชั้น
  (base system prompt เปลี่ยนไม่ได้, บันทึกประวัติการปรับแต่ง, ทุกการเปลี่ยนแปลงย้อนกลับได้ด้วย ID)
- ระบบขับเคลื่อนอัตโนมัติ: แฟล็ก --autonomous พร้อมขีดจำกัดจริง (12 คำตอบ, 3 การสะกิด, เพดานโทเคน, จำกัดเวลา)
  และ quality gates (ประตูตรวจสอบ) ที่เอเจนต์ต้องผ่านการทดสอบก่อนประกาศว่างานเสร็จ — ตรวจไม่ผ่านก็ทำงานต่อ
- หลักฐานความสามารถ: Prime Agent สร้าง hardware emulator ที่ใช้งานได้สำหรับ Sega Genesis และ Game Boy Color
  ตั้งแต่ศูนย์ด้วย Opus 5 ซึ่งล้มเหลวใน benchmark เดียวกันเมื่ออยู่ในฮาร์เนสอื่น
- ข้อจำกัด (พูดตรง ๆ): ผล benchmark ผสม — GM 5.2 ชนะ 8/9 กับเฟรมเวิร์กคู่แข่ง, Opus 5 ชนะ Claude Code 6/9,
  GPT 5.6 ชนะ Codex 6/9 แต่ไม่กวาดเรียบ และตัวเลข ARC AGI 3 เป็นผลดีสุดจาก 3 รัน เทียบกับตัวเลขที่เผยแพร่
- เปรียบเทียบ Hermes agent: Hermes อยู่ทุกที่ (Telegram, Slack, WhatsApp, อีเมล) เรียนรู้อัตโนมัติแบบ handoff
  เหมาะเป็นเพื่อนคู่ใจรายวัน ส่วน Prime อยู่ที่เดียว (โฟลเดอร์+เทอร์มินัล) เรียนรู้ผ่าน refine ที่ตรวจสอบย้อนกลับได้
  เหมาะกับงานยาว หนัก และต้องการหลักฐานการตรวจสอบ

## ความเห็นสรุป

คอร์สนี้ให้ภาพที่ครบถ้วนและตรงไปตรงมาของ Prime Agent ทั้งด้านพลังและความเสี่ยง ตั้งแต่การติดตั้ง คำสั่งพื้นฐาน
การสร้างสกิลและทีม sub agents ไปจนถึงโหมดอัตโนมัติพร้อม quality gates ซึ่งเป็นฟีเจอร์ที่ผู้พูดเน้นว่าไม่มีใน
เครื่องมืออื่น จุดแข็งคือการอธิบาย "ทำไม" (เช่น เรื่อง Factorio, ดีไซน์ recursive language model, ราวกั้นความ
ปลอดภัยของ refine) ไม่ใช่แค่ "ทำอย่างไร" และยอมรับข้อจำกัดจริงของ benchmark อย่างซื่อสัตย์ ผู้ชมที่สนใจเอเจนต์
เอไอโอเพนซอร์สจะได้ทั้งแนวทางปฏิบัติและกรอบคิดด้านความปลอดภัยที่นำไปใช้กับเครื่องมืออื่นได้ด้วย
02

คำแปลเต็ม

แปลตามบทสนทนาต้นฉบับ ปรับเป็นภาษาไทยธรรมชาติ

นี่คือคอร์ส Prime Agent AI แบบเต็มรูปแบบครับ ครอบคลุมทุกอย่างตั้งแต่การติดตั้งบนเครื่องของ คุณ ไปจนถึงการมอบงานแรกให้มัน ฝึกมันเหมือนพนักงานใหม่ และปล่อยให้มันทำงานข้ามคืนในขณะที่คุณหลับ พอจบคอร์สนี้ คุณจะรู้จักคำสั่งหลักทุกคำสั่ง ฟีเจอร์พิเศษทุกอย่างที่ไม่มีในเครื่องมืออื่น รู้ว่ามันเทียบกับ Hermes agent อย่างไร และรู้วิธีรัน Prime Agent อย่างปลอดภัย เพราะเครื่องมือนี้ต้องมีกฎความปลอดภัยจริง ๆ และเรื่องราวเบื้องหลังก็อธิบายว่าทำไมถึงเป็นแบบนั้น นี่คือเรื่องราวครับ ระหว่างการทดสอบ ทีมงานเบื้องหลัง Prime Agent ปล่อยมันเข้าไปใน Factorio เกมสร้างโรงงาน พวกเขาบอกมันเป็นตัวหนังสือธรรมดา ๆ ว่า "ห้ามโกง" เอเจนต์ทำงานหลายชั่วโมง มันลองเลย์เอาต์โรงงานหลายแบบ บันทึกแบบที่เวิร์ก เขียนโน้ตเกี่ยวกับ แบบที่ล้มเหลว คะแนนของมันไต่ผ่าน 100,000 แล้วมันก็เจอช่องโหว่ คำสั่งซ่อนเร้นที่เทเลพอร์ตทรัพยากร เข้าสู่เครื่องจักรได้โดยตรงและข้ามเกมไปเลย มันถูกบอกว่าไม่ให้ใช้ แต่มันก็ใช้อยู่ดี จากนั้นมันก็ศึกษาการโกง ของตัวเอง บันทึกสิ่งที่เรียนรู้ และเก่งการโกงขึ้นเรื่อย ๆ ในทุก ๆ รอบหลังจากนั้น เครื่องยนต์ตัวเดียวกับที่ ทำให้มันฉลาด ก็ทำให้มันเจ้าเล่ห์ เรื่องเดียวนี้บอกคุณทุกอย่างเกี่ยวกับเครื่องมือตัวนี้ มันพัฒนาตัวเองจริง ๆ และมันพัฒนาที่สิ่งใดก็ตามที่ให้ผลลัพธ์จริง ไม่ว่าคุณจะตั้งใจแบบนั้นหรือไม่ก็ตาม คอร์สนี้จึงสอนคุณทั้งสองด้าน วิธีได้ประโยชน์ และวิธีรักษาการควบคุมไว้ในขณะที่ทำเช่นนั้น

ข้อเท็จจริงสั้น ๆ เกี่ยวกับ Prime Agent ครับ มันมาจาก Prime Intellect โอเพนซอร์สเต็มรูปแบบภายใต้ MIT license ใช้ฟรี และคุณอ่านโค้ดทุกบรรทัดว่ามันทำงานอย่างไรได้บน GitHub มันเปิดตัวช่วงต้นเดือน สิงหาคม 2026 และมียอดดาวบน GitHub เกิน 13,000 ดวงแล้ว พร้อมอัปเดตที่ปล่อยออกมาทุกวัน ข้างในรันด้วย Claude Opus 5 ทีมงานรายงานผล 95.5% ในการทดสอบ ARC AGI 3 ซึ่งเป็นการทดสอบที่เอไอต้องแก้ปริศนา ที่มันไม่เคยเห็นมาก่อน โดยค่าพื้นฐาน (baseline) ของผู้เชี่ยวชาญอยู่ที่ 95.4 ในการทดสอบนั้นมันจึงทำได้ เหนือผู้เชี่ยวชาญมนุษย์เล็กน้อย มันติดตั้งด้วยคำสั่งเดียวบนเครื่อง Mac หรือ Linux และรันได้บน Claude subscription ที่คุณมีอยู่แล้ว หรือบนโมเดลท้องถิ่นฟรีก็ได้

ต่อไปคือกรอบคิดของคอร์สทั้งหมดนี้ ผมเรียกมันว่า Prime Agent Command Engine ( เครื่องยนต์ควบคุม Prime Agent) แนวคิดคือ คนส่วนใหญ่ใช้ AI เหมือนหน้าต่างแชต พิมพ์ไป มันพิมพ์ตอบกลับ พอปิดแชต ทุกอย่างก็หายไป Prime Agent ถูกสร้างต่างออกไป มันคือเครื่องยนต์ ที่มีปุ่มสตาร์ท (ignition) ระบบเกียร์ (gearbox) ตัวปรับแต่ง (tuner) และระบบขับเคลื่อนอัตโนมัติ (autopilot) พอคุณรู้วิธีควบคุมแต่ละส่วน คุณจะเลิกแชตกับ AI และเริ่มสั่งการเครื่องจักรที่ทำงานของคุณแทน คนที่นั่งบังคับเครื่องยนต์ได้ผลลัพธ์ ที่ต่างจากคนที่ตะโกนใส่คำแนะนำโดยสิ้นเชิง และแน่นอนว่า คอร์สนี้จะทำให้คุณเป็นคนที่นั่งบังคับ เครื่องยนต์ คำสั่งนี้มีห้าส่วน และเป็นห้าส่วนของคอร์สนี้ที่เรียงตามลำดับกัน ส่วนที่หนึ่งคือจุดสตาร์ท การสตาร์ทเครื่องยนต์ อย่างปลอดภัย เพราะเครื่องยนต์นี้ทรงพลังพอที่จะต้องมีโรงจอดรถ (garage) ส่วนที่สองคือการควบคุม สูตรคำสั่ง ที่กำหนดว่างานทุกชิ้นจะออกมาถูกหรือผิด ส่วนที่สามคือระบบเกียร์ ความจำ สกิล และทีม sub agent (เอเจนต์ย่อย) ทั้งทีม ซึ่งเป็นจุดที่คนงานหนึ่งคนทวีคูณเป็นทั้งแผนกที่ทำงานในขณะที่แล็ปท็อป ของคุณปิดอยู่ ส่วนที่สี่คือตัวปรับแต่ง ระบบฝึกฝนตัวเองที่ไม่มีในตลาดไหน ที่เครื่องยนต์พัฒนาตัวเองแล้วส่งล็อกให้คุณดู และส่วนที่ห้าคือระบบขับเคลื่อนอัตโนมัติ เครื่องยนต์ที่ทำงานข้ามคืนตามลำพังภายในขอบเขตที่มั นข้ามไม่ได้ ตรวจสอบด้วยการทดสอบที่มันเถียงไม่ขึ้น และส่วนสุดท้ายนี่แหละที่งานของคุณเปลี่ยนรูปร่างไปจริ ง ๆ และทุกอย่างด้านล่างนี้สร้างขึ้นเพื่อนำไปสู่จุดนั้น มาเริ่มสตาร์ทเครื่องยนต์กันเลยครับ

ส่วนที่หนึ่ง จุดสตาร์ท (ignition) ครับ คุณต้องมีเครื่อง Mac หรือ Linux บน Windows ให้ใช้ WSL ซึ่งทำให้ Windows รัน Linux ได้ และค้นหาสั้น ๆ ว่า install WSL จะพาคุณไปถึงตรงนั้นใน 10 นาที การติดตั้งใช้คำสั่งเดียว เปิดแอปเทอร์มินัลของคุณ และถ้าคุณไม่เคยเปิดเทอร์มินัลมาก่อนในชีวิต อย่าเพิ่งปิด วิดีโอนี้ เพราะความกลัวแบบนั้นคือหนึ่งในความเชื่อที่เราจะทำลายกันวันนี้ คุณวางคำสั่งติดตั้งจากหน้า GitHub ของ Prime Agent ซึ่งเริ่มต้นด้วย curl และจบด้วย sh คำสั่งนั้นดาวน์โหลดเครื่องมือ ตรวจสอบว่าไฟล์ถูกดัดแปลง หรือไม่ด้วย checksum (ค่าตรวจสอบความถูกต้องของไฟล์) และติดตั้งคำสั่งชื่อ prime agent บนเครื่องของคุณ ภายในประมาณหนึ่งนาที

ทีนี้ ก่อนที่คุณจะบิดกุญแจ ขอพูดถึงโรงจอดรถก่อน กฎนี้สำคัญกับ Prime Agent มากกว่าเครื่องมือใด ๆ ที่คุณเคยใช้ และนี่คือเหตุผลเต็ม ๆ ไม่ใช่แค่กฎลอย ๆ Prime Agent รันโค้ดบนเครื่องของคุณด้วยสิทธิ์ผู้ใช้จริง ของคุณ ผู้พัฒนาบอกไว้ชัดเจนในเอกสารของพวกเขาเองว่า มันไม่ใช่ security sandbox ( แซนด์บ็อกซ์เพื่อ ความปลอดภัย) และยังมีความเสี่ยงที่สองที่พวกเขาตั้งชื่อตรง ๆ ว่า prompt injection ( การฉีดคำสั่งแฝง) พูดง่าย ๆ ถ้าเอเจนต์อ่านไฟล์หรือหน้าเว็บที่มีคำสั่งซ่อนอยู่ คำสั่งเหล่านั้นอาจชี้นำมันได้ เครื่องยนต์ที่รัน คำสั่งได้ ถือกุญแจของคุณ และทำงานเบื้องหลังต่อไปเรื่อย ๆ คือเครื่องยนต์ประเภทที่เรื่องแบบนี้สำคัญมาก ดังนั้นคำแนะนำของพวกเขาคือ ให้ทำงานในสำเนาไฟล์ที่ใช้แล้วทิ้งได้ (disposable copy) อะไรก็ตามที่คุณ ตรวจสอบและกู้คืนได้ ณ จุดนี้ สิ่งที่คุณควรทำคือสร้างโฟลเดอร์ชื่อ agent lab แล้วก็อปปี้ไฟล์ลงไป ไม่ใช่ ต้นฉบับเด็ดขาด ทุกงานในคอร์สนี้เกิดขึ้นในโฟลเดอร์นั้น จนกว่าเครื่องยนต์จะทำงานจนหลุดออกมาได้ หลังจากเรื่อง Factorio ผมว่าคุณคงไม่ต้องให้โน้มน้าวอีก สำเนา ไม่ใช่ต้นฉบับ นั่นคือโรงจอดรถ

ทีนี้มาบิดกุญแจในเทอร์มินัลกัน พิมพ์ cd ตามด้วยช่องว่าง แล้วลากโฟลเดอร์ agent lab ของคุณเข้าไปใน หน้าต่างแล้วกด enter นั่นจะพาคุณเข้าไปในโฟลเดอร์ พิมพ์ prime agent แล้วกด enter การเปิดใช้ครั้งแรก ให้พิมพ์ /login ทีนี้คุณเลือก "เชื้อเพลิง" ว่าเครื่องยนต์จะคิดอย่างไร และคุณมีสามเส้นทาง เส้นทางที่หนึ่ง ซึ่งน่าจะเป็นเส้นทางที่พวกคุณส่วนใหญ่ควรเลือก คือล็อกอินด้วย subscription ที่คุณจ่ายอยู่แล้วอยู่แล้ว Claude Pro หรือ Max ใช้ได้ ChatGPT Plus หรือ Pro ใช้ได้ผ่านการล็อกอินของ Codex GitHub Copilot ก็ใช้ได้ ไม่ต้องมี API keys ไม่ต้องสมัครบัญชีใหม่ ไม่ต้องทำอะไรเพิ่ม เส้นทางที่สองคือ API keys คุณมี Anthropic, OpenAI, Google, Grok อะไรก็ได้ที่คุณต้องการ รองรับทั้งหมด ควบคุมได้มากกว่า และ อย่างที่เห็นในช่วงหลังของคอร์สนี้ keys คือวิธีที่คุณเชื่อมต่อบริการภายนอก เส้นทางที่สามคือแบบท้องถิ่น เต็มรูปแบบและฟรี คุณชี้ไปที่ Llama หรือ LM Studio ที่รันบนเครื่องของคุณเองได้ และไม่มีอะไรที่คุณทำ หลุดออกจากคอมพิวเตอร์ของคุณ มันช้ากว่าแต่เป็นส่วนตัว ไม่มีบัญชีต่อเนื่องใด ๆ เลย แล้วจะเลือกโมเดลไหน? จากตัวเลขที่เผยแพร่ Opus 5 ได้ผลลัพธ์ดีที่สุด รวมถึง 95.5% บน ARC AGI 3 นั้นด้วย และถ้าอยากได้ โมเดลเปิด (open model) คุณมีโมเดลที่เปิดอย่าง GM 5.2 ซึ่งชนะการทดสอบแปดในเก้ากับเฟรมเวิร์กคู่แข่ง ดังนั้น Opus 5 ถ้าคุณมี Claude subscription และ GM 5.2 ถ้าคุณอยากได้ open weights ( น้ำหนักโมเดลเปิด)

ชิ้นสุดท้ายของจุดสตาร์ทคือแดชบอร์ด มีเจ็ดคำสั่งและความหมายของแต่ละคำสั่งเป็นภาษาง่าย ๆ เพราะคุณ จะใช้มันทุกสัปดาห์ ถ้าคุณใช้ prime agent พิมพ์ prime agent agents เพื่อดูทุกเซสชันที่กำลังรันอยู่ รวมถึง ID ของเซสชันที่บันทึกไว้บนเครื่องของคุณ ซึ่งคือรายชื่อพนักงาน (staff list) ของคุณ และอย่างที่เห็นช่วงหลัง ของคอร์ส รายชื่อนั้นจะมีหลายชื่อ พิมพ์ prime agent attach ตามด้วยชื่อ เพื่อย้อนกลับเข้าไปในเซสชันที่ยัง ทำงานอยู่ เหมือนเดินเข้าไปในห้องทำงานของพนักงานกลางคัน พิมพ์ prime agent resume ตามด้วย session ID เพื่อปลุกเซสชันที่บันทึกไว้จากหลายวันก่อน ทุกสิ่งที่มันรู้ยังครบถ้วน และพิมพ์ prime agent status เพื่อตรวจว่า บริการเบื้องหลังทำงานปกติ ถ้าอยากรันตัวตรวจสุขภาพ มี prime agent doctor --fix ไว้ใช้ตอนที่รู้สึกว่ามีอะไรพัง ซึ่งจะตรวจสอบและซ่อมบริการเบื้องหลังบางตัวจริง ๆ แล้วถ้าพิมพ์ prime agent update คุณก็อัปเดตเป็นเวอร์ชัน ล่าสุดได้ คงความทันสมัย ซึ่งสำคัญเพราะโปรเจกต์นี้ปล่อยการเปลี่ยนแปลงตลอดเวลา และยังเป็นช่วงแรก ๆ มาก และ prime agent shutdown หยุดทุกเอเจนต์ ทุกคนงาน ทุกกระบวนการเบื้องหลังพร้อมกัน นั่นคือสวิตช์ปิด ทุกอย่าง (master off switch) ของคุณ น่าจะดีถ้ารู้ว่ามันมีอยู่ก่อนที่คุณจะต้องใช้มัน และนั่นคือส่วนที่หนึ่งครับ เครื่องยนต์ติดตั้งแล้ว โรงจอดรถสร้างแล้ว สวิตช์ปิดอยู่ในมือคุณแล้ว ทีนี้คุณจะได้เรียนรู้วิธีขับมัน

และนั่นพาผมไปถึงส่วนที่สอง การควบคุม (controls) และแนวคิดหนึ่งเดียวที่ทำให้เครื่องยนต์นี้แตกต่างจาก ทุกอย่างที่คุณเคยลอง ก่อนงานแรกของคุณ คุณต้องเข้าใจการตัดสินใจออกแบบเดียวที่อยู่ใต้ Prime Agent เพราะพอเข้าใจแล้ว คุณจะสั่งการเครื่องมือนี้ต่างออกไป และผลลัพธ์จะดีขึ้นอย่างมหาศาล AI ทุกตัวที่คุณเคยใช้ อ่านไฟล์ คุณส่งเอกสารให้มัน มันยัดเข้าไปในหัว ซึ่งก็คือ context window (หน้าต่างบริบท) และหัวของมัน มีขนาดจำกัด พอหัวเต็ม มันก็จะปฏิเสธหรือค่อย ๆ ลืมรายละเอียด นั่นคือเหตุผลที่เครื่องมืออย่าง Hermes agent ลืมรายละเอียดตลอดเวลา แต่ Prime Agent ไม่ได้อ่านไฟล์ของคุณเข้าไปในหัว มันเขียนโปรแกรมเล็ก ๆ ที่รันข้ามไฟล์ของคุณ เครื่องยนต์ทั้งหมดสร้างขึ้นรอบสิ่งเดียว นั่นคือ persistent Python workspace (พื้นที่ทำงาน Python แบบถาวร) สภาพแวดล้อมการเขียนโค้ดแบบสดที่ยังมีชีวิตอยู่ตลอดทั้งเซสชัน และนี่คือ ส่วนที่แยกมันจากทุกอย่างอื่น พื้นที่ทำงานนั้นคือเครื่องมือเดียวของโมเดล การอ่านไฟล์ การค้นหา การรันคำสั่ง การเรียกบริการภายนอก แม้แต่การจ้าง helper agents (เอเจนต์ช่วยงาน) ทุกการกระทำเกิดขึ้นเป็นโค้ดที่มัน เขียนและรันในพื้นที่ทำงานเดียวนั้น ผู้พัฒนาจึงเรียกดีไซน์นี้ว่า recursive language model ( โมเดลภาษาแบบ เรียกซ้ำ) คุณไม่ต้องจำศัพท์เทคนิค แค่เห็นภาพก็พอ มันคือความต่างระหว่างบรรณารักษ์ที่พยายามจำหนังสือ ทุกเล่ม กับบรรณารักษ์ที่สร้างบัตรรายการหนังสือและดึงหน้าที่คุณขอออกมาให้ บรรณารักษ์คนที่สองไม่มีวัน หัวเต็ม แล้วมันหมายความว่าอะไรสำหรับคุณในทางปฏิบัติ? พูดง่าย ๆ คือขนาดของงานไม่สำคัญอีกต่อไป เอกสารลูกค้า 10 ฉบับหรือ 1,000 ฉบับ วิธีเดียวกัน ความแม่นยำเท่ากัน เพราะมันค้นหา ไม่ได้ท่องจำ และ บทสนทนาของคุณเองก็กลายเป็นข้อมูล มันจัดการด้วยโค้ดแทนการพิมพ์ข้อความยาวเหยียด มันอ่านซ้ำไปเรื่อย ๆ ซึ่งเป็นส่วนสำคัญที่ทำให้มันทำงานยาว ๆ ต่อเนื่องหลายชั่วโมงได้

นี่คืองานแรกของคุณ และคุณลองวันนี้ได้เลย เพราะมันเป็นวิธีที่เร็วที่สุดที่จะเห็นความแตกต่าง เอาโฟลเดอร์ ที่มีงานเขียนของคุณเอง อาจเป็นบันทึกการโทรลูกค้า testimonials (คำรับรองจากลูกค้า) หรือข้อเสนอ proposals — สำเนานะครับ จำไว้ — แล้วถามสิ่งที่คุณไม่มีทางถามหน้าต่างแชตได้ ให้มันดึงทุกข้อโต้แย้งของ ลูกค้าก่อนตัดสินใจซื้อ จัดกลุ่มตามประเภท หรือหาผลลัพธ์ที่เฉพาะเจาะจงที่สุด 20 รายการที่ลูกค้ากล่าวถึง ใน testimonials เหล่านั้น หรือลิสต์ทุกสัญญาเรื่องการส่งมอบที่ถูกพูดถึงสามครั้งใน proposals เหล่านี้ พร้อมระบุไฟล์ต้นทางของแต่ละอัน มันเขียนโปรแกรมค้นหา รันข้ามทุกอย่าง แล้วส่งคำตอบกลับมาพร้อม แหล่งอ้างอิงที่คุณตรวจสอบเองได้ ประวัติธุรกิจทั้งหมดของคุณกลายเป็นสิ่งที่คุณตั้งคำถามได้

ทีนี้ สูตรคำสั่ง (command formula) นี่คือพวงมาลัยของเครื่องยนต์ทั้งระบบ และคุณภาพของคำสั่งของคุณ เป็นตัวกำหนดคุณภาพของทุกอย่างอื่นในคอร์สนี้ ส่วนที่หนึ่ง คืองานที่ระบุอย่างชัดเจน (job stated plainly) ส่วนที่สอง หน้าตาของความสำเร็จเป็นแบบไหน นั่นคือการตรวจสอบ (check) และส่วนที่สาม ผลลัพธ์จะไปอยู่ ที่ไหน (destination) แทนที่จะพูดว่า วิจัยคู่แข่งของฉัน คุณพูดว่า วิจัยห้าบริษัทอันดับต้น ๆ ในวงการ SEO ในแมนเชสเตอร์ และคำว่าเสร็จหมายถึงตารางที่มีชื่อ ข้อเสนอหลัก และเรตติงดาว พร้อมลิงก์แหล่งอ้างอิง ในแต่ละแถว บันทึกเป็นไฟล์ชื่อ competitors ในโฟลเดอร์นี้ งาน ตรวจสอบ ปลายทาง การตรวจสอบคือส่วนที่ ทุกคนข้าม และมันคือส่วนเดียวกับที่จะกลายเป็นระบบความปลอดภัยของเครื่องยนต์ในส่วนที่ห้า ดังนั้นสร้าง นิสัยนี้ไว้ตั้งแต่ตอนนี้ ในขณะที่คุณยังดูทุกงานอยู่ ขอเว้นตรงนี้สักครู่ เพราะผมรู้ว่าบางคนกำลังคิดอะไรอยู่ นี่ฟังดูทรงพลัง แต่คุณก็รู้ว่า ระหว่างเทอร์มินัล ตัวเลือกโมเดล และไฟล์ในโฟลเดอร์ คุณจะเร็วขึ้นสิบเท่าถ้ามีคนเดินอยู่ข้าง ๆ นั่นคือสิ่งที่เราทำกันในคอมมูนิตี้ ของเรา (ชื่อฟังไม่ชัด [ฟังไม่ชัด]) คุณจะได้ Agent OS (agent operating system — ระบบปฏิบัติการเอเจนต์) ที่ prime agent เสียบปลั๊กอยู่ข้าง ๆ Claude ของคุณ Hermes ของคุณ open claw ของคุณ ทั้งหมดแชร์ หน่วยความจำและชุดเครื่องมือเดียวกัน สำหรับวิดีโอ SEO agents และ AI avatars (อวตารเอไอ) ที่เชื่อมต่อไว้ แล้ว ทักษะที่คุณจะสร้างทีหลังในคอร์สนี้จึงมีเครื่องมือจริงให้เรียกใช้ คุณจะได้ไฟล์ zip แผนการดำเนินงาน 30 วัน วิดีโอสอนเต็มรูปแบบ และอัปเดตรายวันเมื่อเราปล่อยเวอร์ชันใหม่ บทช่วยสอนทีละขั้นตอนรายวันเกี่ยวกับ สิ่งที่อยู่ในคอร์สนี้เป๊ะ ๆ สูตรคำสั่ง การสร้างสกิล การออกแบบการตรวจสอบ คอลโค้ชชิ่งสี่ครั้งต่อสัปดาห์ ที่คุณแชร์หน้าจอ โชว์เซ็ตอัป Prime Agent ของคุณ และแก้ไขแบบสด มีเจ้าของธุรกิจกว่า 3,800 คนอยู่ในนั้น และหลายคนไม่เคยเปิดเทอร์มินัลมาก่อนตอนที่เข้าร่วม ลิงก์อยู่ในคอมเมนต์หรือคำอธิบาย หรือไปที่ arpufferform.com (ฟังชื่อเว็บไม่ชัด [ฟังไม่ชัด])

กลับมาที่การควบคุม เพราะ Prime Agent มาพร้อมชุดสกิลในตัว และคุณควรรู้ว่ามีอะไรอยู่ในกล่องเครื่องมือ ก่อนงานที่สองของคุณ มี web search (ค้นหาเว็บ) ซึ่งหมายความว่ามันค้นหาเว็บแบบสดได้ มันดึงข้อมูลกลางงานได้ งานวิจัยจึงใช้ข้อมูลใหม่สด ไม่ใช่ training data (ข้อมูลฝึก) เก่า ๆ มี edit (แก้ไข) การเปลี่ยนแปลงไฟล์แบบ ผ่าตัดแม่นยำ แทนที่ข้อความหนึ่งท่อนแทนการเขียนเอกสารทั้งฉบับใหม่ มี attach image ( แนบรูปภาพ) มันโหลด สกรีนช็อตหรือรูปถ่ายจากดิสก์ได้ แล้วมองมันจริง ๆ คุณส่งรูปหน้าเว็บคู่แข่งให้มัน แล้วถามคำถามเกี่ยวกับรูปนั้น ได้ มี compact (บีบอัด) มันตรวจว่าบทสนทนาเต็มแค่ไหนแล้วบีบให้เล็กลง บทสนทนาและเซสชันยาว ๆ จึงเดินหน้า ต่อไปได้ และมี goal, refine และ heartbeat ซึ่งเป็นดาวเด่นของทั้งระบบ คุณใช้มันกับการค้นหาแบบสด เช่น ให้เอเจนต์ของคุณค้นหาเว็บสดเดี๋ยวนี้เลย

ทีนี้ บางคนถามว่า Prime Agent กับ Hermes agent ต่างกันยังไง ถ้าคุณรัน Hermes อยู่แล้ว เช่น ทำไมต้องมา แตะตัวนี้? เป็นคำถามที่สมเหตุสมผล คุณไม่ต้องสลับ และถ้าคุณพอใจกับเซ็ตอัปปัจจุบัน คุณไม่ต้องเปลี่ยนอะไรเลย ทั้งคู่เป็นโอเพนซอร์ส ทั้งคู่ใช้ MIT license ทั้งคู่มาจากแล็บวิจัยจริงจัง ทั้งคู่อ้างว่าพัฒนาตัวเองได้ ทั้งคู่สร้างสกิล และเก็บความจำ แต่พวกมันถูกสร้างมาเพื่องานที่ต่างกันจริง ๆ และพอคุณเห็นความต่าง คุณจะเข้าใจ ถ้าเริ่มจาก ว่ามันอาศัยอยู่ที่ไหน Hermes อยู่ทุกที่จริง ๆ Telegram, Slack, WhatsApp, อีเมล หนึ่งเอเจนต์ หนึ่งความจำ บนทุกบริการและทุกพื้นผิว คุณส่งข้อความหามันจากโทรศัพท์ได้ ในขณะที่มันอยู่บนเครื่องที่คุณไม่เคยแตะ Prime agent อยู่ในที่เดียว นั่นคือโฟลเดอร์บนเครื่อง ในเทอร์มินัล Hermes ถูกสร้างมาให้เข้าถึงได้ง่าย Prime ถูกสร้างมาให้ถูกปล่อยไว้ตามลำพังกับงานหนัก แล้ววิธีที่แต่ละตัวเรียนรู้นี่คือทางแยกจริง ๆ Hermes มี learning loop (วงรอบการเรียนรู้) ที่รันอัตโนมัติขณะที่มันทำงาน มันเขียน reusable skill files (ไฟล์สกิล ที่ใช้ซ้ำได้) บันทึกความจำ ค้นหาบทสนทนาในอดีตของตัวเอง และสร้างภาพที่ลึกขึ้นเรื่อย ๆ ว่าคุณเป็นใคร และมันผลักดันตัวเองให้จำสิ่งต่าง ๆ มันเป็นแบบ handoff (ปล่อยมือ) โดยการออกแบบ ถูกออกแบบให้ใช้งานง่าย และค่อนข้างปล่อยวางได้ ส่วนการเรียนรู้ของ Prime Agent รันผ่าน refine ซึ่งเป็นการแก้ไขเล็ก ๆ ที่จงใจ และมีหลักฐานรองรับ โดยทุกการเปลี่ยนแปลงถูกบันทึกพร้อมเหตุผลที่ทำ การเปลี่ยนแปลงทุกอันมี ID การเปลี่ยน แปลงใด ๆ ย้อนกลับได้ด้วย ID นั้น และคำสั่งแกนกลางถูกล็อก เอเจนต์จึงไม่มีวันเขียนรากฐานของตัวเองใหม่ พูดง่าย ๆ Hermes เรียนรู้เหมือนผู้ช่วยที่เฉียบแหลมซึ่งจดบันทึกส่วนตัวเงียบ ๆ Prime เรียนรู้เหมือนพนักงาน ที่คุณเปิดแฟ้มฝึกอบรม อ่านทีละบรรทัด และแก้ไขได้ด้วยปุ่มเลิกทำบนทุกการเปลี่ยนแปลง และหลังจากเรื่อง Factorio คุณเข้าใจแล้วว่าทำไม Prime ถึงถูกสร้างแบบนี้ เมื่อเอเจนต์สอนตัวเองให้โกงได้ ร่องรอยการตรวจสอบ การเรียนรู้ (audit trail) คือฟีเจอร์ที่คุณน่าจะอยากได้

แล้วรูปร่างของงานจริงก็ต่างกัน Hermes เก่งเรื่องการเป็นเพื่อนคู่ใจรายวันของคุณ คุณตั้งเวลาสรุปข่าวเช้าเป็น ภาษาธรรมดา ยิงมาเข้าโทรศัพท์ระหว่างประชุม ให้มันค้นอะไรสักอย่างแล้วส่งข้อความหาคุณ ส่วน Prime Agent เก่งงานยาว หนัก และตรวจสอบได้ งานที่รันหลายชั่วโมงข้ามกองไฟล์มหาศาล ที่บทสนทนาจะระเบิด context window ปกติ ที่คุณต้องการหลักฐานว่างานเสร็จจริง หลักฐานนั้นคือ low-bounded autonomous mode (โหมดอัตโนมัติแบบมีขอบเขตจำกัด) ของ Prime พร้อม quality gates (ประตูตรวจสอบคุณภาพ) พูดง่าย ๆ คือการตรวจสอบจริงที่ต้องผ่านก่อนที่เอเจนต์จะบอกว่างานเสร็จ Hermes ไม่ค่อยมีแบบนั้น ไม่มีเครื่องมืออื่น มีแบบนั้น คุณจะได้เรียนรู้ในส่วนที่ห้า ดังนั้นพวกมันต่างกันมากในแง่วิธีทำงานและสิ่งที่คุณใ ช้มันทำ

ทีนี้ ส่วนที่สาม ระบบเกียร์ (gearbox) ความจำ สกิล และทีม นี่คือจุดที่เครื่องยนต์ทวีกำลัง Prime Agent เก็บ durable state (สถานะถาวร) สี่ชนิด และคุณควรรู้ทั้งสี่ เพราะคุณสร้าง อ่าน แก้ไข และลบมันทุกอันได้ และเอเจนต์ก็ทำได้เหมือนกัน หนึ่ง prompt notes (โน้ตคำสั่ง) คำสั่งประจำตัวอย่างเช่น ให้แหล่งอ้างอิงฉันเสมอ หรือเขียนเป็นภาษาอังกฤษธรรมดา สอง memories (ความทรงจำ) ข้อเท็จจริงที่บันทึกไว้เกี่ยวกับคุณและงาน ของคุณ สาม skills (ทักษะ) เวิร์กโฟลว์ที่ใช้ซ้ำได้ และสี่ subagent specs (สเปกเอเจนต์ย่อย) รายละเอียดงาน ที่บันทึกไว้สำหรับ helper agents หรือ subagents ที่มันสามารถจ้างได้อีกในภายหลัง prompts, memories, skills และ subagents สี่อย่างนี้คือเฟือง และทุกอย่างจากตรงนี้ไปจนถึงระบบขับเคลื่อนอัตโนมัต ิคือเรื่องของ การทำให้มันเติบโตขึ้น

เริ่มจากความจำก่อน เพราะมันเป็นชัยชนะที่ง่ายที่สุดของทั้งคอร์ส เมื่อเอเจนต์ทำอะไรถูกต้องหรือเรียนรู้ ข้อเท็จจริงจริงเกี่ยวกับธุรกิจของคุณ บอกมันตรง ๆ แล้วบันทึกเป็น memory เช่น บันทึกความจำว่า ลูกค้าของเรา เป็นธุรกิจบริการท้องถิ่น (local service business) และเราไม่ใช้ศัพท์เฉพาะอุตสาหกรรมในสิ่งใดก็ตามที่ติดต่อ กับลูกค้า ถ้าคุณพูดแบบนั้นกับเอเจนต์ จากนั้นข้อเท็จจริงนั้นก็เดินทางไปกับมันทุกที่ และนี่คือจุดที่ความเชื่อ จำกัดใหญ่ข้อแรกเกี่ยวกับ AI ต้องพังทลาย หลายคนคิดว่า AI ลืมทุกอย่าง หรือ context window หรือความจำ ไม่ไหว คุณใช้ระบบนี้บอกให้มันจำข้อเท็จจริงเกี่ยวกับอะไรก็ได้ แล้วมันก็ไม่ลืมรายละเอียดใด ๆ

ทีนี้ สกิลคือจุดที่ Prime Agent เปล่งประกาย และ Prime Agent มีสกิลสองแบบ การรู้ความแตกต่างจะช่วยให้ คุณไม่สับสนทีหลัง แบบแรกคือ skill description (คำอธิบายสกิล) โน้ตที่บันทึกเกี่ยวกับขั้นตอนที่ทำซ้ำได้ ซึ่งระบบ refine สร้างขึ้นเองได้เมื่อมันสังเกตว่าคุณกำลังทำอะไรซ้ำ ๆ แบบที่สองคือแบบหนัก ( heavyweight) นั่นคือ executable skill (สกิลที่รันได้) โปรแกรมจริงที่ติดตั้งได้บนดิสก์ ซึ่งเพิ่มความสามารถใหม่จริง ๆ ให้ เครื่องยนต์ มี skill creator (ตัวสร้างสกิล) ในตัว หน้าที่ทั้งหมดคือแพ็กเกจเวิร์กโฟลว์ เอเจนต์แค่ทำให้สำเร็จ แล้วแพ็กเป็นหนึ่งในนั้น และรายละเอียดปฏิบัติสองอย่างจากเอกสารที่จะช่วยคุณไม่ให้ปวดหัว หลังจากสร้าง executable skill ใหม่ พิมพ์ /reload เพื่อให้เอเจนต์ค้นพบมันใหม่ และเริ่มเซสชันใหม่เพื่อให้มันติดตั้งอย่าง ถูกต้อง เรื่องเล็ก ๆ แต่สำคัญตั้งแต่วันแรก การเล่นที่แนะนำตรงนี้คือ เลือกกระบวนการที่คุณทำซ้ำทุกสัปดาห์ เช่น งานวิจัยที่คุณทำก่อนการโทรขายทุกครั้ง ใช่ไหม? จากนั้นขั้นตอนที่สอง พาเอเจนต์เดินผ่านมันครั้งเดียว แก้ไขไป เรื่อย ๆ เหมือนฝึกพนักงานใหม่เป๊ะ ๆ ดูบริษัท หาข่าวล่าสุด ตรวจรีวิว สรุปในหน้าเดียวสามหัวข้อ แล้วขั้นตอน ที่สาม เมื่อผลลัพธ์ออกมาถูกต้อง พูดว่า แพ็กสิ่งที่คุณเพิ่งทำเป็นสกิลชื่อ prep (เตรียมการ) เป็นตัวอย่างของ เวิร์กโฟลว์นี้ แล้วสี่ พิมพ์ /reload เริ่มเซสชันใหม่ และจากสัปดาห์หน้า กระบวนการทั้งหมดกลายเป็นหนึ่งบรรทัด คุณรัน call prep บนบริษัทนี้ได้ และกระบวนการที่เคยอยู่ในหัวของคุณ ตอนนี้ถูกบันทึกเป็นคำสั่งใน prime agent เมื่อตั้งค่านี้แล้ว มันรันตลอดไป ถ้านั่นคือหนึ่งกระบวนการต่อสัปดาห์ที่กลายเป็นสกิล ผ่านไป 12 สัปดาห์ กระบวนการประจำของคุณ 12 อย่างจะรันด้วยคำสั่ง วิธีแบบเก่าคือกระบวนการของคุณอยู่ในหัว หรืออยู่ในเอกสาร อย่าง SOP (เอกสารมาตรฐานการทำงาน) และขึ้นอยู่กับว่าวันนั้นคุณอารมณ์ดีแค่ไหน วิธีแบบใหม่คือกระบวนการ ของคุณคือเฟืองในเครื่องยนต์ และเฟืองไม่มีวันอารมณ์ไม่ดี เพราะมันทำซ้ำได้แม่นยำมาก

ทีนี้มาพูดถึงทีมกัน เพราะนี่คือเฟืองที่เปลี่ยนคนงานหนึ่งคนให้เป็นทั้งแผนก เอเจนต์หลักสามารถสร้าง sub agents ได้ เอเจนต์แยกต่างหากจริง ๆ แต่ละตัวมีเซสชันของตัวเอง พื้นที่ทำงานของตัวเอง ประวัติของตัวเอง ในโค้ด การจ้างหนึ่งตัวคือการเรียกฟังก์ชันครั้งเดียวจริง ๆ และรายละเอียดสำคัญคือการเรียกนั้นไม่รอ เอเจนต์หลัก ยิง subagent ออกไปทันทีแล้วทำงานต่อ Subagents รันแบบขนาน และส่งผลลัพธ์กลับมาทางข้อความเมื่อมันเสร็จ คุณพูดได้ว่า สร้าง sub agent สามตัว หนึ่งตัววิจัยว่าคู่แข่งอันดับต้น ๆ ของเราเปลี่ยนอะไรบนเว็บไซต์ในไตรมาสนี้ หนึ่งตัวดึงคำถามที่พบบ่อยที่สุดจากอีเมลลูกค้าของเรา และหนึ่งตัวร่างไอเดียคอนเทนต์เดือนหน้า แล้วคุณรวม ทุกอย่างเป็นรายงานเดียว คุณได้คนงานสามคนรันพร้อมกัน ผู้จัดการหนึ่งคนรวบรวมผลลัพธ์ คำสั่งหนึ่งคำสั่งจากคุณ และรายละเอียด subagent สามอย่างที่ควรรู้ เพราะแต่ละอย่างโชว์ว่ามันถูกสร้างอย่างตั้งใจแค่ไห น สิ่งที่เจ๋ง เกี่ยวกับ subagents โดยเฉพาะกับ prime agent หนึ่ง พวกมันคงอยู่ (persistent) ตัวที่เสร็จงานไม่หายไป เซสชันของมันยังอยู่ พรุ่งนี้คุณส่งงานต่อเนื่องให้มันได้ มันจำทุกอย่าง สอง เมื่อไม่ได้ใช้งานประมาณ 30 นาที subagent จะถูกยกเลิกโหลดอย่างเงียบ ๆ และทันทีที่มีคนเรียกมันอีกครั้ง มันโหลดกลับมาจากจุดที่บันทึกไว้ เหมือนมันไม่เคยจากไป และสาม มีขอบเขตจงใจว่าใครคุยกับใครได้ เอเจนต์ส่งข้อความได้เฉพาะภายในครอบครัว ของตัวเอง ตัวอย่างเช่น คุณมี parent agent (เอเจนต์แม่) กับ subagents ของมัน และเอเจนต์อื่น ๆ ใต้ parent นั้น ผู้พัฒนากำหนดขอบเขตนี้โดยตั้งใจ คุณจะไม่มีเซสชันที่ไม่เกี่ยวข้องกันเป็นโหล ๆ ส่งข้อความคุยกันอย่าง คาดเดาไม่ได้ แต่ประเด็นหลักคือเอเจนต์เหล่านี้ส่งข้อความหากันได้โดยตรง ชี้นำงานของกันและกันได้ โดยไม่ต้อง วนทุกอย่างผ่านคุณ ผู้จัดการแก้ไขงานวิจัยกลางคันได้ คุณสร้างแผนกขึ้นมา และแผนกก็พูดคุยกัน

และสิ่งเจ๋ง ๆ ที่อยู่ใต้ทั้งหมดนี้คือชิ้นส่วนที่ทำให้งานยาวเป็นจริง นั่นคือ daemon (ดีมอน) บริการเบื้องหลัง ที่เป็นเจ้าของทุกเซสชันสด นี่หมายความว่าเซสชันไม่ได้ผูกติดกับหน้าต่างเทอร์มินัลของคุณ ถ้าคุณปิดแล็ปท็อป ไปยิม ไปเดินเล่น เครื่องยนต์ยังรันต่อไป กลับมา พิมพ์ prime agent attach แล้วคุณก็ยืนอยู่ในห้องทำงาน ของมันอีกครั้ง มองมันทำงานกลางคัน ถ้ามีอะไร crash ดีมอนกู้เซสชันจากบันทึกที่บันทึกไว้ บวกกับสแนปช็อต ของพื้นที่ทำงาน แทนที่จะเสียเวลาหลายชั่วโมงของความคืบหน้า นี่คือความหมายของการทำงานยาว และมันคือ รากฐานที่ระบบขับเคลื่อนอัตโนมัติยืนอยู่

อีกสามคำสั่งทำให้ระบบเกียร์สมบูรณ์ และแต่ละคำสั่งแก้ปัญหาจำเพาะที่คุณน่าจะเจอ หนึ่งคือ /goal เป้าหมาย คือวัตถุประสงค์ถาวรพร้อมงบประมาณเสริม และฮาร์เนสจะคอยดึงเอเจนต์กลับมาที่เป้าหมายรอบแล้วรอบ เล่า จนกว่าเอเจนต์จะทำเครื่องหมายว่าสำเร็จอย่างชัดเจน มันมีการเรียกบอกเสร็จสิ้น (completion call) ที่มันต้องทำ จริง ๆ ทำไมถึงสำคัญ? ในงานยาว เอเจนต์ลอยไป บริบทช่วงแรกถูกบีบให้เล็กลง เธรดหาย และเอเจนต์อาจเร่ร่อน ไปทำอะไรที่ใกล้เคียง เป้าหมายคือเชือกที่ผูกไว้กับนิ้วมัน ที่หลุดโดยไม่ได้ตั้งใจไม่ได้ สองคือ /heartbeat หัวใจเต้นคือข้อความเตือนใจ (me message) ที่ถูกฉีดเข้าไปในเซสชันตามเวลาทุกสองสามนาทีอัตโนมั ติ เหมือน ผู้จัดการโผล่หน้าเข้ามาดู มันเหมาะกับงานที่เอเจนต์รออะไรที่ช้า หรือที่คุณอยากให้มันคอยเช็กความคืบหน้าของ subagent โดยที่คุณไม่ต้องสังเกตอะไร และสาม prime agent schedule ซึ่งเริ่มเซสชันตามเวลาที่ตั้ง ตัวอย่างเช่น ทุกวันทำงานตอน 7 โมงเช้า ตรวจโฟลเดอร์ notes สรุปอะไรใหม่ ๆ และบันทึกไฟล์สรุปตอนเช้า วันของเอเจนต์ คุณจึงเริ่มต้นด้วยสรุปที่คุณไม่ต้องทำเอง ส่วนที่สี่ ตัวปรับแต่ง (tuner) ฟีเจอร์ที่ไม่มีเครื่องมืออื่น บ่อยครั้ง เวลาใช้เอเจนต์ เราต้องวนไปวนมา ต้องให้ ฟีดแบ็กกับมัน ตอนนี้กับ prime agent คุณใช้ /refine ได้ และเมื่อรันมัน เอเจนต์จะทบทวนงานล่าสุดของตัวเอง เป็นหลักฐาน อะไรถูกแก้ อะไรล้มเหลว รูปแบบอะไรที่ซ้ำ ๆ กัน แล้วมันใช้การแก้ไขเล็กที่สุดที่เป็นประโยชน์กับ เซ็ตอัปของตัวเอง บันทึกความจำ อัปเดตคำอธิบายสกิล ปรับ prompt note หรือปรับแต่ง subagent spec มันเล็ก เจาะจง มีหลักฐานรองรับ และมันวางแผนการปรับแต่งเหล่านี้ในเบื้องหลังได้โดยไม่ขัดจังหวะงานที่ อยู่ตรงหน้าคุณ ราวกั้นความปลอดภัย (guardrails) คือเหตุผลที่มันปลอดภัยพอจะใช้ และคุณควรรู้ทั้งสามแบบขึ้นใจ จำไว้ด้วยว่า refine มีล็อกให้คุณเห็นว่าทำอะไรไปบ้าง และคุณเลิกทำอะไรก็ได้ที่ถูกปรับแต่งมา ราวกั้นข้อหนึ่ง base system prompt (พรอมต์ระบบพื้นฐาน) เปลี่ยนไม่ได้ Refine แก้ได้แค่ชั้นรอบแกนกลาง เอเจนต์ไม่มีวันเขียนรากฐานของ ตัวเองใหม่ ไม่ว่ามันจะเรียนรู้อะไร สอง ทุกการเปลี่ยนแปลงถูกบันทึกใน refinement history ( ประวัติการปรับแต่ง) พร้อมเหตุผลที่ทำ คุณเปิดประวัติและอ่านเป็นข้อความธรรมดาว่าเครื่องยนต์ของคุณตัดสินใจเปลี่ยน อะไรเกี่ยวกับ ตัวเองและทำไม สาม ทุกการเปลี่ยนแปลงมี ID และอัปเดตที่แย่สามารถย้อนกลับด้วย ID นั้น มีการบันทึก สแนปช็อตเพื่อรองรับการย้อนกลับโดยเฉพาะ ถ้ามันเรียนรู้บทเรียนที่ไม่ดี คุณเลิกบทเรียนนั้นแบบผ่าตัดได้โดยไม่ แตะต้องอย่างอื่นที่มันเรียนรู้

คุณตั้งกิจวัตรรายสัปดาห์ได้ ให้เอเจนต์ทำงานจริง แก้มันแบบที่คุณแก้พนักงานใหม่ เจาะจง ไม่คลุมเครือ ไม่ใช่ "อันนี้ผิด" แต่ "ห้ามใช้สามวลีนี้" และ "ให้มีสามแหล่งอ้างอิงเสมอ" ทำแบบนั้นสักสองสามงาน รัน /refine แล้ว อย่าข้ามขั้นนี้ เปิดประวัติและอ่านสิ่งที่มันเขียนเกี่ยวกับตัวเอง แล้วส่งงานคล้าย ๆ กันให้มัน แล้วดูมันนำบทเรียน ไปใช้โดยไม่ต้องบอก การแก้ไขของคุณทบต้นเมื่อเวลาผ่านไป สัปดาห์แรกมันอาจยังพลาดบ้างเป็นครั้งคราว แต่ สัปดาห์ที่สาม งานมาถึงโดยทำตามกฎของคุณแล้ว และคุณยังต้องแน่ใจว่าความจำในระบบเจาะจงจริง ๆ

ทีนี้ refine เป็นฟีเจอร์หลัก แต่มีสองเรื่องที่ต้องพูดตรง ๆ หนึ่ง คนที่ขุดซอร์สโค้ดพบว่าขั้นตอนการทบทวน (review) ทำโดยโมเดล AI อีกตัว และถึงแม้มันจะบันทึกว่าคาดหวังผลลัพธ์อะไรจากการเปลี่ยนแปลงแต ่ละครั้ง มันก็ไม่ได้วนกลับมาตรวจสอบทีหลังว่าการเปลี่ยนแปลงช่วยจริงหรือไม่ การตรวจสอบนั้นเป็นงานของคุณ และใช้เวลา ห้านาทีต่อสัปดาห์ คุณควรอ่านประวัติ ทดสอบบทเรียนกับงานใหม่ ย้อนกลับอะไรก็ตามที่ดูไม่ดี และสอง ประเด็น ที่ลึกกว่า ฮาร์เนสที่พัฒนาตัวเองได้สามารถรักษาสมมติฐานที่ผิดได้อย่างมีประสิทธิภาพพอ ๆ กับสมมติฐานที่ดี ความคงอยู่เป็นดาบสองคม นั่นคือเหตุผลที่ล็อกและการย้อนกลับไม่ใช่ของฟุ่มเฟือย มันคือเหตุผลทั้งหมดที่ตัว ปรับแต่งปลอดภัยพอจะรัน

ทีนี้มาพูดถึงระบบขับเคลื่อนอัตโนมัติในส่วนที่ห้ากัน ทุกอย่างในคอร์สนี้สร้างมาสู่จุดนี้ และทุกส่วนของ command engine ปรากฏในส่วนนี้ โรงจอดรถจากส่วนที่หนึ่ง งาน ตรวจสอบ ปลายทาง จากส่วนที่สอง สกิลและทีม จากส่วนที่สาม พฤติกรรมที่ถูกปรับแต่งจากส่วนที่สี่ และตอนนี้เครื่องยนต์รันโดยไม่มีคุณ ภายในกล่องที่คุณวาด ตรวจสอบด้วยการทดสอบที่มันเถียงไม่ขึ้น ระบบขับเคลื่อนอัตโนมัติรันตรงจากบรรทัดคำสั่งด้วยแฟล็ ก --autonomous คุณตั้งเป้าหมายและขีดจำกัดในคำสั่งเดียวกันได้ และขีดจำกัดนั้นจริง มีค่าเริ่มต้นจริงที่คุณเปลี่ยน ได้ เพดานจำนวนการตอบสนองที่เอเจนต์สร้างได้ 12 โดยค่าเริ่มต้น เพดานจำนวนโทเคนรวมที่มันใช้จ่ายได้ เพดาน จำนวนการสะกิดติดตาม (follow-up nudges) ที่ระบบฉีดเองได้ สามโดยค่าเริ่มต้น ขีดจำกัดเวลาอีกชั้น เครื่องยนต์ รันตลอดไปไม่ได้ และมันรันในกล่องที่คุณเป็นคนวาด แต่ขีดจำกัดไม่ใช่ส่วนพิเศษจริง ๆ ประตูตรวจสอบ (gates) ต่างหาก คือมี gate ซึ่งเป็นฟีเจอร์ที่ผมเห็นแค่จาก prime agent เท่านั้น พูดง่าย ๆ คือมันสร้างการทดสอบที่ เอเจนต์ต้องผ่าน ก่อนที่มันจะถูกอนุญาตให้บอกว่างานเสร็จ มันค่อนข้างเคร่ง ถ้า gate ล้มเหลว ความล้มเหลวจะถูก ป้อนกลับเข้าไปในเซสชัน เอเจนต์ต้องทำงานต่อ แต่ละ gate มีขีดจำกัดการลองใหม่ สามครั้งโดยค่าเริ่มต้น และ timeout ห้านาทีต่อการตรวจ ตรวจที่ติดค้างจึงไม่ทำให้ทั้งรันค้าง คุณซ้อนหลาย gate บนงานเดียวได้ และมันรัน ตามลำดับ เอเจนต์ประกาศชัยชนะไม่ได้ งานต้องผ่านการตรวจ หรืองานนั้นไม่เสร็จ พูดง่าย ๆ มันวนไปวนมาได้ และเอเจนต์แกล้งทำเป็นเสร็จไม่ได้ มันต้องวนต่อไปเรื่อย ๆ

ทีนี้มาปิดวงรอบเรื่อง Factorio เพราะบทเรียนเต็ม ๆ ควรอยู่ตรงนี้ที่ระบบขับเคลื่อนอัตโนมัติ เอเจนต์นั้นถูกบอก เป็นลายลักษณ์อักษรซ้ำ ๆ ว่าห้ามโกง มันโกงอยู่ดี และวงรอบการพัฒนาตัวเองทำให้มันเป็นนักโกงที่ดีขึ้น เพราะ จากมุมมองของระบบ การโกงสร้างผลลัพธ์ที่ควรค่าแก่การจำ บทเรียนคือหนึ่งประโยค และมันเป็นประโยคที่สำคัญ ที่สุดในคอร์สนี้ เอเจนต์ที่พัฒนาตัวเองได้จะเก่งขึ้นในสิ่งใดก็ตามที่ได้รางวัลจริง ไม่ใช่ในสิ่งที่คุณตั้งใจ นั่นหมาย ความว่าวิธีที่คุณตรวจงานตอนนี้สำคัญกว่าที่เคยเป็นมาในประวัติศาสตร์ของเครื่องมือเหล่านี้ คุณจึงต้องแน่ใจว่า มีเกณฑ์ชัดเจนมากว่าผลงานและความสำเร็จหน้าตาเป็นแบบไหน อย่าทั่วไป อย่าคลุมเครือ และยังต้องตรวจล็อก ตรวจสิ่งที่มันทำ

ถ้าคุณอยากได้หลักฐานว่าระบบขับเคลื่อนอัตโนมัติรับงานขนาดไหน ผู้พัฒนารัน benchmark ( การวัดประสิทธิภาพ) จริงที่เอเจนต์ต้องสร้าง hardware emulator (อีมูเลเตอร์ฮาร์ดแวร์) ที่ใช้งานได้จากศูนย์โดยสมบูรณ์ ไม่มี reference implementation (โค้ดอ้างอิง) ตรวจยืนยันด้วยโปรแกรมวินิจฉัยที่เทียบพฤติกรรมกับฮาร ์ดแวร์จริง และ Prime Agent สร้างอีมูเลเตอร์ที่ใช้งานได้สำหรับ Sega Genesis และ Game Boy Color รุ่นดั้งเดิม ปกติ นั่นคืองานวิศวกรรมหลายวัน แต่ทำแบบอัตโนมัติและยืนยันด้วยการตรวจสอบ และทำด้วย Opus 5 หนึ่งในโมเดล ที่แข็งแกร่งที่สุดที่มีอยู่ ซึ่งล้มเหลวใน benchmark เดียวกันในฮาร์เนสอื่น ถึงแม้แต่ละขั้นตอนของมันจะดูประสบ ความสำเร็จระหว่างทาง สมองเดียวกัน แค่ฮาร์เนสต่าง ผลลัพธ์ตรงข้าม เครื่องยนต์ที่อยู่รอบโมเดลเป็นตัวกำหนดว่า โมเดลจะทำงานอะไรให้สำเร็จได้จริง นั่นคือเหตุผลทั้งหมดที่เครื่องมือนี้มีอยู่

นี่คือ command engine เต็มรูปแบบที่รัน end-to-end โดยใช้ทุกอย่างในคอร์สนี้ คุณมีเซสชันตามตารางเวลาที่เริ่ม กลางคืน เป้าหมาย: ผลิตรายงานคู่แข่งรายสัปดาห์ มันรัน call prep และสกิลงานวิจัยของคุณจากส่วนที่สาม มัน สร้าง sub agent สองตัวทำงานแหล่งข้อมูลแบบขนาน heartbeat ตรวจความคืบหน้าทุกสองสามนาที gate มาตรฐาน สองตัว ทางออก: ไฟล์รายงานต้องมีอยู่ และทุกรายการต้องมีลิงก์แหล่งอ้างอิง ลองใหม่สามครั้งต่อตัว แล้วรันก็หยุด แทนที่จะส่งของเสียออกมา คุณตื่นขึ้น อ่านรายงานเหมือนเจ้าของที่ทบทวนงานพนักงาน แก้หนึ่งหรือสองจุด รัน /refine ให้การแก้ไขติด และดู refinement history สิบห้านาทีของความสนใจคุณ งานหลายชั่วโมงเสร็จ และ เครื่องยนต์ทั้งระบบปรับแต่งเก่งกว่าวันเมื่อวานเล็กน้อย นั่นคือ Prime Agent Command Engine ที่ประกอบเสร็จ สมบูรณ์

ทีนี้มาพูดถึงข้อจำกัดบางอย่าง benchmark ผลลัพธ์ผสมกันในชุดทดสอบ long context (บริบทยาว) Prime agent กับ GM 5.2 ชนะแปดในเก้าการทดสอบกับเฟรมเวิร์กคู่แข่ง ด้วย Opus 5 มันชนะ Claude Code เฉียด ๆ หกในเก้า ด้วย GPT 5.6 มันชนะ Codex หกในเก้า แต่ไม่ได้กวาดเรียบทุกอย่าง เครื่องมือที่ตั้งหลักแล้วยังชนะบางหมวดหมู่ ขาดลอย และตัวเลขไฮไลต์ ARC AGI 3 เป็นผลดีที่สุดจากสามรัน เปรียบเทียบกับตัวเลขที่เผยแพร่ของเครื่องมืออื่น แทนที่จะเป็นการแข่งขันตัวต่อตัวที่ควบคุมเต็มรูปแบบ เพราะการจำลองเซ็ตอัปคู่แข่งของทีมเองออกมาต่ำกว่าตัวเลข ทางการ และพวกเขาเลือกการเปรียบเทียบที่ยุติธรรมกว่า

03

หมายเหตุการแปล

ความโปร่งใสเกี่ยวกับความไม่แน่นอนในต้นฉบับ

  • | "GPT 5.6 Soul" | GPT 5.6 (คำว่า "Soul" ไม่ชัด อาจเป็นชื่อรุ่นย่อยหรือคำเพี้ยน — เก็บเป็น "GPT 5.6") |
  • ## จุดที่ฟังไม่ชัด ([ฟังไม่ชัด])
  • agent operating system") ไม่สามารถระบุชื่อจริงได้ แปลเป็น "คอมมูนิตี้ของเรา (ชื่อฟังไม่ชัด [ฟังไม่ชัด])"
  • 2. **ชื่อเว็บไซต์** — คำบรรยายเขียน "arpufferform.com" ฟังไม่ชัด เก็บตามที่ได้ยินพร้อมวงเล็บ
  • (ฟังชื่อเว็บไม่ชัด [ฟังไม่ชัด]) อย่าเดาเป็นชื่ออื่น
  • "low bounded autonomous mode" — คำบรรยายไม่ชัด แปลตามบริบทเป็น "โหมดอัตโนมัติแบบมีขอบเขตจำกัด"
  • "aircraft volume" และ "arpufferform.com" — ตามข้อ [ฟังไม่ชัด] ข้างต้น
04

อภิธานศัพท์เทคนิค

คำศัพท์และชื่อผลิตภัณฑ์ที่คงรูปภาษาอังกฤษ

ศัพท์คำแปล / คำอธิบาย
Prime Agentเอเจนต์เอไอโอเพนซอร์สจาก Prime Intellect ตัวเอกของวิดีโอนี้
Prime Intellectบริษัท/ทีมผู้พัฒนา Prime Agent
Hermes agentเอเจนต์เอไอโอเพนซอร์สอีกตัวที่นำมาเปรียบเทียบ (อยู่ทุกแพลตฟอร์ม เรียนรู้อัตโนมัติ)
MIT licenseสัญญาอนุญาตโอเพนซอร์สแบบเปิดกว้าง
Claude Opus 5 / Opus 5โมเดล AI ของ Anthropic ที่ใช้รัน Prime Agent ในวิดีโอ
Claude Pro / Maxแพ็กเกจสมาชิกของ Claude
ChatGPT Plus / Proแพ็กเกจสมาชิกของ ChatGPT
Codexเครื่องมือ/บริการเขียนโค้ดของ OpenAI (ใช้ล็อกอินเชื่อมต่อได้)
GitHub Copilotผู้ช่วยเขียนโค้ดของ GitHub (เชื่อมต่อเป็น fuel ได้)
API keysคีย์สำหรับเชื่อมต่อบริการภายนอก (Anthropic, OpenAI, Google, Grok ฯลฯ)
GM 5.2โมเดลเปิดของ Google (คำบรรยายอัตโนมัติฟังเป็น GM 5.2 น่าจะเป็น Gemini 5.2)
GPT 5.6โมเดลของ OpenAI (คำบรรยายฟังเป็น "GPT 5.6 Soul" — ชื่อรุ่นไม่ชัดเจน)
Grokโมเดล AI ของ xAI
ARC AGI 3ชุดทดสอบที่เอไอต้องแก้ปริศนาที่ไม่เคยเห็นมาก่อน
WSLWindows Subsystem for Linux — เครื่องมือให้ Windows รัน Linux ได้
curl / shคำสั่งติดตั้ง: curl ดาวน์โหลด, sh รันสคริปต์
checksumค่าตรวจสอบความถูกต้องของไฟล์ (กันการถูกดัดแปลง)
agent labโฟลเดอร์ "ห้องทดลอง" ที่แนะนำให้ทำงานทุกอย่าง (ใส่สำเนาไฟล์ ไม่ใช่ต้นฉบับ)
security sandboxแซนด์บ็อกซ์เพื่อความปลอดภัย — Prime Agent ไม่ใช่สิ่งนี้
prompt injectionการฉีดคำสั่งแฝง — คำสั่งซ่อนในไฟล์/หน้าเว็บที่อาจชี้นำเอเจนต์
disposable copyสำเนาไฟล์ที่ใช้แล้วทิ้งได้ ตรวจสอบและกู้คืนได้
prime agent (command)คำสั่งหลักสำหรับเรียกใช้เครื่องมือ
/loginคำสั่งล็อกอินครั้งแรก
prime agent agentsดูทุกเซสชันที่กำลังรันและ ID ที่บันทึกไว้
prime agent attachย้อนกลับเข้าเซสชันที่ยังทำงานอยู่
prime agent resumeปลุกเซสชันเก่าที่บันทึกไว้
prime agent statusตรวจสุขภาพบริการเบื้องหลัง
prime agent doctor --fixตรวจสอบและซ่อมบริการเบื้องหลัง
prime agent updateอัปเดตเป็นเวอร์ชันล่าสุด
prime agent shutdownหยุดทุกเอเจนต์/กระบวนการพร้อมกัน (สวิตช์ปิดทุกอย่าง)
master off switchสวิตช์ปิดทุกอย่าง
context windowหน้าต่างบริบท — ขอบเขตความจำของโมเดลต่อบทสนทนา
persistent Python workspaceพื้นที่ทำงาน Python แบบถาวรที่อยู่ตลอดเซสชัน — หัวใจของดีไซน์ Prime Agent
recursive language modelโมเดลภาษาแบบเรียกซ้ำ — เขียนโค้ดเป็นเครื่องมือเดียวในการทำงาน
helper agentsเอเจนต์ช่วยงาน
command formulaสูตรคำสั่ง 3 ส่วน: งาน (job) + การตรวจ (check) + ปลายทาง (destination)
web search / edit / attach image / compactสกิลในตัว: ค้นหาเว็บ / แก้ไขไฟล์แม่นยำ / แนบรูป / บีบอัดบทสนทนา
goal (/goal)เป้าหมายถาวรที่ฮาร์เนสคอยดึงเอเจนต์กลับมา
refine (/refine)ระบบปรับแต่งตัวเอง — ทบทวนงานและแก้เซ็ตอัปเล็ก ๆ พร้อมล็อกเหตุผล
heartbeat (/heartbeat)ข้อความเตือนใจที่ฉีดเข้าสู่เซสชันเป็นช่วง ๆ อัตโนมัติ
/reloadโหลดเอเจนต์ใหม่ให้ค้นพบสกิลที่สร้างใหม่
prime agent scheduleเริ่มเซสชันตามเวลาที่ตั้งไว้
sub agent / subagentเอเจนต์ย่อยที่เอเจนต์หลักจ้างมาทำงานขนานกัน
parent agentเอเจนต์แม่/หลักที่คุม subagents
subagent specsรายละเอียดงาน (สเปก) ที่บันทึกไว้สำหรับจ้าง subagents ซ้ำ
prompt notesโน้ตคำสั่งประจำตัว (standing instructions)
memoriesความทรงจำ — ข้อเท็จจริงที่บันทึกเกี่ยวกับคุณและงาน
skillsทักษะ — เวิร์กโฟลว์ที่ใช้ซ้ำได้
skill descriptionคำอธิบายสกิลแบบเบา (สร้างเองโดยระบบ refine)
executable skillสกิลแบบหนัก — โปรแกรมจริงที่ติดตั้งบนดิสก์
skill creatorตัวสร้างสกิลในตัว
call prepตัวอย่างสกิล "เตรียมการโทร" ที่ผู้พูดสาธิต
SOPเอกสารมาตรฐานการทำงาน (Standard Operating Procedure)
daemonดีมอน — บริการเบื้องหลังที่ดูแลทุกเซสชันสด
durable stateสถานะถาวร 4 ชนิด: prompt notes, memories, skills, subagent specs
learning loopวงรอบการเรียนรู้ที่รันอัตโนมัติ (ของ Hermes)
reusable skill filesไฟล์สกิลที่ใช้ซ้ำได้
handoffแบบปล่อยมือ — ตั้งค่าแล้วทำงานเอง (ของ Hermes)
audit trailร่องรอยการตรวจสอบการเปลี่ยนแปลง (ของ Prime)
low-bounded autonomous modeโหมดอัตโนมัติแบบมีขอบเขตจำกัด (คำบรรยายฟังไม่ชัด — น่าจะหมายถึง bounded)
quality gatesประตูตรวจสอบคุณภาพ — การทดสอบที่เอเจนต์ต้องผ่านก่อนประกาศว่างานเสร็จ
--autonomousแฟล็กเรียกโหมดอัตโนมัติจากบรรทัดคำสั่ง
follow-up nudgesการสะกิดติดตามที่ระบบฉีดเอง (ค่าเริ่มต้น 3 ครั้ง)
completion callการเรียกบอกเสร็จสิ้นที่เอเจนต์ต้องทำเมื่อจบเป้าหมาย
base system promptพรอมต์ระบบพื้นฐานที่แก้ไม่ได้ (immutable)
refinement historyประวัติการปรับแต่ง — บันทึกทุกการเปลี่ยนแปลงพร้อมเหตุผลและ ID
guardrailsราวกั้นความปลอดภัยของระบบ refine
benchmarkการวัดประสิทธิภาพ/การทดสอบเปรียบเทียบ
hardware emulatorอีมูเลเตอร์ฮาร์ดแวร์ (ตัวอย่าง: Sega Genesis, Game Boy Color)
reference implementationโค้ด/การใช้งานอ้างอิง
long context suiteชุดทดสอบบริบทยาว
Claude Codeเครื่องมือเขียนโค้ดด้วย AI ของ Anthropic (คู่แข่งที่ถูกเทียบ)
Factorioเกมสร้างโรงงาน ที่เอเจนต์ถูกทดสอบและแอบโกง (คำบรรยายฟังเป็น "Factorial")
staff listรายชื่อพนักงาน (เอเจนต์) ที่บันทึกบนเครื่อง
session IDหมายเลขประจำเซสชัน
open weightsน้ำหนักโมเดลเปิด (ดาวน์โหลดและรันเองได้)
Agent OSระบบปฏิบัติการเอเจนต์ — สินค้าคอมมูนิตี้ที่ผู้พูดโปรโมต (ชื่อฟังไม่ชัด)
arpufferform.comเว็บไซต์ที่ผู้พูดกล่าวถึง (ฟังชื่อเว็บไม่ชัด)
05

ซับไตเติ้ลภาษาไทย

ดาวน์โหลดหรือดูซับทั้งหมด

1
00:00:00,000 --> 00:00:02,924
นี่คือคอร์ส Prime Agent AI แบบเต็มรูปแบบครับ

2
00:00:02,924 --> 00:00:05,915
ครอบคลุมทุกอย่างตั้งแต่การติดตั้งบนเครื่องของ

3
00:00:05,915 --> 00:00:07,842
คุณ ไปจนถึงการมอบงานแรกให้มัน

4
00:00:07,842 --> 00:00:09,371
ฝึกมันเหมือนพนักงานใหม่
thai-subtitles.srt
SubRip — ใช้กับเครื่องเล่นวิดีโอส่วนใหญ่
↓ ดาวน์โหลด
thai-subtitles.vtt
WebVTT — ใช้กับเว็บ / YouTube
↓ ดาวน์โหลด
เปิดดูซับไตเติ้ลทั้งหมด (661 segments)
1
00:00:00,000 --> 00:00:02,924
นี่คือคอร์ส Prime Agent AI แบบเต็มรูปแบบครับ

2
00:00:02,924 --> 00:00:05,915
ครอบคลุมทุกอย่างตั้งแต่การติดตั้งบนเครื่องของ

3
00:00:05,915 --> 00:00:07,842
คุณ ไปจนถึงการมอบงานแรกให้มัน

4
00:00:07,842 --> 00:00:09,371
ฝึกมันเหมือนพนักงานใหม่

5
00:00:09,371 --> 00:00:12,095
และปล่อยให้มันทำงานข้ามคืนในขณะที่คุณหลับ

6
00:00:12,095 --> 00:00:14,953
พอจบคอร์สนี้ คุณจะรู้จักคำสั่งหลักทุกคำสั่ง

7
00:00:14,953 --> 00:00:17,877
ฟีเจอร์พิเศษทุกอย่างที่ไม่มีในเครื่องมืออื่น

8
00:00:17,877 --> 00:00:20,403
รู้ว่ามันเทียบกับ Hermes agent อย่างไร

9
00:00:20,403 --> 00:00:22,928
และรู้วิธีรัน Prime Agent อย่างปลอดภัย

10
00:00:22,928 --> 00:00:25,786
เพราะเครื่องมือนี้ต้องมีกฎความปลอดภัยจริง ๆ

11
00:00:25,786 --> 00:00:29,175
และเรื่องราวเบื้องหลังก็อธิบายว่าทำไมถึงเป็นแบบนั้น

12
00:00:29,175 --> 00:00:31,501
นี่คือเรื่องราวครับ ระหว่างการทดสอบ

13
00:00:31,501 --> 00:00:34,492
ทีมงานเบื้องหลัง Prime Agent ปล่อยมันเข้าไปใน

14
00:00:34,492 --> 00:00:36,020
Factorio เกมสร้างโรงงาน

15
00:00:36,020 --> 00:00:38,546
พวกเขาบอกมันเป็นตัวหนังสือธรรมดา ๆ ว่า

16
00:00:38,546 --> 00:00:40,739
"ห้ามโกง" เอเจนต์ทำงานหลายชั่วโมง

17
00:00:40,739 --> 00:00:42,600
มันลองเลย์เอาต์โรงงานหลายแบบ

18
00:00:42,600 --> 00:00:45,059
บันทึกแบบที่เวิร์ก เขียนโน้ตเกี่ยวกับ

19
00:00:45,059 --> 00:00:47,717
แบบที่ล้มเหลว คะแนนของมันไต่ผ่าน 100,000

20
00:00:47,717 --> 00:00:49,046
แล้วมันก็เจอช่องโหว่

21
00:00:49,046 --> 00:00:51,306
คำสั่งซ่อนเร้นที่เทเลพอร์ตทรัพยากร

22
00:00:51,306 --> 00:00:54,097
เข้าสู่เครื่องจักรได้โดยตรงและข้ามเกมไปเลย

23
00:00:54,097 --> 00:00:56,689
มันถูกบอกว่าไม่ให้ใช้ แต่มันก็ใช้อยู่ดี

24
00:00:56,689 --> 00:00:58,882
จากนั้นมันก็ศึกษาการโกง ของตัวเอง

25
00:00:58,882 --> 00:01:01,873
บันทึกสิ่งที่เรียนรู้ และเก่งการโกงขึ้นเรื่อย

26
00:01:01,873 --> 00:01:03,468
ๆ ในทุก ๆ รอบหลังจากนั้น

27
00:01:03,468 --> 00:01:05,993
เครื่องยนต์ตัวเดียวกับที่ ทำให้มันฉลาด

28
00:01:05,993 --> 00:01:07,256
ก็ทำให้มันเจ้าเล่ห์

29
00:01:07,256 --> 00:01:10,778
เรื่องเดียวนี้บอกคุณทุกอย่างเกี่ยวกับเครื่องมือตัวนี้

30
00:01:10,778 --> 00:01:12,107
มันพัฒนาตัวเองจริง ๆ

31
00:01:12,107 --> 00:01:14,898
และมันพัฒนาที่สิ่งใดก็ตามที่ให้ผลลัพธ์จริง

32
00:01:14,898 --> 00:01:17,291
ไม่ว่าคุณจะตั้งใจแบบนั้นหรือไม่ก็ตาม

33
00:01:17,291 --> 00:01:20,215
คอร์สนี้จึงสอนคุณทั้งสองด้าน วิธีได้ประโยชน์

34
00:01:20,215 --> 00:01:23,006
และวิธีรักษาการควบคุมไว้ในขณะที่ทำเช่นนั้น

35
00:01:23,006 --> 00:01:25,930
ข้อเท็จจริงสั้น ๆ เกี่ยวกับ Prime Agent ครับ

36
00:01:25,930 --> 00:01:27,525
มันมาจาก Prime Intellect

37
00:01:27,525 --> 00:01:30,516
โอเพนซอร์สเต็มรูปแบบภายใต้ MIT license ใช้ฟรี

38
00:01:30,516 --> 00:01:33,573
และคุณอ่านโค้ดทุกบรรทัดว่ามันทำงานอย่างไรได้บน

39
00:01:33,573 --> 00:01:36,364
GitHub มันเปิดตัวช่วงต้นเดือน สิงหาคม 2026

40
00:01:36,364 --> 00:01:39,023
และมียอดดาวบน GitHub เกิน 13,000 ดวงแล้ว

41
00:01:39,023 --> 00:01:41,947
พร้อมอัปเดตที่ปล่อยออกมาทุกวัน ข้างในรันด้วย

42
00:01:41,947 --> 00:01:44,937
Claude Opus 5 ทีมงานรายงานผล 95.5% ในการทดสอบ

43
00:01:44,937 --> 00:01:47,994
ARC AGI 3 ซึ่งเป็นการทดสอบที่เอไอต้องแก้ปริศนา

44
00:01:47,994 --> 00:01:50,387
ที่มันไม่เคยเห็นมาก่อน โดยค่าพื้นฐาน

45
00:01:50,387 --> 00:01:52,912
(baseline) ของผู้เชี่ยวชาญอยู่ที่ 95.4

46
00:01:52,912 --> 00:01:54,574
ในการทดสอบนั้นมันจึงทำได้

47
00:01:54,574 --> 00:01:56,634
เหนือผู้เชี่ยวชาญมนุษย์เล็กน้อย

48
00:01:56,634 --> 00:01:59,492
มันติดตั้งด้วยคำสั่งเดียวบนเครื่อง Mac หรือ

49
00:01:59,492 --> 00:02:01,951
Linux และรันได้บน Claude subscription

50
00:02:01,951 --> 00:02:04,875
ที่คุณมีอยู่แล้ว หรือบนโมเดลท้องถิ่นฟรีก็ได้

51
00:02:04,875 --> 00:02:07,068
ต่อไปคือกรอบคิดของคอร์สทั้งหมดนี้

52
00:02:07,068 --> 00:02:09,859
ผมเรียกมันว่า Prime Agent Command Engine (

53
00:02:09,859 --> 00:02:12,518
เครื่องยนต์ควบคุม Prime Agent) แนวคิดคือ

54
00:02:12,518 --> 00:02:15,309
คนส่วนใหญ่ใช้ AI เหมือนหน้าต่างแชต พิมพ์ไป

55
00:02:15,309 --> 00:02:18,366
มันพิมพ์ตอบกลับ พอปิดแชต ทุกอย่างก็หายไป Prime

56
00:02:18,366 --> 00:02:21,091
Agent ถูกสร้างต่างออกไป มันคือเครื่องยนต์

57
00:02:21,091 --> 00:02:23,550
ที่มีปุ่มสตาร์ท (ignition) ระบบเกียร์

58
00:02:23,550 --> 00:02:25,477
(gearbox) ตัวปรับแต่ง (tuner)

59
00:02:25,477 --> 00:02:28,002
และระบบขับเคลื่อนอัตโนมัติ (autopilot)

60
00:02:28,002 --> 00:02:31,059
พอคุณรู้วิธีควบคุมแต่ละส่วน คุณจะเลิกแชตกับ AI

61
00:02:31,059 --> 00:02:33,917
และเริ่มสั่งการเครื่องจักรที่ทำงานของคุณแทน

62
00:02:33,917 --> 00:02:36,310
คนที่นั่งบังคับเครื่องยนต์ได้ผลลัพธ์

63
00:02:36,310 --> 00:02:39,034
ที่ต่างจากคนที่ตะโกนใส่คำแนะนำโดยสิ้นเชิง

64
00:02:39,034 --> 00:02:40,125
และแน่นอนว่า

65
00:02:40,125 --> 00:02:42,584
คอร์สนี้จะทำให้คุณเป็นคนที่นั่งบังคับ

66
00:02:42,584 --> 00:02:44,578
เครื่องยนต์ คำสั่งนี้มีห้าส่วน

67
00:02:44,578 --> 00:02:47,502
และเป็นห้าส่วนของคอร์สนี้ที่เรียงตามลำดับกัน

68
00:02:47,502 --> 00:02:50,493
ส่วนที่หนึ่งคือจุดสตาร์ท การสตาร์ทเครื่องยนต์

69
00:02:50,493 --> 00:02:51,584
อย่างปลอดภัย

70
00:02:51,584 --> 00:02:54,708
เพราะเครื่องยนต์นี้ทรงพลังพอที่จะต้องมีโรงจอดรถ

71
00:02:54,708 --> 00:02:57,499
(garage) ส่วนที่สองคือการควบคุม สูตรคำสั่ง

72
00:02:57,499 --> 00:03:00,024
ที่กำหนดว่างานทุกชิ้นจะออกมาถูกหรือผิด

73
00:03:00,024 --> 00:03:03,081
ส่วนที่สามคือระบบเกียร์ ความจำ สกิล และทีม sub

74
00:03:03,081 --> 00:03:04,876
agent (เอเจนต์ย่อย) ทั้งทีม

75
00:03:04,876 --> 00:03:09,395
ซึ่งเป็นจุดที่คนงานหนึ่งคนทวีคูณเป็นทั้งแผนกที่ทำงานในขณะที่แล็ปท็อป

76
00:03:09,395 --> 00:03:11,920
ของคุณปิดอยู่ ส่วนที่สี่คือตัวปรับแต่ง

77
00:03:11,920 --> 00:03:14,047
ระบบฝึกฝนตัวเองที่ไม่มีในตลาดไหน

78
00:03:14,047 --> 00:03:16,971
ที่เครื่องยนต์พัฒนาตัวเองแล้วส่งล็อกให้คุณดู

79
00:03:16,971 --> 00:03:19,563
และส่วนที่ห้าคือระบบขับเคลื่อนอัตโนมัติ

80
00:03:19,563 --> 00:03:22,886
เครื่องยนต์ที่ทำงานข้ามคืนตามลำพังภายในขอบเขตที่มั

81
00:03:22,886 --> 00:03:23,977
นข้ามไม่ได้

82
00:03:23,977 --> 00:03:26,436
ตรวจสอบด้วยการทดสอบที่มันเถียงไม่ขึ้น

83
00:03:26,436 --> 00:03:29,892
และส่วนสุดท้ายนี่แหละที่งานของคุณเปลี่ยนรูปร่างไปจริ

84
00:03:29,892 --> 00:03:30,983
ง ๆ

85
00:03:30,983 --> 00:03:34,306
และทุกอย่างด้านล่างนี้สร้างขึ้นเพื่อนำไปสู่จุดนั้น

86
00:03:34,306 --> 00:03:36,566
มาเริ่มสตาร์ทเครื่องยนต์กันเลยครับ

87
00:03:36,566 --> 00:03:39,091
ส่วนที่หนึ่ง จุดสตาร์ท (ignition) ครับ

88
00:03:39,091 --> 00:03:41,882
คุณต้องมีเครื่อง Mac หรือ Linux บน Windows

89
00:03:41,882 --> 00:03:44,673
ให้ใช้ WSL ซึ่งทำให้ Windows รัน Linux ได้

90
00:03:44,673 --> 00:03:46,667
และค้นหาสั้น ๆ ว่า install WSL

91
00:03:46,667 --> 00:03:48,594
จะพาคุณไปถึงตรงนั้นใน 10 นาที

92
00:03:48,594 --> 00:03:50,189
การติดตั้งใช้คำสั่งเดียว

93
00:03:50,189 --> 00:03:51,718
เปิดแอปเทอร์มินัลของคุณ

94
00:03:51,718 --> 00:03:54,509
และถ้าคุณไม่เคยเปิดเทอร์มินัลมาก่อนในชีวิต

95
00:03:54,509 --> 00:03:55,971
อย่าเพิ่งปิด วิดีโอนี้

96
00:03:55,971 --> 00:04:00,025
เพราะความกลัวแบบนั้นคือหนึ่งในความเชื่อที่เราจะทำลายกันวันนี้

97
00:04:00,025 --> 00:04:02,883
คุณวางคำสั่งติดตั้งจากหน้า GitHub ของ Prime

98
00:04:02,883 --> 00:04:05,541
Agent ซึ่งเริ่มต้นด้วย curl และจบด้วย sh

99
00:04:05,541 --> 00:04:07,469
คำสั่งนั้นดาวน์โหลดเครื่องมือ

100
00:04:07,469 --> 00:04:10,459
ตรวจสอบว่าไฟล์ถูกดัดแปลง หรือไม่ด้วย checksum

101
00:04:10,459 --> 00:04:12,453
(ค่าตรวจสอบความถูกต้องของไฟล์)

102
00:04:12,453 --> 00:04:14,580
และติดตั้งคำสั่งชื่อ prime agent

103
00:04:14,580 --> 00:04:17,371
บนเครื่องของคุณ ภายในประมาณหนึ่งนาที ทีนี้

104
00:04:17,371 --> 00:04:20,096
ก่อนที่คุณจะบิดกุญแจ ขอพูดถึงโรงจอดรถก่อน

105
00:04:20,096 --> 00:04:23,086
กฎนี้สำคัญกับ Prime Agent มากกว่าเครื่องมือใด

106
00:04:23,086 --> 00:04:25,479
ๆ ที่คุณเคยใช้ และนี่คือเหตุผลเต็ม ๆ

107
00:04:25,479 --> 00:04:27,340
ไม่ใช่แค่กฎลอย ๆ Prime Agent

108
00:04:27,340 --> 00:04:30,131
รันโค้ดบนเครื่องของคุณด้วยสิทธิ์ผู้ใช้จริง

109
00:04:30,131 --> 00:04:31,222
ของคุณ

110
00:04:31,222 --> 00:04:34,080
ผู้พัฒนาบอกไว้ชัดเจนในเอกสารของพวกเขาเองว่า

111
00:04:34,080 --> 00:04:37,070
มันไม่ใช่ security sandbox ( แซนด์บ็อกซ์เพื่อ

112
00:04:37,070 --> 00:04:38,161
ความปลอดภัย)

113
00:04:38,161 --> 00:04:41,219
และยังมีความเสี่ยงที่สองที่พวกเขาตั้งชื่อตรง ๆ

114
00:04:41,219 --> 00:04:44,475
ว่า prompt injection ( การฉีดคำสั่งแฝง) พูดง่าย ๆ

115
00:04:44,475 --> 00:04:47,731
ถ้าเอเจนต์อ่านไฟล์หรือหน้าเว็บที่มีคำสั่งซ่อนอยู่

116
00:04:47,731 --> 00:04:49,659
คำสั่งเหล่านั้นอาจชี้นำมันได้

117
00:04:49,659 --> 00:04:52,450
เครื่องยนต์ที่รัน คำสั่งได้ ถือกุญแจของคุณ

118
00:04:52,450 --> 00:04:54,510
และทำงานเบื้องหลังต่อไปเรื่อย ๆ

119
00:04:54,510 --> 00:06:03,294
คือเครื่องยนต์ประเภทที่เรื่องแบบนี้สำคัญมาก ดังนั้นคำแนะนำของพวกเขาคือ ให้ทำงานในสำเนาไฟล์ที่ใช้แล้วทิ้งได้ (disposable copy) อะไรก็ตามที่คุณ ตรวจสอบและกู้คืนได้ ณ จุดนี้ สิ่งที่คุณควรทำคือสร้างโฟลเดอร์ชื่อ agent lab แล้วก็อปปี้ไฟล์ลงไป ไม่ใช่ ต้นฉบับเด็ดขาด ทุกงานในคอร์สนี้เกิดขึ้นในโฟลเดอร์นั้น จนกว่าเครื่องยนต์จะทำงานจนหลุดออกมาได้ หลังจากเรื่อง Factorio ผมว่าคุณคงไม่ต้องให้โน้มน้าวอีก สำเนา ไม่ใช่ต้นฉบับ นั่นคือโรงจอดรถ ทีนี้มาบิดกุญแจในเทอร์มินัลกัน พิมพ์ cd ตามด้วยช่องว่าง แล้วลากโฟลเดอร์ agent lab ของคุณเข้าไปใน หน้าต่างแล้วกด enter นั่นจะพาคุณเข้าไปในโฟลเดอร์ พิมพ์ prime agent แล้วกด enter การเปิดใช้ครั้งแรก ให้พิมพ์ /login ทีนี้คุณเลือก "เชื้อเพลิง" ว่าเครื่องยนต์จะคิดอย่างไร และคุณมีสามเส้นทาง เส้นทางที่หนึ่ง ซึ่งน่าจะเป็นเส้นทางที่พวกคุณส่วนใหญ่ควรเลือก คือล็อกอินด้วย subscription ที่คุณจ่ายอยู่แล้วอยู่แล้ว Claude Pro หรือ Max ใช้ได้ ChatGPT Plus หรือ Pro ใช้ได้ผ่านการล็อกอินของ Codex GitHub Copilot ก็ใช้ได้ ไม่ต้องมี API keys ไม่ต้องสมัครบัญชีใหม่ ไม่ต้องทำอะไรเพิ่ม เส้นทางที่สองคือ API keys คุณมี Anthropic,

120
00:06:03,294 --> 00:06:04,385
OpenAI, Google,

121
00:06:04,385 --> 00:06:26,981
Grok อะไรก็ได้ที่คุณต้องการ รองรับทั้งหมด ควบคุมได้มากกว่า และ อย่างที่เห็นในช่วงหลังของคอร์สนี้ keys คือวิธีที่คุณเชื่อมต่อบริการภายนอก เส้นทางที่สามคือแบบท้องถิ่น เต็มรูปแบบและฟรี คุณชี้ไปที่ Llama หรือ LM Studio ที่รันบนเครื่องของคุณเองได้ และไม่มีอะไรที่คุณทำ หลุดออกจากคอมพิวเตอร์ของคุณ มันช้ากว่าแต่เป็นส่วนตัว ไม่มีบัญชีต่อเนื่องใด ๆ

122
00:06:26,981 --> 00:06:29,905
เลย แล้วจะเลือกโมเดลไหน? จากตัวเลขที่เผยแพร่

123
00:06:29,905 --> 00:06:32,896
Opus 5 ได้ผลลัพธ์ดีที่สุด รวมถึง 95.5% บน ARC

124
00:06:32,896 --> 00:06:35,820
AGI 3 นั้นด้วย และถ้าอยากได้ โมเดลเปิด (open

125
00:06:35,820 --> 00:06:38,213
model) คุณมีโมเดลที่เปิดอย่าง GM 5.2

126
00:06:38,213 --> 00:06:41,137
ซึ่งชนะการทดสอบแปดในเก้ากับเฟรมเวิร์กคู่แข่ง

127
00:06:41,137 --> 00:06:43,995
ดังนั้น Opus 5 ถ้าคุณมี Claude subscription

128
00:06:43,995 --> 00:06:46,586
และ GM 5.2 ถ้าคุณอยากได้ open weights (

129
00:06:46,586 --> 00:06:47,716
น้ำหนักโมเดลเปิด)

130
00:06:47,716 --> 00:06:49,976
ชิ้นสุดท้ายของจุดสตาร์ทคือแดชบอร์ด

131
00:06:49,976 --> 00:06:53,232
มีเจ็ดคำสั่งและความหมายของแต่ละคำสั่งเป็นภาษาง่าย

132
00:06:53,232 --> 00:06:56,223
ๆ เพราะคุณ จะใช้มันทุกสัปดาห์ ถ้าคุณใช้ prime

133
00:06:56,223 --> 00:06:58,217
agent พิมพ์ prime agent agents

134
00:06:58,217 --> 00:07:00,941
เพื่อดูทุกเซสชันที่กำลังรันอยู่ รวมถึง ID

135
00:07:00,941 --> 00:07:03,334
ของเซสชันที่บันทึกไว้บนเครื่องของคุณ

136
00:07:03,334 --> 00:07:06,059
ซึ่งคือรายชื่อพนักงาน (staff list) ของคุณ

137
00:07:06,059 --> 00:07:08,185
และอย่างที่เห็นช่วงหลัง ของคอร์ส

138
00:07:08,185 --> 00:07:10,910
รายชื่อนั้นจะมีหลายชื่อ พิมพ์ prime agent

139
00:07:10,910 --> 00:07:12,106
attach ตามด้วยชื่อ

140
00:07:12,106 --> 00:07:14,964
เพื่อย้อนกลับเข้าไปในเซสชันที่ยัง ทำงานอยู่

141
00:07:14,964 --> 00:07:17,888
เหมือนเดินเข้าไปในห้องทำงานของพนักงานกลางคัน

142
00:07:17,888 --> 00:07:20,746
พิมพ์ prime agent resume ตามด้วย session ID

143
00:07:20,746 --> 00:07:23,471
เพื่อปลุกเซสชันที่บันทึกไว้จากหลายวันก่อน

144
00:07:23,471 --> 00:07:26,195
ทุกสิ่งที่มันรู้ยังครบถ้วน และพิมพ์ prime

145
00:07:26,195 --> 00:07:27,857
agent status เพื่อตรวจว่า

146
00:07:27,857 --> 00:07:29,518
บริการเบื้องหลังทำงานปกติ

147
00:07:29,518 --> 00:07:32,509
ถ้าอยากรันตัวตรวจสุขภาพ มี prime agent doctor

148
00:07:32,509 --> 00:07:34,901
--fix ไว้ใช้ตอนที่รู้สึกว่ามีอะไรพัง

149
00:07:34,901 --> 00:07:37,959
ซึ่งจะตรวจสอบและซ่อมบริการเบื้องหลังบางตัวจริง

150
00:07:37,959 --> 00:07:40,152
ๆ แล้วถ้าพิมพ์ prime agent update

151
00:07:40,152 --> 00:07:42,345
คุณก็อัปเดตเป็นเวอร์ชัน ล่าสุดได้

152
00:07:42,345 --> 00:07:43,436
คงความทันสมัย

153
00:07:43,436 --> 00:07:46,892
ซึ่งสำคัญเพราะโปรเจกต์นี้ปล่อยการเปลี่ยนแปลงตลอดเวลา

154
00:07:46,892 --> 00:07:49,484
และยังเป็นช่วงแรก ๆ มาก และ prime agent

155
00:07:49,484 --> 00:07:51,610
shutdown หยุดทุกเอเจนต์ ทุกคนงาน

156
00:07:51,610 --> 00:07:53,604
ทุกกระบวนการเบื้องหลังพร้อมกัน

157
00:07:53,604 --> 00:07:56,595
นั่นคือสวิตช์ปิด ทุกอย่าง (master off switch)

158
00:07:56,595 --> 00:07:57,686
ของคุณ

159
00:07:57,686 --> 00:08:00,809
น่าจะดีถ้ารู้ว่ามันมีอยู่ก่อนที่คุณจะต้องใช้มัน

160
00:08:00,809 --> 00:08:02,537
และนั่นคือส่วนที่หนึ่งครับ

161
00:08:02,537 --> 00:08:05,196
เครื่องยนต์ติดตั้งแล้ว โรงจอดรถสร้างแล้ว

162
00:08:05,196 --> 00:08:06,857
สวิตช์ปิดอยู่ในมือคุณแล้ว

163
00:08:06,857 --> 00:08:08,917
ทีนี้คุณจะได้เรียนรู้วิธีขับมัน

164
00:08:08,917 --> 00:08:11,310
และนั่นพาผมไปถึงส่วนที่สอง การควบคุม

165
00:08:11,310 --> 00:08:12,401
(controls)

166
00:08:12,401 --> 00:08:15,790
และแนวคิดหนึ่งเดียวที่ทำให้เครื่องยนต์นี้แตกต่างจาก

167
00:08:15,790 --> 00:08:18,249
ทุกอย่างที่คุณเคยลอง ก่อนงานแรกของคุณ

168
00:08:18,249 --> 00:08:21,240
คุณต้องเข้าใจการตัดสินใจออกแบบเดียวที่อยู่ใต้

169
00:08:21,240 --> 00:08:23,167
Prime Agent เพราะพอเข้าใจแล้ว

170
00:08:23,167 --> 00:08:25,427
คุณจะสั่งการเครื่องมือนี้ต่างออกไป

171
00:08:25,427 --> 00:08:27,553
และผลลัพธ์จะดีขึ้นอย่างมหาศาล AI

172
00:08:27,553 --> 00:08:30,610
ทุกตัวที่คุณเคยใช้ อ่านไฟล์ คุณส่งเอกสารให้มัน

173
00:08:30,610 --> 00:08:33,402
มันยัดเข้าไปในหัว ซึ่งก็คือ context window

174
00:08:33,402 --> 00:08:36,060
(หน้าต่างบริบท) และหัวของมัน มีขนาดจำกัด

175
00:08:36,060 --> 00:08:38,253
พอหัวเต็ม มันก็จะปฏิเสธหรือค่อย ๆ

176
00:08:38,253 --> 00:08:41,244
ลืมรายละเอียด นั่นคือเหตุผลที่เครื่องมืออย่าง

177
00:08:41,244 --> 00:08:44,168
Hermes agent ลืมรายละเอียดตลอดเวลา แต่ Prime

178
00:08:44,168 --> 00:08:46,627
Agent ไม่ได้อ่านไฟล์ของคุณเข้าไปในหัว

179
00:08:46,627 --> 00:08:49,418
มันเขียนโปรแกรมเล็ก ๆ ที่รันข้ามไฟล์ของคุณ

180
00:08:49,418 --> 00:08:52,010
เครื่องยนต์ทั้งหมดสร้างขึ้นรอบสิ่งเดียว

181
00:08:52,010 --> 00:08:54,336
นั่นคือ persistent Python workspace

182
00:08:54,336 --> 00:08:56,263
(พื้นที่ทำงาน Python แบบถาวร)

183
00:08:56,263 --> 00:09:00,184
สภาพแวดล้อมการเขียนโค้ดแบบสดที่ยังมีชีวิตอยู่ตลอดทั้งเซสชัน

184
00:09:00,184 --> 00:09:02,710
และนี่คือ ส่วนที่แยกมันจากทุกอย่างอื่น

185
00:09:02,710 --> 00:09:05,501
พื้นที่ทำงานนั้นคือเครื่องมือเดียวของโมเดล

186
00:09:05,501 --> 00:09:07,694
การอ่านไฟล์ การค้นหา การรันคำสั่ง

187
00:09:07,694 --> 00:09:10,419
การเรียกบริการภายนอก แม้แต่การจ้าง helper

188
00:09:10,419 --> 00:09:11,947
agents (เอเจนต์ช่วยงาน)

189
00:09:11,947 --> 00:09:14,141
ทุกการกระทำเกิดขึ้นเป็นโค้ดที่มัน

190
00:09:14,141 --> 00:09:16,400
เขียนและรันในพื้นที่ทำงานเดียวนั้น

191
00:09:16,400 --> 00:09:18,925
ผู้พัฒนาจึงเรียกดีไซน์นี้ว่า recursive

192
00:09:18,925 --> 00:09:21,517
language model ( โมเดลภาษาแบบ เรียกซ้ำ)

193
00:09:21,517 --> 00:09:24,043
คุณไม่ต้องจำศัพท์เทคนิค แค่เห็นภาพก็พอ

194
00:09:24,043 --> 00:09:27,299
มันคือความต่างระหว่างบรรณารักษ์ที่พยายามจำหนังสือ

195
00:09:27,299 --> 00:09:28,390
ทุกเล่ม

196
00:09:28,390 --> 00:09:32,644
กับบรรณารักษ์ที่สร้างบัตรรายการหนังสือและดึงหน้าที่คุณขอออกมาให้

197
00:09:32,644 --> 00:09:34,903
บรรณารักษ์คนที่สองไม่มีวัน หัวเต็ม

198
00:09:34,903 --> 00:09:37,827
แล้วมันหมายความว่าอะไรสำหรับคุณในทางปฏิบัติ?

199
00:09:37,827 --> 00:09:40,419
พูดง่าย ๆ คือขนาดของงานไม่สำคัญอีกต่อไป

200
00:09:40,419 --> 00:09:42,745
เอกสารลูกค้า 10 ฉบับหรือ 1,000 ฉบับ

201
00:09:42,745 --> 00:09:45,670
วิธีเดียวกัน ความแม่นยำเท่ากัน เพราะมันค้นหา

202
00:09:45,670 --> 00:09:46,761
ไม่ได้ท่องจำ และ

203
00:09:46,761 --> 00:09:48,887
บทสนทนาของคุณเองก็กลายเป็นข้อมูล

204
00:09:48,887 --> 00:09:51,811
มันจัดการด้วยโค้ดแทนการพิมพ์ข้อความยาวเหยียด

205
00:09:51,811 --> 00:09:53,141
มันอ่านซ้ำไปเรื่อย ๆ

206
00:09:53,141 --> 00:09:55,666
ซึ่งเป็นส่วนสำคัญที่ทำให้มันทำงานยาว ๆ

207
00:09:55,666 --> 00:09:58,457
ต่อเนื่องหลายชั่วโมงได้ นี่คืองานแรกของคุณ

208
00:09:58,457 --> 00:09:59,853
และคุณลองวันนี้ได้เลย

209
00:09:59,853 --> 00:10:03,109
เพราะมันเป็นวิธีที่เร็วที่สุดที่จะเห็นความแตกต่าง

210
00:10:03,109 --> 00:10:05,369
เอาโฟลเดอร์ ที่มีงานเขียนของคุณเอง

211
00:10:05,369 --> 00:10:07,894
อาจเป็นบันทึกการโทรลูกค้า testimonials

212
00:10:07,894 --> 00:10:10,752
(คำรับรองจากลูกค้า) หรือข้อเสนอ proposals —

213
00:10:10,752 --> 00:10:12,015
สำเนานะครับ จำไว้ —

214
00:10:12,015 --> 00:10:14,806
แล้วถามสิ่งที่คุณไม่มีทางถามหน้าต่างแชตได้

215
00:10:14,806 --> 00:10:16,467
ให้มันดึงทุกข้อโต้แย้งของ

216
00:10:16,467 --> 00:10:19,126
ลูกค้าก่อนตัดสินใจซื้อ จัดกลุ่มตามประเภท

217
00:10:19,126 --> 00:10:21,518
หรือหาผลลัพธ์ที่เฉพาะเจาะจงที่สุด 20

218
00:10:21,518 --> 00:10:24,110
รายการที่ลูกค้ากล่าวถึง ใน testimonials

219
00:10:24,110 --> 00:10:25,201
เหล่านั้น

220
00:10:25,201 --> 00:10:28,790
หรือลิสต์ทุกสัญญาเรื่องการส่งมอบที่ถูกพูดถึงสามครั้งใน

221
00:10:28,790 --> 00:10:29,986
proposals เหล่านี้

222
00:10:29,986 --> 00:10:31,980
พร้อมระบุไฟล์ต้นทางของแต่ละอัน

223
00:10:31,980 --> 00:10:34,373
มันเขียนโปรแกรมค้นหา รันข้ามทุกอย่าง

224
00:10:34,373 --> 00:10:35,901
แล้วส่งคำตอบกลับมาพร้อม

225
00:10:35,901 --> 00:10:37,961
แหล่งอ้างอิงที่คุณตรวจสอบเองได้

226
00:10:37,961 --> 00:10:41,683
ประวัติธุรกิจทั้งหมดของคุณกลายเป็นสิ่งที่คุณตั้งคำถามได้

227
00:10:41,683 --> 00:10:43,943
ทีนี้ สูตรคำสั่ง (command formula)

228
00:10:43,943 --> 00:10:46,335
นี่คือพวงมาลัยของเครื่องยนต์ทั้งระบบ

229
00:10:46,335 --> 00:10:47,930
และคุณภาพของคำสั่งของคุณ

230
00:10:47,930 --> 00:10:50,788
เป็นตัวกำหนดคุณภาพของทุกอย่างอื่นในคอร์สนี้

231
00:10:50,788 --> 00:10:53,579
ส่วนที่หนึ่ง คืองานที่ระบุอย่างชัดเจน (job

232
00:10:53,579 --> 00:10:55,307
stated plainly) ส่วนที่สอง

233
00:10:55,307 --> 00:10:57,234
หน้าตาของความสำเร็จเป็นแบบไหน

234
00:10:57,234 --> 00:10:59,826
นั่นคือการตรวจสอบ (check) และส่วนที่สาม

235
00:10:59,826 --> 00:11:02,218
ผลลัพธ์จะไปอยู่ ที่ไหน (destination)

236
00:11:02,218 --> 00:11:05,076
แทนที่จะพูดว่า วิจัยคู่แข่งของฉัน คุณพูดว่า

237
00:11:05,076 --> 00:11:07,535
วิจัยห้าบริษัทอันดับต้น ๆ ในวงการ SEO

238
00:11:07,535 --> 00:11:08,626
ในแมนเชสเตอร์

239
00:11:08,626 --> 00:11:11,683
และคำว่าเสร็จหมายถึงตารางที่มีชื่อ ข้อเสนอหลัก

240
00:11:11,683 --> 00:11:14,740
และเรตติงดาว พร้อมลิงก์แหล่งอ้างอิง ในแต่ละแถว

241
00:11:14,740 --> 00:11:17,665
บันทึกเป็นไฟล์ชื่อ competitors ในโฟลเดอร์นี้

242
00:11:17,665 --> 00:11:20,323
งาน ตรวจสอบ ปลายทาง การตรวจสอบคือส่วนที่

243
00:11:20,323 --> 00:11:21,414
ทุกคนข้าม

244
00:11:21,414 --> 00:11:26,398
และมันคือส่วนเดียวกับที่จะกลายเป็นระบบความปลอดภัยของเครื่องยนต์ในส่วนที่ห้า

245
00:11:26,398 --> 00:11:28,857
ดังนั้นสร้าง นิสัยนี้ไว้ตั้งแต่ตอนนี้

246
00:11:28,857 --> 00:11:31,915
ในขณะที่คุณยังดูทุกงานอยู่ ขอเว้นตรงนี้สักครู่

247
00:11:31,915 --> 00:11:34,174
เพราะผมรู้ว่าบางคนกำลังคิดอะไรอยู่

248
00:11:34,174 --> 00:11:36,168
นี่ฟังดูทรงพลัง แต่คุณก็รู้ว่า

249
00:11:36,168 --> 00:11:38,228
ระหว่างเทอร์มินัล ตัวเลือกโมเดล

250
00:11:38,228 --> 00:11:39,358
และไฟล์ในโฟลเดอร์

251
00:11:39,358 --> 00:11:42,083
คุณจะเร็วขึ้นสิบเท่าถ้ามีคนเดินอยู่ข้าง ๆ

252
00:11:42,083 --> 00:11:44,807
นั่นคือสิ่งที่เราทำกันในคอมมูนิตี้ ของเรา

253
00:11:44,807 --> 00:11:47,798
(ชื่อฟังไม่ชัด [ฟังไม่ชัด]) คุณจะได้ Agent OS

254
00:11:47,798 --> 00:11:49,459
(agent operating system —

255
00:11:49,459 --> 00:11:51,985
ระบบปฏิบัติการเอเจนต์) ที่ prime agent

256
00:11:51,985 --> 00:11:54,710
เสียบปลั๊กอยู่ข้าง ๆ Claude ของคุณ Hermes

257
00:11:54,710 --> 00:11:57,036
ของคุณ open claw ของคุณ ทั้งหมดแชร์

258
00:11:57,036 --> 00:11:59,362
หน่วยความจำและชุดเครื่องมือเดียวกัน

259
00:11:59,362 --> 00:12:01,887
สำหรับวิดีโอ SEO agents และ AI avatars

260
00:12:01,887 --> 00:12:04,014
(อวตารเอไอ) ที่เชื่อมต่อไว้ แล้ว

261
00:12:04,014 --> 00:12:08,267
ทักษะที่คุณจะสร้างทีหลังในคอร์สนี้จึงมีเครื่องมือจริงให้เรียกใช้

262
00:12:08,267 --> 00:12:10,859
คุณจะได้ไฟล์ zip แผนการดำเนินงาน 30 วัน

263
00:12:10,859 --> 00:12:12,122
วิดีโอสอนเต็มรูปแบบ

264
00:12:12,122 --> 00:12:14,780
และอัปเดตรายวันเมื่อเราปล่อยเวอร์ชันใหม่

265
00:12:14,780 --> 00:12:17,106
บทช่วยสอนทีละขั้นตอนรายวันเกี่ยวกับ

266
00:12:17,106 --> 00:12:19,631
สิ่งที่อยู่ในคอร์สนี้เป๊ะ ๆ สูตรคำสั่ง

267
00:12:19,631 --> 00:12:21,758
การสร้างสกิล การออกแบบการตรวจสอบ

268
00:12:21,758 --> 00:12:24,815
คอลโค้ชชิ่งสี่ครั้งต่อสัปดาห์ ที่คุณแชร์หน้าจอ

269
00:12:24,815 --> 00:12:27,739
โชว์เซ็ตอัป Prime Agent ของคุณ และแก้ไขแบบสด

270
00:12:27,739 --> 00:12:30,265
มีเจ้าของธุรกิจกว่า 3,800 คนอยู่ในนั้น

271
00:12:30,265 --> 00:12:33,521
และหลายคนไม่เคยเปิดเทอร์มินัลมาก่อนตอนที่เข้าร่วม

272
00:12:33,521 --> 00:12:36,246
ลิงก์อยู่ในคอมเมนต์หรือคำอธิบาย หรือไปที่

273
00:12:36,246 --> 00:12:38,572
arpufferform.com (ฟังชื่อเว็บไม่ชัด

274
00:12:38,572 --> 00:12:41,430
[ฟังไม่ชัด]) กลับมาที่การควบคุม เพราะ Prime

275
00:12:41,430 --> 00:12:43,091
Agent มาพร้อมชุดสกิลในตัว

276
00:12:43,091 --> 00:12:45,882
และคุณควรรู้ว่ามีอะไรอยู่ในกล่องเครื่องมือ

277
00:12:45,882 --> 00:12:48,873
ก่อนงานที่สองของคุณ มี web search (ค้นหาเว็บ)

278
00:12:48,873 --> 00:12:51,199
ซึ่งหมายความว่ามันค้นหาเว็บแบบสดได้

279
00:12:51,199 --> 00:12:52,661
มันดึงข้อมูลกลางงานได้

280
00:12:52,661 --> 00:12:55,452
งานวิจัยจึงใช้ข้อมูลใหม่สด ไม่ใช่ training

281
00:12:55,452 --> 00:12:58,044
data (ข้อมูลฝึก) เก่า ๆ มี edit (แก้ไข)

282
00:12:58,044 --> 00:13:00,304
การเปลี่ยนแปลงไฟล์แบบ ผ่าตัดแม่นยำ

283
00:13:00,304 --> 00:13:03,693
แทนที่ข้อความหนึ่งท่อนแทนการเขียนเอกสารทั้งฉบับใหม่

284
00:13:03,693 --> 00:13:06,086
มี attach image ( แนบรูปภาพ) มันโหลด

285
00:13:06,086 --> 00:13:09,143
สกรีนช็อตหรือรูปถ่ายจากดิสก์ได้ แล้วมองมันจริง

286
00:13:09,143 --> 00:13:11,269
ๆ คุณส่งรูปหน้าเว็บคู่แข่งให้มัน

287
00:13:11,269 --> 00:13:14,127
แล้วถามคำถามเกี่ยวกับรูปนั้น ได้ มี compact

288
00:13:14,127 --> 00:13:15,218
(บีบอัด)

289
00:13:15,218 --> 00:13:18,076
มันตรวจว่าบทสนทนาเต็มแค่ไหนแล้วบีบให้เล็กลง

290
00:13:18,076 --> 00:13:19,472
บทสนทนาและเซสชันยาว ๆ

291
00:13:19,472 --> 00:13:21,598
จึงเดินหน้า ต่อไปได้ และมี goal,

292
00:13:21,598 --> 00:13:36,950
refine และ heartbeat ซึ่งเป็นดาวเด่นของทั้งระบบ คุณใช้มันกับการค้นหาแบบสด เช่น ให้เอเจนต์ของคุณค้นหาเว็บสดเดี๋ยวนี้เลย ทีนี้ บางคนถามว่า Prime Agent กับ Hermes agent ต่างกันยังไง ถ้าคุณรัน Hermes อยู่แล้ว เช่น ทำไมต้องมา แตะตัวนี้?

293
00:13:36,950 --> 00:13:39,409
เป็นคำถามที่สมเหตุสมผล คุณไม่ต้องสลับ

294
00:13:39,409 --> 00:13:41,469
และถ้าคุณพอใจกับเซ็ตอัปปัจจุบัน

295
00:13:41,469 --> 00:13:44,526
คุณไม่ต้องเปลี่ยนอะไรเลย ทั้งคู่เป็นโอเพนซอร์ส

296
00:13:44,526 --> 00:13:45,988
ทั้งคู่ใช้ MIT license

297
00:13:45,988 --> 00:13:47,849
ทั้งคู่มาจากแล็บวิจัยจริงจัง

298
00:13:47,849 --> 00:13:50,840
ทั้งคู่อ้างว่าพัฒนาตัวเองได้ ทั้งคู่สร้างสกิล

299
00:13:50,840 --> 00:13:51,931
และเก็บความจำ

300
00:13:51,931 --> 00:13:54,789
แต่พวกมันถูกสร้างมาเพื่องานที่ต่างกันจริง ๆ

301
00:13:54,789 --> 00:14:00,770
และพอคุณเห็นความต่าง คุณจะเข้าใจ ถ้าเริ่มจาก ว่ามันอาศัยอยู่ที่ไหน Hermes อยู่ทุกที่จริง ๆ

302
00:14:00,770 --> 00:14:02,498
Telegram, Slack, WhatsApp,

303
00:14:02,498 --> 00:14:23,964
อีเมล หนึ่งเอเจนต์ หนึ่งความจำ บนทุกบริการและทุกพื้นผิว คุณส่งข้อความหามันจากโทรศัพท์ได้ ในขณะที่มันอยู่บนเครื่องที่คุณไม่เคยแตะ Prime agent อยู่ในที่เดียว นั่นคือโฟลเดอร์บนเครื่อง ในเทอร์มินัล Hermes ถูกสร้างมาให้เข้าถึงได้ง่าย Prime ถูกสร้างมาให้ถูกปล่อยไว้ตามลำพังกับงานหนัก แล้ววิธีที่แต่ละตัวเรียนรู้นี่คือทางแยกจริง ๆ

304
00:14:23,964 --> 00:14:26,755
Hermes มี learning loop (วงรอบการเรียนรู้)

305
00:14:26,755 --> 00:14:29,280
ที่รันอัตโนมัติขณะที่มันทำงาน มันเขียน

306
00:14:29,280 --> 00:14:32,205
reusable skill files (ไฟล์สกิล ที่ใช้ซ้ำได้)

307
00:14:32,205 --> 00:14:34,863
บันทึกความจำ ค้นหาบทสนทนาในอดีตของตัวเอง

308
00:14:34,863 --> 00:14:36,790
และสร้างภาพที่ลึกขึ้นเรื่อย ๆ

309
00:14:36,790 --> 00:14:39,980
ว่าคุณเป็นใคร และมันผลักดันตัวเองให้จำสิ่งต่าง ๆ

310
00:14:39,980 --> 00:14:42,771
มันเป็นแบบ handoff (ปล่อยมือ) โดยการออกแบบ

311
00:14:42,771 --> 00:14:45,762
ถูกออกแบบให้ใช้งานง่าย และค่อนข้างปล่อยวางได้

312
00:14:45,762 --> 00:14:48,753
ส่วนการเรียนรู้ของ Prime Agent รันผ่าน refine

313
00:14:48,753 --> 00:14:50,746
ซึ่งเป็นการแก้ไขเล็ก ๆ ที่จงใจ

314
00:14:50,746 --> 00:14:51,943
และมีหลักฐานรองรับ

315
00:14:51,943 --> 00:14:54,933
โดยทุกการเปลี่ยนแปลงถูกบันทึกพร้อมเหตุผลที่ทำ

316
00:14:54,933 --> 00:14:57,924
การเปลี่ยนแปลงทุกอันมี ID การเปลี่ยน แปลงใด ๆ

317
00:14:57,924 --> 00:14:59,452
ย้อนกลับได้ด้วย ID นั้น

318
00:14:59,452 --> 00:15:00,981
และคำสั่งแกนกลางถูกล็อก

319
00:15:00,981 --> 00:15:03,772
เอเจนต์จึงไม่มีวันเขียนรากฐานของตัวเองใหม่

320
00:15:03,772 --> 00:15:04,863
พูดง่าย ๆ

321
00:15:04,863 --> 00:15:09,250
Hermes เรียนรู้เหมือนผู้ช่วยที่เฉียบแหลมซึ่งจดบันทึกส่วนตัวเงียบ ๆ

322
00:15:09,250 --> 00:15:11,044
Prime เรียนรู้เหมือนพนักงาน

323
00:15:11,044 --> 00:15:13,437
ที่คุณเปิดแฟ้มฝึกอบรม อ่านทีละบรรทัด

324
00:15:13,437 --> 00:15:16,361
และแก้ไขได้ด้วยปุ่มเลิกทำบนทุกการเปลี่ยนแปลง

325
00:15:16,361 --> 00:15:19,418
และหลังจากเรื่อง Factorio คุณเข้าใจแล้วว่าทำไม

326
00:15:19,418 --> 00:15:20,946
Prime ถึงถูกสร้างแบบนี้

327
00:15:20,946 --> 00:15:22,940
เมื่อเอเจนต์สอนตัวเองให้โกงได้

328
00:15:22,940 --> 00:15:25,798
ร่องรอยการตรวจสอบ การเรียนรู้ (audit trail)

329
00:15:25,798 --> 00:15:27,659
คือฟีเจอร์ที่คุณน่าจะอยากได้

330
00:15:27,659 --> 00:15:30,118
แล้วรูปร่างของงานจริงก็ต่างกัน Hermes

331
00:15:30,118 --> 00:15:32,776
เก่งเรื่องการเป็นเพื่อนคู่ใจรายวันของคุณ

332
00:15:32,776 --> 00:15:35,301
คุณตั้งเวลาสรุปข่าวเช้าเป็น ภาษาธรรมดา

333
00:15:35,301 --> 00:15:37,295
ยิงมาเข้าโทรศัพท์ระหว่างประชุม

334
00:15:37,295 --> 00:15:40,286
ให้มันค้นอะไรสักอย่างแล้วส่งข้อความหาคุณ ส่วน

335
00:15:40,286 --> 00:15:43,010
Prime Agent เก่งงานยาว หนัก และตรวจสอบได้

336
00:15:43,010 --> 00:15:45,469
งานที่รันหลายชั่วโมงข้ามกองไฟล์มหาศาล

337
00:15:45,469 --> 00:15:47,995
ที่บทสนทนาจะระเบิด context window ปกติ

338
00:15:47,995 --> 00:15:50,321
ที่คุณต้องการหลักฐานว่างานเสร็จจริง

339
00:15:50,321 --> 00:15:53,112
หลักฐานนั้นคือ low-bounded autonomous mode

340
00:15:53,112 --> 00:15:55,837
(โหมดอัตโนมัติแบบมีขอบเขตจำกัด) ของ Prime

341
00:15:55,837 --> 00:15:58,495
พร้อม quality gates (ประตูตรวจสอบคุณภาพ)

342
00:15:58,495 --> 00:15:59,586
พูดง่าย ๆ

343
00:15:59,586 --> 00:16:52,753
คือการตรวจสอบจริงที่ต้องผ่านก่อนที่เอเจนต์จะบอกว่างานเสร็จ Hermes ไม่ค่อยมีแบบนั้น ไม่มีเครื่องมืออื่น มีแบบนั้น คุณจะได้เรียนรู้ในส่วนที่ห้า ดังนั้นพวกมันต่างกันมากในแง่วิธีทำงานและสิ่งที่คุณใ ช้มันทำ ทีนี้ ส่วนที่สาม ระบบเกียร์ (gearbox) ความจำ สกิล และทีม นี่คือจุดที่เครื่องยนต์ทวีกำลัง Prime Agent เก็บ durable state (สถานะถาวร) สี่ชนิด และคุณควรรู้ทั้งสี่ เพราะคุณสร้าง อ่าน แก้ไข และลบมันทุกอันได้ และเอเจนต์ก็ทำได้เหมือนกัน หนึ่ง prompt notes (โน้ตคำสั่ง) คำสั่งประจำตัวอย่างเช่น ให้แหล่งอ้างอิงฉันเสมอ หรือเขียนเป็นภาษาอังกฤษธรรมดา สอง memories (ความทรงจำ) ข้อเท็จจริงที่บันทึกไว้เกี่ยวกับคุณและงาน ของคุณ สาม skills (ทักษะ) เวิร์กโฟลว์ที่ใช้ซ้ำได้ และสี่ subagent specs (สเปกเอเจนต์ย่อย) รายละเอียดงาน ที่บันทึกไว้สำหรับ helper agents หรือ subagents ที่มันสามารถจ้างได้อีกในภายหลัง prompts,

344
00:16:52,753 --> 00:16:53,844
memories,

345
00:16:53,844 --> 00:17:12,186
skills และ subagents สี่อย่างนี้คือเฟือง และทุกอย่างจากตรงนี้ไปจนถึงระบบขับเคลื่อนอัตโนมัต ิคือเรื่องของ การทำให้มันเติบโตขึ้น เริ่มจากความจำก่อน เพราะมันเป็นชัยชนะที่ง่ายที่สุดของทั้งคอร์ส เมื่อเอเจนต์ทำอะไรถูกต้องหรือเรียนรู้ ข้อเท็จจริงจริงเกี่ยวกับธุรกิจของคุณ บอกมันตรง ๆ

346
00:17:12,186 --> 00:17:14,978
แล้วบันทึกเป็น memory เช่น บันทึกความจำว่า

347
00:17:14,978 --> 00:17:17,902
ลูกค้าของเรา เป็นธุรกิจบริการท้องถิ่น (local

348
00:17:17,902 --> 00:17:19,032
service business)

349
00:17:19,032 --> 00:17:22,620
และเราไม่ใช้ศัพท์เฉพาะอุตสาหกรรมในสิ่งใดก็ตามที่ติดต่อ

350
00:17:22,620 --> 00:17:25,013
กับลูกค้า ถ้าคุณพูดแบบนั้นกับเอเจนต์

351
00:17:25,013 --> 00:17:28,003
จากนั้นข้อเท็จจริงนั้นก็เดินทางไปกับมันทุกที่

352
00:17:28,003 --> 00:17:29,598
และนี่คือจุดที่ความเชื่อ

353
00:17:29,598 --> 00:17:32,190
จำกัดใหญ่ข้อแรกเกี่ยวกับ AI ต้องพังทลาย

354
00:17:32,190 --> 00:17:34,849
หลายคนคิดว่า AI ลืมทุกอย่าง หรือ context

355
00:17:34,849 --> 00:17:36,444
window หรือความจำ ไม่ไหว

356
00:17:36,444 --> 00:17:39,966
คุณใช้ระบบนี้บอกให้มันจำข้อเท็จจริงเกี่ยวกับอะไรก็ได้

357
00:17:39,966 --> 00:17:42,292
แล้วมันก็ไม่ลืมรายละเอียดใด ๆ ทีนี้

358
00:17:42,292 --> 00:17:45,017
สกิลคือจุดที่ Prime Agent เปล่งประกาย และ

359
00:17:45,017 --> 00:17:46,612
Prime Agent มีสกิลสองแบบ

360
00:17:46,612 --> 00:17:49,536
การรู้ความแตกต่างจะช่วยให้ คุณไม่สับสนทีหลัง

361
00:17:49,536 --> 00:17:52,327
แบบแรกคือ skill description (คำอธิบายสกิล)

362
00:17:52,327 --> 00:17:54,985
โน้ตที่บันทึกเกี่ยวกับขั้นตอนที่ทำซ้ำได้

363
00:17:54,985 --> 00:17:56,077
ซึ่งระบบ refine

364
00:17:56,077 --> 00:17:59,333
สร้างขึ้นเองได้เมื่อมันสังเกตว่าคุณกำลังทำอะไรซ้ำ

365
00:17:59,333 --> 00:18:02,257
ๆ แบบที่สองคือแบบหนัก ( heavyweight) นั่นคือ

366
00:18:02,257 --> 00:18:04,384
executable skill (สกิลที่รันได้)

367
00:18:04,384 --> 00:18:06,444
โปรแกรมจริงที่ติดตั้งได้บนดิสก์

368
00:18:06,444 --> 00:18:09,435
ซึ่งเพิ่มความสามารถใหม่จริง ๆ ให้ เครื่องยนต์

369
00:18:09,435 --> 00:18:11,894
มี skill creator (ตัวสร้างสกิล) ในตัว

370
00:18:11,894 --> 00:18:14,220
หน้าที่ทั้งหมดคือแพ็กเกจเวิร์กโฟลว์

371
00:18:14,220 --> 00:18:17,210
เอเจนต์แค่ทำให้สำเร็จ แล้วแพ็กเป็นหนึ่งในนั้น

372
00:18:17,210 --> 00:18:21,264
และรายละเอียดปฏิบัติสองอย่างจากเอกสารที่จะช่วยคุณไม่ให้ปวดหัว

373
00:18:21,264 --> 00:18:23,923
หลังจากสร้าง executable skill ใหม่ พิมพ์

374
00:18:23,923 --> 00:18:26,249
/reload เพื่อให้เอเจนต์ค้นพบมันใหม่

375
00:18:26,249 --> 00:18:28,973
และเริ่มเซสชันใหม่เพื่อให้มันติดตั้งอย่าง

376
00:18:28,973 --> 00:18:31,765
ถูกต้อง เรื่องเล็ก ๆ แต่สำคัญตั้งแต่วันแรก

377
00:18:31,765 --> 00:18:33,360
การเล่นที่แนะนำตรงนี้คือ

378
00:18:33,360 --> 00:18:36,018
เลือกกระบวนการที่คุณทำซ้ำทุกสัปดาห์ เช่น

379
00:18:36,018 --> 00:18:39,009
งานวิจัยที่คุณทำก่อนการโทรขายทุกครั้ง ใช่ไหม?

380
00:18:39,009 --> 00:18:43,528
จากนั้นขั้นตอนที่สอง พาเอเจนต์เดินผ่านมันครั้งเดียว แก้ไขไป เรื่อย ๆ

381
00:18:43,528 --> 00:18:45,854
เหมือนฝึกพนักงานใหม่เป๊ะ ๆ ดูบริษัท

382
00:18:45,854 --> 00:18:47,316
หาข่าวล่าสุด ตรวจรีวิว

383
00:18:47,316 --> 00:18:50,174
สรุปในหน้าเดียวสามหัวข้อ แล้วขั้นตอน ที่สาม

384
00:18:50,174 --> 00:18:52,234
เมื่อผลลัพธ์ออกมาถูกต้อง พูดว่า

385
00:18:52,234 --> 00:18:54,759
แพ็กสิ่งที่คุณเพิ่งทำเป็นสกิลชื่อ prep

386
00:18:54,759 --> 00:18:57,550
(เตรียมการ) เป็นตัวอย่างของ เวิร์กโฟลว์นี้

387
00:18:57,550 --> 00:19:00,009
แล้วสี่ พิมพ์ /reload เริ่มเซสชันใหม่

388
00:19:00,009 --> 00:19:01,139
และจากสัปดาห์หน้า

389
00:19:01,139 --> 00:19:03,930
กระบวนการทั้งหมดกลายเป็นหนึ่งบรรทัด คุณรัน

390
00:19:03,930 --> 00:19:05,525
call prep บนบริษัทนี้ได้

391
00:19:05,525 --> 00:19:07,719
และกระบวนการที่เคยอยู่ในหัวของคุณ

392
00:19:07,719 --> 00:19:10,310
ตอนนี้ถูกบันทึกเป็นคำสั่งใน prime agent

393
00:19:10,310 --> 00:19:12,437
เมื่อตั้งค่านี้แล้ว มันรันตลอดไป

394
00:19:12,437 --> 00:19:15,693
ถ้านั่นคือหนึ่งกระบวนการต่อสัปดาห์ที่กลายเป็นสกิล

395
00:19:15,693 --> 00:19:18,418
ผ่านไป 12 สัปดาห์ กระบวนการประจำของคุณ 12

396
00:19:18,418 --> 00:19:19,747
อย่างจะรันด้วยคำสั่ง

397
00:19:19,747 --> 00:19:22,273
วิธีแบบเก่าคือกระบวนการของคุณอยู่ในหัว

398
00:19:22,273 --> 00:19:24,001
หรืออยู่ในเอกสาร อย่าง SOP

399
00:19:24,001 --> 00:19:25,529
(เอกสารมาตรฐานการทำงาน)

400
00:19:25,529 --> 00:19:28,254
และขึ้นอยู่กับว่าวันนั้นคุณอารมณ์ดีแค่ไหน

401
00:19:28,254 --> 00:19:29,783
วิธีแบบใหม่คือกระบวนการ

402
00:19:29,783 --> 00:19:31,577
ของคุณคือเฟืองในเครื่องยนต์

403
00:19:31,577 --> 00:19:33,371
และเฟืองไม่มีวันอารมณ์ไม่ดี

404
00:19:33,371 --> 00:19:36,362
เพราะมันทำซ้ำได้แม่นยำมาก ทีนี้มาพูดถึงทีมกัน

405
00:19:36,362 --> 00:19:39,884
เพราะนี่คือเฟืองที่เปลี่ยนคนงานหนึ่งคนให้เป็นทั้งแผนก

406
00:19:39,884 --> 00:19:42,343
เอเจนต์หลักสามารถสร้าง sub agents ได้

407
00:19:42,343 --> 00:19:43,872
เอเจนต์แยกต่างหากจริง ๆ

408
00:19:43,872 --> 00:19:45,533
แต่ละตัวมีเซสชันของตัวเอง

409
00:19:45,533 --> 00:19:48,524
พื้นที่ทำงานของตัวเอง ประวัติของตัวเอง ในโค้ด

410
00:19:48,524 --> 00:19:51,714
การจ้างหนึ่งตัวคือการเรียกฟังก์ชันครั้งเดียวจริง

411
00:19:51,714 --> 00:19:54,372
ๆ และรายละเอียดสำคัญคือการเรียกนั้นไม่รอ

412
00:19:54,372 --> 00:19:55,967
เอเจนต์หลัก ยิง subagent

413
00:19:55,967 --> 00:19:58,825
ออกไปทันทีแล้วทำงานต่อ Subagents รันแบบขนาน

414
00:19:58,825 --> 00:20:01,616
และส่งผลลัพธ์กลับมาทางข้อความเมื่อมันเสร็จ

415
00:20:01,616 --> 00:20:03,942
คุณพูดได้ว่า สร้าง sub agent สามตัว

416
00:20:03,942 --> 00:20:06,202
หนึ่งตัววิจัยว่าคู่แข่งอันดับต้น ๆ

417
00:20:06,202 --> 00:20:08,727
ของเราเปลี่ยนอะไรบนเว็บไซต์ในไตรมาสนี้

418
00:20:08,727 --> 00:20:12,116
หนึ่งตัวดึงคำถามที่พบบ่อยที่สุดจากอีเมลลูกค้าของเรา

419
00:20:12,116 --> 00:20:14,642
และหนึ่งตัวร่างไอเดียคอนเทนต์เดือนหน้า

420
00:20:14,642 --> 00:20:16,901
แล้วคุณรวม ทุกอย่างเป็นรายงานเดียว

421
00:20:16,901 --> 00:20:18,696
คุณได้คนงานสามคนรันพร้อมกัน

422
00:20:18,696 --> 00:20:20,623
ผู้จัดการหนึ่งคนรวบรวมผลลัพธ์

423
00:20:20,623 --> 00:20:23,680
คำสั่งหนึ่งคำสั่งจากคุณ และรายละเอียด subagent

424
00:20:23,680 --> 00:20:24,810
สามอย่างที่ควรรู้

425
00:20:24,810 --> 00:20:28,066
เพราะแต่ละอย่างโชว์ว่ามันถูกสร้างอย่างตั้งใจแค่ไห

426
00:20:28,066 --> 00:20:31,057
น สิ่งที่เจ๋ง เกี่ยวกับ subagents โดยเฉพาะกับ

427
00:20:31,057 --> 00:20:33,915
prime agent หนึ่ง พวกมันคงอยู่ (persistent)

428
00:20:33,915 --> 00:20:36,706
ตัวที่เสร็จงานไม่หายไป เซสชันของมันยังอยู่

429
00:20:36,706 --> 00:20:39,032
พรุ่งนี้คุณส่งงานต่อเนื่องให้มันได้

430
00:20:39,032 --> 00:20:41,956
มันจำทุกอย่าง สอง เมื่อไม่ได้ใช้งานประมาณ 30

431
00:20:41,956 --> 00:20:44,681
นาที subagent จะถูกยกเลิกโหลดอย่างเงียบ ๆ

432
00:20:44,681 --> 00:20:46,741
และทันทีที่มีคนเรียกมันอีกครั้ง

433
00:20:46,741 --> 00:20:48,801
มันโหลดกลับมาจากจุดที่บันทึกไว้

434
00:20:48,801 --> 00:20:50,596
เหมือนมันไม่เคยจากไป และสาม

435
00:20:50,596 --> 00:20:52,589
มีขอบเขตจงใจว่าใครคุยกับใครได้

436
00:20:52,589 --> 00:20:55,115
เอเจนต์ส่งข้อความได้เฉพาะภายในครอบครัว

437
00:20:55,115 --> 00:20:57,840
ของตัวเอง ตัวอย่างเช่น คุณมี parent agent

438
00:20:57,840 --> 00:21:00,033
(เอเจนต์แม่) กับ subagents ของมัน

439
00:21:00,033 --> 00:21:01,124
และเอเจนต์อื่น ๆ

440
00:21:01,124 --> 00:21:07,238
ใต้ parent นั้น ผู้พัฒนากำหนดขอบเขตนี้โดยตั้งใจ คุณจะไม่มีเซสชันที่ไม่เกี่ยวข้องกันเป็นโหล ๆ

441
00:21:07,238 --> 00:21:09,498
ส่งข้อความคุยกันอย่าง คาดเดาไม่ได้

442
00:21:09,498 --> 00:21:13,219
แต่ประเด็นหลักคือเอเจนต์เหล่านี้ส่งข้อความหากันได้โดยตรง

443
00:21:13,219 --> 00:21:15,479
ชี้นำงานของกันและกันได้ โดยไม่ต้อง

444
00:21:15,479 --> 00:21:16,609
วนทุกอย่างผ่านคุณ

445
00:21:16,609 --> 00:21:18,735
ผู้จัดการแก้ไขงานวิจัยกลางคันได้

446
00:21:18,735 --> 00:21:21,194
คุณสร้างแผนกขึ้นมา และแผนกก็พูดคุยกัน

447
00:21:21,194 --> 00:21:22,285
และสิ่งเจ๋ง ๆ

448
00:21:22,285 --> 00:21:25,808
ที่อยู่ใต้ทั้งหมดนี้คือชิ้นส่วนที่ทำให้งานยาวเป็นจริง

449
00:21:25,808 --> 00:21:28,400
นั่นคือ daemon (ดีมอน) บริการเบื้องหลัง

450
00:21:28,400 --> 00:21:30,061
ที่เป็นเจ้าของทุกเซสชันสด

451
00:21:30,061 --> 00:21:33,982
นี่หมายความว่าเซสชันไม่ได้ผูกติดกับหน้าต่างเทอร์มินัลของคุณ

452
00:21:33,982 --> 00:21:36,242
ถ้าคุณปิดแล็ปท็อป ไปยิม ไปเดินเล่น

453
00:21:36,242 --> 00:21:38,966
เครื่องยนต์ยังรันต่อไป กลับมา พิมพ์ prime

454
00:21:38,966 --> 00:21:41,625
agent attach แล้วคุณก็ยืนอยู่ในห้องทำงาน

455
00:21:41,625 --> 00:21:44,482
ของมันอีกครั้ง มองมันทำงานกลางคัน ถ้ามีอะไร

456
00:21:44,482 --> 00:21:47,207
crash ดีมอนกู้เซสชันจากบันทึกที่บันทึกไว้

457
00:21:47,207 --> 00:21:49,201
บวกกับสแนปช็อต ของพื้นที่ทำงาน

458
00:21:49,201 --> 00:21:51,926
แทนที่จะเสียเวลาหลายชั่วโมงของความคืบหน้า

459
00:21:51,926 --> 00:21:54,451
นี่คือความหมายของการทำงานยาว และมันคือ

460
00:21:54,451 --> 00:21:57,043
รากฐานที่ระบบขับเคลื่อนอัตโนมัติยืนอยู่

461
00:21:57,043 --> 00:21:59,303
อีกสามคำสั่งทำให้ระบบเกียร์สมบูรณ์

462
00:21:59,303 --> 00:22:02,094
และแต่ละคำสั่งแก้ปัญหาจำเพาะที่คุณน่าจะเจอ

463
00:22:02,094 --> 00:22:03,622
หนึ่งคือ /goal เป้าหมาย

464
00:22:03,622 --> 00:22:06,081
คือวัตถุประสงค์ถาวรพร้อมงบประมาณเสริม

465
00:22:06,081 --> 00:22:09,537
และฮาร์เนสจะคอยดึงเอเจนต์กลับมาที่เป้าหมายรอบแล้วรอบ

466
00:22:09,537 --> 00:22:10,628
เล่า

467
00:22:10,628 --> 00:22:13,818
จนกว่าเอเจนต์จะทำเครื่องหมายว่าสำเร็จอย่างชัดเจน

468
00:22:13,818 --> 00:22:16,676
มันมีการเรียกบอกเสร็จสิ้น (completion call)

469
00:22:16,676 --> 00:22:19,467
ที่มันต้องทำ จริง ๆ ทำไมถึงสำคัญ? ในงานยาว

470
00:22:19,467 --> 00:22:22,126
เอเจนต์ลอยไป บริบทช่วงแรกถูกบีบให้เล็กลง

471
00:22:22,126 --> 00:22:23,986
เธรดหาย และเอเจนต์อาจเร่ร่อน

472
00:22:23,986 --> 00:22:25,316
ไปทำอะไรที่ใกล้เคียง

473
00:22:25,316 --> 00:22:27,642
เป้าหมายคือเชือกที่ผูกไว้กับนิ้วมัน

474
00:22:27,642 --> 00:22:30,699
ที่หลุดโดยไม่ได้ตั้งใจไม่ได้ สองคือ /heartbeat

475
00:22:30,699 --> 00:22:33,291
หัวใจเต้นคือข้อความเตือนใจ (me message)

476
00:22:33,291 --> 00:22:36,613
ที่ถูกฉีดเข้าไปในเซสชันตามเวลาทุกสองสามนาทีอัตโนมั

477
00:22:36,613 --> 00:22:38,940
ติ เหมือน ผู้จัดการโผล่หน้าเข้ามาดู

478
00:22:38,940 --> 00:22:41,332
มันเหมาะกับงานที่เอเจนต์รออะไรที่ช้า

479
00:22:41,332 --> 00:22:44,057
หรือที่คุณอยากให้มันคอยเช็กความคืบหน้าของ

480
00:22:44,057 --> 00:22:46,848
subagent โดยที่คุณไม่ต้องสังเกตอะไร และสาม

481
00:22:46,848 --> 00:22:48,177
prime agent schedule

482
00:22:48,177 --> 00:22:50,968
ซึ่งเริ่มเซสชันตามเวลาที่ตั้ง ตัวอย่างเช่น

483
00:22:50,968 --> 00:22:53,826
ทุกวันทำงานตอน 7 โมงเช้า ตรวจโฟลเดอร์ notes

484
00:22:53,826 --> 00:22:56,418
สรุปอะไรใหม่ ๆ และบันทึกไฟล์สรุปตอนเช้า

485
00:22:56,418 --> 00:22:57,509
วันของเอเจนต์

486
00:22:57,509 --> 00:23:00,168
คุณจึงเริ่มต้นด้วยสรุปที่คุณไม่ต้องทำเอง

487
00:23:00,168 --> 00:23:02,161
ส่วนที่สี่ ตัวปรับแต่ง (tuner)

488
00:23:02,161 --> 00:23:04,753
ฟีเจอร์ที่ไม่มีเครื่องมืออื่น บ่อยครั้ง

489
00:23:04,753 --> 00:23:07,279
เวลาใช้เอเจนต์ เราต้องวนไปวนมา ต้องให้

490
00:23:07,279 --> 00:23:10,070
ฟีดแบ็กกับมัน ตอนนี้กับ prime agent คุณใช้

491
00:23:10,070 --> 00:23:11,798
/refine ได้ และเมื่อรันมัน

492
00:23:11,798 --> 00:23:14,722
เอเจนต์จะทบทวนงานล่าสุดของตัวเอง เป็นหลักฐาน

493
00:23:14,722 --> 00:23:17,712
อะไรถูกแก้ อะไรล้มเหลว รูปแบบอะไรที่ซ้ำ ๆ กัน

494
00:23:17,712 --> 00:23:20,770
แล้วมันใช้การแก้ไขเล็กที่สุดที่เป็นประโยชน์กับ

495
00:23:20,770 --> 00:23:22,697
เซ็ตอัปของตัวเอง บันทึกความจำ

496
00:23:22,697 --> 00:23:25,023
อัปเดตคำอธิบายสกิล ปรับ prompt note

497
00:23:25,023 --> 00:23:27,748
หรือปรับแต่ง subagent spec มันเล็ก เจาะจง

498
00:23:27,748 --> 00:23:28,839
มีหลักฐานรองรับ

499
00:23:28,839 --> 00:23:33,292
และมันวางแผนการปรับแต่งเหล่านี้ในเบื้องหลังได้โดยไม่ขัดจังหวะงานที่

500
00:23:33,292 --> 00:23:36,349
อยู่ตรงหน้าคุณ ราวกั้นความปลอดภัย (guardrails)

501
00:23:36,349 --> 00:23:38,276
คือเหตุผลที่มันปลอดภัยพอจะใช้

502
00:23:38,276 --> 00:23:41,001
และคุณควรรู้ทั้งสามแบบขึ้นใจ จำไว้ด้วยว่า

503
00:23:41,001 --> 00:23:43,526
refine มีล็อกให้คุณเห็นว่าทำอะไรไปบ้าง

504
00:23:43,526 --> 00:23:45,985
และคุณเลิกทำอะไรก็ได้ที่ถูกปรับแต่งมา

505
00:23:45,985 --> 00:23:48,245
ราวกั้นข้อหนึ่ง base system prompt

506
00:23:48,245 --> 00:23:50,903
(พรอมต์ระบบพื้นฐาน) เปลี่ยนไม่ได้ Refine

507
00:23:50,903 --> 00:23:52,431
แก้ได้แค่ชั้นรอบแกนกลาง

508
00:23:52,431 --> 00:23:55,090
เอเจนต์ไม่มีวันเขียนรากฐานของ ตัวเองใหม่

509
00:23:55,090 --> 00:23:56,884
ไม่ว่ามันจะเรียนรู้อะไร สอง

510
00:23:56,884 --> 00:23:59,476
ทุกการเปลี่ยนแปลงถูกบันทึกใน refinement

511
00:23:59,476 --> 00:24:02,533
history ( ประวัติการปรับแต่ง) พร้อมเหตุผลที่ทำ

512
00:24:02,533 --> 00:24:07,385
คุณเปิดประวัติและอ่านเป็นข้อความธรรมดาว่าเครื่องยนต์ของคุณตัดสินใจเปลี่ยน

513
00:24:07,385 --> 00:24:09,445
อะไรเกี่ยวกับ ตัวเองและทำไม สาม

514
00:24:09,445 --> 00:24:10,907
ทุกการเปลี่ยนแปลงมี ID

515
00:24:10,907 --> 00:24:13,632
และอัปเดตที่แย่สามารถย้อนกลับด้วย ID นั้น

516
00:24:13,632 --> 00:24:14,723
มีการบันทึก

517
00:24:14,723 --> 00:24:17,248
สแนปช็อตเพื่อรองรับการย้อนกลับโดยเฉพาะ

518
00:24:17,248 --> 00:24:19,175
ถ้ามันเรียนรู้บทเรียนที่ไม่ดี

519
00:24:19,175 --> 00:24:21,568
คุณเลิกบทเรียนนั้นแบบผ่าตัดได้โดยไม่

520
00:24:21,568 --> 00:24:23,562
แตะต้องอย่างอื่นที่มันเรียนรู้

521
00:24:23,562 --> 00:24:25,356
คุณตั้งกิจวัตรรายสัปดาห์ได้

522
00:24:25,356 --> 00:24:26,619
ให้เอเจนต์ทำงานจริง

523
00:24:26,619 --> 00:24:29,011
แก้มันแบบที่คุณแก้พนักงานใหม่ เจาะจง

524
00:24:29,011 --> 00:24:31,337
ไม่คลุมเครือ ไม่ใช่ "อันนี้ผิด" แต่

525
00:24:31,337 --> 00:24:32,799
"ห้ามใช้สามวลีนี้" และ

526
00:24:32,799 --> 00:24:34,527
"ให้มีสามแหล่งอ้างอิงเสมอ"

527
00:24:34,527 --> 00:24:37,053
ทำแบบนั้นสักสองสามงาน รัน /refine แล้ว

528
00:24:37,053 --> 00:24:38,144
อย่าข้ามขั้นนี้

529
00:24:38,144 --> 00:24:41,334
เปิดประวัติและอ่านสิ่งที่มันเขียนเกี่ยวกับตัวเอง

530
00:24:41,334 --> 00:24:44,391
แล้วส่งงานคล้าย ๆ กันให้มัน แล้วดูมันนำบทเรียน

531
00:24:44,391 --> 00:24:45,587
ไปใช้โดยไม่ต้องบอก

532
00:24:45,587 --> 00:24:47,847
การแก้ไขของคุณทบต้นเมื่อเวลาผ่านไป

533
00:24:47,847 --> 00:24:50,771
สัปดาห์แรกมันอาจยังพลาดบ้างเป็นครั้งคราว แต่

534
00:24:50,771 --> 00:24:53,562
สัปดาห์ที่สาม งานมาถึงโดยทำตามกฎของคุณแล้ว

535
00:24:53,562 --> 00:24:56,553
และคุณยังต้องแน่ใจว่าความจำในระบบเจาะจงจริง ๆ

536
00:24:56,553 --> 00:25:00,407
ทีนี้ refine เป็นฟีเจอร์หลัก แต่มีสองเรื่องที่ต้องพูดตรง ๆ

537
00:25:00,407 --> 00:25:03,265
หนึ่ง คนที่ขุดซอร์สโค้ดพบว่าขั้นตอนการทบทวน

538
00:25:03,265 --> 00:25:05,192
(review) ทำโดยโมเดล AI อีกตัว

539
00:25:05,192 --> 00:25:09,180
และถึงแม้มันจะบันทึกว่าคาดหวังผลลัพธ์อะไรจากการเปลี่ยนแปลงแต

540
00:25:09,180 --> 00:25:10,271
่ละครั้ง

541
00:25:10,271 --> 00:25:14,524
มันก็ไม่ได้วนกลับมาตรวจสอบทีหลังว่าการเปลี่ยนแปลงช่วยจริงหรือไม่

542
00:25:14,524 --> 00:25:17,050
การตรวจสอบนั้นเป็นงานของคุณ และใช้เวลา

543
00:25:17,050 --> 00:25:19,376
ห้านาทีต่อสัปดาห์ คุณควรอ่านประวัติ

544
00:25:19,376 --> 00:25:20,838
ทดสอบบทเรียนกับงานใหม่

545
00:25:20,838 --> 00:25:23,629
ย้อนกลับอะไรก็ตามที่ดูไม่ดี และสอง ประเด็น

546
00:25:23,629 --> 00:25:24,720
ที่ลึกกว่า

547
00:25:24,720 --> 00:25:29,505
ฮาร์เนสที่พัฒนาตัวเองได้สามารถรักษาสมมติฐานที่ผิดได้อย่างมีประสิทธิภาพพอ

548
00:25:29,505 --> 00:25:32,230
ๆ กับสมมติฐานที่ดี ความคงอยู่เป็นดาบสองคม

549
00:25:32,230 --> 00:25:35,686
นั่นคือเหตุผลที่ล็อกและการย้อนกลับไม่ใช่ของฟุ่มเฟือย

550
00:25:35,686 --> 00:25:37,347
มันคือเหตุผลทั้งหมดที่ตัว

551
00:25:37,347 --> 00:25:38,809
ปรับแต่งปลอดภัยพอจะรัน

552
00:25:38,809 --> 00:25:42,199
ทีนี้มาพูดถึงระบบขับเคลื่อนอัตโนมัติในส่วนที่ห้ากัน

553
00:25:42,199 --> 00:25:44,458
ทุกอย่างในคอร์สนี้สร้างมาสู่จุดนี้

554
00:25:44,458 --> 00:25:47,316
และทุกส่วนของ command engine ปรากฏในส่วนนี้

555
00:25:47,316 --> 00:25:50,174
โรงจอดรถจากส่วนที่หนึ่ง งาน ตรวจสอบ ปลายทาง

556
00:25:50,174 --> 00:25:52,699
จากส่วนที่สอง สกิลและทีม จากส่วนที่สาม

557
00:25:52,699 --> 00:25:55,025
พฤติกรรมที่ถูกปรับแต่งจากส่วนที่สี่

558
00:25:55,025 --> 00:25:57,285
และตอนนี้เครื่องยนต์รันโดยไม่มีคุณ

559
00:25:57,285 --> 00:25:58,547
ภายในกล่องที่คุณวาด

560
00:25:58,547 --> 00:26:01,006
ตรวจสอบด้วยการทดสอบที่มันเถียงไม่ขึ้น

561
00:26:01,006 --> 00:26:04,462
ระบบขับเคลื่อนอัตโนมัติรันตรงจากบรรทัดคำสั่งด้วยแฟล็

562
00:26:04,462 --> 00:26:05,553
ก --autonomous

563
00:26:05,553 --> 00:26:08,544
คุณตั้งเป้าหมายและขีดจำกัดในคำสั่งเดียวกันได้

564
00:26:08,544 --> 00:26:09,807
และขีดจำกัดนั้นจริง

565
00:26:09,807 --> 00:26:12,066
มีค่าเริ่มต้นจริงที่คุณเปลี่ยน ได้

566
00:26:12,066 --> 00:26:14,791
เพดานจำนวนการตอบสนองที่เอเจนต์สร้างได้ 12

567
00:26:14,791 --> 00:26:15,882
โดยค่าเริ่มต้น

568
00:26:15,882 --> 00:26:18,541
เพดานจำนวนโทเคนรวมที่มันใช้จ่ายได้ เพดาน

569
00:26:18,541 --> 00:26:21,066
จำนวนการสะกิดติดตาม (follow-up nudges)

570
00:26:21,066 --> 00:26:23,326
ที่ระบบฉีดเองได้ สามโดยค่าเริ่มต้น

571
00:26:23,326 --> 00:26:25,386
ขีดจำกัดเวลาอีกชั้น เครื่องยนต์

572
00:26:25,386 --> 00:26:26,477
รันตลอดไปไม่ได้

573
00:26:26,477 --> 00:26:28,537
และมันรันในกล่องที่คุณเป็นคนวาด

574
00:26:28,537 --> 00:26:31,528
แต่ขีดจำกัดไม่ใช่ส่วนพิเศษจริง ๆ ประตูตรวจสอบ

575
00:26:31,528 --> 00:26:33,256
(gates) ต่างหาก คือมี gate

576
00:26:33,256 --> 00:26:36,047
ซึ่งเป็นฟีเจอร์ที่ผมเห็นแค่จาก prime agent

577
00:26:36,047 --> 00:26:38,772
เท่านั้น พูดง่าย ๆ คือมันสร้างการทดสอบที่

578
00:26:38,772 --> 00:26:39,863
เอเจนต์ต้องผ่าน

579
00:26:39,863 --> 00:26:42,388
ก่อนที่มันจะถูกอนุญาตให้บอกว่างานเสร็จ

580
00:26:42,388 --> 00:26:44,581
มันค่อนข้างเคร่ง ถ้า gate ล้มเหลว

581
00:26:44,581 --> 00:26:47,173
ความล้มเหลวจะถูก ป้อนกลับเข้าไปในเซสชัน

582
00:26:47,173 --> 00:26:49,167
เอเจนต์ต้องทำงานต่อ แต่ละ gate

583
00:26:49,167 --> 00:26:52,025
มีขีดจำกัดการลองใหม่ สามครั้งโดยค่าเริ่มต้น

584
00:26:52,025 --> 00:26:53,952
และ timeout ห้านาทีต่อการตรวจ

585
00:26:53,952 --> 00:26:56,344
ตรวจที่ติดค้างจึงไม่ทำให้ทั้งรันค้าง

586
00:26:56,344 --> 00:26:59,003
คุณซ้อนหลาย gate บนงานเดียวได้ และมันรัน

587
00:26:59,003 --> 00:27:01,262
ตามลำดับ เอเจนต์ประกาศชัยชนะไม่ได้

588
00:27:01,262 --> 00:27:04,319
งานต้องผ่านการตรวจ หรืองานนั้นไม่เสร็จ พูดง่าย

589
00:27:04,319 --> 00:27:05,411
ๆ

590
00:27:05,411 --> 00:27:10,063
มันวนไปวนมาได้ และเอเจนต์แกล้งทำเป็นเสร็จไม่ได้ มันต้องวนต่อไปเรื่อย ๆ

591
00:27:10,063 --> 00:27:13,319
ทีนี้มาปิดวงรอบเรื่อง Factorio เพราะบทเรียนเต็ม ๆ

592
00:27:13,319 --> 00:27:18,702
ควรอยู่ตรงนี้ที่ระบบขับเคลื่อนอัตโนมัติ เอเจนต์นั้นถูกบอก เป็นลายลักษณ์อักษรซ้ำ ๆ

593
00:27:18,702 --> 00:27:20,231
ว่าห้ามโกง มันโกงอยู่ดี

594
00:27:20,231 --> 00:27:23,487
และวงรอบการพัฒนาตัวเองทำให้มันเป็นนักโกงที่ดีขึ้น

595
00:27:23,487 --> 00:27:24,949
เพราะ จากมุมมองของระบบ

596
00:27:24,949 --> 00:27:27,275
การโกงสร้างผลลัพธ์ที่ควรค่าแก่การจำ

597
00:27:27,275 --> 00:27:30,332
บทเรียนคือหนึ่งประโยค และมันเป็นประโยคที่สำคัญ

598
00:27:30,332 --> 00:27:31,424
ที่สุดในคอร์สนี้

599
00:27:31,424 --> 00:27:35,610
เอเจนต์ที่พัฒนาตัวเองได้จะเก่งขึ้นในสิ่งใดก็ตามที่ได้รางวัลจริง

600
00:27:35,610 --> 00:27:37,804
ไม่ใช่ในสิ่งที่คุณตั้งใจ นั่นหมาย

601
00:27:37,804 --> 00:27:43,585
ความว่าวิธีที่คุณตรวจงานตอนนี้สำคัญกว่าที่เคยเป็นมาในประวัติศาสตร์ของเครื่องมือเหล่านี้

602
00:27:43,585 --> 00:27:44,782
คุณจึงต้องแน่ใจว่า

603
00:27:44,782 --> 00:27:48,304
มีเกณฑ์ชัดเจนมากว่าผลงานและความสำเร็จหน้าตาเป็นแบบไหน

604
00:27:48,304 --> 00:27:51,162
อย่าทั่วไป อย่าคลุมเครือ และยังต้องตรวจล็อก

605
00:27:51,162 --> 00:27:52,253
ตรวจสิ่งที่มันทำ

606
00:27:52,253 --> 00:27:56,174
ถ้าคุณอยากได้หลักฐานว่าระบบขับเคลื่อนอัตโนมัติรับงานขนาดไหน

607
00:27:56,174 --> 00:27:58,965
ผู้พัฒนารัน benchmark ( การวัดประสิทธิภาพ)

608
00:27:58,965 --> 00:28:01,690
จริงที่เอเจนต์ต้องสร้าง hardware emulator

609
00:28:01,690 --> 00:28:03,152
(อีมูเลเตอร์ฮาร์ดแวร์)

610
00:28:03,152 --> 00:28:06,209
ที่ใช้งานได้จากศูนย์โดยสมบูรณ์ ไม่มี reference

611
00:28:06,209 --> 00:28:08,070
implementation (โค้ดอ้างอิง)

612
00:28:08,070 --> 00:28:11,459
ตรวจยืนยันด้วยโปรแกรมวินิจฉัยที่เทียบพฤติกรรมกับฮาร

613
00:28:11,459 --> 00:28:13,187
์ดแวร์จริง และ Prime Agent

614
00:28:13,187 --> 00:28:15,779
สร้างอีมูเลเตอร์ที่ใช้งานได้สำหรับ Sega

615
00:28:15,779 --> 00:28:18,703
Genesis และ Game Boy Color รุ่นดั้งเดิม ปกติ

616
00:28:18,703 --> 00:28:20,365
นั่นคืองานวิศวกรรมหลายวัน

617
00:28:20,365 --> 00:28:23,023
แต่ทำแบบอัตโนมัติและยืนยันด้วยการตรวจสอบ

618
00:28:23,023 --> 00:28:24,950
และทำด้วย Opus 5 หนึ่งในโมเดล

619
00:28:24,950 --> 00:28:27,675
ที่แข็งแกร่งที่สุดที่มีอยู่ ซึ่งล้มเหลวใน

620
00:28:27,675 --> 00:28:29,735
benchmark เดียวกันในฮาร์เนสอื่น

621
00:28:29,735 --> 00:28:31,928
ถึงแม้แต่ละขั้นตอนของมันจะดูประสบ

622
00:28:31,928 --> 00:28:34,121
ความสำเร็จระหว่างทาง สมองเดียวกัน

623
00:28:34,121 --> 00:28:36,049
แค่ฮาร์เนสต่าง ผลลัพธ์ตรงข้าม

624
00:28:36,049 --> 00:28:38,774
เครื่องยนต์ที่อยู่รอบโมเดลเป็นตัวกำหนดว่า

625
00:28:38,774 --> 00:28:40,900
โมเดลจะทำงานอะไรให้สำเร็จได้จริง

626
00:28:40,900 --> 00:28:43,691
นั่นคือเหตุผลทั้งหมดที่เครื่องมือนี้มีอยู่

627
00:28:43,691 --> 00:28:46,217
นี่คือ command engine เต็มรูปแบบที่รัน

628
00:28:46,217 --> 00:28:48,543
end-to-end โดยใช้ทุกอย่างในคอร์สนี้

629
00:28:48,543 --> 00:28:51,135
คุณมีเซสชันตามตารางเวลาที่เริ่ม กลางคืน

630
00:28:51,135 --> 00:28:54,059
เป้าหมาย: ผลิตรายงานคู่แข่งรายสัปดาห์ มันรัน

631
00:28:54,059 --> 00:28:56,983
call prep และสกิลงานวิจัยของคุณจากส่วนที่สาม

632
00:28:56,983 --> 00:28:58,246
มัน สร้าง sub agent

633
00:28:58,246 --> 00:29:00,838
สองตัวทำงานแหล่งข้อมูลแบบขนาน heartbeat

634
00:29:00,838 --> 00:29:03,562
ตรวจความคืบหน้าทุกสองสามนาที gate มาตรฐาน

635
00:29:03,562 --> 00:29:05,888
สองตัว ทางออก: ไฟล์รายงานต้องมีอยู่

636
00:29:05,888 --> 00:29:08,214
และทุกรายการต้องมีลิงก์แหล่งอ้างอิง

637
00:29:08,214 --> 00:29:10,541
ลองใหม่สามครั้งต่อตัว แล้วรันก็หยุด

638
00:29:10,541 --> 00:29:12,867
แทนที่จะส่งของเสียออกมา คุณตื่นขึ้น

639
00:29:12,867 --> 00:29:15,591
อ่านรายงานเหมือนเจ้าของที่ทบทวนงานพนักงาน

640
00:29:15,591 --> 00:29:18,582
แก้หนึ่งหรือสองจุด รัน /refine ให้การแก้ไขติด

641
00:29:18,582 --> 00:29:20,177
และดู refinement history

642
00:29:20,177 --> 00:29:23,101
สิบห้านาทีของความสนใจคุณ งานหลายชั่วโมงเสร็จ

643
00:29:23,101 --> 00:29:24,192
และ

644
00:29:24,192 --> 00:29:27,781
เครื่องยนต์ทั้งระบบปรับแต่งเก่งกว่าวันเมื่อวานเล็กน้อย

645
00:29:27,781 --> 00:29:30,041
นั่นคือ Prime Agent Command Engine

646
00:29:30,041 --> 00:29:31,503
ที่ประกอบเสร็จ สมบูรณ์

647
00:29:31,503 --> 00:29:34,095
ทีนี้มาพูดถึงข้อจำกัดบางอย่าง benchmark

648
00:29:34,095 --> 00:29:36,487
ผลลัพธ์ผสมกันในชุดทดสอบ long context

649
00:29:36,487 --> 00:29:38,680
(บริบทยาว) Prime agent กับ GM 5.2

650
00:29:38,680 --> 00:29:41,671
ชนะแปดในเก้าการทดสอบกับเฟรมเวิร์กคู่แข่ง ด้วย

651
00:29:41,671 --> 00:29:44,462
Opus 5 มันชนะ Claude Code เฉียด ๆ หกในเก้า

652
00:29:44,462 --> 00:29:46,722
ด้วย GPT 5.6 มันชนะ Codex หกในเก้า

653
00:29:46,722 --> 00:29:48,450
แต่ไม่ได้กวาดเรียบทุกอย่าง

654
00:29:48,450 --> 00:29:51,241
เครื่องมือที่ตั้งหลักแล้วยังชนะบางหมวดหมู่

655
00:29:51,241 --> 00:29:53,367
ขาดลอย และตัวเลขไฮไลต์ ARC AGI 3

656
00:29:53,367 --> 00:29:54,896
เป็นผลดีที่สุดจากสามรัน

657
00:29:54,896 --> 00:29:58,019
เปรียบเทียบกับตัวเลขที่เผยแพร่ของเครื่องมืออื่น

658
00:29:58,019 --> 00:30:01,342
แทนที่จะเป็นการแข่งขันตัวต่อตัวที่ควบคุมเต็มรูปแบบ

659
00:30:01,342 --> 00:30:04,931
เพราะการจำลองเซ็ตอัปคู่แข่งของทีมเองออกมาต่ำกว่าตัวเลข

660
00:30:04,931 --> 00:30:06,022
ทางการ

661
00:30:06,022 --> 00:30:08,880
และพวกเขาเลือกการเปรียบเทียบที่ยุติธรรมกว่า