▶SUBTHAIแปลไทย · ซับ · พากย์⚙
บทความแปลภาษาไทย · YouTube

How to Reduce Claude Code AI Tokens by 80% (FREE)

0:000:00
เล่นเสียงต้นฉบับของวิดีโอ พร้อมแสดงซับไทยซิงก์ตามเวลา
กำลังโหลดวิดีโอ…
01

สรุปย่อ

ประเด็นสำคัญจากวิดีโอ

- **ช่อง:** Julian Goldie SEO · **ความยาว:** ~15 นาที · **ลิงก์:** https://www.youtube.com/watch?v=rXuJ90FV9Y0

# สรุป: How to Reduce Claude Code AI Tokens by 80% (FREE)
- **ช่อง:** Julian Goldie SEO · **ความยาว:** ~15 นาที · **ลิงก์:** https://www.youtube.com/watch?v=rXuJ90FV9Y0

## ประเด็นหลัก
- ปัญหาที่แท้จริงไม่ใช่ token ที่เราพิมพ์ แต่คือ "รอยรั่ว" 4 จุดที่ทำให้ token สูญเปล่าโดยไม่รู้ตัว ได้แก่ ผลลัพธ์ของเครื่องมือ (tool output) ความสุภาพ/น้ำลายของ Claude งานที่สร้างเกินจำเป็น และการส่งงานง่าย ๆ ไปให้โมเดลระดับแนวหน้าที่แพงที่สุด
- ปลั๊กตัวที่ 1: RTK — กรองและบีบอัดผลลัพธ์ของคำสั่งที่ไหลเข้ากลางบทสนทนา ผลทดสอบจริงของผู้พูดลดการใช้ token ลง 82.9% โดยเพิ่มเวลาหน่วงเพียง ~14 มิลลิวินาที
- ปลั๊กตัวที่ 2: Caveman — บังคับให้ Claude ตอบสั้นตรงประเด็น ลด output token ลง 69% และลดการใช้ token โดยรวม ~30% โดยคำตอบยังคงถูกต้อง
- ปลั๊กตัวที่ 3: Ponytail — กัน Claude สร้างงานเกินจำเป็น ผลทดสอบลดปริมาณงานลง ~54% ต้นทุนถูกลง ~20% เร็วขึ้น 27% โดยไม่แตะเรื่องความปลอดภัยหรือการจัดการข้อผิดพลาด
- ปลั๊กตัวที่ 4: Omni Route — เกตเวย์ฟรีที่จัดเส้นทางงานง่าย ๆ ไปให้โมเดลฟรี 90 ตัวแทนแพ็กเกจเสียเงินของ Claude พร้อมบีบอัดคำขอเพิ่มอีก 15–95% กันชน rate limit ของโมเดลฟรี
- เมื่อรวมทั้ง 4 ตัว ประหยัดไม่ใช่การบวกกันแต่ทวีคูณ บางประเภทงานประหยัดได้เกิน 80% ไปไกล ผู้พูดยกตัวอย่างตัวเลขจริง: 82.9% (tool output), 69% (คำตอบ), ครึ่งหนึ่ง (ปริมาณงาน), 100% (งานที่ย้ายไปโมเดลฟรี)
- เทคนิคเสริม 8 ข้อ: ใช้ /clear จบงาน, ใช้ /compact ในงานยาว, ตัดแต่งไฟล์ Claude.md, จัดเส้นทางตามความยาก, วางแผนก่อนลงมือ, รวมคำขอเป็นชุด, ใช้ scout/sub agent, และใช้ memory vault (เช่น Obsidian) เพื่อไม่ต้องอธิบายบริบทซ้ำ
- ข้อควรรู้: การจัดเส้นทางไม่ได้ช่วยทุกงาน และ 80% ไม่ได้การันตีทุกงาน เซสชันที่ใช้เครื่องมือเยอะจะประหยัดที่สุด
- มุมมองใหม่: อย่าจ่ายค่าแพ็กเกจใหญ่เพื่อชดเชย token ที่รั่ว แก้ที่รอยรั่วก่อน แล้วส่วนใหญ่จะพบว่าไม่ต้องอัปเกรด
- ช่องทาง: ลิงก์ในคอมเมนต์/คำอธิบาย, airprofitable.com และ AI Profit Board Room ซึ่งมีชุดติดตั้งสำเร็จรูปใน Agentic Operating System พร้อมวิดีโอสอน คอลโค้ชรายสัปดาห์ และชุมชนสมาชิกกว่า 3,700 คน

## ความเห็นสรุป
คลิปนี้นำเสนอแนวทางปฏิบัติจริงที่จับต้องได้: ชี้รอยรั่วของ token อย่างเป็นระบบ ให้เครื่องมือฟรีที่ติดตั้งง่ายพร้อมตัวเลขทดสอบจริง ไม่ใช่แค่คำโฆษณา แม้จะมีส่วนโปรโมตสมาชิก AI Profit Board Room ในช่วงท้าย แต่เนื้อหาหลักทั้ง 4 ปลั๊กและ 8 เทคนิคใช้ได้ฟรีด้วยตัวเอง เหมาะสำหรับผู้ใช้ Claude Code ที่เจอปัญหา token หมดเร็วและอยากใช้แพ็กเกจเดิมให้คุ้มขึ้น
02

คำแปลเต็ม

แปลตามบทสนทนาต้นฉบับ ปรับเป็นภาษาไทยธรรมชาติ

ตอนนี้คุณสามารถลด token ของ Claude Code ลงได้ถึง 80% และฟรีด้วยนะครับ เอาล่ะ สิ่งที่คนส่วนใหญ่เข้าใจผิดก็คือ พอเจอขีดจำกัดของ token พวกเขาก็เริ่มพิมพ์ prompt ให้สั้นลง ถามคำถามน้อยลง แบ่ง token ใช้อย่างประหยัดเหมือนน้ำในทะเลทราย นั่นคือวิธีแก้อันผิด เพราะ token ที่คุณพิมพ์เข้าไปนั้นเป็นแค่เศษเสี้ยวเล็ก ๆ ของปัญหาจริง ๆ ปัญหาที่แท้จริงคือรอยรั่วซ่อนเร้นสี่จุดที่กำลังดูด token ของคุณไปเบื้องหลัง และวันนี้ผมจะโชว์วิธีอุดทั้งสี่จุดด้วยเครื่องมือฟรี ตัวละประมาณหนึ่งคำสั่งในการติดตั้ง พอติดตั้งเสร็จมันก็ทำงานอัตโนมัติตลอดไป ไม่ต้องไปแตะมันอีกเลย token ของคุณจะหยุดรั่วไหลเงียบ ๆ และ AI ของคุณจะทำงานได้มากขึ้นถึงห้าเท่า และคอยดูต่อไปนะครับ เพราะช่วงท้าย ๆ ผมจะโชว์สิ่งที่ทำให้ผมประหลาดใจที่สุด นั่นคือเครื่องมือที่ให้ AI ตัวที่สองทั้งตัวฟรี มาทำงานเคียงข้าง Claude เริ่มกันเลยครับ

ปัญหาที่แท้จริงคือสิ่งที่ผมเรียกว่าเครื่องยนต์กันรั่ว หรือพูดให้ถูกคือการที่คุณไม่มีมันนั่นแหละครับ การตั้งค่า Claude ของคุณมีรอยรั่วใหญ่สี่จุด และ token กำลังไหลออกจากทุกจุดโดยที่คุณไม่เคยเห็น แต่ถ้าอุดครบทั้งสี่จุด token ของคุณจะใช้ได้นานขึ้นประมาณห้าเท่า สมาชิกแพ็กเกจเดิม คุณภาพเท่าเดิม แต่ทำงานได้มากกว่ามาก งั้นขอโชว์รอยรั่วทั้งสี่ก่อน เพราะพอเห็นแล้วจะลบออกจากหัวไม่ได้ รอยรั่วข้อหนึ่งคือผลลัพธ์ของเครื่องมือ (tool output) เมื่อ Claude รันคำสั่งบนเครื่องของคุณ ผลลัพธ์ดิบ ๆ จะทะลักกลับเข้ามาในบทสนทนา ล็อกยักษ์ ข้อความเต็มกำแพงที่ Claude ไม่ได้จำเป็นต้องอ่านด้วยซ้ำ ทุกบรรทัดของมันคิดเงิน token คุณ รอยรั่วข้อสองคือความสุภาพของ Claude Claude สุภาพมากเกินไป มันเขียนสามย่อหน้าในขณะที่สามคำก็พอแล้ว เนื้อความฟุ่มเฟือยพวกนั้นทั้งหมดหักออกจากงบ token ของคุณ รอยรั่วข้อสามคืองานที่สร้างเกินความจำเป็น ขอให้ Claude สร้างของง่าย ๆ สักชิ้น มันมักจะสร้างเพิ่มอีกห้าอย่างเผื่อไว้ โครงสร้างเสริม ตัวเลือกเสริมที่ไม่มีใครขอ ทั้งหมดคือ token และรอยรั่วข้อสี่คือข้อที่ใหญ่ที่สุด คุณกำลังจ่ายเงินในราคาโมเดลระดับแนวหน้า (frontier model) เพื่อทำงานง่าย ๆ งานเล็ก ๆ น้อย ๆ ที่โมเดลฟรีจัดการได้อย่างสบาย ๆ กลับถูกส่งไปให้แพ็กเกจ Claude ราคาแพงของคุณ นี่คือรอยรั่วสี่จุด เครื่องมือฟรีสี่ตัว หนึ่งตัวต่อหนึ่งรอยรั่ว นั่นคือแผนกันรั่ว มาอุดทีละจุดกัน และระหว่างทางผมจะโชว์ตัวเลขผลทดสอบจริงของผมด้วย อยู่ดูกันต่อนะครับ เพราะข้อสี่นี่แหละทรงพลังที่สุด มันให้ AI ฟรีอีกตัวมาทำงานน่าเบื่อ ๆ แทนคุณ

ปลั๊กตัวที่หนึ่งคือ RTK RTK ทำหน้าที่คั่นกลางระหว่าง AI agent (เอเจนต์ AI) ของคุณกับคำสั่งต่าง ๆ มันรันอยู่บนคอมพิวเตอร์ของคุณ นึกภาพเหมือนไส้กรองที่ก๊อกน้ำ น้ำยังไหลผ่านได้ตามปกติ แต่สิ่งสกปรกไม่ผ่าน ดังนั้นเมื่อ Claude รันคำสั่ง RTK จะเขียนคำสั่งใหม่ให้กระชับ กรองผลลัพธ์ ตัดเสียงซ้ำซ้อนออก แล้วส่งเฉพาะสัญญาณสำคัญให้ Claude เท่านั้น ส่วนสำคัญจริง ๆ ไม่มีอะไรเกินนี้ โปรเจกต์ RTK อ้างว่าลด token ในผลลัพธ์รวมได้ถึง 90% ผมไม่ได้เชื่อตามคำโฆษณา ผมทดสอบด้วยตัวเองจริง ๆ ในการทดสอบของผม มันลดการใช้ token ลง 82.9% คำโฆษณาของพวกเขาแทบจะตรงเป๊ะ และนี่คือส่วนที่ทำให้ผมประหลาดใจ มันเพิ่มเวลาหน่วงแค่ประมาณ 14 มิลลิวินาทีเท่านั้น แค่นั้นจริง ๆ คุณจะไม่มีทางสังเกตเห็น คุณไม่เห็นมันทำงาน agent ของคุณก็ไม่ช้าลง token ของคุณแค่หยุดรั่วเงียบ ๆ

ตอนนี้คุณอาจกำลังคิดว่า เดี๋ยวก่อน ถ้ามันกรองผลลัพธ์ออก มันจะทำให้ AI agent ของฉันพังไหม? Claude จะพลาดอะไรสำคัญไปไหม? ไม่ครับ เพราะ RTK กรองเฉพาะเสียงรบกวนเชิงกลเท่านั้น บรรทัดซ้ำ ๆ เนื้อหาปาดขยาย สิ่งที่ Claude ไม่เคยต้องใช้ตั้งแต่แรก สัญญาณสำคัญผ่านไปแบบไม่ถูกแตะต้อง และในการทดสอบของผม คุณภาพของผลลัพธ์ยังเท่าเดิม แต่ค่าใช้จ่ายในการได้ผลลัพธ์นั้นลดลงกว่า 80% ยกตัวอย่างเช่น สมมติคุณให้ Claude ตรวจดูว่ามีอะไรเปลี่ยนไปในโฟลเดอร์เอกสาร ปกติมันจะถมล็อกขนาดใหญ่ยุ่งเหยิงเข้ามาในแชท แต่กับ RTK Claude จะเห็นเวอร์ชันสั้นสะอาดแล้วก็ทำงานต่อ นั่นคืออุดรอยรั่วข้อหนึ่งได้แล้ว แต่ RTK แก้ได้แค่สิ่งที่ไหลเข้าไปหา Claude รอยรั่วถัดไปคือสิ่งที่ไหลออกมา

ปลั๊กตัวที่สองคือ Caveman Caveman ทำตามชื่อเลยครับ มันทำให้ Claude พูดแบบมนุษย์ถ้ำ สั้น ตรงประเด็น ไม่มีน้ำลาย ปกติคุณถาม Claude คำถามเดียว มันจะตอบประมาณว่า คำถามดีมาก ยินดีช่วยเหลือคุณมาก ขอพาคุณไปทีละขั้นตอนนะ ทั้งหมดนั้นคือ token และเป็น token ของคุณเอง พอติดตั้ง Caveman คำตอบเดียวกันนั้นจะถูกตัดเหลือแค่คำตอบล้วน ๆ ในตัวอย่างหนึ่ง คำตอบปกติใช้ 69 token แต่เวอร์ชัน Caveman ใช้แค่ 19 token ข้อมูลเท่าเดิม แต่ต้นทุนเหลือไม่ถึงหนึ่งในสาม ผมทดสอบตัวนี้กับ Fable 5 ผลที่ได้คือ output token ลดลง 69% ซึ่งทำให้การใช้ token โดยรวมของผมลดลงประมาณ 30% และประเด็นสำคัญคือ ทุกคำตอบยังคงถูกต้อง มันตัดแค่เนื้อฟุ่มเฟือยเท่านั้น และตัดเฉพาะส่วนนั้นจริง ๆ ถ้าคุณคิดว่า แต่ผมชอบให้ Claude เป็นมิตรนะ ก็ได้ครับสำหรับการแชทเล่น แต่เมื่อ Claude ทำงาน 50 อย่างต่อเนื่องกัน คุณไม่ต้องการคำพูดหวาน ๆ 50 รอบหรอก คุณต้องการให้งานเสร็จ Caveman ทำให้งานเสร็จ

ตอนนี้ข้อมูลขาเข้าถูกกรองแล้ว คำตอบก็กระชับแล้ว แต่ยังมีรอยรั่วข้อสามซ่อนอยู่ในตัวงานเอง ปลั๊กตัวที่สามคือ Ponytail Ponytail หยุด Claude ไม่ให้สร้างงานเกินความจำเป็น เมื่อ Claude สร้างอะไรให้คุณ มันชอบเพิ่มของเสริม ชั้นที่คุณไม่ได้ขอ โครงสร้างสำหรับอนาคตที่อาจไม่มีวันมาถึง ชิ้นส่วนพิเศษ แปลว่า token มากขึ้นในตอนนี้ และ token มากขึ้นทุกครั้งที่ Claude ต้องย้อนกลับมาอ่านงานนั้นทีหลัง Ponytail ทำให้ Claude ทำตัวเหมือนนักพัฒนาเซียนที่ขี้เกียจ ใครสักคนที่ทำแบบนี้มานับพันครั้งแล้วรู้เส้นทางที่สั้นและปลอดภัยที่สุด มันสร้างสิ่งที่คุณขอเท่านั้น ไม่มีมากไปกว่านั้น ตัวเลขคือ ปริมาณงานลดลงประมาณ 54% ต้นทุนถูกลงประมาณ 20% และเร็วขึ้น 27% ในการทดสอบ ก่อนที่คุณจะกังวล ไม่ครับ มันไม่ได้ตัดมุมในเรื่องที่สำคัญ มันไม่แตะพื้นฐานด้านความปลอดภัย มันไม่ข้ามการจัดการข้อผิดพลาดหรือการตรวจสอบ มันข้ามแค่ส่วนเสริมเชิงคาดเดา พวกเผื่อไว้ว่าบางทีวันหนึ่งอาจต้องใช้ ซึ่งส่วนใหญ่คุณไม่เคยใช้จริง ๆ ปริมาณครึ่งหนึ่ง งานเสร็จเท่าเดิม และเพราะมีอะไรให้อ่านย้อนหลังน้อยลง ทุกเซสชันในอนาคตก็ถูกลงไปด้วย มันทบต้นกัน อุดไปแล้วสามรอยรั่ว

มาถึงตัวใหญ่กันต่อ ตัวที่เปลี่ยนเกมทั้งเกม ปลั๊กตัวที่สี่คือ Omni Route Omni Route คือเกตเวย์ฟรีที่รันอยู่บนเครื่องของคุณเอง สิ่งที่มันทำนั้นง่ายมาก มันจัดเส้นทางงานง่าย ๆ (grunt work) ไปให้โมเดล AI ฟรีแทนที่จะไปกินแพ็กเกจ Claude แบบเสียเงินของคุณ ลองนึกถึงวิธีบริหารธุรกิจสิครับ คุณไม่ส่งคนเก่งที่สุดไปคัดแยกจดหมาย แต่คนส่วนใหญ่กลับทำแบบนั้นกับ Claude งานเปลี่ยนชื่อ สรุปสั้น ๆ แก้ไขเล็ก ๆ น้อย ๆ งานซ้ำซากน่าเบื่อ ทั้งหมดถูกส่งไปให้โมเดลที่แพงที่สุดในโลก Omni Route ให้โมเดลฟรี 90 ตัวให้คุณเลือกใช้ รวมถึงโมเดลฟรีจริง ๆ งานง่ายก็ให้โมเดลฟรีจัดการ งานยากก็ให้ Claude จัดการ token แบบเสียเงินของคุณจะถูกใช้เฉพาะที่มันคุ้มค่าจริง ๆ เท่านั้น และนี่คือจุดที่ฉลาด Omni Route มีระบบบีบอัดแบบ RTK และ Caveman ติดตั้งอยู่ในตัวเกตเวย์แล้ว ดังนั้นแม้แต่คำขอที่ส่งไปหาโมเดลฟรีก็ถูกบีบอัดเพิ่มอีก 15 ถึง 95% ซึ่งสำคัญเพราะโมเดลฟรีก็มีขีดจำกัดอัตราการใช้งาน (rate limit) เช่นกัน และนี่ช่วยให้คุณไม่ชนเพดานนั้น เรารันชุดติดตั้งแบบนี้จริง ๆ เป็นเครื่องยนต์เขียนโค้ดฟรีภายใน Agentic Operating System (ระบบปฏิบัติการแบบ Agentic) ของเรา งานน่าเบื่อถูกส่งออกไปให้โมเดลฟรีแบบบีบอัด งานสำคัญอยู่กับ Claude ก็บีบอัดเช่นกัน ทุกอย่างถูกลงพร้อมกัน

ขอหยุดตรงนี้สักครู่ เพราะผมรู้ว่าบางคนกำลังคิดว่า Julian นี่มันดูเทคนิคเกินไป ฉันไม่ใช่นักเขียนโค้ด นี่ไม่เหมาะกับฉัน ผมเข้าใจ แต่ความจริงคือ ผมเองก็ไม่ใช่คนสายเทคนิค แต่ละตัวติดตั้งด้วยคำสั่งเดียวแทบจะทั้งนั้น ทั้งชุดใช้เวลาติดตั้งประมาณ 15 นาที และหลังจากนั้นมันอัตโนมัติ ไม่ต้องแตะอีกเลย และถ้ารู้สึกว่ายังเยอะเกินไป เราทำไว้ให้คุณแล้ว ภายใน AI Profit Board Room ชุดลด token ทั้งหมดนี้ถูกสร้างไว้ล่วงหน้าใน Agentic Operating System แล้ว คุณจะได้ไฟล์ zip คำแนะนำวิดีโอทีละขั้นตอนที่โชว์วิธีติดตั้ง RTK, Caveman, Ponytail และ Omni Route อย่างละเอียด และได้คู่มือลด token ฉบับเต็ม เพื่อที่คุณจะไม่เจอขีดจำกัดของ Claude กลางงานอีก เราอัปเดต Agent OS ทุกวัน เมื่อเครื่องมือพวกนี้พัฒนาขึ้น ชุดติดตั้งของคุณก็พัฒนาตามไปด้วย ผมช่วยเจ้าของธุรกิจกว่า 3,700 คนในนั้นแล้ว และหลายคนไม่เคยแตะ AI มาก่อนเลยด้วยซ้ำตอนที่เข้ามา ลิงก์อยู่ในคอมเมนต์และคำอธิบายใต้คลิป หรือไปที่ airprofitable.com เพื่อเข้าใช้งาน

สรุปคือปลั๊กทั้งสี่ตัว RTK กรองข้อมูลขาเข้า Caveman ย่อคำตอบ Ponytail ตัดทอนผลงาน Omni Route ส่งงานง่าย ๆ ไปให้โมเดลฟรี นี่คือเครื่องจักรกันรั่ว แต่จะเกิดอะไรขึ้นเมื่อรวมทั้งสี่ตัวเข้าด้วยกัน? เพราะตรงนี้แหละที่น่าสนใจจริง ๆ เงินที่ประหยัดได้ไม่ได้แค่บวกกัน แต่มันทวีคูณ RTK ลดผลลัพธ์จากเครื่องมือของผมลง 82.9% Caveman ลด token คำตอบลง 69% Ponytail ลดปริมาณงานลงประมาณครึ่งหนึ่ง และ Omni Route เอางานทั้งก้อนออกจากแพ็กเกจเสียเงินของคุณไปเลย คิดเป็นเงินออม 100% สำหรับงานพวกนั้น ดังนั้นถ้าคุณรันทั้งสี่ตัวพร้อมกัน แล้วแต่ประเภทงานที่ทำ คุณอาจทะลุเกิน 80% ไปไกลได้ในงานบางประเภท นี่คือความรู้สึกจริงที่เกิดขึ้นกับผม ก่อนมีชุดนี้ ทุกเซสชัน Claude Code มีรูปแบบเดียวกัน เริ่มเร็ว ไหลลื่น พอ context (บริบท) พองโตก็ชนขีดจำกัด หยุด รอ และความกังวลเรื่อง token ก็วนเวียนอยู่ที่ก้นสมองตลอดเวลา กลัวจะถามอะไร Claude เพราะกลัวว่ามันจะกินเวลาที่เหลือของเซสชัน ตอนนี้ สมาชิกแพ็กเกจเดิม แต่ผมรัน agent หลายตัวพร้อมกัน ทำงานได้ต่อเซสชันมากขึ้น และความกังวลหายไปเพราะท่อถูกซ่อมแล้ว token ไหลไปที่ที่ควรไป และไม่มีทางอื่น

ต่อมา ขอแถมเทคนิคพิเศษอีกแปดข้อเพิ่มจากชุดหลัก ฟรี ใช้เวลาไม่กี่วินาที และคนส่วนใหญ่ข้ามไปหมด ข้อหนึ่ง พิมพ์ /clear เมื่อทำงานเสร็จ มันล้าง context เก่าทิ้ง งานถัดไปจึงเริ่มต้นสดใหม่แทนที่จะลากภาระเก่าติดตัวไป context เก่าคือรอยรั่วล้วน ๆ ล้างมันทิ้ง ข้อสอง ในงานยาวเดี่ยว ๆ ให้รัน /compact มันจะสรุปประวัติการสนทนาแทนที่จะแบกทั้งก้อนไปด้วย Claude เก็บใจความสำคัญแล้วทิ้งส่วนที่หนัก ข้อสาม ควบคุมอาหารให้ไฟล์ Claude.md ของคุณ นั่นคือไฟล์คำสั่งที่เดินทางไปด้วยทุกเซสชัน กฎทุกข้อในนั้นกิน token ทุกครั้ง คนส่วนใหญ่ลบทิ้งได้ครึ่งหนึ่งโดยไม่มีอะไรพัง และนี่ไม่ใช่แค่ผมพูดเอง ทีมงานของ Claude เองออกคู่มือที่พวกเขาตัดระบบของตัวเองลงประมาณ 80% แล้วได้คุณภาพเท่าเดิม ข้อสี่ จัดเส้นทางตามความยาก งานง่ายส่งไปโมเดลราคาถูกหรือฟรีผ่าน Omni Route งานยากส่งไปหา Claude ถามตัวเองก่อนทุกงานว่างานนี้จำเป็นต้องใช้โมเดลที่ดีที่สุดในโลกจริงไหม? ส่วนใหญ่คำตอบคือไม่ ข้อห้า วางแผนก่อนลงมือ เมื่อ Claude วางแผนก่อนแล้วค่อยลงมือ มันจะวกวนน้อยลง การวกวนคือ token แผนสองนาทีช่วยให้คุณไม่ต้องลองผิดลองถูกเป็นกอง ข้อหก รวมคำขอเป็นชุด แทนที่จะส่งคำขอเล็ก ๆ ห้าอันทีละอัน ซึ่ง Claude ต้องอ่าน context ชุดเดิมห้ารอบ ให้ส่งรวมกันในครั้งเดียว อ่าน context หนึ่งรอบ ทำงานเสร็จห้างาน ข้อเจ็ด ใช้หน่วยสอดแนม (scout) คุณให้ sub agent (เอเจนต์ย่อย) ไปขุดคุ้ยข้อมูลก้อนใหญ่ ๆ ด้วยตัวเองได้ หน่วยสอดแนมใช้ context ของมันเอง แล้วรายงานกลับมาแค่บทสรุป เซสชันหลักของคุณจ่ายแค่ค่าสรุป ไม่เคยจ่ายค่าค้นหา และข้อแปด ใช้คลังความจำ (memory vault) เช่น ภายใน Agentic Operating System ของเรา เราต่อ Obsidian memory เข้าไป เอเจนต์รู้บริบทของเราอยู่แล้ว ไม่ต้องอธิบายซ้ำว่าคุณเป็นใครหรือกำลังทำอะไรตอนเริ่มทุกเซสชัน การอธิบายซ้ำนี่แหละคือหนึ่งในรอยรั่วที่แอบแฝงที่สุด

มาพูดถึงวิธีแบบเก่ากับวิธีแบบใหม่กัน เพราะนี่คือการเปลี่ยนวิธีคิดเรื่อง token จริง ๆ วิธีแบบเก่าคือคุณมอง token เป็นทรัพยากรที่หายาก คุณพิมพ์สั้นลง ถามน้อยลง รู้สึกใจสั่นเล็กน้อยก่อนทุกงาน คุณถนอมใช้ รอคอยการรีเซ็ต ตั้งใจใช้ AI น้อยลงเพียงเพื่อให้ขีดจำกัดอยู่ได้นานขึ้น ส่วนวิธีแบบใหม่ คุณซ่อมท่อประปาครั้งเดียว ใช้เวลาติดตั้ง 15 นาที เครื่องมือฟรีสี่ตัว เสียงรบกวนถูกกรอง ผลงานถูกตัดทอน คำตอบถูกย่อ และงานง่าย ๆ ถูกส่งไปโมเดลฟรีอัตโนมัติตลอดไป แล้วคุณก็เลิกถนอมและเริ่มทำมากขึ้น นั่นคือประเด็นทั้งหมด นี่ไม่ใช่เรื่องของการใช้ AI น้อยลง แต่ตรงกันข้ามเลย เมื่อแต่ละงานมีต้นทุนเหลือหนึ่งในห้าของเดิม คุณก็รันงานได้ห้าเท่า agent มากขึ้น เซสชันมากขึ้น ทำงานเสร็จในวันมากขึ้น

ขอพูดอีกสองสามเรื่อง เพราะผมสัญญาว่าจะให้ข้อเท็จจริง ไม่ใช่โฆษณาเกินจริง ข้อเสียคืออะไร? ส่วนของการจัดเส้นทางจะใช้ไม่ได้กับทุกอย่าง ถ้างานทุกชิ้นที่คุณรันต้องใช้โมเดลระดับแนวหน้าจริง ๆ Omni Route ก็ช่วยได้น้อยลง แต่ลองซื่อสัตย์กับตัวเองดูสิว่า สิ่งที่คุณส่งให้ Claude นั้น มีสัดส่วนเท่าไหร่ที่ต้องใช้ Claude จริง ๆ? สำหรับคนส่วนใหญ่ สัดส่วนใหญ่ ๆ ไม่ได้ต้องใช้เลย และแม้แต่งานที่ต้องใช้ Claude RTK หรือ Caveman กับ Ponytail ก็ยังลดการใช้ของคุณตลอดเวลา แล้ว 80% การันตีทุกงานไหม? ไม่ครับ มันขึ้นอยู่กับว่าคุณกำลังทำอะไร เซสชันที่ใช้เครื่องมือเยอะ มีคำสั่งมาก จะประหยัดได้มากที่สุด เพราะนั่นคือจุดที่ RTK ทำได้ดีที่สุด แต่ในวันทำงานจริงที่รันชุดเต็มทั้งวัน การประหยัดนั้นมหาศาล ตัวเลขของผมมาจากการทดสอบของผมเอง 82.9% สำหรับผลลัพธ์จากเครื่องมือ 69% สำหรับ token คำตอบ และปริมาณงานลดลงประมาณครึ่งหนึ่ง นั่นไม่ใช่ตัวเลขคาดการณ์ นั่นคือสิ่งที่ผมวัดได้จริง

คุณอาจคิดอีกว่า จะไปเปลืองแรงประหยัด token ทำไม เดี๋ยวก็จ่ายซื้อแพ็กเกจใหญ่เอง คุณทำได้ครับ แต่ลองคิดดูว่าคุณกำลังจ่ายเพื่ออะไรจริง ๆ คุณจะจ่ายเต็มราคาเพื่อให้ล็อกถูกปาดขยาย คำตอบถูกถมน้ำลาย งานง่าย ๆ ถูกส่งไปโมเดลแพงทั้งที่โมเดลฟรีก็ทำได้ และแม้แต่แพ็กเกจใหญ่ที่สุด คุณก็ยังชนขีดจำกัด แค่ช้ากว่าเดิม โดยที่เผา token ไปมากกว่าเพื่อไปถึงจุดนั้น ซ่อมรอยรั่วก่อน แล้วค่อยตัดสินใจว่าคุณยังต้องอัปเกรดแพ็กเกจไหม คนส่วนใหญ่พบว่าไม่ต้อง

และยังมีความเชื่ออีกข้อที่ควรทลาย บางคนคิดว่ายังไงก็ต้องชนขีดจำกัดอยู่ดี นั่นคือธรรมชาติของ Claude แต่จริง ๆ แล้วไม่ใช่ ขีดจำกัดคือเพดานของ token และ token ส่วนใหญ่ของคุณกำลังถูกทิ้งไปกับสิ่งที่คุณไม่เคยเห็นด้วยซ้ำ ปัญหาที่แท้จริงไม่เคยอยู่ที่ขีดจำกัด แต่อยู่ที่รอยรั่วต่างหาก นี่คือสิ่งที่ควรทำต่อไป ติดตั้ง RTK ก่อน มันให้ผลตอบแทนเดี่ยวที่คุ้มที่สุด และคุณจะเห็นความต่างในเซสชันแรก จากนั้นเพิ่ม Caveman สำหรับคำตอบ แล้ว Ponytail แล้วตั้งค่า Omni Route และเริ่มส่งงานง่าย ๆ ของคุณไปโมเดลฟรี ตัวละหนึ่งคำสั่ง รวม 15 นาที จากนั้นเพิ่มนิสัยแปดข้อต่อ: /clear, /compact, ตัดแต่งไฟล์ Claude.md, จัดเส้นทางตามความยาก, วางแผนก่อน, ทำงานเป็นชุด, ใช้ scout และใช้ memory หรือถ้าอยากได้ทางลัด ภายใน AI Profit Board Room เครื่องจักรกันรั่วทั้งตัวถูกเดินสายไว้ใน Agentic Operating System แล้ว ครบทั้งสี่โปรเจกต์ ตั้งค่าล่วงหน้าแล้ว ทำงานร่วมกันกับ Claude, Hermes และเอเจนต์อื่น ๆ ที่คุณมีในระบบเดียว เอเจนต์ทุกตัวที่คุณรันได้ประโยชน์จากการบีบอัด ไม่ใช่แค่ตัวเดียว คุณยังได้ไฟล์ zip สำหรับติดตั้ง วิดีโอสอนทีละขั้น แผน 30 วันสำหรับนำไปใช้ในธุรกิจของคุณ และอัปเดตรายวันเมื่อเราพัฒนาระบบให้ดีขึ้น มีหมวดการลด token ฉบับเต็มในห้องเรียน พร้อมคู่มือทีละขั้นสำหรับชุดติดตั้งนี้โดยเฉพาะ คอลโค้ชสัปดาห์ละสี่ครั้งที่คุณถามเรื่องการตั้งค่า Claude Code ของคุณสด ๆ แล้วแก้ให้จบในคอล และชุมชนเจ้าของธุรกิจที่รันเอเจนต์พวกนี้อยู่จริงในตอนนี้ หลายคนเริ่มจากไม่มีความรู้เทคนิคเลย และมีบันทึกความสำเร็จจากสมาชิกกว่า 200 หน้าเป็นเครื่องพิสูจน์ คุณโพสต์คำถามตอนตีสอง ยังมีคนออนไลน์มาช่วย ลิงก์อยู่ในคอมเมนต์และคำอธิบายใต้คลิป หรือไปที่ AI Profit Board Room เพื่อเข้าใช้งาน

token ของคุณไม่เคยเป็นปัญหา ปัญหาคือรอยรั่ว อุดมันครั้งเดียว แล้ว AI ของคุณจะไปได้ไกลขึ้นห้าเท่า เริ่มตั้งแต่วันนี้ ขอบคุณที่รับชมครับ แล้วเจอกันข้างใน

03

หมายเหตุการแปล

ความโปร่งใสเกี่ยวกับความไม่แน่นอนในต้นฉบับ

  • ## ส่วนที่ฟังไม่ชัด / สงสัย (จากคำบรรยายอัตโนมัติ)
  • "Fable 5"** (ช่วง ~t=4:24, "I tested this one on Fable 5") — น่าจะเป็นข้อผิดพลาดของคำบรรยายอัตโนมัติ ไม่ชัดเจนว่าหมายถึงอะไร (อาจเป็นชื่อชุดทดสอบหรือผลิตภัณฑ์) แปลคงชื่อไว้ตามต้นฉบับว่า "Fable 5"
  • ไม่มีส่วนที่ต้องเขียน [ฟังไม่ชัด] ในตัวบท เนื่องจากทุกจุดที่คลุมเครือพอจะกู้ความหมายจากบริบทได้ และได้ระบุไว้ข้างต้น
04

อภิธานศัพท์เทคนิค

คำศัพท์และชื่อผลิตภัณฑ์ที่คงรูปภาษาอังกฤษ

ศัพท์คำแปล / คำอธิบาย
Claude Codeเครื่องมือเขียนโค้ดด้วย AI ของ Anthropic ที่รันบนเครื่องของผู้ใช้
tokenหน่วยนับการใช้ทรัพยากรของโมเดล AI ใช้คิดค่าบริการและกำหนดขีดจำกัดการใช้งาน
AI agentเอเจนต์ AI ผู้ช่วยอัตโนมัติที่ลงมือทำงานแทนผู้ใช้ได้เอง
sub agent / scoutเอเจนต์ย่อยที่ใช้ขุดคุ้ยข้อมูลก้อนใหญ่ด้วยตัวเอง แล้วรายงานกลับมาแค่บทสรุป
promptคำสั่งหรือข้อความที่ผู้ใช้ป้อนให้ AI
frontier modelโมเดล AI ระดับแนวหน้าที่มีความสามารถสูงสุดและแพงที่สุด
tool outputผลลัพธ์ดิบที่เครื่องมือ/คำสั่งส่งกลับเข้ามาในบทสนทนาของ AI
contextบริบทของบทสนทนาที่ AI ต้องอ่านทุกครั้ง ยิ่งมากยิ่งกิน token
grunt workงานง่าย ๆ ซ้ำซากที่ไม่จำเป็นต้องใช้โมเดลระดับสูง
rate limitขีดจำกัดอัตราการใช้งานของโมเดล (เช่น จำนวนคำขอต่อช่วงเวลา)
RTKเครื่องมือฟรีที่คั่นกลางระหว่าง AI agent กับคำสั่ง กรองและบีบอัดผลลัพธ์ที่ไหลเข้ากลางสนทนา
Cavemanเครื่องมือฟรีที่บังคับให้ Claude ตอบสั้นตรงประเด็น ลด token ฝั่งคำตอบ
Ponytailเครื่องมือฟรีที่กัน Claude สร้างงานเกินความจำเป็น ลดปริมาณผลงาน
Omni Routeเกตเวย์ฟรีที่จัดเส้นทางงานง่าย ๆ ไปให้โมเดลฟรีแทนโมเดลเสียเงิน
Claude.mdไฟล์คำสั่งที่ Claude อ่านทุกเซสชัน ยิ่งมีกฎมากยิ่งกิน token
/clearคำสั่งล้าง context เก่าเมื่อจบงาน เพื่อเริ่มต้นงานใหม่สด ๆ
/compactคำสั่งสรุปประวัติการสนทนาแทนการแบก context ทั้งก้อนต่อไป
Agentic Operating System (Agent OS)ระบบปฏิบัติการแบบ Agentic ที่รวมเอเจนต์ AI หลายตัวไว้ในระบบเดียว
AI Profit Board Roomชุมชน/ห้องสมาชิกของ Julian Goldie SEO ที่มีชุดติดตั้งและคอลโค้ช
airprofitable.comเว็บไซต์สำหรับเข้าถึงชุดเครื่องมือและสมาชิก
Hermesเอเจนต์ AI ที่ทำงานร่วมกับ Claude ได้ในระบบเดียวกัน
Obsidian memoryคลังความจำที่เชื่อมต่อกับเอเจนต์ ให้รู้บริบทโดยไม่ต้องอธิบายซ้ำ
memory vaultคลังความจำที่เก็บบริบทของงาน เพื่อลดการอธิบายซ้ำตอนเริ่มเซสชัน
coaching callคอลปรึกษาสดที่ผู้ใช้ถามปัญหาการตั้งค่าและแก้ให้จบในคอล
zip fileไฟล์บีบอัดที่ใช้ติดตั้งชุดเครื่องมือ
leakรอยรั่ว จุดที่ทำให้ token สูญเปล่าโดยไม่เกิดประโยชน์
05

ซับไตเติ้ลภาษาไทย

ดาวน์โหลดหรือดูซับทั้งหมด

1
00:00:00,000 --> 00:00:02,653
ตอนนี้คุณสามารถลด token ของ Claude Code

2
00:00:02,653 --> 00:00:05,102
ลงได้ถึง 80% และฟรีด้วยนะครับ เอาล่ะ

3
00:00:05,102 --> 00:00:07,211
สิ่งที่คนส่วนใหญ่เข้าใจผิดก็คือ

4
00:00:07,211 --> 00:00:10,000
พอเจอขีดจำกัดของ token พวกเขาก็เริ่มพิมพ์
thai-subtitles.srt
SubRip — ใช้กับเครื่องเล่นวิดีโอส่วนใหญ่
↓ ดาวน์โหลด
thai-subtitles.vtt
WebVTT — ใช้กับเว็บ / YouTube
↓ ดาวน์โหลด
เปิดดูซับไตเติ้ลทั้งหมด (358 segments)
1
00:00:00,000 --> 00:00:02,653
ตอนนี้คุณสามารถลด token ของ Claude Code

2
00:00:02,653 --> 00:00:05,102
ลงได้ถึง 80% และฟรีด้วยนะครับ เอาล่ะ

3
00:00:05,102 --> 00:00:07,211
สิ่งที่คนส่วนใหญ่เข้าใจผิดก็คือ

4
00:00:07,211 --> 00:00:10,000
พอเจอขีดจำกัดของ token พวกเขาก็เริ่มพิมพ์

5
00:00:10,000 --> 00:00:12,857
prompt ให้สั้นลง ถามคำถามน้อยลง แบ่ง token

6
00:00:12,857 --> 00:00:15,170
ใช้อย่างประหยัดเหมือนน้ำในทะเลทราย

7
00:00:15,170 --> 00:00:17,347
นั่นคือวิธีแก้อันผิด เพราะ token

8
00:00:17,347 --> 00:00:20,272
ที่คุณพิมพ์เข้าไปนั้นเป็นแค่เศษเสี้ยวเล็ก ๆ

9
00:00:20,272 --> 00:00:21,367
ของปัญหาจริง ๆ

10
00:00:21,367 --> 00:00:24,769
ปัญหาที่แท้จริงคือรอยรั่วซ่อนเร้นสี่จุดที่กำลังดูด

11
00:00:24,769 --> 00:00:26,401
token ของคุณไปเบื้องหลัง

12
00:00:26,401 --> 00:00:29,871
และวันนี้ผมจะโชว์วิธีอุดทั้งสี่จุดด้วยเครื่องมือฟรี

13
00:00:29,871 --> 00:00:32,184
ตัวละประมาณหนึ่งคำสั่งในการติดตั้ง

14
00:00:32,184 --> 00:00:34,837
พอติดตั้งเสร็จมันก็ทำงานอัตโนมัติตลอดไป

15
00:00:34,837 --> 00:00:36,673
ไม่ต้องไปแตะมันอีกเลย token

16
00:00:36,673 --> 00:00:38,442
ของคุณจะหยุดรั่วไหลเงียบ ๆ

17
00:00:38,442 --> 00:00:43,612
และ AI ของคุณจะทำงานได้มากขึ้นถึงห้าเท่า และคอยดูต่อไปนะครับ เพราะช่วงท้าย ๆ

18
00:00:43,612 --> 00:00:46,129
ผมจะโชว์สิ่งที่ทำให้ผมประหลาดใจที่สุด

19
00:00:46,129 --> 00:00:49,259
นั่นคือเครื่องมือที่ให้ AI ตัวที่สองทั้งตัวฟรี

20
00:00:49,259 --> 00:00:51,912
มาทำงานเคียงข้าง Claude เริ่มกันเลยครับ

21
00:00:51,912 --> 00:00:55,517
ปัญหาที่แท้จริงคือสิ่งที่ผมเรียกว่าเครื่องยนต์กันรั่ว

22
00:00:55,517 --> 00:00:58,578
หรือพูดให้ถูกคือการที่คุณไม่มีมันนั่นแหละครับ

23
00:00:58,578 --> 00:01:01,503
การตั้งค่า Claude ของคุณมีรอยรั่วใหญ่สี่จุด

24
00:01:01,503 --> 00:01:02,599
และ token

25
00:01:02,599 --> 00:01:05,252
กำลังไหลออกจากทุกจุดโดยที่คุณไม่เคยเห็น

26
00:01:05,252 --> 00:01:07,156
แต่ถ้าอุดครบทั้งสี่จุด token

27
00:01:07,156 --> 00:01:09,469
ของคุณจะใช้ได้นานขึ้นประมาณห้าเท่า

28
00:01:09,469 --> 00:01:11,646
สมาชิกแพ็กเกจเดิม คุณภาพเท่าเดิม

29
00:01:11,646 --> 00:01:13,075
แต่ทำงานได้มากกว่ามาก

30
00:01:13,075 --> 00:01:14,980
งั้นขอโชว์รอยรั่วทั้งสี่ก่อน

31
00:01:14,980 --> 00:01:17,293
เพราะพอเห็นแล้วจะลบออกจากหัวไม่ได้

32
00:01:17,293 --> 00:01:20,286
รอยรั่วข้อหนึ่งคือผลลัพธ์ของเครื่องมือ (tool

33
00:01:20,286 --> 00:01:23,347
output) เมื่อ Claude รันคำสั่งบนเครื่องของคุณ

34
00:01:23,347 --> 00:01:26,000
ผลลัพธ์ดิบ ๆ จะทะลักกลับเข้ามาในบทสนทนา

35
00:01:26,000 --> 00:01:28,449
ล็อกยักษ์ ข้อความเต็มกำแพงที่ Claude

36
00:01:28,449 --> 00:01:30,286
ไม่ได้จำเป็นต้องอ่านด้วยซ้ำ

37
00:01:30,286 --> 00:01:32,463
ทุกบรรทัดของมันคิดเงิน token คุณ

38
00:01:32,463 --> 00:01:35,320
รอยรั่วข้อสองคือความสุภาพของ Claude Claude

39
00:01:35,320 --> 00:01:36,415
สุภาพมากเกินไป

40
00:01:36,415 --> 00:01:39,068
มันเขียนสามย่อหน้าในขณะที่สามคำก็พอแล้ว

41
00:01:39,068 --> 00:01:41,993
เนื้อความฟุ่มเฟือยพวกนั้นทั้งหมดหักออกจากงบ

42
00:01:41,993 --> 00:01:43,088
token ของคุณ

43
00:01:43,088 --> 00:01:45,878
รอยรั่วข้อสามคืองานที่สร้างเกินความจำเป็น

44
00:01:45,878 --> 00:01:48,259
ขอให้ Claude สร้างของง่าย ๆ สักชิ้น

45
00:01:48,259 --> 00:01:50,776
มันมักจะสร้างเพิ่มอีกห้าอย่างเผื่อไว้

46
00:01:50,776 --> 00:01:53,565
โครงสร้างเสริม ตัวเลือกเสริมที่ไม่มีใครขอ

47
00:01:53,565 --> 00:01:54,660
ทั้งหมดคือ token

48
00:01:54,660 --> 00:01:57,041
และรอยรั่วข้อสี่คือข้อที่ใหญ่ที่สุด

49
00:01:57,041 --> 00:01:59,694
คุณกำลังจ่ายเงินในราคาโมเดลระดับแนวหน้า

50
00:01:59,694 --> 00:02:02,619
(frontier model) เพื่อทำงานง่าย ๆ งานเล็ก ๆ

51
00:02:02,619 --> 00:02:05,204
น้อย ๆ ที่โมเดลฟรีจัดการได้อย่างสบาย ๆ

52
00:02:05,204 --> 00:02:08,129
กลับถูกส่งไปให้แพ็กเกจ Claude ราคาแพงของคุณ

53
00:02:08,129 --> 00:02:10,782
นี่คือรอยรั่วสี่จุด เครื่องมือฟรีสี่ตัว

54
00:02:10,782 --> 00:02:13,571
หนึ่งตัวต่อหนึ่งรอยรั่ว นั่นคือแผนกันรั่ว

55
00:02:13,571 --> 00:02:14,667
มาอุดทีละจุดกัน

56
00:02:14,667 --> 00:02:17,864
และระหว่างทางผมจะโชว์ตัวเลขผลทดสอบจริงของผมด้วย

57
00:02:17,864 --> 00:02:19,088
อยู่ดูกันต่อนะครับ

58
00:02:19,088 --> 00:02:21,878
เพราะข้อสี่นี่แหละทรงพลังที่สุด มันให้ AI

59
00:02:21,878 --> 00:02:24,122
ฟรีอีกตัวมาทำงานน่าเบื่อ ๆ แทนคุณ

60
00:02:24,122 --> 00:02:25,959
ปลั๊กตัวที่หนึ่งคือ RTK RTK

61
00:02:25,959 --> 00:02:29,088
ทำหน้าที่คั่นกลางระหว่าง AI agent (เอเจนต์ AI)

62
00:02:29,088 --> 00:02:30,517
ของคุณกับคำสั่งต่าง ๆ

63
00:02:30,517 --> 00:02:32,490
มันรันอยู่บนคอมพิวเตอร์ของคุณ

64
00:02:32,490 --> 00:02:34,463
นึกภาพเหมือนไส้กรองที่ก๊อกน้ำ

65
00:02:34,463 --> 00:02:37,388
น้ำยังไหลผ่านได้ตามปกติ แต่สิ่งสกปรกไม่ผ่าน

66
00:02:37,388 --> 00:02:39,633
ดังนั้นเมื่อ Claude รันคำสั่ง RTK

67
00:02:39,633 --> 00:02:42,218
จะเขียนคำสั่งใหม่ให้กระชับ กรองผลลัพธ์

68
00:02:42,218 --> 00:02:45,279
ตัดเสียงซ้ำซ้อนออก แล้วส่งเฉพาะสัญญาณสำคัญให้

69
00:02:45,279 --> 00:02:47,388
Claude เท่านั้น ส่วนสำคัญจริง ๆ

70
00:02:47,388 --> 00:02:50,449
ไม่มีอะไรเกินนี้ โปรเจกต์ RTK อ้างว่าลด token

71
00:02:50,449 --> 00:02:53,578
ในผลลัพธ์รวมได้ถึง 90% ผมไม่ได้เชื่อตามคำโฆษณา

72
00:02:53,578 --> 00:02:56,231
ผมทดสอบด้วยตัวเองจริง ๆ ในการทดสอบของผม

73
00:02:56,231 --> 00:02:58,000
มันลดการใช้ token ลง 82.9%

74
00:02:58,000 --> 00:02:59,905
คำโฆษณาของพวกเขาแทบจะตรงเป๊ะ

75
00:02:59,905 --> 00:03:02,082
และนี่คือส่วนที่ทำให้ผมประหลาดใจ

76
00:03:02,082 --> 00:03:04,054
มันเพิ่มเวลาหน่วงแค่ประมาณ 14

77
00:03:04,054 --> 00:03:06,299
มิลลิวินาทีเท่านั้น แค่นั้นจริง ๆ

78
00:03:06,299 --> 00:03:12,830
คุณจะไม่มีทางสังเกตเห็น คุณไม่เห็นมันทำงาน agent ของคุณก็ไม่ช้าลง token ของคุณแค่หยุดรั่วเงียบ ๆ

79
00:03:12,830 --> 00:03:18,884
ตอนนี้คุณอาจกำลังคิดว่า เดี๋ยวก่อน ถ้ามันกรองผลลัพธ์ออก มันจะทำให้ AI agent ของฉันพังไหม?

80
00:03:18,884 --> 00:03:20,789
Claude จะพลาดอะไรสำคัญไปไหม?

81
00:03:20,789 --> 00:03:25,075
ไม่ครับ เพราะ RTK กรองเฉพาะเสียงรบกวนเชิงกลเท่านั้น บรรทัดซ้ำ ๆ

82
00:03:25,075 --> 00:03:27,048
เนื้อหาปาดขยาย สิ่งที่ Claude

83
00:03:27,048 --> 00:03:28,612
ไม่เคยต้องใช้ตั้งแต่แรก

84
00:03:28,612 --> 00:03:30,857
สัญญาณสำคัญผ่านไปแบบไม่ถูกแตะต้อง

85
00:03:30,857 --> 00:03:33,986
และในการทดสอบของผม คุณภาพของผลลัพธ์ยังเท่าเดิม

86
00:03:33,986 --> 00:03:36,980
แต่ค่าใช้จ่ายในการได้ผลลัพธ์นั้นลดลงกว่า 80%

87
00:03:36,980 --> 00:03:39,225
ยกตัวอย่างเช่น สมมติคุณให้ Claude

88
00:03:39,225 --> 00:03:41,946
ตรวจดูว่ามีอะไรเปลี่ยนไปในโฟลเดอร์เอกสาร

89
00:03:41,946 --> 00:03:44,871
ปกติมันจะถมล็อกขนาดใหญ่ยุ่งเหยิงเข้ามาในแชท

90
00:03:44,871 --> 00:03:46,027
แต่กับ RTK Claude

91
00:03:46,027 --> 00:03:48,544
จะเห็นเวอร์ชันสั้นสะอาดแล้วก็ทำงานต่อ

92
00:03:48,544 --> 00:03:51,265
นั่นคืออุดรอยรั่วข้อหนึ่งได้แล้ว แต่ RTK

93
00:03:51,265 --> 00:03:53,578
แก้ได้แค่สิ่งที่ไหลเข้าไปหา Claude

94
00:03:53,578 --> 00:03:55,619
รอยรั่วถัดไปคือสิ่งที่ไหลออกมา

95
00:03:55,619 --> 00:03:57,864
ปลั๊กตัวที่สองคือ Caveman Caveman

96
00:03:57,864 --> 00:04:00,041
ทำตามชื่อเลยครับ มันทำให้ Claude

97
00:04:00,041 --> 00:04:02,966
พูดแบบมนุษย์ถ้ำ สั้น ตรงประเด็น ไม่มีน้ำลาย

98
00:04:02,966 --> 00:04:06,095
ปกติคุณถาม Claude คำถามเดียว มันจะตอบประมาณว่า

99
00:04:06,095 --> 00:04:08,204
คำถามดีมาก ยินดีช่วยเหลือคุณมาก

100
00:04:08,204 --> 00:04:11,129
ขอพาคุณไปทีละขั้นตอนนะ ทั้งหมดนั้นคือ token

101
00:04:11,129 --> 00:04:13,919
และเป็น token ของคุณเอง พอติดตั้ง Caveman

102
00:04:13,919 --> 00:04:16,912
คำตอบเดียวกันนั้นจะถูกตัดเหลือแค่คำตอบล้วน ๆ

103
00:04:16,912 --> 00:04:19,429
ในตัวอย่างหนึ่ง คำตอบปกติใช้ 69 token

104
00:04:19,429 --> 00:04:21,810
แต่เวอร์ชัน Caveman ใช้แค่ 19 token

105
00:04:21,810 --> 00:04:24,871
ข้อมูลเท่าเดิม แต่ต้นทุนเหลือไม่ถึงหนึ่งในสาม

106
00:04:24,871 --> 00:04:27,796
ผมทดสอบตัวนี้กับ Fable 5 ผลที่ได้คือ output

107
00:04:27,796 --> 00:04:30,245
token ลดลง 69% ซึ่งทำให้การใช้ token

108
00:04:30,245 --> 00:04:33,238
โดยรวมของผมลดลงประมาณ 30% และประเด็นสำคัญคือ

109
00:04:33,238 --> 00:04:34,599
ทุกคำตอบยังคงถูกต้อง

110
00:04:34,599 --> 00:04:36,708
มันตัดแค่เนื้อฟุ่มเฟือยเท่านั้น

111
00:04:36,708 --> 00:04:39,293
และตัดเฉพาะส่วนนั้นจริง ๆ ถ้าคุณคิดว่า

112
00:04:39,293 --> 00:04:41,265
แต่ผมชอบให้ Claude เป็นมิตรนะ

113
00:04:41,265 --> 00:04:44,055
ก็ได้ครับสำหรับการแชทเล่น แต่เมื่อ Claude

114
00:04:44,055 --> 00:04:45,823
ทำงาน 50 อย่างต่อเนื่องกัน

115
00:04:45,823 --> 00:04:48,204
คุณไม่ต้องการคำพูดหวาน ๆ 50 รอบหรอก

116
00:04:48,204 --> 00:04:51,129
คุณต้องการให้งานเสร็จ Caveman ทำให้งานเสร็จ

117
00:04:51,129 --> 00:04:53,102
ตอนนี้ข้อมูลขาเข้าถูกกรองแล้ว

118
00:04:53,102 --> 00:04:54,259
คำตอบก็กระชับแล้ว

119
00:04:54,259 --> 00:04:56,980
แต่ยังมีรอยรั่วข้อสามซ่อนอยู่ในตัวงานเอง

120
00:04:56,980 --> 00:04:59,701
ปลั๊กตัวที่สามคือ Ponytail Ponytail หยุด

121
00:04:59,701 --> 00:05:02,490
Claude ไม่ให้สร้างงานเกินความจำเป็น เมื่อ

122
00:05:02,490 --> 00:05:05,347
Claude สร้างอะไรให้คุณ มันชอบเพิ่มของเสริม

123
00:05:05,347 --> 00:05:06,572
ชั้นที่คุณไม่ได้ขอ

124
00:05:06,572 --> 00:05:09,225
โครงสร้างสำหรับอนาคตที่อาจไม่มีวันมาถึง

125
00:05:09,225 --> 00:05:12,354
ชิ้นส่วนพิเศษ แปลว่า token มากขึ้นในตอนนี้ และ

126
00:05:12,354 --> 00:05:14,463
token มากขึ้นทุกครั้งที่ Claude

127
00:05:14,463 --> 00:05:17,592
ต้องย้อนกลับมาอ่านงานนั้นทีหลัง Ponytail ทำให้

128
00:05:17,592 --> 00:05:20,449
Claude ทำตัวเหมือนนักพัฒนาเซียนที่ขี้เกียจ

129
00:05:20,449 --> 00:05:25,143
ใครสักคนที่ทำแบบนี้มานับพันครั้งแล้วรู้เส้นทางที่สั้นและปลอดภัยที่สุด

130
00:05:25,143 --> 00:05:27,048
มันสร้างสิ่งที่คุณขอเท่านั้น

131
00:05:27,048 --> 00:05:28,953
ไม่มีมากไปกว่านั้น ตัวเลขคือ

132
00:05:28,953 --> 00:05:32,014
ปริมาณงานลดลงประมาณ 54% ต้นทุนถูกลงประมาณ 20%

133
00:05:32,014 --> 00:05:35,007
และเร็วขึ้น 27% ในการทดสอบ ก่อนที่คุณจะกังวล

134
00:05:35,007 --> 00:05:37,660
ไม่ครับ มันไม่ได้ตัดมุมในเรื่องที่สำคัญ

135
00:05:37,660 --> 00:05:39,769
มันไม่แตะพื้นฐานด้านความปลอดภัย

136
00:05:39,769 --> 00:05:42,694
มันไม่ข้ามการจัดการข้อผิดพลาดหรือการตรวจสอบ

137
00:05:42,694 --> 00:05:44,667
มันข้ามแค่ส่วนเสริมเชิงคาดเดา

138
00:05:44,667 --> 00:05:47,184
พวกเผื่อไว้ว่าบางทีวันหนึ่งอาจต้องใช้

139
00:05:47,184 --> 00:05:49,225
ซึ่งส่วนใหญ่คุณไม่เคยใช้จริง ๆ

140
00:05:49,225 --> 00:05:51,470
ปริมาณครึ่งหนึ่ง งานเสร็จเท่าเดิม

141
00:05:51,470 --> 00:05:53,851
และเพราะมีอะไรให้อ่านย้อนหลังน้อยลง

142
00:05:53,851 --> 00:05:56,640
ทุกเซสชันในอนาคตก็ถูกลงไปด้วย มันทบต้นกัน

143
00:05:56,640 --> 00:05:59,225
อุดไปแล้วสามรอยรั่ว มาถึงตัวใหญ่กันต่อ

144
00:05:59,225 --> 00:06:02,354
ตัวที่เปลี่ยนเกมทั้งเกม ปลั๊กตัวที่สี่คือ Omni

145
00:06:02,354 --> 00:06:03,449
Route Omni Route

146
00:06:03,449 --> 00:06:06,238
คือเกตเวย์ฟรีที่รันอยู่บนเครื่องของคุณเอง

147
00:06:06,238 --> 00:06:09,368
สิ่งที่มันทำนั้นง่ายมาก มันจัดเส้นทางงานง่าย ๆ

148
00:06:09,368 --> 00:06:11,136
(grunt work) ไปให้โมเดล AI

149
00:06:11,136 --> 00:06:13,177
ฟรีแทนที่จะไปกินแพ็กเกจ Claude

150
00:06:13,177 --> 00:06:14,334
แบบเสียเงินของคุณ

151
00:06:14,334 --> 00:06:16,442
ลองนึกถึงวิธีบริหารธุรกิจสิครับ

152
00:06:16,442 --> 00:06:18,823
คุณไม่ส่งคนเก่งที่สุดไปคัดแยกจดหมาย

153
00:06:18,823 --> 00:06:21,272
แต่คนส่วนใหญ่กลับทำแบบนั้นกับ Claude

154
00:06:21,272 --> 00:06:24,266
งานเปลี่ยนชื่อ สรุปสั้น ๆ แก้ไขเล็ก ๆ น้อย ๆ

155
00:06:24,266 --> 00:06:25,422
งานซ้ำซากน่าเบื่อ

156
00:06:25,422 --> 00:06:28,483
ทั้งหมดถูกส่งไปให้โมเดลที่แพงที่สุดในโลก Omni

157
00:06:28,483 --> 00:06:31,068
Route ให้โมเดลฟรี 90 ตัวให้คุณเลือกใช้

158
00:06:31,068 --> 00:06:32,429
รวมถึงโมเดลฟรีจริง ๆ

159
00:06:32,429 --> 00:06:35,490
งานง่ายก็ให้โมเดลฟรีจัดการ งานยากก็ให้ Claude

160
00:06:35,490 --> 00:06:36,585
จัดการ token

161
00:06:36,585 --> 00:06:39,783
แบบเสียเงินของคุณจะถูกใช้เฉพาะที่มันคุ้มค่าจริง

162
00:06:39,783 --> 00:06:42,572
ๆ เท่านั้น และนี่คือจุดที่ฉลาด Omni Route

163
00:06:42,572 --> 00:06:44,681
มีระบบบีบอัดแบบ RTK และ Caveman

164
00:06:44,681 --> 00:06:46,517
ติดตั้งอยู่ในตัวเกตเวย์แล้ว

165
00:06:46,517 --> 00:06:50,191
ดังนั้นแม้แต่คำขอที่ส่งไปหาโมเดลฟรีก็ถูกบีบอัดเพิ่มอีก

166
00:06:50,191 --> 00:06:51,286
15 ถึง 95%

167
00:06:51,286 --> 00:06:54,551
ซึ่งสำคัญเพราะโมเดลฟรีก็มีขีดจำกัดอัตราการใช้งาน

168
00:06:54,551 --> 00:06:55,912
(rate limit) เช่นกัน

169
00:06:55,912 --> 00:06:57,953
และนี่ช่วยให้คุณไม่ชนเพดานนั้น

170
00:06:57,953 --> 00:06:59,857
เรารันชุดติดตั้งแบบนี้จริง ๆ

171
00:06:59,857 --> 00:07:02,579
เป็นเครื่องยนต์เขียนโค้ดฟรีภายใน Agentic

172
00:07:02,579 --> 00:07:05,572
Operating System (ระบบปฏิบัติการแบบ Agentic)

173
00:07:05,572 --> 00:07:06,667
ของเรา

174
00:07:06,667 --> 00:07:09,524
งานน่าเบื่อถูกส่งออกไปให้โมเดลฟรีแบบบีบอัด

175
00:07:09,524 --> 00:07:12,109
งานสำคัญอยู่กับ Claude ก็บีบอัดเช่นกัน

176
00:07:12,109 --> 00:07:14,898
ทุกอย่างถูกลงพร้อมกัน ขอหยุดตรงนี้สักครู่

177
00:07:14,898 --> 00:07:17,347
เพราะผมรู้ว่าบางคนกำลังคิดว่า Julian

178
00:07:17,347 --> 00:07:20,204
นี่มันดูเทคนิคเกินไป ฉันไม่ใช่นักเขียนโค้ด

179
00:07:20,204 --> 00:07:22,993
นี่ไม่เหมาะกับฉัน ผมเข้าใจ แต่ความจริงคือ

180
00:07:22,993 --> 00:07:24,626
ผมเองก็ไม่ใช่คนสายเทคนิค

181
00:07:24,626 --> 00:07:27,551
แต่ละตัวติดตั้งด้วยคำสั่งเดียวแทบจะทั้งนั้น

182
00:07:27,551 --> 00:07:29,932
ทั้งชุดใช้เวลาติดตั้งประมาณ 15 นาที

183
00:07:29,932 --> 00:07:32,857
และหลังจากนั้นมันอัตโนมัติ ไม่ต้องแตะอีกเลย

184
00:07:32,857 --> 00:07:34,762
และถ้ารู้สึกว่ายังเยอะเกินไป

185
00:07:34,762 --> 00:07:37,823
เราทำไว้ให้คุณแล้ว ภายใน AI Profit Board Room

186
00:07:37,823 --> 00:07:40,749
ชุดลด token ทั้งหมดนี้ถูกสร้างไว้ล่วงหน้าใน

187
00:07:40,749 --> 00:07:43,878
Agentic Operating System แล้ว คุณจะได้ไฟล์ zip

188
00:07:43,878 --> 00:07:46,735
คำแนะนำวิดีโอทีละขั้นตอนที่โชว์วิธีติดตั้ง

189
00:07:46,735 --> 00:07:49,252
RTK, Caveman, Ponytail และ Omni Route

190
00:07:49,252 --> 00:07:52,109
อย่างละเอียด และได้คู่มือลด token ฉบับเต็ม

191
00:07:52,109 --> 00:07:54,626
เพื่อที่คุณจะไม่เจอขีดจำกัดของ Claude

192
00:07:54,626 --> 00:07:57,075
กลางงานอีก เราอัปเดต Agent OS ทุกวัน

193
00:07:57,075 --> 00:07:59,116
เมื่อเครื่องมือพวกนี้พัฒนาขึ้น

194
00:07:59,116 --> 00:08:01,293
ชุดติดตั้งของคุณก็พัฒนาตามไปด้วย

195
00:08:01,293 --> 00:08:04,150
ผมช่วยเจ้าของธุรกิจกว่า 3,700 คนในนั้นแล้ว

196
00:08:04,150 --> 00:08:05,579
และหลายคนไม่เคยแตะ AI

197
00:08:05,579 --> 00:08:07,483
มาก่อนเลยด้วยซ้ำตอนที่เข้ามา

198
00:08:07,483 --> 00:08:10,000
ลิงก์อยู่ในคอมเมนต์และคำอธิบายใต้คลิป

199
00:08:10,000 --> 00:08:12,926
หรือไปที่ airprofitable.com เพื่อเข้าใช้งาน

200
00:08:12,926 --> 00:08:15,851
สรุปคือปลั๊กทั้งสี่ตัว RTK กรองข้อมูลขาเข้า

201
00:08:15,851 --> 00:08:18,708
Caveman ย่อคำตอบ Ponytail ตัดทอนผลงาน Omni

202
00:08:18,708 --> 00:08:19,932
Route ส่งงานง่าย ๆ

203
00:08:19,932 --> 00:08:25,783
ไปให้โมเดลฟรี นี่คือเครื่องจักรกันรั่ว แต่จะเกิดอะไรขึ้นเมื่อรวมทั้งสี่ตัวเข้าด้วยกัน?

204
00:08:25,783 --> 00:08:27,892
เพราะตรงนี้แหละที่น่าสนใจจริง ๆ

205
00:08:27,892 --> 00:08:30,953
เงินที่ประหยัดได้ไม่ได้แค่บวกกัน แต่มันทวีคูณ

206
00:08:30,953 --> 00:08:33,606
RTK ลดผลลัพธ์จากเครื่องมือของผมลง 82.9%

207
00:08:33,606 --> 00:08:36,123
Caveman ลด token คำตอบลง 69% Ponytail

208
00:08:36,123 --> 00:08:39,116
ลดปริมาณงานลงประมาณครึ่งหนึ่ง และ Omni Route

209
00:08:39,116 --> 00:08:42,245
เอางานทั้งก้อนออกจากแพ็กเกจเสียเงินของคุณไปเลย

210
00:08:42,245 --> 00:08:44,694
คิดเป็นเงินออม 100% สำหรับงานพวกนั้น

211
00:08:44,694 --> 00:08:47,007
ดังนั้นถ้าคุณรันทั้งสี่ตัวพร้อมกัน

212
00:08:47,007 --> 00:08:49,728
แล้วแต่ประเภทงานที่ทำ คุณอาจทะลุเกิน 80%

213
00:08:49,728 --> 00:08:51,225
ไปไกลได้ในงานบางประเภท

214
00:08:51,225 --> 00:08:53,674
นี่คือความรู้สึกจริงที่เกิดขึ้นกับผม

215
00:08:53,674 --> 00:08:55,987
ก่อนมีชุดนี้ ทุกเซสชัน Claude Code

216
00:08:55,987 --> 00:08:59,048
มีรูปแบบเดียวกัน เริ่มเร็ว ไหลลื่น พอ context

217
00:08:59,048 --> 00:09:01,293
(บริบท) พองโตก็ชนขีดจำกัด หยุด รอ

218
00:09:01,293 --> 00:09:02,926
และความกังวลเรื่อง token

219
00:09:02,926 --> 00:09:05,987
ก็วนเวียนอยู่ที่ก้นสมองตลอดเวลา กลัวจะถามอะไร

220
00:09:05,987 --> 00:09:07,082
Claude

221
00:09:07,082 --> 00:09:09,871
เพราะกลัวว่ามันจะกินเวลาที่เหลือของเซสชัน

222
00:09:09,871 --> 00:09:12,524
ตอนนี้ สมาชิกแพ็กเกจเดิม แต่ผมรัน agent

223
00:09:12,524 --> 00:09:15,245
หลายตัวพร้อมกัน ทำงานได้ต่อเซสชันมากขึ้น

224
00:09:15,245 --> 00:09:18,102
และความกังวลหายไปเพราะท่อถูกซ่อมแล้ว token

225
00:09:18,102 --> 00:09:20,687
ไหลไปที่ที่ควรไป และไม่มีทางอื่น ต่อมา

226
00:09:20,687 --> 00:09:23,681
ขอแถมเทคนิคพิเศษอีกแปดข้อเพิ่มจากชุดหลัก ฟรี

227
00:09:23,681 --> 00:09:26,538
ใช้เวลาไม่กี่วินาที และคนส่วนใหญ่ข้ามไปหมด

228
00:09:26,538 --> 00:09:29,599
ข้อหนึ่ง พิมพ์ /clear เมื่อทำงานเสร็จ มันล้าง

229
00:09:29,599 --> 00:09:30,694
context เก่าทิ้ง

230
00:09:30,694 --> 00:09:34,232
งานถัดไปจึงเริ่มต้นสดใหม่แทนที่จะลากภาระเก่าติดตัวไป

231
00:09:34,232 --> 00:09:36,136
context เก่าคือรอยรั่วล้วน ๆ

232
00:09:36,136 --> 00:09:38,994
ล้างมันทิ้ง ข้อสอง ในงานยาวเดี่ยว ๆ ให้รัน

233
00:09:38,994 --> 00:09:40,089
/compact

234
00:09:40,089 --> 00:09:43,422
มันจะสรุปประวัติการสนทนาแทนที่จะแบกทั้งก้อนไปด้วย

235
00:09:43,422 --> 00:09:46,211
Claude เก็บใจความสำคัญแล้วทิ้งส่วนที่หนัก

236
00:09:46,211 --> 00:09:49,068
ข้อสาม ควบคุมอาหารให้ไฟล์ Claude.md ของคุณ

237
00:09:49,068 --> 00:09:51,926
นั่นคือไฟล์คำสั่งที่เดินทางไปด้วยทุกเซสชัน

238
00:09:51,926 --> 00:09:54,102
กฎทุกข้อในนั้นกิน token ทุกครั้ง

239
00:09:54,102 --> 00:09:57,096
คนส่วนใหญ่ลบทิ้งได้ครึ่งหนึ่งโดยไม่มีอะไรพัง

240
00:09:57,096 --> 00:09:59,817
และนี่ไม่ใช่แค่ผมพูดเอง ทีมงานของ Claude

241
00:09:59,817 --> 00:10:02,878
เองออกคู่มือที่พวกเขาตัดระบบของตัวเองลงประมาณ

242
00:10:02,878 --> 00:10:05,055
80% แล้วได้คุณภาพเท่าเดิม ข้อสี่

243
00:10:05,055 --> 00:10:06,415
จัดเส้นทางตามความยาก

244
00:10:06,415 --> 00:10:09,545
งานง่ายส่งไปโมเดลราคาถูกหรือฟรีผ่าน Omni Route

245
00:10:09,545 --> 00:10:10,905
งานยากส่งไปหา Claude

246
00:10:10,905 --> 00:10:15,667
ถามตัวเองก่อนทุกงานว่างานนี้จำเป็นต้องใช้โมเดลที่ดีที่สุดในโลกจริงไหม?

247
00:10:15,667 --> 00:10:18,524
ส่วนใหญ่คำตอบคือไม่ ข้อห้า วางแผนก่อนลงมือ

248
00:10:18,524 --> 00:10:20,973
เมื่อ Claude วางแผนก่อนแล้วค่อยลงมือ

249
00:10:20,973 --> 00:10:23,150
มันจะวกวนน้อยลง การวกวนคือ token

250
00:10:23,150 --> 00:10:26,279
แผนสองนาทีช่วยให้คุณไม่ต้องลองผิดลองถูกเป็นกอง

251
00:10:26,279 --> 00:10:29,136
ข้อหก รวมคำขอเป็นชุด แทนที่จะส่งคำขอเล็ก ๆ

252
00:10:29,136 --> 00:10:31,994
ห้าอันทีละอัน ซึ่ง Claude ต้องอ่าน context

253
00:10:31,994 --> 00:10:34,919
ชุดเดิมห้ารอบ ให้ส่งรวมกันในครั้งเดียว อ่าน

254
00:10:34,919 --> 00:10:37,708
context หนึ่งรอบ ทำงานเสร็จห้างาน ข้อเจ็ด

255
00:10:37,708 --> 00:10:40,361
ใช้หน่วยสอดแนม (scout) คุณให้ sub agent

256
00:10:40,361 --> 00:10:43,014
(เอเจนต์ย่อย) ไปขุดคุ้ยข้อมูลก้อนใหญ่ ๆ

257
00:10:43,014 --> 00:10:46,143
ด้วยตัวเองได้ หน่วยสอดแนมใช้ context ของมันเอง

258
00:10:46,143 --> 00:10:47,844
แล้วรายงานกลับมาแค่บทสรุป

259
00:10:47,844 --> 00:10:49,885
เซสชันหลักของคุณจ่ายแค่ค่าสรุป

260
00:10:49,885 --> 00:10:52,742
ไม่เคยจ่ายค่าค้นหา และข้อแปด ใช้คลังความจำ

261
00:10:52,742 --> 00:10:55,667
(memory vault) เช่น ภายใน Agentic Operating

262
00:10:55,667 --> 00:10:58,592
System ของเรา เราต่อ Obsidian memory เข้าไป

263
00:10:58,592 --> 00:11:00,565
เอเจนต์รู้บริบทของเราอยู่แล้ว

264
00:11:00,565 --> 00:11:04,715
ไม่ต้องอธิบายซ้ำว่าคุณเป็นใครหรือกำลังทำอะไรตอนเริ่มทุกเซสชัน

265
00:11:04,715 --> 00:11:08,184
การอธิบายซ้ำนี่แหละคือหนึ่งในรอยรั่วที่แอบแฝงที่สุด

266
00:11:08,184 --> 00:11:10,633
มาพูดถึงวิธีแบบเก่ากับวิธีแบบใหม่กัน

267
00:11:10,633 --> 00:11:13,694
เพราะนี่คือการเปลี่ยนวิธีคิดเรื่อง token จริง

268
00:11:13,694 --> 00:11:15,599
ๆ วิธีแบบเก่าคือคุณมอง token

269
00:11:15,599 --> 00:11:18,660
เป็นทรัพยากรที่หายาก คุณพิมพ์สั้นลง ถามน้อยลง

270
00:11:18,660 --> 00:11:21,449
รู้สึกใจสั่นเล็กน้อยก่อนทุกงาน คุณถนอมใช้

271
00:11:21,449 --> 00:11:23,286
รอคอยการรีเซ็ต ตั้งใจใช้ AI

272
00:11:23,286 --> 00:11:26,075
น้อยลงเพียงเพื่อให้ขีดจำกัดอยู่ได้นานขึ้น

273
00:11:26,075 --> 00:11:28,864
ส่วนวิธีแบบใหม่ คุณซ่อมท่อประปาครั้งเดียว

274
00:11:28,864 --> 00:11:31,722
ใช้เวลาติดตั้ง 15 นาที เครื่องมือฟรีสี่ตัว

275
00:11:31,722 --> 00:11:34,715
เสียงรบกวนถูกกรอง ผลงานถูกตัดทอน คำตอบถูกย่อ

276
00:11:34,715 --> 00:11:37,708
และงานง่าย ๆ ถูกส่งไปโมเดลฟรีอัตโนมัติตลอดไป

277
00:11:37,708 --> 00:11:40,021
แล้วคุณก็เลิกถนอมและเริ่มทำมากขึ้น

278
00:11:40,021 --> 00:11:43,150
นั่นคือประเด็นทั้งหมด นี่ไม่ใช่เรื่องของการใช้

279
00:11:43,150 --> 00:11:44,919
AI น้อยลง แต่ตรงกันข้ามเลย

280
00:11:44,919 --> 00:11:47,844
เมื่อแต่ละงานมีต้นทุนเหลือหนึ่งในห้าของเดิม

281
00:11:47,844 --> 00:11:50,225
คุณก็รันงานได้ห้าเท่า agent มากขึ้น

282
00:11:50,225 --> 00:11:52,674
เซสชันมากขึ้น ทำงานเสร็จในวันมากขึ้น

283
00:11:52,674 --> 00:11:54,035
ขอพูดอีกสองสามเรื่อง

284
00:11:54,035 --> 00:11:56,143
เพราะผมสัญญาว่าจะให้ข้อเท็จจริง

285
00:11:56,143 --> 00:11:58,524
ไม่ใช่โฆษณาเกินจริง ข้อเสียคืออะไร?

286
00:11:58,524 --> 00:12:04,987
ส่วนของการจัดเส้นทางจะใช้ไม่ได้กับทุกอย่าง ถ้างานทุกชิ้นที่คุณรันต้องใช้โมเดลระดับแนวหน้าจริง ๆ

287
00:12:04,987 --> 00:12:06,756
Omni Route ก็ช่วยได้น้อยลง

288
00:12:06,756 --> 00:12:08,865
แต่ลองซื่อสัตย์กับตัวเองดูสิว่า

289
00:12:08,865 --> 00:12:10,769
สิ่งที่คุณส่งให้ Claude นั้น

290
00:12:10,769 --> 00:12:13,626
มีสัดส่วนเท่าไหร่ที่ต้องใช้ Claude จริง ๆ?

291
00:12:13,626 --> 00:12:15,667
สำหรับคนส่วนใหญ่ สัดส่วนใหญ่ ๆ

292
00:12:15,667 --> 00:12:18,797
ไม่ได้ต้องใช้เลย และแม้แต่งานที่ต้องใช้ Claude

293
00:12:18,797 --> 00:12:20,769
RTK หรือ Caveman กับ Ponytail

294
00:12:20,769 --> 00:12:23,218
ก็ยังลดการใช้ของคุณตลอดเวลา แล้ว 80%

295
00:12:23,218 --> 00:12:24,919
การันตีทุกงานไหม? ไม่ครับ

296
00:12:24,919 --> 00:12:27,028
มันขึ้นอยู่กับว่าคุณกำลังทำอะไร

297
00:12:27,028 --> 00:12:29,613
เซสชันที่ใช้เครื่องมือเยอะ มีคำสั่งมาก

298
00:12:29,613 --> 00:12:32,606
จะประหยัดได้มากที่สุด เพราะนั่นคือจุดที่ RTK

299
00:12:32,606 --> 00:12:33,701
ทำได้ดีที่สุด

300
00:12:33,701 --> 00:12:36,218
แต่ในวันทำงานจริงที่รันชุดเต็มทั้งวัน

301
00:12:36,218 --> 00:12:37,579
การประหยัดนั้นมหาศาล

302
00:12:37,579 --> 00:12:40,164
ตัวเลขของผมมาจากการทดสอบของผมเอง 82.9%

303
00:12:40,164 --> 00:12:43,089
สำหรับผลลัพธ์จากเครื่องมือ 69% สำหรับ token

304
00:12:43,089 --> 00:12:45,674
คำตอบ และปริมาณงานลดลงประมาณครึ่งหนึ่ง

305
00:12:45,674 --> 00:12:47,307
นั่นไม่ใช่ตัวเลขคาดการณ์

306
00:12:47,307 --> 00:12:50,164
นั่นคือสิ่งที่ผมวัดได้จริง คุณอาจคิดอีกว่า

307
00:12:50,164 --> 00:12:52,273
จะไปเปลืองแรงประหยัด token ทำไม

308
00:12:52,273 --> 00:12:55,198
เดี๋ยวก็จ่ายซื้อแพ็กเกจใหญ่เอง คุณทำได้ครับ

309
00:12:55,198 --> 00:12:57,987
แต่ลองคิดดูว่าคุณกำลังจ่ายเพื่ออะไรจริง ๆ

310
00:12:57,987 --> 00:13:02,477
คุณจะจ่ายเต็มราคาเพื่อให้ล็อกถูกปาดขยาย คำตอบถูกถมน้ำลาย งานง่าย ๆ

311
00:13:02,477 --> 00:13:05,062
ถูกส่งไปโมเดลแพงทั้งที่โมเดลฟรีก็ทำได้

312
00:13:05,062 --> 00:13:08,123
และแม้แต่แพ็กเกจใหญ่ที่สุด คุณก็ยังชนขีดจำกัด

313
00:13:08,123 --> 00:13:10,164
แค่ช้ากว่าเดิม โดยที่เผา token

314
00:13:10,164 --> 00:13:13,021
ไปมากกว่าเพื่อไปถึงจุดนั้น ซ่อมรอยรั่วก่อน

315
00:13:13,021 --> 00:13:16,150
แล้วค่อยตัดสินใจว่าคุณยังต้องอัปเกรดแพ็กเกจไหม

316
00:13:16,150 --> 00:13:17,647
คนส่วนใหญ่พบว่าไม่ต้อง

317
00:13:17,647 --> 00:13:19,892
และยังมีความเชื่ออีกข้อที่ควรทลาย

318
00:13:19,892 --> 00:13:22,477
บางคนคิดว่ายังไงก็ต้องชนขีดจำกัดอยู่ดี

319
00:13:22,477 --> 00:13:25,606
นั่นคือธรรมชาติของ Claude แต่จริง ๆ แล้วไม่ใช่

320
00:13:25,606 --> 00:13:27,987
ขีดจำกัดคือเพดานของ token และ token

321
00:13:27,987 --> 00:13:31,933
ส่วนใหญ่ของคุณกำลังถูกทิ้งไปกับสิ่งที่คุณไม่เคยเห็นด้วยซ้ำ

322
00:13:31,933 --> 00:13:34,382
ปัญหาที่แท้จริงไม่เคยอยู่ที่ขีดจำกัด

323
00:13:34,382 --> 00:13:36,014
แต่อยู่ที่รอยรั่วต่างหาก

324
00:13:36,014 --> 00:13:38,735
นี่คือสิ่งที่ควรทำต่อไป ติดตั้ง RTK ก่อน

325
00:13:38,735 --> 00:13:40,980
มันให้ผลตอบแทนเดี่ยวที่คุ้มที่สุด

326
00:13:40,980 --> 00:13:43,973
และคุณจะเห็นความต่างในเซสชันแรก จากนั้นเพิ่ม

327
00:13:43,973 --> 00:13:47,035
Caveman สำหรับคำตอบ แล้ว Ponytail แล้วตั้งค่า

328
00:13:47,035 --> 00:13:49,144
Omni Route และเริ่มส่งงานง่าย ๆ

329
00:13:49,144 --> 00:13:54,654
ของคุณไปโมเดลฟรี ตัวละหนึ่งคำสั่ง รวม 15 นาที จากนั้นเพิ่มนิสัยแปดข้อต่อ: /clear,

330
00:13:54,654 --> 00:13:56,831
/compact, ตัดแต่งไฟล์ Claude.md,

331
00:13:56,831 --> 00:13:59,076
จัดเส้นทางตามความยาก, วางแผนก่อน,

332
00:13:59,076 --> 00:14:01,593
ทำงานเป็นชุด, ใช้ scout และใช้ memory

333
00:14:01,593 --> 00:14:04,450
หรือถ้าอยากได้ทางลัด ภายใน AI Profit Board

334
00:14:04,450 --> 00:14:07,511
Room เครื่องจักรกันรั่วทั้งตัวถูกเดินสายไว้ใน

335
00:14:07,511 --> 00:14:09,484
Agentic Operating System แล้ว

336
00:14:09,484 --> 00:14:12,069
ครบทั้งสี่โปรเจกต์ ตั้งค่าล่วงหน้าแล้ว

337
00:14:12,069 --> 00:14:13,633
ทำงานร่วมกันกับ Claude,

338
00:14:13,633 --> 00:14:16,559
Hermes และเอเจนต์อื่น ๆ ที่คุณมีในระบบเดียว

339
00:14:16,559 --> 00:14:19,620
เอเจนต์ทุกตัวที่คุณรันได้ประโยชน์จากการบีบอัด

340
00:14:19,620 --> 00:14:22,001
ไม่ใช่แค่ตัวเดียว คุณยังได้ไฟล์ zip

341
00:14:22,001 --> 00:14:24,586
สำหรับติดตั้ง วิดีโอสอนทีละขั้น แผน 30

342
00:14:24,586 --> 00:14:26,627
วันสำหรับนำไปใช้ในธุรกิจของคุณ

343
00:14:26,627 --> 00:14:29,416
และอัปเดตรายวันเมื่อเราพัฒนาระบบให้ดีขึ้น

344
00:14:29,416 --> 00:14:31,933
มีหมวดการลด token ฉบับเต็มในห้องเรียน

345
00:14:31,933 --> 00:14:35,062
พร้อมคู่มือทีละขั้นสำหรับชุดติดตั้งนี้โดยเฉพาะ

346
00:14:35,062 --> 00:14:38,395
คอลโค้ชสัปดาห์ละสี่ครั้งที่คุณถามเรื่องการตั้งค่า

347
00:14:38,395 --> 00:14:41,116
Claude Code ของคุณสด ๆ แล้วแก้ให้จบในคอล

348
00:14:41,116 --> 00:14:44,926
และชุมชนเจ้าของธุรกิจที่รันเอเจนต์พวกนี้อยู่จริงในตอนนี้

349
00:14:44,926 --> 00:14:47,307
หลายคนเริ่มจากไม่มีความรู้เทคนิคเลย

350
00:14:47,307 --> 00:14:49,892
และมีบันทึกความสำเร็จจากสมาชิกกว่า 200

351
00:14:49,892 --> 00:14:52,885
หน้าเป็นเครื่องพิสูจน์ คุณโพสต์คำถามตอนตีสอง

352
00:14:52,885 --> 00:14:54,246
ยังมีคนออนไลน์มาช่วย

353
00:14:54,246 --> 00:14:56,763
ลิงก์อยู่ในคอมเมนต์และคำอธิบายใต้คลิป

354
00:14:56,763 --> 00:14:59,892
หรือไปที่ AI Profit Board Room เพื่อเข้าใช้งาน

355
00:14:59,892 --> 00:15:02,817
token ของคุณไม่เคยเป็นปัญหา ปัญหาคือรอยรั่ว

356
00:15:02,817 --> 00:15:04,450
อุดมันครั้งเดียว แล้ว AI

357
00:15:04,450 --> 00:15:07,579
ของคุณจะไปได้ไกลขึ้นห้าเท่า เริ่มตั้งแต่วันนี้

358
00:15:07,579 --> 00:15:09,960
ขอบคุณที่รับชมครับ แล้วเจอกันข้างใน