วิธีที่ปลอดภัยที่สุดในการนำ Claw Code มาใช้คือการปฏิบัติเหมือนเป็นเวิร์กโฟลว์การปฏิบัติงาน ไม่ใช่คำสั่งวิเศษ โมเดลมีความสำคัญ แต่รันไทม์โดยรอบจะกำหนดว่าโมเดลสามารถมองเห็นอะไร เปลี่ยนแปลงอะไรได้บ้าง และจะกู้คืนข้อผิดพลาดได้เร็วแค่ไหน
คู่มือนี้จะเปลี่ยน การวิเคราะห์สถาปัตยกรรม Claw Code ให้เป็นเส้นทางที่ทำซ้ำได้สำหรับการพัฒนารายวัน
เริ่มต้นด้วยสัญญางาน
ก่อนที่จะเปิดเซสชั่นตัวแทน ให้เขียนสัญญาสั้นๆ:
- เป้าหมาย: ผลลัพธ์เดียวที่สังเกตได้ที่ควรเปลี่ยนแปลง
- ขอบเขต: ไดเรกทอรีและไฟล์ที่ตัวแทนอาจตรวจสอบหรือแก้ไข
- ข้อจำกัด: API, กฎรูปแบบ, ข้อกำหนดด้านความเข้ากันได้ และการดำเนินการที่ต้องห้าม
- การตรวจสอบความถูกต้อง: คำสั่ง การทดสอบ ภาพหน้าจอ หรือบันทึกที่พิสูจน์ความสำเร็จ
- การย้อนกลับ: คอมมิต แพตช์ แบรนช์ หรือการสำรองข้อมูลที่ให้คุณยกเลิกการเปลี่ยนแปลงได้
“ปรับปรุงระบบรับรองความถูกต้อง” ไม่ใช่สัญญาจ้างงาน “เพิ่มการทดสอบที่ล้มเหลวสำหรับเซสชันที่หมดอายุ ใช้การแก้ไขที่เล็กที่สุดใน
app/authระดับการอนุญาต
ใช้ความไว้วางใจที่ก้าวหน้า นโยบายสี่ระดับง่ายๆ นั้นเพียงพอสำหรับทีมส่วนใหญ่:
| ระดับ | ตัวแทนก็ทำได้ | กฎการอนุมัติ |
|---|---|---|
| อ่านอย่างเดียว | ตรวจสอบไฟล์ ค้นหา อธิบาย และเสนอแพตช์ | ไม่มีการเข้าถึงการเขียน |
| พื้นที่ทำงานเขียน | แก้ไขไฟล์ที่ถูกติดตามในไดเร็กทอรีที่มีขอบเขต | ตรวจสอบความแตกต่างก่อนการทดสอบ |
| ทดสอบการดำเนินการ | รันการทดสอบและฟอร์แมตเตอร์ที่เลือก | รายการที่อนุญาตของคำสั่งและการหมดเวลา |
| การกระทำภายนอก | เครือข่าย ปรับใช้ เผยแพร่ หรือเปลี่ยนแปลงโครงสร้างพื้นฐาน | การอนุมัติที่ชัดเจนต่อการกระทำ |
เริ่มต้นพื้นที่เก็บข้อมูลใหม่ทุกรายการเป็นแบบอ่านอย่างเดียวหรือเขียนพื้นที่ทำงาน อย่าให้สิทธิ์การเข้าถึงข้อมูลลับหรือการผลิตเพียงเพราะเอเจนต์ดำเนินการรีแฟคเตอร์ในเครื่องเสร็จแล้ว
AI coding agent stack ที่ละเอียดยิ่งขึ้นจะอธิบายว่าทำไมเครื่องมือ สิทธิ์ และเซสชันจึงเป็นฟีเจอร์ของผลิตภัณฑ์ ไม่ใช่รายละเอียดการใช้งาน
เซสชันวนซ้ำที่เชื่อถือได้
ใช้วงนี้สำหรับแต่ละงาน:
- ตรวจสอบ: ขอไฟล์ที่เกี่ยวข้อง พฤติกรรมปัจจุบัน และการทดสอบที่มีอยู่
- แผน: ต้องมีแผนการเปลี่ยนแปลงสั้นๆ และรายการไฟล์ก่อนทำการแก้ไข
- แพทช์: ทำให้ส่วนต่างแคบลง หลีกเลี่ยงการล้างข้อมูลที่ไม่เกี่ยวข้อง
- ตรวจสอบ: เรียกใช้การทดสอบที่เกี่ยวข้องน้อยที่สุดก่อน จากนั้นจึงทดสอบชุดที่กว้างขึ้น
- อธิบาย: ขอสรุปพฤติกรรมที่เปลี่ยนแปลง หลักฐาน และความเสี่ยงที่เหลืออยู่
- จุดตรวจสอบ: กระทำหรือบันทึกแพตช์ก่อนขั้นตอนอัตโนมัติถัดไป
จุดตรวจก็สำคัญ เซสชันที่ยาวนานซึ่งเปลี่ยนแปลงไฟล์หลายสิบไฟล์โดยไม่มีขอบเขตการตรวจสอบนั้นยากที่จะแก้ไข แม้ว่าการแก้ไขแต่ละครั้งจะดูสมเหตุสมผลก็ตาม
ทดสอบโค้ดที่เอเจนต์สร้างขึ้น
การทดสอบควรพิสูจน์พฤติกรรม ไม่ใช่แค่ว่าตัวแทนรันคำสั่งเท่านั้น สำหรับการเปลี่ยนแปลงโค้ด ให้รวม:
- การทดสอบหน่วยสำหรับตรรกะที่เปลี่ยนแปลง
- การทดสอบบูรณาการสำหรับขอบเขตที่ตัวแทนสัมผัส
- การตรวจสอบประเภทหรือการคอมไพล์
- การทบทวนการขยายขอบเขตโดยไม่ได้ตั้งใจ
- การตรวจสอบด้วยตนเองที่เป็นเป้าหมายเมื่อเอาต์พุตเป็นแบบภาพหรือแบบหันหน้าเข้าหาผู้ใช้
เมื่อการทดสอบล้มเหลว อย่าปล่อยให้เอเจนต์ทำการแก้ไขซ้ำๆ จนกว่าความล้มเหลวจะหายไป ขอให้อธิบายความล้มเหลว ระบุว่าการทดสอบหรือการใช้งานไม่ถูกต้อง และเสนอการทดลองที่เล็กที่สุดถัดไป
MCP และเครื่องมือภายนอก
MCP สามารถทำให้ตัวแทนมีประโยชน์มากขึ้นอย่างมาก แต่ยังขยายขอบเขตความน่าเชื่อถือด้วย สำหรับแต่ละเซิร์ฟเวอร์ ให้บันทึกทรัพยากรที่เซิร์ฟเวอร์เปิดเผย เครื่องมือที่สามารถเรียกใช้ได้ การโทรสามารถย้อนกลับได้หรือไม่ และข้อมูลใดบ้างที่สามารถออกจากเครื่องได้
คู่มือโปรโตคอล MCP เป็นเพื่อนที่เหมาะสมสำหรับการทำความเข้าใจทรัพยากร เครื่องมือ ข้อความแจ้ง ราก และการส่งข้อมูล ในการเปิดตัวจริง ให้จับคู่กับรายการที่อนุญาตและบันทึกการตรวจสอบ แทนที่จะถือว่า "เชื่อมต่อ" เป็น "เชื่อถือได้"
การจัดการความล้มเหลว
เวิร์กโฟลว์ตัวแทนที่ดีถือว่าล้มเหลว เพิ่มพฤติกรรมที่ชัดเจนสำหรับ:
- คำสั่งที่หมดเวลา
- การทดสอบที่ล้มเหลวหลังจากการแก้ไขบางส่วน
- เครื่องมือส่งคืนข้อมูลที่มีรูปแบบไม่ถูกต้อง
- ตัวแทนขออนุญาตที่ไม่ควรจำเป็น
- คำสั่งที่ขัดแย้งกับนโยบายพื้นที่เก็บข้อมูล
- เซสชันที่สูญเสียบริบทหรือดำเนินต่อในสาขาที่ไม่ถูกต้อง
การตอบสนองที่ถูกต้องมักจะคือการหยุด รักษาส่วนต่าง และสร้างสัญญางานใหม่ เซสชั่นใหม่ที่มีการแฮนด์ออฟแบบสั้นๆ มักจะปลอดภัยกว่าการสนทนาที่ยาวนานที่มีการคาดเดากันมานาน
รายการตรวจสอบการรับเลี้ยงบุตรบุญธรรม
ก่อนที่ทีมจะใช้ Claw Code บนโค้ดเบสที่ใช้ร่วมกัน ให้ยืนยัน:
- ทุกงานมีเงื่อนไขความสำเร็จเป็นลายลักษณ์อักษร
- ชุดสิทธิ์เริ่มต้นคือสิทธิ์ขั้นต่ำ
- การทดสอบทำงานในแซนด์บ็อกซ์โดยมีการหมดเวลา
- เซสชันเปิดเผยไฟล์ที่เปลี่ยนแปลงและการเรียกใช้เครื่องมือ
- จุดตรวจมีราคาถูกและบ่อยครั้ง
- ความลับจะไม่ถูกคัดลอกไปยังพรอมต์หรือบันทึก
- มนุษย์ตรวจสอบการเปลี่ยนแปลงที่ส่งผลกระทบต่อการผลิต
- ทีมงานจะวัดการเปลี่ยนแปลงที่ยอมรับ ลูปการแก้ไข และอัตราการย้อนกลับ
สำหรับตัวเลือกเครื่องมือระดับผลิตภัณฑ์ ให้ไปที่ ไดเรกทอรีเครื่องมือ AI สำหรับตัวเลือกระดับโมเดล ให้ใช้ ไดเรกทอรีโมเดล AI และการวัดประสิทธิภาพ แทนที่จะคิดว่าการสาธิตที่น่าประทับใจที่สุดคือรันไทม์ที่ดีที่สุด