กลับไปบล็อก

เวิร์กโฟลว์ทำเงินด้วย AI Agents สองประเภท

งานสร้างรายได้แบบใดที่ AI Agents ทำได้อย่างน่าเชื่อถือแล้ว งานแบบใดยังไม่ควรทำอัตโนมัติ และจุดใดที่ต้องคงการตรวจสอบโดยมนุษย์ไว้

เส้นแบ่งสำคัญระหว่าง AI Agent กับ AI แบบสนทนาคือ Agent สามารถลงมือทำงานได้จริง เช่น เปิดเบราว์เซอร์ กรอกฟอร์ม อ่านและเขียนสเปรดชีต และเดินตามเวิร์กโฟลว์ต่อไปโดยที่คุณไม่ต้องคอยคัดลอกและวางทุกขั้นตอน

ความแตกต่างนี้เพิ่มความสามารถได้จริง แต่ขณะเดียวกันก็ทำให้เห็นขอบเขตระหว่างสิ่งที่ทำได้กับสิ่งที่ทำไม่ได้อย่างรวดเร็ว เมื่อลองรันสักสองสามรอบ จะพบว่าจุดติดขัดแทบไม่ได้อยู่ที่เทคนิคอย่างเดียว แต่มักเป็นข้อจำกัดด้านอื่นในโลกจริง

งานที่ทำได้จริงและค่อนข้างเสถียรในตอนนี้

กรณีใช้งานที่เสถียรในปัจจุบันมีจุดร่วมหนึ่งอย่าง คือมนุษย์สามารถตรวจผลลัพธ์ได้อย่างรวดเร็ว และหากผิดพลาดก็ไม่สร้างผลกระทบที่ย้อนกลับไม่ได้

การจัดระเบียบและมอนิเตอร์ข้อมูลเป็นงานที่ง่ายที่สุด Agent สามารถดึงข้อมูลที่กระจายอยู่หลายแหล่งตามรอบเวลา จัดฟิลด์ให้ตรงกัน ลบข้อมูลซ้ำ และสร้างรายงานการเปลี่ยนแปลงรายวันหรือรายสัปดาห์ได้รวดเร็วโดยไม่เหนื่อย ความผันผวนของราคา สถานะสต็อก การเปลี่ยนอันดับ และการอัปเดตข้อมูลสาธารณะล้วนจัดการแบบนี้ได้ หากเวิร์กโฟลว์เป็นแบบอ่านอย่างเดียวและไม่เขียนข้อมูล ต้นทุนของความผิดพลาดแทบเป็นศูนย์

การสร้างร่างแรกจำนวนมากและการเขียนเนื้อหาใหม่ก็ใช้งานได้แล้ว เมื่อกำหนดหัวข้อ Agent สามารถรวบรวมข้อมูลสาธารณะ จัดเป็นบันทึกที่มีโครงสร้าง และสร้างโครงร่างของฉบับแรก ช่วยประหยัดเวลาค้นข้อมูลได้มาก การเขียนใหม่ก็คล้ายกัน เนื้อหายาวสามารถแบ่งและปรับตามความยาวและโทนของแต่ละช่องทางได้ในระดับที่ค่อนข้างสมบูรณ์ อย่างไรก็ตาม ผลลัพธ์ยังควรถือเป็นร่าง ส่วนที่ต้องอาศัยประสบการณ์ การตัดสินใจ หรือมุมมองส่วนตัวจำเป็นต้องให้คนเติมเข้าไป ไม่เช่นนั้นเนื้อหาจะดูว่างเปล่า

งานตอบลูกค้าและอีเมลชั้นแรกก็รับภาระได้มาก คำถามที่พบบ่อย การเช็กสถานะขนส่ง การอธิบายขั้นตอนคืนและเปลี่ยนสินค้า และการยืนยันนัดหมาย มักมีคำตอบมาตรฐาน ให้ Agent รับเรื่องเหล่านี้ก่อน แล้วทำเครื่องหมายบทสนทนาที่เกินขอบเขตเพื่อส่งต่อให้คน จะช่วยให้ความเร็วในการตอบดีขึ้นอย่างเห็นได้ชัด

การเปรียบเทียบราคาและรวบรวมข้อมูลก็เสถียรเช่นกัน การรวมราคาสินค้าชิ้นเดียวกันจากหลายช่องทาง ความแตกต่างด้านสเปก และข้อร้องเรียนที่พบซ้ำในรีวิวให้อยู่ในตารางเดียว มักเชื่อถือได้กว่าการให้คนเปิดดูทีละหน้า หากกำหนดมิติเปรียบเทียบชัดเจน ผลลัพธ์ก็มักนำไปใช้ได้ทันที

ทั้งสี่กรณีนี้ยังมีเงื่อนไขแฝงร่วมกันอีกข้อ คือขอบเขตของงานต้องชัดเจน ยิ่งบอกได้ชัดว่า “รับอะไรเข้า ต้องส่งอะไรออก และหยุดเมื่อใด” เวิร์กโฟลว์ก็ยิ่งทำงานเสถียร

งานที่ยังทำให้ทำงานได้ไม่ดีในตอนนี้

อีกฝั่งของขอบเขตก็ชัดเจนเช่นกัน ปัญหาไม่ได้อยู่ที่ความสามารถของโมเดลเสมอไป แต่ติดข้อจำกัดของโลกจริง

ตัวอย่างที่ชัดที่สุดคือการกระทำที่ต้องใช้ตัวตนของบัญชี สถานะล็อกอิน ข้อมูลยืนยันตัวตน และชื่อเสียงที่สะสมมา ล้วนเป็นการอนุญาตที่แพลตฟอร์มมอบให้บุคคลหรือหน่วยงานเฉพาะ Agent ไม่สามารถได้สิทธิ์เหล่านี้ด้วยเทคนิคเพียงอย่างเดียว การให้ Agent “ใช้งานบัญชีหนึ่งบัญชี” จึงเป็นคนละเรื่องกับการให้ Agent “ประมวลผลชุดข้อมูลหนึ่งชุด” อย่างสิ้นเชิง

การกระทำที่เกี่ยวกับการจ่ายเงินก็ไม่ควรมอบให้ระบบอัตโนมัติทั้งหมด การสั่งซื้อ การตัดเงิน การโอนเงิน หรือการไถ่ถอนสินทรัพย์ ล้วนเป็นการเคลื่อนย้ายมูลค่าจริง จึงควรเก็บขั้นตอนยืนยันสุดท้ายไว้ให้มนุษย์ ไม่ใช่เพียงเพราะกลัวความผิดพลาด แต่เพราะการทำธุรกรรมทางการเงินจำนวนมากย้อนกลับไม่ได้

ยังมีการกระทำอีกประเภทที่ต้องได้รับการยอมรับหรืออนุมัติจากแพลตฟอร์ม เช่น การผ่านการประเมิน การอนุมัติคุณสมบัติ การสมัครกิจกรรม หรือการผ่านการตรวจเนื้อหา ผลลัพธ์เหล่านี้ขึ้นกับการตัดสินของแพลตฟอร์ม ไม่มีทางลัดทางเทคนิคที่จะข้ามการตัดสินนั้น คำกล่าวอ้างว่าเครื่องมือสามารถรับประกันผลลัพธ์แบบนี้แทนคุณได้โดยทั่วไปจึงไม่น่าเชื่อถือ

การสมัครบัญชีจำนวนมากและการทำภารกิจอัตโนมัติเพื่อสะสมรางวัลก็ไม่ควรอยู่ในเวิร์กโฟลว์ที่เหมาะสม วิธีเหล่านี้ชนกับกฎของแพลตฟอร์มที่ระบุไว้อย่างชัดเจน และการตรวจจับไม่ได้ดูแค่การกระทำครั้งเดียว จังหวะการใช้งาน เส้นทางพฤติกรรม และความสอดคล้องของสภาพแวดล้อมล้วนมีผล แม้ทางเทคนิคจะรันได้ แต่อายุของบัญชีก็ยังขึ้นกับสิ่งที่แพลตฟอร์มยอมรับ และเงื่อนไขนั้นเปลี่ยนได้ตลอดเวลา

จุดตรวจที่ควรเก็บไว้ให้มนุษย์

Agent เหมาะที่สุดเมื่อใช้เป็นชั้นสำหรับลงมือทำ ขั้นตอนต่อไปนี้ควรคงไว้ภายใต้การควบคุมของคน

กำหนดเป้าหมายและลำดับความสำคัญ การตัดสินว่าจะทำอะไร ใช้มาตรฐานใด และเมื่อไรควรหยุด มีน้ำหนักมากกว่าความเร็วในการทำงาน Agent จะไม่รับผลลัพธ์แทนคุณหากเลือกทิศทางผิด

ตรวจสอบเนื้อหาที่ส่งออกไปภายนอก สิ่งใดก็ตามที่จะถูกอ่านในชื่อของคุณ—อีเมล คำตอบ โพสต์ หรือรายงาน—ควรตรวจอีกครั้งก่อนส่ง เหตุผลง่ายมาก หากผิด คนที่รับผิดชอบคือคุณ

ยืนยันการกระทำเกี่ยวกับเงินและสิทธิ์ สิทธิ์อ่านสามารถเปิดกว้างเพื่อให้ Agent ดูข้อมูลและสร้างรายงานได้ตลอดเวลา การปรับทั่วไป เช่น เปลี่ยนพารามิเตอร์หรือหยุดงานที่ไม่มีประสิทธิภาพ ก็สามารถมอบหมายได้ แต่การเปลี่ยนแปลงขนาดใหญ่และการทำงานจำนวนมากควรผ่านการยืนยันจากมนุษย์อีกครั้ง วิธีนี้รักษาได้ทั้งประสิทธิภาพและการควบคุม

เก็บบันทึกการดำเนินงาน ควรมีบันทึกว่า Agent ทำอะไร และทำตามกฎใด เมื่อเกิดปัญหา บันทึกนี้คือฐานสำหรับการตรวจสอบ และในเวลาปกติก็เป็นข้อมูลสำหรับปรับปรุงเวิร์กโฟลว์

เมื่ออยากให้หลายบัญชีทำงานพร้อมกันมากขึ้น

เมื่อเวิร์กโฟลว์หนึ่งทำงานได้เสถียร คำถามต่อไปที่เกิดขึ้นอย่างเป็นธรรมชาติคือจะนำรูปแบบเดียวกันไปใช้กับบัญชีอื่นได้หรือไม่

ตอนนั้นคอขวดมักไม่ใช่ Agent แต่เป็นสภาพแวดล้อมของบัญชี หากหลายบัญชีทำงานในสภาพแวดล้อมเบราว์เซอร์เดียวกันและออกอินเทอร์เน็ตผ่านจุดเดียวกัน แพลตฟอร์มสามารถจัดกลุ่มบัญชีเหล่านี้เข้าด้วยกันและจัดการเป็นชุดเดียวได้ง่าย แนวทางที่ใช้ได้คือจับคู่บัญชีกับสภาพแวดล้อมแบบหนึ่งต่อหนึ่ง โดยแต่ละบัญชีมีสภาพแวดล้อมเบราว์เซอร์อิสระและทางออกเครือข่ายคงที่ แล้วโหลดสภาพแวดล้อมที่ตรงกับบัญชีนั้นเมื่อทำงาน เครื่องมืออย่าง PurpleMark มีความสามารถในการจัดการหลายสภาพแวดล้อมลักษณะนี้ และทำงานร่วมกับสคริปต์ที่สลับสภาพแวดล้อมตามบัญชีได้

แต่อย่าสลับลำดับ การแยกสภาพแวดล้อมตอบได้เพียงว่า บัญชี “ดูเหมือนผู้ใช้อิสระหรือไม่” มันไม่ได้ตอบว่า “ควรทำสิ่งนั้นหรือไม่” การใช้งานบัญชีเองต้องสอดคล้องกับกฎก่อน การแยกสภาพแวดล้อมจึงจะมีความหมาย

ลำดับการเริ่มใช้งานที่ลดโอกาสพลาด

เริ่มจากกรณีเล็กและชัดเจนหนึ่งอย่าง แทนที่จะพยายามทำทุกขั้นตอนให้เป็นอัตโนมัติตั้งแต่วันแรก ตรวจดูว่าผลลัพธ์นำไปใช้ได้โดยตรงหรือไม่ ถ้าได้ค่อยเพิ่มขั้นตอนถัดไป ตั้งขอบเขตสิทธิ์ตั้งแต่ขั้นนี้ โดยเฉพาะสิทธิ์เขียนและการกระทำที่เกี่ยวข้องกับเงิน ให้เวิร์กโฟลว์เดียวทำงานอย่างเสถียรไปสักระยะก่อนค่อยขยายไปหลายบัญชี และเตรียมการแยกสภาพแวดล้อมก่อนเพิ่มขนาด

ลำดับนี้ช้ากว่าเล็กน้อย แต่ต้นทุนของความล้มเหลวในแต่ละขั้นต่ำ และข้อสรุปจากแต่ละขั้นก็นำกลับมาใช้ซ้ำได้