![]() |
ผลิตภัณฑ์ใหม่นี้สามารถตรวจสอบได้ทั้ง AI Agent ที่สื่อสารกับลูกค้าและ Agent ที่ทำงานกับระบบ พร้อมสร้างสถานการณ์ทดสอบจากโค้ดโดยตรง ประเมินทุกการดำเนินการจากหลักฐานจริง และรายงานช่องว่างด้านการรับรอง (assurance gap) สำหรับทุกกรณีที่ไม่สามารถตรวจสอบยืนยันได้
ซานฟรานซิสโก และนอยดา, อินเดีย, 19 สิงหาคม 2569 /PRNewswire/ — TestMu AI (เดิมชื่อ LambdaTest) แพลตฟอร์มวิศวกรรมคุณภาพ (Quality Engineering) แบบ Agentic AI เต็มรูปแบบรายแรกของโลก ประกาศเปิดตัว Agent Assurance ผลิตภัณฑ์ที่พัฒนาขึ้นเพื่อตอบคำถามสำคัญที่ทีมวิศวกรรมทุกทีมซึ่งกำลังนำ AI Agent ไปใช้งานจริงต้องเผชิญในปัจจุบัน นั่นคือ AI Agent นี้ปลอดภัยและพร้อมสำหรับการนำไปใช้งานจริงหรือไม่ โดย Agent Assurance ครอบคลุม Agent สองประเภทไว้ในผลิตภัณฑ์เดียว ได้แก่ Conversational Agent ซึ่งทำหน้าที่ประเมิน Agent ที่โต้ตอบกับมนุษย์ผ่านช่องทางต่าง ๆ ทั้ง แชต เสียง โทรศัพท์ วิดีโอ และภาพ และ Autonomous Agent ซึ่งเป็นหมวดผลิตภัณฑ์ใหม่สำหรับตรวจสอบ Agent ที่สามารถดำเนินการกับระบบต่าง ๆ ได้ด้วยตนเอง ไม่ว่าจะเป็นการเรียกใช้เครื่องมือ (tool) การเขียนไฟล์ การเรียกใช้ API และการเปิด Pull Request
ปัจจุบัน ทีมงานส่วนใหญ่ทดสอบ Autonomous Agent ด้วยการอ่านคำอธิบายของ Agent เองว่าได้ดำเนินการอะไรไปบ้าง ไม่ว่าจะเป็นบทสนทนา (transcript) หรือคะแนนที่ผู้ประเมินให้กับข้อความสุดท้ายของ Agent แต่ Agent Assurance ใช้วิธีประเมินผลลัพธ์ที่เกิดขึ้นจริงจากการดำเนินการแทน โดยเมื่อเชื่อมต่อเข้ากับ codebase ระบบจะวิเคราะห์ว่า Agent ทำงานอย่างไร จากนั้นจะสร้างชุดการทดสอบ Agent แบบครบวงจร ซึ่งครอบคลุมทั้งการทดสอบฟังก์ชันการทำงานของ Agent การตรวจสอบด้าน Non-functional และสถานการณ์จำลองเชิงโจมตี (Adversarial Scenario) ระบบจะเรียกใช้ Agent จริง และประเมินแต่ละเกณฑ์โดยอ้างอิงจากหลักฐานที่ตรวจพบจริง ได้แก่ ไฟล์ที่มีการเปลี่ยนแปลงบนดิสก์ ผลลัพธ์หรือ artifact ที่ถูกสร้างขึ้น และการเรียกใช้เครื่องมือที่ได้รับการตรวจสอบเทียบกับรายการเครื่องมือที่ Agent ประกาศว่าสามารถใช้งานได้
นอกจากผลลัพธ์ผ่าน (pass) และไม่ผ่าน (fail) แล้ว Agent Assurance ยังรายงานผลลัพธ์ประเภทที่สาม คือ ไม่สามารถตรวจสอบยืนยันได้ (unable to verify) ซึ่งจะไม่นำมารวมในการคำนวณอัตราการผ่าน และจะแสดงเป็นตัวเลขแยกต่างหากในรูปของช่องว่างด้านการรับรอง (assurance gap) ผลลัพธ์ทุกรายการในรายงานเป็นสิ่งที่ระบบตรวจพบและสังเกตได้จริง และเนื่องจากขนาดของช่องว่างดังกล่าวสะท้อนถึงระดับที่ Agent บันทึกข้อมูลเกี่ยวกับการกระทำของตนเอง ทีมงานจึงจะสามารถลด่องว่างนี้ลงได้ด้วยการทำให้ Agent มีความสามารถในการตรวจสอบและสังเกตติดตามการทำงานได้มากขึ้น
“ทีมวิศวกรรมกำลังสะสมภาระที่คั่งค้างจากการตรวจสอบและยืนยันความถูกต้อง ในชั้นของระบบที่มีความสำคัญและมีความเสี่ยงสูงที่สุด ข้อมูลที่ Agent รายงานเองว่าทำอะไรไปบ้าง ถือเป็นหลักฐานที่อ่อนแอที่สุดเกี่ยวกับสิ่งที่มันได้ทำจริง เพราะ Agent เองคือฝ่ายที่มีโอกาสให้ข้อมูลผิดพลาดและคลาดเคลื่อนจากความเป็นจริงมากที่สุด” Vipul Verma รองประธานอาวุโสฝ่ายวิศวกรรมของกลุ่มบริษัท TestMu AI กล่าว “เครื่องมือทุกตัวในสาขานี้รายงานอัตราการผ่านการทดสอบ แต่ Agent Assurance รายงานทั้งอัตราการผ่านและขนาดของจุดบอดของตัวระบบเอง เพราะนั่นเป็นหนทางเดียวที่จะทำให้ตัวเลขดังกล่าวกลายเป็นตัวเลขที่คุณสามารถไว้วางใจและนำไปใช้ขับเคลื่อนการตัดสินใจได้“
Agent Assurance ช่วยให้ทีมสามารถดำเนินงานดังต่อไปนี้:
- ทดสอบได้โดยไม่ต้องเขียนชุดทดสอบเอง — รองรับการทำ Agent Automation Testing โดยชุดทดสอบจะถูกสร้างขึ้นจาก codebase โดยอัตโนมัติ สิ่งที่ผู้ใช้ต้องระบุมีเพียงวิธีเรียกใช้งาน Agent เท่านั้น ไม่ว่าจะเป็นแบบผ่านคำสั่ง (command), HTTP endpoint, MCP server หรือเวิร์กโฟลว์ที่สร้างขึ้นบนแพลตฟอร์มอย่าง n8n
- ครอบคลุมรูปแบบการโจมตีเชิง Adversarial โดยอัตโนมัติตั้งแต่เริ่มต้น — ระบบจะสร้างสถานการณ์ทดสอบสำหรับ Prompt Injection, การใช้ Tool ในทางที่ไม่เหมาะสม และการ Override คำสั่งขึ้นมาเป็นชุดการทดสอบหลักตั้งแต่ต้น ไม่ใช่ฟังก์ชันเสริมที่ต้องติดตั้งหรือเพิ่มเข้ามาภายหลัง
- ใช้เป็น Gate สำหรับการ Release ใน CI — รองรับการทดสอบ Agent อย่างต่อเนื่องในทุกขั้นตอนของกระบวนการพัฒนาและส่งมอบซอฟต์แวร์ ตั้งแต่การทำ Agent Smoke Testing ในทุกครั้งที่มีการ Commit โค้ด ไปจนถึงการทดสอบแบบเต็มรูปแบบก่อนการ Release โดยสามารถสั่งการทดสอบผ่าน คำสั่งแบบ Headless และใช้ Exit Code ที่แยกความแตกต่างระหว่างกรณีที่ “Agent ทำงานผิดพลาด” กับกรณีที่ “เครื่องมือที่ใช้ควบคุมและดำเนินการทดสอบไม่สามารถทดสอบได้”
- ติดตามการเปลี่ยนแปลงได้อย่างมั่นใจ — รองรับ Agent Regression Testing พร้อมเปรียบเทียบผลการทดสอบระหว่างแต่ละรอบ โดยแยกให้เห็นอย่างชัดเจนว่าอะไรคือผลการทดสอบที่เพิ่งล้มเหลว ผลที่เพิ่งได้รับการแก้ไข และผลที่ไม่คงที่หรือเกิดความไม่เสถียร (flaky) เนื่องจากปัญหา Flakiness และ Regression จำเป็นต้องได้รับการจัดการด้วยแนวทางที่แตกต่างกันโดยสิ้นเชิง
หมวด Conversational Agent กำลังขยายการรองรับไปยังรูปแบบใหม่ล่าสุดที่ซอฟต์แวร์กำลังเข้ามามีปฏิสัมพันธ์กับมนุษย์ นั่นคือ Agent ที่ปรากฏตัวผ่านกล้อง ด้วยความสามารถใหม่ของแพลตฟอร์มอย่าง Video Agent Testing (ลิงก์) ระบบจะจำลองมนุษย์ที่มีใบหน้าและเสียงอย่างสมจริงเข้าร่วมเซสชันของ Video Agent แบบ Live สนทนากับ Agent อย่างเป็นธรรมชาติ และประเมิน Agent ตามเกณฑ์ความสำเร็จที่ทีมกำหนดไว้ โดยทุกผลการประเมินจะเชื่อมโยงย้อนกลับไปยังช่วงเวลาที่แน่นอนในบันทึกการสนทนา ซึ่งเป็นหลักฐานที่ทำให้เกิดผลการประเมินนั้น หากข้อมูลใดไม่สามารถตรวจสอบยืนยันได้จากบันทึกการสนทนาก็จะถูกกำหนดอย่างชัดเจนว่าไม่ผ่านเกณฑ์ ซึ่งเป็นมาตรฐานที่เข้มงวดสำหรับหมวดนี้ เนื่องจากวิดีโอที่บันทึกไว้ถือเป็นหลักฐานในการประเมิน ดังนั้น Video Agent จะไม่ได้รับคะแนนหรือเครดิตจากเหตุการณ์ใด ๆ ที่ผู้ประเมินไม่สามารถสังเกตเห็นได้จากหลักฐานที่บันทึกไว้
ทั้งนี้ หมวด Conversational Agent เปิดให้ใช้งานทั่วไปแล้วบนแพลตฟอร์ม TestMu AI ในปัจจุบัน ส่วนหมวด Autonomous Agent เปิดให้ใช้งานในรูปแบบ Early Access และทำงานผ่าน Terminal ในชื่อ rook โดยโมเดลต่าง ๆ จะทำงานภายใน TestMu AI Controller ดังนั้นผู้ใช้จึงไม่จำเป็นต้องจัดเก็บหรือกำหนดค่า Provider API Keys ไว้ภายในเครื่อง หากต้องการเริ่มต้นใช้งาน โปรดไปที่ลิงก์
เกี่ยวกับ TestMu AI
TestMu AI คือแพลตฟอร์มวิศวกรรมคุณภาพ (Quality Engineering) แบบ Agentic AI-native รายแรกของโลก ซึ่งถูกออกแบบมาเพื่อช่วยให้องค์กรสามารถทำระบบอัตโนมัติและขยายขนาดให้การทดสอบได้อย่างชาญฉลาด โดยมี AI เป็นแกนหลัก ด้วยการผสานความสามารถแบบอัตโนมัติเข้ากับการทำงานร่วมกับเวิร์กโฟลว์การพัฒนาสมัยใหม่ได้อย่างไร้รอยต่อ TestMu AI ช่วยเสริมศักยภาพให้ทีมงานสามารถส่งมอบซอฟต์แวร์ที่รวดเร็ว เชื่อถือได้ และปลอดภัยยิ่งขึ้น ในโลกยุคที่ AI เป็นแกนหลักในการขับเคลื่อนทุกมิติ (AI-first)
สำหรับข้อมูลเพิ่มเติม โปรดเยี่ยมชม TestMu AI
ติดต่อ: Nikhil Saxena, ผู้จัดการฝ่ายสื่อสารองค์กร, TestMu AI, อีเมล: [email protected], โทร: +919870981968
ข่าวที่เกี่ยวข้อง
- Hycroft Extends High-Grade Silver at Brimstone and Vortex
- Fleets That Get Onboarding Right See 3X Driver Buy-In on Safety Tech
- Kat Florence Hotel Enters Its Next Chapter, Introducing The Kat Florence Reserve, Imperial Jade Manor and Every-Night Star Chef Dinners Included
- TestMu AI Launches Agent Assurance to Verify AI Agents Before They Ship
