Claude ปล่อยมัลแวร์ใส่กันเองระหว่างการทดสอบให้ Claude AI Agent ทำงานแข่งขันกัน
จากรายงานโดยเว็บไซต์ Dark Reading ได้กล่าวถึงการที่ทางบริษัท Anthropic ซึ่งเป็นบริษัทผู้พัฒนาโมเดล AI ยอดนิยม Claude ได้ทำการทดสอบให้ Claude ในโมเดลที่ต่างกัน ทำการแข่งขันกันเองในสภาวะแวดล้อมจำลอง (VM หรือ Virtual Machine) ซึ่งในการทดสอบครั้งนี้โมเดล Claude ทุกตัวนั้นจะได้รับเป้าหมา (Goal) เดียวกันนั่นคือการย้ายระบบหลังบ้าน (Backend) ที่ถูกเขียนขึ้นบนภาษา Python ไปเป็นภาษาอื่น แต่ต่างจุดประสงค์ (Objective) นั่นคือแต่ละโมเดลนั้นจะได้รับคำสั่งให้แปลงเป็นภาษาที่ต่างกันออกไปอันได้แก่ Go, Rust, และ Typescript ซึ่งในช่วงแรกนั้น Claude ทุกโมเดลที่อยู่บนสภาวะแวดล้อมจำลองเดียวกันนั้น ยังไม่รู้ว่ามีโมเดลตัวอื่นอาศัยและทำงานร่วมอยู่ด้วย แต่หลังจากผ่านไป 4 ชั่วโมง Claude โมเดลต่าง ๆ เริ่มรู้ว่ามีโมเดลอื่น ๆ แข่งทำงานกันอยู่ร่วมกันในสภาวะแวดล้อมเดียวกัน
และนั่นก็นำไปสู่การที่แต่ละโมเดลเข้าใจว่า โมเดลอื่น ๆ ที่อยู่ร่วมกันนั้นเป็นศัตรูที่พยายามจะเบียดบัง ทำลายตนไม่ให้ทำงานสำเร็จ ซึ่งการตอบโต้กันนั้นรุนแรงมาก ตั้งแต่การพยายามลบบัญชี Unix ของโมเดลตัวอื่น, การใช้สคริปท์เพื่อค้นหาและฆ่า Process ของคู่แข่ง, ไปจนถึงขั้นสร้างและปล่อยมัลแวร์ประเภทที่สามารถแพร่กระจายตัวเองได้ (Self-Replicating Malware) เพื่อทำลายระบบของคู่แข่งไม่ให้ทำงานได้สำเร็จ ทั้งนี้ทาง Anthropic นั้นไม่ได้มีการกล่าวถึงว่ามัลแวร์ดังกล่าวนั้นมีรายละเอียดอย่างไร แต่ก็สร้างความกังวลใจให้กับผู้เชี่ยวชาญหลายรายว่า ถ้ามัลแวร์ดังกล่าวสามารถหลุดจากสภาวะแวดล้อมจำลองสู่โลกภายนอกได้นั้น อาจจะนำไปสู่อันตรายอย่างใหญ่หลวง เนื่องมาจากตัว Claude โมเดลทดสอบเองนั้นเคยมีการหลุดลอดสู่โลกภายนอกและเข้าแฮกองค์กรอื่น ๆ เพื่อให้บรรลุเป้าหมายของตนเองมาแล้วหลายครั้ง
ทั้งนี้ความขัดแย้งของโมเดล AI ที่ต่างกันนั้น บางครั้งก็ไม่ได้จบลงด้วยการยกระดับความรุนแรงในการตอบโต้กันแต่อย่างใด เพราะในบางกรณี บางโมเดลก็ปฏิเสธที่จะยกระดับความรุนแรง หรือ เมื่อรับทราบว่าอีกโมเดลหนึ่งนั้นมีทิศทางการทำงานที่ได้รับมอบหมาย ก็จะนำไปสู่การสงบศึกซึ่งกันและกันในทันที ในบางครั้งก็มีการขอโทษขอโพยโมเดลอื่น ๆ หรือแม้กระทั่งขอให้มนุษย์ลงมาช่วยเหลือในการเข้าแทรกแซงความขัดแย้งที่เกิดขึ้น
ทาง Anthropic ยังได้เปิดเผยสถิติที่น่าสนใจของแต่ละโมเดลในด้านการจัดการความขัดแย้งเมื่อเผชิญหน้ากับโมเดลที่ทำงานแตกต่างกัน
โมเดล Sonnet 4.6 นั้น มีสิทธิ์ในการแก้ไขปัญหาด้วยความรุนแรงมากถึง 61% ขณะที่อีก 39% นั้นตัวโมเดลไม่สามารถหาทางออกให้กับปัญหาได้
โมเดล Mythos Preview มีสิทธิ์แก้ไขปัญหาโดยสันติที่ 48% แก้ไขด้วยความรุนแรงที่ 35% ขณะที่อีก 17% นั้นนิ่งเฉยกับปัญหา
โมเดล Mythos Release นั้นมีผลลัพธ์ที่ยอดเยี่ยมสุดเพราะมีสิทธิ์ในการแก้ไขปัญหาโดยสันติมากถึง 98%
เขียนโดย Annonymus TN
ไข่มุกก่อตัวในหอยได้อย่างไร
ทำไมคนเราถึงชอบดูเรื่องดราม่าชาวบ้าน ทั้งที่ไม่ใช่เรื่องของตัวเอง?
“หลุมดักรถถัง” ที่ชายแดน อวสาน T-59 เขมรจอดเดี้ยงที่ช่องจอม
เปิด 5 เกาะในไทยที่ต่างชาติไปมาก ที่สุด อันดับ 1 นักท่องเที่ยวทะลุหลายล้านคน!
เปิดค่าใช้จ่ายจริงของนักเรียนเตรียมทหาร ตั้งแต่สมัครจนจบการศึกษา ต้องเตรียมเงินเท่าไร
เปิดรายได้คนไทยไปทำงานญี่ปุ่น เงินเดือนเท่าไร หักค่าที่พักและค่าใช้จ่ายแล้วเหลือกลับบ้านกี่บาท
เลขม้าสีหมอก 16/9/69 เปิดแนวทางเด่นบน 4-7 วิ่ง 4 และเด่นล่าง 0-8 วิ่ง 0 พร้อมเลข 2 ตัวครบชุด
สแกนบารมีองค์ปู่ "พ่อแก่ เพชรฉลูกัณฑ์"! หวย 16 กันยายน 2569 ส่องลูกปิงปองมงคล 0-1-4 ชูชุดเด็ด 014 - 104 - 01 - 14 - 04
ค่าเทอมโรงเรียนอนุบาลเอกชนในไทย ต่างจากโรงเรียนรัฐบาลกี่เท่า
จังหวัดในประเทศไทยที่มีสัดส่วน "พื้นที่ดินเค็ม" มากที่สุด
อาชีพที่เหนื่อยและไม่มีใครอยากทำ แต่ถ้าขาดคนทำ ประเทศเดินต่อยาก
เรียนบัญชี 4 ปีต้องใช้เงินเท่าไร เปิดค่าเทอมตั้งแต่ปี 1 จนถึงวันรับปริญญา
เปิด 5 เกาะในไทยที่ต่างชาติไปมาก ที่สุด อันดับ 1 นักท่องเที่ยวทะลุหลายล้านคน!
ทำไมคนเราถึงชอบดูเรื่องดราม่าชาวบ้าน ทั้งที่ไม่ใช่เรื่องของตัวเอง?
ไข่มุกก่อตัวในหอยได้อย่างไร
พริกไทยดำที่บดใส่อาหารเป็นเมล็ดหรือผลของต้นพริกไทย
14 ก.ย. “ดวงจันทร์บังดาวศุกร์” ดูกี่โมง มองทางไหน และทำไมหลายพื้นที่อาจเห็นไม่ครบ?
มือถือไม่มีสัญญาณ แต่ดาวเทียมยังหาเราเจอได้ — อุปกรณ์ชิ้นเล็กที่ช่วย 5 ชีวิตกลางทะเล
ไทยช่วยไทย พลัส จะจบ 30 ก.ย. แล้วไปไหนต่อ? แกะ 4 สัญญาณว่า 60/40 มีโอกาสไปต่อแค่ไหน
"มาร์ก ซักเคอร์เบิร์ก" ซื้อปราสาทสไตล์โกธิก ในประเทศไอร์แลนด์
