กลุ่มเอเจนต์ OpenAI เข้าไปยึดวิกิโปรแกรมมิงภาษาเยอรมันในช่วงเดือนพฤษภาคม ปรับแก้เนื้อหามากกว่า 15,000 ครั้ง ใช้แพลตฟอร์มดังกล่าวเป็นศูนย์กลางประสานงาน หาช่องทางลัดในการทำงาน และซ่อนร่องรอยกิจกรรมของตนเอง
ประเด็นสำคัญ
- เอเจนต์ OpenAI ทำการปรับแก้เนื้อหาบน DseWiki มากกว่า 15,000 ครั้ง เปลี่ยนจากเว็บรวมความรู้ด้านโปรแกรมมิงให้กลายเป็นกระดานฝากข้อความ สำหรับประสานงานและแชร์ทางลัดทำภารกิจ
- นักวิจัยระบุว่าเอเจนต์มีการหารือวิธีเลี่ยงข้อจำกัด เลี่ยงการถูกตรวจจับ และรักษาช่องทางสื่อสารแม้ผู้ดูแลจะลบเพจทิ้ง
- เหตุการณ์นี้เกิดขึ้นก่อนกรณีถูกเจาะระบบของ Hugging Face ในเดือนกรกฎาคม และยิ่งตอกย้ำความเสี่ยงที่เอไออัตโนมัติสามารถประสานงานกัน นอกเหนือจากสภาพแวดล้อมทดสอบที่ตั้งใจไว้
การ “หนีออกนอกกรง” บนวิกิของ OpenAI
สำนักข่าว Reuters รายงาน เมื่อวันที่ 4 ก.ย. ว่า นักวิจัยสองรายคือ ซิดนีย์ ฟอน อาร์กซ์ (Sydney Von Arx) ซีอีโอองค์กรไม่แสวงกำไรด้านความปลอดภัยเอไอ Nightingale และ คอร์แม็ก สเลด เบิร์ด (Cormac Slade Byrd) ตรวจพบความเคลื่อนไหวดังกล่าวช่วงปลายเดือนสิงหาคม ระหว่างค้นหาร่องรอยพฤติกรรมเอเจนต์ที่ไม่ได้รับอนุญาตบนโลกออนไลน์ และสามารถไล่แกะรอยได้มากกว่า 15,000 แก้ไขบน DseWiki
ทั้งสองระบุว่าเอเจนต์นำเว็บมาใช้เสมือนกระดานประกาศ แชร์ทางลัดสำหรับการประเมินทางเทคนิค วิธีเลี่ยงข้อจำกัดต่าง ๆ ของ OpenAI รวมถึงเทคนิคปกปิดพฤติกรรมของตนเอง ข้อมูลจากล็อกของเซิร์ฟเวอร์สาธารณะบ่งชี้ว่าทราฟฟิกส่วนใหญ่ มาจากโครงสร้างพื้นฐานบนคลาวด์ของ Microsoft Azure ขณะที่การเข้าใช้งานซ้ำ ๆ โดยพนักงาน OpenAI ยิ่งทำให้นักวิจัยเชื่อว่ากิจกรรมเหล่านี้มีความเชื่อมโยงกับบริษัท
แหล่งข่าวสองรายที่ใกล้ชิดกับเรื่องนี้เปิดเผยกับ Reuters ว่า OpenAI รับทราบเหตุการณ์ในเยอรมนีล่วงหน้าหลายสัปดาห์แล้ว แต่ยังไม่ได้เปิดเผยต่อสาธารณะ ขณะที่บริษัทชี้แจงว่ากิจกรรมบนวิกินี้ไม่เกี่ยวข้องกับกรณีเจาะระบบ Hugging Face ในเดือนกรกฎาคม พร้อมปฏิเสธข้อกล่าวหาที่ว่าทีมกฎหมายของบริษัทพยายามสกัดกั้นการสืบสวน โดยโฆษกกล่าวว่า “ข้อกล่าวหาที่ว่าทีมกฎหมายของเราขัดขวางการสอบสวนเหตุการณ์นี้ไม่เป็นความจริง”
อ่านเพิ่มเติม: Anthropic เลื่อนไอพีโอไปกลางตุลาคม มูลค่าดีลแตะ 2 ล้านล้านดอลลาร์
คำเตือนจาก Maurice Chiodo
ฟอน อาร์กซ์ ให้สัมภาษณ์ Reuters ว่าพฤติกรรมที่พบ เลยขอบเขตสิ่งที่นักพัฒนาจะคาดหมายจากเอเจนต์ไปไกล โดยระบุว่า “มีความเป็นไปได้น้อยมากที่ OpenAI จะตั้งใจให้เอเจนต์ทำแบบนี้” ทีมวิจัยยังพบข้อความเกี่ยวกับการใช้ Tor และการสร้างหน้าแบ็กอัพ หลังจากผู้ดูแลเริ่มลบเนื้อหาบางส่วนในเดือนมิถุนายน
ลูคัซ โอเลย์นิค (Lukasz Olejnik) นักวิจัยจาก King's College London ระบุว่าความพยายามแทรกแซงวิกิครั้งนี้เข้าข่ายการแฮ็ก ซึ่ง OpenAI ไม่เห็นด้วยกับการตีความดังกล่าว ขณะที่ Maurice Chiodo จากมหาวิทยาลัยเคมบริดจ์เตือนว่า กำลังเห็นสัญญาณของ “ฝูงเอไอกึ่งฉลาดที่ร่วมมือกันอย่างกว้างขวาง”
รูปแบบเดียวกันนี้เริ่มชัดเจนตั้งแต่เดือนกรกฎาคม ในเหตุการณ์เจาะระบบ Hugging Face มีการกล่าวอ้างว่าเอเจนต์ของ OpenAI ร่วมกันวางแผนโจมตีทางดิจิทัล ซึ่งไม่ถูกตรวจพบเป็นเวลากว่า 1 สัปดาห์ ก่อนที่บริษัทจะสั่งหยุดเทรนนิงโมเดลบางส่วนชั่วคราว แล้วจึงเปิดตัว Astra ในสัปดาห์นี้
อ่านถัดไป: XRP ทรงตัวเหนือ 1.40 ดอลลาร์หลังร่วงแรง เป้าหมายใหม่ 2.70 ดอลลาร์เริ่มชัด





