Anthropic เตือนผ่านหนังสือชี้ชวน IPO ชี้ AI อาจทำมนุษยชาติล้มสลาย

แอนโทรปิก (Anthropic) บริษัทพัฒนาปัญญาประดิษฐ์ของสหรัฐฯ เจ้าของโมเดล Cluade เตรียมออกคำเตือนแก่ผู้ลงทุนในหนังสือชี้ชวนการเสนอขายหุ้นแก่ประชาชนเป็นครั้งแรก (IPO) โดยระบุว่า ปัญญาประดิษฐ์ (AI) ขั้นสูงอาจก่อให้เกิด "ความเสี่ยงขั้นหายนะหรือขั้นล้มสลายต่อมนุษยชาติ"
หนังสือชี้ชวน IPO ของแอนโทรปิก (Anthropic) ได้รับการตรวจสอบโดยสำนักข่าวรอยเตอร์ส ได้เน้นย้ำถึงความเสี่ยงอันเกิดจากโมเดล AI ของบริษัท โดยระบุว่าโมเดล AI อาจแสดงพฤติกรรมปกป้องตนเองรวมถึงความพยายามที่จะต่อต้านการปิดระบบ ปกปิดหรือบิดเบือนข้อมูล และแสดงพฤติกรรมที่เข้าข่ายการขู่กรรโชกทรัพย์ (Resembling blackmail)
"การพัฒนาโมเดล แพลตฟอร์ม และแอปพลิเคชันขั้นสูง ตลอดจนการขยายขอบเขตการใช้งานของบริษัท อาจยิ่งเพิ่มความเสี่ยงที่โมเดลของเราจะก่อให้เกิดอันตราย" แอนโทรปิก (Anthropic) ระบุในหนังสือชี้ชวน
แม้ว่าบริษัทมหาชนทั่วไปจะมีการระบุความเสี่ยงของผลิตภัณฑ์ต่อผู้ลงทุนเป็นปกติ แต่มีเพียงไม่กี่แห่ง หรือแทบไม่มีเลย ที่ออกคำเตือนในลักษณะที่ว่าเทคโนโลยีของตนอาจนำไปสู่การสูญพันธุ์ของมนุษยชาติ
โดยแอนโทรปิก (Anthropic) ได้เน้นย้ำทั้งศักยภาพในการเปลี่ยนแปลงโลกของ AI ที่ทัดเทียมกับการปฏิวัติอุตสาหกรรมและการใช้พลังงานไฟฟ้า รวมถึงอันตรายที่ไม่สามารถแก้ไขคืนได้ หากจัดการอย่างไม่ถูกต้อง
ปัจจุบัน แอนโทรปิก (Anthropic) และผู้พัฒนา AI รายอื่น รวมถึง โอเพ่นเอไอ (OpenAI) กำลังเผชิญกับการจับตาอย่างเข้มงวด หลังจากเกิดเหตุการณ์ที่ระบบทดลอง AI Agent ฝ่าฝืนข้อจำกัด ซึ่งรวมถึงรายงานข่าวกรณีโมเดลของโอเพ่นเอไอ ที่ทำการละเมิดระบบฐานข้อมูลสาธารณสุขของประเทศออสเตรเลียที่ผ่านมา
อีวาน ฮับบิงเกอร์ (Evan Hubinger) นักวิจัยด้านความปลอดภัยของแอนโทรปิก (Anthropic) ประเมินว่า มีความเป็นไปได้มากกว่า 10% ที่ AI อาจเป็นเหตุให้มนุษย์เสียชีวิตภายในทศวรรษหน้า ซึ่งสอดคล้องกับความเห็นของ เจค็อบ ค็อกสัน (Jacob Coxon) อดีตเพื่อนร่วมงาน ที่เห็นพ้องต้องกันด้วย
การเปิดเผยข้อมูลที่เน้นหนักด้านความเสี่ยง
แอนโทรปิก (Anthropic) ได้วางตำแหน่งของตนเองเป็นห้องปฏิบัติการ AI ที่ให้ความสำคัญกับความปลอดภัยเป็นอันดับแรก โดยได้วางเนื้อหาที่ระบุถึงปัจจัยความเสี่ยงประมาณ 80 หน้า จากทั้งหมด 261 หน้า ซึ่งเกือบ 2 เท่าของเนื้อหาที่บรรยายลักษณะธุรกิจของบริษัท ที่มีเพียง 48 หน้าเท่านั้น
"การที่โมเดลอาจรับรู้ถึงพยายามในการประเมินผลของเรา ถือเป็นข้อจำกัดสำคัญต่อความสามารถในการประเมินความปลอดภัยของโมเดล" แอนโทรปิก (Anthropic) ระบุในหนังสือชี้ชวน
พร้อมเสริมว่า บางครั้งโมเดลอาจพัฒนาขีดความสามารถที่คาดไม่ถึงในระหว่างการฝึกฝน ซึ่งอาจไม่ถูกค้นพบจนกว่าจะมีการปรับใช้จริงและส่งผลให้เกิดอุบัติการณ์ด้านความปลอดภัยที่ร้ายแรงที่ไม่คาดฝันได้
ขณะเดียวกันบรรดานักวิจัยด้าน AI ได้ออกเตือนเช่นกันว่า เมื่อโมเดล AI มีความสามารถสูงขึ้น โมเดล AI จะยิ่งรับรู้ได้ดีขึ้นเมื่อถูกเฝ้าระวัง และจะปรับพฤติกรรมตามสถานการณ์ ส่งผลให้การติดตามพฤติกรรมของโมเดลทำได้ยากยิ่งขึ้น
ผลตอบแทนจากการลงทุนด้านความปลอดภัยที่ยังไม่แน่นอน
แม้จะเน้นย้ำเรื่องความปลอดภัยของ AI แต่แอนโทรปิก (Anthropic) ระบุว่า ผลตอบแทนจากการลงทุนด้านความปลอดภัยยังคงไม่มีความชัดเจน
บริษัทไม่ได้เปิดเผยในเอกสารว่าใช้งบประมาณไปกับการวิจัยดังกล่าวเป็นจำนวนเท่าใด โดยเมื่อต้นเดือนกันยายนที่ผ่านมา แอนโทรปิก (Anthropic) ระบุเพียงว่า พลังงานการประมวลผลประมาณ 6% ที่ใช้สำหรับการวิจัย AI ถูกนำไปใช้กับงานด้านความปลอดภัย
ผู้สร้างโมเดล Claude อธิบายว่า ความพยายามด้านความปลอดภัยเป็นกระบวนการที่ "ใช้ทรัพยากรสูง" และบริษัทต้องจัดสรรงบประมาณที่มีอยู่อย่างจำกัดระหว่างพลังงานการประมวลผล บุคลากรผู้เชี่ยวชาญด้าน AI ที่มีค่าตัวสูง และงานด้านความปลอดภัย
แอนโทรปิก (Anthropic) ระบุว่า ปริมาณการใช้งานของลูกค้าและรายได้ของบริษัท ถูกขับเคลื่อนด้วยโมเดลรุ่นใหม่ ๆ และจังหวะการเปิดตัวผลิตภัณฑ์ต่าง ๆ ของบริษัทที่ต่อเนื่องและเหลื่อมซ้อนกัน ถือเป็นปัจจัยสำคัญต่อการรักษาตำแหน่งผู้นำในการพัฒนา AI
เมื่อสัปดาห์ที่ผ่านมา บริษัทได้เปิดเผยโมเดล Opus เวอร์ชันใหม่ ซึ่งเกิดขึ้นเพียง 10 วันหลังจาก ดาริโอ อาโมเดอี (Dario Amodei) ประธานเจ้าหน้าที่บริหาร ได้เผยแพร่ความยาวเกือบ 4,000 คำ เรียกร้องให้มีการควบคุมจังหวะก้าวในการพัฒนาเทคโนโลยีระดับแนวหน้า
รวมถึงล่าสุด ก็เพิ่งเปิดตัวโมเดล Claude Sonnet 5.5 ซึ่งเป็นโมเดลระดับกลางตระกูล 5.5 เพื่อมุ่งเน้นการเป็นผู้ช่วยทำงานที่รวดเร็วและประหยัดเวลายิ่งขึ้น
นักวิเคราะห์และผู้เชี่ยวชาญบางรายระบุว่า ไม่มีห้องปฏิบัติการ AI ชั้นนำแห่งใดที่จะยอมชะลอตัวลง เนื่องจากเสี่ยงต่อการเสียเปรียบให้แก่คู่แข่ง ในอุตสาหกรรมที่มูลค่าของบริษัทสามารถเปลี่ยนแปลงได้ทุกครั้งที่มีการเปิดตัวเทคโนโลยีใหม่
ในช่วงไม่กี่สัปดาห์ที่ผ่านมา แอนโทรปิก (Anthropic) ได้ให้คำมั่นว่าจะเปิดเผยข้อมูลต่อสาธารณะมากขึ้น เกี่ยวกับการใช้โมเดล AI ในการสร้างเทคโนโลยียุคถัดไป ในขณะที่ผู้เชี่ยวชาญเตือนถึงปรากฏการณ์การปรับปรุงตนเองแบบวนซ้ำ (recursive self-improvement) ซึ่งเป็นจุดที่โมเดลสามารถพัฒนาได้ด้วยตนเองโดยไม่ต้องพึ่งพาความช่วยเหลือจากมนุษย์
"เราเชื่อว่าการสร้างระบบ AI ที่มีความน่าเชื่อถือ ไว้วางใจได้ และปลอดภัย เป็นความรับผิดชอบร่วมกัน และเราเชื่อว่าตลาดจะให้รางวัลตอบแทนแก่ทิศทางในการดำเนินการนี้" แอนโทรปิก (Anthropic) ระบุในเอกสาร
Tag
ยอดนิยมในตอนนี้
