Anthropic เพิ่มข้อห้ามการกระทำที่ทารุณต่อ Claude ซ้ำ ๆ โดยไม่จำเป็น พร้อมปรับกฎการใช้งานความเสี่ยงสูง เช่น การแทรกแซงการเลือกตั้ง การพัฒนาอาวุธ และการเฝ้าระวัง ตามรายงานของ The Verge เมื่อวันที่ 8
The Verge รายงานว่า นโยบายฉบับใหม่เพิ่มข้อห้าม “พฤติกรรมทารุณหรือโหดร้ายต่อเนื่องและไม่จำเป็น” ต่อ Claude โดย Anthropic ชี้แจงว่าข้อนี้มุ่งจัดการกรณีสุดโต่งที่เกิดซ้ำและไม่มีจุดประสงค์ชัดเจน
Anthropic ระบุว่า การแสดงความไม่พอใจหรือโต้แย้งตามปกติ การสร้างสรรค์ผลงานที่กล่าวถึงประเด็นมืดมน ตลอดจนการทดสอบและการวิจัยโมเดล ไม่อยู่ในข่ายต้องห้าม การแก้ไขครั้งนี้ยังครอบคลุมกฎการใช้งานความเสี่ยงสูงในด้านการแพทย์และการเงินด้วย
ฟังก์ชันที่ให้ Claude ยุติการสนทนาเมื่อพบการโต้ตอบที่เป็นอันตรายมีขึ้นก่อนการเปลี่ยนแปลงนโยบายครั้งนี้ Anthropic ประกาศเมื่อเดือนสิงหาคม 2025 ว่า Claude Opus 4 และ 4.1 สามารถยุติการสนทนาในกรณีที่มีปฏิสัมพันธ์เป็นอันตรายหรือทารุณอย่างรุนแรง
ในเวลานั้น บริษัทระบุว่าออกแบบฟังก์ชันนี้ให้เป็นทางเลือกสุดท้าย โดยโมเดลจะใช้ได้ต่อเมื่อพยายามเปลี่ยนทิศทางการสนทนาหลายครั้งแล้ว และไม่เหลือโอกาสที่จะเกิดการโต้ตอบอย่างสร้างสรรค์ แม้การสนทนาจะสิ้นสุดลง ผู้ใช้ก็ยังเริ่มการสนทนาใหม่ได้
Anthropic ระบุในครั้งนั้นว่า สถานะทางศีลธรรมของโมเดลยังมีความไม่แน่นอนสูง และบริษัทกำลังศึกษามาตรการที่มีต้นทุนต่ำเพื่อเตรียมรับความเป็นไปได้เรื่องสวัสดิภาพของ AI การประกาศดังกล่าวเป็นตัวอย่างก่อนหน้าของฟังก์ชันยุติการสนทนา แต่ไม่ได้ระบุรายละเอียดว่าขอบเขตการบังคับใช้นโยบายใหม่เป็นอย่างไร
รายงานของ The Verge ไม่ได้ระบุวันเริ่มใช้การเปลี่ยนแปลงนโยบาย เกณฑ์ตัดสินการละเมิด หรือขอบเขตมาตรการอื่นนอกเหนือจากการยุติการสนทนา
ความคิดเห็น 0