ลายน้ำข้อความของ Anthropic เป็นเวอร์ชันหนึ่งของเทคนิค SynthID-Text ของ Google DeepMind ซึ่งตีพิมพ์ในวารสาร Nature ที่ผ่านการตรวจสอบโดยผู้ทรงคุณวุฒิในปี 2024 ต่างจากลายน้ำที่มองเห็นหรือข้อมูลเมตาที่ซ่อนอยู่ SynthID-Text ทำงานทั้งหมดผ่านการกระจายตัวทางสถิติของตัวเลือกคำ
เมื่อ Claude สร้างข้อความ มันมักจะเจอตัวเลือกคำถัดไปหลายตัวที่มีความเหมาะสมพอๆ กัน เช่น การเลือกระหว่างคำว่า "ครึ้ม" หรือ "เทา" หลังจากวลี "วันนี้อากาศหนาวและ..." โดยปกติ การเลือกนี้จะถูกตัดสินโดยตัวสร้างตัวเลขสุ่ม แต่ภายใต้ระบบลายน้ำ ความสุ่มนี้จะถูกแทนที่ด้วย คีย์ลับที่รวมกับคำสองสามคำก่อนหน้า ทำให้เกิดรูปแบบที่ทำซ้ำได้แต่มองไม่เห็น ในการเลือกคำพ้องความหมายของ Claude
คุณสมบัติหลักของลายน้ำ:
Anthropic ระบุอย่างชัดเจน: "การใส่ลายน้ำไม่มีผลกระทบต่อคุณภาพของผลลัพธ์ของ Claude" บริษัทรายงานว่าความแตกต่างระหว่างข้อความที่มีลายน้ำและไม่มีลายน้ำนั้นแยกไม่ออกสำหรับผู้อ่าน โดยไม่มีผลกระทบต่อเนื้อหา ความคิดสร้างสรรค์ หรือความสามารถในการอ่าน
คำกล่าวอ้างเหล่านี้ได้รับการสนับสนุนโดยงานวิจัย SynthID-Text ของ Google DeepMind การศึกษานั้นทำการทดสอบ A/B กับการรับส่งข้อมูลจริงของ Gemini: คะแนนการกดถูกใจและไม่ถูกใจ ไม่แสดงความแตกต่างที่มีนัยสำคัญทางสถิติ จากโมเดลที่ไม่มีลายน้ำ และการศึกษาจากผู้ประเมินที่เป็นมนุษย์ที่มีการควบคุมก็ไม่พบความแตกต่างด้านคุณภาพที่รับรู้ได้ ลายน้ำไม่มีค่าใช้จ่ายเพิ่มเติมและไม่ต้องใช้โทเค็นพิเศษระหว่างการสร้าง
ได้ แต่ความง่ายในการลบขึ้นอยู่กับระดับของการแก้ไข:
ลายน้ำทำงานแตกต่างกันกับโค้ด เนื่องจากโค้ดมี ตัวเลือกคำที่มีความเสี่ยงต่ำน้อยกว่ามาก Anthropic อธิบายว่าในกรณีที่ต้องการผลลัพธ์ที่แน่นอน เช่น "ผลงานที่มีชื่อเสียงที่สุดของไอแซก นิวตัน เรียกว่า Principia Mathematica" มีคำที่ถูกต้องเพียงคำเดียว ดังนั้นลายน้ำจึงไม่มีอะไรให้ดำเนินการ
ตรรกะเดียวกันนี้ใช้กับโค้ด: การเรียกใช้ฟังก์ชันเฉพาะ คีย์เวิร์ดที่จำเป็นทางไวยากรณ์ และชื่อไลบรารีที่แน่นอน ไม่มีสัญญาณลายน้ำ ลายน้ำสามารถปรากฏได้เฉพาะในตำแหน่งที่มีโทเค็นที่ถูกต้องหลายตัว เช่น ชื่อตัวแปร การใช้ถ้อยคำในความคิดเห็น หรือความแตกต่างของโครงสร้างโค้ด
สำหรับการพิสูจน์อักษรหรือการแก้ไขข้อความมนุษย์เล็กน้อย ลายน้ำก็เบาบางเช่นกัน โดยจะใช้เฉพาะกับคำที่ Claude เลือกจริงๆ ซึ่งอาจน้อยเกินไปที่จะตรวจจับ
Anthropic ยืนยันเมื่อวันที่ 12 สิงหาคม 2026 ว่ากำลังพัฒนา API ตรวจจับข้อความแบบสาธารณะ ที่จะช่วยให้นักพัฒนาบุคคลที่สามตรวจสอบว่าข้อความนั้นมีแนวโน้มว่าจะถูกสร้างโดย Claude หรือไม่ API จะใช้คีย์ลับเพื่อเปรียบเทียบรูปแบบการเลือกคำกับสิ่งที่ Claude จะสร้างขึ้น ณ วันที่ 15 สิงหาคม 2026 ยังไม่มีการประกาศวันวางจำหน่ายที่แน่นอน
Anthropic ตั้งข้อสังเกตว่าลายน้ำของมันแตกต่างจากเครื่องตรวจจับ AI ที่ใช้รูปแบบภาษา (เช่น Pangram) ที่มองหารูปแบบการใช้ถ้อยคำที่บ่งบอก — การตรวจสอบลายน้ำเป็นสิ่งที่แตกต่างโดยพื้นฐานจากการมองหาลักษณะทางโวหาร
การตอบสนองต่อการใส่ลายน้ำนั้นถูกแบ่งออกอย่างชัดเจน:
ใช่ Anthropic ระบุอย่างชัดเจน: "นักพัฒนาโมเดลรายใหญ่อื่นๆ ได้ลงนามใน Code of Practice เดียวกันและจะดำเนินการใส่ลายน้ำของตนเอง" วิศวกรของ Anthropic ในทีม Claude Code กล่าวต่อสาธารณะว่า "นี่เป็นส่วนหนึ่งของการทำงานกับ EU AI Act แล็บอื่นๆ กำลังเพิ่มลายน้ำที่คล้ายคลึงกัน เป็นการยากที่จะระบุข้อความที่สร้างโดย AI และนี่คือหนึ่งในวิธีแก้ปัญหาที่เสนอ"
มาตรา 50(2) ของ EU AI Act ว่าด้วย Code of Practice ความโปร่งใสของเนื้อหาที่สร้างโดย AI มีผลบังคับใช้เมื่อวันที่ 2 สิงหาคม 2026 และใช้กับผู้ให้บริการ AI เชิงสร้างสรรค์ทุกรายที่ให้บริการในตลาดสหภาพยุโรป บริษัท AI รายใหญ่หลายแห่งได้ลงนามในหลักปฏิบัติเดียวกัน แม้ว่าระยะเวลาการดำเนินการจะแตกต่างกันไปในแต่ละผู้ให้บริการ