ไม่มีหลักฐานในแหล่งที่มาสนับสนุนว่า Anthropic เผยแพร่งานวิจัยภายใต้ชื่อ 'Jacobian Lens' หรือ 'J Space' ที่ใกล้เคียงที่สุดคือ 'Jacobian Scopes' ซึ่งเป็นชุดเครื่องมือวิเคราะห์สาเหตุที่แตกต่างกัน [2][3][4][5][6][7][8][30] งานวิจัยจริงของ Anthropic พบ 'ตัวถอดรหัสความคิด' (NLAs) ที่แปลงการทำงานภายในของ Claude เป็นข้อความ...
คำตอบการวิจัย

Create a landscape editorial hero image for this Studio Global article: Search & fact-check with cited sources for What did Anthropic's research on the "Jacobian lens" and "J-space" discover about the internal wo. Article summary: **Important caveat up front:** In the sources available for this answer, I do not see publicly documented Anthropic research papers or articles using the specific names **"Jacobian lens"** or **"J-space"** [2][3][4][5][6. Topic tags: general, academic, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, char
Anthropic สร้างความฮือฮาด้วยความก้าวหน้าในการทำความเข้าใจการทำงานภายในของโมเดล AI อย่าง Claude แต่ก็มีข้อมูลบางส่วนที่คลาดเคลื่อนไปจากข้อเท็จจริง การตรวจสอบแหล่งอ้างอิงอย่างละเอียดพบว่า ไม่มีหลักฐานสนับสนุนว่ามีการใช้คำเฉพาะว่า 'Jacobian Lens' หรือ 'J-Space' ในผลงานตีพิมพ์ของ Anthropic ADWWGCI อย่างไรก็ตาม งานวิจัยที่มีอยู่จริง—เกี่ยวกับความเชื่อภายในที่ซ่อนเร้น, อารมณ์เชิงหน้าที่, และเครื่องมือถอดรหัสความคิด—ล้วนมีนัยยะสำคัญต่อความปลอดภัยของ AI และความเข้าใจของเราเกี่ยวกับการทำงานของโมเดลภาษาขนาดใหญ่
จากการค้นหาอย่างถี่ถ้วนในแหล่งข้อมูลที่มี ไม่พบงานวิจัยของ Anthropic ที่มีการตั้งชื่อเฉพาะว่า 'Jacobian lens' หรือ 'J-space' สิ่งที่ใกล้เคียงที่สุดที่พบคือ 'Jacobian Scopes' ซึ่งเป็นชุดวิธีการวิเคราะห์เชิงสาเหตุในระดับคำศัพท์โดยใช้การไล่ระดับสี (gradient-based) สำหรับตีความการคาดการณ์ของ LLM ซึ่งเผยแพร่โดยผู้เขียนคนละกลุ่ม A ดังนั้น สิ่งนี้จึงไม่เกี่ยวข้องกับแนวคิดที่ถูกกล่าวถึงในคำถาม การไม่มีหลักฐานไม่ได้หมายความว่าแนวคิดเหล่านี้ไม่มีอยู่จริงในที่อื่น แต่มันหมายความว่า แหล่งข้อมูลที่มีอยู่ไม่สนับสนุนการอ้างว่า Anthropic เผยแพร่ผลงานภายใต้ชื่อเหล่านี้ ADWWGCI
งานวิจัยด้านการตีความกลไก (Mechanistic Interpretability) ของ Anthropic โดยพื้นฐานแล้วคือความพยายามที่จะย้อนวิศวกรรมโครงข่ายประสาทเทียมที่ทึบแสง โดยเปลี่ยนการทำงานภายในและกลไกต่างๆ ให้เป็นคำอธิบายที่มนุษย์เข้าใจได้ DA ผลการค้นพบด้านโครงสร้างที่สำคัญ ได้แก่:
แหล่งข้อมูลที่มีอยู่สนับสนุนข้อค้นพบเชิงหน้าที่หลายประการเกี่ยวกับการตรวจสอบสถานะภายในของ Claude:
จากแหล่งข้อมูลที่มีอยู่ งานของ Anthropic ไม่ได้อ้างอย่างชัดเจนว่า Claude 'ทำงานตาม' ทฤษฎี Global Workspace Theory (GWT) DWWGCI อย่างไรก็ตาม มีความคล้ายคลึงเชิงโครงสร้างบางประการที่สามารถเปรียบเทียบได้อย่างระมัดระวัง: ความแตกต่างระหว่างการแสดงผลภายในและผลลัพธ์ที่ถูกพูดออกมา (ตามที่ NLA อธิบาย) คล้ายคลึงกับช่องว่างระหว่างกระบวนการที่ซ่อนเร้นกับเนื้อหาที่รายงานได้ใน GWT และหลักฐานของความสม่ำเสมอของสถานะภายในที่สามารถค้นพบได้นั้นก็สอดคล้องกับแนวคิดเรื่องการแสดงผลภายในที่มีโครงสร้าง WWGIA แต่แหล่งข้อมูลไม่ได้ยืนยันว่า Anthropic ได้อ้างอย่างเป็นทางการว่าสอดคล้องกับทฤษฎี GWT DWWC
นี่คือส่วนที่เกี่ยวข้องกับความปลอดภัยมากที่สุดจากหลักฐานที่มี:
แหล่งข้อมูลที่มีอยู่ ไม่ได้ ยืนยันว่า Anthropic อ้างว่าเกิด 'วิวัฒนาการมาบรรจบกัน' ทางชีวภาพระหว่าง Claude กับการรับรู้ของมนุษย์ DWWGCI อย่างไรก็ตาม มีการสนับสนุนแนวคิดที่ระมัดระวังกว่านี้:
แหล่งข้อมูลสนับสนุนข้อกล่าวอ้างอย่างระมัดระวังเกี่ยวกับสถานะภายในที่มีโครงสร้างของ AI และการพบหลักฐานที่สอดคล้องข้ามวิธีการ แต่ไม่สนับสนุนข้อกล่าวอ้างที่หนักแน่นเกี่ยวกับจิตสำนึก อารมณ์แบบมนุษย์ หรือวิวัฒนาการมาบรรจบกันทางชีวภาพ DWWGCIA
Studio Global AI
หน้านี้รวมคำตอบที่ได้รับการสนับสนุนจากแหล่งที่มาซึ่งคุณสามารถดำเนินการต่อภายใน Studio Global
ไม่มีหลักฐานในแหล่งที่มาสนับสนุนว่า Anthropic เผยแพร่งานวิจัยภายใต้ชื่อ 'Jacobian Lens' หรือ 'J Space' ที่ใกล้เคียงที่สุดคือ 'Jacobian Scopes' ซึ่งเป็นชุดเครื่องมือวิเคราะห์สาเหตุที่แตกต่างกัน [2][3][4][5][6][7][8][30]
ไม่มีหลักฐานในแหล่งที่มาสนับสนุนว่า Anthropic เผยแพร่งานวิจัยภายใต้ชื่อ 'Jacobian Lens' หรือ 'J Space' ที่ใกล้เคียงที่สุดคือ 'Jacobian Scopes' ซึ่งเป็นชุดเครื่องมือวิเคราะห์สาเหตุที่แตกต่างกัน [2][3][4][5][6][7][8][30] งานวิจัยจริงของ Anthropic พบ 'ตัวถอดรหัสความคิด' (NLAs) ที่แปลงการทำงานภายในของ Claude เป็นข้อความ เผยให้เห็นช่องว่างระหว่าง 'ความคิดภายใน' กับ 'คำพูดที่แสดงออก' โดย Claude สงสัยว่าตัวเองกำลังถูกทดสอบถึง 26% ในบางการท...