ผู้ดูแลงานมีรายงานว่าใช้รูปแบบการเขียนและความเร็วในการทำงานเป็นเบาะแส แทนการพึ่งโปรแกรมตรวจจับ AI แต่เบาะแสเหล่านี้ไม่ใช่หลักฐานยืนยันในตัวเอง[9][33]
Why did OpenAI remove contractors from Project Lily for using AI tools to evaluate ChatGPT responses, how does the project recruit and pay hAI-generated editorial illustration; it does not depict a Project Lily reviewer or workplace.
AI พรอมต์
Create a landscape editorial hero image for this Studio Global article: Why did OpenAI remove contractors from Project Lily for using AI tools to evaluate ChatGPT responses, how does the project recruit and pay h. Article summary: OpenAI reportedly removed contractors because Project Lily pays for independent *human* judgments about ChatGPT replies; using AI to produce those judgments breaks the project’s rules and risks feeding model-generated ju. Topic tags: general, general web, user generated. Style: premium digital editorial illustration, source-backed research mood, clean composition, high detail, modern web publication hero. Use reference image context only for broad subject, composition, and topical grounding; do not copy the exact image. Avoid: logos, brand marks, copyrighted characters, real person likenesses, fake screenshots, UI text, readable text, watermarks, charts with fa
openai.com
ฟังดูย้อนแย้งที่บริษัท AI ปลดคนเพราะใช้ AI แต่ประเด็นของงานนี้อยู่ที่ ใครเป็นผู้ให้ความเห็น มีรายงานว่า OpenAI ปลดผู้รับเหมาหลายรายที่ใช้ AI ช่วยประเมินโมเดล ทั้งที่งานประเมินลักษณะนี้ต้องการวิจารณญาณจากมนุษย์อย่างเป็นอิสระ ไม่ใช่คำวิจารณ์ที่ AI สร้างขึ้นอีกทอดหนึ่ง ข่าวการปลดคนเชื่อมโยงกับงานประเมินของผู้รับเหมาหลายส่วน ส่วน Project Lily เป็นตัวอย่างโครงการที่ใช้คนตรวจคำตอบของ ChatGPT; ข้อมูลที่มีไม่ได้ยืนยันว่าผู้ที่ถูกปลดทุกคนทำงานในโครงการนี้1613
คนอ่านอาจเห็นได้ว่าคำตอบช่วยแก้โจทย์ของผู้ใช้จริงหรือไม่ หรือสุภาพจนกลายเป็นเออออตามผู้ใช้ไปเสียทุกเรื่อง หากผู้ประเมินให้ AI อีกตัวเขียนคำวิจารณ์หรือเลือกคะแนนแทน ความเห็นนั้นก็อาจสะท้อนแนวโน้มของ AI มากกว่าการตัดสินของมนุษย์ ทำให้คุณค่าของข้อมูลประเมินลดลงได้ นี่เป็นความเสี่ยงต่อคุณภาพของข้อมูล ไม่ใช่หลักฐานว่าคะแนนที่ใช้ AI ช่วยรายการใดรายการหนึ่งทำให้โมเดลแย่ลงแล้ว416
คำสั่งงานที่มีรายงานระบุว่าห้ามผู้ประเมินใช้ AI ตรวจงานหรือเขียนความเห็น รวมถึงเครื่องมืออย่าง Grammarly และฟีเจอร์แปลภาษาด้วย AI ส่วนผู้ที่ตรวจงานของผู้รับเหมาคนอื่นก็ถูกห้ามใช้โปรแกรมตรวจจับข้อความจาก AI เพราะคำสั่งงานมองว่าเครื่องมือเหล่านั้นไม่น่าเชื่อถือ139
แล้วผู้ดูแลงานรู้ได้อย่างไรว่าใครอาจใช้ AI
รายงานระบุว่าผู้ดูแลงานสังเกตรูปแบบที่น่าสงสัย เช่น ถ้อยคำซ้ำ ๆ ที่คล้ายข้อความจาก AI หรือการทำงานเสร็จเร็วผิดปกติ แทนการยึดคะแนนจากโปรแกรมตรวจจับเป็นข้อสรุป สัญญาณเหล่านี้อาจเป็นเหตุให้ตรวจงานต่อ แต่เพียงอย่างเดียวพิสูจน์ไม่ได้ว่าใครใช้ AI และข้อมูลที่มีไม่ได้บอกว่าผู้ดูแลงานตรวจพบถูกต้องหรือพลาดบ่อยเพียงใด933