เอกสารคดีฟ้องร้องเผยความกังวลภายในไมโครซอฟท์ต่อการสแครปข้อมูลฝึก AI
เอกสารที่ถูกเปิดผนึกบางส่วนใหม่ในคดีละเมิดลิขสิทธิ์ที่ The New York Times ฟ้อง OpenAI และ Microsoft เผยให้เห็นมุมมองภายในองค์กรเกี่ยวกับวิธีการเก็บข้อมูลฝึกโมเดล AI โดยเฉพาะความกังวลว่าระบบเหล่านี้…

เอกสารที่ถูกเปิดผนึกบางส่วนใหม่ในคดีละเมิดลิขสิทธิ์ที่ The New York Times ฟ้อง OpenAI และ Microsoft เผยให้เห็นมุมมองภายในองค์กรเกี่ยวกับวิธีการเก็บข้อมูลฝึกโมเดล AI โดยเฉพาะความกังวลว่าระบบเหล่านี้พึ่งพาการสแครปเนื้อหาข่าวจำนวนมากอย่างหนัก เอกสารระบุว่ามีชุดข้อมูลขนาดใหญ่ที่รวมสำเนาผลงานจาก The New York Times และสำนักพิมพ์อื่น ๆ อยู่ด้วย ซึ่งทำให้ประเด็นเรื่องที่มาของข้อมูลฝึกกลายเป็นข้อพิพาทสำคัญในคดีนี้
สาระจากเอกสารชี้ว่าไมโครซอฟท์เองมีการประเมินผลกระทบและความเสี่ยงจากแนวทางดังกล่าว ไม่ใช่เพียงแค่ปัญหาทางเทคนิคในการสร้างโมเดล แต่ยังแตะไปถึงข้อกังวลด้านจริยธรรมและสิทธิในทรัพย์สินทางปัญญา เนื้อหาในฟิลิงส์สะท้อนว่าภายในบริษัทมีความตระหนักว่าการนำผลงานของสื่อและผู้สร้างสรรค์ไปใช้เพื่อฝึก AI อาจสร้างความตึงเครียดกับเจ้าของลิขสิทธิ์และอุตสาหกรรมข่าว
ประเด็นนี้มีความสำคัญเพราะมันแสดงให้เห็นว่าข้อถกเถียงเรื่องข้อมูลฝึก AI ไม่ได้จำกัดอยู่แค่คำถามว่าเทคโนโลยีทำงานได้ดีแค่ไหน แต่ยังรวมถึงคำถามว่าแหล่งข้อมูลที่ใช้ได้มาถูกต้องหรือไม่ และผู้สร้างผลงานควรได้รับการคุ้มครองอย่างไร เมื่อเอกสารคดีถูกเปิดเผยเพิ่มเติม ก็ยิ่งเพิ่มแรงกดดันต่อบริษัทเทคโนโลยีรายใหญ่ที่พัฒนาโมเดล AI บนฐานข้อมูลขนาดมหาศาล
สำหรับวงการเทคโนโลยีและสื่อ ข่าวนี้ตอกย้ำว่าการจัดการข้อมูลฝึกกำลังกลายเป็นหัวใจของข้อพิพาทด้านกฎหมายและความเชื่อมั่นของสาธารณะ บริษัท AI อาจต้องเผชิญการตรวจสอบที่เข้มงวดขึ้นเกี่ยวกับที่มาของชุดข้อมูล การได้รับอนุญาต และความโปร่งใสในการใช้เนื้อหาจากภายนอก ขณะที่ฝั่งสำนักข่าวและผู้ถือลิขสิทธิ์มีแนวโน้มผลักดันให้เกิดมาตรฐานใหม่ในการใช้ข้อมูลเพื่อฝึก AI มากขึ้น


