ISBNdb ลบข้ออ้างว่าจัดหาและทำลายหนังสือเพื่อฝึกโมเดล AI จากเว็บไซต์

ที่มาภาพ: PC Gamer

AI-อ่าน 6 นาทีPC Gamer

ISBNdb ลบข้ออ้างว่าจัดหาและทำลายหนังสือเพื่อฝึกโมเดล AI จากเว็บไซต์

⚡ สรุป 30 วิ

ISBNdb ลบส่วนของเว็บที่อ้างว่าจะจัดหาและทำลายหนังสือจำนวนมากเพื่อฝึกโมเดล AI หลังถูก 404 Media เปิดเผยว่าบริการนี้เป็นเพียงการทดสอบตลาดและไม่เคยดำเนินการจริง.

บริษัทฐานข้อมูลหนังสือออนไลน์ ISBNdb เพิ่งลบส่วนหนึ่งของเว็บไซต์ที่เคยอ้างว่าสามารถจัดหาและทำลายหนังสือพิมพ์จำนวนมากเพื่อใช้เป็นข้อมูลฝึกฝนโมเดลภาษา (LLM) หลังจากที่สื่อ 404 Media เปิดเผยรายละเอียดเกี่ยวกับบริการดังกล่าว บริษัทได้ให้คำชี้แจงว่า “หน้าดังกล่าวเป็นการทดสอบความสนใจของตลาด; ไม่เคยมีการนำบริการไปปฏิบัติจริง” การเปลี่ยนแปลงนี้ทำให้เกิดข้อถกเถียงใหม่เกี่ยวกับวิธีที่บริษัท AI ใช้ข้อมูลจากหนังสือและผลกระทบต่ออุตสาหกรรมหนังสือมือสอง

Overview

ตามรายงานของ 404 Media หน้าเว็บที่กล่าวถึงการเป็น “พันธมิตรเชิงราบรื่นสำหรับการจัดหา หนังสือพิมพ์จำนวนมาก เพื่อตอบสนองความต้องการฝึก LLM” ได้ถูกลบออกจากเว็บไซต์ของ ISBNdb อย่างไรก็ตามสำเนาของหน้านั้นยังคงปรากฏบน Internet Archive และในบล็อกโพสต์ที่มีชื่อ “Reframing the Destruction Narrative” บริษัทได้อธิบายแนวคิดว่าการทำลายหนังสือนั้นไม่ได้เป็นการสูญเสียคุณค่า แต่เป็นการ “ย้ายค่าของหนังสือไปยังวงจรอื่น”. รายละเอียดนี้สะท้อนให้เห็นถึงความพยายามของบริษัทในการสร้างภาพลักษณ์ที่บวกต่อกระบวนการเก็บข้อมูลสำหรับ AI.

ในช่วงหลายเดือนที่ผ่านมา มีข่าวว่าบริษัทเทคโนโลยีบางแห่งใช้วิธีสั่งซื้อหนังสือจำนวนมากจากผู้ขายมือสอง เพื่อนำไปสแกนและฝึกโมเดล AI โดยไม่มีการเปิดเผยต่อสาธารณะอย่างชัดเจน ซึ่งทำให้เกิดความกังวลเกี่ยวกับสิทธิ์ของผู้เขียนและการรักษามรดกทางวัฒนธรรม. การลบข้อมูลดังกล่าวจากเว็บไซต์อาจเป็นการตอบสนองต่อแรงกดดันด้านสาธารณชนและข้อวิพากษ์วิจารณ์ที่เพิ่มขึ้น.

The Controversial Service Claim

ในบล็อกโพสต์ “Reframing the Destruction Narrative” ของ ISBNdb มีการให้เหตุผลหลายประการเกี่ยวกับคุณค่าที่ “ย้ายไป” หลังจากหนังสือถูกทำลาย:

  • หนังสือไม่ได้ถูกทำลายในความหมายของการสูญเสียข้อมูล; “The book is not destroyed.”
  • ค่าของหนังสือ “migrated” ไปยังรูปแบบอื่นที่อาจเป็นประโยชน์ต่อวงจรสารสนเทศ.
  • กระดาษกลับเข้าสู่ material cycle อีกครั้ง ส่วนความรู้จะถูกรวมเข้ากับ intellectual cycle.

การใช้คำพูดเหล่านี้ทำให้ผู้วิพากษ์มองว่า บริษัทกำลังพยายามเปลี่ยนแปลงภาพลักษณ์ของการ “ทำลาย” ให้ดูเหมือนเป็นกระบวนการรีไซเคิลและเพิ่มคุณค่า, แม้ว่าการสแกนข้อมูลหนังสือเพื่อฝึก AI ยังเป็นประเด็นที่ยังไม่ได้รับความเห็นชอบจากหลายฝ่าย.

Response and Denial

เมื่อถูกถามโดย 404 Media เกี่ยวกับหน้าเว็บที่ลบออก, ตัวแทนของ ISBNdb ตอบว่า “หน้านั้นเป็นการทดสอบตลาด; ไม่เคยมีการดำเนินการบริการจริง”. คำชี้แจงนี้สอดคล้องกับแนวโน้มที่หลายบริษัทเทคโนโลยีเลือกที่จะปฏิเสธหรือจำกัดข้อมูลเกี่ยวกับกระบวนการจัดหาข้อมูลฝึก AI.

อย่างไรก็ตาม การลบหน้าเว็บไม่ได้ทำให้ข้อมูลเก่า ๆ หายไปจากอินเทอร์เน็ต เนื่องจากสำเนาอยู่ใน Internet Archive ทำให้นักวิจัยและสาธารณะยังสามารถตรวจสอบหลักฐานของข้อเสนอเดิมได้. สิ่งนี้เพิ่มความซับซ้อนต่อการประเมินว่าบริษัทเคยมีแผนปฏิบัติจริงหรือเป็นเพียงการทดลองตลาดที่หยุดนิ่ง.

Market Impact on Secondhand Book Sellers

ตามรายงานของ Guardian Australia, ร้านหนังสือมือสองหลายแห่งได้เฝ้าสังเกตเห็น “คลื่นของออร์เดอร์” ที่ไม่ตรงกับพฤติกรรมลูกค้าปกติ. คำอธิบายบ่งชี้ว่าผู้ซื้อเหล่านี้เป็นตัวแทนจากบริษัทหรือบุคคลที่ทำหน้าที่รวบรวมหนังสือเพื่อใช้เป็นข้อมูล AI.

การเพิ่มขึ้นของคำสั่งซื้อแบบนี้ส่งผลต่อสต็อกและกำไรของร้านขายหนังสือมือสอง, ทำให้พวกเขาต้องปรับกลยุทธ์การจัดหาสินค้าและตรวจสอบแหล่งที่มาของลูกค้าด้วยความระมัดระวังมากขึ้น. นอกจากนี้ ยังอาจกระตุ้นให้มีการต่อสู้ทางกฎหมายหรือข้อกำหนดใหม่เกี่ยวกับการใช้หนังสือเป็นข้อมูลฝึก AI ในอนาคต.

Analysis

เหตุการณ์นี้สะท้อนถึงความขัดแย้งระหว่างเทคโนโลยี AI ที่ต้องการข้อมูลจำนวนมหาศาลและความคุ้มครองทรัพย์สินทางปัญญา. การที่ ISBNdb ลบหน้าเว็บและอ้างว่าเป็น “การทดสอบตลาด” แสดงให้เห็นถึงแรงกดดันจากสาธารณะและองค์กรตรวจสอบ ที่เรียกร้องความโปร่งใสในกระบวนการจัดหาข้อมูล.

นอกจากนี้, คำอธิบายเชิงปรัชญาที่พยายาม “ย้ายค่า” ของหนังสือเข้าสู่วงจรอื่นยังไม่สามารถตอบโจทย์ข้อกังวลด้านสิทธิผู้สร้างและความเป็นธรรมของตลาดได้อย่างเต็มที่. หากบริษัท AI ต้องการใช้หนังสือเป็นข้อมูลฝึก, การกำหนดมาตรฐานเปิดเผยแหล่งที่มาของหนังสือและการชำระค่าลิขสิทธิ์อาจกลายเป็นแนวทางสำคัญเพื่อป้องกันข้อขัดแย้งในอนาคต.

Summary

ISBNdb ได้ลบข้อมูลเกี่ยวกับบริการจัดหาและทำลายหนังสือเพื่อฝึกโมเดล AI, และยืนยันว่าไม่มีการดำเนินการจริง. เหตุการณ์นี้กระตุ้นให้เกิดการวิพากษ์วิจารณ์ต่อการใช้หนังสือเป็นแหล่งข้อมูล AI และส่งผลต่อผู้ขายหนังสือมือสองที่พบกับออร์เดอร์จากผู้ซื้อแบบใหม่.

แชร์บทความนี้:

ชอบบทความแบบนี้?

สมัคร AI Automate Weekly Newsletter — รับเคล็ดลับ AI + how-to ใหม่
ทุกสัปดาห์ตรงถึง inbox ฟรี ไม่มีสแปม

แหล่งข่าวต้นฉบับ

ชื่อต้นฉบับ
Company that said it could scan and destroy books for AI data-harvesting has deleted that part of its website: 'no such service was ever brought to life'
ผู้เขียน
Jody Macgregor
แหล่ง
PC Gamer
วันที่เผยแพร่
3 สิงหาคม 2569 เวลา 07:21

Related

บทความที่เกี่ยวข้อง

AI ทำลายหนังสือโบราณหายากเพื่อฝึกโมเดล—อาชญากรรมต่อมรดกวัฒนธรรมAI
-

AI ทำลายหนังสือโบราณหายากเพื่อฝึกโมเดล—อาชญากรรมต่อมรดกวัฒนธรรม

ISBNdb ส่งหนังสือโบราณก่อนปี 2022 จำนวนหลายแสนเล่มให้บริษัท AI ผ่านการสแกนทำลายต้นฉบับ กระบวนการนี้ถูกพิจารณาว่าอาจเป็นอาชญากรรมต่อมรดกวัฒนธรรม

TechRadar6 นาที
ย้ายครึ่งงานไปใช้โมเดล AI Haiku และ Sonnet ไม่รู้สึกแตกต่างมากนักAI
3 สิงหาคม 2569 เวลา 05:30

ย้ายครึ่งงานไปใช้โมเดล AI Haiku และ Sonnet ไม่รู้สึกแตกต่างมากนัก

ผู้เขียนทดลองย้ายงานบางส่วนไปใช้โมเดล AI ใหม่สองรุ่นคคือ Haiku และ Sonnet ผลลัพธ์พบว่าในหลายงานไม่มีความแตกต่างชัดเจน ส่วนงานที่ต้องการแม่นยำสูง Sonnet…

XDA Developers7 นาที
AI เริ่มจากการสร้างฟีเจอร์สู่การลบโค้ด ลดภาระงานซ้ำซ้อนAI
3 สิงหาคม 2569 เวลา 02:30

AI เริ่มจากการสร้างฟีเจอร์สู่การลบโค้ด ลดภาระงานซ้ำซ้อน

AI ไม่เพียงสร้างฟีเจอร์ใหม่ แต่เริ่มช่วยลบโค้ดที่ไม่ใช้ได้ ลดภาระงานซ้ำซ้อนและ Technical Debt. การตรวจสอบผลของ AI…

XDA Developers5 นาที
บิ๊กเทคใช้เงินกว่า 1 แสนล้านดอลลาร์ในโครงสร้างพื้นฐาน AI ภายในปี 2023AI
2 สิงหาคม 2569 เวลา 23:30

บิ๊กเทคใช้เงินกว่า 1 แสนล้านดอลลาร์ในโครงสร้างพื้นฐาน AI ภายในปี 2023

บริดัชน์เทคโนโลยีระดับโลก Amazon, Google, Meta และ Microsoft รวมกันใช้จ่ายกว่า 1.1 แสนล้านดอลลาร์ในการสร้างศูนย์ข้อมูล AI จนถึงปี 2023…

Tom's Hardware7 นาที
คัดลอกลิงก์แล้ว!