ค้นพบความสนใจของคุณ ไปด้วยกัน

ดีลจริง รีวิวตรงไปตรงมา และเรื่องราวการช้อปปิ้งจากคนที่มีความสนใจเดียวกับคุณ — ทุกวันบน ZestBuy

ค้นพบความสนใจของคุณ ไปด้วยกันดีลจริง รีวิวตรงไปตรงมา และเรื่องราวการช้อปปิ้งจากคนที่มีความสนใจเดียวกับคุณ — ทุกวันบน ZestBuy

เมื่อข้อมูลฝึก AI ไม่ฟรีอีกต่อไป เกมใหม่ของเศรษฐศาสตร์ปัญญาประดิษฐ์

เมื่อข้อมูลฝึก AI ไม่ฟรีอีกต่อไป เกมใหม่ของเศรษฐศาสตร์ปัญญาประดิษฐ์
ความสนใจ|วิเคราะห์ข้อมูลด้วย AI

ข้อมูลฝึก AI คืออะไร และทำไมเรื่องนี้กลายเป็นเดิมพันใหญ่ของยักษ์เทค

ข้อมูลฝึก AI คือชุดข้อความ ภาพ เสียง หรือสัญญาณควบคุมที่ถูกรวบรวมและจัดระเบียบ เพื่อใช้สอนโมเดลปัญญาประดิษฐ์ให้เรียนรู้รูปแบบ พฤติกรรม และความสัมพันธ์ในโลกจริง ข้อมูลฝึก AI ที่ดีต้องมีความถูกต้อง ครอบคลุม และได้มาด้วยวิธีที่ไม่ละเมิดสิทธิ์ของเจ้าของเนื้อหา เมื่อ AI ถูกนำไปใช้ในงานระดับองค์กรและโครงสร้างพื้นฐานดิจิทัล การเลือกแหล่งข้อมูลฝึกจึงไม่ใช่เรื่องเทคนิคอย่างเดียว แต่กลายเป็นเรื่องเศรษฐศาสตร์ กฎหมาย และอำนาจต่อรองของผู้เล่นรายใหญ่ในตลาด

จุดเปลี่ยนล่าสุดคือการที่กูเกิลยอมจ่ายเงินให้ผู้ผลิตสื่อดิจิทัลประมาณ 100 แห่ง เพื่อแลกกับการนำเนื้อหาไปใช้ตอบคำถามด้วยปัญญาประดิษฐ์ในระบบค้นหาและผลิตภัณฑ์อื่นของบริษัท ความเคลื่อนไหวนี้เกิดขึ้นหลังการเปิดตัว AI Overviews ทำให้ปริมาณการเข้าชมเว็บไซต์จากระบบค้นหาลดลงอย่างมากและตามมาด้วยเสียงร้องเรียนและการฟ้องร้องจากผู้ผลิตสื่อหลายราย การยอมเปิดกระเป๋าครั้งนี้จึงไม่ใช่การทำบุญ แต่เป็นสัญญาณว่าระบบ “ดูดข้อมูลฟรี” กำลังแตะขีดจำกัดทั้งทางการเมืองและกฎหมาย

จากการขูดข้อมูลสู่การซื้อข้อมูลสำหรับ AI เมื่อเนื้อหากลายเป็นทรัพย์สินต่อรอง

โครงการนำร่องที่กูเกิลจ่ายค่าตอบแทนให้สำนักพิมพ์สำหรับเนื้อหาที่นำมาแสดงในเครื่องมือค้นหา ถือเป็นการเปลี่ยนแนวทางจากเดิมที่บริษัทเคยยืนยันว่าไม่ควรต้องจ่ายเงินให้สำนักพิมพ์ เพราะการตอบคำถามผ่านระบบค้นหาจะช่วยนำผู้ใช้งานเข้าสู่เว็บไซต์ของสื่ออยู่แล้ว การยอมจ่ายให้ผู้ผลิตเนื้อหาเหล่านี้คือการยอมรับโดยปริยายว่า การซื้อข้อมูลสำหรับ AI เป็นต้นทุนที่หลีกเลี่ยงไม่ได้หากต้องการหลีกเลี่ยงข้อพิพาททางกฎหมายและแรงกดดันทางสังคม

การเปลี่ยนจากการขูดข้อมูลฟรีไปสู่การทำข้อตกลงสิทธิ์ใช้เนื้อหา ยังสะท้อนว่าผู้ผลิตสื่อดิจิทัลเริ่มกลับมามีอำนาจต่อรอง เพราะเนื้อหากลายเป็นแหล่งข้อมูลสำเร็จรูปที่โมเดล AI ระดับใหญ่ต้องพึ่งพา การมีสัญญาอย่างเป็นทางการไม่เพียงช่วยลดความเสี่ยงเรื่องลิขสิทธิ์ แต่ยังเปิดทางสู่โมเดลธุรกิจใหม่ เช่น การขายสิทธิ์แบบพิเศษ การจัดชุดข้อมูลเฉพาะอุตสาหกรรม และการติดตามการใช้ข้อมูลอย่างโปร่งใส ผู้เล่นที่ถือคลังข้อมูลคุณภาพสูงและพิสูจน์ที่มาได้จึงอาจกลายเป็นคู่ค้าหลักของยักษ์เทคในระยะยาว

โลกเกมกลายเป็นแหล่งข้อมูลสำเร็จรูปใหม่ เมื่อสตาร์ทอัพหันใช้เกมฝึก AI

อีกด้านหนึ่งของเกมข้อมูลฝึก AI คือการมองหาแหล่งข้อมูลสำเร็จรูปที่มีอยู่แล้วในโลกดิจิทัล Worldmodeldata บริษัทสตาร์ทอัพจากอังกฤษกำลังรวบรวมข้อมูลการควบคุมเกมของผู้เล่น ทั้งการโยกจอย การกดปุ่ม และภาพฉากสามมิติที่เปลี่ยนไปตามการกระทำของผู้เล่น มาจัดเป็นชุดข้อมูลสำหรับฝึก World Model หรือ AI ที่ถูกออกแบบให้เข้าใจและทำงานในโลกกายภาพได้ บริษัทระบุว่าได้รับสิทธิ์ใช้ข้อมูลแล้วเกือบหนึ่งล้านชั่วโมง ซึ่งถือเป็นปริมาณมหาศาลเมื่อเทียบกับการจำลองสถานการณ์เองในห้องแล็บ

Worldmodeldata เห็นว่าข้อมูลการควบคุมซึ่งสตูดิโอเกมเก็บไว้อยู่แล้วเป็นผลพลอยได้ที่มีอยู่ในปริมาณมาก และสามารถนำมาใช้แก้ปัญหาการขาดแคลนข้อมูลฝึก World Model ได้ ปัจจุบันมีบางบริษัทที่เก็บข้อมูลเกมจากแพลตฟอร์มของตัวเองไปสร้างโมเดล เช่น General Intuition และ Niantic แต่ Worldmodeldata เลือกวางตัวเป็นตัวกลางที่คัดสรรและจัดระเบียบข้อมูลให้ ห้องแล็บ AI จึงไม่ต้องทำข้อตกลงกับสตูดิโอเกมทีละราย บริษัทนี้ยังตั้งเป้าจะเปิดช่องทางให้ผู้เล่นได้รับค่าตอบแทนในอนาคต ทำให้ข้อมูลจากเกมกลายเป็นสินทรัพย์ที่แบ่งรายได้กลับสู่ผู้เล่นได้ด้วย

เกมหรือโลกจริง ใครให้ข้อมูลฝึก AI ที่ “ดีพอ”

แม้แนวคิดใช้เกมเป็นแหล่งข้อมูลฝึก AI จะดูน่าตื่นเต้น แต่ไม่ได้รับการยอมรับแบบเอกฉันท์ นักวิจัยบางส่วนรวมถึงผู้นำทีมพัฒนา World Model ของ Nvidia ตั้งคำถามว่าฟิสิกส์ในเกมจะละเอียดพอสำหรับงานในโลกจริงหรือไม่ ตัวอย่างเช่น การควบคุมการเคลื่อนไหวที่ต้องความละเอียดสูงอย่างการหยิบจับวัตถุในชีวิตจริง เกมจำนวนมากใช้ทางลัดเพื่อให้ภาพดูสมจริงโดยไม่จำเป็นต้องจำลองแรงและการเคลื่อนที่อย่างละเอียด

รองศาสตราจารย์ด้าน AI จากมหาวิทยาลัยเซอร์รีย์ยังมองว่าฟิสิกส์ในเกมเป็นเพียงการประมาณ ครั้นจะใช้เป็นฐานเดียวสำหรับฝึกโมเดลที่ต้องทำงานในโลกจริงก็อาจเสี่ยงสูง อย่างไรก็ตาม แนวคิดนี้เกิดจากความเชื่อที่เติบโตขึ้นว่าการพึ่งพาแต่ตัวอักษรในโมเดลภาษาขนาดใหญ่จะเจอข้อจำกัดในท้ายที่สุด และอาจไม่เหมาะกับงานที่ต้องการความแม่นยำและความละเอียดอ่อน เช่น การขับรถยนต์ไร้คนขับ คำถามเชิงยุทธศาสตร์จึงไม่ใช่แค่ “เกมใช้ได้ไหม” แต่คือ “จะผสมข้อมูลจากเกมและโลกจริงอย่างไรให้โมเดลเก่งทั้งสองโลก”

บทสรุป งานศิลป์ของการเลือกข้อมูลฝึก AI อยู่ที่คุณภาพและความชอบธรรม

เมื่อยักษ์เทคอย่างกูเกิลเริ่มจ่ายเงินให้ผู้ผลิตสื่อดิจิทัลเพื่อใช้เนื้อหาตอบคำถาม AI และสตาร์ทอัพอย่าง Worldmodeldata หันไปเก็บข้อมูลจากวิดีโอเกมเกือบหนึ่งล้านชั่วโมงสำหรับฝึก World Model ภาพรวมที่ชัดเจนคือข้อมูลฝึก AI กำลังกลายเป็นสินทรัพย์ที่มีมูลค่าทั้งเชิงเศรษฐกิจและเชิงอำนาจ ผู้เล่นที่ถือคลังข้อมูลคุณภาพสูง มีการจัดระเบียบ และได้สิทธิ์ใช้อย่างถูกต้องตามกฎหมาย จะมีแต้มต่อไม่แพ้บริษัทที่มีพลังประมวลผลหรือทีมวิจัยเก่งๆ

ท้ายที่สุด เศรษฐศาสตร์ของ AI จะถูกกำหนดด้วยคำถามง่ายแต่ตอบยากสองข้อ คือ ข้อมูลชุดไหนให้ผลลัพธ์ดีที่สุดต่อหน่วยต้นทุน และข้อมูลชุดไหนทำให้บริษัทเดินหน้าได้โดยไม่ถูกฟ้องหรือถูกสังคมหันหลัง การซื้อข้อมูลสำหรับ AI จากสื่อดิจิทัล การใช้ข้อมูลเกมเป็นแหล่งข้อมูลสำเร็จรูป และการลงทุนสร้างข้อมูลจำลองในโลกเสมือน ล้วนเป็นกลยุทธ์ที่ต่างกัน แต่จุดร่วมคือยอมรับว่าข้อมูลที่ดีและถูกกฎหมายไม่ใช่ของฟรีอีกต่อไป ใครเข้าใจเรื่องนี้เร็วกว่าและสร้างระบบจัดการข้อมูลได้ดีกว่า ก็มีโอกาสคุมเกม AI ในระยะยาว

ZestBuy ได้รับค่าคอมมิชชั่นเมื่อคุณช้อปผ่านลิงก์ของเรา โดยคุณไม่ต้องจ่ายเพิ่ม

You May Also Like

Comments
พูดอะไรบางอย่าง...
ยังไม่มีความคิดเห็น มาเป็นคนแรกที่แบ่งปันความคิดเห็นของคุณ!