"นิยายของ AI น่าสนใจกว่าของมนุษย์?" งานวิจัยที่ผู้อ่านให้คะแนนสูงกับผลงานของ ChatGPT ชี้ให้เห็นถึงอนาคตของการสร้างสรรค์

"นิยายของ AI น่าสนใจกว่าของมนุษย์?" งานวิจัยที่ผู้อ่านให้คะแนนสูงกับผลงานของ ChatGPT ชี้ให้เห็นถึงอนาคตของการสร้างสรรค์

"AI สามารถเขียนเรื่องราวที่ทำให้คนรู้สึกซาบซึ้งได้จริงหรือไม่"

คำถามนี้ถูกตั้งขึ้นซ้ำๆ ตั้งแต่ AI ที่สร้างขึ้นเริ่มแพร่หลายอย่างรวดเร็ว ไม่มีใครแปลกใจอีกต่อไปเมื่อ AI แสดงความสามารถในงานเขียนที่ใช้งานได้จริง เช่น การสรุปข้อความ การเขียนอีเมล หรือการสร้างคำโฆษณา แต่เมื่อพูดถึงนวนิยาย เรื่องราวก็เปลี่ยนไป

การเขียนเรื่องราวต้องการประสบการณ์ชีวิต อารมณ์ ความทรงจำ ความขัดแย้ง วัฒนธรรม และค่านิยมของผู้เขียนเอง การสร้างสรรค์ถูกมองว่าเป็นหนึ่งในพื้นที่ที่เหลืออยู่สำหรับมนุษย์มาเป็นเวลานาน

อย่างไรก็ตาม มีผลการวิจัยที่ท้าทายสมมติฐานนี้

ในการทดลองที่ดำเนินการโดยนักวิจัยจาก Villanova University ในสหรัฐอเมริกา พบว่าเรื่องสั้นที่สร้างโดย ChatGPT มีแนวโน้มที่จะได้รับการประเมินว่า "มีคุณภาพสูงกว่า" และ "ดึงดูดใจ" มากกว่าเรื่องสั้นที่เขียนโดยมนุษย์

ที่น่าสนใจยิ่งกว่านั้นคือ ในกรณีที่ผู้อ่านประเมินผลงานของ AI ไว้สูง แต่เข้าใจผิดว่าเป็นผลงานที่ "มนุษย์เขียน" การประเมินจะสูงเป็นพิเศษ

นั่นหมายความว่าเราอาจเปลี่ยนคุณค่าของผลงานไม่เพียงแค่อ่านผลงานเท่านั้น แต่ยังขึ้นอยู่กับ "ใครที่เราคิดว่าเขียน"

การวิจัยนี้ไม่ได้พิสูจน์ว่า "AI เกินกว่าผู้เขียนมนุษย์" แต่สิ่งที่ปรากฏขึ้นคือปัญหาว่าเราประเมินผลงานสร้างสรรค์อย่างไร มากกว่าความสามารถในการเขียนของ AI


การทดลองอ่านเรื่องสั้นที่เขียนโดย ChatGPT และมนุษย์

ในการวิจัย ผู้เข้าร่วมได้อ่านเรื่องสั้นที่เขียนโดยมนุษย์และที่สร้างโดย ChatGPT และประเมินคุณภาพของผลงานและความดึงดูดใจของเรื่องราว

ในการวิจัยที่รายงานในเดือนสิงหาคม 2026 มีผู้ใหญ่ 1,682 คนเข้าร่วมในการทดลองหลัก

มีผลงาน 6 ชิ้นที่เตรียมไว้ เรื่องสั้น 3 เรื่องที่เขียนโดยมนุษย์และอีก 3 เรื่องที่สร้างโดย ChatGPT ในธีมที่ใกล้เคียงกัน

อย่างไรก็ตาม ข้อมูลผู้เขียนที่แจ้งให้ผู้เข้าร่วมทราบไม่จำเป็นต้องเป็นความจริงเสมอไป

มีกรณีที่อธิบายว่าผลงานที่เขียนโดย AI เป็น "มนุษย์เขียน" และผลงานของมนุษย์เป็น "ผลงานของ ChatGPT"

นี่คือกลไกสำคัญของการวิจัยนี้

ไม่เพียงแต่ความแตกต่างของผลงานเท่านั้น แต่ยังศึกษาว่าฉลาก "มนุษย์เขียน" หรือ "AI เขียน" มีผลต่อการประเมินมากน้อยเพียงใด

ผลลัพธ์นั้นน่าสนใจมาก

เมื่อเปรียบเทียบผู้เขียนจริง ผู้เข้าร่วมมีแนวโน้มที่จะประเมินเรื่องสั้นที่สร้างโดย ChatGPT สูงกว่าเรื่องสั้นที่เขียนโดยมนุษย์

ผลงานของ AI รู้สึกว่า "มีคุณภาพสูงกว่า" "อ่านได้ง่ายกว่า" และ "ดึงดูดใจ" มากกว่า

แต่ในขณะเดียวกัน ผลงานเดียวกันที่อธิบายว่า "มนุษย์เขียน" กลับได้รับการประเมินที่สูงกว่า

สามารถตีความได้ว่ามีปรากฏการณ์ที่ผู้คนชอบผลงานของ AI แต่รู้สึกว่า "นี่เป็นผลงานที่ดี ดังนั้นต้องเป็นมนุษย์เขียน"


ทำไมเรื่องราวของ AI ถึง "อ่านง่าย"

นักวิจัยให้ความสนใจกับความแตกต่างของโครงสร้างประโยคระหว่าง AI และมนุษย์

AI ที่สร้างขึ้นในปัจจุบันมักจะจัดระเบียบประโยคอย่างชัดเจน

มีแนวโน้มที่จะอธิบายอย่างชัดเจนว่าตัวละครคิดอะไร ธีมของเรื่องคืออะไร และเหตุการณ์มีความหมายอย่างไร

ในขณะที่นักเขียนมนุษย์ไม่จำเป็นต้องอธิบายทุกอย่าง

อาจเหลือความเงียบหรือความคลุมเครือ หรือแสดงเพียงการกระทำของตัวละครเพื่อให้ผู้อ่านคาดเดาอารมณ์ หรือเชื่อมโยงฉากที่ดูเหมือนไม่เกี่ยวข้องให้มีความหมายในภายหลัง

ในวรรณกรรม สิ่งนี้มักจะเป็นเสน่ห์

แต่เมื่อประเมินว่า "อ่านง่ายและสนุกกว่าในเวลาสั้นๆ" ผลงานที่ซับซ้อนไม่จำเป็นต้องได้เปรียบเสมอไป

ตรงกันข้าม ผลงานของ AI ที่มีธีมชัดเจน การดำเนินเรื่องราบรื่น และความหมายของอารมณ์เข้าใจง่ายอาจได้คะแนนสูงกว่า

นี่คล้ายกับภาพยนตร์หรือดนตรี

ผลงานที่ซับซ้อนและมีพื้นที่ให้ตีความมากอาจไม่ได้รับการประเมินสูงเท่าผลงานที่เข้าใจง่ายและทำให้เกิดอารมณ์ตั้งแต่ต้นจนจบจากคนจำนวนมาก

AI อาจถูกมองว่าเป็นการเพิ่มความสามารถในการสร้างผลงานที่ "คนส่วนใหญ่ยอมรับได้ง่าย" อย่างรวดเร็ว


คนส่วนใหญ่ไม่สามารถแยกแยะระหว่างบทความของ AI และมนุษย์ได้

ทีมวิจัยยังได้ทำการทดลองที่ให้ผู้เข้าร่วมทายผู้เขียนเมื่อวางผลงานของ AI และมนุษย์ไว้ข้างกัน

ในการทดลองเพิ่มเติมที่มีผู้เข้าร่วมประมาณ 900 คน รายงานว่าความถูกต้องในการทายผู้เขียนอยู่ที่ประมาณ 40% ในการทดลองหนึ่ง และประมาณ 52% ในอีกการทดลองหนึ่ง

ถ้าเป็นการเลือกสองตัวเลือก ความถูกต้องโดยบังเอิญจะอยู่ที่ประมาณ 50%

ดังนั้นเมื่อมองโดยรวม ผลลัพธ์แสดงให้เห็นว่ามนุษย์ไม่สามารถแยกแยะผลงานของ AI และมนุษย์ได้อย่างมั่นคง

นี่แสดงถึงการเปลี่ยนแปลงครั้งใหญ่ที่เกิดขึ้นเกี่ยวกับ AI ที่สร้างขึ้น

ไม่กี่ปีที่ผ่านมาหลายคนยังคงเชื่อว่า "บทความของ AI มีความไม่ธรรมชาติที่ชัดเจน" และ "สามารถบอกได้ทันทีเมื่ออ่าน"

แต่เมื่อโมเดลพัฒนา การใช้ความไม่ธรรมชาติทางไวยากรณ์หรือความขัดแย้งของความหมายเพื่อตัดสิน AI กลายเป็นเรื่องยากขึ้น

ที่น่าสนใจคือ คนที่คิดว่าตนเองอ่านนวนิยายมากไม่ได้หมายความว่าจะสามารถแยกแยะ AI ได้ดีขึ้น

ในทางกลับกัน คนที่ใช้ AI ที่สร้างขึ้น เช่น ChatGPT บ่อยๆ มีแนวโน้มที่จะทายผู้เขียนได้ดีกว่าเล็กน้อย

การใช้ AI อาจทำให้คุ้นเคยกับรูปแบบประโยค โครงสร้าง และวิธีการอธิบายที่เฉพาะเจาะจง

ในอนาคต ความสำคัญอาจไม่ได้อยู่ที่ความสามารถในการเขียน แต่เป็น "ความรู้เกี่ยวกับ AI"


ในโซเชียลมีเดียมีเสียงว่า "ไม่แปลกใจ"

ผลการวิจัยนี้ก่อให้เกิดการถกเถียงในโซเชียลมีเดียและชุมชนออนไลน์

 

ใน Reddit มีการตอบสนองว่า "ไม่ใช่ผลลัพธ์ที่น่าแปลกใจ"

AI ที่สร้างขึ้นมีความมั่นคงทางไวยากรณ์ จัดระเบียบการเล่าเรื่อง และสร้างบทความที่ผู้อ่านเข้าใจได้ง่ายในเวลาสั้นๆ เมื่อเปรียบเทียบกับนักเขียนทั่วไปที่ไม่ใช่มืออาชีพ การที่ AI ได้รับการประเมินสูงกว่าก็ไม่น่าแปลกใจ

ในทางกลับกัน มีการโต้แย้งที่สำคัญมาก

คือการเปรียบเทียบ "บทความของมนุษย์ทั่วไปกับ AI" และ "นักเขียนระดับสูงสุดกับ AI" เป็นปัญหาที่แตกต่างกันอย่างสิ้นเชิง

ในโซเชียลมีเดีย มีเสียงว่า "อ่านง่ายแต่มีแนวโน้มจะธรรมดา" และ "ถ้าไม่สั่งละเอียดก็ยากที่จะไปในทิศทางที่สร้างสรรค์" เกี่ยวกับผลงานของ AI

นั่นหมายความว่า AI ยกระดับขั้นต่ำหรือคะแนนเฉลี่ยของบทความขึ้นอย่างมาก แต่การสร้างผลงานที่โดดเด่นเหมือนที่นักเขียนมนุษย์ชั้นนำทำได้เป็นอีกปัญหาหนึ่ง

มีการตอบสนองว่า "การให้คำสั่งสองบรรทัดกับ ChatGPT จะไม่ทำให้ได้ผลงานระดับ 'Harry Potter'" และยังมีการสนับสนุนความเห็นว่าการสร้างผลงานที่ยอดเยี่ยมด้วย AI ยังคงต้องการการคิดเรื่องราว การตั้งค่า และโครงสร้างจากมนุษย์


"เรื่องสั้นเพียง 6 เรื่องไม่สามารถพูดถึงนวนิยายทั้งหมดได้"

สิ่งสำคัญในการอ่านงานวิจัยคือการเข้าใจขอบเขตของมัน

การทดลองประเมินเพียงจำนวนจำกัดของเรื่องสั้น

จากผลลัพธ์นี้ ไม่สามารถสรุปได้ว่า "AI เหนือกว่ามนุษย์ในนวนิยายทุกเรื่อง"

เพราะความสามารถที่จำเป็นในเรื่องสั้นและนวนิยายยาวแตกต่างกันอย่างมาก

ในเรื่องสั้นที่มีความยาวประมาณ 1,000 คำ สามารถจัดโครงสร้างได้โดยเน้นที่ธีม เหตุการณ์ หรืออารมณ์เดียว

ในขณะที่นวนิยายยาว 300 หน้า ต้องรักษาการเปลี่ยนแปลงทางจิตวิทยาของตัวละคร การวางแผนล่วงหน้า โลกทัศน์ หลายซับพล็อต จังหวะของบทความ และความสอดคล้องของเรื่องราวทั้งหมดในระยะยาว

ในโซเชียลมีเดียก็มีการตอบสนองที่เน้นย้ำจุดนี้

"สิ่งที่สามารถพูดได้จากการวิจัยนี้คือ AI เรื่องสั้นบางเรื่องได้รับการประเมินสูงภายใต้เงื่อนไขเฉพาะ" เป็นความเห็นที่ระมัดระวัง

การแยกแยะนี้มีความสำคัญมาก

ข่าวการวิจัย AI มักจะมีพาดหัวว่า "AI เหนือกว่ามนุษย์" ซึ่งดึงดูดความสนใจได้ง่าย

แต่ถ้าแยกออกจากเงื่อนไขการทดลองและนำไปใช้ทั่วไป เรื่องราวจะไม่ตรงกับผลการวิจัยที่แท้จริง


ยิ่ง AI ช่วยในการสร้างสรรค์มากเท่าไร เรื่องราวก็อาจคล้ายกันมากขึ้น

มีการวิจัยอื่นที่ควรพิจารณาร่วมกับการวิจัยครั้งนี้

ในการวิจัยที่เผยแพร่ใน Science Advances ในปี 2024 พบว่าเรื่องสั้นที่เขียนโดยคนที่ได้รับไอเดียจาก AI ได้รับการประเมินว่า "สร้างสรรค์" "เขียนได้ดี" และ "สนุก" มากกว่าการไม่ใช้ AI

โดยเฉพาะอย่างยิ่ง ผู้เข้าร่วมที่มีการประเมินความสามารถในการสร้างสรรค์ต่ำได้รับประโยชน์มากจาก AI

จนถึงตอนนี้ทิศทางของการวิจัยนี้คล้ายกับการวิจัยครั้งนี้

แต่ก็มีผลข้างเคียงที่สำคัญ

เรื่องราวที่เขียนด้วยความช่วยเหลือของ AI มีแนวโน้มที่จะคล้ายกันมากกว่าเรื่องราวที่เขียนโดยมนุษย์เพียงอย่างเดียว

ในระดับบุคคล คะแนนเฉลี่ยของผลงานเพิ่มขึ้น

แต่ถ้ามองในระดับสังคม เรื่องราวที่คล้ายกันอาจเพิ่มขึ้นและความหลากหลายอาจลดลง

นี่เป็นปัญหาใหญ่ในการพิจารณาการสร้างสรรค์ในยุค AI ที่สร้างขึ้น

ถ้ามีนักเขียนหนึ่งล้านคนได้รับคำแนะนำจาก AI เดียวกันในเรื่องโครงเรื่อง การใช้คำ และวิธีการดำเนินเรื่อง ผลงานแต่ละชิ้นอาจมีคุณภาพเกินกว่าระดับหนึ่ง

แต่ในขณะเดียวกัน ผลงานที่ "ไม่มีใครคิดถึง" อาจลดลง

การที่ AI ยกระดับคะแนนเฉลี่ยของการสร้างสรรค์ไม่ได้หมายความว่าทั้งวัฒนธรรมจะร่ำรวยขึ้น


อันตรายจากการสงสัยผู้เขียนจาก "บทความที่ดูเหมือน AI"

เมื่อการแยกแ