ภาพในหัวให้ตรงภาพที่ออกจาก AI คืออะไร และทำไมต้องวางแผน Prompt ก่อน
การวางแผน Prompt เพื่อสร้างรูปภาพด้วย AI คือกระบวนการคิดโครงสร้างภาพ กำหนดองค์ประกอบ สไตล์ ข้อจำกัด และรายละเอียดสำคัญให้ชัดเจน ก่อนส่งคำสั่งเข้าโมเดลสร้างภาพอย่าง ChatGPT Images 2.5 เพื่อให้ภาพที่ได้ใกล้เคียงกับภาพในหัว ลดการสุ่มกดสร้างซ้ำไปมา และช่วยประหยัดเวลาทั้งสำหรับนักการตลาด คอนเทนต์ครีเอเตอร์ ไปจนถึงคนทำงานอิสระที่ต้องใช้ภาพประกอบงานเป็นประจำ สอน Prompt Engineering ในมุมนี้จึงเน้นการคิดเป็นระบบมากกว่าพิมพ์คำสวยหรู
หลายคนลองสร้างรูปภาพด้วย AI ครั้งแรกแล้วผิดหวัง เพราะภาพที่ออกมาหน้าตาไม่เหมือนที่คิดไว้ ทั้งองค์ประกอบ วัดแสง หรือฉากหลังดูรกเกินไป ทั้งที่ตัวโมเดลไม่ได้แย่ แต่สิ่งที่เราขอไม่ชัดพอแหล่งหนึ่งอธิบายว่า การพิมพ์แค่ “สร้างภาพโปรแกรมเมอร์กำลังทำงานหน้าคอมพิวเตอร์” ยังไม่ครอบคลุมสิ่งที่ต้องตัดสินใจอีกจำนวนมากเลย นี่จึงเป็นเหตุผลว่าทำไมต้องมี Prompt Planning Claude มาช่วยคิดภาพให้ละเอียดก่อน แล้วค่อยไปสั่ง ChatGPT ให้สร้างจริง เพื่อให้แต่ละการสร้างใกล้เป้าหมายมากขึ้นตั้งแต่รอบแรก
ข้อสำคัญอีกอย่างสำหรับยุค ChatGPT Images 2.5 คือแก่นการเขียน Prompt ยังเหมือนยุค Image 2.0 แต่รูปแบบการควบคุมภาพเปลี่ยนไปพอสมควร โมเดลใหม่เข้าใจคำสั่งซับซ้อนได้ดีขึ้น ทำให้ความต่างระหว่างคนที่คิดโครงสร้างก่อนพิมพ์ กับคนที่พิมพ์สุ่มๆ แล้วลุ้นผล ยิ่งถ่างออก ถ้าอยากให้ภาพออกมาตรง งานวางแผนก่อนจึงสำคัญมากกว่าเดิม

รู้ก่อนลงมือ: ความต่างของ Prompt ระหว่าง ChatGPT Images 2.0 กับ 2.5
ก่อนจะลงมือวางแผน Prompt เราต้องเข้าใจธรรมชาติของ ChatGPT Images 2.5 ก่อนว่าเหมือนหรือต่างจาก Image 2.0 ตรงไหน หลายคนสงสัยว่าทักษะการเขียน Prompt เดิมยังใช้ได้ไหม คำตอบคือแก่นยังเหมือนเดิม แต่รูปแบบการคุมภาพต่างไป การสอน Prompt Engineering ในยุคใหม่จึงเน้นทั้งการบรรยายภาพปลายทาง และการระบุสิ่งที่ห้ามเปลี่ยนอย่างชัดเจน
ยุค Image 2.0 เรามักใช้ Prompt แบบบรรยายฉาก เช่น สร้างภาพสินค้า ถ่ายบนพื้นหินอ่อน แสงแบบสตูดิโอ โทนสะอาดตา เน้นเล่า “อยากได้อะไร” เป็นหลัก แต่ในยุค ChatGPT Images 2.5 จุดใหญ่ที่เปลี่ยนคือการย้ายจากการอธิบายสิ่งที่อยากได้ ไปสู่การประกาศสิ่งที่ห้ามเปลี่ยน เช่น ใช้ภาพแนบเป็นต้นแบบ ระบุว่ารูปทรงขวด สี เนื้อเซรั่ม ฉลาก โลโก้ และตัวหนังสือต้องเหมือนต้นฉบับห้ามเพี้ยน แล้วค่อยเล่าต่อว่าฉากหลัง แสง ข้อความบนภาพต้องเปลี่ยนเป็นอะไร
มีประโยคหนึ่งที่ควรจำว่า Prompt ที่ดีไม่ใช่ Prompt ที่กองคำคุณศัพท์อย่าง Beautiful Premium 4K แต่คือ Prompt ที่บรรยายฉากให้เห็นภาพ บอกองค์ประกอบที่ต้องมี ระบุสไตล์และข้อจำกัดอย่างเจาะจง นอกจากนี้ Images 2.5 ยังเพิ่มคันโยกใหม่ เช่น การใช้สเกตช์เพื่อคุมเลย์เอาต์ ทำให้เราไม่ต้องบรรยายตำแหน่งทุกอย่างเป็นตัวหนังสืออีกต่อไป และถ้าอยากคุมโครงสร้างคำสั่งให้เป็นระบบมากขึ้น ยังมีเทคนิค JSON Prompt ที่ช่วยจัดชุดคำสั่งให้เป็นระเบียบด้วย
ขั้นตอนเดียวแต่ครบ: ใช้ Claude วางแผน แล้วค่อยไปสร้างภาพใน ChatGPT
หัวใจของบทความนี้คือการใช้ Claude กับ ChatGPT ร่วมกันแบบงานทีม โดยให้ Claude รับบทวางแผน Prompt และให้ ChatGPT รับบทสร้างภาพจริง หลักคิดคือแยกงานคิดออกจากงานสร้างภาพ เพื่อไม่ให้เราไปนั่งเขียน Prompt ยาวๆ ในหน้าต่างเดียวกับที่ใช้สร้างรูป ซึ่งทำให้สับสนกรอบความคิดได้ง่าย
- เริ่มจากไอเดียคร่าวๆ แล้วคุยกับ Claude เปิด Claude แล้วบอกก่อนว่าเราจะสร้างภาพไปใช้ทำอะไร เช่น ภาพหน้าปกบทความ ภาพปกเว็บ หรือโพสต์โซเชียล พร้อมเล่าโทนและสิ่งที่อยากเห็นแบบกว้างๆ ให้ Claude รู้ว่าเราจะเอาภาพนี้ไปใช้ตรงไหนและอยากได้อารมณ์ประมาณไหน โดยยังไม่ต้องลงดีเทลเรื่องเลนส์หรือเฟอร์นิเจอร์ จากนั้นปล่อยให้ Claude ถามคำถามกลับมา เพื่อช่วยเติมรายละเอียดที่เรายังไม่เคยนึกถึง เช่น มุมกล้อง เวลาในภาพ พื้นหลัง และช่วยเสนอทางเลือกให้เราเลือกตอบ
- ใส่ข้อกำหนดเชิงเทคนิคและให้ Claude รวมเป็น Prompt เดียว เมื่อแนวภาพเริ่มชัดแล้ว ใส่ข้อมูลเทคนิคที่จำเป็น เช่น อัตราส่วนภาพ รูปแบบแนวนอนหรือแนวตั้ง และบอกว่าไม่อยากให้ตัวแบบอยู่ชิดขอบ เพราะบางหน้าจออาจครอปภาพได้ พร้อมระบุว่าต้องการพื้นที่โล่งสำหรับข้อความตรงไหน ข้อกำหนดเหล่านี้ควรใส่ก่อนเขียน Prompt จริง จากนั้นบอก Claude ให้เขียน Prompt สำหรับสร้างภาพหนึ่งชุดแบบละเอียด ที่พร้อมคัดลอกไปวางใน ChatGPT โดยให้รวมทั้งตัวแบบ ฉาก การจัดองค์ประกอบ มุมกล้อง แสง อารมณ์ และรายละเอียดสำคัญทั้งหมด
- คัดลอก Prompt ไปสร้างภาพใน ChatGPT แล้ววนปรับแบบมีเหตุผล พอได้ Prompt สมบูรณ์จาก Claude ให้คัดลอกไปเปิดบทสนทนาใหม่ใน ChatGPT แล้วพิมพ์บรรทัดสั้นๆ ว่า Create an image using the following prompt ตามด้วย Prompt เต็มจาก Claude ภาพร่างแรกมักไม่ใช่ภาพที่เสร็จสมบูรณ์ แต่เป็นจุดเริ่มต้นที่ดีขึ้นเพราะ Prompt ละเอียดกว่าเดิม จากนั้นดูภาพให้ละเอียดแล้วบอกสิ่งที่ผิดเฉพาะจุด เช่น ให้คงฉากโดยรวม แต่ขยับตัวแบบไปด้านขวา ลบต้นไม้ด้านซ้าย เพื่อให้เหลือพื้นที่สำหรับหัวข้อ แทนที่จะพิมพ์คำสั่งคลุมเครืออย่าง make it better ที่โมเดลไม่รู้ว่าคำว่า better ของเราแปลว่าอะไร หากลองปรับแล้วหลายรอบยังไม่สื่อสิ่งที่ต้องการ ควรหยุดสร้างแล้วกลับไปเล่าโจทย์ใหม่ให้ Claude ช่วยคิดใหม่อีกรอบ
ข้อควรระวังคือไม่ควรข้ามขั้นโดยหวังว่า Prompt รอบแรกจะเป๊ะเสมอ แม้ Prompt ที่ละเอียดจะช่วยให้ภาพเริ่มต้นดีขึ้นมาก แต่ก็ไม่ได้แปลว่ารอบแรกจะจบงานได้ทันที ข้ออีกอย่างคืออย่าปล่อยให้ความขี้เกียจทำให้เราใช้คำสั่งกำกวม เช่น make it better หรือทำให้สวยขึ้น เพราะโมเดลไม่รู้ว่าความสวยของเราคืออะไร วิธีที่ปลอดภัยคือบอกสิ่งที่ผิดอย่างชัด เช่น ให้เก็บองค์ประกอบเดิมแต่ย้ายตำแหน่ง หรือลดสิ่งรกรุงรังออกบางส่วน

หลีกเลี่ยงผิดซ้ำ: 3 พลาดยอดฮิตเวลาเขียน Prompt และสิ่งที่ควรทำแทน
เมื่อใช้ Claude และ ChatGPT คู่กันแล้ว สิ่งที่จะทำให้งานลื่นหรือสะดุดอยู่ที่คุณภาพของ Prompt เป็นหลัก ความผิดพลาดบางอย่างเกิดซ้ำบ่อยจนกลายเป็นกับดัก เช่น คิดว่าสร้างภาพด้วย AI ไม่ต้องคิดเยอะ แค่พิมพ์แล้วปล่อยให้โมเดลจัดการ ที่จริงหลายครั้งตัวสร้างภาพไม่ใช่ปัญหา แต่สิ่งที่เราขอจากมันต่างหากที่เป็นปัญหา
- ใช้คำคุณศัพท์เยอะเกินแต่ไม่เล่าฉาก การกองคำอย่าง Beautiful Premium 4K ลงใน Prompt ไม่ได้ช่วยให้โมเดลเข้าใจว่าภาพควรหน้าตาอย่างไร สิ่งที่ได้ผลกว่าคือการเล่าฉากให้เห็นภาพ ระบุองค์ประกอบ สไตล์ และข้อจำกัดให้ชัดเจน
- ใช้คำสั่งกำกวมเวลาปรับภาพ การพิมพ์คำสั่งแบบ make it better ทำให้โมเดลไม่รู้ว่าต้องแก้ตรงไหน เพราะไม่รู้ว่าสิ่งที่เรามองว่า better คืออะไร แหล่งหนึ่งแนะนำให้ระบุปัญหาแบบเฉพาะจุด เช่น ขยับตัวแบบไปด้านขวา ลบต้นไม้ด้านซ้าย เพื่อเหลือพื้นที่โล่งสำหรับข้อความ
- ข้ามการวางแผนกับ Claude แล้วไปสุ่มสร้างใน ChatGPT เลย การใช้ Claude วางแผนภาพก่อน สอบถามโจทย์ย้อนกลับ และช่วยเขียน Prompt แบบเต็ม ช่วยเปลี่ยนไอเดียคร่าวๆ ให้กลายเป็นคำสั่งละเอียดที่นำไปสร้างภาพได้ทันที มีประโยคหนึ่งที่น่าจดจำว่า การใช้เวลาไม่กี่นาทีเพื่อกำหนดภาพล่วงหน้า ช่วยลดการลองผิดลองถูกได้มาก และลดการนั่งกดปุ่มสร้างซ้ำไปมาโดยไม่มีทิศทาง
ถ้าอยากคุมโครงสร้างคำสั่งให้เป็นระบบและลดโอกาสลืมรายละเอียด สามารถศึกษาแนวคิด JSON Prompt ซึ่งช่วยจัดรูปแบบคำสั่งเป็นหมวดหมู่ เช่น ฉาก ตัวแบบ แสง และข้อห้ามต่างๆ ให้เป็นระเบียบมากขึ้น การทำแบบนี้ช่วยให้ทั้ง Claude และ ChatGPT เข้าใจโจทย์ได้สอดคล้องกัน และเวลาเรากลับมาแก้ Prompt ในรอบต่อไปก็อ่านย้อนหลังง่าย ไม่ต้องเดาว่าบรรทัดไหนควบคุมอะไร
สรุป: ใช้สมองคิดกับ Claude แล้วให้ ChatGPT ลงมือสร้าง ประหยัดรอบ ประหยัดแรง
เมื่อนำทุกอย่างมารวมกัน วิธีทำงานที่คุ้มเวลาคือให้ Claude รับหน้าที่คิด และให้ ChatGPT รับหน้าที่ลงมือสร้าง ภาพรวมของเวิร์กโฟลว์สั้นๆ คือ เริ่มจากไอเดียคร่าวๆ ใส่บริบทว่าภาพจะถูกใช้ที่ไหน ถ้าโจทย์ยังคลุมเครือให้ Claude ถามกลับเพื่อช่วยขุดรายละเอียด เมื่อทิศทางเริ่มชัดแล้วค่อยขอให้ Claude เขียน Prompt เต็มหนึ่งชุด แล้วคัดลอกไปสร้างภาพใน ChatGPT จากนั้นวนดูภาพ ปรับแก้ด้วยคำอธิบายที่เฉพาะเจาะจง และหากภาพยังไม่สื่อสิ่งที่ต้องการค่อยย้อนกลับไปขอให้ Claude ช่วยปรับโจทย์ใหม่อีกครั้ง
ผลลัพธ์ที่ควรคาดหวังคือ Prompt ที่ละเอียดจะให้ภาพเริ่มต้นที่ดีกว่าเดิม แม้ภาพแรกที่ได้อาจยังไม่ใช่เวอร์ชันสุดท้าย แต่จะใกล้สิ่งที่เราคิดไว้มากขึ้นอย่างเห็นได้ชัด เช่น จากคำสั่งกว้างๆ เรื่องนักพัฒนานั่งทำงาน ภาพที่ได้อาจกลายเป็นห้องทำงานที่สมจริง มีแสงวันธรรมชาติส่องจากหน้าต่าง โค้ดเปิดอยู่บนหน้าจอ และพื้นที่โล่งสำหรับใส่หัวข้อ เป็นคนละระดับกับการพิมพ์สั้นๆ แบบเดิม เมื่อฝึกใช้เวิร์กโฟลว์นี้จนคล่อง คุณจะรู้ว่าการสละเวลาไม่กี่นาทีเพื่อวางแผน Prompt ใน Claude ช่วยประหยัดแรงจากการลองผิดลองถูกใน ChatGPT ได้มาก และทำให้การสร้างรูปภาพด้วย AI กลายเป็นงานที่ควบคุมได้จริงมากขึ้น






