การเขียนพรอมต์สำหรับสร้างภาพ

วิธีการที่ใช้ได้จริงสำหรับการเขียนพรอมต์ภาพ AI บน Sunra: โครงสร้างที่เชื่อถือได้ การปรับจากอ่อนไปแข็ง คำศัพท์ด้านสไตล์และแสงที่โมเดลเข้าใจ ภาพอ้างอิง และวิธีแก้ปัญหา

พรอมต์ภาพที่ดีอ่านเหมือนบรีฟที่คุณยื่นให้ช่างภาพหรือนักวาดภาพประกอบ คือมีอะไรอยู่ในเฟรม สไตล์เป็นแบบไหน จัดองค์ประกอบอย่างไร และจัดแสงอย่างไร ครอบคลุมทั้งสี่อย่างนี้แล้วคุณจะได้ภาพที่ใช้งานได้บ่อยกว่าการใช้พรอมต์คำเดียวมาก

แถบพรอมต์ของเครื่องสร้างภาพ Sunra — ตั้งค่าโมเดล อัตราส่วนภาพ ความละเอียด คุณภาพ และจำนวน ค่าใช้จ่ายเครดิตจะแสดงบนปุ่ม Generate
แถบพรอมต์ของเครื่องสร้างภาพ Sunra — ตั้งค่าโมเดล อัตราส่วนภาพ ความละเอียด คุณภาพ และจำนวน ค่าใช้จ่ายเครดิตจะแสดงบนปุ่ม Generate

โครงสร้างที่เชื่อถือได้

เขียนตามลำดับนี้ — มันสะท้อนวิธีวางแผนช็อตจริง:

  1. Subject (วัตถุหลัก) — มีอะไรอยู่ในเฟรม ระบุให้เจาะจง “ถ้วยกาแฟเซรามิกวางบนผ้าเช็ดปากลินิน”
  2. Style (สไตล์) — สื่อและการตกแต่ง “ภาพถ่ายสินค้าแบบบรรณาธิการ” “ภาพประกอบเวกเตอร์แบน” “เรนเดอร์ 3D” “สีน้ำ”
  3. Composition (องค์ประกอบ) — การจัดเฟรมและมุม “โคลสอัพ ถ่ายจากด้านบน จัดกึ่งกลาง ระยะชัดตื้น”
  4. Light & mood (แสงและอารมณ์) — “แสงเช้านุ่มนวล” “ยามค่ำคืนแสงนีออน” “ซอฟต์บ็อกซ์สตูดิโอ ไฮคีย์”
ภาพถ่ายสินค้าแบบบรรณาธิการของเคสหูฟังไร้สายสีดำด้าน วางบนพื้นผิวหินเปียก ถ่ายจากด้านบน ระยะชัดตื้น แสงสตูดิโอนุ่มกระจาย มินิมอล โทนเย็น

จากอ่อนไปแข็ง

ไอเดียเดียวกันแต่คมขึ้นด้วยการเพิ่มความเจาะจงของวัตถุหลัก ตามด้วยสไตล์ แล้วจึงเพิ่มแสง:

พรอมต์ผลลัพธ์
“ถ้วยกาแฟ”ถ้วยทั่วๆไป สไตล์และแสงสุ่ม
“ถ้วยกาแฟเซรามิกวางบนผ้าเช็ดปากลินิน”วัตถุหลักถูกต้อง แต่แบนและไร้สไตล์
ภาพถ่ายแบบบรรณาธิการ ของถ้วยกาแฟเซรามิกวางบนผ้าเช็ดปากลินิน โคลสอัพ”องค์ประกอบตรงตามบรีฟ
“ภาพถ่ายแบบบรรณาธิการของถ้วยกาแฟเซรามิกวางบนผ้าเช็ดปากลินิน โคลสอัพ แสงเช้านุ่มนวลจากหน้าต่าง ระยะชัดตื้นช็อตที่คุณต้องการจริงๆ

แต่ละวลีที่เพิ่มเข้าไปจะตัดการตัดสินใจที่ไม่อย่างนั้นโมเดลจะเลือกแทนคุณ

หมายเหตุ
ความยาวพรอมต์มีขีดจำกัดสูงสุด (แตกต่างกันไปตามโมเดล) และ Sunra จะไม่ตัดพรอมต์ที่ยาวเกินให้ — มันจะล้มเหลวแทนที่จะรัน ใส่สิ่งที่สำคัญที่สุดไว้ก่อน หากคุณกำลังต่อวลีแล้ววลีเล่า ยังไงคุณก็เลยจุดที่ผลตอบแทนเริ่มลดลงไปแล้ว

คำศัพท์ที่โมเดลเข้าใจ

เลือกใช้คำที่เป็นรูปธรรมแทนคำคุณศัพท์คลุมเครือ — โมเดลจับคู่คำเหล่านี้กับรูปแบบภาพจริง:

  • สื่อ (Medium) — ภาพถ่าย ภาพประกอบ เรนเดอร์ 3D ภาพสีน้ำมัน ลายเส้น ไอโซเมตริก เคลย์เมชั่น
  • ช็อตและเลนส์ (Shot & lens) — โคลสอัพ ภาพมุมกว้าง มาโคร ถ่ายจากด้านบน ระดับสายตา 35mm โบเก้ ฟิชอาย
  • แสง (Light) — golden hour ย้อนแสง รีมไลท์ ซอฟต์บ็อกซ์ เงาคม ไฮคีย์ โลว์คีย์
  • อารมณ์ / โทนสี (Mood / palette) — พาสเทลทึม คอนทราสต์สูง โมโนโครม โทนอุ่น ซีเนมาติก
เคล็ดลับ
คำที่แม่นยำหนึ่งคำดีกว่าคำคลุมเครือสามคำ “ย้อนแสงในช่วง golden hour” บอกโมเดลได้มากกว่า “แสงสวย” มาก

บอกสิ่งที่คุณต้องการ ไม่ใช่สิ่งที่คุณไม่ต้องการ

โมเดลจัดการกับคำอธิบายเชิงบวกได้ดีกว่าการปฏิเสธมาก ขอ “โต๊ะทำงานมินิมอลที่ว่างเปล่า” ไม่ใช่ “โต๊ะที่ไม่มีอะไรวางอยู่บนนั้น” หากคุณจะเพิ่มข้อความหรือโลโก้ทับลงไปทีหลัง ให้สั่งพรอมต์เป็น negative space (พื้นที่ว่าง) — “ท้องฟ้าว่างกว้างๆด้านบน” — แทนที่จะอธิบายสิ่งที่ไม่ควรมีอยู่

ทำงานจากภาพอ้างอิง

แนบ ภาพอ้างอิงได้สูงสุด 10 ภาพ เพื่อกำหนดทิศทางสไตล์ องค์ประกอบ หรือวัตถุหลักเฉพาะ ขณะเขียนพรอมต์ ให้พิมพ์ @ เพื่อชี้ไปยังภาพที่แนบไว้เฉพาะภาพ:

วาง @Image1 ลงบนโต๊ะใน @Image2 โดยให้เข้ากับแสงของ @Image2

นี่คือวิธีที่สะอาดที่สุดในการรวมภาพอ้างอิงหลายภาพให้เป็นช็อตเดียว — ดู การกำกับภาพแก้ไขและภาพอ้างอิง สำหรับเวิร์กโฟลว์การอ้างอิงและการแก้ไขแบบเต็ม

จับคู่พรอมต์ให้เข้ากับโมเดล

พรอมต์เดียวกันใช้ได้ข้ามโมเดล แต่แต่ละโมเดลตอบสนองต่อจุดเน้นที่ต่างกันเล็กน้อย:

  • GPT Image 2 — สะกดข้อความในภาพออกมาให้ครบถ้วนในเครื่องหมายคำพูด มันเรนเดอร์ตัวอักษรได้น่าเชื่อถือกว่าโมเดลอื่น
  • Seedream 5.0 — เน้นรายละเอียดเสมือนจริง (ผิว สายตา ความลึก) มันให้เหตุผลเรื่องความสมจริงได้ดีและยังจัดการข้อความในภาพได้ด้วย
  • Midjourney V8 — ป้อนคำที่เกี่ยวกับอารมณ์และสไตล์ให้มัน มันเอนเอียงไปทางซีเนมาติกและแบบภาพวาดโดยปริยาย
  • Nano Banana Pro — สำหรับการแก้ไขแม่นยำ ให้อธิบายเฉพาะสิ่งที่จะเปลี่ยน (“ทำให้แจ็กเก็ตเป็นสีแดง”) มันแก้ไขเฉพาะจุดได้โดยไม่ต้องใช้มาสก์ และยังเก่งเรื่องข้อความในภาพด้วย
เคล็ดลับ
การเรนเดอร์ ตัวอักษร ภายในภาพเป็นสิ่งที่ยากที่สุดสำหรับโมเดลส่วนใหญ่ หากดีไซน์ของคุณต้องการข้อความที่อ่านออก — ป้าย ฉลาก หรือโปสเตอร์ — ให้เลือกโมเดลที่เก่งเรื่องข้อความและใส่คำที่ต้องการแบบเป๊ะๆ ใน เครื่องหมายคำพูด: a neon sign reading "OPEN 24 HOURS" ดู การเรนเดอร์ข้อความของ GPT Image 2

ไม่แน่ใจว่าจะใช้ตัวไหน? การเลือกโมเดล แยกแยะให้ครบทุกตัว

คำเตือน
มาจาก Discord Midjourney ใช่ไหม? อย่าพิมพ์แฟล็กพารามิเตอร์ อย่าง --ar, --v, หรือ --style ลงในพรอมต์ — Sunra จะตีความว่าเป็นคำธรรมดาและโมเดลจะปฏิเสธการสร้างทั้งหมด ให้ใช้ ตัวควบคุม อัตราส่วนภาพ เวอร์ชัน และสไตล์ในแถบพรอมต์แทน

แก้ปัญหาที่พบบ่อย

ปัญหาลองทำแบบนี้
ข้อความในภาพเพี้ยนสลับไปใช้ GPT Image 2 ใส่คำที่ต้องการแบบเป๊ะๆในเครื่องหมายคำพูด
เน้นวัตถุหลักผิดวางวัตถุหลักไว้ก่อน ตัดความรกของฉากหลังออกจากพรอมต์
ตัวละครไม่สม่ำเสมอข้ามภาพใช้ภาพอ้างอิงและโมเดลที่เก่งเรื่องความสม่ำเสมออย่าง Nano Banana Pro
เกือบถูกแล้ว เพี้ยนแค่จุดเดียวอย่ารีโรล — แก้ไข ผลลัพธ์หรือกำกับแล้วแก้ไขเฉพาะบริเวณนั้น
สไตล์เพี้ยนไปเรื่อยๆระบุชื่อสื่ออย่างชัดเจนและให้ภาพอ้างอิง

ปรับปรุงอย่างตั้งใจ

เปลี่ยน ทีละหนึ่งตัวแปร — โมเดล แล้วค่อยแสง แล้วค่อยองค์ประกอบ — เพื่อให้คุณเรียนรู้ว่าแต่ละการเปลี่ยนแปลงทำอะไร เมื่อชุดภาพใกล้เคียงแล้ว ให้สลับไป แก้ไข แทนการเขียนพรอมต์ใหม่ทั้งหมด: แก้คำด้วย text edit เปลี่ยนมุมกล้องด้วย multi-angle หรือปรับฉากหลังแทนที่จะเริ่มใหม่ตั้งแต่ต้น

พร้อมจะนำสัญชาตญาณเหล่านี้ไปสู่ภาพเคลื่อนไหวแล้วหรือยัง? อ่าน การเขียนพรอมต์สำหรับวิดีโอ

บทความที่เกี่ยวข้อง