สร้างภาพยังไงให้ได้ ตัวละคร เหมือนเดิมตลอดทุกภาพ ที่ต้องการ 

ในการใช้งาน Gemini เพื่อสร้างภาพ (Image Generation) ปัจจุบัน Gemini ถูกพัฒนาให้เข้าใจภาษาธรรมชาติและบริบทที่ซับซ้อนได้ดีมากครับ แต่เนื่องจากระบบการสร้างภาพของ Gemini จะเป็นการตีความใหม่ในทุก ๆ Prompt (ไม่มีคำสั่งประเภท --cref ล็อกภาพเหมือน Midjourney)

ดังนั้น การจะสั่ง Gemini ให้เสกตัวละครเดิมหลุดไปอยู่ทุก ๆ ฉาก จึงต้องใช้เทคนิค “การเลี้ยงบริบทและการล็อกรายละเอียดเชิงวิศวกรรมคำสั่ง (Prompt Engineering)” เข้าช่วย ซึ่งเป็นเทคนิคที่ผมแนะนำให้ดีไซเนอร์ใช้อยู่เป็นประจำ ดังนี้ครับ:

🛠️ เทคนิคที่ 1: การใช้ระบบ “คุยต่อเนื่อง” ในแชทเดียวกัน (Context Retention)

Gemini มีจุดเด่นเรื่อง Long Context Window (ความจำยาวมาก) ให้คุณใช้ประโยชน์จากข้อนี้โดยการห้ามเปลี่ยนห้องแชทเด็ดขาด ให้สร้างตัวละครแรกขึ้นมาในแชทนั้น แล้วคุยต่อ突ในแชทเดิมเลยครับ

ขั้นตอนการทำ:

  1. เจนภาพตัวละครแรกที่คุณพอใจที่สุดขึ้นมาก่อน
  2. เมื่อได้ภาพที่ชอบแล้ว ให้พิมพ์คุยกับ Gemini เพื่อสั่งให้เขา “จำภาพนี้ไว้”
    • ตัวอย่างประโยคสั่งจำ: “จำหน้าตา ทรงผม และเสื้อผ้าของคุณยายในภาพล่าสุดนี้ไว้นะ ต่อไปนี้เราจะเรียกคุณยายคนนี้ว่า ‘คุณยายเทอร์โบ'”
  3. เวลาจะสั่งฉากใหม่ ให้สั่งโดยอ้างอิงภาพเดิมทันที เช่น “จากภาพล่าสุด ช่วยเปลี่ยนฉากให้คุณยายเทอร์โบไปนั่งดื่มกาแฟในคาเฟ่แทน โดยคุมหน้าตาและชุดเดิมไว้”

📐 เทคนิคที่ 2: ใช้สูตร C.S.D.L.Q. ล็อกรายละเอียดแบบ “Copy-Paste”

เนื่องจาก Gemini แปลความหมายคำศัพท์ละเอียดมาก หากคุณเปลี่ยนคำอธิบายแม้แต่นิดเดียว หน้าตัวละครจะเปลี่ยนทันที วิธีแก้คือให้ทำ “คลังคำศัพท์ประจำตัว (Character Asset)” ของตัวละครนั้นไว้ แล้วก๊อปปี้ส่วน D (Details) และ S (Style) ไปวางใน Prompt ใหม่ทุกครั้ง 100% ห้ามลดหรือเพิ่มคำในส่วนนี้

ตัวอย่างโครงสร้างคำสั่งสำหรับ Gemini:

  • ภาพที่ 1 (ฉากซิ่งรถ): [Concept: คุณยายซิ่งรถสกู๊ตเตอร์บนถนนอนาคต] + [Style: 3D Pixar animation style rendering] + [Details: silver hair tied back in a neat bun, smiling joyfully, no glasses, wearing a colorful modern racing outfit] + [Lighting: vibrant neon lighting] + [Quality: highly detailed, 8K]
  • ภาพที่ 2 (ฉากในฟาร์ม): [Concept: คุณยายคนเดิมกำลังยืนเด็ดใบกะเพราอยู่ในฟาร์ม Solaris Organic Farm Village] + [Style: 3D Pixar animation style rendering] + [Details: silver hair tied back in a neat bun, smiling joyfully, no glasses, wearing a colorful modern racing outfit] + [Lighting: bright daytime sunlight] + [Quality: highly detailed, 8K]

💡 ข้อสังเกต: สิ่งที่เปลี่ยนมีแค่ Concept (การกระทำ/สถานที่) และ Lighting (แสงตามฉากใหม่) ส่วนหน้าตา ทรงผม เสื้อผ้า และสไตล์ภาพ (Pixar 3D) ถูกล็อกไว้ด้วยคำเดิมเป๊ะ ๆ วิธีนี้จะช่วยบีบให้ Gemini เจนภาพออกมาใกล้เคียงเดิมที่สุดครับ

🤖 เทคนิคที่ 3: สั่งทำ “Character Sheet” (ฉากรวมมุมมอง) ตั้งแต่แรก

หากคุณต้องการนำตัวละครนี้ไปทำแอนิเมชัน ทำคลิปสั้น หรือวาดสตอรี่บอร์ดต่อ เทคนิคที่ดีที่สุดคือสั่งให้ Gemini เจนภาพตัวละครตัวเดิมในหลากหลายมุมมองรวมอยู่ในภาพเดียวกันตั้งแต่รูปแรก

ตัวอย่าง Prompt สั่งทำแผ่นอ้างอิง:

"A character design sheet of a cute, energetic elderly grandmother, 3D Pixar animation style rendering. The image shows the exact same character in 4 different angles and poses: front view, side view, back view, and an action pose driving a scooter. She has silver hair tied back in a neat bun, smiling joyfully, no glasses, wearing a colorful modern racing outfit. Clean white background, studio lighting, ultra-high quality, 8K."

วิธีนำไปใช้: พอคุณได้ภาพที่มีคุณยาย 4 มุมมองในภาพเดียวแล้ว เวลาคุณจะเอาไปตัดต่อทำคลิป หรือแชร์ลงช่องทางออนไลน์ (เช่น วีแซดมาร์ท, ซานกั๋ว หรือ WELLGEN) คุณก็แค่ตัดครอป (Crop) เอาเฉพาะท่าทางที่ต้องการไปใช้งาน ทำให้ได้ตัวละครที่หน้าตาเหมือนกันเป๊ะในหลากหลายอารมณ์ทันทีครับ

📝 สรุป Checklist สำหรับสายกราฟิกบน Gemini

  1. เปิดแชทใหม่เพื่อสร้างตัวละคร และคุยต่อเนื่องในแชทนั้นยาว ๆ
  2. ตั้งชื่อเฉพาะให้ตัวละคร และเขียนรายละเอียดถอดรหัส (ทรงผม, เสื้อผ้า, อารมณ์) เก็บไว้ใน Notepad
  3. เวลาสั่งภาพใหม่ ให้ก๊อปปี้รายละเอียดตัวละครเดิมไปแปะร่วมกับฉากใหม่ทุกครั้ง

ลองนำเทคนิคการล็อกบริบทนี้ไปปรับใช้ดูครับ Gemini จะกลายเป็นมือขวาที่ช่วยเสกคาแรกเตอร์เดิมของคุณให้โลดแล่นได้ในทุก ๆ ไอเดียเลยครับ!

ถ้าคุณมีภาพต้นแบบที่ชอบอยู่แล้ว (ไม่ว่าจะเป็นภาพถ่าย ภาพวาด หรือภาพที่แคปมาจากเน็ต) แล้วอยากจะแกะมันออกมาเป็น Prompt ภาษาอังกฤษเพื่อเอาไปสั่ง AI ให้เจนภาพสไตล์เดิม หรือตัวละครเดิมออกมา วิธีนี้ในทางเทคนิคเรียกว่า Image-to-Prompt (หรือ Reverse Engineering) ครับ

ในฐานะดีไซเนอร์และผู้เชี่ยวชาญ AI ผมมี 2 วิธีหลัก ๆ ที่ทำได้ง่ายและได้ผลดีที่สุดมาแนะนำครับ:

🤖 วิธีที่ 1: ให้ Gemini ช่วยแกะ Prompt ให้ (วิธีที่ง่ายและแม่นยำที่สุด)

เนื่องจาก Gemini สามารถอ่านภาพและวิเคราะห์รายละเอียดได้อย่างลึกซึ้ง คุณสามารถอัปโหลดภาพนั้นให้ Gemini ดูแล้วสั่งให้เขาเขียน Prompt ตามสูตร C.S.D.L.Q. กลับมาให้ได้เลยครับ

ขั้นตอนการทำ:

  1. กดปุ่ม + หรือปุ่มอัปโหลดรูปภาพในช่องแชทของ Gemini แล้วเลือกภาพต้นแบบของคุณ
  2. พิมพ์สั่ง Gemini ด้วย Prompt นี้ (สามารถก๊อปปี้ไปใช้ได้เลย):

“ช่วยวิเคราะห์รูปภาพนี้ในฐานะผู้เชี่ยวชาญ AI และนักออกแบบกราฟิก แล้วเขียนเป็น Prompt ภาษาอังกฤษสำหรับนำไปสั่ง AI สร้างภาพ (เช่น Midjourney หรือ Gemini) โดยถอดรหัสตามโครงสร้าง C.S.D.L.Q. (Concept, Style, Details, Lighting, Quality) ให้ละเอียด เพื่อให้ได้ภาพที่มีสไตล์ อารมณ์ และองค์ประกอบใกล้เคียงกับรูปภาพนี้มากที่สุด”

  1. Gemini จะส่ง Prompt ภาษาอังกฤษที่สมบูรณ์แบบกลับมาให้ คุณแค่ก๊อปปี้ข้อความนั้นไปใช้งานได้ทันทีครับ

✍️ วิธีที่ 2: แกะด้วยตัวเองโดยใช้สูตร C.S.D.L.Q. (Manual Reverse Engineering)

ถ้าคุณอยากฝึกฝนเพื่อเป็นเซียน Prompt ให้ใช้วิธีมองภาพต้นแบบแล้วแยกแยะองค์ประกอบออกมาทีละข้อตามสูตรนี้ครับ:

🔎 ลองดูภาพตัวอย่างแล้วแกะตามระบบนี้:

  • C – Concept (ภาพนี้คืออะไร): มองดูว่าในภาพคือใคร ทำอะไร ที่ไหน (เช่น ผู้หญิงนั่งในคาเฟ่, รถสปอร์ตวิ่งบนถนน)
  • S – Style (ภาพนี้สไตล์ไหน): ดูว่าเป็นภาพประเภทใด (เช่น 3D Pixar animation style, Photorealistic, Watercolor painting, Flat vector)
  • D – Details (รายละเอียดมีอะไรบ้าง): สังเกตเสื้อผ้า สีผม อารมณ์ใบหน้า สิ่งของรอบตัว (เช่น silver hair, wearing a racing suit, smiling joyfully)
  • L – Lighting & Color (แสงสีเป็นอย่างไร): โทนสีหลักและทิศทางแสง (เช่น vibrant neon colors, golden hour sunlight, studio lighting)
  • Q – Quality (ความคมชัด/มุมกล้อง): เป็นมุมมองแบบไหน เนี้ยบไหม (เช่น isometric view, cinematic composition, highly detailed, 8K)

💡 ตัวอย่างการรวมร่าง: พอคุณแกะได้ครบ 5 ข้อ ก็นำคำศัพท์ภาษาอังกฤษเหล่านั้นมาเขียนต่อกัน คั่นด้วยเครื่องหมายจุลภาค ( , ) เช่น:

A cute character, 3D Pixar style rendering, silver hair in a bun, wearing a colorful modern outfit, bright daytime lighting, clean background, ultra-high quality, 8K.

🛠️ เคล็ดลับเพิ่มเติมในการนำไปใช้

  • ถ้าอยากได้ตัวละครเดิมแต่เปลี่ยนฉาก: เมื่อได้ Prompt ที่แกะมาจากภาพแรกแล้ว ให้ล็อกส่วน S (Style) และ D (Details ของตัวละคร) เอาไว้ จากนั้นเปลี่ยนเฉพาะส่วน C (Concept – สถานที่/ท่าทางใหม่) เท่านั้นครับ
  • ลองผสมผสาน: คุณสามารถนำคำแปลก ๆ ที่แกะได้จากวิธีที่ 1 มาปรับแต่งร่วมกับจินตนาการของคุณในวิธีที่ 2 เพื่อสร้างสรรค์ภาพใหม่ที่ไม่ซ้ำใคร แต่ยังคงกลิ่นอายความสวยงามจากภาพต้นฉบับไว้ได้ 100% ครับ

Leave a Reply

Your email address will not be published. Required fields are marked *