Pony v7 ทำไม ยังไม่ฮิต อันนี้มาตั้งแต่ปีที่แล้ว เห็นว่าดีกว่าทุกอย่าง แต่ผ่านไป 1 ปี ไม่ฮิต คนยังใช้ Pony XL อยู่เลย ก็เลยต้องลองว่ามันดีจริงไไหมสรุปผมไปลองมาครับแต่ก่อนอื่น มาดูว่าอัดเดตอะไรบ้าง
https://huggingface.co/purplesmartai/pony-v7-base
การอัพเดต ภาพรวม Pony v7
เข้าใจภาษาคนดีขึ้นมาก: โดยเฉพาะเรื่องตำแหน่ง (ใครยืนตรงไหน) และการสั่งงานที่มีตัวละครหลายตัวในภาพเดียว
ฉากหลังอลังการขึ้น: สร้างฉากหลังได้สวย และจับคู่ตัวละครเข้ากับฉากได้เนียนกว่าเดิม
รองรับความสมจริง (Realism): ทำภาพคนจริง/สมจริงได้ตั้งแต่แกะกล่อง
คุมแสงเก่ง: สั่งทำภาพที่มืดมากๆ หรือสว่างจ้ามากๆ ได้ดี
อัปสเกลความละเอียด: ดันความละเอียดขึ้นไปสูงสุดที่ 1536x1536 พิกเซล (แนะนำให้รันที่สเต็ป 30 ขึ้นไป)
รู้จักตัวละครเยอะขึ้น: ฐานข้อมูลกว้างขึ้น รู้จักตัวละครแปลกๆ มากขึ้น
จุด อัพเกรดสำคัญส่วนข้อมูล การฝึกฝน
เทรนจากรูปกว่า 10 ล้านรูป โดยแบ่งสัดส่วนเป๊ะๆ (อนิเมะ/การ์ตูน/Furry/Pony อย่างละเท่าๆ กัน) และเรตติ้งภาพ (Safe/Questionable/Explicit อย่างละเท่ากัน)
ถูกกฎหมายและถูกศีลธรรม! โดยการ
"ลบชื่อศิลปินออกทั้งหมด (Artists' names have been removed)" และคัดกรองรูปสุ่มเสี่ยงออกไป เพื่อป้องกันปัญหาลิขสิทธิ์และกฎหมาย
เอาละครับ เห็นข้อดีหรือยังครับ เอาละ จากที่ผมลองใช้จริง ผลที่ได้ตามนี้ครับ
1.ภาพไม่สวย ไม่ได้ดังใจ เมื่อเทียบกับ v6
2.ช้า แบบช้า หลายเท่าเลย ข้อดีที่ได้มา ไม่คุ้ม
จากเดิม Pony v6 ภาพขนาด 1024x1024 เวลาเจน 12-16 s
ของใหม่ Pony v7 ภาพขนาด 1024x1024 เวลาเจน 67-86 s
โดยใช้ RTX 5060ti 16GB
3.แดก VRAM ไป 14 GB แปลว่า RTX 5070 12GB เป็นขยะ เผาไม่ได้ไป
เพราะไฟล์ base model ก็ปาไป 12.78 GB แล้ว
*(แล้วถ้าเถียง GGUF, NF4 หรือ FP8 ก็มี 8 GB ก็รันได้ งั้นก็รันโมเดลรุ่นตัดทอนไปครับ รันแล้วลุ้นเอาเองครับ ความจริง ผมเสนอให้แยก โมเดล ภาพจริง กับ การ์ตูน แยกกันครับ จะดีกว่า
แบบ
Pony v7 (Anime Base) และ Pony v7 (Realism Base)
แบบนี้ครับ เอาเถอะ รวมกันมันก็ดี สำหรับคนมีของแรงๆ แบบ RTX 5090 แต่นั้นไม่ใช่ผม
)
https://civitai.red/models/1901521/pony-v7-base
จากของเดิม v6 ไฟล์ base model แค่ 6.46 GB เอง
https://civitai.red/models/257749/pony-diffusion-v6-xl
ผมลองแล้ว RTX 3070 8GB ไหว ในภาพขนาด 1024x1024 + LoRA อีก 2-4 ตัว ได้อยู่
แต่ ต้องใช้คู่ iGPU UHD770 คือ ให้หน้าหลักแสดงผล ผ่าน UHD770 ทำให้เปิดเครื่องมา RTX 3070 ไม่มีภาระ ไม่งั้น เปิดเครื่องมา โดนไป 1GB แน่นอน ไปบวก กับ base model 6.46 GB กลายเป็น 7.5 GB /8.0 GB
ก็ดูไหวอยู่ แต่อาจจะใส่ LoRA ได้ 1 ตัว หรือไม่ได้เลย
และยังต้องมี
Text Encode
+
VAE
ด้วย ทำให้ ใหญ่ขึ้นไปอีก
แล้วถ้ามันมี VAE สองขนาด ถ้าเลือกอันเล็ก จะเละ ถ้าเลือกอันใหญ่ก็จะเปลือง VRAM อีก 200-300MB
แล้วไม่ได้รวมมาเป็นก้อนเหมือ v6
4. หน้าเละ
5.สไตล์ เละ
คือสไตล์ ถูกเปลี่ยนเป็น style_cluster แทน
6.การเขียน Prompt ต้องเรียง
<species> <gender> <name> from <source>
<สายพันธุ์> <เพศ> <ชื่อ> จาก <น่าจะหมายถึง อนิเมะเรื่อง ใส่ชื่อเมะ เข้าไป >
ห้ามสลับ ไม่งั้น เละ
7.ทีมเดฟเอา ภาพจริงมารวมด้วย ซึ่ง คนใช้ Pony เขาไม่อยากได้ภาพคนจริงๆ เขาอยากได้ pony ที่ทำภาพเป็น การ์ตูน แถมยัง ดันเพิ่มขนาด จาก 6GB เป็น 12 GB อีก
สรุป ตารางเปรียบเทียบ ระหว่างมุมมอง เดฟ กับ ผู้ใช้(ผม)
| ประเด็น | สิ่งที่ทีมเดฟตั้งใจแก้ (Dev's Goal) | ผลลัพธ์จริงจากการใช้งาน (User's Reality) |
| สถาปัตยกรรม | เปลี่ยนเป็น AuraFlow เพื่อให้ AI ฉลาดขึ้น | โมเดลกินสเปคจัด ช้าลง 5-7 เท่า และใช้ LoRA เก่าไม่ได้เลย |
| ขนาดไฟล์ / VRAM | ยัดข้อมูล 10M ภาพ ขยายเป็น 12.78 GB | กิน VRAM 14GB ดันการ์ดจอ 12GB ตกกระป๋อง ปิดทางยัด LoRA เพิ่ม |
| ระบบสไตล์ | ลบชื่อศิลปิน หนีกฎหมาย ใช้ style_cluster | สไตล์ภาพเละ ดึงเอกลักษณ์ลายเส้นเดิมไม่ได้ |
| Dataset | เพิ่มความสมจริง (Realism) ให้ทำได้หลากหลาย | ผู้ใช้สายการ์ตูนไม่ต้องการ ทำให้ไฟล์บวมฟรี |
| การเขียน Prompt | ใช้ประโยคภาษาธรรมชาติเล่าเรื่อง | ต้องท่องสูตรเรียงลำดับเป๊ะๆ ห้ามสลับ ไม่งั้นภาพเละ |
| รายละเอียดใบหน้า | เพิ่มการจดจำตัวละครใหม่ๆ | VAE ล้าสมัย และเทรนไม่พอ ทำให้หน้าและรายละเอียดเละ |
ความคิดเห็นผู้ใช้
สรุปโดยใช้ AI Gemini pro (ตัวอักษรสีม่วง)
จากการประมวลผลความคิดเห็นของผู้ใช้งานจริงบน Civitai ต่อ **Pony V7** ภาพรวมคือ **"ผิดหวังอย่างท่วมท้น (Overwhelmingly Negative)"** ครับ ผู้ใช้ส่วนใหญ่มองว่าเป็นการถอยหลังเข้าคลองเมื่อเทียบกับ V6
เพื่อให้เห็นภาพชัดเจน ผมได้แปลและจัดกลุ่มความคิดเห็นเหล่านั้นออกเป็น **6 หมวดหมู่หลัก** ดังนี้ครับ:
---
## 1. ด้านความเร็วและประสิทธิภาพ (ช้าเต่าคลาน และกินเครื่อง)
ผู้ใช้ส่วนใหญ่บ่นเรื่องความช้าอย่างรุนแรงเมื่อเทียบกับโมเดลอื่นในตลาด:
* **`ripemist14286` (สายวิเคราะห์):** ช้ากว่า Flux ถึง 2.5 เท่าที่สเปคเดียวกัน และถ้าเทียบกับ SDXL/V6 ในบาง Workflow มันช้ากว่าเดิม **7 เท่า ถึง 20 เท่า!** ต้องรอให้มีคนทำ Patch หรือ LoRA มาช่วยเร่งความเร็วก่อนถึงจะพอใช้งานจริงได้
* **`yawox22499972`:** "รันได้ห่วยแตกมาก"
* **`bloodforce88`:** "หวังว่าจะมีระบบเร่งความเร็วรองรับเร็วๆ นี้ ไม่ชินกับการต้องมานั่งรอนานๆ แล้ว"
---
## 2. คุณภาพงานภาพและการเขียน Prompt (เขียนยาก แต่รูปออกมาธรรมดา)
ผู้ใช้รู้สึกว่าระบบการเขียน Prompt แบบใหม่ไม่คุ้มค่ากับผลลัพธ์ที่ได้:
* **`notre1212`:** การเขียน Prompt ย้อนยุคกลับไปนั่งป้อนประโยคยาวๆ บรรยายทุกรายละเอียดมันรู้สึกเหนื่อยและไม่คุ้มเลย พอรูปออกมาก็แค่ระดับปานกลาง เหมือนนักเรียนศิลปะที่วาดรูปเป็นแค่จากการลอกตัวอย่าง
* **`XX0XX`:** ภาพออกมาดู "ไร้จิตวิญญาณ" เมื่อเทียบกับโมเดลยอดนิยมอื่นๆ ในปัจจุบัน
* **`BecauseNoOneElseWill`:** เป็นโมเดลฐานที่ห่วยที่สุดตัวหนึ่ง ภาพออกมาเหมือนขี้ตัวโหนด ขนาดชื่อโมเดลว่า PONY แต่กลับจำตัวละครจากเรื่อง MLP (My Little Pony) ไม่ได้เลยถ้าไม่ใส่ LoRA ช่วย
* **`Shio_N`:** "นี่มันก็แค่โมเดล AuraFlow ที่ถูกทำลายระบบหรือเปล่า? ดูไม่เหมือนโมเดลที่ถูกเทรนมาอย่างถูกต้องเลย"
---
## 3. ระบบนิเวศพังพินาศ และสแกม LoRA (ไม่มี LoRA และใช้กับซอฟต์แวร์เดิมไม่ได้)
ผู้ใช้พบปัญหาเรื่องการนำไปใช้งานร่วมกับเครื่องมืออื่น และมีประเด็นเรื่อง "LoRA ปลอม":
* **`_Varos_` (สายสืบ):** แฉว่าบนเว็บมี LoRA ของ V7 แค่ 18 ตัว และ **12 บัญชีจากทั้งหมด 15 บัญชีเป็นไอดีเพิ่งสร้างใหม่** เพื่อทำ LoRA มาโปรโมต V7 ให้ดูเหมือนมีคนสนใจ (เป็นการปั๊มยอดและหลอกลวงคอมมูนิตี้)
* **`jmkiii`, `VixenPic`, `jiayu_office202`:** บ่นตรงกันว่าเอาไปรันใน WebUI หรือ Stable Diffusion Forge แล้วขึ้นข้อความไม่รองรับโมเดล หรือได้ภาพเละๆ กลับมา
* **`CuauhtemocI5MAL`:** ติดปัญหาเรื่องการใช้ SimpleTuner เพื่อเทรน LoRA และแทบไม่มีใครทำ LoRA ของ V7 ออกมาเลย
---
## 4. ประเด็นเรื่องความโลภ การเซ็นเซอร์ และแอป "Fictional"
หลายคนมองว่าทีมพัฒนาเปลี่ยนอุดมการณ์ เน้นหาเงินและหนีกฎหมายจนทำลายเสน่ห์เดิม:
* **`LatteLeopard`:** รู้สึกเศร้าที่เห็นโครงการดีๆ ต้องพังลง V6 เคยสร้างแรงบันดาลใจให้คนทำ LoRA แต่ V7 เหมือนทำออกมาเพื่อหาเงิน เซ็นเซอร์ภาพหนักลบสไตล์นักวาดออกหมด แถมยังเอาแอป "Fictional" มายัดไส้โฆษณาอีก
* **`weedvee420`:** "ไม่ได้ออกโมเดลใหม่หรอก แค่เอาโมเดลเก่ามาลดสเปคแล้วแปะโฆษณาแอปไว้ข้างบนสุดก่อนบอกรายละเอียดซะอีก โคตรหิวเงิน"
* **`hestiacummings`:** "นี่คือสิ่งที่เกิดขึ้นเมื่อคุณไม่สนใจผู้ใช้อีกต่อไป และเห็นเงินสำคัญกว่าคุณภาพ"
---
## 5. การเปรียบเทียบกับ Pony V6 และคู่แข่งอย่าง Illustrious
คอมมูนิตี้มองว่าค่ายอื่นและเวอร์ชันเก่าทำได้ดีกว่ามาก:
* **`ronaldmikhailp236` / `SLACK69`:** ฟ้าไม่ได้ผ่าสองหน **Illustrious (ILXL)** ยังคงเป็นราชาครองเมืองอยู่ในปัจจุบัน และ V7 ไม่มีทางสู้ได้เลย
* **`Henkei` / `pixiv000001714`:** เสียเวลาพัฒนาไป 2 ปีเพื่อสิ่งนี้เนี่ยนะ? ความเย่อหยิ่งคือเส้นทางสู่ความล้มเหลว ขอให้โมเดลนี้เป็นตัวอย่างของ 'สิ่งที่ไมเควรทำ'
* **`Intosica`:** สรุปบทเรียนว่า "ถ้าของเดิมมันไม่ได้พัง ก็อย่าหาทำแก้เลย" V6 ถึงจะเก่าแต่ยังมีเสน่ห์และมีทรัพยากรจากคอมมูนิตี้ซัพพอร์ตมหาศาล แถมไม่ทำใหม์การ์ดจอระเบิดเหมือนโมเดลรุ่นใหม่ๆ
---
## 6. มุมมองคนที่เห็นต่าง / พยายามปรับตัว (เสียงส่วนน้อย)
มีผู้ใช้บางส่วนที่มองเห็นข้อดีและชี้ว่าคนส่วนใหญ่แค่ **"ยังใช้ไม่เป็น"**:
* **`him_dox` (สายปรับตัว):** การเรียนรู้โมเดลนี้ยากมาก แต่ถ้าจับจุดได้และตั้ง Workflow ดีๆ มันให้ภาพคุณภาพสูงและสม่ำเสมอมาก ปัญหาคือคนส่วนใหญ่ชินกับวิธีใช้ V6 พอเอาวิธีเดิมมาใช้กับ V7 แล้วไม่ได้ผลก็โวยวาย ตัวเขาใช้ Sampler แบบ `multistep/res_3m` แล้วได้ผลลัพธ์ที่ดีทั้งความเร็วและคุณภาพ
* **`iloveoldmen`:** สิ่งเดียวที่ชอบใน V7 คือการเจนสีที่สม่ำเสมอมาก เช่น ชุดนักเรียนประจำชาติวาดออกมาได้ตรงเป๊ะ
---
### 📝 สรุปสั้นๆ
ความคิดเห็นของคอมมูนิตี้สรุปได้ว่า **Pony V7 ถูกมองว่าเป็นความล้มเหลวครั้งใหญ่** เนื่องจากช้ากว่าเดิมหลายเท่า กินสเปค VRAM สูง ลบสไตล์นักวาดออกเพราะเรื่องลิขสิทธิ์ และใช้งานร่วมกับระบบเดิม (SDXL) ไม่ได้ ทำให้ผู้ใช้และนักสร้าง LoRA เกือบทั้งหมดเลือกที่จะอพยพไปใช้ **Illustrious (ILXL), NoobAI** หรือถอยกลับไปใช้ **Pony V6** ตามเดิมครับ
สรุปก็คือโมเดล V7 มีข้อจำกัด ทั้งด้านภาพ ที่ออกมาเน้น สไตล์สมจริง+Fury สมจริง ไม่ใช่สไตล์ การ์ตูน อีกต่อไป
และ ข้อจำกัด ด้าน ฮาร์ดแวร์ ครับ ที่แดก สเป็คเยอะกว่า เดิม มากมาย ครับ
และผมไม่ได้ถูกทุกเรื่อง ผิดก็เยอะ แต่นี้เป็นความเห็น จากการใช้งาน จริงครับ











