จ่ายรายปีได้เครดิตต่อเดือนเท่าเดิม แต่ถูกลงราว 30%

ดูแพ็กเกจ

GPT Image 2.5 รีวิวและทดสอบ

GPT Image 2.5 รีวิวและทดสอบ

ผมให้ GPT Image 2.5 รับงานจริงตลอดหนึ่งสัปดาห์ ไม่ใช่พรอมป์ตสาธิตสวยๆ นาฬิกาที่ต้องอ่านเวลาได้ตรงตามที่สั่ง แก้วไวน์ที่ต้องเติมจนเต็มปริ่ม ฝูงชนที่แถวหลังต้องไม่ละลายเป็นก้อน ส่วนใหญ่ออกมาถูกต้อง มีอยู่รอบหนึ่งที่ได้นาฬิกามาสองเรือน

ทุกภาพเบื้องหลังบทความนี้ผมสร้างเองทั้งหมดในแผง gpt image 2.5 บนเว็บไซต์นี้ และราคาเครดิตที่ยกมาก็อ่านจากหน้าจอเดียวกันนั้น

TL;DR GPT Image 2.5 คือรุ่นต่อจาก GPT Image 2 ของ OpenAI มาในสองเวอร์ชัน Flare เน้นความเร็ว Sunburst เน้นเฟรมหนักๆ จุดเด่นที่สุดคือการทำตามคำสั่งแบบตรงตัว จุดพลาดที่สุดคือคำสั่งที่ซ้อนกันหลายชั้น การรัน GPT Image 2.5 ที่นี่คิด 6 เครดิตที่ 1K, 10 เครดิตที่ 2K และ 16 เครดิตที่ 4K และการรองรับ 4K แบบเนทีฟแปลว่าไม่ต้องมีขั้นตอนอัปสเกลตามหลัง

Flare, Sunburst และตัวที่คุณจะได้จริง

OpenAI ส่ง GPT Image 2.5 ออกมาเป็นสองเวอร์ชัน Flare เบากว่าและไวกว่า ส่วน Sunburst คือพี่ใหญ่สายหนัก เหมาะกับงานที่ผลลัพธ์สำคัญกว่าเวลาที่ต้องรอ ส่วนที่ว่า GPT Image 2.5 เวอร์ชันไหนตอบอยู่ใน ChatGPT และ Codex นั้นไม่มีเอกสารระบุไว้ แต่ดูจากพฤติกรรมของผลลัพธ์แล้วผมเดาว่าเป็น Flare

ที่นี่เลือกได้ชัดเจน Flare คือเวอร์ชัน GPT Image 2.5 ที่ได้เป็นค่าเริ่มต้นตอนเปิดแผง Flare ส่วน Sunburst รออยู่ห่างไปแค่คลิกเดียวและมีหน้าของตัวเองเผื่อใครอยากเริ่มจากตัวหนักเลย ส่วนภาพรวมของ 2.5ไล่ให้ดูว่า GPT Image 2.5 แต่ละเวอร์ชันรับงานแบบไหนได้บ้าง

ผมส่งพรอมป์ตชุดเดียวกันหกอันเข้าทั้งสองเวอร์ชัน การแบ่งแบบนี้สะท้อนการแบ่งงานของ OpenAI เอง Flare ไว้ยิงรอบไวๆ Sunburst ไว้กับเฟรมที่คุณไม่อยากให้เร่ง การเลือกเวอร์ชัน GPT Image 2.5 จึงเป็นคำถามเรื่องโจทย์ล้วนๆ เพราะค่าใช้จ่ายเท่ากันทั้งคู่

เวอร์ชันเหมาะกับงานแบบไหน1K2K4K
Flareงานร่าง งานปรับซ้ำ พรอมป์ตทั่วไป6 เครดิต10 เครดิต16 เครดิต
Sunburstฉากคนแน่น เฟรมตัวจริง6 เครดิต10 เครดิต16 เครดิต

หมายเหตุสั้นๆ เรื่องเครดิต: ขนาดมีแค่ 1K, 2K และ 4K ไม่มีอะไรคั่นกลาง และการรัน GPT Image 2.5 ที่ล้มเหลวจะคืนเครดิตให้อัตโนมัติ เครดิตเริ่มต้นแจกฟรี จากนั้นจะต่อด้วยแพ็กเกจรายเดือนหรือแพ็กจ่ายครั้งเดียวในหน้าราคาเพื่อให้ GPT Image 2.5 ทำงานต่อได้ ทุกแพ็กเกจไม่มีลายน้ำ

สอง GPT Image 2.5 ในกล่องเดียว

ลองพรอมป์ตเดียวกันกับทั้ง Flare และ Sunburst ได้โดยไม่ต้องออกจากหน้านี้

เปิด GPT Image 2.5

gpt image 2.5

บททดสอบความตรงตัว

สั่งโมเดลดิฟฟิวชันให้วาดนาฬิกาที่บอกเวลา 5:15 แล้วคุณจะได้ 10:10 กลับมา สั่งให้รินไวน์จนเต็มปากแก้วก็จะได้แก้วที่รินอย่างสุภาพราวกับมีซอมเมอลิเยร์ยืนมองอยู่ โมเดลพวกนั้นเฉลี่ยจากหน้าตาที่ภาพแบบนั้นมักจะเป็น แต่ GPT Image 2.5 ไม่ทำแบบนั้น ผมสั่ง 5:15 เข็มก็ไปหยุดที่ 5:15 แก้วที่สั่งให้เติมก็กลับมาเต็ม

สิ่งที่ GPT Image 2.5 ทำกับตัวเลขที่ระบุไว้คือมองว่ามันเป็นตัวเลขจริงๆ ไม่ว่าจะเป็นเวลา จำนวน หรือระดับความเต็ม ตอนนี้โจทย์ไหนที่มีตัวเลขอยู่ในนั้น ผมส่งเข้า GPT Image 2.5 ก่อนเสมอ

ระยะที่ขยับขึ้นจาก GPT Image 1 นั้นแคบกว่าที่เลขเวอร์ชันชวนให้คิด เพราะสิ่งที่ GPT Image 2.5 ทำได้ดีขึ้นคือการแก้ภาพผ่านบทสนทนาและระดับนอยส์พื้น มากกว่าความคมชัดดิบๆ

ความเชื่อฟังก็แลกมาด้วยรสนิยมของ GPT Image 2.5 อยู่บ้าง ผลลัพธ์ดิบจาก GPT Image 2.5 อาจดูจืดเมื่อวางข้าง Midjourney ซึ่งยังเป็นเครื่องมือที่ดีกว่าเมื่อโจทย์คืออารมณ์

gpt image 2.5
ทุกการรัน GPT Image 2.5 จะเริ่มที่ Flare เสมอ เว้นแต่คุณจะเลื่อนตัวเลือกไปที่ Sunburst

จุดที่ GPT Image 2.5 ยังพังอยู่

พอซ้อนคำสั่งสี่ชั้นเมื่อไหร่ รอยต่อของ GPT Image 2.5 ก็โผล่ บททดสอบของผมคือนกกระทุงขี่จักรยานตอน 5:15 พร้อมถือแก้วไวน์ สิ่งที่ได้กลับมาคือนาฬิกาเข็มที่บอกเวลาถูกต้อง บวกนาฬิกาดิจิทัลอีกเรือนที่ไม่มีใครเรียก และขาที่ยืดเรียวแบบฟลามิงโกเพื่อเอื้อมไปถึงบันไดปั่นที่ดันไปกองอยู่ฝั่งเดียวกันทั้งคู่

ความตรงตัวของ GPT Image 2.5 ทำงานเป็นรายคำสั่ง ไม่ใช่รายฉาก ทุกอนุประโยคได้รับการตอบสนองครบ แต่ไม่มีอะไรใน GPT Image 2.5 ที่สังเกตว่าการทำครบทุกข้อพร้อมกันให้กายวิภาคที่เป็นไปไม่ได้ ถ้ามีเงื่อนไขหนักๆ สี่ข้อ แปลว่าต้องแบ่งงานออกเป็นสองรอบของ GPT Image 2.5

เกรนลดลง และอาการเหมือนแปะทับบนวัตถุหน้าฉากก็เบาลงแม้จะยังไม่หายสนิท ส่วนที่ดีขึ้นชัดที่สุดคือฝูงชน ตัวประกอบด้านหลังที่เมื่อก่อนมักมาพร้อมแขนขาเกินและใบหน้าเละๆ ตอนนี้อ่านออกเป็นคนที่อยู่นอกโฟกัสได้อย่างสมเหตุสมผล ซึ่งทำให้งานที่ผมกล้าส่งให้ GPT Image 2.5 กว้างขึ้น

ความละเอียดคือความต่างที่จับต้องได้

ผลลัพธ์เนทีฟของ GPT Image 2.5 ใน ChatGPT และ Codex วัดได้ราว 1672x941 ซึ่งต่ำกว่า 1080p งานโปรดักชันที่นั่นจึงต้องเริ่มด้วยการอัปสเกลหนึ่งรอบ

ที่นี่โมเดลตัวเดียวกันรันที่ 4K แบบเนทีฟในราคา 16 เครดิต และไม่ต้องมีขั้นตอนอัปสเกล นี่คือทั้งหมดที่กล้าเคลมและผมจะไม่ขยายไปกว่านี้ พิกเซลออกจาก GPT Image 2.5 ที่ขนาดที่คุณเลือกไว้ การรัน gpt image 2.5 ที่ 2K คิด 10 เครดิต และครอบคลุมงานเว็บเกือบทั้งหมดแล้ว

ผลลัพธ์ลงใน My Creations ในขนาดเต็ม ไฟล์ GPT Image 2.5 ระดับ 4K ที่คุณจ่ายไปจึงเป็นไฟล์ที่ได้กลับมาจริงๆ ขนาดทั้งสามแบบนี้แสดงอยู่ในหน้ารวมtext to imageเหมือนกัน

มีเรื่องหนึ่งที่ควรรู้ก่อนเปิดแผงนี้ มันทำได้แค่ text to image เท่านั้น ไม่มีช่องใส่ภาพอ้างอิง ทุกการรัน GPT Image 2.5 เริ่มจากกล่องเปล่า ผมเสียเวลาไปยี่สิบนาทีกว่าจะรู้ และงานที่พยายามทำอยู่ตอนนั้นก็ควรไปอยู่ที่image to imageตั้งแต่แรก

Sunburst สำหรับเฟรมที่เรียกร้องสูง

เวอร์ชันหนักของ GPT Image 2.5 อยู่ในตัวเลือกเดียวกัน ห่างจาก Flare แค่คลิกเดียวและราคาเท่ากัน

ลอง Sunburst

gpt image 2.5

สิ่งที่ Astra เติมเข้ามาจากฝั่ง OpenAI

เมื่อจับคู่กับระบบให้เหตุผล Astra ของ OpenAI แล้ว GPT Image 2.5 ทำได้มากกว่าที่กล่องพรอมป์ตเปิดทางให้ เริ่มจากการแก้ภาพที่ผ่านการค้นข้อมูลมาก่อนลงมือ ภาพอ้างอิงใบเดียวให้กริดสี่มุมที่สะอาดออกมา และ GPT Image 2.5 คุมอัตลักษณ์ของตัวละครตลอดทั้งกริดได้ดีกว่า Nano Banana 2 หรือ Nano Banana Pro ส่วนการถ่ายทอดสไตล์ก็ไปไกลกว่าแค่อารมณ์ ถึงขั้นจับเกรดสีของหนังที่ระบุชื่อได้

จังหวะที่ติดใจกลับเป็นเรื่องเล็กกว่านั้น ผลลัพธ์ใบหนึ่งตัดเท้าของตัวแบบหายไป แล้ว GPT Image 2.5 จัดเฟรมใหม่ให้เองโดยไม่ต้องสั่ง

Astra ไม่ได้อยู่ในแผงสร้างภาพธรรมดา รวมถึงแผงนี้ด้วย สิ่งที่ติดมาคือตัวโมเดล GPT Image 2.5 สายตรงตัวที่อยู่ข้างใต้

GPT Image 2.5 ยืนอยู่ตรงไหนเมื่อเทียบกับเพื่อนบ้าน

ในตัวเลือกเดียวกันมีอีกสี่โมเดลที่ขอบเขตงานทับกับ GPT Image 2.5 สิ่งที่จะเล่าต่อไปนี้คือผลที่ได้จากการใช้งานจริงตลอดหนึ่งสัปดาห์ตามโจทย์ของผมเอง ไม่ใช่การวัดผลเชิงเบนช์มาร์ก และแต่ละตัวต่างมีจุดที่ทำได้ดีกว่า GPT Image 2.5

โมเดลจุดแข็งที่สุดจุดอ่อนเหมาะกับใคร
GPT Image 2.5คำสั่งตรงตัว จำนวนเป๊ะพรอมต์สี่เงื่อนไข งานดิบยังขาดความเนี้ยบคนที่มีสเปก ไม่ใช่มีอารมณ์
Nano Banana Proซับเจกต์สะอาดตา ปรับซ้ำได้ไวคุมหน้าตัวละครข้ามสี่มุมได้ด้อยกว่างานปริมาณมาก โจทย์ไม่ซับซ้อน
Midjourneyลุคและอารมณ์ภาพตั้งแต่ช็อตแรกเถียงกับรายละเอียดที่สั่งตรงตัวมู้ดบอร์ด ปก โปสเตอร์
Ideogramตัวอักษรในภาพขอบเขตงานด้านอื่นแคบกว่าป้าย แพ็กเกจจิ้ง งานล็อกอัพ
Seedream 5 Proการจัดองค์ประกอบเชิงสไตล์หละหลวมเรื่องจำนวนภาพประกอบบทความและงานคอนเซปต์

อย่าเพิ่งเชื่อโจทย์ของผม ลองโจทย์ของคุณเองดีกว่า ทดสอบ GPT Image 2.5 ที่ 1K ด้วย 6 เครดิตก็รู้ผลแล้ว ส่วนโมเดลที่เหลือในแคตตาล็อกก็อยู่ห่างออกไปแค่คลิกเดียวในเวิร์กสเปซเดียวกัน

เมื่อไหร่ที่ GPT Image 2.5 ไม่ใช่ตัวเลือกที่ใช่

สัปดาห์นั้นมีสามครั้งที่ผมควรจะเปิดโมเดลอื่นมากกว่า

งานที่เน้นความสวยล้วนๆ เมื่อโจทย์คือความรู้สึกและไม่มีใครมานั่งนับอะไร Midjourney ยังให้ภาพที่ดูดีกว่าตั้งแต่ยังไม่แต่ง ขณะที่ GPT Image 2.5 เรนเดอร์ตามคำบรรยายอย่างซื่อสัตย์ แล้วทิ้งให้คุณโหยหาบรรยากาศที่หายไป

งานที่เริ่มจากภาพอ้างอิง แผงนี้รองรับเฉพาะ text to image งานแบบนั้นจึงต้องไปที่ image to image หรือถ้าแค่ต้องการตัดภาพออกมา ก็ใช้ เครื่องมือลบพื้นหลัง กับ เครื่องมือลบวัตถุ ที่ใช้ได้ฟรี

การร่างงานหยาบทีละมากๆ ทำภาพย่อสี่สิบใบที่ใบละ 6 เครดิตถือว่าไม่คุ้ม ผมจึงใช้โมเดลที่ถูกกว่าคัดจนเหลือไม่กี่ตัวเลือก แล้วส่งเฉพาะตัวที่ชนะไปให้ GPT Image 2.5 ทำที่ 4K

บทสรุปหลังใช้งานหนึ่งสัปดาห์

ผมกลับมาใช้ซ้ำเพราะ GPT Image 2.5 ทำตามที่ผมบอก ซึ่งฟังดูเป็นมาตรฐานที่ต่ำเตี้ย จนกว่าคุณจะเคยเถียงกับโมเดลที่ไม่ยอมทำตาม ความแบนของภาพเป็นเรื่องจริง ปัญหาพรอมต์ซ้อนหลายชั้นก็เป็นเรื่องจริง แต่ไม่มีข้อไหนขวางไม่ให้ GPT Image 2.5 กลายเป็นตัวเลือกแรกของผมสำหรับงานที่มีตัวเลขเข้ามาเกี่ยวข้อง

ถ้าอยากทดสอบจริงจัง ข้ามพรอมต์สวยๆ ไปเลย ลองเขียนสี่สิ่งที่ต้องปรากฏจริงในภาพ แล้วสั่ง gpt image 2.5 ที่ 1K จากนั้นค่อยนับว่าเหลือรอดกี่ข้อ

Flare กับ Sunburst ต่างกันอย่างไร

Flare เบากว่าและเปิดขึ้นมาเป็นค่าเริ่มต้น ส่วน Sunburst เป็นรุ่นหนักสำหรับฉากที่เรียกร้องสูง ทั้งสองเวอร์ชันของ GPT Image 2.5 ราคาเท่ากัน คือ 6 เครดิตที่ 1K, 10 ที่ 2K และ 16 ที่ 4K

เวอร์ชันไหนที่อยู่เบื้องหลัง ChatGPT และ Codex

OpenAI ไม่ได้ระบุไว้ ผลการทดสอบชี้ไปที่ Flare แต่ขอให้ถือว่าเป็นการเดาบนพื้นฐานประสบการณ์เกี่ยวกับ GPT Image 2.5 ไม่ใช่ข้อเท็จจริง

ต้องอัปสเกลเพิ่มอีกขั้นไหม

ที่นี่ไม่ต้อง ภาพจาก ChatGPT และ Codex อยู่ที่ราวๆ 1672x941 ซึ่งต่ำกว่า 1080p ส่วน GPT Image 2.5 บนเว็บนี้เรนเดอร์ที่ 4K แบบเนทีฟในราคา 16 เครดิต

อัปโหลดภาพอ้างอิงได้ไหม

ไม่ได้ ทุกครั้งที่สั่ง GPT Image 2.5 จะเริ่มจากกล่องเปล่าเสมอ งานที่ต้องใช้ภาพอ้างอิงอยู่ที่ image to image ซึ่งมี Flux 2, Ideogram V3 Reframe และ Nano Banana Edit เพิ่มเข้ามาด้วย

ถ้าสั่งงานแล้วล้มเหลวจะเป็นอย่างไร

เครดิตจะคืนให้อัตโนมัติ ไฟล์ GPT Image 2.5 ที่เสร็จแล้วจะได้ขนาดเต็มโดยไม่มีลายน้ำ ส่วนแพ็กเกจรายเดือนหรือแพ็กแบบจ่ายครั้งเดียวดูได้ที่หน้าราคา

ดีกว่า GPT Image 1 ไหม

ดีกว่าในเรื่องการแก้ภาพผ่านบทสนทนา และสัญญาณรบกวนพื้นฐานสะอาดขึ้น แต่คุณภาพดิบไม่ได้ก้าวกระโดด สิ่งที่เปลี่ยนทั้งสัปดาห์ของผมคือความสม่ำเสมอที่ GPT Image 2.5 ทำตามคำสั่งแบบตรงตัว

aiimage.com ไม่มีความเกี่ยวข้องใดๆ กับ OpenAI ชื่อโมเดลทั้งหมดรวมถึง GPT Image 2.5 เป็นของเจ้าของแบรนด์นั้นๆ ค่าเครดิตและขนาดภาพที่ระบุไว้ที่นี่อ้างอิงจากสิ่งที่เปิดใช้งานจริงบน aiimage.com ในช่วงที่ทดสอบ และอาจเปลี่ยนแปลงได้