Gemini Omni: คู่แข่งวิดีโอ AI ตัวใหม่ของ Google ที่คนไทยเริ่มใช้ได้ 189 บาทต่อเดือน
หลัง OpenAI ปิดแอป Sora ไปเงียบ ๆ ตลาดวิดีโอ AI ก็ว่างอยู่ราวสามสัปดาห์ ก่อน Google จะเปิดตัว Gemini Omni ที่งาน I/O 2026 ซึ่งเป็นโมเดลที่ใส่ตัวเองลงในวิดีโออะไรก็ได้ และคนไทยเข้าถึงได้แล้วเริ่มที่ 189 บาทต่อเดือน บทความนี้สรุปว่ามันคืออะไร เทียบกับคู่แข่งยังไง และใช้งานจริงได้แค่ไหน
ปลายเดือนเมษายน 2026 เมื่อ OpenAI ตัดสินใจปิดบริการแอปและเว็บของ Sora สำหรับผู้ใช้งานทั่วไป ตลาดวิดีโอ AI จึงเกิดช่องว่างขึ้นราวสามสัปดาห์ ก่อนที่ Google จะอาศัยจังหวะนี้เปิดตัว Gemini Omni ในงาน Google I/O 2026 เมื่อวันที่ 19 พฤษภาคม โมเดลวิดีโอเจเนอเรชันใหม่ที่เปิดให้ผู้ใช้สร้างคลิปวิดีโอสั้นพร้อมเสียง และสามารถนำตนเองเข้าไปอยู่ในฉากต่างๆ ได้อย่างแนบเนียน ที่สำคัญคือผู้ใช้งานในไทยเข้าถึงได้ทันทีในราคาเริ่มต้น 189 บาทต่อเดือน พร้อมช่องทางใช้งานฟรีผ่านแพลตฟอร์มในเครือ
บทความนี้สรุปภาพรวมของ Gemini Omni เจาะลึกการเปรียบเทียบกับคู่แข่งอย่าง Sora, Veo และ Kling ตลอดจนแนวทางการเข้าถึงและข้อจำกัดที่ควรทราบในการนำไปใช้งานจริง
Gemini Omni คืออะไร และเหตุผลที่กลายเป็นจุดสนใจ
Gemini Omni คือโมเดล Multimodal เจเนอเรชันใหม่จาก Google ที่สร้างขึ้นภายใต้แนวคิด "สร้างสรรค์สื่อได้จากทุกรูปแบบข้อมูลนำเข้า" (Any-to-any generation) เริ่มต้นจากการสร้างวิดีโอ โดยเวอร์ชันแรกที่เปิดให้ใช้งานคือ Gemini Omni Flash รองรับอินพุตทั้งข้อความ รูปภาพ เสียง และคลิปวิดีโอ เพื่อสร้างคลิปสั้นความยาวประมาณ 10 วินาทีพร้อมเสียงประกอบในตัวอย่างสมบูรณ์ อ้างอิงตามประกาศของ Google
เพดานความยาว 10 วินาทีต่อคลิปไม่ใช่ข้อจำกัดด้านศักยภาพของโมเดล แต่เป็นเกณฑ์ที่ Google กำหนดไว้เพื่อรองรับการขยายฐานผู้ใช้ในวงกว้างได้อย่างมีเสถียรภาพ ตามที่ Nicole Brichtova หัวหน้าฝ่ายผลิตภัณฑ์ระบุไว้ใน TechCrunch ขณะที่ Sundar Pichai ซีอีโอของ Google ชี้ให้เห็นว่า AI กำลังเปลี่ยนผ่านจากการทำนายข้อความไปสู่การสร้างแบบจำลองโลกจริง (World Simulator) ทำให้ Omni เป็นหมุดหมายสำคัญในการจำลองการเคลื่อนไหวและฟิสิกส์ในโลกเสมือน
ความสามารถสำคัญ 3 ด้านที่ทำให้ Omni แตกต่างจากเครื่องมืออื่น:
- รองรับ Audio Input: สามารถรับไฟล์เสียงพูดเข้ามาเป็นบริบทตั้งต้นในการสร้างและควบคุมทิศทางของคลิป
- แก้ไขวิดีโอผ่านการสนทนาต่อเนื่อง (Conversational Editing): จดจำสถานะเดิมของคลิป ทำให้สั่งปรับเปลี่ยนเฉพาะจุดได้ เช่น สั่งเปลี่ยนสีเสื้อผ้าหรือสภาพอากาศ โดยไม่ทำให้องค์ประกอบอื่นเสียหาย
- เชื่อมโยงข้อมูลจริงผ่าน Search Grounding: ดึงฐานข้อมูลของ Gemini และ Google Search มาช่วยจำลองสถานที่จริงและข้อเท็จจริงได้อย่างแม่นยำ
จังหวะการเปิดตัวถือว่าลงตัวอย่างยิ่ง หลังจาก OpenAI ประกาศปิดเว็บและแอป Sora ฝั่งผู้ใช้ทั่วไปเมื่อวันที่ 26 เมษายน 2026 (คงเหลือไว้เฉพาะการเข้าถึงผ่าน API จนถึงปลายกันยายน 2026) เนื่องจากต้นทุนการประมวลผลที่สูงมาก การมาของ Gemini Omni จึงเข้ามาตอบรับความต้องการของตลาดคอนเทนต์ครีเอเตอร์ได้ทันท่วงที
ฟีเจอร์ Avatar: สร้างคลิปด้วยใบหน้าและเสียงของตัวเอง
ฟีเจอร์เด่นที่ดึงดูดความสนใจคือระบบ Avatar ที่ให้ผู้ใช้สร้างตัวละครดิจิทัลของตนเอง โดยเริ่มต้นบันทึกใบหน้าและเสียงผ่านกล้องและไมโครโฟนบนสมาร์ตโฟนผ่านแอป Gemini ซึ่งมีขั้นตอนคล้ายฟีเจอร์ Cameos ของ Sora ตามรายงานของ TechTimes เมื่อบันทึกเสร็จ ผู้ใช้สามารถสั่งให้ Avatar ของตนเองไปปรากฏในสถานการณ์ต่างๆ ได้อย่างอิสระ เช่น การสวมบทบาทบรรยายบนเวที การร่วมงานอีเวนต์ระดับนานาชาติ หรือการร่วมคลิปแนวสนุกสนาน
Google มองการใช้งานรูปแบบนี้เป็น "Personalized Memes" เพื่อเปิดพื้นที่สร้างสรรค์คอนเทนต์เฉพาะบุคคล อย่างไรก็ตาม เพื่อป้องกันความเสี่ยงด้าน Deepfake และการนำอัตลักษณ์ของผู้อื่นไปใช้ในทางมิชอบ Google จึงวางมาตรการความปลอดภัยไว้หลายระดับ:
- ฝังลายน้ำ SynthID ในทุกไฟล์: ฝังข้อมูลลายน้ำดิจิทัลที่มองไม่เห็นด้วยตาเปล่าในโครงสร้างไฟล์ เพื่อให้เครื่องมือของ Google ตรวจสอบที่มาได้เสมอว่าสร้างขึ้นด้วย AI
- ยืนยันตัวตนด้วยคำสั่งเสียง: บังคับให้ผู้ใช้อ่านชุดตัวเลขที่สุ่มขึ้นระหว่างการบันทึก Avatar เพื่อยืนยันว่ามีตัวตนอยู่จริง
- ระงับฟังก์ชันดัดแปลงฟุตเทจบุคคลอื่น: ยังไม่อนุญาตให้สลับใบหน้าหรือเสียงลงบนฟุตเทจวิดีโอภายนอกที่มีอยู่เดิม เพื่อลดความเสี่ยงจากการปลอมแปลงข้อมูล
เปรียบเทียบสมรรถนะ: Omni, Sora, Veo และ Kling
การแข่งขันในตลาดวิดีโอ AI ปี 2026 ไม่ได้วัดกันเพียงความสวยงามของภาพ แต่วัดจากความคุ้มค่าและความเหมาะสมกับ Use Case เฉพาะด้าน:
| มิติการเปรียบเทียบ | Gemini Omni Flash | Sora 2 (OpenAI) | Veo 3.1 (Google) | Kling (Kuaishou) |
|---|---|---|---|---|
| ความยาวคลิปต่อรอบ | ประมาณ 10 วินาที | ประมาณ 15 ถึง 25 วินาที | 8 วินาที (ต่อช็อตได้) | คลิปสั้น 5 ถึง 10 วินาที |
| ความละเอียดภาพ | ประมาณ 720p ถึง 1080p | 720p ถึง 1080p | 1080p ถึง 4K ระดับสตูดิโอ | 720p ถึง 1080p |
| การรองรับ Audio Input | รองรับ (ฟีเจอร์เด่น) | ไม่รองรับ | ไม่รองรับ | ไม่รองรับ |
| รูปแบบลายน้ำ | SynthID (ไม่บดบังภาพ) | ลายน้ำข้อความมุมจอ | SynthID (ไม่บดบังภาพ) | ลายน้ำตามแพ็กเกจ |
| รูปแบบการเข้าถึง | แอป Gemini และ Shorts | เหลือเฉพาะนักพัฒนาผ่าน API | Vertex AI และ Workspace | หน้าเว็บและแพ็กเกจราคาประหยัด |
| กลุ่มผู้ใช้ที่เหมาะสม | ครีเอเตอร์และงานโซเชียล | นักพัฒนาแอปพลิเคชัน | โปรดักชันองค์กรและงาน 4K | ผู้ทดลองใช้งานทั่วไป |
Omni โดดเด่นเป็นพิเศษในแง่การสนทนาเพื่อปรับแก้คลิปและการรับเสียงนำเข้า ขณะที่ Veo 3.1 ยังคงเป็นตัวเลือกหลักสำหรับงานโปรดักชันภาพยนตร์และงานนำเสนอขององค์กรที่ต้องการความคมชัดระดับ 4K บน Vertex AI
ช่องทางการใช้งานและแพ็กเกจราคาในประเทศไทย
ผู้ใช้งานในไทยสามารถเข้าถึง Gemini Omni ได้ผ่านหลายช่องทาง:
- ใช้งานฟรีผ่าน YouTube Shorts และ Google Create: ช่องทางเริ่มต้นสำหรับครีเอเตอร์ที่ต้องการสร้างคลิปสั้นลงแพลตฟอร์มวิดีโอ
- แพ็กเกจ Google AI Plus: ราคาปกติ 189 บาทต่อเดือน (มีโปรโมชันช่วงเปิดตัวในราคาพิเศษ) สำหรับผู้ใช้งานที่ต้องการสร้าง Avatar และใช้งานฟังก์ชันสร้างคลิปได้อย่างคล่องตัว
- แพ็กเกจ Google AI Pro: ราคา 750 บาทต่อเดือน สำหรับผู้ที่ต้องการโควตาและความเร็วในการประมวลผลระดับสูง
- สิทธิ์ใช้งานฟรีสำหรับนักศึกษาไทย: โครงการความร่วมมือที่มอบสิทธิ์ Google AI Pro ให้นักศึกษาในสถาบันการศึกษาไทยใช้งานฟรีเป็นเวลา 1 ปี
ศักยภาพการนำไปใช้จริงและข้อจำกัดที่ควรทราบ
สำหรับงานครีเอทีฟและการตลาด Gemini Omni ช่วยให้สร้างสื่อโปรโมตสินค้า คลิปแนะนำบริการ หรือการทำ Video Montage สรุปกิจกรรมได้อย่างรวดเร็วโดยไม่ต้องใช้อุปกรณ์ถ่ายทำระดับมืออาชีพ สามารถสั่งให้โมเดลเพิ่มเติมหรือปรับเปลี่ยนวัตถุในฉากหลังได้อย่างกลมกลืน
อย่างไรก็ตาม ยังมีข้อจำกัดทางเทคนิคที่ควรคำนึงถึง:
- ความยาวต่อคลิปจำกัดอยู่ที่ประมาณ 10 วินาที จึงเหมาะกับคอนเทนต์แบบ Short-form เป็นหลัก
- ความต่อเนื่องของมุมกล้องในฉากที่มีความซับซ้อนสูงอาจมีจังหวะสะดุดเล็กน้อย
- การนำคลิปต้นฉบับภายนอกมาเป็นเฟรมเริ่มต้นยังต้องการการพัฒนาเพิ่มเติม
- ทุกคลิปจะมีการฝังลายน้ำ SynthID จึงเหมาะกับงานที่เปิดเผยการใช้ AI อย่างโปร่งใส
สรุปภาพรวม
Gemini Omni เข้ามาเติมเต็มตลาดวิดีโอ AI ได้อย่างน่าสนใจ ด้วยจุดเด่นด้านการสั่งงานด้วยเสียง การปรับแก้คลิปผ่านการพิมพ์คุยต่อเนื่อง และโครงสร้างราคาที่คนไทยจับต้องได้ง่าย เริ่มต้นเพียง 189 บาทต่อเดือน หรือใช้งานฟรีสำหรับนักศึกษา เหมาะสำหรับครีเอเตอร์และธุรกิจที่ต้องการทดลองสร้างคอนเทนต์วิดีโอสั้นลงโซเชียลมีเดียได้อย่างรวดเร็วและคุ้มค่า
ชอบเรื่องแนวนี้ มีอีบุ๊คฟรีให้อ่านต่อ
ChatGPT Work ฉบับเข้าใจง่าย มอบงานให้ AI ทำจนจบ ตั้งแต่งานแรกจนถึงงานอัตโนมัติ พร้อม workflow ใช้ได้จริง 8 แบบ
กดสมัครแล้วเราจะส่งเทคนิค AI และของแจกใหม่ๆ ให้ทางอีเมล เลิกรับได้ตลอด
Claude Cowork · The Business Playbook

ฉบับภาษาไทย 15 บท เรียนรู้ผ่านโปรเจกต์จำลองต่อเนื่องทั้งเล่ม ตั้งแต่ตั้งค่า Workspace จัดการไฟล์ เชื่อมแอป ตั้งระบบอัตโนมัติ จนถึงสร้าง Plugin


