เจาะลึก Google Veo 3.1 Lite: วิธีสร้างวิดีโอ AI 1080p พร้อมเสียง ในราคาถูกลงกว่า 80%
สรุปวิธีใช้งาน Veo 3.1 Lite โมเดลสร้างวิดีโอ AI ตัวใหม่จาก Google ที่ให้คุณภาพระดับ 1080p พร้อมเสียง ในราคาที่ถูกกว่ารุ่นเดิมเกินครึ่ง

Google DeepMind ได้เปิดตัว Veo 3.1 Lite โมเดลสร้างวิดีโอ AI รุ่นประหยัดในตระกูล Veo ที่ช่วยลดต้นทุนการประมวลผลลงอย่างมาก ทำให้การสร้างวิดีโอความละเอียด 1080p พร้อมเสียงประกอบ (Audio) มีราคาเริ่มต้นเพียง $0.08 ต่อวินาที (ประมาณ 2 ถึง 3 บาทต่อวินาที)
จังหวะการเปิดตัวนี้น่าสนใจเป็นพิเศษ เพราะเกิดขึ้นในช่วงเดียวกับที่ OpenAI ชะลอการทำตลาดแอปพลิเคชันวิดีโอสำหรับผู้บริโภคทั่วไป ทำให้ Google ก้าวขึ้นมาเป็นตัวเลือกหลักสำหรับนักพัฒนาและครีเอเตอร์ที่ต้องการสร้างคอนเทนต์หรือแอนิเมชันสั้นในปริมาณมาก โดยที่ยังรักษาคุณภาพระดับสูงไว้ได้
บทความนี้สรุปวิธีใช้งานตั้งแต่การเตรียม API Key, การติดตั้ง SDK, โค้ดตัวอย่างภาษา Python และเทคนิคการเขียน Prompt สั่งงานให้ได้ผลลัพธ์คมชัดสมจริง
โครงสร้างราคา: เปรียบเทียบความคุ้มค่าของ Veo 3.1 Lite
ตระกูลโมเดล Veo แบ่งออกเป็น 3 ระดับตามการใช้งาน:
- Veo Standard ($0.40 ต่อวินาที): รองรับงานระดับมืออาชีพสูงสุด ความละเอียด 4K และการขยายคลิป (Video Extension)
- Veo Fast ($0.15 ต่อวินาที): เน้นความเร็วในการประมวลผลสำหรับงานเร่งด่วน
- Veo 3.1 Lite ($0.08 ต่อวินาที): เน้นความประหยัดสูงสุด ให้ความละเอียด 1080p พร้อมเสียงประกอบในตัว
เมื่อเปรียบเทียบการสร้างคลิปความยาว 8 วินาทีที่ความละเอียด 1080p:
- รุ่น Lite มีค่าใช้จ่าย $0.64 (ประมาณ 23 บาท)
- รุ่น Standard มีค่าใช้จ่าย $3.20 (ประมาณ 115 บาท)
ส่วนต่างราคาที่ลดลงกว่า 80% ช่วยให้นักพัฒนาสามารถนำไปสร้างบริการแบบสร้างวิดีโออัตโนมัติ (Automated Video Generation) หรือทำโฆษณาแบบ Dynamic Ads หลายสิบเวอร์ชันได้โดยไม่เกินงบประมาณ
ข้อกำหนดและสิ่งที่ต้องเตรียม
- Gemini API Key: สมัครรับ API Key จาก Google AI Studio โดยต้องเปิดใช้งานแพ็กเกจ Paid Tier (ชำระตามการใช้งานจริง) เนื่องจากโมเดลวิดีโอไม่มี Free Tier ให้บริการ
- สภาพแวดล้อม: ตัวอย่างในบทความนี้ใช้ภาษา Python 3.10 ขึ้นไป
- ข้อจำกัดของรุ่น Lite: ไม่รองรับความละเอียด 4K, ไม่รองรับการต่อความยาววิดีโอ (Video Extension) และไม่รองรับ Reference Images หลายรูปพร้อมกัน โดยมุ่งเน้นงานสร้างวิดีโอจากข้อความ (Text-to-Video) หรือจากรูปภาพตั้งต้น 1 รูป (Image-to-Video)
ขั้นตอนการติดตั้ง (Setup)
ติดตั้งแพ็กเกจ Google GenAI เวอร์ชันล่าสุดใน Terminal:
pip install google-genaiกำหนดค่า API Key ใน Environment Variable เพื่อความปลอดภัย:
export GEMINI_API_KEY='ใส่_api_key_ของคุณที่นี่'วิธีสร้างวิดีโอจากข้อความ (Text-to-Video)
การสั่งงานโมเดล Veo 3.1 Lite ต้องระบุ Model ID เป็น veo-3.1-lite-generate-preview ตัวอย่างโค้ด Python สำหรับสร้างวิดีโอ 1080p ความยาว 8 วินาที:
import time
from google import genai
from google.genai import types
# สร้าง Client โดยดึง API Key จาก Environment
client = genai.Client()
# สั่งสร้างวิดีโอ
operation = client.models.generate_videos(
model='veo-3.1-lite-generate-preview',
prompt='A cinematic aerial shot of a futuristic Bangkok at sunset, flying cars zooming between skyscrapers, neon lights starting to flicker on, 4k detail, highly realistic, synthwave aesthetic',
config=types.GenerateVideosConfig(
aspect_ratio='16:9',
resolution='1080p',
duration_seconds='8' # สำหรับ 1080p ต้องกำหนดเป็น 8 วินาที
),
)
# ตรวจสอบสถานะการทำงานแบบ Asynchronous
while not operation.done:
print('กำลังประมวลผลวิดีโอ... กรุณารอสักครู่')
time.sleep(10)
operation = client.operations.get(operation)
# เมื่อประมวลผลเสร็จสิ้น บันทึกไฟล์ลงเครื่อง
video = operation.response.generated_videos[0]
client.files.download(file=video.video)
video.video.save('bangkok_2077.mp4')
print('สร้างวิดีโอสำเร็จ บันทึกไฟล์ bangkok_2077.mp4 เรียบร้อย')เนื่องจากกระบวนการเรนเดอร์ทำงานแบบ Asynchronous ตัวโปรแกรมจะได้รับ Operation ID มาก่อน จากนั้นจึงใช้ลูป Polling เพื่อเช็กสถานะการประมวลผล ซึ่งโดยทั่วไปจะใช้เวลาประมาณ 10 วินาทีถึง 5 นาที ขึ้นอยู่กับความหนาแน่นของผู้ใช้บนระบบ
วิธีสร้างวิดีโอจากภาพนิ่ง (Image-to-Video)
โหมด Image-to-Video ช่วยให้คุณควบคุมองค์ประกอบภาพ ตัวละคร หรือสไตล์ศิลปะได้แม่นยำขึ้น โดยใช้ภาพตั้งต้นจาก Midjourney หรือภาพถ่ายจริง แล้วให้ Veo คำนวณการเคลื่อนไหวต่อเนื่อง
from google import genai
from google.genai import types
client = genai.Client()
# โหลดรูปภาพต้นฉบับ
image = types.Image.from_file('my_photo.jpg')
operation = client.models.generate_videos(
model='veo-3.1-lite-generate-preview',
prompt='Smooth camera pan to the right, gentle wind blowing through the hair, soft cinematic lighting',
image=image,
config=types.GenerateVideosConfig(
aspect_ratio='16:9',
resolution='720p', # รุ่น Lite รองรับความละเอียด 720p ด้วยเช่นกัน
),
)สำหรับโหมดนี้ แนะนำให้เน้น Prompt อธิบาย "การเคลื่อนไหวของกล้องและวัตถุ" เป็นหลัก เช่น ทิศทางการแพนกล้อง ความเร็ว หรือสภาพแสง เพราะรายละเอียดของวัตถุมีอยู่ในภาพต้นฉบับแล้ว
พารามิเตอร์สำคัญในการปรับแต่ง
- aspectRatio: กำหนด
16:9สำหรับงานแนวนอนทั่วไป หรือ9:16สำหรับวิดีโอแนวตั้งบน TikTok, Reels และ Shorts - resolution: เลือกได้ระหว่าง
720pและ1080p - personGeneration: สำหรับ Text-to-Video ตั้งค่าเป็น
allow_allส่วน Image-to-Video ในบางภูมิภาคอาจต้องกำหนดเป็นallow_adultเพื่อให้ประมวลผลได้ถูกต้อง - SynthID: วิดีโอทุกไฟล์ที่สร้างจาก Veo จะได้รับการฝังลายน้ำดิจิทัลแบบมองไม่เห็น (Digital Watermark) ของ Google เพื่อระบุที่มาว่าเป็นสื่อที่สร้างจาก AI
การแก้ปัญหาข้อผิดพลาดที่พบบ่อย (Common Errors)
- PUBLIC_ERROR_MINOR: มักเกิดจากความหนาแน่นชั่วคราวของเซิร์ฟเวอร์เรนเดอร์ แนะนำให้เว้นระยะ 5 ถึง 10 นาทีแล้วลองใหม่ หรือหลีกเลี่ยงช่วงเวลา Peak Hours ของสหรัฐฯ
- Safety Filter Blocks: เกิดจากคำใน Prompt ที่ระบบความปลอดภัยจัดเป็นคำกำกวม เช่น
shot,strike,fireหรือexecutionแนะนำให้ปรับไปใช้คำอธิบายภาพยนตร์ที่เฉพาะเจาะจงแทน เช่นcamera framingหรือcinematic take - 429 RESOURCE_EXHAUSTED: ส่งคำขอถี่เกินขีดจำกัด Rate Limit แนะนำให้ใช้กลยุทธ์ Exponential Backoff ในการ Retry คำสั่ง
โครงสร้าง Prompt เพื่อผลลัพธ์ระดับภาพยนตร์
การเขียนคำสั่งให้ Veo เข้าใจการเคลื่อนไหว ควรระบุองค์ประกอบ 3 ส่วนหลัก:
[แนวคิดหลักของฉาก] + [รายละเอียดบรรยากาศและแสง] + [ศัพท์เทคนิคการถ่ายภาพยนตร์]
ตัวอย่าง:
"A cinematic close-up shot of a ginger cat running through a field of lavender, slow motion, tracking shot, morning golden hour lighting, 24fps"
การใส่คีย์เวิร์ดอย่าง tracking shot, panning, aerial drone view หรือ slow motion ช่วยให้โมเดลเข้าใจทิศทางและการเคลื่อนที่ของมุมกล้องได้อย่างชัดเจน
สรุปภาพรวม
Veo 3.1 Lite เป็นตัวเลือกที่น่าสนใจสำหรับการนำ AI Video ไปประยุกต์ใช้งานจริงในเชิงพาณิชย์ ด้วยต้นทุนที่ลดลงอย่างมีนัยสำคัญ ควบคู่กับคุณภาพระดับ 1080p ที่มีระบบสร้างเสียงในตัว ช่วยให้นักพัฒนาและทีมงานครีเอทีฟสามารถสร้างระบบอัตโนมัติได้อย่างคุ้มค่า
สามารถทดลองใช้งานผ่าน Google AI Studio เพื่อทดสอบคุณภาพและเริ่มผสานเข้ากับเวิร์กโฟลว์ของโปรเจกต์คุณได้ทันที
แหล่งอ้างอิง
ชอบเรื่องแนวนี้ มีอีบุ๊คฟรีให้อ่านต่อ
Vibe Coding สำหรับคนไม่ใช่โปรแกรมเมอร์ ใช้ Claude Code สร้าง landing page, mini app และ prototype จริงโดยไม่ต้องเขียนโค้ด
กดสมัครแล้วเราจะส่งเทคนิค AI และของแจกใหม่ๆ ให้ทางอีเมล เลิกรับได้ตลอด
Vibecoding · The Developer's Playbook

ฉบับภาษาไทย 10 บท พา dev สร้าง Personal Finance Tracker (LINE OA + AI จัดหมวดอัตโนมัติ) ตั้งแต่โครงโปรเจกต์บรรทัดแรกจนแอปทำงานจริงบน server


