🎬 Google ทำให้ Gemini Omni Flash ขยับจาก Preview เป็น GA พร้…
🎬 Google ทำให้ Gemini Omni Flash ขยับจาก Preview เป็น GA พร้อมโจทย์สำคัญกว่าแค่ “สร้างวิดีโอได้” — ตอนนี้นักพัฒนาคุมการต่อ การเชื่อม และความละเอียดของวิดีโอได้เป็นระบบมากขึ้น
Gemini Omni Flash (gemini-omni-1.1-flash) เป็น multimodal model สำหรับสร้างและแก้ไขวิดีโอแบบ conversational ผ่าน Interactions API โดยรับ Text, Image และ Video เป็น input และคืนผลเป็น Video
สิ่งที่เพิ่มในรุ่น GA:
• Video extension: ต่อวิดีโอเดิมด้วยการสร้างช่วงต่อเนื่องท้ายคลิปผ่าน extend หรือ prompt โดยตรง
• Interpolation: ใช้ภาพต้นทางและภาพปลายทางได้สูงสุด 2 ภาพ เพื่อสร้างวิดีโอเชื่อมระหว่างเฟรมผ่าน image_to_video
• Resolution control: เลือก 360p, 720p, 1080p หรือ 4K ผ่าน video_config; 1080p และ 4K ใช้ upscaling
• Conversational editing: สั่งแก้ไขด้วยภาษาธรรมชาติ และคงส่วนที่ต้องการเก็บไว้ใน workflow เดิม
มุมที่ควรอ่านให้ออกคือ “การควบคุม” ไม่ใช่เพียงคุณภาพภาพ ตัวระบบเปิดทางให้ workflow แยกเป็นขั้น: สร้าง draft → ต่อ shot → เชื่อม first/last frame → เลือก output resolution ซึ่งเหมาะกับการทำ prototype, product demo และ short-form content ที่ต้อง iterate หลายรอบ
ข้อจำกัดที่ต้องวางแผน: โมเดลรองรับ video input สำหรับ editing และ extension สูงสุด 10 วินาที และ output อยู่ช่วง 3–10 วินาทีที่ 24 FPS ส่วน 1080p/4K เป็นผลจาก upscaling ไม่ใช่ native detail ทั้งหมด จึงควรตรวจ artifact และต้นทุนก่อนใช้ใน production pipeline
Preview endpoint เดิม gemini-omni-flash-preview มีกำหนด deprecate วันที่ 30 กันยายน 2026 ผู้ที่ผูก integration ไว้ควรทดสอบการย้ายไป gemini-omni-1.1-flash ล่วงหน้า
ลิงก์เอกสารอยู่ในคอมเมนต์แรก ใครทำ video workflow อยู่ คุณให้ความสำคัญกับการคุม continuity, resolution หรือค่าใช้จ่ายมากที่สุด? แชร์ use case กันได้เลย — SynapTech AI ชวนคุยเรื่อง AI ที่เอาไปใช้งานจริง พร้อมข้อจำกัดที่ต้องรู้
#Gemini #VideoGeneration #GenerativeAI #DeveloperTools #SynapTechAI
📖 อ่านบทความเต็มบน Facebook | 🔔 ติดตาม SynapTech
รับข่าว AI และบทความใหม่ก่อนผู้อื่น ส่งตรงถึง inbox
ถ้าชอบเนื้อหาแบบนี้
กดติดตาม SynapTech บน Facebook