Google 在人工智慧視訊生成領域再次邁出重要一步,推出全新的 Veo 3.1 模型,並為其 AI 影片製作工具 Flow 帶來一系列創新功能。這次更新不僅提升了視訊生成的品質,更賦予創作者更精細的控制權,讓 AI 輔助影片製作進入新的階段。
Veo 3.1 帶來更豐富的音訊與敘事控制
自 Flow 推出以來,這款由 Veo 驅動的 AI 影片製作工具已協助用戶創作超過 2.75 億支影片,展現出驚人的創意潛力。全新的 Veo 3.1 模型在多個面向實現突破,特別是在音訊生成、敘事控制以及畫面真實感方面都有顯著提升。
根據 [Google 官方部落格](https://blog.google/technology/ai/veo-updates-flow/)的說明,Veo 3.1 能夠產生更豐富的音訊效果,讓生成的影片不再只是視覺呈現,而是包含完整聽覺體驗的多媒體作品。同時,模型對於敘事結構的掌握能力也大幅提升,能夠更準確地理解創作者的意圖,產生符合期望的影片內容。
圖片轉影片功能更加精準
Veo 3.1 在「提示詞遵循度」方面有明顯改善,這意味著系統能更精確地按照用戶輸入的文字描述來生成影片。更值得注意的是,新版本在將靜態圖片轉換為動態影片時表現更為出色。當用戶上傳圖片作為創作素材,並搭配文字提示詞時,Veo 3.1 能夠更好地理解這些視覺元素,創造出更貼近預期的動態效果。
這項改進對於需要將既有視覺素材轉化為動態內容的創作者而言特別實用,無論是將產品照片製作成展示影片,或是為靜態插畫注入生命力,都能獲得更理想的成果。
Flow 編輯工具新增精細控制選項
除了底層模型的升級,Flow 平台本身也獲得重要的功能擴充。新版本提供更精細的片段編輯能力,讓創作者對最終場景擁有更細緻的掌控權。這些新增的編輯功能回應了用戶對於創作自由度的需求,使得 AI 輔助創作不再僅是「生成後接受」的單向過程,而是能夠進行細部調整的互動式創作體驗。
創作者現在可以針對生成的影片片段進行更多客製化調整,包括修改特定場景、調整視覺元素的呈現方式,以及優化整體敘事流程。這種程度的編輯彈性,讓 Flow 從單純的生成工具進化為更完整的創作平台。
Gemini API 同步開放使用
Veo 3.1 的強大功能並非僅限於 Flow 平台使用者。Google 同步透過 Gemini API 開放這項技術,讓開發者能夠將 Veo 3.1 的視訊生成能力整合到自己的應用程式或服務中。這項開放策略將 AI 視訊生成技術的應用範圍擴展到更廣泛的場景,從內容創作平台、行銷工具到教育應用,都能夠運用這項技術。
對於企業和開發者而言,透過 API 取得 Veo 3.1 的能力意味著可以客製化影片生成流程,整合到既有的工作流程中,創造出符合特定需求的解決方案。
AI 影片生成競爭持續升溫
Veo 3.1 的推出時機恰逢 AI 視訊生成領域競爭白熱化之際。在 OpenAI 的 Sora 引發廣泛關注的背景下,Google 透過這次更新展現其在這個快速發展領域的技術實力。從五個月前首次推出 Flow 至今,2.75 億支影片的生成量證明市場對 AI 視訊工具的龐大需求。
這次更新不僅是技術參數的提升,更反映出 Google 對於創作者需求的深入理解。透過增強音訊品質、提升敘事控制、改善圖片轉影片功能,以及新增編輯工具,Veo 3.1 和 Flow 的組合為創作者提供了更完整的創作生態系統,讓 AI 成為激發創意而非限制想像的工具。







