創作者在 Google Flow 上取得人工智慧影片的數位副本

google flowgoogle flow

google flow - Fajri Mulia Hidayat / Shutterstock.com

在 2026 年 I/O 大會上,這家搜尋巨頭推出了一款適用於 Flow 生態系統的新工具,讓用戶能夠生成自己的虛擬複製品,以便在人工智慧引導的視聽作品中進行表演。該機制專注於尋求優化錄製時間而無需設置照明場景或面對鏡頭的內容製作者,在埃利亞斯·羅曼 (Elias Roman) 的領導下首次公開展示。谷歌實驗室產品管理副總裁在活動期間使用自己的合成身份在多個演算法生成的演示中擔任主角。

一步步在應用程式中產生虛擬身份

為了讓網路複製栩栩如生,整個過程只需要幾分鐘和一部智慧型手機。使用者透過掃描二維碼開始配置,引導他們在 Flow 中進行設定檔調整。從那時起,軟體要求人們大聲背誦特定的數字序列,並向各個方向移動他們的臉。這項校準步驟使該技術能夠從不同角度繪製聲帶和臉部生物特徵,從而建立高度準確和個性化的三維模型。

Google – daily_creativity/shutterstock.com

所有這些視覺工程都在 OmniFlash 引擎上運行,這是該公司最新的視訊架構,淘汰了舊的 Veo 系統。這種結構更新的最大差異在於複製過程中元素的穩定性。雖然過去幾代人都患有視覺幻覺,在鏡頭切換之間特徵會融化或發生巨大變化,但新的人工智慧能夠從錄製的開始到結束保持角色的解剖學凝聚力。

使用 OmniFlash 引擎進行影像渲染的技術進步

作為這項新功能的核心,OmniFlash 代表了機器處理行動像素方式的世代飛躍。該公司強調,開發的重點是消除去年合成剪輯的人為和不穩定的外觀。隨著臉部異常和紋理突變的大幅減少,最終結果更接近傳統工作室製作的專業捕捉。

為了使該工具的使用民主化,該介面現在接受純文字說明,允許任何人只需輸入他們想看的內容即可更改佈景或服裝。該平台還獲得了智慧日常自動化系統,製作人可以將燈光和風格參數保存在特定資料夾中。該組織促進了在多個未來項目中應用相同的視覺識別,優化了那些每天在社交網路上發布材料的人的日常工作,並擴大了人工智慧對非專業人士的使用。

針對數位虛假資訊的可追溯性和安全密封

該公司了解語音和圖像克隆固有的風險,因此在原始程式碼中嵌入了嚴格的安全鎖來監控生態系統。 OmniFlash 匯出的任何資料都會自動帶有不可見的 SynthID 簽名,這是一種加密協議,旨在揭示文件的合成來源。這種人眼無法察覺的水印最初於 2023 年推出,現已橫掃搜尋引擎結果,並在活動結束後幾週內確認與 Chrome 瀏覽器整合。

另一個防禦陣線是 C2PA 標準的擴展,這是一個全球聯盟,在媒體捕獲的確切時刻對元資料的真實性進行標記。此驗證機制首先在 Pixel 10 智慧型手機鏡頭上進行測試,很快就會擴展到 Pixel 8 和 9 系列上錄製的影片。市場也在等待 Instagram 等元平台開始讀取和顯示這些原產地證書,從而建立一個統一的屏障,防止網路上的操縱。

限制使用並持續打擊假視頻

與市場所看到的已滅絕的 Sora 專案不同,山景城當前的賭注有一個直接寫入資料庫的道德限制:你只能克隆自己。此介面會立即阻止在目前開發階段產生第三方副本的任何嘗試。這種架構鎖是工程師找到的解決方案,旨在防止該工具成為惡意深度偽造或未經授權的身份盜竊的工廠。

打擊音像假冒行為還包括與隱形品牌生態系統平行的其他措施:

  • 每當媒體透過演算法建構時,Gemini 應用程式和其他品牌服務中就會出現明確的視覺警告。
  • Google Lens 和搜尋 AI 模式中內建的逆向工程工具可檢查可疑影像的準確性。
  • Nvidia 卡和伺服器採用 SynthID 協議,直接在硬體上追蹤內容。
  • 與 OpenAI、Kakao 和 ElevenLabs 等巨頭簽署合作夥伴關係,以標準化對這些安全印章的讀取和支援。

這些驗證過濾器的不斷改進表明,科技業正在努力跟上數位詐欺者的步伐,同時為 Flow 釋放新的創意能力。透過將大容量虛擬工作室與複雜的來源追蹤器結合,該公司正試圖建立一個商業標準,讓演算法創新能夠負責任地存在,同時又不會破壞公眾對螢幕上所看到內容的信任。