內容表
如果您的數位化身看起來不自然,不要從重新執行整個剪輯開始。 找到首先打破的圖層:面部源、語音效能、操作提示或編輯上下文。 然後更改一個輸入並測試一條短線。
大多數弱頭像影片都會失敗,因為一個訊號與其他訊號衝突。 平靜的肖像與興奮的聲音配對。 側角影象試圖提供直接到相機的指令碼。 動作提示要求表達太多。 修復不是「讓它更現實」。 修復方法是讓每個輸入都要求相同的效能。
在更改任何內容之前,請在三次透過中觀看原始匯出。
寫下感覺不對的第一個時刻。 不要一下子判斷整個剪輯。 第一個錯誤幀通常會告訴您哪個輸入導致了問題。
如果臉在靜音時發生變化,請從源影象開始。 如果臉看起來很好,但聲音聽起來很假,請從聲音和節奏開始。 如果頭像移動太多,請從操作提示開始。 如果頭像在短部分看起來不錯,但在最終編輯中卻很奇怪,請修復編輯上下文。
在構建下一個版本之前,要獲得更廣泛的工具圖, DomoAI指南 可以幫助您選擇哪個建立工具屬於工作流程的每個部分。
在重新生成之前,請使用此表格。
| # | 有什麼感覺不對 | 可能的層 | 先修復 |
|---|---|---|---|
| 1 | 臉型變化,身份漂移,或者嘴巴看起來不清楚 | 來源臉 | 使用更清晰的肖像、更安全的裁剪和更易讀的嘴區域 |
| 2 | 聲音感覺與角色脫節 | 語音表演 | 改變聲音、節奏、情緒或指令碼長度 |
| 3 | 頭腦和表情感覺太忙或太僵硬 | 行動提示 | 刪除多餘的手勢,並保留一個可見的動作 |
| 4 | 只有在最後的影片中,剪輯才會感覺是假的 | 編輯上下文 | 新增截斷、字幕或較短的演講者鏡頭 |
不要同時修復所有四個。 新的肖像、新的聲音、新的提示和新的裁剪可能會改善剪輯,但你不會知道哪個變化很重要。
當兩個圖層看起來可疑時,請使用此規則:修復離第一個可見故障最近的圖層。
如果在第一個單詞之前臉部看起來不對,請修復影象。 如果第一個表達方式有效,但說話感覺很奇怪,請糾正聲音。 如果聲音本身聽起來正確,但臉部過度,請修復操作提示。 如果原始匯出看起來不錯,但最終的社交編輯感覺是假的,請修復編輯。
這個訂單讓測試價格便宜。 你花最少的時間在最有可能解釋觀眾首先看到的變化上。
源影象為模型提供了面部角度、嘴巴形狀、凝視、照明和身份。 弱影象為之後的每一幀都會產生弱證據。
先修復: 在更改指令碼、語音或操作提示之前,先替換或修復源肖像。
從一張有一張可見的臉、清晰的下臉和均勻光線的肖像開始。 嘴巴應該自然休息。 眼睛應該指向適合場景的方向。 在頭部和肩部周圍留出足夠的空間,以便進行小動作。
避免嘴巴有濃重的陰影、強烈的側角、小臉、靠近嘴唇的手、麥克風遮住下巴、頭髮穿過臉部。 這些細節在靜止影象中可能看起來很時尚,但它們可能會使移動結果感覺不穩定。
更大的檔案並不能解決隱藏的嘴。 升級可以銳化邊緣,但它不能揭示源中從未出現過的唇部細節。 如果嘴巴位於陰影中或道具後面,請選擇其他影象。
如果肖像接近但尚未準備好,請使用 多模型圖片生成與編輯 解決一個視覺問題。 清理背景,擴大作物,或清除障礙物。 在診斷測試期間,不要重新設計整個字元。
對於動漫和插圖頭像來說,可讀性比現實主義更重要。 保持嘴角清晰,眼睛穩定,臉部比例一致。 當效能與設計相匹配時,風格化的角色仍然可以感覺自然。
建立新源影象時,請在動畫前製作兩個版本:乾淨的中性肖像和略顯富有表現力的肖像。 先測試中性的那個。 如果中性結果感覺太平淡,請用相同的音訊和提示測試表達版本。
這為您提供了可控的比較。 當源影象已經包含衝突的表示式時,它還會阻止您指責模型。
當聲音不合適時,看起來很自然的肖像仍然會感覺很假。 觀眾將臉部和聲音解讀為一種表演。
先修復: 讓臺詞聽起來像角色在那個場景中實際上可以說的話。
單獨聆聽音訊,並提出五個問題:
寫作是為了演講,而不是為了報告。 縮短長句子。 刪除堆疊的子句。 每一次呼吸都放一個想法。 如果一行在頁面上看起來很優雅,但大聲聽起來很僵硬,請重寫。
如果您需要生成的旁白,請用 DomoAI文字轉語音。 使用一個清晰的心情。 情緒標籤可以有所幫助,但混合方向可能會使表現感覺不一致。
如果您上傳音訊,請使用清晰的語音或語音音訊。 消除噪音、回聲、剪下的峰值和意外的沉默。 如果剪輯需要音樂,請在CapCut、Premiere Pro、DaVinci Resolve或其他編輯器中匯出後新增音樂。 從聲音中生成頭像,而不是從完整的混合軌道中生成。
操作提示應該描述檢視者可以看到的內容。 它不應該要求頭像同時表現出五種不同的情緒。
先修復: 用一個定時提示要求一個可見的動作。
弱提示:
富有表現力、興奮、專業、自然、友好、自信和吸引人。
更好的提示:
冷靜的演講者,直接的眼神接觸,放鬆的臉,第一句話後微微點頭,最後溫柔的微笑。
第二個提示效果更好,因為它為頭像提供了一個可見的計劃。 它命名了心情、手勢和時刻。
根據問題使用其中一項:
| 可見的問題 | 提示測試 |
|---|---|
| 點頭太多 | 直接眼神接觸,放鬆的臉,儘量減少頭部運動,最後一句話後微微點頭。 |
| 微笑感覺不對 | 中立的演講者,表情柔和,沒有燦爛的笑容,在停頓時微微眨眼。 |
| 角色感覺被凍住了 | 友好的主持人,微妙的眨眼,在問題上微微傾斜頭部,最後微微點頭。 |
| 情緒變化太大 | 表情平靜,沒有驚訝的反應,沒有大手勢,只有在回答後才會露出柔和的微笑。 |
在測試這些提示時,保持縱向和音訊不變。 僅更改提示強度。
數位化身不需要每秒都攜帶。 使用頭像幫助臉部,然後切入證明。
先修復: 縮短可見頭像部分或用另一個視覺層來支援它。
好的截斷包括:
使用頭像進行鉤子、設定、過渡和最終動作。 使用其他視覺效果進行詳細的證明。 這讓臉部在螢幕上坐的時間太長,以至於微小的人工製品會分散注意力。
編輯還允許您隱藏一個薄弱的句子,替換一個簡短的部分,或在匯出後新增音樂。 將頭像視為影片中的一個圖層,而不是整個影片。
完整的影片隱藏了原因。 一個簡短的測試揭示了它。
構建一個12秒的測試,有一個困難的短語,一個自然的停頓和一個清晰的結尾。 每次使用相同的肖像。
指令碼:
今天,我們正在測試一個更平靜的頭像交付。 在這裡暫停一個節拍。 現在觀看最後的表達。
行動提示:
友好的演講者,直接的眼神接觸,放鬆的臉,第一句小腦袋傾斜,停頓時保持不動,最後溫柔的微笑。
執行測試 DomoAI 數位化身。 用單個更改的輸入來命名每個版本:
肖像A_聲音-原始_提示-低_v01
肖像A_聲音-慢_提示-低_v02
肖像A_聲音-慢_提示-靜止_v03
僅回顧四個時刻:
如果版本二改進了面部和時機,語音節奏可能會有所幫助。 如果版本三只改進了暫停,操作提示有幫助。 這就是測試的重點。 它把模糊的反應變成了明確的下一步行動。
在擴充套件指令碼之前儲存獲勝的輸入。 將源肖像、語音和操作提示放在一個專案備註中。 如果您稍後更改了所有三個,您將失去使簡短測試發揮作用的基線。
每次簡短測試後使用此記分卡。 標記每行「透過」、「稽核」或「失敗」。
| 檢查 | 透過條件 | 如果它失敗了 |
|---|---|---|
| 身分 | 臉仍然可辨認 | 使用更清晰的影象或更安全的裁剪 |
| 嘴 | 嘴唇和下巴保持可讀性 | 使用中性口和更好的照明 |
| 聲音 | 節奏和心情適合臉部 | 重寫臺詞或更改語音設定 |
| 暫停 | 當說話停止時,臉就平靜下來了 | 檢查音訊靜音和提示強度 |
| 動作 | 手勢支援句子 | 移除額外操作 |
| 編輯 | 頭像只出現在有用的地方 | 新增切口或縮短鏡頭 |
修復第一個失敗。 在主要故障消失之前,不要追逐每個審查專案。
如果一切都值得回顧,而沒有什麼值得失敗,那麼剪輯可能已經可以使用了。 許多創作者過度拋光頭像照片,因為他們連續看了十次同一張臉。 第一次觀看的人通常會注意到資訊、剪輯和輔助視覺效果,然後才會有一個微小的表情。
使用記分卡來決定什麼必須改變,而不是永遠尋找缺點。
升級可以打磨一個好的最終拍攝,但它不能修復隱藏的嘴巴、錯誤的聲音或繁忙的提示。 先修復輸入。 然後使用 影片畫質提升工具 在選定的剪輯上。
如果靜音時臉部看起來不對,請先更改源照片。 如果臉部清晰,但動作感覺太忙、太僵硬或時間不對,請先更改提示。
是的。 自然不一定意味著逼真。 角色需要可讀的面部形狀、匹配的聲音能量和符合風格的剋制動作。
聲音可能聽起來平淡,目光可能不適合場景,或者動作提示可能太空。 新增一個有意的表達線索,而不是詢問一般情緒。
不。 隨機重試會隱藏原因。 更改一個輸入,執行一個簡短的測試,並保持版本名稱清晰。
找到第一個不自然的圖層,然後用一個更改的輸入重新執行一個簡短的測試。 更好的來源、更乾淨的聲音、更平靜的動作提示或更短的編輯可以比另一個完全盲人再生更多。
最近的文章