內容表
「免費」可能是持續額度、一次性點數、限時試用,或三次短預覽。 以下8款工具都支援個人圖片加語音,但真正可用的免費路徑差異很大。官方方案查核日期為2026年7月31日。
免費存取有多種形式,各自回答不同問題。免費預覽不等於可以下載的影片,也不等於持續免費的生成額度。
本文使用4個標籤:
只有官方資料確認相關的「照片+語音」流程與某種免費入口,才列入討論。除非現行文件明確支持,否則不會標示為「免費輸出」。
產品頁面的變動速度比常青教學快。上傳最終人像前,請在帳號畫面確認點數、浮水印、下載、信用卡要求與授權。
順序依使用情境,而非虛構的品質分數。 使用點數前先看最後一欄。
| 工具 | 最適合的免費測試 | 存取類型 | 公開資料確認的額度 | 要核對的方案條件 |
|---|---|---|---|---|
| DomoAI | 真人、插畫、動漫、吉祥物或寵物照片 | 一次性試用點數 | 新試用帳號25點 | 生成前由實際帳號顯示目前點數、輸出選項與浮水印 |
| HeyGen | 個人或內建主持人 | 免費方案 | 依地區1至3支影片,每支最長1分鐘,720p分享連結 | 下載與移除浮水印屬付費方案比較項目;地區額度不同 |
| CapCut | 在主流社群編輯器內測試會說話照片 | 免費編輯器,AI依方案與地區而異 | 官方工具支援個人照片加腳本或音訊,再進入時間軸 | AI點數、可用性、浮水印與輸出依帳號、平台、地區而變 |
| D-ID | 以照片為起點的原生手機流程 | 14天限時試用 | 現行說明為手機12點 | 手機註冊要信用卡;試用輸出有浮水印且限個人使用 |
| VEED | 瀏覽器中的照片加音訊模型 | 免費預覽 | Fabric可生成3次,每次最長10秒 | 繼續使用要點數;在帳號核對輸出與浮水印 |
| WaveSpeedAI | 比較多個照片加音訊化身模型 | 一次性註冊點數 | 免信用卡1美元點數 | 各模型成本、解析度、長度、速度、商用授權不同 |
| Vidnoz | 持續製作文字驅動的會說話照片 | 免費方案 | 每日點數與每日照片化身額度 | 定價表動態顯示額度;除非帳號另有說明,預期有浮水印 |
| Hedra | 以短片測試音訊驅動角色 | 有限免費方案 | Hedra Avatar標示Free tier;免費音訊最長20秒 | 免費生成數量有限且有浮水印;其他數款模型只限付費 |
候選工具涵蓋不同免費模式與創作工作。Vidnoz適合持續使用照片化身,WaveSpeedAI可用小額度比較多個模型,Hedra適合短音訊驅動測試。若素材可能是真人、插畫、動漫、吉祥物或寵物,聲音又可能來自文字、直接錄音或上傳檔案,DomoAI是本清單中涵蓋範圍最廣的起點。 HeyGen則更偏向真人主持人。
如果還不確定哪項限制最重要,先用DomoAI做一次短測試。只有在原生手機流程、可重複使用的企業主持人或持續免費額度等條件不可妥協時,再轉向專門工具。
我們查看定價頁、說明中心、功能頁、條款與應用程式商店資料。沒有把同一素材放進每個實際帳號,因此不對成品質量評分。
唇形同步與真實感仍要用同一張照片、腳本、音訊與輸出目標實測。 文件只能幫你判斷先測哪些產品。
主選還必須有現行官方文件、相關會說話照片流程、近期產品活動,以及廣泛採用或明確的類別領導地位。僅因頁面寫了「化身」,不代表靜態化身或只供內建主持人的展示符合條件。
8個免費入口對應8種工作:
證據順序越低,越不應單獨主導購買決定。
DomoAI的**數位化身**接受自拍、角色插畫或寵物照片。以人臉為主的免費主持人工具通常沒有這麼廣的範圍。
新帳號目前會收到**25點試用額度。創作者可使用文字轉語音**、直接錄音,或上傳最大80MB的MP3、WAV、M4A。
付款前可驗證3個問題:
先用5秒台詞測試。 數位化身的Fast Mode適合短而集中的測試,Pro方案可延伸到30秒與60秒。
DomoAI的25點試用可先探索**動漫、吉祥物、動物與VTuber風格主持人**,再決定長期流程。
Vidnoz免費方案包含照片化身,不會把個人照片功能完全放在付費自訂化身之後。使用者可上傳照片、輸入腳本、選擇聲音並下載影片。
官方Talking Photo頁支援真人、卡通、動物與100多種語言。定價表顯示每日免費點數與每日照片化身額度;確切數量是動態內容,應記錄帳號內數字,不要複製不穩定的搜尋摘要。
主要限制是交付而非輸入。移除浮水印列為付費功能;可用聲音、輸出設定、生成速度、每日額度也與付費層不同。
如果持續使用比高級動作控制重要,可先選Vidnoz。若浮水印不可接受,或專案需要上傳已表演的音訊而非文字語音,則不適合。
WaveSpeedAI不同於單模型化身應用程式。其Avatar Lipsync集合用同一帳號提供多個圖片+音訊模型,包括短會話與較長音訊驅動影片。
每個新帳號目前可免信用卡取得1美元註冊點數。模型頁分別顯示單次成本、支援解析度、長度與輸入,適合比較架構,但不是持續免費方案。
已備妥乾淨人像與完成音訊的創作者或開發者較適合。若需要引導式腳本編輯器、內建主持人庫或可預測的一鍵免費輸出,則較弱。
商用還取決於所選模型的授權,而不只看WaveSpeed帳號。把成功測試當成可交付成果前,先查模型卡。
Hedra Avatar接受起始圖片與音訊檔,產生唇形同步角色影片。官方模型卡標示Free tier,檔案規格則把免費音訊限制在20秒。
免費路徑適合用真人、插畫角色或其他清楚人像做一次短概念驗證。應用程式文件支援上傳、預覽、下載與刪除;定價頁則說未付費生成有浮水印。
不要假設Hedra內每個化身模型都免費。Character-3標為付費限定,各模型點數費率也不同。先用Hedra Avatar,確認實際成本,第一段音訊要明顯短於免費上限。
需要上傳音訊與有表情的角色動態時值得測試。若要求免費且無浮水印,或優先原生手機流程,則應略過。
HeyGen免費方案更適合個人主持人,而不是不受限的角色圖片。現行官方限制為依地區1至3支影片,每支最長1分鐘。
免費層也列出1個自訂影片化身、3個照片化身欄位、500多個內建化身、30多種語言與720p分享連結。
關鍵字是「分享」。 免費說明承諾分享連結,1080p輸出與移除浮水印則列在付費Creator功能。先確認交付方式符合任務,再寫完整腳本。
需要人類代言人、個人數位分身或內建主持人草稿時可優先考慮。若輸入是寵物、插畫或風格化角色,DomoAI更適合先測。
CapCut入選,是因為會說話照片位於完整的主流社群影片編輯器中,而非獨立生成工作區。
官方Talking Photos流程接受個人圖片與腳本或音訊,再把生成片段送進編輯器。可加入字幕、音樂、疊加、剪輯、比例變更與輔助影片;AI Avatar頁也描述照片驅動化身、內建數位人與多種聲音。
免費邊界沒有流程本身那麼清楚。 功能、AI點數、浮水印與輸出依裝置、地區、版本、帳號而變。它存在於免費編輯器,不代表每次AI生成都持續免費。
若會說話照片只是已在CapCut編輯的社群影片其中一幕,這個選擇很合理。若角色是寵物、動漫或吉祥物,且角色表現比手機時間軸重要,DomoAI更合適。
D-ID提供iOS與Android原生流程,可用一張圖片建立會說話的數位人物。手機應用程式支援上傳錄音或文字轉語音,也能選語言與聲音。
D-ID手機試用要求選擇訂閱並輸入信用卡。 現行說明是14天、12點、有浮水印、限個人使用。這是付費產品的限時評估,不是持續免費方案。
若原生手機製作是決定條件,試用仍有價值。註冊前設定取消提醒、確認續訂價格,第一點用在短而具代表性的腳本。
當會說話化身要放進完成的社群或行銷影片時,VEED值得考慮。其瀏覽器編輯器整合字幕、音樂、標誌、素材與版面。
Fabric 1.0接受圖片與音訊。VEED目前給所有使用者3次免費Fabric生成,每次最長10秒;付費使用者以點數繼續並可生成較長片段。
請把它視為3次模型預覽,而非持續免費方案。第1次驗證臉,第2次測最難台詞,第3次保留給修正後輸入。製作周邊剪輯前先確認輸出解析度與浮水印。
更廣義的「AI化身生成器」可包含靜態頭像、3D遊戲角色與內建主持人。本文的門檻較窄:必須用你提供的照片與語音產生會說話影片,且有文件支持的免費入口。
| 排除工具 | 常見於廣義化身清單的原因 | 未通過本文門檻的原因 |
|---|---|---|
| Ready Player Me | 建立遊戲與虛擬世界可重複使用的3D化身 | 不會從個人照片與語音產生會說話影片 |
| Lensa | 由自拍建立風格化化身圖片 | 核心輸出是靜態圖片,不是唇形同步影片 |
| Synthesia | 成熟的內建主持人與培訓影片流程 | 免費路徑不是把個人靜態照片動畫化的明確入口 |
| Canva | 可承載化身應用並編輯簡報或影片 | 照片到會說話人物的生成可能由整合商提供,免費額度與授權不受單一Canva方案欄位控制 |
WaveSpeedAI的廣義化身文章包含會說話人物、頭像與3D化身。這些產品在各自工作中有效,但若加入本文,只會增加數量,無法回答會說話照片的查詢。
每個免費選項都用另一種限制取代費用。 先選可接受的限制,再在剩餘工具中比較化身風格或聲音。
| 無法妥協的條件 | 最先測試 | 生成前確認 |
|---|---|---|
| 主體是動漫、插畫或寵物 | DomoAI | 臉部可見度、試用點數、片長、浮水印 |
| 需要每日持續的照片化身額度 | Vidnoz | 每日額度、浮水印、聲音、下載設定 |
| 用一個餘額比較多個模型 | WaveSpeedAI | 模型成本、解析度、長度、速度、授權 |
| 已有音訊並要短角色測試 | Hedra | 免費模型、20秒上限、浮水印、點數成本 |
| 可重複使用的人類主持人 | HeyGen | 地區額度、分享與下載、照片化身存取 |
| 在主流社群編輯器內製作 | CapCut | 功能、AI點數、浮水印、目標裝置輸出 |
| 原生iPhone或Android流程 | D-ID | 信用卡、續訂日、浮水印、個人用途 |
| 需要化身周邊字幕與編輯 | VEED | 功能存取、AI點數、解析度、浮水印 |
| 商業交付 | 沒有自動贏家 | 精確方案授權、照片/聲音權利、揭露規則 |
不要把少量額度浪費在可避免的輸入問題。使用單一清楚臉孔、均勻光線、可見嘴巴、乾淨語音與一個刻意停頓。
文件可縮小清單,卻無法判斷哪個模型最適合你的臉與聲音。對所有剩餘候選使用同一份小型測試包。
| 檢查 | 記錄內容 | 重要原因 |
|---|---|---|
| 存取 | 信用卡、點數、每日重設、試用到期 | 看出免費是持續還是暫時 |
| 生成 | 模型、成本、長度、重試 | 避免低成本預覽掩蓋昂貴修正循環 |
| 臉部 | 身分、口形、眼睛、頭部動作 | 區分可用動畫與單純上傳成功 |
| 音訊 | 第一個字、刻意停頓、最後閉嘴 | 提供3個可觀察的同步節點 |
| 交付 | 下載、浮水印、解析度、格式 | 確認成品能否離開平台 |
| 權利 | 個人/商用與揭露需求 | 避免技術合格卻無法用於真實任務 |
不要每個平台使用不同輸入後再排名。只有照片、音訊、目標與評估標準一致,比較才有意義。
你有一張狗狗照片、一句生日祝福與很少點數,目標是私人分享的10秒直式影片。
如果背景要清理或臉部對比要提高,先編輯副本再花試用點數。
DomoAI支援**寵物照片與上傳WAV**,因此是第一選擇。Hedra與WaveSpeedAI是可信的音訊驅動替代;可接受文字轉語音時,Vidnoz是持續免費候選。先用能放下台詞的最短片長。
動作只寫「輕微歪頭、眨眼一次、友善表情、固定鏡頭」。語音檔不要放背景音樂;標題卡、音樂、字幕與9:16構圖留給CapCut。
輸出一支附可讀字幕的9:16影片,音樂用獨立低音量軌道加入。分享前檢查狗狗臉部、最後子音、浮水印與下載檔。**影片放大**只用在保留版本。
| 問題 | 先做的修正 | 為何優先 |
|---|---|---|
| 最後幾個字口型未跟上 | 修剪尾端靜音並縮短台詞 | 修正音訊時序比換圖或換工具便宜 |
| 臉部彎曲或口鼻漂移 | 改用更正面的裁切,減少脖子與背景 | 清楚臉部區域可減少互相競爭的動作線索 |
| 動作太忙 | 刪除額外動作,只保留一個頭部動作 | 單一主體、單一動作、固定鏡頭較清楚 |
| 音樂遮住語音 | 生成後才加音樂,並把音量降到人聲下 | 乾淨語音改善輸入,也保留混音控制 |
| 免費輸出有不可接受的浮水印 | 停止重做,比較付費輸出成本與另一條已驗證免費路徑 | 更多生成無法解決交付限制 |
測試任何「免費」會說話照片產品前先複製,分開行銷入口與真正可用的交付物。
工具與網址:
查核日期與地區:
裝置與應用程式/瀏覽器版本:
免費類型:免費方案/試用點數/限時試用/預覽
需要信用卡:是/否
起始額度:
單次範例生成成本:
接受個人照片:是/否
此方案接受自有音訊:是/否/未知
最長時間:
可用分享連結:是/否
可下載:是/否
下載檔浮水印:是/否/未知
輸出解析度:
允許商用:是/否/不清楚
續訂日期與價格:
已確認刪除控制:是/否
範例通過:身分/口型時序/音訊/輸出/權利
升級或淘汰理由:
不要用行銷標題填入未知欄位。 開啟該方案與地區的實際帳號、最新說明或條款。
有時。 它可能是持續免費方案、一次性點數、限時試用,或只有預覽。生成、下載、浮水印、信用卡與續訂要分開確認。
有些有。 D-ID明確在試用輸出加浮水印,其他產品則把移除功能留給付費方案。精確免費流程要用實際帳號確認。
依免費存取類型而異。 DomoAI、WaveSpeedAI、Hedra、VEED Fabric、D-ID、CapCut都有音訊驅動或錄音路徑;Vidnoz最清楚的免費路徑是文字驅動。
不要假設。 查核精確方案條款、圖片與聲音權利,以及適用的合成媒體揭露規則。D-ID現行試用限個人用途。
靜態頭像或3D遊戲化身不符合會說話照片查詢。 主清單要求個人圖片、語音輸入、生成影片與有文件支持的免費入口。
第一筆額度要測生成、修正、下載、浮水印、權利與口型時序。 不確定時先從DomoAI開始;只有在持續免費、多模型比較、真人主持人或手機剪輯成為必要條件時,再選擇其他工具。
在把流程拆到多個平台前,先用DomoAI的數位化身完成一次短測試。 使用同一張圖片與8秒音訊,確認角色一致性、口型時序、修正成本、輸出與權利,再決定後續製作方式。
最近的文章