AI 影片給 AI 代理用MCP · SKILL
AI 照片說話
上傳一張人像照片和一段錄音。照片裡的人會說出你的音訊,影片和錄音一樣長。
會在工作室裡開啟「照片說話」,到那裡再新增檔案。沒登入的話要先登入。

使用方式
照片說話怎麼用
新增人像照片
上傳一張照片,裡面只有一張清晰的臉,正對鏡頭。支援 PNG、JPEG或WEBP 格式,最大 20 MB。
新增音訊
上傳要讓這個人說的話或唱的歌(MP3、WAV和M4A;3 秒 – 2 分鐘)。影片和音訊一樣長。
描述動作並生成
寫明人物說話時該怎麼動:表情、頭部動作、情緒。然後查看價格並生成。
使用情境
大家用 AI 照片說話做什麼
留言和祝福
錄一段生日祝福或感謝的話,讓你自己的照片替你說出來。
口播影片
用一張大頭照和一段配音做出口播影片,用來講解、上課或介紹產品更新,不用拍攝。
AI 角色
拿一張你用 AIdol(DER 的 AI 網紅生成工具)做的角色照片,讓它說出你錄的一句台詞。
會唱歌的照片
把說話的音訊換成一首歌,照片裡的人就會唱出來。
比較
照片說話和影片對嘴的差別
兩者都能讓人說出你的音訊。看你手上有什麼素材來選。
| 你會得到 | 照片說話 | 影片對嘴 |
|---|---|---|
| 你上傳 | 一張照片和一個音訊檔案 | 一支影片和一個音訊檔案 |
| 會發生什麼 | 靜態人像動起來,開口說話 | 影片裡的嘴型跟著新音訊走 |
| 適合 | 手上只有一張照片時 | 已經有這個人的影片時 |
已經有影片了?AI 影片對嘴
為什麼選 DER
讓照片開口說話
一張人像照片
照片清晰、臉容易看清,效果會更好。
你自己的音訊
上傳說話或唱歌的音訊,照片裡的人會照著它開口,影片長度跟著音訊走。
引導動作
加一段簡短的提示詞,說明人物說話時該怎麼動。
怎樣效果更好
選對照片和音訊,效果更好
臉要容易看清,聲音要清楚。上傳之前兩樣都檢查一下。
照片
建議
- 只有一張臉,正對鏡頭
- 整張臉都在畫面裡,而且對焦清楚
- 光線均勻
避免
- 多人合照
- 墨鏡、口罩,或者手擋著嘴
- 側臉照,或者臉轉得太偏
音訊
建議
- 說話或人聲清楚
- 長度:3 秒 – 2 分鐘
- MP3、WAV和M4A,最大 50 MB
避免
- 音樂或噪音蓋過人聲
- 幾個人同時說話、互相蓋住
範例
照片說話範例
按用量計費
免訂閱,沒有每月最低消費:只有生成時才消耗點數。最低儲值 US$5。
生成失敗不扣點數
如果生成失敗,這次用掉的點數會自動退回帳號餘額。
常見問題
AI 照片說話常見問題
AI 照片說話是什麼?
用一張靜態人像和一段音訊生成的短影片。照片裡的人的嘴唇、臉和頭會跟著音訊動,有時也叫照片對嘴。
怎麼讓照片開口說話?
上傳一張人像照片,上傳音訊,描述人物該怎麼動,查看價格,然後生成。影片和你的音訊一樣長。
可以用什麼音訊?
MP3、WAV和M4A 格式的錄音,最大 50 MB。影片和音訊一樣長。
照片說話和虛擬人對嘴有什麼差別?
照片說話每次都是讓你上傳的那張照片動起來。虛擬人對嘴用的是現成的虛擬人,或者你之前自訂的虛擬人,讓它說出你的音訊。那個工具是「AI 對嘴」。
可以用誰的照片和聲音?
你自己的,或者本人同意的。不要用照片說話做出來的影片冒充真實內容。
AI 照片說話是免費的嗎?
不是。每支影片都要消耗點數。價格按音訊長度計算,開始之前工作室會顯示。點數透過單次儲值取得,最低儲值 US$5。免訂閱,生成失敗會退還點數。
我的結果會保存多久?
7 天。想留的可以保留進「Library」(作品庫),最多 200 個,這樣就不會過期。
現在就讓照片說話
照片說話