minimaxiH3 取得存取
影片適用廠商內容政策搶先體驗

一張照片在說話

一張照片。一個聲音。一位主持人。

產品片、開場、需要對鏡頭說話的角色。

價格 下列最便宜模型每second $0.072 起。

說話虛擬人

$0.072/sec 起
把臉與音訊拖到這裡或點擊選擇檔案檔案留在你的專案。不會拿去訓練。
長度
畫幅
邀請碼可在 Chat 開啟此工具。還沒有?加入候補——我們依需求最多的工具先開放。

怎麼用

三步。

上傳肖像

肩膀以上、中性表情。

上傳音訊

人聲乾淨、底噪少。

執行

可選較沉或較活的手勢。

來自 Avatar Omni Human 1.5 的示意樣本,不是此工具的前後對照。

你提供

輸入。

  • 一張肖像
  • 音訊(說話或唱歌)
  • 可選手勢風格

你得到

輸出。

  • 內嵌音訊的說話頭像

底層

這個工具用的模型。

每個模型自列價格與內容政策。spicy 路線是 MiniMax H3;其餘跟廠商規則。

常見問題

短答。

音訊能多長?

依模型約 30–60 秒;更長的稿就分段。

合成角色可以嗎?

可以。先用文生圖做出肖像。

是 spicy 路線嗎?

不是。虛擬人模型跟廠商政策。

怎麼取得存取?

輸入邀請碼即可在 Chat 開啟工具,或在本頁加入候補。我們分批開放,優先需求最多的工具。

相關工具

也常打開。

在 Chat 使用說話虛擬人。

邀請碼開啟工具。沒有就加入候補;需求最多的先開放。

取得存取 瀏覽模型