minimaxiH3 获取访问
影片适用厂商内容政策抢先体验

一张照片在说话

一张照片。一个声音。一位主持人。

产品片、开场、需要对镜头说话的角色。

价格 下列最便宜模型每second $0.072 起。

说话虚拟人

$0.072/sec 起
把脸与音频拖到这里或点击选择文件文件留在你的项目。不会拿去训练。
长度
画幅
邀请码可在 Chat 开启此工具。还没有?加入候补——我们依需求最多的工具先开放。

怎么用

三步。

上传肖像

肩膀以上、中性表情。

上传音频

人声干净、底噪少。

执行

可选较沉或较活的手势。

来自 Avatar Omni Human 1.5 的示意样本,不是此工具的前后对照。

你提供

输入。

  • 一张肖像
  • 音频(说话或唱歌)
  • 可选手势风格

你得到

输出。

  • 内嵌音频的说话头像

底层

这个工具用的模型。

每个模型自列价格与内容政策。spicy 路线是 MiniMax H3;其余跟厂商规则。

常见问题

短答。

音频能多长?

依模型约 30–60 秒;更长的稿就分段。

合成角色可以吗?

可以。先用文生图做出肖像。

是 spicy 路线吗?

不是。虚拟人模型跟厂商政策。

怎么获取访问?

输入邀请码即可在 Chat 开启工具,或在本页加入候补。我们分批开放,优先需求最多的工具。

相关工具

也常打开。

在 Chat 使用说话虚拟人。

邀请码开启工具。没有就加入候补;需求最多的先开放。

获取访问 浏览模型