Google

Gemini Omni Video

面向任意输入到视频的多模态创作,相比 Gemini 早期视频能力更强调文本、图像、音频和视频资料的统一编排;对比 Veo、Kling、Runway,它更适合把复杂多模态素材整合进同一创意工作流。

  • 多模态输出
在控制台使用gemini-omni-video

USD

价格

default
4S/1080p$0.495/s
4S/720p$0.495/s
6S/1080p$0.66/s
6S/720p$0.66/s
8S/1080p$0.825/s
8S/720p$0.825/s
basis$1/s
10S/1080p$1/s
10S/720p$1/s
4S/4K$1.15/s
720p/input_video$1.32/s
1080p/input_video$1.32/s
6S/4K$1.32/s
8S/4K$1.5/s
10S/4K$1.65/s
4K/input_video$2/s

展示价格为美元公开价,实际费用可能因账户分组和用量阶梯而变化。

API

代码示例

curl --location 'https://api.tokenhot.cn/v1/video/generations' \
--header 'Content-Type: application/json' \
--data '{
    "model": "gemini-omni-video",
    "input": {
        "prompt": "Slow push-in as the character walks out from a neon-lit street",
        "image_urls": [
            "https://your-host.com/scene1.png"
        ],
        "duration": "6",
        "aspect_ratio": "16:9",
        "resolution": "720p"
    }
}'

Google

相关模型

FAQ

常见问题

Gemini Omni Video 适合哪些场景?

Gemini Omni Video 适合本页所列的输入、输出与能力类型。用于关键业务前,建议先用真实负载进行验证。

Gemini Omni Video 如何计费?

价格见上方价格部分,实际成本取决于使用量、账户分组和请求内容。

如何调用 Gemini Omni Video?

使用上方模型 ID,通过受支持的 API 协议调用;有调用数据时,本页会展示代码示例。

开始使用

使用 Gemini Omni Video 构建

在控制台使用
TokenHot

前沿智能网关。一个 API。127 个模型。0.2 秒延迟。按需付费。

所有系统正常 · 99.997% 正常运行时间

公司

© 2026 TokenHot Inc. — 为开发者而生。