Gemini Omni Video
面向任意输入到视频的多模态创作,相比 Gemini 早期视频能力更强调文本、图像、音频和视频资料的统一编排;对比 Veo、Kling、Runway,它更适合把复杂多模态素材整合进同一创意工作流。
- 多模态输出
在控制台使用
gemini-omni-videoUSD
价格
default
4S/1080p$0.495/s
4S/720p$0.495/s
6S/1080p$0.66/s
6S/720p$0.66/s
8S/1080p$0.825/s
8S/720p$0.825/s
basis$1/s
10S/1080p$1/s
10S/720p$1/s
4S/4K$1.15/s
720p/input_video$1.32/s
1080p/input_video$1.32/s
6S/4K$1.32/s
8S/4K$1.5/s
10S/4K$1.65/s
4K/input_video$2/s
展示价格为美元公开价,实际费用可能因账户分组和用量阶梯而变化。
API
代码示例
curl --location 'https://api.tokenhot.cn/v1/video/generations' \
--header 'Content-Type: application/json' \
--data '{
"model": "gemini-omni-video",
"input": {
"prompt": "Slow push-in as the character walks out from a neon-lit street",
"image_urls": [
"https://your-host.com/scene1.png"
],
"duration": "6",
"aspect_ratio": "16:9",
"resolution": "720p"
}
}'相关模型
FAQ
常见问题
Gemini Omni Video 适合哪些场景?
Gemini Omni Video 适合本页所列的输入、输出与能力类型。用于关键业务前,建议先用真实负载进行验证。
Gemini Omni Video 如何计费?
价格见上方价格部分,实际成本取决于使用量、账户分组和请求内容。
如何调用 Gemini Omni Video?
使用上方模型 ID,通过受支持的 API 协议调用;有调用数据时,本页会展示代码示例。
开始使用