Google

Gemini 3.1 Flash Lite

Built for multimodal understanding, coding, and long-context tasks, improving over Gemini 3.0 / 2.5 in throughput, context, and tool capabilities. Compared with GPT, Claude, and Qwen models, it is strong for unified analysis workflows across text, images, audio, video, and documents.

  • 推論
  • ツール利用
  • 関数呼び出し
  • 構造化出力
  • 長いコンテキスト

このモデルの説明は現在の言語に未対応のため、英語で表示しています。

コンソールで使うgemini-3.1-flash-lite

USD

料金

default
標準レート
入力$0.25/1M tokens補完価格$1.5/1M tokensキャッシュ読込$1/1M tokens

米ドル建ての公開価格です。実際の料金はアカウントグループや利用量により異なる場合があります。

API

コード例

import http.client
import json

conn = http.client.HTTPSConnection("api.tokenhot.cn")
payload = json.dumps({
   "contents": [
      {
         "role": "user",
         "parts": [
            {
               "text": "Hello"
            }
         ]
      }
   ]
})
headers = {
   'Authorization': 'Bearer <token>',
   'Content-Type': 'application/json'
}
conn.request("POST", "/v1beta/models/gemini-3.1-flash-lite:generateContent", payload, headers)
res = conn.getresponse()
data = res.read()
print(data.decode("utf-8"))

Google

関連モデル

FAQ

よくある質問

Gemini 3.1 Flash Lite はどの用途に適していますか?

Gemini 3.1 Flash Lite は、このページに記載された入出力と機能に適しています。重要なシステムでは実際の負荷で事前に検証してください。

Gemini 3.1 Flash Lite の料金体系は?

料金は上の料金セクションに表示されています。実際の費用は利用量、アカウントグループ、リクエスト内容によって異なります。

Gemini 3.1 Flash Lite を呼び出すには?

上記のモデル ID と対応 API プロトコルを使用します。利用データがある場合はコード例も表示されます。

はじめる

Gemini 3.1 Flash Lite で構築する

コンソールで使う