Google

Gemini 3.1 Flash Lite

Built for multimodal understanding, coding, and long-context tasks, improving over Gemini 3.0 / 2.5 in throughput, context, and tool capabilities. Compared with GPT, Claude, and Qwen models, it is strong for unified analysis workflows across text, images, audio, video, and documents.

  • Рассуждение
  • Инструменты
  • Вызов функций
  • Структурированный вывод
  • Длинный контекст

Описание на выбранном языке пока недоступно, поэтому показана английская версия.

USD

Цены

default
Стандартный тариф
Ввод$0.25/1M tokensЦена завершения$1.5/1M tokensЧтение кэша$1/1M tokens

Показаны публичные цены в долларах США. Итоговая стоимость зависит от группы аккаунта и объёма использования.

API

Примеры кода

import http.client
import json

conn = http.client.HTTPSConnection("api.tokenhot.cn")
payload = json.dumps({
   "contents": [
      {
         "role": "user",
         "parts": [
            {
               "text": "Hello"
            }
         ]
      }
   ]
})
headers = {
   'Authorization': 'Bearer <token>',
   'Content-Type': 'application/json'
}
conn.request("POST", "/v1beta/models/gemini-3.1-flash-lite:generateContent", payload, headers)
res = conn.getresponse()
data = res.read()
print(data.decode("utf-8"))

Google

Похожие модели

FAQ

Частые вопросы

Для чего лучше всего подходит Gemini 3.1 Flash Lite?

Gemini 3.1 Flash Lite подходит для указанных на странице типов ввода, вывода и возможностей. Перед критическим использованием проверьте реальную нагрузку.

Как рассчитывается цена Gemini 3.1 Flash Lite?

Цены указаны выше. Фактическая стоимость зависит от объёма, группы аккаунта и содержимого запроса.

Как вызвать Gemini 3.1 Flash Lite?

Используйте идентификатор модели и поддерживаемый протокол API. Примеры кода показаны, когда доступны данные использования.

Начать

Создавайте с Gemini 3.1 Flash Lite

Открыть в консоли