Google

Gemini 3.1 Flash Lite

Built for multimodal understanding, coding, and long-context tasks, improving over Gemini 3.0 / 2.5 in throughput, context, and tool capabilities. Compared with GPT, Claude, and Qwen models, it is strong for unified analysis workflows across text, images, audio, video, and documents.

  • Raisonnement
  • Utilisation d’outils
  • Appel de fonctions
  • Sortie structurée
  • Contexte long

La description n’est pas encore disponible dans cette langue ; elle est affichée en anglais.

Utiliser dans la consolegemini-3.1-flash-lite

USD

Tarifs

default
Tarif standard
Entrée$0.25/1M tokensPrix de complétion$1.5/1M tokensLecture cache$1/1M tokens

Prix publics en dollars US. Le coût final peut varier selon le groupe de compte et le volume d’utilisation.

API

Exemples de code

import http.client
import json

conn = http.client.HTTPSConnection("api.tokenhot.cn")
payload = json.dumps({
   "contents": [
      {
         "role": "user",
         "parts": [
            {
               "text": "Hello"
            }
         ]
      }
   ]
})
headers = {
   'Authorization': 'Bearer <token>',
   'Content-Type': 'application/json'
}
conn.request("POST", "/v1beta/models/gemini-3.1-flash-lite:generateContent", payload, headers)
res = conn.getresponse()
data = res.read()
print(data.decode("utf-8"))

Google

Modèles associés

FAQ

Questions fréquentes

À quels usages Gemini 3.1 Flash Lite convient-il ?

Gemini 3.1 Flash Lite convient aux types d’entrée, de sortie et de capacités indiqués sur cette page. Testez vos charges réelles avant un usage critique.

Comment Gemini 3.1 Flash Lite est-il facturé ?

Les tarifs figurent ci-dessus. Le coût réel dépend du volume, du groupe de compte et du contenu de la requête.

Comment appeler Gemini 3.1 Flash Lite ?

Utilisez l’identifiant du modèle ci-dessus avec un protocole API pris en charge. Des exemples sont affichés lorsqu’ils sont disponibles.

Commencer

Créez avec Gemini 3.1 Flash Lite

Utiliser dans la console
TokenHot

La passerelle d'intelligence de frontière. Une API. 127 modèles. Latence de 0.2s. Payez uniquement ce que vous utilisez.

Tous les systèmes normaux · 99.997% de disponibilité

Entreprise

© 2026 TokenHot Inc. — Conçu pour les créateurs.