MiniMax

M2.5

MiniMax M2.5 targets long-document processing, Chinese productivity work, coding assistance, and tool-use scenarios with a 200K context window and steady text reasoning. It is a practical long-context productivity option alongside peers such as Kimi, GLM, and Qwen.

  • Contexte long
  • Utilisation d’outils

La description n’est pas encore disponible dans cette langue ; elle est affichée en anglais.

USD

Tarifs

default
Tarif standard
Entrée$0.302/1M tokensPrix de complétion$1.207698/1M tokensLecture cache$0.029415/1M tokensÉcriture cache$0.367504/1M tokens

Prix publics en dollars US. Le coût final peut varier selon le groupe de compte et le volume d’utilisation.

API

Exemples de code

curl --location --request POST 'https://api.tokenhot.cn/v1/chat/completions' \
--header 'Authorization: Bearer <token>' \
--header 'Content-Type: application/json' \
--data-raw '{
    "model": "MiniMax-M2.5",
    "messages": [
        {
            "role": "user",
            "content": "What model are you"
        }
    ]
}'

MiniMax

Modèles associés

FAQ

Questions fréquentes

À quels usages M2.5 convient-il ?

M2.5 convient aux types d’entrée, de sortie et de capacités indiqués sur cette page. Testez vos charges réelles avant un usage critique.

Comment M2.5 est-il facturé ?

Les tarifs figurent ci-dessus. Le coût réel dépend du volume, du groupe de compte et du contenu de la requête.

Comment appeler M2.5 ?

Utilisez l’identifiant du modèle ci-dessus avec un protocole API pris en charge. Des exemples sont affichés lorsqu’ils sont disponibles.

Commencer

Créez avec M2.5

Utiliser dans la console
TokenHot

La passerelle d'intelligence de frontière. Une API. 127 modèles. Latence de 0.2s. Payez uniquement ce que vous utilisez.

Tous les systèmes normaux · 99.997% de disponibilité

Entreprise

© 2026 TokenHot Inc. — Conçu pour les créateurs.