Minimax

MiniMax-M2.5

MiniMaxBasé sur les jetons

MiniMax 的 MiniMax-M2.5 模型,支持文本输入和文本输出。支持推理、工具调用、结构化输出。

textfunction_callingtoolsjson_modestructured_outputreasoningcontext:204800
Tarif à partir de
Entree / Sortie · 1M
Contexte
204.8K
Fenêtre d'entrée maximale
Sortie max
128K
Nombre maximal de jetons par réponse
Modalités
→
Sorti
Feb 2026

Tarification par fournisseur

official
官方接口直连
Entree$0.3/ 1M
Sortie$1.2/ 1M
Lecture du cache$0.03/ 1M
Écriture cache (5m)$0.375/ 1M
Écriture cache (1h)$0.6/ 1M
Alibaba
阿里巴巴百炼官方
Entree$0.3/ 1M
Sortie$1.2/ 1M
Lecture du cache$0.03/ 1M
Écriture cache (5m)$0.375/ 1M
Écriture cache (1h)$0.6/ 1M

Capacités / Modalités prises en charge

Appel de fonctionOutilsMode JSONSortie structuréeRaisonnement
Entree
Sortie

Fournisseur & confidentialité

Fournisseur
MiniMaxDocuments
Tokeniseur
ABAB tokenizer
Licence
Proprietary (commercial)Propriétaire
Rétention des données35 joursNon utilisé pour l'entraînement amont par défaut

Performances

Accès API

Exemples de code

RequêtePOST/v1/chat/completions
Exemple de requête
Paramètres
ParamètreTypeDéfaut / plageDescription
temperature
number
=10 ~ 2
Température d'échantillonnage ; plus c'est bas, plus c'est déterministe
top_p
number
=10 ~ 1
Masse probabiliste de l'échantillonnage nucleus
max_tokens
integer>= 1Nombre maximum de jetons dans la réponse
frequency_penalty
number
=0-2 ~ 2
Pénalise la répétition des jetons fréquents
presence_penalty
number
=0-2 ~ 2
Encourage l'introduction de nouveaux sujets
stop
array—Jusqu'à 4 chaînes qui arrêtent la génération
seed
integer—Graine d'échantillonnage déterministe (meilleur effort)
n
integer
=1>= 1
Nombre de complétions à générer
stream
boolean
=false
Diffuser les jetons via Server-Sent Events
response_format
object—Forcer une sortie JSON ou conforme à un schéma
tools
array—Déclarations d'outils / fonctions que le modèle peut appeler
tool_choice
string
autononerequired
Stratégie de choix d'outil ou nom d'outil spécifique
logprobs
boolean
=false
Retourner les log-probabilités par jeton
top_logprobs
integer0 ~ 20Nombre de log-probabilités retournées par jeton
logit_bias
object—Carte de biais des logits par jeton
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Remplacer <YOUR_API_KEY> par la clé API de votre page de jetons.

Authentification

Toutes les requêtes doivent inclure Authorization: Bearer <TOKEN> . Les points de terminaison au format Anthropic acceptent à la place x-api-key .

Générez des jetons depuis la page Jetons ; vous pouvez les restreindre par modèle, groupe, IP et limites de débit.

Paramètres pris en charge

Generation parameters
ParamètreTypeDéfaut / plageDescription
temperature
number
=10 ~ 2
Température d'échantillonnage ; plus c'est bas, plus c'est déterministe
top_p
number
=10 ~ 1
Masse probabiliste de l'échantillonnage nucleus
max_tokens
integer>= 1Nombre maximum de jetons dans la réponse
frequency_penalty
number
=0-2 ~ 2
Pénalise la répétition des jetons fréquents
presence_penalty
number
=0-2 ~ 2
Encourage l'introduction de nouveaux sujets
stop
array—Jusqu'à 4 chaînes qui arrêtent la génération
seed
integer—Graine d'échantillonnage déterministe (meilleur effort)
n
integer
=1>= 1
Nombre de complétions à générer
stream
boolean
=false
Diffuser les jetons via Server-Sent Events
response_format
object—Forcer une sortie JSON ou conforme à un schéma
tools
array—Déclarations d'outils / fonctions que le modèle peut appeler
tool_choice
string
autononerequired
Stratégie de choix d'outil ou nom d'outil spécifique
logprobs
boolean
=false
Retourner les log-probabilités par jeton
top_logprobs
integer0 ~ 20Nombre de log-probabilités retournées par jeton
logit_bias
object—Carte de biais des logits par jeton
user
string—Identifiant d'utilisateur final pour la surveillance des abus

Limites de débit

FournisseurRPMTPMRPD
Alibaba930370K19K
official760304K15K

RPM = requêtes/minute, TPM = jetons/minute, RPD = requêtes/jour. Les limites s'appliquent par groupe de jetons.

Questions sur l’accès API

Tout ce qu’il faut savoir avant de créer un compte.

Découvrir d’autres modèles