MiniMax M2.1 Lightning est le palier de service axé sur la vitesse de MiniMax M2.1, le modèle léger et à l'état de l'art de MiniMax pour le codage, les workflows agentiques et le développement d'applications modernes. Avec seulement 10 milliards de paramètres activés, il réalise un bond important en capacités réelles tout en conservant une latence, une évolutivité et une efficacité de coût exceptionnelles ; le palier Lightning privilégie la rapidité des réponses, avec une sortie facturée 2,40 $/M contre 0,30 $/M en entrée et des lectures de cache à 0,03 $/M. Il prend en charge le raisonnement, l'appel de fonctions, la mise en cache des prompts et la recherche web. Fenêtre de contexte : 200K tokens, sortie : 131K. Disponible via les protocoles OpenAI et Anthropic.
Providers
/v1/chat/completions/v1/responsesExemples de code
from openai import OpenAIclient = OpenAI(base_url="https://api.ofox.ai/v1",api_key="YOUR_OFOX_API_KEY",)response = client.chat.completions.create(model="minimax/minimax-m2.1-lightning",messages=[{"role": "user", "content": "Hello!"}],)print(response.choices[0].message.content)