Skip to Content
GuidesVue d’ensemble

Guides de développement

Une fois l’API opérationnelle, trouvez le guide correspondant à ce que vous voulez faire. Chaque guide fournit des exemples exécutables ; les protocoles couverts sont indiqués dans chaque page.

Fonctionnalités de base

Définissez « comment le modèle répond » : affichage progressif, appel de vos fonctions, réponse dans un format fixe, compréhension des images.

Je veux…GuidePoints clés
Afficher la réponse au fil de l’eau, sans attendre la génération complèteRéponses en streamingDiffusion SSE ; inclut la reconnexion et l’appel de fonctions en streaming
Faire appeler mes fonctions ou des API externes par le modèleAppel de fonctionsDéfinir tools ; appels parallèles et tool_choice pris en charge
Obtenir une sortie toujours au format JSONSortie structuréeContraintes JSON Mode et JSON Schema
Faire analyser des images par le modèleCompréhension visuelleURL d’image ou Base64, comparaison de plusieurs images possible

Coûts et stabilité

Payer moins pour les mêmes requêtes et éviter les interruptions en cas de problème.

Je veux…GuidePoints clés
Réduire le coût de longs prompts envoyés de façon répétéeCache de promptsMise en cache des préfixes répétés, moins de coûts en tokens et de latence
Réutiliser un long contexte Gemini d’une requête à l’autreCache explicite GeminiCréer et référencer activement des cachedContents, pour des hits plus déterministes
Choisir le fournisseur qui traite la requêteRoutage des fournisseursRoutage automatique par défaut ; provider.type pour imposer un fournisseur
Basculer automatiquement vers un modèle de secours en cas d’erreur du modèle principalRepli automatiqueprovider.fallback, jusqu’à 3 modèles de secours

En cas d’erreur

Commencez ici lorsqu’une requête échoue, est limitée ou est bloquée.

Je rencontre…GuidePoints clés
Une erreur, et je veux savoir comment la traiter et s’il faut réessayerGestion des erreursCodes d’état, format des erreurs, backoff exponentiel et délais d’expiration
429 Too Many RequestsLimites de débit100 RPM par défaut, cumulés par équipe ; lire les en-têtes de réponse pour savoir combien de temps attendre
Une requête bloquée ou suspendue par la sécurité des contenusSécurité des contenusRègles de déclenchement, durée de suspension et reprise

SDK et frameworks

Intégrez OfoxAI dans votre code avec un SDK ou un framework existant : seules l’URL de l’API et la clé changent.

J’utilise…Guide
Le SDK officiel OpenAI (migration d’un projet existant)OpenAI SDK
LangChainLangChain
LlamaIndexLlamaIndex
Last updated on