Skip to Content
開発ガイド概要

開発ガイド

API の疎通を確認できたら、やりたいことに合わせて該当するガイドをご覧ください。各ガイドには実行可能なサンプルを掲載しています。対応するプロトコルは各ページの記載を参照してください。

基本機能

モデルの「応答の仕方」を制御します。逐次出力、関数の呼び出し、固定フォーマットでの返却、画像の理解などです。

やりたいことガイドポイント
生成完了を待たずに応答を逐次表示したいストリーミングSSE によるプッシュ。切断時の再接続やストリーミング中の関数呼び出しも解説
モデルに自分の関数や外部 API を呼び出させたいファンクションコーリングtools を定義。並列呼び出しと tool_choice に対応
出力を JSON に固定したい構造化出力JSON Mode と JSON Schema による制約
モデルに画像を読み取らせたいビジョン画像の URL または Base64。複数画像の比較も可能

コスト削減と安定性

同じリクエストをより低コストで実行し、障害時にも処理を止めないための機能です。

やりたいことガイドポイント
長いプロンプトを繰り返し送信するので、コストを下げたいプロンプトキャッシュ繰り返し使うプレフィックスをキャッシュし、トークン費用とレイテンシを削減
Gemini で大量のコンテキストを複数のリクエストで再利用したいGemini 明示的キャッシュcachedContents を明示的に作成・参照し、確実にヒットさせる
リクエストを処理するプロバイダーを指定したいプロバイダールーティングデフォルトは自動ルーティング。必要に応じて provider.type で指定
メインモデルでエラーが起きたら代替モデルに自動で切り替えたいフォールバックprovider.fallback で最大 3 つの代替モデルを指定

エラーが発生したとき

リクエストが失敗した、レート制限にかかった、またはブロックされた場合は、まずこちらをご確認ください。

状況ガイドポイント
エラーの対処方法やリトライの要否を知りたいエラーハンドリングステータスコード、エラー形式、指数バックオフとタイムアウト設定
429 Too Many Requestsレート制限デフォルトは 100 RPM でチーム単位の合算。レスポンスヘッダーから待機時間を判断
リクエストがコンテンツセーフティによりブロック・一時停止されたコンテンツセーフティ発動条件、停止期間、復旧方法

SDK とフレームワーク

既存の SDK やフレームワークでコードから接続します。変更するのは API アドレスと Key だけです。

利用しているものガイド
OpenAI 公式 SDK(既存プロジェクトの移行)OpenAI SDK
LangChainLangChain
LlamaIndexLlamaIndex
Last updated on