Gemini Embedding 2 Preview 是 Google 的多模态向量化模型,发布于 2026-03-10。它把文本、图像、音频与视频转换为数值向量,向量的空间关系刻画了原始数据的语义与上下文,可直接供机器学习流程和大模型使用。因此它可以作为检索增强生成、语义搜索、聚类、分类、去重和相似度排序的基础,一个模型即覆盖上述四种输入模态。单次请求最多接受 8K 输入 tokens,文本输入计费为 $0.20/M tokens。通过 Ofox 可使用 Gemini 协议访问。
上下文窗口
8K
最大输出 Token
8K
发布日期
2026-03-10
能力
视觉音频输入视频输入
可用供应商
Vertex
支持的协议
gemini
供应商
Vertex
输入 Token
$0.2/M
输出 Token
$0/M
图像输入
$0.45/M
音频输入
$6.5/M
视频输入
$12/M
接入协议
gemini
代码示例
from google import genaiclient = genai.Client(api_key="YOUR_OFOX_API_KEY",http_options={"api_version": "v1beta", "base_url": "https://api.ofox.ai/gemini"},)response = client.models.embed_content(model="google/gemini-embedding-2-preview",contents="Hello, world!",)print(response.embeddings[0].values[:5])
相关模型
常见问题
Google: Gemini Embedding 2 Preview 在 Ofox.ai 上的价格为输入 $0.2/M/百万 Token,输出 $0/百万 Token。按量计费,无月费。
Google: Gemini Embedding 2 Preview 支持 8K Token 的上下文窗口,最大输出 8K Token,可处理大型文档并维持长对话。
只需将 base URL 设置为 https://api.ofox.ai/v1,并使用你的 Ofox API Key。API 兼容 OpenAI 格式——只需更改 base URL 和 API Key 即可。
Google: Gemini Embedding 2 Preview 支持以下能力:视觉, 音频输入, 视频输入。通过 Ofox.ai 统一 API 访问所有功能。