model
Google Gemini
直接答案Gemini 是 Google 的多模态家族,官方目录按通用推理、低延迟、图像、视频、音频、Embedding 与 Agent 等任务列出独立型号和方法。
更新 · 审核信息
官方产品线
Gemini 官方目录不仅包含 Gemini 3 系列通用模型,也包含图像、Veo 视频、Lyria 音乐、Embedding、Computer Use、Deep Research 等专用型号。它们共享品牌但不共享一个请求协议或输出模态。
多模态能力
通用 Gemini 通过 contents/parts 组合文本、图像、音频和视频;专用模型使用各自生成方法。模型页会列出 supported generation methods,只有该列表才是函数调用、缓存或结构化输出的依据。
如何选择
复杂推理和多模态理解评估能力优先型号;交互和高频任务评估 Flash/Lite 类;图像、视频、音乐与向量必须使用专用模型。把媒体模型的价格或限制与文本 token 模型直接比较没有意义。
API 使用
原生调用使用 /v1beta/models/{model}:generateContent 或相应专用方法。本站若开放该型号,使用 Bearer 令牌;OpenAI 兼容路径可能无法表达所有 Gemini parts、安全和 Grounding 字段。
生命周期
官方目录明确标记 preview、experimental、deprecated 和 shut down。生产避免依赖即将关闭的型号,固定稳定 ID,并核验地域、文件限制、上下文、输出、安全设置和数据政策。
适用场景
- 原生多模态
- 长上下文推理
- 媒体生成
API 协议
/v1/chat/completions
FAQ
模型名是否固定?
否。官方别名可能移动,平台启用的精确 API ID 也会变化;生产应固定已验证 ID,并在模型广场单独确认可用性。
通用 Gemini 和图像、视频、音乐或 Embedding 模型怎么选?
复杂推理和多模态理解选择通用能力型号,高频交互评估 Flash/Lite 类;图像、视频、音乐和向量使用对应专用模型与生成方法。共享 Gemini 品牌不代表端点、输出或计费单位相同。
Gemini 原生 GenerateContent 和 OpenAI 兼容调用等价吗?
不等价。原生 contents/parts 可表达多模态内容和 Gemini 特有安全、Grounding 等字段,兼容层可能无法完整映射。应按模型页的 supported generation methods 选择协议并做字段级测试。
关联指南
官方来源
- Gemini Models Official
兔子API