provider
Azure AI Foundry
直接答案直连 Foundry 时请求中的 model 通常是部署名,不是目录模型 ID;生产优先使用 Microsoft Entra ID。
更新 · 审核信息
先分清平台、模型原厂和部署
官方现称 Microsoft Foundry,Azure AI Foundry 是仍常见的旧名称。它是 Azure 上的多厂商目录与部署平台,不是所有目录模型的原厂。Azure OpenAI、Microsoft 模型及合作伙伴模型可能使用不同条款、区域、接口和内容安全配置;本站 /v1/chat/completions 只是已配置渠道的网关协议。
请求通常使用部署名
在 Foundry 中先把目录模型部署成一个 Azure 资源,并为 deployment 自定义名称。请求的 model 通常填部署名,而不是目录显示的模型 ID;该部署同时固定模型版本、容量类型、筛选和限流配置。遇到 404 时先检查资源 endpoint、部署名和 API 版本,不要只尝试另一个模型别名。
生产优先 Microsoft Entra ID
Foundry 支持 API Key 与 Microsoft Entra ID。快速验证可用 key,但生产优先采用 Entra 的无密钥认证和 Cognitive Services User 等最小权限角色,令牌 scope 要与目标服务匹配。API Key 只能存服务端秘密管理器并定期轮换;本站令牌、Azure key 和 Entra access token 互不通用。
接口与 SDK 正在迁移
Azure OpenAI endpoint、Foundry Models endpoint、OpenAI/v1 与提供商专用路径的能力不完全相同。官方已弃用 Azure AI Inference beta SDK,并计划在 2026-08-26 退役,建议迁移到 GA 的 OpenAI/v1 与稳定 OpenAI SDK。迁移时同时核对 Base URL、部署名、API version、响应字段、工具和流事件。
计费由部署类型决定
Foundry 平台浏览本身不等于免费推理。语言、视觉或音频可按 token 或单模型计量单位收费;Provisioned Throughput、托管计算与微调模型还可能产生预置容量、训练和持续托管费用。给每个部署设置预算、Cost Management、Azure Monitor 和用量告警,并在删除实验部署前确认是否仍有托管资源。
429、错误与安全
401/403 检查 Entra scope、角色、key 与模型权限,404 检查 endpoint 和部署名。429 可能来自 TPM/RPM、PTU 已满或共享容量,应遵循 retry-after-ms,限制并发并做有界退避;持续问题再调整 quota 或部署类型。记录请求 ID、实际模型版本、区域和筛选结果,内容安全不替代应用自身授权、审计与隐私控制。
已核验厂商目录
按能力类型查看最新模型
这里展示厂商官方目录中的具体型号,不代表本站一定已开放;可调用 ID、端点和价格请以模型广场为准。
文本、推理与代码
-
gpt-5.6-sol稳定Microsoft Foundry 托管的 OpenAI GPT-5.6 旗舰推理与编码型号。
-
gpt-5.6-terra稳定Microsoft Foundry 托管的 GPT-5.6 均衡型号。
图像生成与编辑
-
gpt-image-2稳定Microsoft Foundry 托管的 OpenAI 最新图像生成与编辑型号。
视频生成与编辑
-
sora-2预览Microsoft Foundry 托管的 OpenAI 视频生成预览型号。
语音与音频
-
gpt-realtime-2.1稳定Microsoft Foundry 托管的 OpenAI 实时语音交互型号。
-
gpt-live-transcribe稳定Microsoft 文档当前推荐的 OpenAI 实时转写型号。
向量、检索与重排
-
text-embedding-3-large稳定Microsoft Foundry 托管的 OpenAI 高能力文本向量型号。
适用场景
- Azure OpenAI 托管
- 多厂商模型目录
- 企业治理与区域部署
API 协议
/v1/chat/completions
FAQ
Foundry 请求里的 model 应填目录模型 ID 还是部署名?
通常填你创建的 deployment name。部署绑定模型、版本、容量和内容筛选;直接复制目录 ID 容易导致 404 或调用错误的部署。
Foundry 生产环境应该用 API Key 还是 Entra ID?
生产优先使用 Microsoft Entra ID 与最小权限角色,避免长期共享密钥;API Key 适合快速验证,但仍需放在服务端秘密管理器并轮换。
为什么 Foundry 会返回 429?
可能是部署的 TPM/RPM、PTU 利用率或共享容量限制。遵循 retry-after-ms 等响应头退避,降低突发并发,再评估配额或 Provisioned Throughput。
创建 Foundry 部署后不调用也会收费吗?
取决于部署类型。按量推理通常按实际输入输出计量;预置容量或微调模型托管可能持续计费,即使暂时没有请求。
Azure AI Inference beta SDK 还能用于新项目吗?
不建议。官方已弃用该 beta SDK,并计划于 2026-08-26 退役;新集成应迁移到 OpenAI/v1 与稳定 OpenAI SDK。
关联指南
官方来源
- Azure Models Sold Directly by Azure Official
- Azure AI Foundry Model Catalog Overview Official
- Microsoft Foundry Model Endpoints Official
- Microsoft Foundry Entra ID Authentication Official
- Microsoft Foundry Cost Management Official
- Azure OpenAI Quota and 429 Guidance Official
兔子API