GPT-5.6 now available in Microsoft Foundry

TL;DR · AI 摘要
微软在Microsoft Foundry平台推出GPT-5.6模型系列及亚太数据区,提供生产级AI代理服务,助力企业将AI从实验转向生产。
核心要点
- GPT-5.6 Sol/Terra/标准版模型已支持亚太区域数据合规需求
- Foundry生产代理服务集成Microsoft 365 Copilot和Teams
- 超过10万组织正在使用Microsoft Foundry构建AI代理
结构提纲
按章节快速跳转。
思维导图
用一张图看清主题之间的关系。
查看大纲文本(无障碍 / 无 JS 友好)
- Microsoft Foundry更新
- GPT-5.6模型系列
- Sol/Terra/标准版
- 亚太数据区
- 区域合规处理
- 生产代理服务
- 托管代理
- 365集成
金句 / Highlights
值得收藏与分享的关键句。
超过100,000组织正在使用Microsoft Foundry构建AI代理
亚太数据区使企业可在区域内处理数据并满足合规要求
生产代理服务直接集成Microsoft 365 Copilot和Teams
- * *
只有当AI真正融入实际系统时,才能创造价值——这些系统必须可靠、可观测,并与业务成果保持一致。目前已有超过10万家企业基于 Microsoft Foundry 进行开发,Adobe、Telefónica 和 Tata Consultancy Services 等公司已开始在生产环境中运行智能代理。
在 Microsoft Build 大会上,我们为智能代理时代提出了一个简单的承诺:开发者应能够在其现有工作环境中构建智能代理,在可信赖的基础设施上运行这些代理,并将其交付给需要的人——而无需拼接多个孤立平台。今天,这一愿景通过 Microsoft Foundry 的三组更新从路线图变为现实,现已正式发布:
- OpenAI 最新前沿模型系列:GPT-5.6 Sol、GPT-5.6 Terra 和 GPT-5.6——分别针对不同工作负载进行优化,可在标准全球区和标准数据区使用。
- 亚太数据区,为亚太地区客户提供区域性选项,可在区域内运行前沿 OpenAI 模型并保持数据处理的本地化。
- 生产级智能代理:通过 Foundry Agent Service 提供,包括 托管代理、工具箱 以及 发布至 Microsoft 365 Copilot 和 Microsoft Teams 的能力。
这些功能将前沿模型、生产级智能代理运行时、企业级身份验证、安全合规控制以及 Microsoft 365 的广泛分布整合到单一平台中,帮助组织无需拼接多个工具和服务即可从实验阶段直接过渡到生产环境。
为什么 Foundry 是最佳智能代理平台
Microsoft Foundry 是微软构建、运行、治理和分发 AI 智能代理的端到端平台。Foundry 通过三大支柱整合了企业将智能代理投入生产所需的能力:
- 构建:模型和框架开放灵活。
- 生成:连接企业数据、工具和用户。
- 治理:安全可控,优化长期价值。
这些支柱在最新 Foundry 更新中深度融合,帮助组织在单一平台上构建、运行和扩展生产级智能代理。
在行业领先的端到端 AI 平台上使用任意框架和模型构建
智能代理开发始于开发者已熟悉的环境——GitHub Copilot 和 Microsoft Visual Studio (VS) Code,通过 Foundry Toolkit for VS Code 和 Foundry skill 实现对 Foundry 的部署。无论团队使用 Microsoft Agent Framework、GitHub Copilot SDK(现已正式发布)还是 Claude Agent SDK,Foundry 都是生产环境的最终目标——这一切都始于选择合适的模型。
为合适的任务选择合适的模型
一个代理的能力取决于其背后的模型推理能力。微软Foundry为组织提供了一个统一平台,使其能够访问行业领先的前沿模型、开源模型和任务专用模型,让团队为每种工作负载选择合适的模型。
今天,我们宣布OpenAI的GPT-5.6系列模型在微软Foundry模型和微软Foundry代理服务中正式上线:
- GPT-5.6 Sol 提供迄今为止最先进的推理能力,支持扩展推理、智能代理工作流程和代码密集型场景,适用于最苛刻的企业级工作负载。
- GPT-5.6 Terra 是一款均衡模型,适用于日常任务,在成本更低的情况下提供与GPT-5.5相当的性能,非常适合在企业范围内扩展智能应用。
- GPT-5.6 Luna 是该系列中速度最快、成本最低的模型,非常适合处理高吞吐量且对延迟敏感的工作负载。
GPT-5.6系列模型使组织能够根据特定业务场景灵活匹配模型能力、成本和性能需求,而不是强制将所有工作负载统一到单一模型上。
客户一直告诉我们,获取新模型的重要性与模型质量同样关键。因此,我们通过全球标准和全球优先处理(覆盖现有28个全球区域、数据区标准以及从第一天起的全球预置),使GPT-5.6——最新模型——对所有客户开放。这使客户能够在已构建、部署和扩展应用的地区,立即采用最新的前沿AI创新。
Sol、Terra和Luna的GPT-5.6定价
下表列出了微软Foundry中Sol、Terra和Luna的GPT-5.6定价。请使用此定价信息比较模型选项并规划部署成本:
模型部署定价(美元/百万个标记) 输入 | 输出 --- | --- GPT-5.6 Sol | 标准全球 5.00 | 30.00 GPT-5.6 Terra | 标准全球 2.50 | 15.00 GPT-5.6 Luna | 标准全球 1.00 | 6.00
在您的业务运营地区运行前沿AI
更多模型和更多地区的可用性只是平台扩展的一半意义。另一半意义在于提供更多的合规运行场所。这正是亚太数据区所实现的目标。今天,我们还宣布微软Foundry亚太(APAC)数据区正式上线,使亚太客户能够在保持数据处理位于亚太地区的同时运行前沿OpenAI模型,无需单独搭建环境,也无需等待能力升级。
通过Foundry提供的全球、数据区和区域部署选项,组织可以在满足主权、合规、性能和扩展需求的同时,保持跨环境的一致开发和运营体验。
随着金融机构采用AI,负责任的数据处理成为建立信任的基础。微软Foundry的亚太数据区使我们能够在保持数据处理区域锚定的同时,按规模访问先进的AI模型。这让我们有信心负责任地加速AI创新,并强化我们成为亚太领先AI驱动型金融平台的雄心。
——Viva Republica(Toss)首席数据和AI官(CDAO)Hongsoo Kim
通过以行动为导向、上下文感知的代理产生影响
一个功能强大的模型只是起点。要让其在生产环境中发挥作用,代理还需要运行环境、对业务知识的掌握、对其工具的受控访问权限、能够跨交互持续存储并响应现实事件的记忆,以及连接使用者的路径。Foundry 将这些能力作为内置功能提供,旨在协同工作。
- 部署位置:**托管代理**现已在 Foundry Agent Service 中全面开放。 开发者现在可以使用统一的生产运行时环境来部署基于任何框架和工具包(如 Microsoft Agent Framework、GitHub Copilot SDK、LangGraph、OpenClaw、Hermes 等)构建的代理。平台从上线起即具备企业级能力:通过 Microsoft Azure 虚拟网络(VNet)集成实现网络隔离,确保代理流量始终处于您的安全边界内。针对长期运行的工作负载,托管代理中新增的弹性任务支持功能(**内测版**)使构建具备故障恢复能力的代理更加简单。平台提供保持沙箱运行的基础能力,您的工具包负责检查点记录,二者协同工作可让代理在重启后自动恢复。最终实现:多轮对话、推理循环和人工介入审批可从中断处无缝继续,无需开发者自行构建恢复、重试和状态管理机制。
- 交互方式:**集成 Voice Live 的托管代理**现已全面开放。 开发者可以使用 Azure VoiceLive SDK,为其基于任意框架构建的代理添加实时语音交互能力。
- 知识能力: Foundry 让代理能够访问企业知识库,而无需开发者从零开始构建复杂的检索流水线。Microsoft IQ 整合了 **Work IQ**(用于实时感知 Microsoft 365 环境)、**Fabric IQ**(用于结构化数据)和 **Web IQ**(用于低延迟实时网络数据)三大能力,所有能力均通过 **Foundry IQ** 统一接入,该组件现已全面开放,作为每个 Foundry 代理背后具备 SLA 保障的知识层。
- 工具调用方式:**Foundry 工具箱**现已全面开放。 工具箱不再需要在每次请求时传输所有工具定义,而是动态选择最适合当前任务的工具——在大幅降低大型工具集的 token 开销的同时,为代理提供受控的、经过筛选的工具访问能力。
- 记忆与响应机制:Foundry Agent Service 中的**记忆**和**例行任务**目前处于公开预览阶段。 记忆功能(包括过程记忆、用户记忆和会话记忆)使代理能够在不同交互之间保持上下文。例行任务可按预定计划或定时器周期性触发任意代理的执行;新的基于事件的触发机制(通过连接器网关实现)现在可以让代理在上游系统发生变更(如工单提交、文件写入存储、工作流完成)时立即响应。
- 如何触达用户:**发布到 Microsoft Teams 和 Microsoft 365 Copilot**将在下周正式发布。开发人员构建的代理会部署到数亿用户已使用的应用程序中,这些应用通过身份验证、权限和策略实现自动化的流程控制。即使对于网络隔离代理也完全适用:当项目运行在私有端点后,您将通过**标准流程**而非一键按钮进行发布。代理始终保留在您的私有网络中,而微软的通道适配器则通过您自己的防火墙和反向代理连接到它。
通过可观测性和控制功能治理和优化整个 AI 生命周期
一个无法看到、改进或保障的代理程序,是无法投入生产的代理程序——因此 Foundry 将信任视为平台优先事项,而非开发者的责任。本次发布的更新完善了构建后所有环节的闭环:查看代理程序执行了什么操作、改进其性能,并证明其运行价值。
- 如何查看其操作—**追踪**和**评估**适用于托管代理程序,现已全面发布。精准查看代理程序执行了哪些操作、原因及错误发生位置,并在发布前后系统性评估其行为。
- 如何实现性能提升和成本优化—**Foundry Agent Service 中的代理程序优化器**,公开预览版。它联合测试您的提示、技能、模型和工具,自动识别更优配置——通常可在保持质量的同时切换至更小、更低成本的模型。
- 如何证明其价值—**Microsoft Foundry 中代理程序的 ROI**,私有预览版。它将代理程序的追踪记录、商业价值评估和运营成本整合为统一视图——在仪表板中展示净价值、总成本和当前 ROI 等关键指标,使客户能直观判断生产代理程序是否创造了超过运行成本的价值,并在未达到目标时深入追踪分析。
当代理程序从试点扩展到每日数千次运行时,Foundry 为团队提供控制杠杆,确保在不离开平台的前提下实现支出可控。
这一切始于选择。
- 选择部署方式。 Foundry 提供全球部署、数据区域部署和区域部署,使您能将 AI 与主权、合规性和性能需求对齐,在运行前沿模型的同时确保数据处理在区域内进行。
- 选择模型推理的付费方式。 标准、优先处理、预置吞吐量和批量四种方案,使您能在同一平台上优化敏捷性、延迟、吞吐量和成本。
在此基础上,**模型路由** 将每个请求匹配到合适的模型,**提示缓存** 减少冗余计算,**PTU 流出** 和配额优化通过使用高峰保障服务连续性。对于代理程序,Foundry 工具箱仅发送每个请求所需的工具,代理程序优化器则根据您自己的评估器调整提示、技能、工具和模型选择。
支出只是方程的一半。Foundry 中代理程序的 ROI 将商业价值、使用情况和成本整合为统一视图——使团队能直观判断生产代理程序是否创造了超过运行成本的价值,并识别成本增长超过价值增长的环节。
如需实际操作演示,请观看我们的新Microsoft Mechanics 集数了解代理程序的代币经济学。
在生产环境中:在 Foundry 上构建的团队
在 Foundry 上构建的组织并非在进行实验,而是在进行部署,从数字原生企业到全球最大的企业都在如此行动。
- Adobe 正在使用 GitHub、Foundry Agent Service 和 Azure Functions,为其应用程序部署代理,节省了大量时间和工作量,加速了生产环境的实现。
- Telefónica 已将 Microsoft Foundry 作为其企业代理平台的核心,首批代理专注于网络运营——这是电信行业最复杂、最关键的领域,覆盖 Microsoft Agent Framework、托管代理、AI Gateway 和 Azure Logic Apps。
- Tata Consultancy Services 正在使用 Foundry Agent Service 中的代理优化器,通过更结构化的方式调整提示,提高代理性能,帮助团队减少人工操作,同时衡量任务遵循率和执行效率的提升。
这一模式具有高度一致性:曾经需要花费数周时间进行集成、安全加固和部署代理的团队,现在只需几天即可完成,依托符合其合规标准的基础设施,通过他们已信任的工具触达用户。
入门指南
本文中提到的所有内容均可在 Microsoft Foundry 上实时体验。
请参考 文档 和 Microsoft Learn 课程。开发人员可通过 快速入门 在几分钟内上手,该指南逐步演示了如何从零开始设置、测试并部署一个生产就绪的托管代理。
查看 AI Agents for Beginners 获取包含 12 课时的课程体系,然后通过指导实验室深入学习:在 Azure 中开发 AI 代理、托管代理工作坊 (.NET)、VS Code 和托管代理工作坊的 Foundry 工具包,以及 ZavaShop 供应链工作坊。为确保代理具备坚实的品质基础,请阅读 评估 AI 代理:使用 Microsoft Foundry 的实用指南。
观看视频:Foundry Agent Service + Microsoft Agent Framework 解析—Jeff Hollan 演示了如何从部署到实际影响,实现 AI 代理的运营化。