OpenAI GPT-5.6 Sol, Terra, and Luna are now generally available on Amazon Bedrock

TL;DR · AI 摘要
OpenAI GPT-5.6 Sol, Terra, and Luna are now generally available on Amazon Bedrock Artificial Intelligence OpenAI GPT-5.6...
核心要点
- 主题聚焦:OpenAI GPT-5.6 Sol, Terra, and Luna are now gene
- 来源:AWS Machine Learning Blog,建议结合原文判断细节。
- AI 分析暂不可用,本条为保底评分与摘要。
OpenAI GPT-5.6 Sol、Terra 和 Luna 现已通过 Amazon Bedrock 提供服务 | 人工智能
OpenAI GPT-5.6 Sol、Terra 和 Luna 现已通过 Amazon Bedrock 提供服务
基于 OpenAI 最先进的模型家族,借助 Amazon Bedrock 的新一代推理引擎进行构建。
随着自主代理和 AI 驱动产品规模的扩大,组织需要能够在数百个步骤中可靠运行的前沿智能技术,从交付生产代码的编程代理,到探索新型攻击面的网络安全研究,再到端到端分析完整基因序列的基因组工作流程。这些工作负载处理敏感数据,需要在不可预测的负载下保持稳定的吞吐量,并且运行在数据驻留和安全性不可妥协的环境中。
今天,OpenAI 的 GPT-5.6 Sol、Terra 和 Luna 已通过 Amazon Bedrock 正式提供服务,将 OpenAI 目前最先进的模型家族引入 Amazon Bedrock 专为高性能、安全性和可靠性打造的新一代推理引擎。GPT-5.6 为智能与效率设立了新标准,使您能在更短时间内以更少的资源解决更复杂的问题。定价与 OpenAI 官方价格一致,使用量将计入您现有的 AWS 承诺。
从旗舰推理到快速推理的前沿智能
GPT-5.6 引入了 OpenAI 的新命名体系:数字标识模型代际,而 Sol、Terra 和 Luna 标识具有持续演进能力的耐久性能层级。
- GPT-5.6 Sol 是旗舰推理模型,也是 OpenAI 目前最强大的模型。根据 OpenAI 的数据,Sol 在人工分析编程代理指数(Artificial Analysis Coding Agent Index)上达到 80 分(比第二佳模型高出 2.8 分),同时使用的输出令牌少于一半,耗时不到一半,成本降低约三分之一,在 ExploitBench 安全研究基准测试中得分 73.5%(相比之下,GPT-5.5 在相似输出令牌预算下得分为 47.9%)。在涵盖 55 个领域的长期专业工作流程评估“Agents’ Last Exam”中,Sol 创下 53.6 分的新高,比第二佳模型高出 13.1 分。在中等推理强度下,其得分仍领先 11.4 分,且预估成本仅为后者的四分之一。Sol 还引入了最大推理强度模式,允许您为复杂任务提升计算资源。适用于自主编程代理、漏洞研究、药物发现工作流程以及需要深度多步骤推理的任务。
- GPT-5.6 Terra 是适用于日常生产工作的平衡型模型。相比 GPT-5.5,Terra 在成本更低的情况下提供更优性能。适用于代码生成、内容工作流程、结构化数据提取以及需要强大推理能力但无需旗舰级定价的一般性代理任务。
- GPT-5.6 Luna 是快速且经济的模型。适用于分类、摘要、路由和实时应用等对延迟和每令牌成本敏感的高吞吐量推理任务。
通过这三个层级,您可以根据每种工作负载的实际情况,精准匹配模型性能与成本。GPT-5.6 系列模型相比前代使用更少的输出令牌完成任务,在每美元性能上实现显著提升。
专为规模扩展打造的推理引擎
代理流量通常具有突发性:一个用户请求可能触发数百次模型调用,且随着使用量增长,需求可能迅速变化。Amazon Bedrock 的新一代推理引擎通过聚合容量来吸收需求峰值,同时隔离每个客户的吞吐量。这减少了在共享容量和可预测的应用性能之间做出取舍的必要性。区域内部推理将请求保留在您指定的 AWS 区域内,帮助团队满足严格的数据驻留要求。
具有代理和多步骤的工作负载在调用之间会重复大量上下文内容。系统指令、工具定义和参考文件通常保持不变,只有最新输入会发生变化。Amazon Bedrock 上的 GPT-5.6 引入了带显式缓存断点的提示缓存功能,以利用这种重复性。您可以使用缓存断点标记提示中可重复使用的部分,Amazon Bedrock 会在后续共享相同上下文的请求中复用已处理的上下文,因此每次调用只需为新工作付费。缓存输入按 90% 的折扣计费,并且至少保留 30 分钟可供重复使用。这一时长足以覆盖单次代理运行生成的请求突发,而不会随着工作负载扩展导致成本叠加。
强大的安全防护与硬件强制安全
更强大的模型需要更严格的安全保障。GPT-5.6 集成了 OpenAI 目前最强大的安全防护体系,该体系基于迄今为止最全面的评估周期构建,结合了人工红队测试与大规模自动化测试。安全防护体系包括模型级别的禁止活动拒绝机制、实时滥用分类器、持续监控以及针对持续模式的账户级执行。
在 Amazon Bedrock 上,这些防护措施建立在硬件级安全之上。Amazon Bedrock 在芯片层面强制实施零操作员访问(ZOA)安全模型,因此没有任何 AWS 操作员可以访问您的提示或完成内容。每个模型调用均在您的 AWS 身份和访问管理(IAM)策略下运行,位于您的虚拟私有云(VPC)内部,并在 AWS CloudTrail 中记录日志。数据边界策略可防止跨账户和网络边界的泄露。根据模型提供商的要求,被分类器标记的流量数据将保留最多 30 天,用于自动化滥用检测。
更多使用 GPT-5.6 的方式
除了 GPT-5.6,OpenAI 还推出了 ChatGPT Work,这是 ChatGPT 中用于处理更大、更复杂任务的代理。更新后的 ChatGPT 桌面应用(适用于 Mac 和 Windows)将 Chat、Work 和 Codex 集成于统一的体验中,提供两个专用代理以应对不同类型的任务:
- Work:新推出的 Work 代理专为更大、多步骤任务设计。它可以跨应用和文件收集信息,使用网络,创建完成的材料(如表格、幻灯片、文档和网站),并能长时间处理复杂项目。用户可以跟踪其进度、更改方向并批准重要操作。
- Codex:Codex 仍然是面向开发者和技术专业人士的强大代码代理。它可以与本地文件、仓库、终端、开发工具和开发环境配合,编写功能、修复漏洞、运行测试并打开拉取请求。
用户可以通过 Amazon Bedrock 上的 Responses API 配置应用使用 GPT-5.6。在 Amazon Bedrock 上运行 OpenAI 最先进的模型家族,结合 AWS 的安全性和扩展能力,获取前沿智能。
立即开始
GPT-5.6 Sol 可在以下 AWS 区域使用:美国东部(北弗吉尼亚)和美国东部(俄亥俄)。GPT-5.6 Terra 和 Luna 可在美国东部(北弗吉尼亚)、美国东部(俄亥俄)和美国西部(俄勒冈)使用。
通过 Amazon Bedrock 控制台或通过 Responses API 以编程方式开始使用 Sol、Terra 和 Luna。欲了解更多信息,请参阅 Amazon Bedrock 文档并访问 Amazon Bedrock 产品页面。
关于作者
'\"`