AWS Machine Learning Blog

Bring near-Astra intelligence to everyday work with GPT-6.1 Sol on Amazon Bedrock

8.5内容质量
Bring near-Astra intelligence to everyday work with GPT-6.1 Sol on Amazon Bedrock

TL;DR · AI 摘要

GPT-6.1 Sol在Amazon Bedrock上发布,提供更高效的推理能力,成本降低至GPT-6 Astra的五分之一,性能提升6.4%。

核心要点

  • GPT-6.1 Sol成本为GPT-6 Astra的20%,推理效率提升6.4%
  • 支持软件工程全流程,包括代码生成、测试和文档分析
  • 通过Codex和Agent Toolkit实现AWS服务集成

结构提纲

按章节快速跳转。

  1. GPT-6.1 Sol在Amazon Bedrock正式上线,提供更强推理能力。

  2. 相比GPT-6 Astra,成本降低80%,性能提升6.4个百分点。

  3. 支持软件工程全流程、文档分析和跨系统工具协调。

  4. 基于优化的推理引擎,集成Codex和Agent Toolkit实现AWS服务连接。

思维导图

用一张图看清主题之间的关系。

查看大纲文本(无障碍 / 无 JS 友好)
  • GPT-6.1 Sol发布
    • 性能优势
      • 成本降低80%
      • 性能提升6.4%
    • 应用场景
      • 软件工程全流程
      • 文档分析
      • 跨系统工具协调
    • 技术集成
      • Codex开发工具
      • AWS Agent Toolkit

金句 / Highlights

值得收藏与分享的关键句。

#AWS#GPT#AI#Bedrock#Codex
打开原文

通过 Amazon Bedrock 上的 GPT-6.1 Sol 将近 Astra 级智能融入日常工作 | 人工智能

通过 Amazon Bedrock 上的 GPT-6.1 Sol 将近 Astra 级智能融入日常工作

GPT-6.1 Sol 现已正式在 Amazon Bedrock 上发布,为频繁运行的编码、计算机使用和专业工作负载带来更强的推理能力。

要完成一项任务,AI 代理可能需要收集信息、使用工具、测试不同方法、从错误中恢复并验证结果。每个决策都会影响后续发展。错误的判断可能在代理得出有用结果前增加模型交互、工具调用、延迟和人工干预。

AI 代理的经济性贯穿整个任务过程。令牌价格影响每次交互的成本,而推理质量则影响工作所需的交互次数以及是否导向成功结果。任务总成本取决于这两者的综合影响。

今天,GPT-6.1 Sol 已正式在 Amazon Bedrock 上发布,其基于为大规模性能、安全性和可靠性设计的推理引擎运行。作为 GPT-6 Sol 的重大升级,它在代理编码、计算机使用和专业工作中表现出色。根据 OpenAI 的数据,它以每项任务成本仅为 GPT-6 Astra 的五分之一,在 DeepSWE v1.1 测试中达到接近 Astra 级的智能水平。同时,其在推理效率低于 GPT-6 Sol 的情况下,将最佳得分提升了 6.4 个百分点。

在智能代理工作中应用更强的推理能力

更高效地导航软件工程工作流

软件工程展示了推理质量如何影响整个工作流。代理可能需要理解陌生的代码库、追踪依赖关系、确定修改位置并验证实现。根据 OpenAI 的数据,GPT-6.1 Sol 在 DeepSWE v1.1 测试中,每项任务成本仅为 GPT-6 Astra 的五分之一。同时,其在推理效率低于 GPT-6 Sol 的情况下,将最佳得分提升了 6.4 个百分点。

Codex 可将这种推理能力应用于完整的开发周期。您可以配置 Codex 使用 Amazon Bedrock 上的 GPT-6.1 Sol 完成从调研、实现到测试的各项工作。Codex 与代码库、本地文件、终端和开发工具协同工作,用于编写功能、修复漏洞和运行测试。您可以通过桌面应用、CLI 和支持的 IDE 访问 Codex。对于 AWS 开发,AWS Agent Toolkit 可通过单条终端指令将 Codex 连接到 AWS 文档、API 和服务。

在文档和工具中将信息转化为行动

当代理需要解读复杂文档、选择适当工具并根据条件变化进行调整时,相同的推理能力同样适用。根据 OpenAI 的数据,GPT-6.1 Sol 在复杂文档分析方面接近 GPT-6 Astra 的水平,并在跨业务工具完成多步骤工作流时优于 GPT-6 Sol。

您可以通过现成的体验或自主构建的应用程序应用这些能力。在桌面应用中,ChatGPT Work 可跨文件和应用程序收集信息并生成最终交付成果。通过支持的 Amazon Bedrock API,您还可以构建内部工具(如文档合成工具)、跨系统协作的代理以及评估多输入的客户面向应用。

跨工具高效协作还需要代理能够识别工具失败、操作受限或信息缺失的情况。传达这些限制可使应用程序或用户在代理继续使用不完整信息或采取非预期操作前进行干预。根据 OpenAI 的数据,GPT-6.1 Sol 在透明度、用户意图和明确限制等具有挑战性的评估中,相比 GPT-6 Sol 有所改进。

在使用 Amazon Bedrock 提供的 API 进行开发时,您可以定义模型可用的工具。您还可以确定应用程序在需要审批或无法完成操作时的响应方式。这些应用程序级别的控制机制与模型改进相辅相成,有助于在工作流到达关键决策点时保持人员参与。

在 Amazon Bedrock 上运行 GPT-6.1 Sol

Amazon Bedrock 提供基础设施和控制机制,用于在生产环境中运行 GPT-6.1 Sol。您可以通过 AWS 身份和访问管理 (IAM) 策略管理模型访问权限,并通过 AWS CloudTrail 审计调用记录。为帮助保持流量在您的网络边界内,您可以使用由 AWS PrivateLink 提供支持的虚拟私有云 (VPC) 端点。推理在硬件隔离的基础设施上运行,且没有操作员访问权限,即使 AWS 操作员也无法在推理过程中访问您的提示和完成内容。

您的推理数据不会用于模型训练,使用 GPT-6.1 Sol 无需同意将数据共享给 OpenAI。对于自动化滥用检测,AWS 会保留标记为分类器标记的流量最多 30 天,并通过程序进行处理。您可以通过 AWS 账户团队请求零数据保留。有关详细信息,请参阅数据保留政策。

入门指南

GPT-6.1 Sol 以每任务成本的几分之一实现了更强的推理能力,使您的代理在更少步骤内就能得出正确答案。您可以通过 Amazon Bedrock 控制台或通过支持的 Amazon Bedrock API 以编程方式启动 GPT-6.1 Sol。有关支持的 AWS 区域、端点、API、功能、推理配置文件和定价的详细信息,请参阅 Amazon Bedrock 文档。

想了解 Amazon Bedrock 如何支持您的团队吗?联系我们开始对话。

作者简介

'"`