Astra is our most aligned model, with substantial improvements in understanding user intent.
OpenAI发布GPT-6 Astra模型,在多个专业领域基准测试中表现优异,显著提升用户意图理解能力。
入选理由:Astra在Agents’ Last Exam和AutomationBench等基准测试中达到SOTA。
概念
别名:TB4.0
综合能力评估基准
已跟踪 3 条高相关材料
最近变化
2026-09-03 · GPT-6 Astra在TerminalBench-4.0等基准测试中达到前沿水平
为什么值得关注
TerminalBench-4.0 被反复提及时,通常意味着它正在影响产品路线、开发者工作流或 AI 产业判断。这个页面把分散材料合并成一个可持续更新的观察入口。
Astra is our most aligned model, with substantial improvements in understanding user intent.
OpenAI(@OpenAI) · 8.5 分
OpenAI发布GPT-6 Astra模型,在多个专业领域基准测试中表现优异,显著提升用户意图理解能力。
Astra is useful for so many things, but I'm particularly excited to see how it transforms areas like...
Greg Brockman(@gdb) · 6.5 分
GPT-6 Astra在科学发现和复杂问题解决领域展现突破性性能,但缺乏技术细节和工程实践指导。
GPT-6 Astra is state-of-the-art on FrontierMath Tier 4, ARC-AGI 3, and TerminalBench-4.0. GPT‑6 Ast...
OpenAI(@OpenAI) · 6 分
OpenAI宣布GPT-6 Astra在多个基准测试中达到最先进水平,但缺乏技术细节和实践指导。
已收录 3 条与 TerminalBench-4.0 相关的内容,按评分排序。
OpenAI发布GPT-6 Astra模型,在多个专业领域基准测试中表现优异,显著提升用户意图理解能力。
入选理由:Astra在Agents’ Last Exam和AutomationBench等基准测试中达到SOTA。
GPT-6 Astra在科学发现和复杂问题解决领域展现突破性性能,但缺乏技术细节和工程实践指导。
入选理由:GPT-6 Astra在TerminalBench-4.0等基准测试中达到前沿水平
OpenAI宣布GPT-6 Astra在多个基准测试中达到最先进水平,但缺乏技术细节和实践指导。
入选理由:GPT-6 Astra在FrontierMath Tier 4等基准测试中表现最佳