T
traeai
登录

公司

lmarena.ai

别名:lmarena_ai

发布Agent Arena相关研究的AI公司

已跟踪 5 条高相关材料

TraeAI 观察

相关材料

已收录 5 条与 lmarena.ai 相关的内容,按评分排序。

New open model: MiniMax M3 by @MiniMax_AI is live in the Arena!

Find it across Text, Vision, Docume...

新开源模型:MiniMax M3 已上线 Arena!

lmarena.ai(@lmarena_ai)124 字 (约 1 分钟)
75

MiniMax M3 是首个开源权重模型,同时支持文本、视觉、文档和代码任务,在 SWE-Bench Pro 等基准测试中表现优异,上下文长度达 1M tokens。

入选理由:MiniMax M3 在 SWE-Bench Pro 达到 59.0%,Terminal Bench 2.1 达 66.0%,是当前开源模型中编程能力最强之一。

精选推文#MiniMax#开源模型#多模态#SWE-Bench英文
Asked Gemini 3.5 Flash to render the Petra Treasury. It built the entire stone canyon around it - so...

Gemini 3.5 Flash在渲染佩特拉宝库时自主构建了周围石峡谷并添加环境音效,展现了超越其他前沿模型的能动性行为。

入选理由:Gemini 3.5 Flash在渲染任务中自主构建了周围石峡谷,而其他模型未做到这点

精选推文#Gemini 3.5 Flash#AI生成#lmarena.ai英文
GLM-5.2 (Max) also moves the Pareto Frontier for Code Arena: Frontend.

GLM-5.2 (Max) also moves the Pareto Frontier for Code Arena: Frontend.

lmarena.ai(@lmarena_ai)53 字 (约 1 分钟)
60

GLM-5.2 (Max)在前端代码生成领域取得进展,但信息密度较低,缺乏具体机制和数据支撑。

入选理由:GLM-5.2 (Max)在前端代码生成领域取得进展。

精选推文#GLM-5.2#前端#AI模型英文

跨材料问答 · lmarena.ai

回答基于:lmarena.ai 相关 5 条材料
    0 / 500

    AI 可能会生成不准确的信息,请核实重要内容