T
traeai
登录

公司

CoreWeave

提供AI基础设施服务的科技公司

已跟踪 22 条高相关材料

TraeAI 观察

相关材料

已收录 22 条与 CoreWeave 相关的内容,按评分排序。

Why Agentic Inference Needs Prefix-Aware Routing Infrastructure

Why Agentic Inference Needs Prefix-Aware Routing Infrastructure

CoreWeave1356 字 (约 6 分钟)
85

代理推理需前缀感知路由基础设施以减少重复计算,提升性能。前缀缓存可降低TTFT但依赖基础设施支持。

入选理由:前缀缓存可减少70%的重复计算开销

精选文章#Agentic Inference#LLM Infrastructure#Prefix Caching#TTFT Optimization英文
Wayve, Decart, NEURA Robotics, Nissan: All Running Physical AI on CoreWeave

CoreWeave为物理AI提供定制化基础设施,支持Wayve、Decart等公司实现高效训练和实时推理。

入选理由:物理AI需要生成模拟训练数据,真实场景数据不足时需依赖仿真

精选文章#物理AI#CoreWeave#机器人#自动驾驶#基础设施英文
5 Lessons from Building a Multi-plane Network Fabric for Agentic AI

5 Lessons from Building a Multi-plane Network Fabric for Agentic AI

CoreWeave2287 字 (约 10 分钟)
85

构建多平面网络架构需解决Agentic AI的高并发低延迟需求,通过非阻塞设计、1:1上行链路比例和多平面分离等方案实现。

入选理由:非阻塞网络设计可避免训练峰值导致的代理链阻塞

精选文章#网络架构#AI#Kubernetes#NVIDIA#多平面网络英文
Get Started with Kimi K3 on CoreWeave Dedicated Inference

Get Started with Kimi K3 on CoreWeave Dedicated Inference

CoreWeave1076 字 (约 5 分钟)
85

CoreWeave支持部署2.8万亿参数的Kimi K3模型,提供租户隔离网关和GPU优化服务,适合需要大规模推理的用户。

入选理由:Kimi K3是2.8万亿参数的开源模型,支持百万级上下文窗口和视觉理解。

精选文章#Kimi K3#CoreWeave#模型部署#Dedicated Inference#AI推理英文
Video Captioning at scale: 600 TB in 95 minutes with Anyscale on CoreWeave

Anyscale与CoreWeave通过优化GPU基础设施,实现600TB视频数据95分钟处理完成,展示大规模视频字幕生成的工程实践。

入选理由:使用Ray和CoreWeave Kubernetes服务可将GPU集群部署时间从数月缩短至1小时

精选文章#视频处理#GPU集群#Ray#CoreWeave#Kubernetes英文
The AI Loop: Launch Day Is Day One

The AI Loop: Launch Day Is Day One

CoreWeave1456 字 (约 6 分钟)
85

AI Loop框架通过持续循环优化模型,提升效率和准确性,适合工程师关注。

入选理由:AI Loop包含运行、观察、整理、评估、改进五个步骤,形成闭环优化

精选文章#AI#机器学习#CoreWeave#Weights & Biases英文
What Comes Next: Operating and Evolving the Production AI Factory

What Comes Next: Operating and Evolving the Production AI Factory

CoreWeave1972 字 (约 8 分钟)
85

AI工厂运营的核心是优化goodput指标,CoreWeave在NVIDIA Hopper GPU上实现96%的goodput,揭示吞吐量与弹性对AI系统效率的决定性影响。

入选理由:CoreWeave在NVIDIA Hopper GPU上实现最高96%的goodput,显著提升AI训练效率

精选文章#AI工厂#NVIDIA Hopper#goodput#CoreWeave#分布式训练英文
Celebrating the One Billion Runs Milestone on Weights & Biases

Celebrating the One Billion Runs Milestone on Weights & Biases

CoreWeave1033 字 (约 5 分钟)
85

Weights & Biases达成10亿次模型训练运行里程碑,推出CoreWeave ARIA工具加速AI研究自动化。

入选理由:10亿次运行里程碑显示AI实验规模呈指数级增长

精选文章#Weights & Biases#AI实验跟踪#CoreWeave#自动化研究#模型训练英文
CoreWeave Leads MLPerf 0.7 Endpoints Benchmark with DeepSeek-R1

CoreWeave Leads MLPerf 0.7 Endpoints Benchmark with DeepSeek-R1

CoreWeave1182 字 (约 5 分钟)
85

CoreWeave在MLPerf 0.7 Endpoints基准测试中,使用68块NVIDIA Blackwell GPU实现每秒44万输出token,验证了DeepSeek-R1模型的高效推理能力。

入选理由:CoreWeave在MLPerf 0.7测试中使用68块NVIDIA Blackwell GPU实现了441,740 token/s的吞吐量

精选文章#MLPerf#DeepSeek-R1#NVIDIA Blackwell#推理服务#基准测试英文
Your Agent Is Only as Good as Your Infrastructure

Your Agent Is Only as Good as Your Infrastructure

CoreWeave1232 字 (约 5 分钟)
85

AI代理系统性能取决于基础设施质量,长流程工作流对延迟和可靠性影响显著。

入选理由:代理工作流的基础设施需求是传统聊天机器人的3-5倍

精选文章#AI代理#基础设施#系统架构#云计算英文
Why AI Factories Need Proof Before Production

Why AI Factories Need Proof Before Production

CoreWeave1746 字 (约 7 分钟)
85

AI工厂需在生产前验证基础设施可靠性,NVIDIA与CoreWeave合作提升AI计算效率。

入选理由:AI工厂需验证全栈系统连续运行能力,避免GPU资源浪费和项目延误

精选文章#AI工厂#NVIDIA#CoreWeave#AI基础设施#生产AI英文
MLCommons 图标

MLPerf Endpoints v0.7: A Foundation Release

MLCommons761 字 (约 4 分钟)
85

MLPerf Endpoints v0.7发布,提供动态、全面的AI推理基准,支持企业采购决策。

入选理由:MLPerf Endpoints v0.7支持自动化提交和实时结果可视化

精选文章#MLPerf#AI基准测试#推理性能#MLCommons英文
A Data Center Should Make Its Community Stronger

A Data Center Should Make Its Community Stronger

CoreWeave491 字 (约 2 分钟)
85

数据中心应与社区合作,通过负责任的开发带来经济和基础设施利益,同时避免将成本转嫁给用户。

入选理由:CoreWeave签署美国用户保护承诺,确保社区不承担能源成本

精选文章#数据中心#社区参与#可持续发展#企业社会责任英文
How AI Agents on CoreWeave Help Process F1® Radio in Near Real Time

How AI Agents on CoreWeave Help Process F1® Radio in Near Real Time

CoreWeave1348 字 (约 6 分钟)
85

CoreWeave与Aston Martin Aramco合作,利用AI代理实时处理F1无线电通信,提取关键信息辅助比赛策略,解决海量音频数据处理难题。

入选理由:F1无线电处理需应对38万单词/50小时音频的实时分析挑战

精选文章#AI代理#实时处理#F1赛车#CoreWeave#Aston Martin Aramco英文
Liquid-Cooled Switching Doubles AI Network Bandwidth Per Rack

Liquid-Cooled Switching Doubles AI Network Bandwidth Per Rack

CoreWeave1631 字 (约 7 分钟)
85

液冷交换机使AI网络每机架带宽翻倍,CoreWeave部署NVIDIA Spectrum-X SN6600-LD实现1.64 Pb/s交换能力。

入选理由:液冷技术使交换机带宽达102.4 Tb/s,每机架交换容量提升至1.64 Pb/s

精选文章#液冷技术#AI网络#NVIDIA#CoreWeave#数据中心英文
Latent Space 图标

[AINews] SpaceX is already a $28B/yr Neocloud

Latent Space2832 字 (约 12 分钟)
85

SpaceX 与多家公司达成 GPU 租赁协议,年收入达 280 亿美元,成为 AI 领域的重要云服务提供商。

入选理由:SpaceX 与 Reflection 签订 63 亿美元 GPU 租赁协议,月租金 1.5 亿美元。

精选文章#SpaceX#AI#云计算#OpenAI英文
The Bear Case for AI Data Centers

The Bear Case for AI Data Centers

Gradient Flow552 字 (约 3 分钟)
85

AI数据中心可能成为下一个泡沫破裂的导火索,因巨额支出与低回报并存,且依赖持续增长的开支。

入选理由:OpenAI年支出约600亿美元,但收入仅130亿美元,存在严重收支不平衡。

精选文章#AI#数据中心#经济#投资英文
AI Cloud Essentials Explores Innovation in New Episodes

AI Cloud Essentials Explores Innovation in New Episodes

CoreWeave857 字 (约 4 分钟)
75

CoreWeave播客第三季聚焦AI云服务创新,揭示88%企业已应用AI并强调AI原生云基础设施的重要性。

入选理由:麦肯锡2025年报告显示88%企业使用AI,较2020年增长38%。

精选文章#AI云服务#企业应用#CoreWeave#AI基础设施英文

跨材料问答 · CoreWeave

回答基于:CoreWeave 相关 22 条材料
    0 / 500

    AI 可能会生成不准确的信息,请核实重要内容