Weekly for Tech Enthusiasts (Issue 399): Visiting China's AI Giants
US analysts' visit reveals China's AI compute is 1/8th of the US, but a 4-7x efficiency gain bridges the hardware gap.
入选理由:2025年底美国AI算力约为中国8倍,中国当前总算力仅相当于美国2023年水平。
公司
别名:deepseek_ai
提供新型自扩展AI系统的科技公司
已跟踪 30 条高相关材料
最近变化
2026-09-02 · DeepSeek Harness可记录工具调用、系统提示和子代理计划,实现性能复现
为什么值得关注
DeepSeek 被反复提及时,通常意味着它正在影响产品路线、开发者工作流或 AI 产业判断。这个页面把分散材料合并成一个可持续更新的观察入口。
已收录 30 条与 DeepSeek 相关的内容,按评分排序。
US analysts' visit reveals China's AI compute is 1/8th of the US, but a 4-7x efficiency gain bridges the hardware gap.
入选理由:2025年底美国AI算力约为中国8倍,中国当前总算力仅相当于美国2023年水平。
DeepSeek builds a low-cost, high-efficiency model system through multiple foundational innovations to drive China's $10 trillion AI hardware ecosystem and achieve its own $1 trillion valuation.
入选理由:DeepSeek V4 Pro在100万上下文中仅需5.48GB HBM显存,远低于竞品的60-89GB。
DeepSeek reduces KV cache requirements through innovations, driving China's AI hardware ecosystem toward a $10 trillion industry.
入选理由:DeepSeek V4 Pro仅需5.48GB HBM,相比GLM5的60GB和Qwen3-235B-A22B的89GB显著节省显存
AI infrastructure is undergoing an unprecedented systemic重构 in capitalist history, with power and wafers as the core bottlenecks; Anthropic's $11B monthly ARR surge reveals explosive demand, while TSMC, NVIDIA, and SpaceX are reshaping the global geopolitics of compute.
入选理由:Anthropic单月ARR增长110亿美元,远超市场预期,证明AI基础设施需求远超资本定价能力。
Axiom Math advances Verified AI to scale brilliance and compound it through formal proofs with Lean, achieving 12/12 on Putnam and 99% (187/189) on Verina Codegen, far exceeding OpenAI o3’s 4.9%, providing critical capability verification and knowledge propagation for AGI.
入选理由:Axiom在Putnam考试中取得12/12,优于顶尖本科生与当时最接近的AI系统DeepSeek(103/120)。
Garry Tan argues that AI is triggering the next personal computing revolution, where open-source Agents and personal AI will empower ordinary people with unprecedented creative capacity; YC’s core tenet is “make something people want”; entrepreneurs must convert trauma into creativity through authentic perception and strong agency.
入选理由:Garry Tan 提出‘个人AI必须由自己拥有和控制’,并正在开发 G Brain——整合邮件、日历、联系人与笔记的个人知识记忆系统。
DeepSeek’s visual pointing lets open-source VLMs slash visual tokens by 90 % while matching or beating GPT-4V on seven public benchmarks and delivering traceable reasoning paths.
入选理由:视觉指针机制将视觉 token 用量压缩 90%,仍保持 SOTA 精度
DeepSeek推出可自我扩展的AI系统,通过动态重写程序实现功能定制,但缺乏详细技术原理说明。
入选理由:自扩展AI系统可通过用户指令动态生成功能模块
DeepSeek V4 Pro 0813发布,但其开源评估工具DeepSeek Harness更具价值,允许开发者重现性能并自定义工具。
入选理由:DeepSeek Harness可记录工具调用、系统提示和子代理计划,实现性能复现
DeepSeek发布新模型DeepSeek Coder引发行业关注,OpenAI因安全风险暂停训练,Claude代码泄露事件被深度分析。
入选理由:DeepSeek Coder成为GitHub最快获得星标的历史性项目
DeepSeek发布实验性多模态模型V4-Flash-Vision-Exp,性能接近Opus-4.8。
入选理由:V4-Flash-Vision-Exp在多模态代理基准上超越V4-Flash,接近Opus-4.8性能
DeepSeek推出支持多模态的API,允许通过图像和文本混合输入进行交互,适用于需要视觉和文本处理的应用场景。
入选理由:DeepSeek的'deepseek-v4-flash-vision-exp'模型支持图像和文本混合输入,每个图像最多384个token计费。
DSpark推测解码通过结合并行和顺序组件,可提升LLM生成速度60-85%。
入选理由:DSpark结合并行与顺序组件,提升生成速度达60-85%
DeepSeek 开源多模态模型 V4-Flash-Vision-Exp,支持图片输入且能力接近 Opus-4.8,采用 MIT 许可证。
入选理由:DeepSeek-V4-Flash-Vision-Exp 支持 JPEG/PNG/GIF/WebP 四种图片格式输入
DeepSeek Harness v0.1 开源,基于 Cordis 框架,所有组件均作为插件实现,支持灵活扩展。
入选理由:DeepSeek Harness 采用 MIT 许可证开源,允许全球开发者自由使用。
DeepSeek通过后训练技术使模型性能提升7倍,超越更大规模模型,展示了AI训练范式的突破性进展。
入选理由:后训练步骤使DeepSeek Flash模型性能提升7倍,超越5倍参数量的Pro版本
Pi Agent凭借简洁系统提示和实际测试数据,成为使用DeepSeek等开源模型的最佳工具,且Anthropic已验证其有效性。
入选理由:Pi系统提示仅数百token,成本降低80%且性能无损
通用AI Agent将主导市场,垂直Agent和封闭系统面临挑战,模型能力是关键竞争因素。
入选理由:通用Agent将取代垂直Agent,Codex和Claude等通用型产品占据优势
DeepSeek-V4-Flash在Agent Arena测试中排名全球第21,开源模型中位列第三,性能较前代提升12.5%。
入选理由:DeepSeek-V4-Flash在Agent Arena测试中排名全球第21,开源模型中位列第三
DeepSeek-V4-Flash API性能大幅提升,但模型架构保持不变,V4-Pro版本暂未更新。
入选理由:DeepSeek-V4-Flash API已开放公测,代理能力超越V4-Pro-Preview
前沿AI实验室通过状态持久性和专有执行环境构建开发者锁定,影响开放系统开发。
入选理由:OpenAI GPT-5.6 Sol通过状态持久性使ARC-AGI-3得分提升3倍
DeepSeek V4-Flash 0731通过微调实现性能跃升,成本降低60%,但未改变架构。
入选理由:DeepSeek V4-Flash 0731在Terminal-Bench测试中提升25.8个百分点至82.7
中国开源AI模型性能接近西方顶尖模型,挑战硅谷封闭策略。
入选理由:中国开源模型Kimi K3性能接近Anthropic的Fable,且开放权重。
Moonshot的Kimi K3模型达到美国前沿AI模型水平,可能改变全球AI格局。
入选理由:Kimi K3性能与Anthropic的Mythos/Fable及OpenAI的GPT-5.6相当。
Dify平台推出Qubrid AI插件,通过单一API密钥集成DeepSeek、Kimi等多模型,解决AI应用开发中频繁切换模型的痛点。
入选理由:Qubrid AI插件支持DeepSeek、Kimi、Qwen等6大模型的一站式接入
开源AI模型可能在6个月内面临政策限制,中美竞争与监管行动将重塑技术格局。
入选理由:美国可能通过行政命令限制超过GPT-5.5能力的开源模型
Milvus在Attu 3.0 beta中引入自带LLM方法,用户可自主控制LLM提供商和数据路径,无需依赖托管服务。
入选理由:Attu 3.0 beta支持OpenAI/Anthropic等5大LLM提供商的自定义接入
通过SGLang与AMD MI300等技术组合,第三方服务商将推理成本降至DeepSeek官方API的五分之一。
入选理由:使用AMD MI300显卡可降低50%以上推理成本
美国政府监管GPT-5.6引发争议,DSpark推理加速技术提升60-85%效率,OpenAI安全防护升级成焦点。
入选理由:DSpark通过半自回归架构使大模型生成速度提升60%-85%
DSpark通过半自回归架构和置信度调度验证,使大模型生成速度提升60%-85%。该框架解决了推测解码中的后缀衰减问题,已在DeepSeek-V4系列模型中落地。
入选理由:DSpark采用半自回归架构,结合并行生成与顺序校验模块,减少后缀衰减问题