Sequoia Capital

Partnering with Ineffable Intelligence: A Superlearner for the Era of Experience

8.5内容质量
Partnering with Ineffable Intelligence: A Superlearner for the Era of Experience

TL;DR · AI 摘要

Sequoia Capital宣布与David Silver和Ineffable Intelligence合作,致力于通过强化学习构建超级学习者,以实现从基础技能到深刻智力突破的自主知识发现。

核心要点

  • Ineffable Intelligence专注于无预训练的强化学习系统。
  • David Silver曾主导AlphaGo等重大突破。
  • 目标是构建能够自主发现知识的超级学习者。

结构提纲

按章节快速跳转。

  1. Sequoia Capital宣布与David Silver和Ineffable Intelligence合作。

  2. Ineffable Intelligence正在开发一种超级学习者,通过自身经验自主发现知识。

  3. David Silver曾在DeepMind主导AlphaGo等项目。

  4. 目标是构建能够自主发现知识的超级学习者。

思维导图

用一张图看清主题之间的关系。

查看大纲文本(无障碍 / 无 JS 友好)
  • Partnering with Ineffable Intelligence

金句 / Highlights

值得收藏与分享的关键句。

  • Ineffable Intelligence正在开发一种超级学习者,通过自身经验自主发现知识。

    第 4 段

    ⬇︎ 下载 PNG𝕏 分享到 X
  • David Silver曾主导AlphaGo等项目,推动了强化学习的发展。

    第 9 段

    ⬇︎ 下载 PNG𝕏 分享到 X
  • 目标是构建能够自主发现知识的超级学习者,实现从基础技能到深刻智力突破的自主知识发现。

    第 11 段

    ⬇︎ 下载 PNG𝕏 分享到 X
#AI#Reinforcement Learning#Superlearner#Ineffable Intelligence
打开原文

与不可言喻的智能合作:体验时代的学习者

跳转到主要内容

[](https://sequoiacap.com/ "Sequoia Capital")

打开搜索

图片 1
图片 1

与不可言喻的智能合作:体验时代的学习者

Sonya HuangAlfred Lin 发表

发布于 2026年4月27日

David Silver 正在努力构建人工智能的下一章节——通过强化学习“超级学习者”。

建立一个不是我们自身副本的大脑意味着什么?

今天,我们很高兴地宣布,红杉资本正在与 David Silver 和 Ineffable Intelligence 合作,这是一家位于伦敦的新的人工智能研究实验室,其唯一使命是与超级智能进行首次接触。

Ineffable 正在构建 David 所称的超级学习者:一个系统,该系统通过自身的经验直接发现所有知识,从基础运动技能到深刻的智力突破。没有预训练。没有模仿。只是一个代理从其自身行为的结果中不断学习在一个为其设计的世界中。

基于强化学习的超级学习者有可能重新发现并超越人类历史上最伟大的发明:语言、科学、数学和技术。想象一下,一台从第一原理推导出物理定律的机器。那是一种我们从未想过询问的新数学分支的发明。那是一种我们还没有词汇描述的材料、药物和计算机的设计。这就是 David 力求达到的目标。

不同的路径

当前一代人工智能是通过对整个人类互联网进行训练而构建的。这是一个非凡的成就。但一个基于人类数据训练的系统也可能存在根本性的局限性。

Ineffable Intelligence 正在从一个干净的基础开始扩展强化学习:没有预训练,也没有人类数据来捷径系统。以《体验时代》作为北极星,David 证明了完全从环境中训练的代理可以开发出非人类的策略来解决我们还不知道如何解决的问题。

David 领导了一些深度强化学习的关键突破,其中最著名的是在围棋这一极其困难的游戏中的突破。围棋是终极的机器智能测试,因为它不能被计算机暴力破解:组合爆炸的 O(10^170) 种可能合法的棋盘位置远远超过了可观测宇宙中的 O(10^80) 个原子。人们认为这对机器来说太难解决了。

在 DeepMind,David 推动了最终解决围棋问题的关键突破:自我对弈。自我对弈推动了约800 ELO点的飞跃,导致了2016年3月历史性的 AlphaGo 对阵李世石的对决。David 还进一步推进了这一想法,推出了 AlphaGo Zero:完全去除人类预训练并通过自我对弈进行学习,使系统的 ELO 评分从约3700分提高到了5000多分。结果是一个系统达到了决定性的超人表现,并且具有某种非人类的行为方式。

这就是 David 花费职业生涯所建立的传承。他是 DeepMind 的 Alpha 系列背后的首席研究员和技术力量,在一段辉煌时期,他的方法成为了主导范式:AlphaGo、AlphaZero、AlphaStar、AlphaProof 等。

即使在大型语言模型(LLMs)出现后,David 也从未停止相信。他是地球上极少数拥有信念、技术深度和团队来扩展强化学习的人之一。

未来展望

前方的工作很艰难,通往超级智能的时间线不确定,而且这个赌注确实反常。这正是让我们兴奋的地方。人工智能最大的进步总是来自那些愿意无视共识的人。David 比几乎所有领域的人都更正确地忽视了更多的共识。

我们很荣幸能共同领导 Ineffable 的首轮融资,并与 David 合作,这可能是我们这一代最具雄心的科学使命。

分享

分享到 Facebook 分享到 Twitter 分享到 LinkedIn [通过电子邮件分享](mailto:?subject=Partnering+with+Ineffable+Intelligence:+A+Superlearner+for+the+Era+of+Experience&body=https%3A%2F%2Fsequoiacap.com%2Farticle%2Fpartnering-with-ineffable-intelligence-a-superlearner-for-the-era-of-experience%2F)

浏览此网站即表示您同意我们的Cookie政策。

接受 拒绝

关于

商业实体

登录