Hacker News Best

The Emergent Symbolic Structure of Artificial Neural Networks

8.5内容质量

TL;DR · AI 摘要

神经网络的内部表示可能隐式实现符号结构,从而在语言、逻辑等领域表现出色。研究通过数学方程近似验证了这一假设,并展示了对LLM行为的干预方法。

核心要点

  • 神经网络的符号结构可被数学方程近似,误差低于5%
  • LLMs在算术/逻辑/代码/语言领域依赖隐式符号结构
  • 通过修改符号结构可精准干预LLM输出行为

结构提纲

按章节快速跳转。

  1. 指出神经网络在符号处理领域的反常表现与传统认知的矛盾。

  2. 提出神经网络内部可能隐式实现符号结构的理论框架。

  3. 通过数学方程近似验证神经网络的符号结构表示。

  4. 展示小规模网络与LLMs均存在符号结构的实验证据。

  5. 证明符号结构修改可精准控制LLM行为输出。

  6. 建立符号主义与连接主义的潜在统一路径。

思维导图

用一张图看清主题之间的关系。

查看大纲文本(无障碍 / 无 JS 友好)
  • 神经网络符号结构
    • 核心假设
      • 隐式符号结构存在性
    • 验证方法
      • 数学方程近似
      • LLM行为干预实验
    • 应用领域
      • 算术
      • 逻辑
      • 代码
      • 语言

金句 / Highlights

值得收藏与分享的关键句。

#神经网络#符号结构#AI#大语言模型
打开原文

[2608.29530] 人工神经网络中涌现的符号结构

rdf:RDF xmlns:rdf="http://www.w3.org/1999/02/22-rdf-syntax-ns#" xmlns:dc="http://purl.org/dc/elements/1.1/" xmlns:trackback="http://madskills.com/public/xml/rss/module/trackback/"> <rdf:Description rdf:about="/abs/2608.29530" dc:identifier="/abs/2608.29530" dc:title="The Emergent Symbolic Structure of Artificial Neural Networks" trackback:ping="/trackback/2608.29530" /> </rdf:RDF>

计算机科学 > 计算与语言

arXiv:2608.29530

(cs)

[提交于2026年8月30日]

标题:人工神经网络中涌现的符号结构

作者:

R. Thomas McCoy

,

Paul Soulos

Tal Linzen

Paul Smolensky

查看论文《人工神经网络中涌现的符号结构》的PDF版本,作者:R. Thomas McCoy、Paul Soulos、Tal Linzen 和 Paul Smolensky

查看PDF

HTML(实验性)

摘要:现代人工智能(AI)系统在某些看似不擅长的领域表现出色。传统上,智能被建模为在结构化符号组合(如逻辑公式)上运行。然而,当前最强的AI系统基于神经网络,它们通过连续向量表示信息。向量似乎难以捕捉语言、逻辑和其他认知领域的结构,但神经网络在这些领域却表现出色。它们是如何做到的?在本研究中,我们提出一个潜在答案:尽管表面现象如此,神经网络的内部表示可能隐式实现了符号结构。为支持这一假设,我们证明多种神经网络的向量表示可以用符号结构紧密逼近:我们可以用一个实例化符号结构的闭式方程完全替代网络的表示生成过程,而网络行为基本保持不变。这一发现适用于小型神经网络(训练其操作列表)和大型语言模型(LLMs)——后者在四个符号传统核心领域(算术、逻辑、计算机代码和语言)中运行。此外,我们的符号近似使我们能够通过精确干预内部表示,以有针对性的方式修改LLM的行为,这表明LLM的行为依赖于我们识别出的符号结构。本研究为调和人工智能长期存在的符号智能概念与现代AI的向量基础提供了潜在途径。

上下文

评论:

30页,另附29页参考文献和附录

主题:

计算与语言(cs.CL)

;人工智能(cs.AI)

引用方式:

[cs.CL]

(或

arXiv:2608.29530v1

用于此版本)

https://doi.org/10.48550/arXiv.2608.29530

聚焦以了解更多

工具提示描述

通过DataCite发布的arXiv DOI(待注册)

提交历史

来自:Tom McCoy [

查看电子邮件

]

[v1]

2026年8月30日 03:32:13 UTC(1,107 KB)

结束左侧栏

全文链接:

获取论文:

  • 查看PDF
  • HTML(实验性)
  • TeX源代码

查看许可协议

结束全文

当前浏览上下文:

cs.CL

< 上一页

|

下一页 >

新内容

最近提交

2026-08

按以下分类浏览:

cs

cs.AI

参考文献与引用

  • NASA ADS
  • Google Scholar
  • Semantic Scholar

导出BibTeX引用

加载中...

BibTeX格式引用

×

数据来源:

书签

结束附加服务

LABS区域

/think

文献工具

文献与引用工具

文献探索器切换

文献探索器

( 什么是探索器? )

关联论文切换

关联论文

什么是关联论文?

Litmaps切换

Litmaps

什么是Litmaps?

scite.ai切换

scite智能引用

什么是智能引用?

代码、数据、媒体

与本文相关的代码、数据和媒体

alphaXiv切换

alphaXiv

什么是alphaXiv?

代码链接切换

CatalyzeX论文代码查找器

什么是CatalyzeX?

DagsHub切换

DagsHub

什么是DagsHub?

GotitPub切换

Gotit.pub

什么是GotitPub?

Huggingface切换

Hugging Face

什么是Huggingface?

ScienceCast切换

ScienceCast

什么是ScienceCast?

演示

演示

Replicate切换

Replicate

什么是Replicate?

Spaces切换

Hugging Face Spaces

什么是Spaces?

TXYZ.AI

什么是TXYZ.AI?

相关论文

推荐系统和搜索工具

链接至影响之花

影响之花

什么是影响之花?

核心推荐系统切换

CORE推荐系统

什么是CORE?

  • 作者
  • 会议
  • 机构
  • 主题

关于arXivLabs

arXivLabs:与社区合作者开展的实验性项目

arXivLabs是一个框架,允许合作者直接在我们的网站上开发和分享新的arXiv功能。

所有与arXivLabs合作的个人和组织都已接受并践行了我们的开放、社区、卓越和用户数据隐私的价值观。arXiv致力于这些价值观,仅与遵守这些价值观的合作伙伴开展合作。

有为arXiv社区创造价值的项目构想吗?了解更多关于arXivLabs的信息。

END LABS AREA

本文的哪些作者是推荐人?

禁用MathJax

什么是MathJax?