Hacker News Best

Ask HN: Add flag for AI-generated articles

6.5内容质量

TL;DR · AI 摘要

Hacker News社区讨论是否应添加AI生成文章标记,以帮助用户筛选内容。

核心要点

  • 社区对AI生成内容存在排斥,可能影响文章地位
  • 当前投票系统不足以应对AI生成内容的挑战
  • 添加标记功能可能有助于用户筛选,但需权衡社区管理

结构提纲

按章节快速跳转。

  1. 提出在Hacker News添加AI生成文章标记的建议

  2. 用户对AI生成内容存在排斥,但未明确禁止

  3. AI生成内容可能改变写作的阶级区分

  4. 现有投票系统是否足够应对AI生成内容

  5. 可能添加标记功能但需增加标注理由步骤

思维导图

用一张图看清主题之间的关系。

查看大纲文本(无障碍 / 无 JS 友好)
  • AI生成内容标记讨论
    • 社区反应
      • 排斥AI生成内容
    • 技术影响
      • 改变写作阶级区分
    • 管理建议
      • 添加标记功能
      • 增加标注理由步骤

金句 / Highlights

值得收藏与分享的关键句。

#AI生成内容#社区管理#Hacker News
打开原文

Ask HN:为AI生成的文章添加标记功能 | Hacker News

Hacker News

new

|

past

comments

ask

show

jobs

submit

login

Ask HN:为AI生成的文章添加标记功能

629 points

by

levkk

7小时前

hide

favorite

289条评论

Hacker News是否应该添加标记AI生成文章的功能?这不需要像常规举报功能那样起作用,即不会降低文章排名;它只需作为一个指示器显示,让像我这样不喜欢阅读AI生成文本的人可以跳过。

开放性问题:1. 为什么常规投票系统不够?2. Hacker News是否需要因生成式AI时代而做出改变?它过去成功的关键在于没有改变核心原则。

dang

6小时前

next

[–]

我们本身不允许在Hacker News上发布生成式AI文本 - 详见

https://news.ycombinator.com/newsguidelines.html#generated

以及

https://news.ycombinator.com/item?id=47340079

。当然,如何执行这一规则是另一个问题,但该规则本身是存在的。

我们目前还没有关于文章内容的类似规则,但我的感觉是,社区大多数成员并不想阅读这些内容——更保守地说,他们会降低对这些内容的重视程度。这就是为什么我们看到如此多的“直接展示提示词”回应,以及其他类似的反馈:https://news.ycombinator.com/genai-pushback。我整理了这个列表,以便向那些询问为何他们的生成式AI文章被标记的用户发送解释。目前这是一场引人入胜的军备竞赛:AI正在学习人类,而人类群体也在学习AI。读者们正在对听起来像LLM生成的语言产生过敏反应。AI会适应这种变化,但人类也会随之调整。最终会发展到什么地步,目前还无人可知。我持乐观态度,但过去多次判断错误让我对此信心不足。现在正在形成一种阶级区分:使用生成式AI写作(以及写作的人)与不使用生成式AI写作之间出现差异。一旦读者对“这听起来像LLM生成”的过敏反应被触发,这类文章会立即在读者心中被归类为低地位类别。这并不意味着人们不会继续阅读——但文章现在蒙上了污名。(直到我回忆起pg在https://paulgraham.com/writes.html中提出的“writes and write-nots”概念,我原本对这个观点的原创性感到满意。算了,重要的是观点本身。)这种现象的积极一面是:任何希望读者将他们的文章归类为高地位而非低地位的人,都可以通过亲自撰写文章这一“柔道技巧”来实现。现在我需要补充免责声明:以上内容并不是对LLM技术本身的否定。我们高度依赖这项技术,毫无疑问它很有用。问题在于如何使用它(再次引用pg的观点:https://x.com/paulg/status/2058871512451412457),以及是否应该将它用于向其他人类公开发布的写作内容。针对OP的问题:> HN是否应该增加标记文章为AI生成的功能?[...] 这可能会以某种指示器的形式出现。将标记仅作为指示器的功能,本质上属于标签系统,我们一直反对在HN中添加此类功能,但并非完全排除可能性。我认为我们最终会添加的,是“请说明标记此帖子的原因”这一步骤,“因为我认为这是生成式AI内容”将作为多个选项(垃圾信息、离题、攻击性等)中的一个选择。> 为什么常规投票系统不够?常规投票系统永远都不够。https://hn.algolia.com/?dateRange=all&page=0&prefix=false&so...> HN是否应该因生成式AI时代而做出改变?对此,我倾向于引用https://news.ycombinator.com/item?id=48887149来致敬https://news.ycombinator.com/item?id=3742902。

jillesvangurp

1分钟前

parent

合理的政策。我认为随着主流新闻媒体现在明显在日常工作中使用LLM,要在此处坚持纯粹主义立场将变得困难。有些人比其他人更负责任地使用这些技术。但只要负责任地使用,这未必是坏事。只有在使用不当的情况下才会成为问题。

糟糕的写作当然不是什么新鲜事。它使用的大部分审核机制早在25年前就已完善,当时像Slashdot这样的网站流行起来,作为对抗不良用户行为的防御手段。不良用户行为会影响评论、文章提交和审核本身。虽然现在的不良用户有了可以滥用的人工智能,但大量低质量内容的问题本质上仍然相同。审核机制最终将问题的根源锁定在识别好用户和坏用户上。因此,同样数量的坏用户生成更多垃圾内容并不会造成太大影响。获得良好的声誉仍然需要大量工作,这使得识别没有良好声誉的用户所创建的所有垃圾内容变得相对直接。使用大型语言模型(LLMs)来标记、标记和过滤内容可能是一个值得尝试的实验。目前有很多低质量的人工智能生成的评论文章莫名其妙地出现在首页。同样,政治和有争议的内容也会出现,这显然违反了HN的内容指南。自动标记明显违反指南的内容应该并不困难,这只需要设置良好的安全防护措施。@dang可能实际上已经在这么做。如果清理大量生成的垃圾内容是我的工作职责之一,我也会这么做。这可能也是为了给优质内容提供一点助力。目前新文章部分的信号与噪声比非常低,优质内容能突破这个门槛的时间窗口非常短暂。首页上的文章经常会有许多重复提交的内容,这些内容从未成功通过审核。在我看来,重复提交应该直接算作对原始文章的点赞。基于规范URL进行自动去重应该并不困难。

grayclhn

3小时前

prev

我认为将其归类为过敏反应或身份地位问题有些过于轻率了。我为工作审阅过至少数百份人工智能生成的文档,也撰写和委托撰写过不少。我最大的问题是,你无法与AI撰写的文档进行互动并提供反馈,因为你无法判断误解或空白是由于作者对材料理解不够深入,还是作者理解充分但AI没有,或者作者没有仔细校对。如果出现了一个令人惊讶的观点,这是作者的见解吗?他们能详细说明这个观点的来源吗?

显然,Hacker News不是工作场所,但“由于作者实际上并不存在,你无法更深入地与内容互动”对于一个讨论网站来说确实是个问题。如果人类合著者投入足够工作,他们可以确保文档真正反映他们的观点和理解,但根据我的经验,这种情况要少得多。

woolion

2小时前

root

我最大的问题是,你无法与AI撰写的文档进行互动并提供反馈,因为你无法判断误解或空白是由于作者对材料理解不够深入,还是作者理解充分但AI没有,或者作者没有仔细校对。

顺便说一句,PR或PoC(概念验证)也存在同样的问题;现在我首先要问的问题是,“你是否了解他的行为?”第一步,获得一个合理的规范,往往要等到第一次草案实现已经推送之后才会进行……

That's interesting, thank you! My only pushback is that my bit about "allergy" and "status" is about the audience response here, whereas you seem to be talking on a somewhat different level.

Oh for sure. My only point is that IME (and I’d assume many other commenters) the quality of discussion and engagement around an imperfect ai-written doc is considerably worse than the same doc written by a human. Work is where it’s most obvious to me… because many of these are design docs for systems I care deeply about us delivering, but I’ve noticed the same thing elsewhere.

avaer

I hope HN doesn't get into moderating the politics of articles.

I can see a grim future (present?) where "AI generated" turns into a slur, warranted or otherwise, in a world where the difference between human trained to talk like an AI and AI masquerading as human becomes increasingly difficult to discern, and some hidden cabal passes judgement. That is wholly different from taking a stance on HN being a place for humans to comment on articles.

freehorse

1 hour ago

AI has a distinct, low-quality and unnecessarily sensational writing style, which signals low effort post first of all. If you use AI and you put the effort to make it not look like AI it means that at least you put some effort into it.

I am not sure how the future may be, but the direction of AIs has been to solidify their distinct writing style rather than assimilate to humans. So we can start addressing what we are dealing with now. I doubt HN tagging/flagging can put enough pressure to affect how llms will evolve anyway in the future, while the llm speech becomes more and more ubiquitous and unhinged.

matheusmoreira

You've accurately described the current state of Lobsters.

archagon

As opposed to wonderful old HN, where about 95% of the front page is now AI, AI-related, or AI-generated.

5 hours ago

There's significant overlap between the front pages of HN and Lobsters. Almost every time I try to submit the interesting articles I see on Lobsters here, I just get redirected to the existing discussion thread.

The massive 1000+ comments/upvotes AI model release threads only show up on HN. Lobsters doesn't accept "business" articles like that. You're quite likely to find reactionary articles that are critical of AI on the front page though. There are several on the front page right now, in addition to the ones derisively tagged vibecoding.

mmastrac

There's a bot user that seems to crosspost every lobsters story here if it isn't already.

IsTom

51 minutes ago

My memory is pretty spotty, but wasn't it similar with other hype-cycle topics like cryptocurrencies?

grahamburger

And the remainder is people complaining about all the AI

That's a high exaggeration of course, but in the wonderful old HN tradition of perceiving the site as dominated by $badness, where everyone has their own perception of $badness.

I'm not picking on you - it's practically a universal response, so much so that it must be driven by human hard-wiring. I've written about this so many times that for once I don't even know what to link to. Perhaps https://news.ycombinator.com/item?id=23308098 . Or maybe https://news.ycombinator.com/item?id=48427800

Fine. Looking at today's /active, it's more than half just based on the titles. (Likely 2/3 or more in practice, but I did not delve into each post.) And this does not feel particularly unusual.

mh-

(Apologies if you've commented on the following already, but I've not seen it.)

我最担忧的日益增长的趋势是那些并未违反任何指南但被标记为“dead”的评论。我所说的不是那些被影子封禁的用户,而是那些在某个话题上认真思考并发表评论,但整个讨论线却强烈反对的评论。我甚至不特指那些在疫苗等敏感议题上的争议性观点。只是在关于AI、交通、住房、裁员等话题的讨论中,单纯地与主流观点相左。我从记事起就一直使用“showdead”功能浏览,但最近这种现象明显加速了。这些评论来自你和我都尊重的高质量贡献者。我不知道解决方案是什么,但这让我(以及其他人)感到沮丧,因为我已经习惯了过去15年在这里阅读的富有启发性的对话。

defrost

未违反任何指南但被标记为“dead”的评论

为这些评论担保,或发送邮件至 hn@ycombinator.com 并说明你认为它们应被标记为[undead]的原因。我经常看到这种情况,有些评论被实时AI检测过滤器错误标记(这个过滤器实际上在剔除真正的AI生成评论方面表现还不错),有些则强烈反对主流趋势。我曾看到管理员恢复了我完全不同意的评论,但那些评论者为反对观点进行了充分的辩护——这些讨论线因为呈现了各方的最佳论点而更加精彩。

我总是会为这些评论担保,但从未主动发送过邮件。我认为管理员看到的Hacker News和我一样。不过,可能我某些晚上在这里花的时间太多了。

但没错,我指的是那些“反对主流趋势”的评论。这让我觉得对社区造成了很大的伤害。

我认为管理员看到的Hacker News和我一样。

能读完所有评论的人非常罕见……我的印象是,他们更倾向于收到关于意外被自动归类评论的精准提示邮件,并且愿意取消对优质评论的标记,即使这些评论试图阐述某个议题的阴暗面。不过,可能最好避免用大量针对/反对特定话题的邮件来淹没他们。顺便说一句,我经常拆解支持我支持的案例的评论……因为我希望看到更有力的论点,并且希望减少那些浅显易被驳回的支持性言论。

我同意这个观点,我看到的被标记的评论中,很多都是表达我不同意的观点。但这些观点应该被讨论,而标记它们剥夺了所有人进行讨论的机会。

我个人从未见过被标记为“dead”的评论重新出现。我不确定点击“担保”按钮是否真的有效。(不过对提交内容来说是有效的。)

我见过,但这种情况确实非常罕见。可能如上所述是人工干预的结果。

我个人只见过两次——都是我发送过邮件的评论(其中一条我

真的很

讨厌其中一条评论所持的立场,但那条评论的辩论水平是礼貌的,回应了提出的反对意见,承认了其他观点等。)

担保过,我可能见过几次反向操作(更多是背景观察,没有深入跟进,所以充其量只是模糊的轶事)。我确实收到过@dang的反馈,我担保的一条评论实际上是一条真正的AI生成评论……显然,我作为人类也会偶尔被一些拙劣的AI生成内容误导。

我需要看到具体的链接,但很多这些帖子可能被系统标记为AI生成内容,而AI生成内容在Hacker News上是被禁止的(见

.)

/think

很高兴在办公桌前时能给你发些相关内容。

(我完全理解生成式AI政策,并且非常支持这一政策。)

与此同时,这是我最近看到的一个例子:

https://news.ycombinator.com/item?id=48660796

这显然不是生成式AI相关的问题,但问题的性质让我现在太疲惫,无法理清思路!

哈哈,说得对。那确实不是一个很好的例子。晚安。

bryanrasmussen

在一个人类被训练得像AI说话,与AI伪装成人类的世界里

我曾因塑造一个抑郁角色的文风而被指责使用AI写作,因为这个角色表现出某种情感疏离,而提出指控的人认为这符合AI特征。简而言之,如今判断是否为AI,不仅取决于特定措辞或用词,还涉及审美效果。

sph

4小时前

诚实提问,为什么人们会对99%情况下毫无难度的低质量内容产生过敏反应,这会带来多么灰暗的未来?

我个人倒是希望看到这样的未来。因此我一直在抗议如今文章作者们为懒惰找的借口,以及他们更懒惰地回避动脑的借口。

你在编辑评论时我刚好发了评论,所以这场对话处于不确定状态!(这不是批评——我有时确实花很长时间编辑这些内容。)

例如,我想你之前提到过"文章的政治性",而我在补充"阶级差异"相关内容时,你恰好也提到了。这种有趣的重叠!我不太明白你所说的灰暗未来具体指什么,但如果你不介意的话,我可以让你阅读我修改后的帖子,然后针对其中未涉及的内容进行回应。

MisterSandman

Hacker News早已在监管文章内容了。这是一份精选的共享文章列表,大量无关文章会被自动删除或被踩到消失。这可不是Reddit。

拥有观点鲜明的网站是可以的。互联网的每个角落都不需要成为言论自由的堡垒。

satisfice

"AI生成"已经变成了一种侮辱性用语。

有时它被用作侮辱,有时是事实,有时两者兼而有之。这一切都尚不明确,因为我们仍处于探索这一问题的早期阶段。

minimaxir

还有clanker(幸运的是这种情况已经减少了一些):

https://hn.algolia.com/?dateRange=all&page=0&prefix=false&qu...

这是一个嵌套得足够深的子线程,我可以随意发表任何观点,因为没人会链接到这里,即使有人链接了,也不会有人关注。

你提到的评论类型——不仅仅是字面使用"clanker"的评论,而是更广泛的类别——目前处于粒子-波的不可判定状态。如果评论者正确——即他们指责的人确实发布了LLM生成的文本——那么这就是社区免疫系统的反应。如果评论者错误——即他们指责的是真诚的人类,并以虚假指控将其拖入法庭——那么这就是我们告诉人们不要在这里发布的攻击类型。他们无法确定自己所说的是真是假,我们也无法确定是否应该进行审查。这两个问题都取决于无法获取的信息。这就是我所说的整个问题目前处于混沌状态,现在还无法确定它会向哪个方向稳定。

这是一个合理的回应。

bluefirebrand

我不羡慕你所处的境地。

我认为禁止AI提交的决定是正确的,但最终这将导致一段时间内的冲突,可能持续很长时间,直到AI在更广泛的文化中趋于稳定。我希望最终AI的使用会成为某些领域的禁忌。创意领域应属于有创造力的人类,而不是那些甚至无法在没有LLM帮助的情况下发表文章的人。

但请注意,我们讨论的并非所有AI使用情况。我们讨论的是使用AI来处理我们发布给他人阅读的文本。

有许多使用AI的方式与这并不冲突。

not-a-llm

有些文章可能只有一小部分(比如10%)由LLM生成,这种情况下内容实际上是LLM与人类写作的叠加,且可能被标记或未被标记。

确实如此!或者可能是20%、60%或80%。

asdff

为什么人类会被训练成像AI一样说话?如果他们从事的领域有强烈的动机去撰写与LLM生成内容相似的内容,不如直接使用LLM生成器。

Barbing

“你最常接触的五个人的平均水平就是你自己。”如果其中一个人是语言模型……(就像我们无意识地学会某种口音一样,最终人们可能会自动切换语言风格——这或许是值得期待的。)

这不过是LinkedIn的现状。

在LinkedIn上浏览普通动态时,我甚至想用铅笔戳自己的眼睛。

genxy

只需注销后去YouTube detox一下。

unholiness

你是不是误解了这个观点?

当前正在进行一场有趣的军备竞赛:AI正在学习人类,而人类集体意识也在学习AI。读者正在对听起来像LLM生成的语言产生过敏反应。人类正在训练自己检测AI生成内容。人类写得越来越像AI的现象是另一个(且更缓慢)的过程。

fzeroracer

“被训练成像AI一样说话的人类”其实就是LinkedIn用户,我真心希望没人希望HN变成LinkedIn帖子那种彻底的虚无之地。

bhaney

我认为我们最终会增加一个步骤:“请说明你标记这篇文章的原因”,其中“我认为这是生成式AI生成的”将只是众多选项之一。

这意味着AI生成的文章会被视为可标记的违规内容吗?我们是否应该在标记系统支持原因之前就标记疑似AI生成的文章,还是应该等待?

你们这些人真是会提出直指模糊地带的好问题!

我目前还不确定。但你说得对,这确实会从我之前的话中得出。我确信的是,用户应该标记他们认为不适合出现在HN上的文章。但这应基于他们对https://news.ycombinator.com/newsguidelines.html的阅读,而不是仅仅基于点赞/点踩的反应。也就是说,用户应标记他们认为违反网站准则的文章,而不仅仅是他们不喜欢的文章。

我一直在劝阻人们标记“他们认为不适合出现在HN上的文章”,因为你一再剥夺了我这样做的能力。在私下对话中,你确认过如果我标记/背书的内容与版主意见不符,即使我真心认为某篇文章违反准则,我的权限也会被剥夺。

因此,要么我能读心,要么最好只在明显、明确违反准则时才进行标记。我一直在对整个标记机制及其背后的规则如此随意、甚至可以说是虚伪感到恼火。

在私下与您的交流中,您确认如果我标记/担保您管理员不同意的内容,即使我真心认为某篇帖子超出了指南范围,我的权限也会被剥夺。

人们喜欢根据我们所谓的言论,做出这种模糊的断言。您能否引用我确切地说过的话,让读者自行判断?如果这听起来尖锐(确实如此),请见谅,但我无法数清有多少不满用户曾在HN帖子中虚假发帖,以宣泄对管理员的积怨。

当然,您可以通过多封邮件与我逐段引用的方式进行。

我担心我们已从您的账户中剥夺了担保权限,因为您担保了太多无实质内容和/或煽动性言论和/或违反网站指南的评论。如果您想先建立一段时间内仅担保优质评论的记录,然后发邮件让我们查看最近的担保记录。您想知道如何判断哪些评论在您眼中是“优质”的?顺便说一句,如果您对某个案例不确定,可以随时与我们确认。我知道一些边缘案例并不总是容易判断。换句话说,要么照dang自己会做的事去做,否则就会受到惩罚。我不从事读心术的生意。这发生在多年前。我确信最近我标记/担保的内容都是我真心认为符合规范的,尽管您手头有所有数据,可以用“啊,但那天您担保了这条差评评论!我明白了!”来反驳,但最终这总是场必输的战斗。无论如何,我的问题在于您说:“用户应标记他们认为不适合出现在HN上的文章”。强调的是我的观点。不,情况比这更复杂。

感谢您完全按照我的要求回应!这本身就很罕见,尤其是在我脾气暴躁的时候,更显难得。非常钦佩。

我理解使用“good”这个词可能令人困惑,但我的意思是“无实质内容和/或煽动性言论和/或违反网站指南的评论”的反面。归根结底,就是判断是否符合指南。> 想知道如何判断您眼中的“优质”评论。既然您无法读取我的想法(至少我假设您无法做到,如果您能读取,就不会有这个问题),这显然是不可能的。您能做的是根据您对网站指南的理解来评估。如果您学习并理解了https://news.ycombinator.com/newsguidelines.html,并基于此而非仅仅个人喜好/厌恶来评估评论,我想您与管理员的判断不会相差太远,因为这也是我们试图做到的。我相信总会有一些个别案例我们意见不同——即使tomhow和我也会在个别案例上意见不同——但这些应是少数。如果您认为我们有具体案例判断错误,我很乐意看到链接,我们始终愿意听取相反的观点。

hypfer

55分钟前

完全元讨论且可能偏离主题,但我想这可能是我第一次与dang(真人)接触,基于此,我对他的尊重油然而生。

很好,保持做自己。请继续这样。

IanCal

您是如何被处罚的?仅仅是失去标记权限吗?

如果您的看法与他们希望标记的方式不一致,移除该权限是合理的。除非有其他惩罚,否则无论您是否真心相信,这似乎都很合理。

Aachen

21分钟前

(非OP。) 我能理解,如果你是真心想帮忙却因此被降级,这确实会感觉像一种惩罚。这不仅仅是人与人之间的提醒,而是权限级别的变更;你被降权了。当然,我并不了解这个具体案例中用户举报/支持的内容,我也能理解你的逻辑,但如果是发生在自己身上,我大概率也会感到难过,而且我认为原文的措辞已经足够恰当。

bellowsgulch

Dan喜欢某些人,而你不在那个圈子里,伙计。

我喜欢那些遵守网站准则并希望按Hacker News原本意图使用平台的人。这并不代表我讨厌那些不遵守的人,但另一方面的情况则更复杂微妙。

他根本不知道我是谁。

私下里,当我刚来时他很礼貌且乐于助人。(试图保持礼貌,但对方并未回应。) /供读者参考的单一轶事

haunter

用户应举报他们认为违反网站准则的文章

我越来越认为这条链接实际上对网站有害而非有益。它对所有内容都是一种陷阱,既可以作为武器也可以作为盾牌。看看关于政治的部分。这里越来越多地出现美国国内政治相关内容(实际上我经常举报这些内容),但当话题出现时,人们却会说:"当世界燃烧时,黑客是否应该背过身去?"基本上只要符合某种叙事,任何内容都可以被接受。在我看来,最严重的问题是最后关于Reddit的部分。因为我真的同意,如果HN现在还没有变成Reddit,那也快了。这篇帖子和评论中所有人都在要求增加反对票按钮,就是这种现象的完美例子。

causality0

我所知道的是,用户应举报他们认为不适合出现在HN上的文章

如果这是事实,那么这条规则应该被加入准则中。很多时候我看到提交的内容时会想:"天哪,这是我一生中读到的最愚蠢的东西,几乎所有事实陈述都是错误的",但我不会举报,因为"不要发布毫无意义的废话"并不在准则中。

你觉得举报是用来做什么的?(真诚提问)

确实我们没有明确说明每件事,但这是因为完全精确说明是不可能的。如果你开始说明,你又该在哪里停止?

frm88

和其他网站一样:垃圾邮件和/或机器人、滥用和/或侮辱以及其他人身攻击,特别是准则中提到的:"请不要将Hacker News用于政治或意识形态斗争。这会扼杀好奇心。" 以及"无关话题:除非是某些有趣新现象的证据,否则关于政治、犯罪、体育或名人的话题都属于无关内容。如果电视新闻会报道,很可能就是无关内容。" 不过我的举报似乎并没有什么影响,这里充斥着大量主流媒体关于美国国内政治的文章,我经常怀疑自己是否误解了准则,但归根结底,我只是一个欧洲穷人 /s

总的来说,目前HN似乎更严重的问题是人们只是因为不喜欢某人的观点就随意进行反对票投票。

我明白你讨厌所谓的“菜鸟”评论,正如你多年来一直强调的那样,也正如指南中所写的,尽管HN是否正在变成Reddit,但这一特性让我作为长期读者无法分辨,无论你作为长期版主是否接受这一点。因为HN的版主机制允许人们仅仅因为不喜欢某事就踩票或标记,这将永远与Reddit相似。否则没有其他区分特征。如果有一种方法可以做到,那就是强制用户说明他们踩票或标记的原因。编辑:如果你多年来一直对人们说“不,不,这不属实”,你只是把手指插在耳朵里。有烟必有火。

DANmode

这并不一定意味着不属实——选民最常见的问题是它

只是不有趣或独特

在你的账户上获得一定数量的点赞之前,你甚至不能使用踩票按钮,对吧?我记得以前有这个规定,现在有变化吗?

你无法随意创建账户、登录并开始踩票,这已经比Reddit有了巨大的改进。

Leynos

我宁愿看到一个标签,而不是一堆“这看起来像是AI生成的,我可以通过像素和我见过的许多AI来判断”的评论。这样,那些拒绝AI内容的人就可以过滤掉它们,而不是在评论中争论。

abnercoimbre

这个现象的积极一面是,任何希望读者将他们的文章归类为高地位而非低地位的人,都可以简单地自己撰写文章,从而应用柔道技巧。

我真的真的希望更多人拿起笔和纸!我上一篇博客文章[0]附带了工作量证明。[0] https://abner.page/post/are-we-harold-bloom/

我刚刚在想这个问题,关于工作量证明的角度。也许现在书面博客也需要附带创作过程的录音,否则它们会显得可疑。

想象这种情景多么荒谬。我希望我们能找到解决办法。我个人对阅读任何LLM生成的内容都没有兴趣,所以如果有什么方法可以证明作者确实自己写了某样东西,我会很感兴趣。

j4k0bfr

这是一个难题,因为我认为任何常见的工作量证明标准最终都会产生足够大的数据集用于训练。

但无论如何,这是一个急需解决的问题!

Springtime

当前的情况是,使用生成AI写作(以及作者)与不使用生成AI写作之间正在形成一种新兴的阶级差异。一旦“这听起来像LLM生成的”这种过敏反应出现,写作就会立即在读者心中被归类为低地位的类别。

这不是一场纯粹性测试,作者在表达时实际上是在传达他们并不关心读者是否能辨别信息的准确性与错误之处。这种做法将验证信息准确性的责任完全推给了读者,即使在作者本应承担基本责任(除了一些存在潜在动机或偏见的领域,读者自然会更加批判性地审视)的情况下也是如此。当人们在这里抱怨时,大多数情况是文章没有对AI使用或人工审核情况进行任何免责声明,这再次将验证责任推给读者,而读者此时往往更加怀疑。这种要求对读者来说比当文章来自已知专家时更难以接受,因为读者在这种情况下更愿意参与和学习。这就是为什么陈词滥调和过度使用的表达方式(LLMs经常使用)成为了判断是否值得关注的启发式方法,因为这些迹象表明文章中可能存在未经人工审核的部分,人们更容易将其归类为“可能有价值但需要完全人工分析”或直接拒绝(正如我们从评论中看到的那样)。编辑:我看到有条同级评论也提出了同样的观察。

恐怕我不太明白——我可以问一下那条同级评论是什么内容吗?也许这能帮助我进行三角验证。

[1]这条评论主要在于,当未披露时,读者无法判断哪些部分是生成的、哪些不是,这给读者增加了额外的评估负担。

比如,如果一篇非争议性文章对某个技术问题发表了观点(此时读者的警惕性尚未被激发),但你观察到了LLM使用的迹象(但没有任何关于使用程度的披露),那么你可能不会认为这是一件值得跟进或记住的有趣事情,而是会思考“作者自己是否理解并审核过该内容的准确性,还是被LLM无意中插入了错误信息”等干扰因素(如果想要当场核实这些信息的真实性,还需要额外的工作)。这使得原本可能是一次愉快且富有教育意义的阅读,变成了对内容的质疑和更加怀疑的态度。与此同时,HN的指南鼓励善意参与,这本身就是一个挑战。编辑:修正了永久链接(不小心多加了一个数字)。[1] https://news.ycombinator.com/item?id=48888422

brudgers

我认为我们最终会添加的一步是“请说明你标记此帖子的原因”。

你认为增加标记的摩擦性会减少低质量文章的数量吗?还是说标记高质量文章才是更严重的问题?或者问题仅仅是“太多该死的标记”?只是好奇。

另一个我不知道答案的好问题!这可能就是我们尚未采取行动的原因。

我想这个想法是,如果很多人用“genai”原因标记某条评论,那么这可以被视为比“一般性标记”更精确的社区信号。但一旦我写下这个论点,它似乎就显得更加薄弱了。

xeyownt

我发现PG的文章如此轻蔑。

我知道一些写作有困难但依然非常聪明的人。所以,他们就应该因为AI警察的说教而放弃使用AI来帮助自己吗?但没错,让我们继续根据人们的外在特征和习惯来对他们进行分类吧……历史已经向我们展示了这种做法会把我们带向何方。这里用一个破折号——来吓唬一下AI警察。

dwroberts

我认识一些写作有困难但依然他妈的聪明的人。所以怎样?他们就应该因为AI警察的说法而放弃使用AI来帮助自己吗?

当别人无法做到某件事时,他们通常会怎么做?难道是干脆不做?我不会画画或做艺术,所以我不会让AI帮我生成艺术作品来扮演艺术家。你也可以……干脆不做某些事?没人拿着枪逼你写博客并在HN上发布。

对内容(写作产物)的评判并不等于对人的评判。我不在乎一个人在生活中是否使用LLM——嘿,我自己也用。但我关心的是,我是否愿意花时间阅读一篇由LLM撰写或协助撰写的文章。

PS 这不是em-dash——这是。

我同意你第二段的观点——事实上,我几小时前还发过一个相当相似的帖子:

https://news.ycombinator.com/item?id=48887812

但我和pg的文章产生了如此不同的反应,我完全无法理解你为何这么说。

Debugreality

52分钟前

我强烈同意。人类只有在更多聪明的想法被发表时才能受益。

更好的做法是直接不发布垃圾内容。如果有人花时间用AI辅助完善和编辑自己的想法,并对最终成品的质量感到满意,那我完全支持。毕竟,并非所有人类作者产出的内容都值得阅读。

aabhay

社区生成标签似乎是对所有这些问题的显而易见的解决方案。你可以轻松地设置一个选项来关闭它们,这不会破坏现有系统,还能允许出现广泛的新兴分类体系。仅显示获得超过X个社区投票的标签,除非超级用户被允许提出标签。

但话说回来,总会有Reddit这样的平台 :)

tptacek

这会破坏HN的核心目标之一,即提供一个非封闭的体验,让整个社区都能看到相同的动态流。

"显示[已删除]"的设置已经存在,因此并非100%暴露在相同的动态流中。

DaiPlusPlus

提供一个非封闭的体验,让整个社区都能看到相同的动态流

Slashdot依然存在

标签可以仅用于显示,没有过滤特定标签的方式。

bigcityslider

如果禁止AI生成的评论,为什么允许AI生成的文章?看起来它们面临的问题是一样的。

这是一个合理的问题,目前我还没有很好的答案,只能说评论内容和文章内容属于两个截然不同的领域。

philipswood

我可以接受那些虽然大部分由AI生成但整体结构良好的文章。

那些足够有趣能获得点赞的内容(即不是垃圾内容),但那些毫无意义的、人类评论区抱怨“这是AI生成”的帖子让我非常烦躁和反感。

clickety_clack

标签的棘手之处在于,今年我们可能为genai设置一个标签,但明年或后年的新事物又该如何处理?我们最终会得到一堆随意附加在各处的标签。用一个框来添加理由进行标记听起来是个绝妙的主意。

Terr_

我不确定,但确实

一些

标签是合理的,比如区分可公开阅读的提交内容和需要账户——甚至更糟,需要付费的提交内容。

这并不是对文章或媒体内容本身价值的评判,而是影响 HN 参与者体验的一个相对客观因素。这有点像过去人们在点击之前非常想知道某个文件的大小,以避免浪费拨号上网带宽(以及下载其他内容的机会成本)在不确定时长的等待上(而这些等待可能远超他们真正想要的内容)。

kruffalon

我认为这是一个非常贴切的类比。

过去是为了保护我们的调制解调器带宽(成本和时间),而现在更多是保护我们自己的认知带宽。

keepamovin

39 分钟前

我们也要公开旗帜信息,比如“被标记者”链接。

恭喜你实现了递归升级

neya

我认为这个问题空间需要划分为两个部分:AI 生成的文章(这也是 OP 问题所关注的)和 AI 生成的内容/评论。对于文章而言,老实说,普通的标记机制已经足够有效。如果内容和其中的信息有价值,我认为人们不会去标记它。这不是标记机制的初衷吗?

然而,问题的第二部分——AI 评论,这才是真正扼杀讨论并最终破坏社区的因素。如果我对与自己对话的是一个机器人而非真实用户存在信任问题,我将不会进一步参与讨论。我可能会或可能不会标记该账号,但最终我会对频繁报告机器人伪装成人类的行为感到厌倦。我认为这才是更严重的问题,需要重点关注。根据我的经验,粗糙的 AI 内容几乎总是会被迅速标记。

1bpp

我希望能看到一个“标记为 AI”的选项,并结合一个个人设置,用于隐藏达到一定 AI 标记数量的帖子。这样可以让那些不想看到可能由 AI 生成内容的人静默地过滤掉这些内容。

cr125rider

精彩的回应。感谢你参与讨论并承担所有审核工作!

dcow

我唯一的想法是,“优秀”的生成式 AI 作者/文章很容易通过过滤器,而“普通”的文章则会失败。因此,结果不会是所有生成式 AI 文章都被标记(除非人们主动报告),只有低质量的会被标记。我认为这可以接受,而我就是那种在读到某些特征时就会忽略生成式 AI 写作的人,所以标记功能可以为我节省时间。

但归根结底,这与“我们是否应该允许生成式 AI 代码进入代码库”的讨论是一样的。高质量的代码自然会被接受,而低质量的代码就是低质量的。全面禁止 AI 并没有太多价值——主要目的是禁止低质量内容。也许标签应该用 [低质量] 而不是 [生成式 AI]...

确实有过一些“优秀”的生成式 AI 文章,引发了相当精彩的 HN 讨论。(别问我链接——抱歉,我被砂纸打磨过的记忆无法保留任何东西。)

我认为我的回应是,我们想要最有趣的讨论。

我认为固定下拉列表的标记理由会是一个非常好的改进,因为它可以在一定程度上抵消用户战略性标记故事作为投票的行为。我认为这个列表需要保持简洁,因为它似乎会引发大量元讨论。

固定列表的问题在于,HN 的精神会随着时代演变。

单页信息图表和 Awesome-Lists 让我想起这一点。天哪,PG 的某本书中甚至包含了一些贝叶斯生成的文本作为诗歌。

bakugo

AI 会适应这一点

我不认为这是真的,至少现在还不是,某种程度上我甚至为此感到庆幸。对唯一已知可能盈利的应用场景(编写代码)的狂热追逐,以及由此产生的对编码RLHF的过度关注,导致模型在模仿人类语言方面变得越来越差。这是我最喜欢的一个例子,但这个例子已经有些过时了:https://progress.openai.com/?prompt=10

slg

这就是为什么我们看到如此多“直接给我看提示词”的回应,还有其他类似的例子:

https://news.ycombinator.com/genai-pushback

这与你的观点完全无关,但那个页面是什么?它不是普通的Algolia搜索链接。这已经是某种手动标签系统的一部分了吗?点击第一个链接,这些评论似乎没有经过审核。你们是用这些投诉来帮助检测AI生成内容吗?我认为这个页面的存在让我感到困惑,不确定你们是否真的希望人们以这种方式评论。

这只是我们手动标记的一系列帖子,并为其定义了一个URL端点。我们偶尔会这么做,但频率很低,所以能理解这种困惑。

请注意,我们这边有一个REPL,可以为任何链接定义任何行为!

这只是一个评论集合,内容是对LLM生成文本的反驳。dang会将这些评论作为回复发送给询问他为什么评论被标记的人。他向被标记的评论者提供了关于社区广泛观点的示例。

ryukoposting

这就是为什么我们看到如此多“直接给我看提示词”的回应,还有其他类似的例子

很多例子更加微妙,比如这个:https://news.ycombinator.com/item?id=48844062 更深层的颠覆性趋势让我很感兴趣。人们故意搞乱别人的机器人,为了取乐而浪费token。

如果有人愚蠢到不理解链接中使用的方法……能解释一下吗?

哦,父评论中存在一个非连续的推理,暴露了某种上下文泄露的情况,而评论者只是用我们平时对语言模型常用的非常通用的“请具体说明”来回复。不是因为有人在意随机文本生成器说了什么,只是觉得烧掉几千个token很有趣。

54分钟前

我没有看到这一点。在我看来,这更像是一个关于嵌入式碳排放量的真正问题,因为问题本身存在大量未明确的细节。我当时读到这个问题时觉得它合理且真实,我看不到任何强烈理由怀疑那里的评论者是LLM。

jorvi

每次我指出明显的人工智能评论时,都会被大量踩票。频繁到我甚至停止指出它们了。

在你说我可能在错误地指责它们之前,这些评论通常具有ChatGPT的典型风格:要么非常友好,要么像诺贝尔奖得主那样优雅,大量使用格式,几段文字后以一个巧妙的一句话结尾。如果你查看这些评论者的发帖历史,全都是这种风格。要么是生成的,要么是人工协助的。对于较老的账号,你可以在2025年左右看到这种风格的显著增加。看起来HN社区对AI生成的评论非常喜爱,禁止它们的规则(令人遗憾)是不必要的。或者说至少不是“大众”想要的。

出于好奇,我浏览了你的发帖历史,寻找你因指出AI评论而被踩票的例子。我能找到的第一个例子是3个月前(

/think

https://news.ycombinator.com/item?id=47493096

), 你因指出一条AI评论而被踩票,但该评论实际上没有任何AI写作的特征。

OP随后回复:> 不是AI。不确定被这样指出我的写作风格时我是什么感觉,不过:D

nojs

我不是OP,但我也曾多次因类似原因被大量踩票,通常会删除那些无意义的评论。这种低质量内容如此普遍,以至于现在说这件事已经没什么特别意义了。

HN的指导原则是标记/踩票后继续前进。

TimorousBestie

如果你过于频繁地标记/踩票AI内容(或其他类型的内容),你会发现你的标记和踩票很快变得无效。

因此,从某种意义上说,这些指导原则其实是个误导。

那不是真的——能问一下是什么让你得出这个结论吗?

OP在父评论中写道:

"... 故障容错且高可用的硬件必须促进低延迟、单线程通信,具有高语义密度,以便在安全关键、异构、对抗性环境中实现多维共识。..." 我不确定你为什么认为有人声称"不是AI相信我兄弟"有任何意义。不管怎样,正如我所说,我已经放弃了这场战斗。人们喜欢阅读那些内容,我只会成为那个不再对着云大喊的老人。

你的帖子 (

) 也可能因说"Be better"(变好)而被踩票,这是网络上一种常见的贬低式表达。

还有这个。

kordlessagain

仅仅因为某事物是AI就让人感到困扰,而一些AI内容确实有用,却可能被一并丢弃。我不是说所有AI内容都有用,但其中存在灰色地带,而非非黑即白。

这与我的评论无关?我的评论更多是在批评基于直觉指责某事物为AI,而很可能判断错误。

我无法代表所有人,但我在这件事上做过很多反思,因此对AI有这样感受的原因我有某种解释。

我认为这是因为我不在优化生活以尽快得到正确答案,或尽快构建事物。对我而言,互联网最重要的事情是与其他人建立联系。如果我在论坛上提问,是因为我想和某人讨论它,也许结识一个朋友。否则我当然会直接问AI。谷歌已经存在很久了,通常能为我找到答案。我仍然有时更愿意与同事讨论,而不是搜索每一件事。人际关系。我们需要更多,而不是更少。我认为过度使用AI并依赖AI进行思考、研究、沟通和构建……这会让人更加孤立。

jdw64

老实说,我希望你也能认识到,非英语母语者在参与HN时词汇量和表达方式有限。

ryandrake

在我看来,发表"这篇文章是AI生成的"并不会为讨论增添任何价值。

HN指南[1]包括:请不要抱怨次要的烦人之处——例如文章或网站格式、名称冲突或后退按钮失效等问题。同时请不要发布关于Astroturfing(虚假活动)、Shilling(恶意推广)、Brigading(有组织攻击)、外国代理人等暗示性言论。这会降低讨论质量且通常存在误解。我认为指出你认为某篇文章是AI生成,与指出上述任何问题在价值上是相似的。我们都不喜欢AI垃圾内容。但我不惊讶到2026年底时,网上90%-95%的文章都将是AI垃圾内容。指出这一点毫无意义,就像指出文章破坏滚动条(这种情况很常见)或文章格式差、文字对比度差,或文章是中国宣传内容一样无用。虽然这些可能属实,但讨论它们对对话毫无帮助,在HN上也是被禁止的。我们真正需要的只是在指南中增加"不要抱怨文章是AI生成"这一条。1: https://news.ycombinator.com/newsguidelines.html

标记为AI生成是有用的,因为它意味着我可以跳过这篇文章。

你可以让AI通过扩展程序标记它,或者用你喜欢的风格重写(或只是做好文章核心内容的摘要)。

那就像每次想查看邮箱时,我都得开一辆V12引擎的车穿过车道一样。

eclipticplane

但如果这辆V12引擎的车正在为一个基于行驶里程的经济体提供燃料呢?

现实中的V12引擎,与我例子中的假设不同,确实会以消耗的汽油形式体现。但即便如此,这并不意味着可以以此作为浪费能源和材料的合理借口,毕竟我本来就能做到这些。如果能将这些计算能力用于治愈疾病或应对气候变化等更有价值的事情,而不是用来把要点转换成文章,再让我把文章转回要点,那就更好了。

nvme0n1p1

> 我不想处理AI或AI垃圾内容

> 我希望你能看到,增加更多AI到生活中其实不是一个有用的建议。

WD-42

但这是有用的。如果内容质量好,我可以忍受滚动条损坏;但如果文章是AI生成的,我根本不想阅读任何内容。这差别非常大。

现在我通常会先查看评论区是否有"这是AI生成"的评论,我自己也发过几次这样的评论,还收到了一些感谢回复。

lelanthran

> 但我不惊讶到2026年底时,网上90%-95%的文章都将是AI垃圾内容。指出这一点毫无意义。

实际上,当90%-95%的在线文章都是AI垃圾内容时,识别出那些不是AI生成的文章反而更有价值。当信号与噪声比过低时,拥有信号指示器是非常有用的。

tayo42

我不太同意这个观点。抱怨AI生成的文章更多是关于写作质量的问题,这与未校对、缺乏研究或意识流式的文章处于同一水平。

我认为这种批评也向投稿者或不知是谁的合著者传递了一个信号:文章不被重视。

我只对那5%非AI垃圾内容的文章感兴趣,因此我总是想看到这些信息。

Ferret7446

我同意,我发现评论区抱怨AI垃圾内容的评论,其价值远低于所谓的AI垃圾内容本身。我怀疑这些评论者是否意识到其中的讽刺意味,或者这些评论本身是否也是AI生成的。

152334H

这篇帖子中发生了许多事情

1st: 假设AI生成的文本实际上并不成功,而非如今广泛传播且未受到挑战 2nd: 将对AI文本的负面态度视为不合理的歧视,而非作为低质量内容的强潜在预测指标 3rd: 假设人类写作能可靠地获得好处,而非只是某种拙劣的替代品(赢得声称真实性的社会竞争) 从操作层面来看,只有极少数人类能以≥ Pangram的准确率识别AI生成文本。人们会歧视"AI"标签,但大多无法准确判断。常见到机器人利用这一漏洞谋取私利——指责人类、对生成的个人资料表示同情...在FUD环境中,人们经常能轻易地驳回真实的指控。对于检测能力一般的人来说,这种结构会让人感觉像是不合理的偏见:看看这些优质帖子、这些诚实的人,却因歧视而被贬低...

有趣的观点!虽然我并不完全认同。

1st: 假设AI生成的文本实际上并不成功,而非如今广泛传播且未受到挑战 我只能谈论HN。如果你认为AI生成内容在HN上广泛传播,我很想看到相关链接。假设这是"广泛"存在的,它们应该很容易被找到。 > 2nd: 将对AI文本的负面态度视为不合理的歧视,而非作为低质量内容的强潜在预测指标 我不太理解这部分。 > 3rd: 假设人类写作能可靠地获得好处,而非只是某种拙劣的替代品(赢得声称真实性的社会竞争) 抱歉,这部分我也无法理解。 > 只有极少数人类能以≥ Pangram的准确率识别AI生成文本 这似乎与我们看到的情况不符。我确实认同存在广泛光谱和大量错误判断。 > 常见到机器人利用这一漏洞谋取私利 我很想看到HN上具体的例子。如果这种情况很普遍,它们应该很容易被找到。

handfuloflight

那些确实自己撰写文章但因使用AI而显得像AI的人怎么办?我认识这样的人。他们现在确实写得像AI。难道不应该对他们公平一些吗?

我有时会听到这种说法,但不清楚这种情况有多普遍。我需要看到具体例子。

ludicrousdispla

我不依赖LLM,也不认为它们有用,所以我不会使用LLM,关于它们的一切都值得质疑。

LLM毫无疑问是有用的。我在HN上用LLM完成的事情数量之多令人惊叹——这些是我过去十年都想做的事情。性能优化、日志文件分析、追踪竞态条件——非常不可思议。

IgorPartola

没有人愿意将他们的内容标记为AI生成,因为这会损害可信度。社区可以根据推测和线索将帖子标记为AI生成,但不会100%准确,且需要额外工作。

我认为博客时代已经彻底终结了,这其实也是一件好事。早在AI出现之前,博客垃圾信息和企业博客就已经让高质量的博客消失殆尽。真正的问题是,什么会取而代之?当然,那个价值64000美元的问题是:如果一篇由AI生成的文章与人类撰写的文章无法区分,而且内容准确且有趣,你还会在意是谁写的吗?我们真正想避免的是低质量内容,而不是AI生成本身,对吧?

这样说吧,如果AI生成的文章确实如此优秀,为什么还要用即将被淘汰的旧模型以冗长的格式存储文章?直接给我们提示词就行了。6个月后,用更新、更大、更好的模型,我们只需输入同样的提示词,就能生成更优质的文章。

但你得保留完整的编辑历史和所有使用过的提示词,而大多数人目前还无法有效记录这些信息。

jqbd

59分钟前

我会将所有提示词作为文档保存,但就我个人而言,我不确定用更先进的模型重新运行整个提示词历史是否值得。编辑:我指的是小型代码库,而不是文章。

maxaw

为了辩论的完整性——我认为首页上的文章通常不是一次性生成的(可能经过多次来回优化)。而且,说实话,我觉得普通读者其实并不想阅读提示词,因为提示词信息密度太高。

不过,我还是希望有一个惯例,即在文章或代码库中包含提示词历史,这样人们可以根据自己的需求选择是否查看。

throwaway219450

这是一个引人深思的问题。

极端情况下,你可能会看到充斥着陈词滥调的个人故事和亚马逊联盟广告的食谱类博客垃圾内容,这些内容往往在正餐之前就已铺垫(请原谅这个双关语)。如果这些前导内容无关紧要,为什么不让LLM解析99%的食谱网站使用的语义标记(用于Google SEO),从而为你生成定制内容?比如食材的历史背景,或者根据你的厨房设备、烤箱的具体温度和时间调整的更详细的烹饪说明?我能看到一个中间地带,即发布某种上下文信息,让用户LLM生成内容。这本质上与戏剧化的非虚构作品有何不同?想想像《Mincemeat行动》这样的书,事实经过深入研究,但作者使用大量艺术创作来讲述故事。但回到你的观点,如果存在反复修改的过程,我希望人们能更多关注LLM写作的明显特征。并不是每篇文章都需要像快节奏的编辑文章那样,但我感觉我们仍处于早期阶段,人们刚刚拿到这项技术,只是兴奋于能快速生成连贯的1000字叙事。

hamandcheese

我很多PR的产生都源于与AI数小时的反复讨论。在许多情况下,我的提示词总和远大于最终输出内容。

petesergeant

这里的谬误在于,你无法将“AI生成”这一广泛概念简化为单一标志。至于为什么不能“让我们看看提示词”:

https://sgnt.ai/p/prompt-is-not-the-work/

agnishom

如果文章既准确又有趣,你还会在意是谁写的吗?

会,因为我想保留人类联系的轨迹和机制。

Sateeshm

我认为博客时代已经彻底终结了

这个时代人们关注知识/学习的风气似乎已经消亡了。至少以我们过去的方式来看是这样,因为现在许多我们过去需要依靠知识完成的事情,如今都可以由大语言模型(LLMs)来完成。

当然,那个价值64000美元的问题是:如果AI生成的文章与人类撰写的文章无法区分,并且内容准确且有趣,你还会在意是谁写的吗?我们想要避免的是低质量内容,而不是AI生成本身,对吧?

在2026年中期,许多人仍认为大语言模型的写作风格不如人类。这种欺骗性是其中一方面。AI用于拼写检查和校对是一回事;AI以第一人称撰写整篇文章并将其伪装成自己的作品,则是另一回事。我也对充斥在Show HN上的Tailwind风格演示网站感到反感。人们本能地反感的那种内容(通常被称作劣质内容)往往并不那么微妙。当然,谨慎而微妙的使用没有问题(比如电影中的CGI技术),但当我看到Claude风格的表达方式和那些过去没人用过的俏皮小标题时,我会直接关闭页面。你可以/应该为自己写作,为了积累写作经验,为了展示作品集,为了分享你感兴趣的事物,比如每天一张照片,等等。为什么这些内容必须消失?

对作者来说,声明“本博客未使用任何AI”是一件非常简单的事。

那么,有什么能阻止AI生成的文章也做出同样的声明吗?

声誉。如果这不是一次性行为,他们最终会被发现并失去受众。

我认为我们现在正处于一个非常有限的时间窗口内,即使通过Pangram等工具仍能检测到AI生成内容。对于小型模型来说,可能情况并非如此。但任何值得付费的内容都可能面临这个问题。

他们只需要犯一次错误。而他们一定会犯,因为LLM用户懒惰,且LLM生成的内容自然会向平均值回归。

如果假币或被盗现金与真钞或诚实的现金无法区分,你还会接受并使用它们吗?不会。为什么?因为这样做会侵蚀甚至摧毁社会。

无论你是否认同骗子只有在被抓住时才是罪犯,还是认为他从一开始就是罪犯,你都应该能理解为什么许多人希望知道自己面对的是朋友,而不是伪装成朋友的AI。

吹牛从来不是犯罪

如果这是犯罪,那么90%的初创公司都将非法,其创始人也将面临监禁。

otterley

欺诈是犯罪,但坦白来说,并非所有吹牛都构成欺诈。

50分钟前

除非你与读者签署了合同,声明“本文未使用LLM撰写”但实际上使用了LLM,这不算欺诈,只是合法的谎言。

但我们甚至还没讨论到这点,大多数作者根本不会声称自己没有使用LLM。

fuckaiwriter

[还有4条]

[已标记]

simonreiff

你为什么不直接说出你的真实感受,而不是这么模棱两可?

el_io

他们对自身感受的表达其实非常明确。

arjie

这是一个让我总是混淆的英语习语。再举一个例子:

https://englishidiomsblog.blogspot.com/2010/10/tell-us-how-y...

这个习语是某人说“告诉我们你的真实感受”(在这里他改写成了这个表达),用来表达(我认为)某人表达的观点对某事的反对过于夸张。它本应被讽刺地阅读。

thinkingemote

28分钟前

人们在HN上想要的大多数文章都是关于LLMs的,而其中大部分文章本身也是由LLMs撰写的。这些投稿通常读起来非常糟糕,通常也没有什么启发性的亮点,所以如果相关的话,我最多只会快速浏览一下,但HN上关于这些投稿的评论中才可能包含真正的精华内容。

如果你能轻易识别出大语言模型(LLM)写作的模式,这里有些内容或许会引起你的兴趣:我正在阅读一些AI研究者和创始人在消费级LLM出现前发表的论文,这些论文的写作风格与现有LLM生成的文本惊人地相似!

Retr0id

关于第一点,我认为a) 相当一部分选民无法识别AI生成的文本;b) 许多人即使注意到也并不在意,或者如果前提足够有趣,他们愿意忽略这一点。(对我来说偶尔也如此)

也许我们需要一个二维投票系统:好坏评价/是否AI生成。我认为第二个维度可以减少关于文章中AI生成内容比例的元讨论。

许多人即使注意到也并不在意,或者如果前提足够有趣,他们愿意忽略这一点

我想象中那些既足够有趣值得阅读,又不够有趣值得原创的文章集合,可能比你想象的要小得多。

在大多数情况下,评判标准不是"是否值得阅读",而是"是否值得讨论"

那为什么还要访问这个网站?如果这里全是LLM生成的帖子和评论,不如直接让Claude为你创建一个自托管的"杜鲁门秀"风格论坛,用LLM生成的内容来发泄你的观点。

andrewmutz

我们为什么需要比"好坏"更复杂的分类标准?

如果某篇关于某个主题的优秀文章作者在创作时使用了AI,这有什么不好吗?

不同的人对"劣质"因素的容忍度不同,这正是当前的主要痛点。(例如,这条线程中另一个顶级评论建议直接禁止AI生成内容)

"劣质"和"差"之间有什么区别?

随便找一篇你认为有洞察力的文章,然后让LLM"重写它,但让内容更好更吸引人"。如果保留了原文实质内容,结果很可能是"优质+劣质"。

hallman76

a) 相当一部分选民无法识别AI生成的文本;b) 许多人即使注意到也并不在意,或者如果前提足够有趣,他们愿意忽略这一点。

我同意。对我来说,问题在于有声音的群体似乎对AI编辑的内容充满厌恶,却无法将这种厌恶转移到其他地方。AI编辑只是另一个工具,就像拼写检查一样。

如果这里人们所说的属实,且在线AI使用率正在加速增长,那么到今年年底,互联网上(被HN读者链接的)绝大多数文章都将是AI生成的劣质内容,届时这将不再重要。"这篇文章是AI生成的"对讨论的贡献,大概等同于"作者用了拼写检查"。

优秀的链接聚合平台应该致力于筛选出不到1%的真正高质量文章。谁在乎"所有人"在做什么?

pixl97

这不是投票系统本来的作用吗?如果用户选择的是低质量内容,那到底有什么意义?

那我们就完蛋了。一个高质量平台必须追求比普通浏览者(很可能是机器人)认为值得阅读的更高标准。这就是你得到现代Reddit的原因。

这个网站的目标是保持高质量,还是依赖随机匿名用户来判断质量?考虑这两种选择可能无法兼容的可能性。

teiferer

这可能会让你意外,但"随机匿名用户判断质量"正是这个网站的运作方式,而且效果相当不错。

我必须反对。它与十年前的状况相去甚远。

这在实践中往往不如纸面设想得那么理想。具体来说,AI使用存在大量误报,这经常在社交媒体上引发舆论风暴。当有人恶意声称“AI?”时,原帖作者不得不为自己辩护,而撰写博客文章时,这种辩护方式并不那么具体有效。(不,要求查看帖子的编辑历史并不合理)

Hacker News采用此类功能很可能会弊大于利。

Joel_Mckay

uBlock Origin用户已经过滤了大量“AI”垃圾网站。在搜索特定内容时能节省大量时间。=3

https://github.com/alvi-se/ai-ublock-blacklist https://github.com/laylavish/uBlockOrigin-HUGE-AI-Blocklist https://github.com/Stevoisiak/Stevos-AI-Blocklist/

仅从BlockOrigin-HUGE-AI-Blocklist黑名单中的网站来看,它会过滤

所有与AI相关的网站

例如Hugging Face和其他模型开发公司如Mistral/Z.ai,而不是实际发布AI垃圾内容的网站。

这正是这种宽泛规则带来的典型问题的绝佳例子。

总体而言,每个黑名单针对的是垃圾内容农场结构的不同方面。某些LLM使用场景如搜索是合法的,但大部分流量都与垃圾信息相关。

这取决于你的使用场景,但大多数人并不需要用于网络骚扰(如YC AstroTurf帖子)的内容。=3

过度草率地使用标记/封锁功能是通过使社区变得过度有毒来摧毁社区的可靠方式,我对此有切身体验。

我对YC平台上“AI”相关内容的频率是否能代表真实用户兴趣持怀疑态度。但我也同意,这个世界存在很多文化差异,这些差异对某些用户来说并不容易理解。有些人会认为,只要在某个话题上意见不同,就等同于某种人身攻击。

即使只是给帖子打分,也会明显改变人们的行为,研究显示这往往会让人们对他人的行为更加严厉。至少,YC应该在帖子上设置机器人验证码保护。因为让聊天机器人对用户进行骚扰通常是不尊重的,只会让人对真诚参与对话失去兴趣。=3

我怀疑YC平台上“AI”相关内容的频率是否能代表真实用户兴趣。

你是暗示首页被机器人操控/操纵了吗?

不确定为何话题会聚焦到如此狭窄的范围,但与过去大多数技术人员拥有的多样化兴趣相比,现在LLM权重似乎成为一个即使与实际使用场景无关也过度代表的话题。

设置机器人验证挑战可能会提高信噪比,但谁知道呢。=3

shahzaibmushtaq

41分钟前

AI并没有比人类更高的权力。

AI并不比人类拥有更高的权力,而且永远都不会。作者和作家有责任明确告知观众/读者他们的作品是AI生成的,或AI生成内容所占的比例。

这确实是个难题,因为有些想法可能没有AI的帮助就无法存在。

我个人最近发表了一篇关于民主理念的白皮书,这个想法在我脑海中酝酿了数十年。AI帮助我完善了这个想法,撰写文本内容并构建白皮书的结构。我不是学术研究者,如果没有AI的帮助,我可能永远无法将这个想法完整地呈现出来。但我认为,与其让这个想法一直停留在脑海中直到我去世,不如将其发表出来让更多人看到。我同意如果有人能手写一份学术版本的该理念,那会更好。但至少AI生成的版本比从未发表要强得多,我仍然花了整整两天时间检查每个段落,确保自己认同其中的观点并修正了所有能发现的问题。总体而言,我认为人类在创作过程中投入的努力程度,可能比是否使用AI辅助创作更能衡量作品的质量。

dawnerd

考虑到YC投资AI,我怀疑你在这里会看到类似的观点。这里太多人认为你只能屈服并接受(我认为这是施暴者的思维模式)。

我很想知道你是否读过

https://news.ycombinator.com/item?id=48887149

等我完成编辑后,告诉我这个内容是否改变了你的看法,或者没有改变。

我认为这个观点非常合理。我一直觉得标记(flagging)功能有些奇怪,因为没有附带任何理由。即使不显示在UI中,如果某个链接被标记足够多,能在HTML中添加一些标识,这样人们可以通过CSS过滤掉它们,这会是个不错的设计。

这并没有改变我的看法,这与原帖作者的观点一致。

你能否解释一下原因?

xdennis

考虑到YC投资AI,我怀疑你在这里会看到类似的观点。

阴谋论的回应价值很低,而你的回应尤其如此,因为HN禁止AI相关评论。

rsoto2

投资者希望看到他们的投资增值。什么阴谋?HN还曾邀请了一位可能的战争罪犯谈论他在加沙杀害儿童的经历。你认为这些人有道德或理想吗?

HN还曾邀请了一位可能的战争罪犯谈论他在加沙杀害儿童的经历。

什么?你是什么意思?“邀请”?我知道互联网上人们喜欢随意指控他人犯下滔天罪行,然后据此推断除了自己之外所有人都没有道德或理想,但这个说法让我感到不适。

browski

[10 more]

lkt

我认为这并不是一个很好的类比。人们可以在没有专家的情况下驾驶汽车,但无法制造汽车。人们可以在不成为专家的情况下使用软件,但制造软件仍需要专家。

AI可以在制造汽车和软件方面提供帮助,但你仍然需要在这些领域具备足够的知识才能获得良好的结果。

人们可以在没有专家的情况下驾驶汽车

并非每个人都能驾驶汽车。> 但无法制造汽车。并非每个人都不具备制造汽车的能力。例如:我父亲,1935年出生,至今仍然健在,他建造过双轴拖车、汽车和车辆,还为St Johns Ambulance建造过医疗救护车。他的教育只有六年的小学教育,这些都是他或他的社区的“副业”。> 你仍然需要在这些领域具备足够的知识,而对普通人来说,获取足够知识以安全地制造软件、汽车,甚至地面效应飞行船的门槛并不高,尽管这确实需要一定的实干精神。

程序员并不制造计算机。EE(电气工程师)和计算机工程师才负责这些。

他们正朝着销售一种无需支付程序员薪资和福利(所有工具都需要存储和复制)的芯片内置模型计算机前进。这是资本主义,而非荣誉义务主义!保住你的工作可不是别人的负担!颠覆吧!(YC社群15年前的主张)。哦,局势竟已反转。将代码的上下文转移到呈现层,通过让硬件专注于几何变换计算来消除状态。Biggidy bam,直接在显示屏上标注数据,同时保存几何信息和标签。业务逻辑上下文在代码中存在没有任何理由。

在AI出现之前,任何人都可以成为程序员。

“我14岁,但我觉得这很深奥。”

大语言模型(LLMs)是对知识产权的大规模盗窃。我过去十年根本不需要它们来“驱动”这台计算机。

tancop

22分钟前

“知识产权”从未真正存在过。只有版权(确保书籍出版商支付作者报酬)、专利(鼓励发明者公开研究而非保密)和商标(保护买家和工厂声誉免受假冒商品侵害)。

它们是为完全不同的目的而创建的不同系统。将它们统称为“财产”的想法源自游说者,他们希望人们认为这些是应被无限扩展和保护的自然权利,而非特定用途的工具。这导致了如今的体系:即使没有版权声明,发布任何内容都能获得70年加生命的完全独占权;但如果你与雇主签订了糟糕的合同,他们甚至会声称你所有的工作都属于他们,即使你是在业余时间完成的,并威胁你若试图抗争就起诉你。这种体系对艺术家的保护(看看音乐产业就知道了)很糟糕,对公众的保护更差。LLM供应商(而非模型本身)所做的事情并非真正的盗窃,因为如果你一直拥有原物,就无法偷窃。他们真正做的是在训练LLM时使用每个人的作品,然后对结果声称版权。这才是真正的不公。这也是为什么我认为在AI领域,开源 === 道德。如果你获取了,就必须回馈。唯一真正的永久解决方案是彻底重新平衡。所有“知识产权”应仅限商业用途,且有效期不超过25年。这意味着只要不从中获利,盗版就是合法的。未支付的版税是真实人的问题,而盗版只伤害公司。我知道自己站在哪一边。

顺便说一句,我认为社交媒体评分很俗气。

它只是刺激人们对虚假的赋权感和社会贡献感上瘾。向下投票以隐藏你不喜欢的观点和想法。保守派是唯一因无法理解或验证自己经验与固有偏见的想法而变得极度失调的人,他们试图将这些想法隐藏起来。这些人并非我真正关心判断的对象。

SilverSlash

顺便说一句,我认为社交媒体评分很俗气

我同意。在点赞系统普及之前,我们至少已有十年的大型繁荣在线论坛,那时一切都很正常。

“任何不同意我的人都是住在洞穴里的保守派”

继续和那些谄媚的、诱发心理疾病的大语言模型聊天机器人聊天吧,我觉得你会玩得更开心。

DevKoala

只关心一篇文章是否具有信息量、基于事实、保持中立等。文章是如何撰写的对我来说并不重要。

nunez

我一个月前就提出过这个请求:

https://news.ycombinator.com/item?id=48296731

我很高兴这个想法正在获得更多关注。在我看来,如果足够多的人标记内容为AI生成,帖子标题应该加上"[AI Generated]"标签。

KingOfCoders

一篇文章要么优秀,要么不优秀。

我不关心是人类、AI还是猫写的。

ramon156

我为此做了一个个人扩展程序 :) 如果我发现某人主要发布AI生成的信息,我会将他们加入我的黑名单。

在个人层面有效,但不确定在实践中是否适用。也许只需添加一个标签就足够了,这样人们可以自己判断。我知道有一些扩展程序在民主化方面做得不错,比如与YouTube相关的DeArrow和SponsorBlock。

你公开过你的黑名单吗?请让我看看。

ivanjermakov

18分钟前

距离下一代大语言模型生成与人类无法区分的文本还剩不了多久。投票系统通常足以过滤掉低质量内容。

tukunjil

我在这里表达过类似的观点:

https://news.ycombinator.com/item?id=48039702

rddbs

我更关心隐藏与AI相关的内容,而不是文章中是否包含AI生成的内容。感觉现在HN上的大部分内容都与AI相关,这真的很令人疲惫。有人有什么方法可以纠正这种内容比例吗?比如浏览器扩展?

insin

在我的HN扩展程序中,我设置了默认的"AI"关键词和域名过滤器(可以单独切换,这样你可以保持个人过滤器独立):

https://soitis.dev/comments-owl-for-hacker-news

warshinder

33分钟前

我只是先看评论。我可能不应该这么轻易透露这些HN秘密,但人们总会评论是否是AI生成、是否值得阅读、是否无法加载,而在早期HN时代,这实际上帮助提交者避免了"死亡拥抱"。这种方法对付费墙内容也有效,有人会评论存档版本。

admiralrohan

35分钟前

我们应该优先重视原创思考,而不是思考内容是否由AI生成。人类可以手动输入激励性的废话,也可以将AI作为原创论点的思考伙伴。哪种更有价值?

lazyasciiart

有没有类似[1997]的标题标记?这类内容可能有人感兴趣,也可能不感兴趣,但如果知道其来源,人们的反应会不同。

这是我听到过的最佳解决方案之一。只需在标题后添加[AI]。不过可能应该用[SLOP],因为"AI"这个词有合法的用途。

aryehof

这让我担心,人们可能仅通过暗示某内容是"AI生成",就轻易忽视或压制特定人类观点。

itsgrimetime

我不反对对AI生成内容进行标记。不过,我希望能看到更多关于内容本身的互动,而不仅仅是写作方式。我知道很多人这么认为,但我觉得我看到的越来越多的是对写作方式的即时否定或批评,而不是对提交内容本身的讨论。

lukasbm

没人喜欢直接阅读未经筛选的聊天机器人输出,但这也无法检测。

CqtGLRGcukpy

我看到的问题是,有些人认为是AI生成的内容实际上并非如此。而且AI检测工具还不够可靠,无法明确判断某内容是否为AI生成。

esjeon

没错,将一篇由人类撰写的文章标记为AI生成会是一种严重的侮辱。对AI生成内容进行标记会给社区带来比仅仅存在AI生成内容更大的伤害。

如果实施类似措施,在模棱两可的情况下必须给予善意的推定,但我觉得大多数时候其实并不难判断。

最新版本的codemaxxed模型在未经特别指示的情况下,通常会以非常独特且易于识别的方式写作(说实话,如果你不想浪费时间阅读AI生成的文本,这反而是件好事)。一个很好的例子是目前在首页排名第一的这篇投稿(同时也是披着羊皮的广告):https://news.ycombinator.com/item?id=48884853

nyellin

不,因为每篇文章都会引发关于是否为AI生成的讨论,以及生成程度的争论。让内容本身说话才是关键。

brador

16分钟前

证明给我看。

一篇好文章就是一篇好文章,不管是谁写的。AI文章的主要问题在于事实的模糊化,这才是应该被纠正的。

mattas

此时或许更合适添加一个"非AI"的标记。

jaredcwhite

我深信AI生成的文本根本不应该出现。但证明这一点可能很困难(除了显而易见的LLM特征外)。要求提供真实人类作者的证据同样困难,不过我越来越倾向于那些将真实作者身份视为任何合法分享前提的社区。

ldoughty

什么才算AI生成?如果人类先写出来,然后用AI优化/修改,这种情况是否算作AI生成?

如何判断哪种情况?如果我们完全不允许AI协助,是否可能对那些不擅长用不完美英语发表内容的人造成歧视?我原则上同意,但在实际执行中有所担忧...我不确定在不产生歧视风险的情况下能否做到公平(编辑:拼写修正)(编辑:或者我是不是AI?!而且修改看起来更合理...(明确说明:我不是,我遵守规则))

[还有2条]

AI撰写的评论比你在这篇帖子中迄今为止的评论更有建设性。

stackghost

我越来越倾向于那些将真实作者身份视为任何合法分享前提的社区。

我很难找到这样的社区。

Mastodon,但最大的问题是发现机制确实很困难。

mleroy

与其追查和标记AI内容,不如使用"自我标注原创内容"。让作者自愿用[Handmade]、[Craft-Article]或[Artisan-Thinking]等标签标注他们的链接。

atomicthumbs

让某人阅读由机器撰写的内容是对他们时间的不尊重。如果你自己都不够重视到亲自撰写,为什么其他人要重视到去阅读?它的价值为零。

jeremyjh

常规的投票系统并不足够,因为帖子无法被踩掉,而且出于某种原因,很多人似乎并不介意阅读那些没人愿意撰写的内容。

问题的复杂性在于,人们可能在写作之外的流程中投入大量精力,因此AI生成的内容并不保证内容没有价值。但为了确立重视真实人类交流的规范,我倾向于对其进行惩罚。我认为这种规范一直存在,只是在真正探索过替代方案之前我们并未意识到。我花大量时间阅读AI生成的内容,因为我经常使用AI进行各种用途——也许我对AI的“声音”更敏感。AI的“声音”总是让我感到困扰,而且随着我对其越来越敏感,这种困扰也变得越来越严重。但当我阅读自己提示生成的回复时,与阅读一个我从未见过的提示生成的回复时,存在巨大差异。当我不清楚作者进行了多少次修改,或者是否有人类在发送前审查过内容时,这种差异更加明显。这会成为无法接受的干扰,因为我不确定自己是否比作者投入了更多时间在内容上,而在正常的书面交流中,作者至少会投入五倍的努力。

visarga

当看到AI生成内容的明显特征时,我也感到烦躁。例如,我写的内容是最终版本的十倍,这究竟是AI生成的,还是仅仅重新表述了?我不用AI来修改我的评论,只在想发布长篇幅文章到我的博客时才使用AI进行格式调整。

人们一直在问这个问题,但在我看来,这根本不是需要考虑的因素——如果AI没有生成内容,它就不会有AI的“声音”。在某种程度上,人类已经学会识别一些特征,但写作过程的一部分包括阅读自己的作品,发现其中不自然的地方,并进行修改。如果你甚至没有投入这么多精力到写作过程中,我也不想读你的内容。

我的全部立场:我不感兴趣阅读听起来像是AI生成的文本。

11分钟前

我的全部立场:我不感兴趣阅读听起来像是AI生成的文本。

我认为这是一个合理的态度——如果作者甚至没有花时间阅读自己的文章,他们凭什么期望别人去阅读?如果他们确实阅读了,他们应该立刻就能察觉到文章的AI风格。

nickandbro

即使你这样做,你又如何执行呢?假设这是一篇纯文本文章,你是否要计算破折号的数量?即使是专门为检测AI生成内容设计的扫描仪也存在严重缺陷。

rienbdj

提问:在Hacker News上添加一个标记AI相关文章的标志?

jvwww

我个人使用Pangram的Chrome扩展程序,它在识别AI生成文本方面非常出色。

这并不是非黑即白的问题。许多文章的创作过程始于人类进行头脑风暴,撰写草稿,然后由AI填补空白或润色语言。也许作者不是母语者,或者有阅读障碍。很难划出一条明确的界限。

edoceo

也许只需在提交内容时添加一个反对票?

jagged-chisel

我们有“标记”功能。

据我所知,“标记”功能的目的是用于违反指南的内容。AI生成的内容在评论中被明确禁止,但不适用于提交内容。

我认为如果AI生成的提交内容被完全禁止,这将是一个很好的措施,因为它们从根本上破坏了Hacker News建立的努力平衡,但正如另一位用户所说,YC对AI有重大投资,因此存在利益冲突。

al_borland

不为自我宣传发帖是社区指南中的规定。我必须假设任何推送AI相关文章的人主要是为了获取流量和自我宣传,因为他们并没有足够重视这个话题,以至于愿意写出自己的观点。

自我宣传并未被禁止,否则就不会存在Show HN页面。具体的社区指南,重点部分由我强调:

请不要将HN主要用于自我宣传。偶尔发布自己的内容是可以接受的,但该网站的主要用途应是激发好奇心。

add-sub-mul-div

如果这些指南没有被严格执行,它们还有意义吗?这里充斥着大量来自仅用于自我宣传账户的AI工具软件投稿。

JimsonYang

HN很少允许用户进行反对投票,只有在你成为活跃成员多年后才被允许

我相信这被设计成鼓励积极讨论的机制

现在提交内容已经没有反对票功能了

你知道原因吗?允许对评论进行反对投票但不允许对提交内容进行反对投票?

这可能是一个错误的记忆,但我认为其初衷是将反对票仅限于违反规则的内容,而在这种情况下,应该标记帖子而不是使用反对票。

what

那评论是否也应如此处理呢?

ranger_danger

关于对评论进行反对投票的能力,我的理解是唯一的要求是至少拥有500声望值。

luciana1u

标记功能应该增加第三个选项:'人工撰写但希望AI能阻止他们'

hgs3

我们是否也可以标记在Show HN上发布的AI生成项目?

我曾经喜欢阅读HN上的人工撰写文章和手工制作项目,但在LLM时代,质量明显下降了很多。我发现自己越来越多地转向其他论坛,这些论坛会标记、限制或禁止LLM内容。

最近指南新增的规则提到:"不要发布生成的文本或AI编辑的文本。HN是人类之间的对话。" 我认为这涵盖了评论,但很高兴看到它也能涵盖那些明显且主要(如果不是完全)由AI生成的文章。但允许多少AI内容?例如:我现在正在写一篇博客文章。全部都是我自己的内容。如果我在最后加入一个AI生成的插图,只是为了说明某个观点,而不是文章的主要内容,这算AI生成吗?这个规则是否保守到足以让主要由人类撰写但明显也经过AI增强的内容被标记?由谁来决定?你如何建议执行规则(针对文章,而不是通常比较明显且自从规则实施后基本停止AI生成的评论)?

在Lobsters上提出类似问题差点让我被踢出社区。

那如果你用AI做部分研究,然后自己输入文本呢?

这是一个好问题。我的观点是,AI辅助研究是一种重要且有效的用途,获取人工撰写的文章和论文(我认为)正是这个讨论的全部意义。

然而,这个网站上许多学术或技术文章实际上包含了AI幻觉(这个问题在HN上并非独有,公平地说)。如果一篇文章或论文包含不存在或明显、公然错误的引用,我会非常强烈地认为这种内容是对HN读者的不尊重,尤其是对我而言,因为我刚刚浪费了时间试图认真对待作者,却发现自己所依据的论点建立在幻觉之上。在某种程度上,对我而言,幻觉是否由AI造成并不重要——如果某人添加了虚假的引用,无论是AI生成的还是其他方式,我认为他们的文章或论文完全应该被标记,以避免浪费他人的时间。

smallerfish

如果增加了向下投票功能,现有的投票系统可能就足够了。

AI写作本身并不是问题——低质量才是问题。低质量的AI文章充满了明显的特征,如果你做过大量AI写作的话,这些特征是显而易见的。要使用AI写出高质量的内容,你需要投入大量时间进行编辑。如果你提交了一篇低质量但带有吸引HN读者的标题的文章,即使文章内容轻量,你也可能登上首页(这种情况确实发生过!)。这在AI生成文章和人类撰写文章中都是适用的。另一方面,有人可能会投入大量精力使用AI创作出杰作。仅仅因为使用了工具就对这类作品进行惩罚是任意的。

awllau

我也有同感。很多人使用AI来润色他们的写作,使其更加简洁。

我认为那些明显的特征(破折号、不是X而是Y等)反复出现确实令人厌烦。一个人不花时间去除这些特征,会让我觉得他是在“低质量”地写作。

你为了写这篇文章而创建新账号这件事本身就说明了一切。

这只会进一步加剧人们对LLM的偏见。在Lobsters上,情况甚至到了我再也不觉得欢迎的地步,尽管我并不使用LLM来生成文章。那些“这是AI垃圾”的评论也让人感到嘈杂和疲惫。

tadfisher

你为什么不再感到欢迎了?

三年来我的工作被归类为“垃圾”,仅仅是因为几个月前我订阅并开始使用Claude。有人甚至说我是个“垃圾爱好者”,仿佛我是个展览狂。我被标记了太多次,根据他们自己的统计数据,我成了网站上第二多被标记的用户。网站本身甚至要求我删除账号,其他用户也直接告诉我让我离开。我想我之所以没有离开,只是因为足够多的人私下联系我,请求我留下。

事情到了这样的地步,我甚至坐拥已经审查和测试过的Mesa补丁,却因为Claude参与了它们的制作而感到羞愧,以至于无法提交。

我想你已经明白我的意思了。

偏见?当然存在。

更多人希望与真实的你打交道。

mattoxic

对于那些伪装成创意作品的LLM生成内容,绝对需要有相应的偏见。

AI垃圾就是AI垃圾。

sjs382

看起来我们每隔一天就会看到类似这样的帖子...

danieltanfh95

  1. 因为你认为AI生成的文本比人类撰写的文本更差,这种观点是完全不合逻辑且错误的。
  1. 不要仅凭封面判断内容,要深入思考。

我认为这个提议是荒谬的。

你是否会因为文章是用文字处理器写的而跳过?你是否需要它一点一点地写,直接在内存中融合?AI / LLM 就是新的文字编辑器。接受现实吧。我真正感到恼火的是所有假装能看见 / 检测 AI 内容的评论……却产生大量误报。

Cadabrum

你还不如尝试标记那些愚蠢的文章。顺便说一句,这会是一个有用的特性。

lpribis

这是错误的等价关系,文字处理器完全保留作者的意图,并且完全由作者确定性地控制。生成式 AI 并非如此。

deadbabe

如果 AI 文章质量差或低劣,这有道理。但假设有一天,AI 生成的内容

实际上

变得很好?好到甚至超过任何人类创作的水平?

是否仅仅是出于“人类优越论”的欲望,才推动人们去禁止或屏蔽这类文章?

unsungNovelty

想象一下你用你自己的风格写作。再想象有成千上万个你同时写作。这就是 LLM。就像你不喜欢每天吃同样的东西一样,重复很快就会变得无聊。更令人烦躁的是,它甚至更容易让人厌烦。

这并不只是关于最终输出。在我看来,最终输出已经很好了。现在的问题是“如果你对表达自己的想法毫不在意,我们又为什么要在意阅读它?”你的写作有多糟糕并不重要。你有自己独特的风格。你写作并不断改进它。更不用说,每次我写作时,我的思路都会越来越清晰。写文章的过程会杀死这个过程。这是关于未知的未知。你甚至不知道你不知道什么,直到你开始写作。LLM 在这里帮不上忙。它可能帮你获得一些点赞。

user3939382

太好了,我可以用一个 CSS 规则隐藏任何带有该标志的内容。

kgwxd

听起来这是 AI 的工作。为什么人类要浪费时间做这种事?任何发布这类内容的账号都应该被封禁并删除。

我不得不创建一个 killfile 列表来屏蔽网站上其他用户的重复评论。很可能我们最终不得不为自己创建这样的 killfile 列表,用于屏蔽那些主要生成文本的域名(网站)和用户。

对我来说,这些文本的问题在于信息密集的部分往往不真实,而大部分内容并不信息密集。它只是某种毫无意义的填充文字。“35% 内存。3 倍贯穿。没有延迟权衡。这就是全部要点。”好吧,为什么这里突然加上了这个随机的“这就是全部要点”?毫无用处。我知道说“HN 正在变得像 X”已经过时了,但这就是纯粹的 LinkedIn 垃圾。有人发布纯粹的胡言乱语,他们的粉丝群却纷纷点赞并评论“我非常兴奋看到这个。太棒的帖子”。

为什么常规的投票系统不够用?

投票系统可以被操控,而且随着 HN 越来越大,它会开始吸引一些有议程的不良用户。

Arubis

撇开主观性不谈,我认为可以安全地说,从这个网站目标受众的大多数观点来看,这种“开始”已经很久以前就发生了。PG 关于潜艇文章的论文并非凭空而来,而且他在这里已经……十年没活跃了?大概?

我的原始账户可以追溯到 2010 年,即使那时他也不太活跃。

senectus1

我们如何检测 AI 生成的文本?

人类?作为一个整体,我们在这一点上并不特别有效... AI服务?我们可能不得不为此付费,让AI去检测AI,而且...它本身也不特别有效。有效性很重要,因为我们不希望真实的人类生成数据被意外移除,这一点的重要性不亚于让AI生成数据留在网站上。

其他网站上的类似讨论:

https://lobste.rs/s/ktew3s/who_does_anubis_actually_stop#c_c...

wxw

+1,我很想停止阅读AI生成的垃圾内容。

在我来看最简洁的解释:网站工作人员无法识别大部分AI生成的垃圾内容。原因不重要,但当审核人员本身分类能力差时,审核系统必然会出现故障。

一个简单且有益的措施,可以带来适度的改进且几乎没有负面影响:与Pangram合作。可以将其作为自动化垃圾过滤器添加,或者直接将检测百分比附加到所有帖子上。

feverzsj

直接封禁所有AI生成的内容。

指南

常见问题

列表

API

安全

法律

申请加入YC

联系我们