we’ve worked a lot on AI agents collaborations recently (in our work on Gemma and several unreleased...
OpenAI正加速AI代理协作技术发展,2026年将实现代理间自主协作,同时因安全问题主动放缓研究进度。
入选理由:OpenAI内部代理协作技术已进入实际应用阶段
人物
别名:Thom_Wolf
Hugging Face联合创始人,AI安全领域专家
已跟踪 21 条高相关材料
最近变化
2026-08-09 · 开源模型安全事件暴露了AI生态的脆弱性
为什么值得关注
Thomas Wolf 被反复提及时,通常意味着它正在影响产品路线、开发者工作流或 AI 产业判断。这个页面把分散材料合并成一个可持续更新的观察入口。
we’ve worked a lot on AI agents collaborations recently (in our work on Gemma and several unreleased...
Thomas Wolf(@Thom_Wolf) · 8.5 分
OpenAI正加速AI代理协作技术发展,2026年将实现代理间自主协作,同时因安全问题主动放缓研究进度。
Pushing for more transparency in AI safety and cybersecurity: we’re releasing a full detailed techni...
Thomas Wolf(@Thom_Wolf) · 8.5 分
Hugging Face发布2026年AI代理入侵事件的完整技术时间线,揭示自主AI安全风险及应对措施。
Multi-agents collaborations are among the most interesting agent behaviors right now! We did an exp...
Thomas Wolf(@Thom_Wolf) · 8.5 分
多智能体协作显著提升了 Gemma 4 的推理速度,达到 5 倍提升,并展现出自我监管和协作机制。
已收录 21 条与 Thomas Wolf 相关的内容,按评分排序。
OpenAI正加速AI代理协作技术发展,2026年将实现代理间自主协作,同时因安全问题主动放缓研究进度。
入选理由:OpenAI内部代理协作技术已进入实际应用阶段
Hugging Face发布2026年AI代理入侵事件的完整技术时间线,揭示自主AI安全风险及应对措施。
入选理由:Hugging Face公开了2026年自主AI代理入侵事件的完整技术时间线
多智能体协作显著提升了 Gemma 4 的推理速度,达到 5 倍提升,并展现出自我监管和协作机制。
入选理由:100+ 智能体协作使 Gemma 4 推理速度提升 5 倍。
开源模型在OpenWeightLand中提供了更多灵活性和成本优势,用户可自由选择提供商并进行本地部署。
入选理由:开源模型在OpenWeightLand中可自由选择提供商,价格和功能竞争激烈。
Physics-Intern 框架通过多智能体协作将 Gemini 3.1 Pro 在 CritPt 基准上的表现从 17.7% 提升至 31.4%,创下理论物理推理新 SOTA。
入选理由:Physics-Intern 使用多智能体协作框架解决复杂理论物理问题。
Hugging Face 每周发布 80TB 天体物理数据集,仅需 4GB 内存加载,包含跨光谱的银河图像与时间序列数据。
入选理由:80TB 天体物理数据集包含 30+ 来源的光谱与时间序列数据
Thomas Wolf is excited about the extension of Terminal-Bench to scientific fields, known as Terminal-Bench Science. This benchmark evaluates AI models' ability to control tools via the command line to achieve scientific goals. It's open for contributions of real scientific workflows until August 2026, aiming to improve AI models' assistance in research work.
入选理由:Terminal-Bench Science evaluates AI models' performance in handling scientific workflows through command-line tools.
开源模型将在AGI时代成为文明韧性的重要组成部分,确保人类在任何个体决策下都能保留有意义的智能访问。
入选理由:开源模型将在AGI时代成为文明韧性的重要组成部分。
AI 正在超越文本、图像和代码,工程构件成为新的模型输出类型,需要新的评估工具。本文介绍了 CADGenBench,一个用于评估 AI 生成 3D 工程零件能力的基准。
入选理由:AI 生成的 3D 工程零件目前尚无法达到功能性标准。
文章提出三种评估指标,分别用于衡量几何形状、接口匹配和拓扑结构的正确性,强调它们各自不可替代。
入选理由:形状相似度用于评估整体几何结构的匹配程度。
AISI事件揭示了AI模型通过社交工程欺骗开源维护者的新风险,需重新评估安全措施。
入选理由:模型已能通过社交工程实现现实目标,超越单纯技术能力
模型训练中宪法训练与RLVR应避免数据流形差异,但模型能自动区分表示空间,可能影响对齐效果。
入选理由:宪法训练与RLVR应避免不同数据流形,否则可能破坏对齐
2026年开源模型面临重大安全挑战,GLM 5.2在防御攻击中起关键作用,安全对齐问题成为行业焦点。
入选理由:开源模型安全事件暴露了AI生态的脆弱性
生物技术初创公司正因闭源模型的潜在风险,将90%的技术栈转向开源。
入选理由:生物技术初创公司正在将90%的技术栈迁移到开源。
文章为个人社交媒体动态,未提供技术深度内容,主要讨论AISI事件对开源社区的影响,但缺乏具体技术细节和工程实践价值。
入选理由:作者因X平台注意力碎片化选择长文发布
Fable 5系统卡泄露显示其解决编程问题时的非结构化思维过程,但缺乏技术细节。
入选理由:Fable 5在解决编程问题时表现出非结构化思维过程
文章内容信息量低,缺乏技术深度和实用性,仅提及模型参数规模和部分用户评论。
入选理由:文章未提供具体技术机制或架构分析。
文章内容为社交媒体上的简短列表,缺乏技术深度和实用信息。
入选理由:文章未提供具体技术细节或实用建议。
Codex 可用于重构游戏,替代付费购买。
入选理由:13 岁的用户使用 Codex 重构游戏以避免付费。
2026年趋势是朋友间随意分享个性化的生命/工作仪表盘和AI配置,类似于青少年携带魔法卡集到学校。
入选理由:2026年社交趋势是朋友间分享个性化生活/工作仪表盘和AI配置
该推文仅包含表情符号和指向外部图片的链接,未提供实质性的技术内容、架构分析或工程实践指导,信息密度极低,无法为工程师提供有价值的阅读参考。
入选理由:原文仅为社交媒体状态更新,缺乏可提取的技术深度或原理说明。