跳到正文
10月3日周六
  1. The Decoder37

    DeepMind 研究人员提出"人工共生智能"作为技术奇点的替代方案

    DeepMind 研究人员提出"人工共生智能"概念,认为智能是社会现象而非个体特质,应构建人与机器共生的生态系统,而非追求单一超级智能。论文引用 DeepSeek-R1 和 QwQ-32B 等推理模型的研究,表明强化学习训练会自发产生多视角内部辩论行为。研究将 AI 智能体重新定义为可分解组合的临时集合体,预测未来交互界面将从聊天转向网络图可视化,呼吁建立协调人与众多智能体协作的制度框架。

9月30日周三
  1. Simon Willison78

    Anthropic Frontier Red Team 报告:大模型在二进制漏洞利用任务上的能力评估

    Anthropic Frontier Red Team 在 100 个二进制漏洞利用任务上测试了多个模型,发现 GLM-5.3 在 4% 的任务中实现了完整控制流劫持,Claude Mythos Preview 为 6%;而更早的模型如 Claude Opus 4.6 和 GLM-5.2 在任何任务中都未成功,表明一个有意义的能力阈值已被跨越。

    推荐理由:研究给出了具体的能力阈值数字和对比基准,读者可以据此理解当前大模型在网络安全任务上的实际进展。