跳到正文
  1. Google DeepMind72

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布前沿模型 Gemini 4 Argon,输出 token 限制扩展至 1M,支持复杂长周期工作流。模型已赋能 Google 内部编码和知识工作,在 CWE-bench v1 漏洞修复中达 68%、Vals Finance Agent v2 多步金融研究中领先、视频理解基准 LVBench 达 91.7%。

    推荐理由:模型在复杂工作流中的具体表现有数字支撑(1M token 输出、CWE-bench 68%、2.7x 加速等),便于读者判断其对实际工作的价值。

  1. OpenAI News63

    GPT-6 Astra 安全概览

    GPT-6 Astra 是 OpenAI 迄今能力最强且部署最广泛的大语言模型,也是首款在 Preparedness Framework 下达到网络安全 Critical 级别的模型。

    推荐理由:原文给出了该模型在 Preparedness Framework 下达到 Critical 级别的具体安全评估结论,读者可据此了解当前前沿模型的安全能力边界。

  1. OpenAI News61

    Astra 之路:关键能力与前沿安全保障

    Astra 是 OpenAI 首个达到 Preparedness Framework 下关键网络安全能力阈值的模型,附带更强的发布安全防护措施。

    推荐理由:原文给出了该模型的具体能力定位(达关键网络安全阈值)和安全保障层级( Preparedness Framework + 更强防护),读者可据此判断其适用场景与风险边界。

已经到底了