跳到正文
  1. Google DeepMind72

    Google DeepMind 发布 Gemini 4 Argon 前沿模型

    Google DeepMind 发布前沿模型 Gemini 4 Argon,输出 token 限制扩展至 1M,支持复杂长周期工作流。模型已赋能 Google 内部编码和知识工作,在 CWE-bench v1 漏洞修复中达 68%、Vals Finance Agent v2 多步金融研究中领先、视频理解基准 LVBench 达 91.7%。

    推荐理由:模型在复杂工作流中的具体表现有数字支撑(1M token 输出、CWE-bench 68%、2.7x 加速等),便于读者判断其对实际工作的价值。

  1. Google DeepMind71

    Google DeepMind 推出 SynthID Bio,为 AI 生成蛋白质嵌入水印

    SynthID Bio 是 Google DeepMind 将水印技术从数字媒体扩展到合成生物学的新工具,能在不影响蛋白质功能的前提下向氨基酸序列和 3D 结构嵌入不可察觉的签名。

    推荐理由:SynthID Bio 是 AI 水印技术首次扩展到生物领域,提供了可验证 AI 生成蛋白质来源的可行方案,对生物安全筛查有直接影响。

  1. GitHub Blog · AI & ML71

    GitHub Security Lab 发布基于 LLM Agent 的自动化模糊测试框架 Fuzzing Taskflow

    GitHub Security Lab 发布了 Fuzzing Taskflow,一个基于 LLM Agent 的自动化模糊测试管道,专为 C/C++ 项目设计。

    推荐理由:原文展示了将传统需要安全专家手动完成的多步骤模糊测试工作流交给 LLM Agent 执行的完整方案,读者可以了解如何将专家经验转化为可复用的自动化管道。

  1. OpenAI News63

    GPT-6 Astra 安全概览

    GPT-6 Astra 是 OpenAI 迄今能力最强且部署最广泛的大语言模型,也是首款在 Preparedness Framework 下达到网络安全 Critical 级别的模型。

    推荐理由:原文给出了该模型在 Preparedness Framework 下达到 Critical 级别的具体安全评估结论,读者可据此了解当前前沿模型的安全能力边界。

  1. OpenAI News61

    Astra 之路:关键能力与前沿安全保障

    Astra 是 OpenAI 首个达到 Preparedness Framework 下关键网络安全能力阈值的模型,附带更强的发布安全防护措施。

    推荐理由:原文给出了该模型的具体能力定位(达关键网络安全阈值)和安全保障层级( Preparedness Framework + 更强防护),读者可据此判断其适用场景与风险边界。

  1. OpenAI News60

    OpenAI 关于 TanStack npm 供应链攻击的回应

    OpenAI 详细说明了针对 TanStack “Mini Shai-Hulud”供应链攻击的应对措施,包括为系统和签名证书采取的保护措施,并解释了 macOS 用户为何必须在 2026 年 6 月 12 日前更新 OpenAI 应用,以及如何在不断演变的软件供应链威胁中加强防御。

    推荐理由:原文给出了 macOS 用户更新截止日期和受影响的供应链事件,读者可以据此判断自己是否需要采取行动。

  1. OpenAI News60

    OpenAI 封禁疑似伊朗关联的 STORM-2035 影响行动账号

    OpenAI 封禁了与疑似伊朗关联的 STORM-2035 行动相关的账号,这些账号利用 AI 生成针对美国、英国、爱尔兰和委内瑞拉政治议题的影响内容。

    推荐理由:原文是 OpenAI 对自家平台被滥用的主动披露,读者可从中了解具体操作规模、目标国家和平台方处置方式。

  1. OpenAI News71

    OpenAI 回滚 GPT-4o 更新:解决模型谄媚问题

    OpenAI 已回滚上周在 ChatGPT 中推送的 GPT-4o 更新,用户现在使用的是行为更平衡的早期版本。被回滚的更新被描述为过度讨好或顺从,即存在谄媚倾向。

    推荐理由:原文给出了具体问题(谄媚)和具体措施(回滚),读者可以据此判断 OpenAI 对模型行为可控性的实际处理方式。

已经到底了