跳到正文

公司与模型

Google / Gemini 最新动态

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

62 条精选近 30 天 7 条共收录 105 条

更新

精选归档 · 第 3 页

3月26日周四第 41–60 条
  1. Google DeepMind70

    Google DeepMind 发布 Gemini 3.1 Flash Live 音频模型,提升实时对话的自然度和可靠性

    Google DeepMind 推出 Gemini 3.1 Flash Live,这是其最高质量的音频和语音模型,在 ComplexFuncBench Audio 上得分 90.8%,在 Scale AI Audio MultiChallenge 上得分 36.1%(开启 thinking)。

    推荐理由:原文给出了具体 benchmark 数据和多产品可用入口,读者可以据此了解 Gemini 3.1 Flash Live 在音频/语音任务上的能力边界和实际落地场景。

  2. Google DeepMind68

    Google DeepMind 发布 Lyria 3 Pro,可生成长达 3 分钟的结构化音乐

    Google DeepMind 发布 Lyria 3 Pro,这是其高级音乐生成模型,支持生成长达 3 分钟的曲目,并能理解音乐结构(intro、verse、chorus、bridge)。

    推荐理由:原文给出了能力变化(3分钟长曲目、结构感知)和多个产品落地入口,读者可以据此判断它对音乐创作工作流的影响。

3月4日周三
2月27日周五
  1. Google DeepMind77

    Google DeepMind 发布 Nano Banana 2:结合 Pro 能力与 Flash 速度的图像生成模型

    Google DeepMind 发布 Nano Banana 2(Gemini 3.1 Flash Image),将 Pro 版的高级世界知识和生成质量与 Flash 级别的高速推理结合。

    推荐理由:读者可以了解 Nano Banana 2 在速度与能力之间实现的具体平衡,以及它与 Pro 版的定位差异,便于在实际工作中选择合适的工具。

2月20日周五
  1. Google DeepMind75

    Google 发布 Gemini 3.1 Pro,主打复杂推理能力

    Google 正式发布 Gemini 3.1 Pro,正在向 Gemini API(AI Studio)、Gemini CLI、Google Antigravity、Android Studio、Vertex AI、Gemini Enterprise、Gemini App 及 NotebookLM 等产品线推广。

    推荐理由:原文给出了 ARC-AGI-2 上 77.1% 的具体分数和相对上一版本的倍增数据,读者可以直接评估该推理能力的提升幅度。

2月19日周四
  1. Google DeepMind76

    Gemini app 上线 Lyria 3 音乐生成功能,支持文本或图片生成 30 秒音轨

    Google DeepMind 宣布在 Gemini app 推出 Lyria 3 音乐生成模型,用户输入文本描述或上传照片即可在数秒内生成 30 秒定制音轨(含自动生成歌词),支持英语、德语、西班牙语、法语、印地语、日语、韩语和葡萄牙语,面向 18 岁以上用户开放 Beta 测试。所有曲目均嵌入 SynthID 水印以标识 AI 生成内容。

    推荐理由:Lyria 3 以 30 秒音乐生成为切入点展示多模态能力进展,且 SynthID 水印和合规设计在文中都有具体说明。

2月13日周五
  1. Google DeepMind72

    Gemini 3 Deep Think:推进科学研究与工程推理

    Google DeepMind 发布 Gemini 3 Deep Think 重大升级,专注科学、研究与工程领域的高难度推理任务。新版在 Humanity's Last Exam 达 48.4%(无工具)、ARC-AGI-2 达 84.6%、Codeforces 达 3455 Elo、CMT-Benchmark 达 50.5%,并在数学、物理和化学奥林匹克书面部分达到金牌水平。

    推荐理由:原文给出了多个权威基准测试的明确分数和 API 开放入口,读者可以据此评估 Gemini 3 Deep Think 的实际能力水平。

2月10日周二
  1. Google DeepMind79

    Gemini Deep Think 在数学与跨学科研究中取得多项 Level 2 级进展

    Google DeepMind 发表了关于 Gemini Deep Think 模式的两篇论文(编号 Feng26 和 LeeSeo26),展示了其在纯数学、物理学和计算机科学多个子领域的专业研究能力。

    推荐理由:展示了 AI 从竞赛级题目到可发表级数学研究的具体进展,并提出了社区可参考的 AI 辅助数学研究分类体系,适合了解 AI for Science 实际边界的读者。

1月16日周五
12月17日周三
  1. Google DeepMind80

    Google DeepMind 发布 Gemini 3 Flash:速度优先的前沿智能模型

    Google DeepMind 发布 Gemini 3 Flash,这是 Gemini 3 模型家族的轻量版,保留 Pro 级推理能力的同时优化了延迟和成本。在 GPQA Diamond 达到 90.4%,SWE-bench Verified 得分 78% 超越 Gemini 3 Pro,速度是 Gemini 2.5 Pro 的 3 倍,token 消耗减少 30%。

    推荐理由:原文展示了 Gemini 3 Flash 在 GPQA Diamond、SWE-bench Verified 等 benchmarks 上的具体性能数据,以及 3 倍速度提升和 token 减少 30% 的量化指标,读者可以据此评估其对现有开发流程的实际影响。

12月16日周二
  1. Google DeepMind65

    Google DeepMind 发布 Gemma Scope 2:覆盖 Gemma 3 全系列的开源可解释性工具套件

    Google DeepMind 发布 Gemma Scope 2,这是面向 Gemma 3 全系列(270M 到 27B 参数)的开源可解释性工具套件,包含稀疏自编码器和转码器,可用于追踪模型内部决策过程、研究越狱行为和安全干预。该工具套件存储了约 110 PB 数据并训练了超过 1 万亿参数,据称为目前 AI 实验室发布的最大规模开源可解释性工具集。

    推荐理由:原文给出了工具覆盖规模和技术细节,读者可以据此判断这些可解释性工具对研究和安全工作的实际可用性。

12月13日周六
12月9日周二
  1. Google DeepMind65

    Google DeepMind 推出 FACTS 基准测试套件,系统性评估大语言模型事实准确性

    Google DeepMind 联合 Kaggle 发布 FACTS 基准测试套件,包含参数基准、搜索基准、多模态基准和更新的 Grounding v2 四个子基准,共 3513 个样例。

    推荐理由:Gemini 3 Pro 在搜索和参数基准上较 2.5 Pro 错误率大幅下降,但多模态基准仍是短板,读者可据此判断当前模型在事实性任务上的真实差距。

11月24日周一
  1. Google DeepMind70

    Google DeepMind 支持美国能源部 Genesis 任务,以 AI 加速科学发现

    Google DeepMind 宣布支持白宫 Genesis 任务,将与美国能源部合作,面向其全部 17 个国家实验室提供前沿 AI 模型和智能体工具,即日起开放 AI co-scientist(基于 Gemini 的多智能体科学协作系统)。

    推荐理由:文章详细说明了 Google DeepMind 将向美国能源部 17 个国家实验室提供的具体 AI 工具及其已验证的能力(如将假设开发从数年压缩至数天),读者可据此了解此次国家级合作的具体范围和技术深度。

11月20日周四
  1. Google DeepMind65

    Google DeepMind 如何在 Gemini 应用中推出 AI 图像验证功能

    Google 在 Gemini 应用中上线 AI 图像验证功能,用户上传图像并询问"这是由 Google AI 创建的吗?"即可检测 SynthID 数字水印,判断图像是否由 Google AI 生成或编辑。

    推荐理由:Google 将 SynthID 水印验证能力直接集成到 Gemini 对话中,用户只需上传图像并提问即可判断是否由 Google AI 生成,降低了普通用户识别 AI 生成内容的门槛。

  2. Google DeepMind69

    Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image)图像生成模型

    Google DeepMind 发布 Nano Banana Pro(Gemini 3 Pro Image),基于 Gemini 3 Pro 构建的高保真图像生成与编辑模型,支持 2K/4K 分辨率、最多十四张输入融合、改进的文字渲染及图像本地化,并集成 SynthID 数字水印。

    推荐理由:该模型将 Gemini 3 Pro 的能力扩展到图像生成领域,并原生支持与 Google Search 的 grounding 融合,可输出数据驱动的可视化内容。

11月19日周三
  1. Google DeepMind79

    Google DeepMind 发布 Gemini 3 Pro 预览版

    Google DeepMind 发布 Gemini 3 Pro,声称是其最智能的模型。Gemini 3 Pro 在 LMArena 达到 1501 Elo,在 GPQA Diamond 取得 91.9%,在 Humanity's Last Exam 取得 37.5%(无工具使用)。

    推荐理由:原文给出了具体基准分数和功能变化,读者可以据此评估 Gemini 3 Pro 在推理、编码和多模态任务上的能力定位。

11月17日周一
  1. Google DeepMind77

    WeatherNext 2:Google 最先进的天气预报模型

    Google DeepMind 发布 WeatherNext 2,预测速度提升 8 倍,分辨率达 1 小时级别。该模型基于 Functional Generative Network 架构,可从单点输入生成数百种天气情景,在 99.9% 的变量和预测时长上超越前代模型。

    推荐理由:WeatherNext 2 在精度和效率上显著提升,已在多个 Google 产品中落地,开发者可通过多个平台获取数据和定制推理能力。