Google DeepMind 推出 SIMA 2:在虚拟 3D 世界中推理、学习和交互的 AI 智能体
Google DeepMind 发布 SIMA 2,集成 Gemini 模型作为核心推理引擎,使智能体从指令跟随进化为可推理、可对话、可自我改进的交互式游戏伴侣,在未训练过的游戏(如 ASKA、MineDojo)中表现出接近人类的泛化能力。
推荐理由:SIMA 2 展示了将 Gemini 推理引擎与具身智能体结合的路径,包括自我改进和跨游戏泛化能力,为后续研究提供了可验证的方向。
公司与模型
Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。
62 条精选近 30 天 7 条共收录 105 条
Google DeepMind 发布 SIMA 2,集成 Gemini 模型作为核心推理引擎,使智能体从指令跟随进化为可推理、可对话、可自我改进的交互式游戏伴侣,在未训练过的游戏(如 ASKA、MineDojo)中表现出接近人类的泛化能力。
推荐理由:SIMA 2 展示了将 Gemini 推理引擎与具身智能体结合的路径,包括自我改进和跨游戏泛化能力,为后续研究提供了可验证的方向。
Google DeepMind 在 Nature 发表论文,分析了视觉 AI 模型与人类在组织视觉世界知识上的系统性差异,并提出一种三步对齐方法:先用 SigLIP-SO400M 加小 adapter 生成百万量级的 AligNet 数据集,再用于微调其他模型。
推荐理由:论文给出了完整的三步对齐方法(SigLIP-SO400M → AligNet → student)和在认知任务及标准 AI 任务上的量化提升,读者可提取一个可迁移的多步骤对齐范式。