跳到正文

Google / Gemini

Google 与 DeepMind 的 AI 动态:Gemini 系列、Veo 视频模型、研究成果与产品生态的持续追踪。

最新精选

第 41–60 条 · 共 114 条
6月9日周二
  1. Google DeepMind82

    Google DeepMind 发布 Gemma 4 12B:统一无编码器多模态模型

    Google DeepMind 发布 Gemma 4 12B,这是一款旨在笔记本电脑上运行的高性能多模态模型。它采用独特的无编码器统一架构,将视觉和音频输入直接融入 LLM 主干网络,支持原生音频输入。

    推荐理由:该模型采用无编码器统一架构,在16GB显存设备上实现接近26B MoE的多模态推理能力,适合关注本地部署效率的开发者。

6月8日周一
  1. Google DeepMind68

    Google DeepMind 发布塞拉利昂 AI 辅助学习影响评估研究

    Google DeepMind 公布在塞拉利昂进行的预注册随机对照试验结果,使用 Gemini 驱动的 Guided Learning 工具使学生在八周内数学成绩提升 0.258 个标准差,相当于 1.2 至 1.7 年的常规学习进度。

    推荐理由:原文披露了塞拉利昂预注册试验数据,显示AI辅助教学显著提升数学成绩且学生主动寻求理解而非答案。

6月5日周五
  1. Google Research60

    Gemini Enterprise Agent Platform 推出基于 Agentic RAG 的跨语料检索功能

    Google Research 在 Gemini Enterprise Agent Platform 中推出了由 Agentic RAG 驱动的跨语料检索功能,旨在解决传统单步 RAG 在处理多源、多跳商业查询时的局限性。

    推荐理由:原文介绍了 Gemini Enterprise Agent Platform 中 Agentic RAG 的架构设计与实验数据,读者可了解其如何通过多智能体协作与充分上下文检查提升复杂查询的准确性。

  2. Google Research67

    Google Research 发布 PHRM:通过智能手机摄像头实现被动心率监测

    Google Research 在 Nature 发表研究,推出名为 PHRM 的被动心率监测系统,利用智能手机前置摄像头在日常使用中估算心率和静息心率。该系统在实验室和真实场景下均达到 MAPE < 10% 的精度,且在不同肤色群体中表现一致,其每日静息心率估算误差小于 5 bpm,媲美可穿戴设备。

    推荐理由:原文展示了基于智能手机前置摄像头的被动心率监测系统,提供了跨肤色的高精度验证数据及开源数据集,为无穿戴设备的心血管健康追踪提供了可复用的技术方案。

6月4日周四
  1. Google Research68

    Google 开源水文模型框架以增强全球洪水韧性

    Google Research 在 GitHub 上开源了其水文建模框架,旨在帮助国家气象和水文服务机构将先进的 AI 洪水预测集成到自身工作流中。该 Python 包基于 PyTorch 实现,包含 LSTM 架构和训练管道,支持使用 Caravan 数据集及用户自定义的本地数据进行微调。

    推荐理由:Google 开源水文模型框架,允许各国气象机构利用本地数据训练 AI 洪水预测模型,降低技术门槛并提升预警精度。

5月29日周五
  1. Google Research78

    Google Research 在 I/O 2026 发布 Gemini for Science 与 Antigravity 2.0 等成果

    Google Research 在 I/O 2026 上发布了多项基于最新模型的研究成果和产品更新,重点推出了用于加速科学发现的 Gemini for Science 套件以及提升开发者效率的 Agentic 开发平台 Google Antigravity 2.0。

    推荐理由:原文展示了从科学发现到开发者效率的全栈 AI 工具链,读者可据此了解 Google 如何将前沿研究转化为具体的生产力应用。

5月20日周三
5月18日周一
  1. Google DeepMind68

    Google DeepMind Project Genie 新增 Street View 实景锚定功能并向全球 Google AI Ultra 用户开放

    Google DeepMind 宣布其通用世界模型 Project Genie 新增基于 Google Street View 的实景锚定能力,允许用户选择美国境内的真实地点生成互动虚拟环境。

    推荐理由:Project Genie 接入 Street View 真实影像,让 AI 生成的虚拟环境能锚定现实地点,为智能体训练和创意探索提供新路径。

  2. Google DeepMind86

    Google DeepMind 发布 Gemini Omni Flash 模型

    Google DeepMind 推出 Gemini Omni Flash,这是 Omni 系列的首个模型,支持从图像、音频、视频和文本等任意输入生成高质量视频。

    推荐理由:原文详细说明了 Gemini Omni Flash 支持自然语言对话式视频编辑及多模态输入生成,并给出了具体的分发渠道和订阅权限。

5月17日周日
  1. Google DeepMind73

    Google DeepMind 发布 Gemini for Science 系列科研工具与技能

    Google DeepMind 正式推出 Gemini for Science,这是一套旨在扩展科学探索规模与精度的工具集合。该计划包含 Google Labs 上的三个实验性原型:基于 Co-Scientist 的假设生成、结合 AlphaEvolve 和 ERA 的计算发现,以及利用 NotebookLM 实现的文献洞察。

    推荐理由:Google DeepMind 推出 Gemini for Science,包含三个实验性工具和科学技能包,旨在通过 AI 智能体加速科学研究的核心步骤。

  2. Google DeepMind73

    Google DeepMind 扩展内容透明度工具并发布 AI 内容检测 API

    Google DeepMind 宣布在 Search、Gemini、Chrome、Pixel 和 Cloud 中扩展内容透明度和验证工具,以帮助用户理解网络内容的创建和编辑方式。

    推荐理由:官方详细说明了 SynthID 和 C2PA 在搜索、浏览器及云端的集成进展,并发布了新的 AI 内容检测 API,为开发者提供了识别生成内容的具体工具。

5月16日周六
  1. Google DeepMind73

    Google DeepMind 解析 WeatherNext 如何助力预测飓风梅丽莎历史性强登陆

    Google DeepMind 发布文章说明其 AI 天气模型 WeatherNext 协助美国国家飓风中心(NHC)成功预测了飓风梅丽莎的迅速增强和登陆。该模型在飓风仍为一级时,便以 80% 的置信度提前五天预测出其将以五级强度登陆牙买加,这是首次从如此低的风速起点成功预测达到五级强度的风暴。

    推荐理由:原文通过飓风梅丽莎案例,展示了 WeatherNext 在提前五天预测五级强度登陆方面的具体表现及与传统模型的对比优势。

  2. Google DeepMind92

    Google DeepMind 发布 Gemini 3.5 Flash 模型

    Google DeepMind 正式发布 Gemini 3.5 系列并率先推出 Gemini 3.5 Flash 模型,该模型主打智能体(Agent)与编码能力,现已向全球用户开放。

    推荐理由:官方详细披露了 Gemini 3.5 Flash 在智能体任务与编码基准上的性能数据及开放入口,为评估其实际工作流替代能力提供了具体依据。

5月12日周二
  1. Google DeepMind82

    Google DeepMind 推出 Co-Scientist 多智能体 AI 科研助手

    Google DeepMind 发布基于 Gemini 的多智能体系统 Co-Scientist,旨在加速科学研究假设的生成与验证。该系统通过生成、辩论和进化三个阶段协同工作,已在肝纤维化、ALS 等研究中展示应用潜力,并计划通过 Hypothesis Generation 工具向研究人员开放。

    推荐理由:原文展示了多智能体系统在假设生成中的具体分工与实测案例,读者可据此评估其辅助科研的实际效能。

5月6日周三
  1. Google DeepMind78

    Google DeepMind发布AlphaEvolve应用成果:Gemini编码智能体在多领域实现规模化影响

    Google DeepMind发布AlphaEvolve一周年进展报告,展示该Gemini驱动的编码智能体在科学发现与基础设施优化上的广泛影响。在科研领域,AlphaEvolve帮助DeepConsensus模型将变异检测错误率降低30%,使电网优化可行解比例从14%提升至88%,并在Willow量子处理器上实现了误差比传统基线低10倍的电路设计。

    推荐理由:官方汇总了AlphaEvolve在基因组学、量子计算及商业基础设施中的具体优化数据,展示了其从科研工具向通用算法引擎的演进。

4月30日周四
  1. Google DeepMind82

    Google DeepMind 发布 AI co-clinician 研究:探索多模态医疗智能体与医生协作模式

    Google DeepMind 宣布启动 AI co-clinician 研究计划,旨在通过“三元护理”模式让 AI 在医生监督下协助患者。该系统在 98 个初级保健查询中实现 97 例无关键错误,并在开放式药物问答基准上超越现有前沿模型。

    推荐理由:原文披露了AI co-clinician在真实临床查询中的零关键错误率及多模态实时交互能力,展示了其作为辅助工具而非替代者的具体边界。

4月23日周四
4月16日周四
  1. Google DeepMind70

    Google DeepMind 发布 Gemini 3.1 Flash TTS 支持细粒度音频标签控制

    Google DeepMind 推出最新文本转语音模型 Gemini 3.1 Flash TTS,即日起在 Gemini API、Google AI Studio 和 Vertex AI 预览版中向开发者和企业开放。

    推荐理由:新模型引入自然语言音频标签以精细控制语调节奏,并在 Artificial Analysis 榜单取得高分,适合评估其在多语言场景下的表现力与成本平衡。