Google Research 验证智能手表估算高级步态指标的可行性
Google Research 开发基于时间卷积网络(TCN)的多头深度学习模型,利用 Pixel Watch 的 IMU 数据直接估算步速、步长等时空步态指标。在包含 246 名参与者和约 70,000 个步行片段的大规模验证中,该方法的皮尔逊相关系数和组内相关系数均超过 0.80,性能与智能手机方案相当。
Google Research 开发基于时间卷积网络(TCN)的多头深度学习模型,利用 Pixel Watch 的 IMU 数据直接估算步速、步长等时空步态指标。在包含 246 名参与者和约 70,000 个步行片段的大规模验证中,该方法的皮尔逊相关系数和组内相关系数均超过 0.80,性能与智能手机方案相当。
OpenAI 宣布投资 Merge Labs,旨在支持新型脑机接口技术。该合作致力于连接生物智能与人工智能,以最大化人类的能力、自主权及体验。
OpenAI 发起一项新的 RFP,旨在通过加速国内制造、创造就业和扩展 AI 基础设施来强化美国 AI 供应链。该举措聚焦于提升本土生产能力与基础设施规模,以支持 AI 行业的持续发展。
OpenAI 与 Cerebras 达成合作,新增 750MW 高速 AI 算力。此举旨在降低推理延迟,使 ChatGPT 在处理实时 AI 工作负载时速度更快。
Google Research 证实通过 Android Auto 收集的急刹车事件(HBE)与道路碰撞率呈显著正相关,可作为交通安全评估的领先指标。分析显示 HBE 数据密度是碰撞报告的 18 倍,能填补稀疏历史数据的空白并实时识别高风险路段。该发现支持将连接车辆数据整合至 Google Maps Platform 的道路管理洞察中,以替代传统滞后的事故统计进行网络级安全评估。
Google Research 发布 MedGemma 1.5 4B 模型和 MedASR 语音识别模型,并启动 Kaggle 黑客松。MedGemma 1.5 新增对 CT、MRI 和全切片病理图像等高维医学影像的解读能力,在内部基准测试中疾病分类准确率较上一代显著提升;MedASR 专为医疗听写微调,错误率远低于通用 Whisper large-v3 模型。
推荐理由:原文给出了MedGemma 1.5对CT和MRI等高维医学影像的支持及具体基准提升,开发者可据此评估其在复杂医疗场景中的适配潜力。
Google Quantum AI 在 Nature Physics 发表研究,实验演示了基于 Willow 处理器的动态表面码。该方案通过交替电路结构解决泄漏与硬件约束问题,其中六边形晶格代码在距离从 3 扩展到 5 时逻辑错误率改善 2.15 倍,模拟显示误差抑制因子提升 15%。
Google DeepMind 发布 Veo 3.1 Ingredients to Video 功能更新,提升了基于参考图像生成视频的创意表现与角色一致性。此次更新首次支持原生 9:16 竖屏视频生成,并引入至 1080p 和 4K 分辨率的尖端升频技术。
推荐理由:原文详述了 Veo 3.1 在角色一致性、原生竖屏输出及高分辨率升级方面的具体改进,为移动端创作和专业工作流提供了新的能力参考。
Zenken 在全公司范围部署 ChatGPT Enterprise,显著提升了销售业绩并增加了提案成功率。该 AI 支持的工作流帮助精简团队大幅缩短准备时间,实现更个性化且高效的客户互动。
Google Research 在 Science Advances 发表新论文,介绍其混合大气模型 NeuralGCM 如何通过直接基于卫星降水观测数据进行训练,从而改进长期全球降水模拟。该模型在 280 km 分辨率下,相比传统物理模型,在平均降水、极端降水(特别是前 0.1% 降雨量)及日循环再现方面均取得显著提升,误差降低约 40%。
Berkeley AI Research 在 NeurIPS 2025 发表研究,提出利用互信息直接评估和优化成像系统。该方法仅依赖噪声测量数据,无需任务特定解码器,即可预测彩色摄影、射电天文等四个领域的性能。优化后的设计匹配端到端方法效果,同时显著降低内存与计算需求。
OpenAI 与软银集团宣布与 SB Energy 合作,共同开发多吉瓦级 AI 数据中心园区。双方将重点建设位于德克萨斯州的 1.2 GW 设施,以支持 Stargate 计划。
Datadog 采用 OpenAI 的 Codex 工具执行系统级代码审查。该应用旨在通过 AI 辅助提升代码质量与安全性,体现了企业级开发流程中智能体技术的实际落地。
OpenAI 推出面向医疗行业的 AI 解决方案,支持 HIPAA 合规。该方案提供企业级安全能力,旨在减轻行政负担并辅助临床工作流程。
Netomi 结合并发、治理和多步推理,利用 GPT-4.1 和 GPT-5.2 将 AI 智能体扩展至企业生产环境。该方案旨在实现可靠的工作流,展示了大语言模型在企业级应用中的规模化路径。
Tolan 利用 GPT-5.1 构建了语音优先的 AI 伴侣,实现了低延迟响应、实时上下文重建和基于记忆的个性化交互。该方案旨在通过结合这些技术特性,为用户提供更自然的对话体验。
OpenAI 发布 ChatGPT Health,这是一个专用的健康体验功能。该功能可安全连接用户的健康数据和应用,并具备隐私保护及由医生参与的设计特点。
推荐理由:OpenAI 推出 ChatGPT Health,通过安全连接健康数据与应用并采用医生参与设计,为个人健康管理提供专用体验。
OpenAI 启动 Grove Cohort 2,这是一个为期 5 周的创始人项目,面向从创意初期到产品阶段的个人。参与者将获得 $50K API credits、AI 工具早期访问权及 OpenAI 团队的实战指导。
Google发布Gemini 3 Pro与Flash,前者在MathArena Apex达23.4% SOTA并登顶LMArena,后者以更低成本实现Pro级推理。开源模型Gemma 3增强多模态能力,Google Antigravity推动AI辅助软件开发。
OpenAI 宣布全球超过一百万家客户正在使用其服务赋能团队。PayPal、Virgin Atlantic、BBVA、Cisco、Moderna 和 Canva 等企业利用 AI 改变了工作方式并解锁了新机遇。
OpenAI 利用基于强化学习的自动化红队测试,持续加固 ChatGPT Atlas 抵御提示注入攻击。该主动发现与修补循环旨在早期识别新型漏洞,并随着 AI 向智能体化演进,增强浏览器代理的防御能力。
Google Research 发布 2025 年成果,Gemini 3 在 SimpleQA Verified 和 FACTS 基准上实现 SOTA 事实性表现。开源模型 Gemma 支持超 140 种语言,成为最佳多语言开放模型;量子领域宣布“可验证量子优势”并推出 verifiable quantum echo 算法。
OpenAI 推出针对思维链(chain-of-thought)可监控性的新框架与评估套件,涵盖 24 个环境下的 13 项评估。研究发现,监控模型内部推理比仅监控输出更有效,为 AI 系统能力增长后的可扩展控制提供了可行路径。
OpenAI 推出新的 AI 素养资源,旨在帮助青少年和家长安全、自信地使用 ChatGPT。这些指南包含经专家审核的建议,涵盖负责任使用、批判性思维、健康边界设定,以及如何支持青少年处理情感或敏感话题。
OpenAI 更新其 Model Spec,新增 Under-18 Principles 以规范 ChatGPT 对青少年的支持。该更新基于发展科学提供适龄指导,旨在强化安全护栏并明确高风险场景下的模型行为预期。
OpenAI 与美国能源部签署谅解备忘录,旨在深化在 AI 和先进计算领域的合作以支持科学发现。该协议建立在双方与国家实验室持续合作的基础上,并为在整个美国能源部生态系统中将 AI 应用于高影响力研究建立了框架。
OpenAI 推出其最先进的编程模型 GPT-5.2-Codex。该模型支持长程推理和大规模代码转换,并增强了网络安全相关能力。
推荐理由:官方明确该模型具备长程推理、大规模代码转换及增强的网络安全能力,为开发者评估其在复杂工程任务中的表现提供了核心依据。
Mistral AI 正式发布 Mistral OCR 3,该模型在表单、扫描文档、复杂表格和手写内容上的整体胜率比 Mistral OCR 2 高出 74%。
推荐理由:Mistral OCR 3 在表单、手写和复杂表格识别上较前代有显著提升,且以极低价格提供 API 服务,适合需要高精度文档解析的开发者评估。
NVIDIA 发布 Nemotron 3 Nano 30B A3B,同步公开基于 NeMo Evaluator 的完整可复现评测配方。该方案通过统一配置与结构化日志解决评估不透明问题,支持独立验证模型性能。开发者可利用这一开源工具链构建标准化、可审计的 AI 评测流程。
Google DeepMind 发布 Gemini 3 Flash,旨在以更低成本和更高速度提供接近 Pro 级别的前沿智能。该模型在 GPQA Diamond 得分 90.4%,SWE-bench Verified 得分 78%,比 Gemini 2.5 Pro 快 3 倍且平均少用 30% token。
推荐理由:原文给出了 Gemini 3 Flash 在多项基准测试中的具体分数、定价及与上一代模型的性能对比,读者可据此评估其在速度与成本平衡上的实际竞争力。
OpenAI 联合 American Journalism Project 和 The Lenfest Institute 推出 OpenAI Academy for News Organizations,旨在帮助新闻机构有效使用 AI。该学习中心提供培训、实际用例及负责任使用指南,支持记者、编辑和出版商在报道与运营中采用 AI。
OpenAI 发布《The state of enterprise AI》报告,基于数据展示企业如何从实验阶段转向实际生产力提升。该报告揭示了组织在采用 AI 过程中获得的新能力与效率变化。
OpenAI 正式推出新的平台功能,允许开发者在 OpenAI 生态中构建和部署应用。该更新扩展了现有 API 的能力边界,为第三方集成提供了更丰富的工具支持。
推荐理由:官方宣布新功能上线,开发者可据此评估在 OpenAI 生态中构建应用的新机会。
Google DeepMind 发布 Gemma Scope 2,这是目前规模最大的开源可解释性工具套件,支持从 270M 到 27B 参数的所有 Gemma 3 模型。该工具结合稀疏自编码器(SAEs)和转码器,旨在帮助研究人员追踪模型内部决策过程以调试越狱、幻觉等安全问题。
OpenAI 推出 FrontierScience 基准测试,旨在评估 AI 在物理、化学和生物领域的推理能力。该基准用于衡量 AI 向真实科学研究任务迈进的进展。
OpenAI 推出一个真实世界评估框架,用于衡量 AI 在湿实验室中加速生物研究的能力。该工作利用 GPT-5 优化分子克隆协议,探索了 AI 辅助实验的潜力与风险。
OpenAI 于 2025 年推出更快的 ChatGPT Images 体验,并在 API 中上线 GPT‑Image‑1.5。用户现可探索最新的 ChatGPT Images 2.5 版本。
OpenAI 指出领导者需通过清晰战略、培训、治理及加速创新来构建适应 AI 的组织。该观点旨在帮助企业在人工智能时代保持竞争优势,强调了从策略到执行层面的系统性准备。
Google Research 推出名为 Paper Assistant Tool (PAT) 的实验性工具,利用 Gemini 2.5 Deep Think 为 STOC 2026 的理论计算机科学论文提供提交前的自动反馈。
推荐理由:原文披露了基于 Gemini 2.5 Deep Think 的 Paper Assistant Tool 在 STOC 2026 的实验数据,展示了 AI 辅助理论计算机科学论文预审核的实际效果与用户反馈。
IBM Research 宣布其开源通用智能体框架 CUGA (Configurable Generalist Agent) 正式集成至 Hugging Face Spaces,并提供在线演示。
推荐理由:IBM Research 将 CUGA 智能体集成至 Hugging Face Spaces,提供基于 gpt-oss-120b 的可视化演示及 Langflow 低代码支持,便于开发者快速评估其在复杂任务中的表现。