Google DeepMind Co-Scientist 助力 Calico 推进衰老研究
Google DeepMind 的 Co-Scientist 正被 Calico Life Sciences 用于整合衰老生物学文献并生成可验证假设。该工具帮助研究人员在综合应激反应(ISR)领域提出关于代谢调节的新假说,并通过优化实验设计获得重要发现。
Google DeepMind 的 Co-Scientist 正被 Calico Life Sciences 用于整合衰老生物学文献并生成可验证假设。该工具帮助研究人员在综合应激反应(ISR)领域提出关于代谢调节的新假说,并通过优化实验设计获得重要发现。
Google DeepMind 的 Co-Scientist 协助爱丁堡大学团队在代谢功能障碍相关脂肪性肝炎(MASH)研究中生成新假设。该系统通过综合文献证据,识别出 NLRP3 炎症小体作为连接肝脏炎症与代谢的关键分子桥梁。这一经实验验证的发现解释了药物 resmetirom 疗效局限的原因,并为开发靶向联合疗法提供了依据。
Google DeepMind 的 Co-Scientist 协助 MIT 与波士顿儿童医院研究人员整合生物工具包,加速 ALS 研究。该 AI 系统压缩了文献梳理时间,帮助生成可测试假设并评估可行性,促成机械工程师与化学生物学家协作。双方正利用其探索靶向 ALS 的新型 RNA 机制及药物。
Google DeepMind 发布基于 Gemini 的多智能体系统 Co-Scientist,旨在加速科学研究假设的生成与验证。该系统通过生成、辩论和进化三个阶段协同工作,已在肝纤维化、ALS 等研究中展示应用潜力,并计划通过 Hypothesis Generation 工具向研究人员开放。
推荐理由:原文展示了多智能体系统在假设生成中的具体分工与实测案例,读者可据此评估其辅助科研的实际效能。
OpenAI 推出 Campus Network,面向全球学生社团开放申请。加入该网络可连接各地社团、获取 AI 工具并举办活动,旨在构建由 AI 驱动的校园社区。
OpenAI 扩展了面向网络安全的可信访问权限,推出 GPT-5.5 和 GPT-5.5-Cyber。该举措旨在协助经过验证的安全防御者加速漏洞研究并保护关键基础设施。
OpenAI 在 ChatGPT 中推出可选安全功能 Trusted Contact,当检测到严重自残担忧时通知用户指定的信任联系人。该功能旨在通过及时预警机制提升用户安全防护能力。
Google DeepMind发布AlphaEvolve一周年进展报告,展示该Gemini驱动的编码智能体在科学发现与基础设施优化上的广泛影响。在科研领域,AlphaEvolve帮助DeepConsensus模型将变异检测错误率降低30%,使电网优化可行解比例从14%提升至88%,并在Willow量子处理器上实现了误差比传统基线低10倍的电路设计。
推荐理由:官方汇总了AlphaEvolve在基因组学、量子计算及商业基础设施中的具体优化数据,展示了其从科研工具向通用算法引擎的演进。
Singular Bank 基于 ChatGPT 和 Codex 构建了内部助手 Singularity,帮助银行家每天在会议准备、投资组合分析和后续跟进上节省 60–90 分钟。
OpenAI 在官方新闻中发布了新的产品功能。该更新涉及 OpenAI 平台的商业化或广告相关能力。
OpenAI 推出 Advanced Account Security,提供防钓鱼登录、更强的恢复机制及增强保护。该功能旨在保障敏感数据安全并防止账户被接管。
DeepInfra 正式接入 Hugging Face Inference Providers,提供涵盖 LLM、文生图等超 100 个模型的 Serverless 推理服务。开发者可通过 Python/JS SDK 或 Agent Harness 直接调用 DeepSeek V4、Kimi-K2.6 等开源模型,支持自定义 API Key 或经 HF 路由计费两种模式。
Mistral AI 推出 Workflows 公共预览版,作为 Studio 的一部分提供企业级 AI 编排能力。该工具基于 Temporal 引擎构建,支持 Python SDK 开发,具备持久执行、全链路可观测性及单行代码实现的人工审批暂停功能。
推荐理由:原文展示了企业级AI编排层如何解决生产环境中的持久性、可观测性和人工审批痛点,为开发者提供了从原型到落地的具体路径。
OpenAI 推出 Symphony,这是一份用于 Codex 编排的开源规范。该规范将 issue tracker 转化为始终在线的智能体系统,旨在提升工程产出并减少上下文切换。
Google Research 宣布在 Google Photos 的 Auto frame 功能中集成新的机器学习方法,通过理解场景空间布局并利用生成式 AI 想象新视角,实现拍摄后照片的自动重新构图。
推荐理由:Google Photos 的 Auto frame 功能引入基于 3D 场景重建的新方法,能自动调整照片视角并修复广角畸变。
OpenAI 宣布对 ChatGPT 进行针对临床场景的功能改进。该更新旨在更好地支持医生在诊断、治疗规划及文档记录等医疗工作流中的使用需求。
OpenAI 在 ChatGPT 中推出了由 Codex 驱动的工作区智能体(Workspace agents)。这些智能体可在云端运行,旨在安全地自动化复杂工作流并帮助团队跨工具扩展工作。
推荐理由:官方介绍了基于 Codex 的工作区智能体,展示了其在云端自动化复杂工作流及跨工具协作的能力。
OpenAI 为 Codex 推出新功能,旨在通过支持计算机操作来加速开发者的编码工作流。该更新聚焦于提升工具在实际编程场景中的自动化处理能力。
推荐理由:官方介绍了 Codex 的新功能,开发者可据此评估其如何辅助日常编码工作流。
HCompany 推出 Chrome 扩展程序 HoloTab,将 Holo3 计算机使用模型直接集成到浏览器中。用户无需技术背景即可通过自然语言指令让 Agent 自动执行网页任务。该工具支持“Routines”功能,允许用户录制操作过程并生成可重复运行或定时执行的自动化流程。HoloTab 目前免费开放下载。
推荐理由:原文介绍了基于 Holo3 模型的浏览器插件及其录制回放功能,展示了降低计算机使用 AI 门槛的具体路径。
Sentence Transformers 库发布 v5.4 版本,新增对文本、图像、音频和视频的多模态嵌入及重排序支持。用户可通过熟悉的 API 进行跨模态相似度计算和混合模态文档排名,适用于视觉文档检索和多模态 RAG 场景。该版本集成了 Qwen3-VL、NVIDIA Nemotron 等主流多模态模型,并提供了详细的安装指南和使用示例。
推荐理由:Sentence Transformers v5.4 引入多模态嵌入与重排序能力,开发者可用统一 API 处理文本、图像及音视频,简化跨模态检索流程。
Google Research 发布 PaperVizAgent 和 ScholarPeer 两个智能体,分别用于生成学术图表和执行同行评审。PaperVizAgent 在综合评分中达到 60.2 分,超越 GPT-Image-1.5、Nano-Banana-Pro 及人类基准线 50.0;ScholarPeer 通过多智能体协作实现文献接地的高批判性评审,胜率优于现有自动化方案。
Hugging Face 发布 gradio.Server,这是一个基于 FastAPI 扩展的新功能,允许开发者使用 React、Svelte 或纯 HTML/JS 等任意前端框架,同时复用 Gradio 的队列系统、并发控制、MCP 支持和 Spaces 上的 ZeroGPU 基础设施。
推荐理由:gradio.Server 允许开发者在保留 Gradio 队列和 ZeroGPU 等后端能力的同时使用任意前端框架,解决了自定义 UI 需脱离 Gradio 的痛点。
Mistral AI 推出名为 Spaces 的 CLI 工具,旨在解决开发者工具在同时服务人类用户和编码智能体时的兼容性问题。该工具确立了“每个交互式输入都有对应的 flag”、“状态必须显式化”以及“插件作为可内省的数据模型”等设计原则,并自动生成 context.json 和 AGENTS.md 文件以提供结构化项目上下文。
推荐理由:Mistral AI 发布 Spaces CLI,通过为智能体设计显式接口和结构化上下文,展示了如何构建同时服务于人类开发者和 AI Agent 的工具。
Hugging Face 正式发布 TRL v1.0,标志着该库从研究代码转变为支持生产环境的稳定基础设施。新版本实现了超过 75 种后训练方法,采用“稳定核心+实验层”的双轨制以应对算法的快速迭代,并计划在未来引入异步 GRPO、更多蒸馏方法以及面向 Agent 的训练可解释性功能。
推荐理由:原文阐述了在快速变化的后训练领域维持库稳定性的设计哲学,并给出了异步GRPO等具体演进路线。
Google DeepMind 推出由 Gemini 驱动的 AI 指针实验演示,旨在让光标具备理解用户指向内容及意图的能力。该功能遵循四项交互原则,允许用户通过简单的指向和语音指令(如“显示路线”或“总结此段”)跨应用调用 AI,无需在独立窗口间切换。
推荐理由:官方展示了基于 Gemini 的 AI 指针原型,将上下文理解融入光标交互,为 Chrome 和 Googlebook 带来无需复杂提示词的自然操作体验。
Google Research 推出 Vibe Coding XR 工作流,利用 Gemini 和 XR Blocks 框架将自然语言直接转化为功能完整的 Android XR 应用。该系统通过长上下文推理与专用系统提示词处理空间逻辑,能在 60 秒内生成具备物理感知的原型,显著加速 XR 交互设计与教育体验的开发验证。
OpenAI 推出基于提示词的青少年安全策略,供使用 gpt-oss-safeguard 的开发者构建更安全的 AI 体验。该方案旨在帮助开发者在 AI 系统中审核与年龄相关的特定风险。
OpenAI 发布了新的产品功能。该更新由 OpenAI 官方渠道直接宣布,涉及具体的能力变化或工具上线。
推荐理由:OpenAI官方发布新产品功能,读者可据此了解其最新能力变化及开放入口。
OpenAI 在构建 Sora 2 模型及 Sora App 时将安全性作为基础,以应对前沿视频模型和新社交平台带来的挑战。该方案依托于具体的保护措施,旨在解决新型安全风险。
Mistral AI 推出 Forge 系统,允许企业利用内部文档、代码库和运营记录等专有数据训练前沿级 AI 模型。该系统支持密集型和混合专家(MoE)架构,涵盖预训练、后训练及强化学习全流程,旨在通过让模型内化机构知识来提升智能体在复杂工作流中的可靠性与控制权。
Google Research 宣布在 Flood Hub 平台上线基于 AI 的城市山洪预报功能,可提前 24 小时预测风险。该模型利用 Gemini 从公开新闻报道中提取历史洪水事件以构建 Groundsource 数据集,解决了缺乏物理水位计数据的难题。
推荐理由:原文介绍了基于新闻数据构建训练集并实现全球城市洪水预测的技术路径,展示了在缺乏传统水文监测地区的应用潜力。
ChatGPT 推出针对数学和科学的交互式可视化解释功能,支持学生实时探索公式、变量及概念。该更新旨在通过动态视觉呈现辅助学习,提升对抽象知识点的理解效率。
Hugging Face Hub 正式推出 Storage Buckets,提供类似 S3 的非版本化对象存储,专门用于管理训练检查点、日志等频繁变动的中间文件。
推荐理由:原文给出了基于 Xet 的去重存储机制和 CLI/Python 集成入口,读者可以据此判断它如何优化中间产物的传输效率与成本。
LeRobot v0.5.0 正式发布,这是该框架迄今最大规模的更新,包含超过 200 个合并 PR 和 50 多位新贡献者。新版本首次全面支持 Unitree G1 人形机器人(含全身控制),引入 Pi0-FAST 自回归 VLA、Real-Time Chunking 等六项新策略,并推出 EnvHub 以直接从 Hugging Face Hub 加载仿真环境。
推荐理由:该版本新增人形机器人支持与多项策略模型,并优化数据管线与仿真环境加载,为具身智能研发提供更完整的开源工具链。
OpenAI 通过官方新闻渠道发布了新的产品或功能更新。具体细节需参考原文链接以获取完整信息。
Descript 利用 OpenAI 推理模型实现了大规模内容库的自动本地化。该方案在生成多语言视频配音时,能够保留原始的时间轴和语义含义。
OpenAI 发布新工具、认证及测量资源,旨在帮助学校与大学缩小 AI 能力差距并扩大机会。这些举措聚焦于教育场景,通过提供标准化评估与实操支持,促进 AI 技术在学术环境中的公平应用。
OpenAI 推出 Adoption news channel,旨在提供将 AI 进展转化为商业优势的实用洞察与框架。该频道聚焦于帮助企业在实际业务中应用人工智能技术,获取竞争优势。
OpenAI 正式推出 ChatGPT for Excel,并宣布一系列新的应用集成。该功能旨在将 AI 助手能力直接带入 Excel 环境,帮助用户在熟悉的界面中完成数据处理与分析任务。
推荐理由:OpenAI 官方发布 ChatGPT for Excel,将智能体能力直接嵌入电子表格工作流,为金融与数据分析场景提供新的工具入口。
Hugging Face 发布 Modular Diffusers,允许用户通过混合和匹配可复用的模块来构建定制化的扩散模型工作流,作为现有 DiffusionPipeline 类的灵活替代方案。该工具支持将自定义模块发布到 Hub 供他人使用,并集成了节点式可视化工作流界面 Mellon,实现了无需代码即可连接模块的功能。
推荐理由:原文展示了通过组合可复用模块构建扩散模型工作流的新方法,并提供了与可视化界面 Mellon 的集成示例。