Google DeepMind 开源 Gemma Scope 2:覆盖 Gemma 3 全尺寸模型的可解释性工具套件
Google DeepMind 发布 Gemma Scope 2,这是目前规模最大的开源可解释性工具套件,支持从 270M 到 27B 参数的所有 Gemma 3 模型。该工具结合稀疏自编码器(SAEs)和转码器,旨在帮助研究人员追踪模型内部决策过程以调试越狱、幻觉等安全问题。
Google DeepMind 发布 Gemma Scope 2,这是目前规模最大的开源可解释性工具套件,支持从 270M 到 27B 参数的所有 Gemma 3 模型。该工具结合稀疏自编码器(SAEs)和转码器,旨在帮助研究人员追踪模型内部决策过程以调试越狱、幻觉等安全问题。
OpenAI 于 2025 年推出更快的 ChatGPT Images 体验,并在 API 中上线 GPT‑Image‑1.5。用户现可探索最新的 ChatGPT Images 2.5 版本。
Google Research 推出名为 Paper Assistant Tool (PAT) 的实验性工具,利用 Gemini 2.5 Deep Think 为 STOC 2026 的理论计算机科学论文提供提交前的自动反馈。
推荐理由:原文披露了基于 Gemini 2.5 Deep Think 的 Paper Assistant Tool 在 STOC 2026 的实验数据,展示了 AI 辅助理论计算机科学论文预审核的实际效果与用户反馈。
IBM Research 宣布其开源通用智能体框架 CUGA (Configurable Generalist Agent) 正式集成至 Hugging Face Spaces,并提供在线演示。
推荐理由:IBM Research 将 CUGA 智能体集成至 Hugging Face Spaces,提供基于 gpt-oss-120b 的可视化演示及 Langflow 低代码支持,便于开发者快速评估其在复杂任务中的表现。
llama.cpp server 推出 router 模式,允许在不重启服务的情况下动态加载、卸载和切换多个模型。该功能采用多进程架构,每个模型独立运行,单个模型崩溃不影响其他模型。用户可通过自动发现缓存或指定目录来管理 GGUF 文件,并支持按需加载、LRU 驱逐及请求路由,同时提供 Web UI 进行模型切换。
推荐理由:llama.cpp 新增 router 模式实现多模型动态加载与切换,无需重启服务即可管理本地 LLM。
Podium 基于 OpenAI 的 GPT-5 模型构建了名为“Jerry”的 AI 智能体,旨在为超过 10,000 家中小企业提供自动化客户服务支持。该方案通过引入 AI 队友显著提升了业务运营效率,并实现了 300% 的增长,彻底改变了传统街边小店(Main Street businesses)的服务模式。
Scout24 基于 GPT-5 打造对话式助手,重构房地产搜索体验。该工具通过澄清问题、生成摘要及提供定制化房源推荐引导用户。
OpenAI 发布首批认证课程及 AI Foundations 课程,旨在帮助用户构建实际 AI 技能并提升职业机会。这些课程聚焦于为未来工作做准备,提供从基础到实战的技能培养路径。
Hugging Face 推出 swift-huggingface,为 Swift 开发者提供完整的 Hugging Face Hub 客户端。该工具支持断点续传、与 Python 生态共享缓存及 OAuth 认证,旨在解决模型下载慢和鉴权混乱问题。它将集成至 swift-transformers 以替代现有实现,并即将支持 Xet 存储后端加速下载。
OpenAI 与 NORAD 合作为“NORAD Tracks Santa”活动引入三款 ChatGPT 节日工具。这些功能允许家庭创建节日精灵、玩具涂色页和定制圣诞故事,旨在通过生成式 AI 增强圣诞追踪体验的互动性与趣味性。
OpenAI 将数据驻留功能扩展至 ChatGPT Enterprise、ChatGPT Edu 和 API Platform,允许符合条件的客户在区域内存储静态数据。
Hugging Face Diffusers 库现已支持 FLUX.2-dev-bnb-4bit 模型,该模型采用 Mistral3ForConditionalGeneration 作为文本编码器。开发者可通过 Flux2Pipeline 加载此 4-bit 量化版本进行图像生成推理。
OVHcloud 正式加入 Hugging Face Inference Providers 生态,提供 gpt-oss、Qwen3、DeepSeek R1 和 Llama 等开源模型的 Serverless 推理服务。
OpenAI 在 ChatGPT 中推出购物研究功能,帮助用户探索、比较和发现产品。该功能通过个性化的买家指南简化决策过程。
Google Research 本周发布一款基于线性回归的轻量级 AI 模型,用于预测特定时间后电动汽车充电口的可用概率。该模型通过整合“小时”特征与权重,在 CA 和德国数据上表现优于“保持当前状态”基线,有效缓解续航焦虑并提升导航效率。
Hugging Face TRL 正式集成 RapidFire AI,通过自适应分块并发训练将微调实验吞吐量提升约 16–24 倍。用户可使用 RFSFTConfig 等零代码替换配置,在单 GPU 上并发比较多个 LLM 微调方案。该工具提供实时仪表盘与交互式控制操作,支持动态停止、克隆及修改运行中的任务以优化资源利用。
Google DeepMind 宣布在 Gemini 应用中引入 AI 图像验证功能,用户可通过上传图像询问是否由 Google AI 生成或编辑。该功能基于 SynthID 数字水印技术,结合模型推理提供内容背景信息。未来计划将验证范围扩展至视频和音频格式,并整合到搜索等更多平台中。
推荐理由:官方介绍了在 Gemini 应用中集成 SynthID 水印检测的具体交互方式,为内容真实性验证提供了新的入口。
Hugging Face 推出 Swift 包 AnyLanguageModel,作为 Apple Foundation Models 框架的即插即用替代方案,支持在单一 API 下无缝切换本地(MLX、Core ML、llama.cpp)和云端(OpenAI、Anthropic 等)大模型。
推荐理由:该工具通过统一 API 简化了 Apple 平台本地与云端大模型的集成,降低了开发者尝试开源模型的技术门槛。
OpenAI 发布 ChatGPT for Teachers,这是一个具备教育级隐私保护和管理控制的安全工作区。经认证的美国 K-12 教育工作者可免费使用至 2027 年 6 月。
Google DeepMind 推出名为 Google Antigravity 的新智能体开发平台,旨在将 IDE 演变为支持浏览器控制和异步交互的 agent-first 环境。
推荐理由:原文详细阐述了从同步 IDE 向异步 Agent-first 平台演进的产品形态,为开发者提供了评估下一代智能体编程工具的具体维度。
Google Research 正式介绍 Generative UI(生成式用户界面)能力,该功能利用 AI 模型根据提示词动态生成网页、游戏或工具等完整交互体验,而非仅渲染静态内容。
推荐理由:官方展示了基于 Gemini 3 的生成式 UI 技术,通过动态创建交互式界面替代静态文本输出,并已在搜索和助手应用中开启实验。
OpenAI 正式推出 ChatGPT 群组聊天功能,支持用户与多人及 AI 在同一对话中协作。该更新扩展了 ChatGPT 的交互边界,使其从个人助手转变为可参与团队讨论的工具。
Google Research 发布 JAX-Privacy 1.0,基于 JAX 构建模块化差分隐私训练与审计工具包。该版本集成最新研究进展,支持 DP-SGD、DP-FTRL 及矩阵分解等算法,利用 JAX 原生并行特性实现大规模模型的高效私有训练。
OpenAI 向退役或离职 12 个月内的美国军人及退伍军人提供一年免费的 ChatGPT Plus,以支持其向平民生活过渡。该服务可辅助用户处理简历、面试准备、教育规划及未来安排等事务。
OpenAI 发布名为 Aardvark 的 AI 智能体安全研究员,可自主大规模发现、验证并协助修复软件漏洞。该系统目前处于私有测试阶段,用户需注册以参与早期测试。
Doppel 采用 GPT-5 和强化微调技术,在攻击扩散前拦截深度伪造及冒充行为。该方案将分析师工作量减少 80%,并把响应时间从数小时缩短至几分钟。
Google 宣布在 Fitbit 应用中推出由 Gemini 模型驱动的个人健康教练公开预览版,面向美国地区符合条件的 Android 用户开放,iOS 版本即将跟进。
推荐理由:原文披露了基于 Gemini 的多智能体架构与 SHARP 评估框架,展示了健康教练从通用建议向个性化数据驱动转型的技术路径。
OpenAI 与 170 多位心理健康专家合作,优化 ChatGPT 在敏感对话中的表现。该更新旨在提升模型识别用户痛苦、共情回应及引导寻求现实支持的能力,使不安全回复减少高达 80%。
Steuerrecht.com 采用 ChatGPT Business 简化法律工作流程,实现税务研究自动化。该方案帮助律所更快交付可直接面向客户的分析结果。
Hugging Face 正式发布 huggingface_hub v1.0,标志着该库经过五年发展达到成熟阶段。此次更新引入了破坏性变更以支持未来十年,包括后端迁移至 httpx、全面采用 hf_xet 进行文件传输以及重新设计的 hf CLI。v1.0 版本在保持向后兼容的同时,通过移除遗留模式提升了性能,并集成了 MCP 和 tiny-agents 以简化 AI 智能体开发。
推荐理由:原文详述了底层架构迁移与 CLI 重构,读者可据此评估升级对现有工作流的影响及新特性价值。
Hugging Face 对 `datasets` 库的流式加载功能进行了底层重构,实现了启动请求减少 100 倍、数据解析速度提升 10 倍以及样本吞吐量翻倍。
推荐理由:Hugging Face 优化了 datasets 库的流式加载后端,通过减少请求风暴和引入预取机制,使大规模训练无需下载即可达到接近本地 SSD 的速度。
Mistral AI 发布 Mistral AI Studio,旨在解决企业 AI 从原型到生产的落地瓶颈。该平台基于 Temporal 构建 Agent Runtime,提供可观测性、AI Registry 及治理功能,支持混合云部署与私有数据微调。
Hugging Face 发布 LeRobot v0.4.0,旨在提升开源机器人学习的性能与可扩展性。该版本引入了支持大规模数据的 Datasets v3.0、新的数据集编辑工具以及用于简化硬件集成的插件系统。
推荐理由:LeRobot v0.4.0 通过引入 Datasets v3.0、新 VLA 模型及硬件插件系统,显著提升了开源机器人学习的扩展性与易用性。
Consensus 采用 GPT-5 和 OpenAI Responses API 构建多智能体研究助手,可在几分钟内完成证据阅读、分析与综合。该工具已服务超 800 万研究人员,显著加速科学发现进程。
Meta和Hugging Face宣布合作推出OpenEnv Hub,这是一个用于构建、共享和探索智能体环境的开放社区中心。该Hub旨在解决大语言模型缺乏安全工具访问的问题,通过定义包含工具、API和执行上下文的沙盒环境,支持强化学习训练与部署。
推荐理由:Meta与Hugging Face联合推出OpenEnv Hub,为智能体提供标准化的训练与部署环境,开发者可据此构建兼容的RL基础设施。
ChatGPT 上线 Company Knowledge 功能,将企业应用上下文引入对话以提供特定业务答案。该功能支持清晰引用、安全隐私及管理员控制,现已面向 Business、Enterprise 和 Edu 用户开放。
OpenAI 宣布 ChatGPT 将在 2026 年 1 月 15 日之后不再支持 WhatsApp。用户需通过链接账户来确保对话数据跨设备同步,以继续使用该服务。
OpenAI 推出名为 ChatGPT Atlas 的浏览器,该浏览器内置了 ChatGPT 功能。目前该产品已被弃用。
Hugging Face开源工具AI Sheets发布重大更新,正式加入对图像视觉内容的支持。用户现在可以在电子表格中直接上传、分析、提取信息以及生成和编辑图片,无需编写代码。
推荐理由:AI Sheets新增视觉能力支持图像提取与生成,用户可在电子表格中直接处理多模态数据并导出结构化结果。
Plex Coffee 使用 ChatGPT Business 集中管理知识并加速员工培训,在扩张过程中保持个性化连接。该方案通过 AI 工具优化内部运营效率,支持企业规模化发展同时维持服务质量。