跳到正文

#产品更新

今日 3 条
今天10月2日周五
  1. AWS Machine Learning Blog28

    Amazon Bedrock 在首尔和新加坡推出 Anthropic Claude Opus 5 与 Sonnet 5 的区域内部推理

    Amazon Bedrock 在首尔支持 Claude Opus 5 和 Sonnet 5,在新加坡支持 Sonnet 5,提供区域内部推理。请求数据全程保留在指定 AWS Region 内,满足金融、医疗等行业的严格数据驻留要求。开发者可通过 bedrock-runtime 端点调用 Anthropic Messages API 或 InvokeModel/Converse API 集成模型。

  2. AWS Machine Learning Blog40

    Amazon Quick 推出 Live Data in Apps,支持 AI 应用实时查询受治理数据

    Amazon Quick 发布 Live Data in Apps 功能,允许 AI 构建的应用程序实时查询受治理的 Quick Sight 数据集。该功能取代了静态快照,支持 SPICE 和 Direct Query 模式,并自动继承行级与列级安全规则。用户通过自然语言描述即可生成应用,确保每次打开时数据均为最新且符合权限控制。

10月1日周四
  1. Hugging Face Blog52

    AllenAI 发布 Olmo-core 3:面向大规模 MoE 的开源训练基础设施

    AllenAI 发布 Olmo-core 3,这是一套专为扩展至万亿参数规模混合专家(MoE)模型设计的开源训练基础设施。该系统通过集成专家并行、流水线并行和分布式优化器等技术,在 NVIDIA B300 GPU 上实现了相比前代约 2.7 倍的训练吞吐量提升,并支持 MXFP8 低精度格式以进一步优化显存占用。

9月30日周三
  1. Hugging Face Blog51

    Hugging Face 发布 Open TTS Leaderboard 支持多语言与声音克隆评测

    Hugging Face 推出 Open TTS Leaderboard,采用 WER、CER、RTFx 和 TTFA 等客观指标对开源文本转语音模型进行标准化评估。该榜单覆盖多语言及声音克隆能力,旨在解决现有竞技场式评测难以跟上模型发布速度且开源模型代表性不足的问题。用户可通过 Listen 标签页试听生成音频并投票反馈,同时可在 Streaming 标签页查看不同硬件下的首音频延迟表现。

9月29日周二
  1. Microsoft Research60

    微软研究院发布 Quine:面向生物学复杂性的 AI 研究系统

    微软研究院发布 Quine,这是一个结合生物学世界模型与交互式工具链的 AI 研究系统,旨在连接模型、科学工具、文献及研究人员。该系统在胰腺导管腺癌(PDAC)研究中应用,仅用一个周末即完成了从缩小化合物搜索空间到确定候选药物的过程,并验证了多个排名靠前的化合物能驱动肿瘤细胞状态转变。

    推荐理由:微软研究院推出Quine,通过多模态世界模型与实验闭环加速生物发现,并在胰腺癌研究中验证了化合物筛选效率。

  2. AWS Machine Learning Blog65

    AWS 宣布 Grok 4.7 上线 Amazon Bedrock

    xAI 的 Grok 4.7 模型现已正式登陆 Amazon Bedrock,提供 500K token 上下文窗口及四档可配置推理强度。该模型通过跨区推理配置文件提供服务,支持 Responses、Chat Completions 和 Converse API,并具备图像输入能力。

    推荐理由:原文详述了 Grok 4.7 在 Bedrock 上的推理档位配置与跨区路由机制,为开发者评估长任务成本与合规性提供了具体操作依据。

9月25日周五
  1. Google DeepMind73

    Google DeepMind 推出 Gemini 3.8 Live with Live Avatar 实时视觉化身功能

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,将低延迟流式视频生成与原生对话模型结合,为企业用户提供具备实时视觉呈现的交互式 AI 体验。

    推荐理由:原文详述了实时视觉化身在对话中的同步机制与异步工具调用能力,为评估企业级多模态交互体验提供了具体技术细节。

9月24日周四
  1. Google DeepMind73

    Google DeepMind 发布 Private AI Compute 新架构:实现安全的服务器端持久记忆

    Google DeepMind 宣布在 Private AI Compute 平台引入新的服务器端持久记忆功能,旨在解决云端 AI 助手长期连续性与严格隐私标准之间的矛盾。

    推荐理由:原文详述了通过硬件隔离和端到端加密实现云端持久记忆的技术架构,为理解隐私保护与跨设备连续性如何兼得提供了具体方案。

9月22日周二
  1. Hugging Face Blog80

    Transformers 支持运行 llama.cpp GGUF 量化模型

    Hugging Face Transformers 新增对 GGUF 格式模型的支持,允许用户通过熟悉的 API 在本地加载和运行 llama.cpp 的量化检查点。该功能目前主要面向 Apple Silicon 设备,通过复用 ggml 内核实现了接近 llama.cpp 的推理性能,并支持使用 transformers serve 暴露 OpenAI 兼容接口。

    推荐理由:原文展示了在 transformers 中直接运行 GGUF 模型的方法及性能基准,为本地开发者提供了无需切换推理引擎即可复用现有 PyTorch 工作流的可行路径。

9月21日周一
  1. Hugging Face Blog65

    Hugging Face 发布 tokenizers v1 预览版,编码速度提升 3 至 30 倍

    Hugging Face 发布 tokenizers v1 的 release candidate,在保持输出 Token ID 完全一致的前提下,单线程编码速度较 v0.23 提升 3 到 30 倍。

    推荐理由:官方详解了通过位流分割和缓存机制实现数倍性能提升的技术路径,为评估大规模训练与推理场景下的数据预处理瓶颈提供了具体参考。

9月16日周三
  1. Mistral AI60

    Mistral 与 Mozilla 合作为 Firefox Smart Window 提供 AI 支持

    Mistral AI 宣布与 Mozilla 达成合作,其模型将为 Firefox 的 AI 浏览助手 Smart Window(测试版)提供动力。该功能旨在帮助用户理解复杂搜索、记忆已关闭标签页内容并基于当前标签页获取信息,首批覆盖法国和北美用户,英国和德国将于今年晚些时候跟进。

    推荐理由:Mistral 模型接入 Firefox Smart Window,为浏览器 AI 助手提供隐私保护与多语言支持,展示了开源技术在消费级场景的落地路径。

9月10日周四
9月8日周二
  1. Google DeepMind73

    Google DeepMind 发布 AlphaGenome Atlas:人类基因组单核苷酸变异预测地图

    Google DeepMind 推出 AlphaGenome Atlas,这是一个包含人类基因组中90亿个单核苷酸变异分子效应预测的平台。该数据集规模达1 PB,并引入了结合 AlphaGenome 和 AlphaMissense 的 AVI 评分以辅助变异排序。目前该平台已通过网站门户、API 以及 Google Antigravity 技能向学术研究免费开放。

    推荐理由:原文提供了覆盖全基因组90亿变异的预测地图及免费访问入口,读者可据此评估其在罕见病解析与群体遗传学研究中的实际可用性。

9月5日周六
  1. GitHub Blog · AI & ML78

    GitHub 发布 Project HydraFusion:通过多模型编排实现前沿质量

    GitHub 推出 Project HydraFusion 研究预览,这是一种通过运行时多模型编排来提供前沿智能的新功能。它能在本地、云端和复合模型间自动进行语义路由,开发者只需像选择普通模型一样选择 HydraFusion,系统会自动规划执行路径以平衡性能、成本和延迟。

    推荐理由:GitHub 推出 HydraFusion 研究预览,通过多模型运行时编排实现前沿质量与成本平衡,提供实测数据与使用入口。

9月3日周四
  1. Hugging Face Blog78

    Hugging Face 发布 funes:为编码智能体提供本地持久化记忆层

    Hugging Face 推出开源工具 funes,旨在为 Claude Code、Codex 等编码智能体提供本地持久化记忆层。它通过索引会话轨迹实现跨智能体和设备的上下文召回,支持私有数据集同步,并在基准测试中显示其成本低于传统上下文压缩或手动交接方案。

    推荐理由:该工具通过本地索引和检索机制,将编码智能体的会话记录转化为可跨设备共享的记忆层,解决了上下文丢失问题。

  2. Google DeepMind62

    Google DeepMind 推出 Fairwind 计划提供主动网络防御能力

    Google DeepMind 推出 Fairwind 计划,向政府、关键基础设施运营商及可信合作伙伴提供受限访问权限,以利用其先进的网络防御能力。该计划整合了 Gemini 3.8 Flash Cyber 模型与 CodeMender 框架,帮助防御者在安全的云环境中自主发现、验证并修复漏洞,将原本需数周的手动修补过程缩短至几分钟。

    推荐理由:原文给出了面向政府与企业的受限访问计划,读者可以据此判断其如何利用专用模型实现漏洞的自主发现与修复。

9月2日周三
  1. Google DeepMind78

    Google DeepMind 在 Gemini 中推出智能体视频理解功能

    Google DeepMind 宣布在 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite 模型中推出智能体视频理解功能。该功能通过让模型主动决定观看内容、速度和模态来替代固定帧率的静态处理,使 token 消耗最多降低 88%,成本最多减少 66%,准确率提升最高达 7%。

    推荐理由:官方给出了视频理解从静态处理转向智能体动态检索的技术路径,并提供了具体的成本与精度优化数据。

9月1日周二
  1. Hugging Face Blog65

    Hugging Face 发布 @huggingface/kernels:包含 207 个 WebGPU 内核以加速本地 AI

    Hugging Face 推出 @huggingface/kernels 库及包含 207 个 WebGPU 内核的集合,旨在优化浏览器端推理性能。该库支持从 Hub 直接加载版本化内核,并配套 Fleet 工具收集真实硬件测试数据。

    推荐理由:原文给出了WebGPU内核库的发布细节与实测性能数据,读者可据此评估浏览器端推理加速的实际效果。

8月28日周五
8月25日周二
  1. Hugging Face Blog65

    Gradio 推出内置工作流功能 gr.Workflow

    Gradio 发布内置工作流功能 `gr.Workflow`,允许用户通过拖拽画布构建由类型化节点组成的 AI 管道。该功能使每个中间结果可见且可运行,同一图形自动转换为 REST API 并支持一键部署至 Hugging Face Spaces。

    推荐理由:原文展示了 Gradio 内置工作流功能,将 AI 管道转化为可视化界面、REST API 和一键部署能力,为开发者提供了从调试到生产环境的完整闭环方案。

8月20日周四
  1. Mistral AI65

    Mistral 发布 Agentic Search 智能体搜索功能

    Mistral 推出 Agentic Search,通过多步检索循环提升 AI 系统处理复杂文档的准确性并降低延迟。该功能提供 search、open、navigate、read 和 grep 五个工具,支持云端和本地部署。

    推荐理由:原文给出了多步检索循环的具体工具链,以及在金融和政务文档基准上的准确率与延迟实测数据。

8月18日周二
  1. Hugging Face Blog80

    Sentence Transformers v6.0 发布:原生支持多向量(Late Interaction)嵌入模型

    Sentence Transformers v6.0 新增 MultiVectorEncoder 模型类型,原生支持 ColBERT 风格的多向量(Late Interaction)检索。该更新允许直接加载 PyLate、Stanford-NLP ColBERT 及 colpali-engine 检查点,通过统一的 API 实现文本、视觉文档、音频和视频的高效检索与重排序。

    推荐理由:Sentence Transformers v6.0 原生支持多向量模型,统一了文本、图像及音视频的检索接口,提供了从加载到部署的完整实践指南。

8月13日周四
  1. Hugging Face Blog44

    OlmoEarth Studio 支持导出自定义嵌入向量用于下游分析

    OlmoEarth Studio 新增功能,允许用户计算并导出由开源 OlmoEarth 基础模型生成的嵌入向量。该功能提供 Nano、Tiny 和 Base 三种编码器变体,支持通过 UI 或 API 选择区域、时间范围及影像源,输出为 Cloud-Optimized GeoTIFFs (COGs)。这些轻量级向量适用于相似性搜索、分割等下游任务,且源码与权重已公开。

8月11日周二
  1. Mistral AI50

    Mistral 推出区域推理端点、优先层级并支持 GLM-5.2 等第三方开源模型

    Mistral 正式推出 Mistral Regional Endpoints 和处于公开预览阶段的 Mistral Priority Tier,提供欧洲或美国区域选择及 SLA 保障。平台开始支持 Z.ai 的 GLM-5.2 等第三方开源模型,使其运行于相同的区域控制与服务承诺下。Mistral 还组建联盟锁定长期算力,计划到 2030 年建成高达 1 GW 容量以强化 AI 主权。

8月6日周四
7月23日周四
7月21日周二
  1. Hugging Face Blog68

    Hugging Face 发布 Grabette:开源低成本机器人操作数据采集系统

    Hugging Face 联合 Pollen Robotics 发布 Grabette,这是一套基于 UMI 理念的开源手持夹爪系统,旨在让普通用户无需机器人即可录制真实世界操作演示并自动转化为 LeRobot 格式数据集。

    推荐理由:该工具将机器人数据采集门槛降至手持设备,通过浏览器端自动化处理直接生成标准训练数据集,为社区协作构建大规模操作数据提供了低成本且可复用的完整技术路径。

7月13日周一
7月9日周四
7月8日周三
  1. Hugging Face Blog78

    Hugging Face 发布 vLLM transformers 后端原速支持

    Hugging Face 宣布 transformers 库的 vLLM 建模后端现已实现与 vLLM 原生手写实现相当或更快的推理速度。用户只需添加 --model-impl transformers 标志,即可在无需修改代码的情况下利用 vLLM 的连续批处理和自定义注意力内核进行高效推理。

    推荐理由:原文展示了通过单一参数即可让 transformers 模型在 vLLM 中达到原生推理速度,消除了手动移植代码的需求。

7月7日周二
  1. Hugging Face Blog66

    微软发布 Foundry Managed Compute 并集成 Hugging Face 模型目录

    微软在 Build 2026 大会上发布 Foundry Managed Compute,并推出包含每周更新的 Hugging Face 精选模型的目录。该服务提供一键部署功能,支持 vLLM、SGLang 等运行时,自动处理容器更新和安全补丁,同时保持与付费令牌和预置吞吐量相同的端点、SDK 和计费体验。

    推荐理由:原文详细说明了托管计算平台的模型筛选流程、自动运维机制及统一接口,为评估企业级开源模型落地提供了具体参考。