Mistral 在慕尼黑设立德国中心,推进工业 AI 与欧洲主权算力
Mistral 在慕尼黑开设新中心,组建专门团队研发 Physics AI 和 Industrial AI。该公司计划到 2030 年建设 1 吉瓦欧洲算力容量,并依托开源权重架构确保数据留在客户基础设施内。目前 Mistral 正与 BMW、Siemens Energy 及慕尼黑工业大学合作,利用其收购的 Emmi AI 技术优化流体动力学模拟等工业应用。
Mistral 在慕尼黑开设新中心,组建专门团队研发 Physics AI 和 Industrial AI。该公司计划到 2030 年建设 1 吉瓦欧洲算力容量,并依托开源权重架构确保数据留在客户基础设施内。目前 Mistral 正与 BMW、Siemens Energy 及慕尼黑工业大学合作,利用其收购的 Emmi AI 技术优化流体动力学模拟等工业应用。
Holo4 是 H Company 推出的新一代智能体模型系列,包含 27B 密集型和 35B-A3B MoE 两种规格,现已上线 H Models API。该模型通过监督学习和强化学习训练,能够灵活调用 GUI、代码、MCP 和 API 等多种接口执行复杂任务。
推荐理由:Holo4 系列模型发布,提供 27B 和 35B-A3B 两种规格,支持 GUI、代码、MCP 和 API 多接口交互,在 OSWorld 2.0 等基准测试中表现优异且成本更低。
GitHub Copilot 应用推出 canvases 功能,允许用户通过 `/create-canvas` 技能用自然语言描述生成可定制的双向交互界面。该界面支持看板、清单等多种形态,用户与智能体可实时同步操作状态,无需编写代码即可创建并复用扩展工具。
推荐理由:原文演示了如何通过自然语言描述生成双向交互界面,为构建个性化智能体工作流提供了具体方法。
GitHub Copilot 推出 canvas 功能,允许用户在应用内创建全栈自定义界面以替代传统聊天窗口进行交互。canvas 支持双向通信和本地代码执行,可用于构建如 Connect 4 游戏、Winget 包管理器等工具,从而减少不必要的 token 消耗并提升开发工作流的自动化程度。
推荐理由:文章通过具体案例展示了如何利用 canvas 构建自定义交互界面,帮助开发者优化与 AI 智能体的协作流程。
Google Research 推出名为“AI video co-director”的统一多智能体框架,旨在解决现有扩散模型在生成长篇叙事视频时面临的语义漂移和级联失败挑战。
推荐理由:Google Research 提出基于 Gemini 和 Veo 的多智能体框架,通过全局优化和世界状态跟踪解决长视频生成的语义漂移问题。
GitHub Security Lab 推出 Fuzzing Taskflow,这是一个用于 C/C++ 项目的自主模糊测试流水线。该工具利用 LLM Agent 自动识别入口点、编写 AFL++ Harness、分析覆盖率报告并分诊崩溃,最终生成漏洞报告。用户只需指定 GitHub 仓库即可启动,但需在隔离环境中运行以防范提示注入风险。
推荐理由:GitHub Security Lab 开源了基于 LLM Agent 的自动化模糊测试流水线,展示了如何将编写 Harness、分析覆盖率和分诊崩溃等重复性安全工作交给 AI 处理。
Google DeepMind 发布 Gemini 3.8 Live with Live Avatar,将低延迟流式视频生成与原生对话模型结合,为企业用户提供具备实时视觉呈现的交互式 AI 体验。
推荐理由:原文详述了实时视觉化身在对话中的同步机制与异步工具调用能力,为评估企业级多模态交互体验提供了具体技术细节。
Hugging Face 推出针对视觉语言模型 LFM2.5-VL-3B 的实验性 DSpark 草稿模型。该模型通过推测解码技术,在仅增加 8.9% 参数量的前提下,实现设备端最高 3.13 倍、H100 上 2.66 倍的解码加速。目前已支持 llama.cpp、MLX-VLM 和 SGLang,提供 Safetensors 和 GGUF 格式供开源部署。
NVIDIA与Google DeepMind等机构合作,在AlphaFold Database中开放了超过2,800种病毒的预测3D蛋白复合物结构。该数据集利用AlphaFold2模型结合NVIDIA BioNeMo Inference Runtime生成,旨在帮助科学家提前储备应对未来大流行的知识。
GitHub Copilot App 重构了 Pull Request 视图以支持包含 2,200 个文件和超过 100 万行变更的超大 PR 流畅渲染。针对代码行高度确定但评论块高度动态变化的矛盾,团队将文档高度拆分为确定性代码几何域和动态块几何域,并采用空闲滚动门控的单次批量测量调度器替代逐块 ResizeObserver 以避免布局反馈循环。
Microsoft Research 挑战机器人仅依赖板载 GPU 进行推理的传统假设,提出将计算卸载至边缘或云端。实测显示该方案能提升任务成功率并延长电池寿命,同时支持更大模型运行。团队还推出了基于 Kubernetes 的工具链,帮助开发者在机器人、边缘和云之间部署分布式推理工作负载。
Google DeepMind 宣布在 Private AI Compute 平台引入新的服务器端持久记忆功能,旨在解决云端 AI 助手长期连续性与严格隐私标准之间的矛盾。
推荐理由:原文详述了通过硬件隔离和端到端加密实现云端持久记忆的技术架构,为理解隐私保护与跨设备连续性如何兼得提供了具体方案。
Google DeepMind 推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款新文本转语音模型,旨在将语音生成从静态预设转变为动态创意工具。
推荐理由:原文展示了从静态预设到动态创意工作室的转变,提供了角色定制、逐行导演及多语言支持的具体能力与基准表现。
NVIDIA 数据中心系统工程师 Sakeena Fiza 通过严格的验证流程,确保 Rubin GPU 等硬件在量产前具备高可靠性。她致力于在从托盘到机架的复杂环境中排查故障,保障 AI 工厂基础设施的稳定运行。
NVIDIA 联合合作伙伴在新加坡 AI Day 展示 Nemotron 3 Super/Nano Omni 等开源模型,推动东南亚公共部门 AI 从试点转向生产。HTX、NCS 及泰国 iApp Technology 等机构利用 Nemotron 与 NeMo 工具开发多模态应用及本地化法律助手 Thanoy(服务约 4.3 万用户)。
NVIDIA 在 ROSCon 大会上发布了 Isaac ROS 5.0,这是一套基于 ROS 的 GPU 加速软件包集合,旨在通过引入 agentic 工作流和新平台支持来加速机器人应用的构建与部署。
Hugging Face Transformers 新增对 GGUF 格式模型的支持,允许用户通过熟悉的 API 在本地加载和运行 llama.cpp 的量化检查点。该功能目前主要面向 Apple Silicon 设备,通过复用 ggml 内核实现了接近 llama.cpp 的推理性能,并支持使用 transformers serve 暴露 OpenAI 兼容接口。
推荐理由:原文展示了在 transformers 中直接运行 GGUF 模型的方法及性能基准,为本地开发者提供了无需切换推理引擎即可复用现有 PyTorch 工作流的可行路径。
UK AISI 利用 EvalEval 基础设施公开分享评估结果,支持可复现的评估科学。此次发布涵盖 HealthBench、FrontierMath 等五个基准及 Claude Opus 4/4.5/4.6、GPT-5/5.2/5.4 六款前沿模型的验证数据。
oMLX 创建者及维护者 Jun Kim 正式加入 Hugging Face,旨在推动本地 AI 生态发展。此举将使 oMLX 从业余项目转变为完全资助和维护的项目,保持 Apache 2.0 开源协议并由 Jun 继续领导。
NVIDIA 发布 DSX Ready 认证计划,旨在验证符合其 AI 工厂参考设计的电源与冷却产品。首批类别包括电池储能系统(BESS)和冷却分配单元(CDU),Hitachi Energy、Tesla、LG Electronics 等厂商的产品已获认证。该计划通过标准化测试降低集成风险,帮助构建者更自信地评估并部署基础设施组件。
NVIDIA 指出 Physical AI 规模化部署需在硬件、软件及 AI 行为等全层级实现安全,预计 2035 年将有 4900 万辆 L3-5 级自动驾驶汽车和 6000 万台工业机器人落地。其推出的 Halos 系统作为首个全栈安全方案,整合 DRIVE AGX Thor、Alpamayo 模型及 Isaac Lab 仿真工具,为自动驾驶与机器人提供从设计到验证的端到端安全保障。
NVIDIA 在埃及举办活动展示其AI生态从赋能转向执行,Deep Learning Institute学习者数量一年内增长超十倍。Hassan Allam Utilities与A15达成约4亿美元数据中心投资协议,Cassava Technologies计划在南非及埃及等地部署AI工厂,潜在投资达7.2亿美元。
Microsoft Research 在 Nature 发表并开源 RetroChimera,该模型通过集成 R-SMILES 2 和 NeuralLoc 两个互补子模型及学习排序策略,显著提升了小分子逆合成路线的预测质量。盲测显示,PhD 级化学家更偏好其生成的反应预测,优于先前模型及文献记录。
NVIDIA 指出 AI 安全是需定义需求、实施控制并验证证据的工程问题,强调在 Agent 栈各层建立可执行边界。其推出开源安全运行时 OpenShell,通过沙箱执行和资源访问管控防止越权操作。Cisco DefenseClaw 与 JFrog 等联盟伙伴基于此构建治理层,协助团队实现防御工具共享与安全验证。
ThinkLabs AI、Atomic Canyon、Redwood Materials、TerraPower 和 Commonwealth Fusion Systems 五家公司利用 NVIDIA AI 技术加速清洁能源研发与部署。这些方案涵盖电网数字孪生、核能运营优化及回收电池供电,显著缩短互联评估时间并提升能源系统灵活性。
Hugging Face 发布 tokenizers v1 的 release candidate,在保持输出 Token ID 完全一致的前提下,单线程编码速度较 v0.23 提升 3 到 30 倍。
推荐理由:官方详解了通过位流分割和缓存机制实现数倍性能提升的技术路径,为评估大规模训练与推理场景下的数据预处理瓶颈提供了具体参考。
Google Research 推出 MilleMiglia,这是一个用 C++ 编写的中间里程物流实例生成器,旨在解决该领域缺乏高质量公开数据的问题。它通过模拟真实的网络拓扑和需求分布,生成保护隐私的基准测试数据,以支持后续优化研究。源代码和文档已在 GitHub 开源。
GitHub Podcast 指出 RAG 并未消亡,而是作为检索增强生成技术为模型提供外部上下文。文章澄清 MCP 负责工具连接标准,Skills 封装团队专业知识,二者互补而非替代。此外,讨论强调开发者仍需审查 AI 代码,且判断力比单纯使用 AI 工具更为关键。
Google Research 推出新研究实验,允许教师利用生成式用户界面(GenUI)创建定制化的交互式学习模拟器。该方案通过游戏化设计和教学护栏确保内容质量,目前已在 STEM 学科发布包含 30 多个由 AI 生成并经教师审核的示例库。
GitHub Copilot 团队使用 AI 智能体将 Copilot agent runtime 从 TypeScript 完全重写为超过 800,000 行生产级 Rust 代码。
推荐理由:原文详细记录了利用 AI 智能体将 GitHub Copilot 运行时从 TypeScript 迁移至 Rust 的全过程,展示了在大规模代码重写中如何通过增量合并、自动化测试和子代理协作来保证稳定性与效率。
NVIDIA Vera Rubin NVL72 在 MLPerf Inference v6.1 预览测试中,Qwen3-VL 吞吐量较 GB300 NVL72 提升最高 3.7x,DeepSeek-R1 提升 2.5x。GB300 NVL72 实现 99% 扩展效率,软件优化使性能较 v6.0 提升 1.6x。
Emerald AI、Google 和 NVIDIA 宣布成立 AI 能源管理联盟(AEMA),旨在推动能根据电网状况动态管理用电的灵活 AI 数据中心。该联盟采用技术中立且基于性能的规则,通过标准化响应速度等指标,加速美国 AI 基础设施互联并提升电网可靠性。
Mistral AI 宣布与 Mozilla 达成合作,其模型将为 Firefox 的 AI 浏览助手 Smart Window(测试版)提供动力。该功能旨在帮助用户理解复杂搜索、记忆已关闭标签页内容并基于当前标签页获取信息,首批覆盖法国和北美用户,英国和德国将于今年晚些时候跟进。
推荐理由:Mistral 模型接入 Firefox Smart Window,为浏览器 AI 助手提供隐私保护与多语言支持,展示了开源技术在消费级场景的落地路径。
曼彻斯特大学团队使用 NVIDIA Earth-2 CorrDiff 模型,在 Isambard-AI 超算上仅用两天训练出覆盖全英、分辨率达 2-3 平方公里的空气污染预测模型。该工作流支持在 DGX Spark 桌面 AI 系统上进行推理和小规模重训,大幅降低算力门槛。团队计划开源训练数据与工作流,并探索结合边缘设备实现实时决策及面向医疗的主动预警应用。
Google Research 推出 Retrieve-for-Train 框架,通过离线强化学习将查询分解行为编译为监督信号,以解决 LLM 在复杂搜索中的推理瓶颈。该方案利用 RL 训练 Gemma3-4B 和 Qwen3-4B 生成对齐属性的子查询,并蒸馏至一个 53.9M 参数的扩散检索器中。此架构实现了单次非自回归推理,消除了测试时思维链开销,显著提升了集合级搜索结果的多样性与响应速度。
Google DeepMind 发布 Gemini 3.8 Live 和 Gemini 3.8 Live Extended Thinking 两款最新实时对话模型,旨在提升语音智能体的近实时推理能力。
推荐理由:原文详细列出了两款新语音模型在多项基准测试中的具体得分及并行推理能力,为开发者评估实时语音智能体的性能与成本提供了直接依据。
IBM Research 在 Hugging Face 博客发布新研究,指出传统 Mean@k 指标掩盖了智能体的不一致性问题,并引入 Pass^k 指标量化这一“一致性缺口”。
推荐理由:提出 Pass^k 指标揭示智能体一致性缺口,提供无需重跑的诊断工具与指南生成方法,可提升生产环境可靠性。
GitHub 日本及韩国市场团队利用 GitHub Copilot 和 Actions,将营销活动从策划到跟进转化为代码驱动的自动化流程。该方案以 Issue 为工作单元,通过标签触发工作流自动执行页面复制、UTM 链接生成及 CRM 数据同步等任务。这种“营销即代码”模式替代了传统手动操作,显著降低了跨工具重复性工作的出错率并提升了效率。
Google Research 提出 ToolGrad,利用“答案优先”策略和文本梯度迭代构建复杂工具链数据。该方法在 Berkeley Function Calling Leaderboard 上表现优异,微调后的 ToolGrad-12B 得分 83.1,超越 Gemini 2.5 Pro、Claude 4.5 Opus 及 GPT-5 等专有模型。
GitHub Copilot app 新增内置面板,支持在应用内直接完成代码变更审查、运行与预览。用户可通过 diff 面板查看增删改行,利用终端面板执行命令或脚本,并借助浏览器面板的 Pick & Polish 工具实时调整 UI 元素。这一集成工作流消除了编辑器、终端与浏览器间的切换,让用户能安全验证并合并 AI 生成的代码。