跳到正文

全部动态

今日 11 条
7月18日周五
7月17日周四
  1. Mistral AI68

    Mistral Le Chat 发布深度研究、Voxtral 语音模式及 Magistral 推理新功能

    Mistral AI 为其助手 Le Chat 推出多项重大更新,包括预览版 Deep Research 模式、基于 Voxtral 模型的语音交互以及由 Magistral 模型驱动的原生多语言推理能力。

    推荐理由:Mistral 为 Le Chat 集中上线了深度研究、语音交互及原生多语言推理等核心功能,展示了其助手向全能型生产力工具演进的具体路径。

7月16日周三
  1. Hugging Face Blog65

    Hugging Face 发布 Ettin Suite:SoTA 配对编码器与解码器模型

    Hugging Face 推出 Ettin Suite,这是首个包含 SoTA 配对编码器(17M-1B 参数)和解码器模型的套件,两者使用完全相同的开放数据(2T tokens)、架构和训练配方进行训练。

    推荐理由:提供了在相同数据和训练配方下对比编码器与解码器架构的受控实验结果,有助于理解不同架构在分类、检索和生成任务上的固有优势。

7月15日周二
  1. Mistral AI82

    Mistral AI 发布开源语音理解模型 Voxtral

    Mistral AI 发布开源语音理解模型 Voxtral,包含适用于生产环境的 24B 版本和适用于本地/边缘部署的 3B 版本(Voxtral Mini),均采用 Apache 2.0 许可证。

    推荐理由:原文给出了两种参数规模的开源语音理解模型及其在转录和语义理解上的基准表现,读者可以据此评估其在本地部署或生产环境中的成本与能力平衡。

  2. Hugging Face Blog70

    Hugging Face Hub 完成从 Git LFS 到 Xet 存储后端的迁移

    Hugging Face Hub 已将超过 50 万个仓库和 20 PB 数据从 Git LFS 迁移至新的 Xet 存储后端,目前超 100 万用户正在使用 Xet。该迁移通过 Git LFS Bridge 和后台内容迁移机制实现零中断兼容,支持新旧客户端无缝访问。自本月起,Xet 将向所有用户开放,新创建仓库默认启用 Xet,现有仓库将自动迁移,同时计划开源 Xet 协议及基础设施栈。

    推荐理由:原文详述了从 Git LFS 到 Xet 的无感迁移架构与性能数据,为理解大规模 AI 存储系统的平滑演进提供了工程参考。

7月11日周五
7月10日周四
  1. Hugging Face Blog65

    Hugging Face 分享构建官方 MCP Server 的技术实践与架构决策

    Hugging Face 发布博客文章,详细解析其官方 MCP Server(hf.co/mcp)的开发历程与技术选型。团队对比了 STDIO、HTTP with SSE 和 Streamable HTTP 三种传输方式,最终在生产环境中采用 Stateless 且 Direct Response 模式的 Streamable HTTP,以优化资源开销并支持动态工具配置。

    推荐理由:官方详解 MCP Server 构建中的传输协议选型与状态管理权衡,为开发者提供远程服务部署的实战参考。

7月9日周三
  1. Hugging Face Blog65

    Hugging Face 发布指南:利用 Gradio MCP Servers 为大语言模型扩展能力

    Hugging Face 发布教程介绍如何通过 Gradio 5.28.0+ 将 Hugging Face Spaces 转化为 MCP 服务器,从而让大语言模型获得图像编辑等新能力。文章以 Flux.1 Kontext[dev] 为例,详细演示了在 Cursor 中配置该 MCP 服务器的步骤,并指出用户可通过“MCP App Store”筛选兼容空间来快速扩展模型功能。

    推荐理由:原文演示了如何将 Hugging Face Spaces 上的 Gradio 应用作为 MCP 服务器接入 LLM,为开发者提供了扩展模型能力的具体操作路径。

7月8日周二
  1. Hugging Face Blog38

    Hugging Face 生产基础设施中的三个关键监控告警

    Hugging Face 基础设施团队分享了支撑其生产环境的三个核心监控告警机制。其中“高 NAT 网关吞吐量”告警用于识别异常流量并优化云成本,通过 DNS 覆盖切换私有网络路径以节省对象存储访问费用。“Hub 请求日志归档成功率”告警则确保 Hub 应用日志数据被高效捕获、处理及存储,保障平台稳定性与可观测性。

  2. Hugging Face Blog78

    Hugging Face 发布 SmolLM3:支持 128k 上下文与双模式推理的开源 3B 模型

    Hugging Face 推出完全开源的 3B 参数模型 SmolLM3,包含 Base 和 Instruct/Reasoning 版本,支持英语、法语等 6 种语言及最高 128k 上下文窗口。

    推荐理由:Hugging Face 发布了 SmolLM3 及其完整训练配方,展示了在 3B 规模下通过公开数据实现长上下文和双模式推理的工程路径。

7月4日周五
  1. Hugging Face Blog28

    Hugging Face 宣布 NeurIPS 2025 E2LM Competition:早期训练评估语言模型

    Hugging Face 联合发起 NeurIPS 2025 E2LM Competition,旨在构建捕捉大语言模型早期训练阶段科学知识的基准。比赛基于 lm-evaluation-harness,提供 0.5B、1B 和 3B 参数模型检查点供信号质量评分,隐藏部分数据以防过拟合。冠军奖金为 6,000 USD,结果将于 2025 年 11 月 4 日公布。

7月3日周四
  1. Mistral AI33

    Mistral AI 推出“AI for Citizens”计划助力各国政府掌控人工智能

    Mistral AI 发布“AI for Citizens”协作倡议,旨在帮助各国政府和公共机构通过开放技术自主塑造 AI 未来。该计划提供从前沿模型到自托管、SaaS 及数据主权保障的灵活部署选项,支持定制化研发以适配本地语言与文化需求。目前 Mistral AI 已与法国、新加坡等多国政府及机构合作,推动公共服务转型并构建本土 AI 生态系统。

7月1日周二
6月28日周六
  1. Hugging Face Blog62

    NVIDIA 发布 Llama Nemotron Nano VL 8B 视觉语言模型

    NVIDIA 推出 Llama Nemotron Nano VL,这是一款基于 Llama-3.1-8B-Instruct 和 C-RADIOv2-VLM-H 架构的 8B 参数视觉语言模型,专为智能文档处理和 OCR 设计。

    推荐理由:原文给出了8B视觉语言模型在文档处理基准上的表现及部署入口,读者可以据此判断其在企业级自动化场景中的适用性。

6月26日周四
  1. Hugging Face Blog84

    Gemma 3n正式登陆开源生态,支持transformers、MLX等主流框架

    Gemma 3n现已全面支持transformers、timm、MLX、llama.cpp、Ollama等主流开源库,实现本地化多模态运行。该模型包含E2B和E4B两种规格,通过Per-Layer Embeddings技术将实际5B/8B参数的显存占用降至2GB/3GB,并首次引入MobileNet-v5视觉编码器与USM音频编码器。

    推荐理由:原文详细列出了Gemma 3n在主流开源库中的集成方式及显存优化原理,为开发者提供了从推理到微调的完整落地路径。

6月23日周一
6月19日周四
6月16日周一
6月12日周四
  1. Hugging Face Blog65

    Hugging Face Kernel Hub 五分钟入门教程

    Hugging Face 发布 Kernel Hub 使用教程,介绍如何通过 kernels 库直接加载预编译优化内核以替代复杂的手动构建流程。文中演示了集成 RMSNorm 内核的方法,并在 L4 GPU 上展示了最高约 1.97x 的推理加速效果。

    推荐理由:原文演示了通过一行代码加载预编译内核以替代手动构建,并给出了 RMSNorm 在特定硬件上的实测加速数据。

6月11日周三
  1. Hugging Face Blog68

    Hugging Face 联合 NVIDIA 推出 Training Cluster as a Service

    Hugging Face 在 GTC Paris 宣布与 NVIDIA 合作推出 Training Cluster as a Service,旨在让全球研究机构更易获取大型 GPU 集群以训练基础模型。

    推荐理由:原文介绍了 Hugging Face 与 NVIDIA 合作推出的 Training Cluster as a Service,读者可了解其按需获取 GPU 集群以训练基础模型的具体机制。

6月10日周二
  1. Mistral AI80

    Mistral AI 发布首个推理模型 Magistral

    Mistral AI 发布其首个推理模型 Magistral,分为开源的 Magistral Small(24B 参数)和企业版 Magistral Medium。

    推荐理由:原文给出了双版本参数规模、AIME2024 具体得分及多语言原生推理特性,读者可据此评估其在专业领域与合规场景下的实际能力边界。

6月6日周五
  1. Hugging Face Blog65

    Hugging Face 发布 ScreenSuite:最全面的 GUI 智能体评估套件

    Hugging Face 发布 ScreenSuite,这是一个包含 13 个基准测试的综合评估套件,用于评估视觉语言模型(VLM)在感知、定位、单步操作和多步智能体等方面的能力。

    推荐理由:原文整合了13个GUI智能体基准并统一为纯视觉评估环境,提供了支持本地部署的Docker容器和快速启动指南。

6月4日周三
  1. Mistral AI60

    Mistral AI 发布 Mistral Code 企业级 AI 编码助手

    Mistral AI 推出 Mistral Code,这是一款面向企业软件团队的 AI 编码助手,现已在 JetBrains IDEs 和 VSCode 开放私有测试。

    推荐理由:原文展示了面向企业的安全合规AI编码助手,整合了模型、IDE插件及私有化部署选项,适合关注代码安全与效率的团队评估。

6月3日周二
  1. Hugging Face Blog65

    H Company 发布 Holo1 GUI 自动化 VLM 家族及 Surfer-H 智能体

    H Company 在 Hugging Face Hub 上发布了 Holo1 系列动作视觉语言模型(Action VLMs)和 WebClick 基准测试。该系列包含 Holo1-3B 和 Holo1-7B 两个版本,基于 Qwen2.5-VL 架构,其中 Holo1-7B 在通用 UI 定位基准上达到 76.2% 的平均准确率。

    推荐理由:原文发布了专为GUI自动化设计的开源视觉语言模型家族及基准,提供了低成本实现网页任务自动化的具体性能数据。