跳到正文

#Hugging Face

今日 0 条
10月23日周四
  1. Hugging Face Blog83

    Meta与Hugging Face联合发布OpenEnv Hub及0.1规范

    Meta和Hugging Face宣布合作推出OpenEnv Hub,这是一个用于构建、共享和探索智能体环境的开放社区中心。该Hub旨在解决大语言模型缺乏安全工具访问的问题,通过定义包含工具、API和执行上下文的沙盒环境,支持强化学习训练与部署。

    推荐理由:Meta与Hugging Face联合推出OpenEnv Hub,为智能体提供标准化的训练与部署环境,开发者可据此构建兼容的RL基础设施。

10月22日周三
  1. Hugging Face Blog43

    Sentence Transformers 正式加入 Hugging Face

    Sentence Transformers 从 TU Darmstadt UKP Lab 移交至 Hugging Face,由 Tom Aarsen 继续领导。该开源库支持生成高质量嵌入向量,Hub 上已有超 16,000 个模型,月活跃用户逾百万。项目保持 Apache 2.0 许可证及社区驱动模式,依托 HF 基础设施持续优化信息检索与 NLP 能力。

10月21日周二
  1. Hugging Face Blog62

    Hugging Face 发布开源 OCR 模型选型与部署指南

    Hugging Face 发布指南帮助开发者选择和使用开源 OCR 模型。文章对比了 Chandra、OlmOCR-2、PaddleOCR-VL 等最新模型在表格处理、多语言支持及输出格式上的能力,并介绍了 OmniDocBenchmark 等评测基准。

    推荐理由:Hugging Face 官方指南系统梳理了主流开源 OCR 模型的能力差异、评测基准及本地与云端部署方案,为构建文档 AI 流水线提供了选型依据。

  2. Hugging Face Blog65

    Hugging Face AI Sheets发布重大更新,新增图像视觉处理能力

    Hugging Face开源工具AI Sheets发布重大更新,正式加入对图像视觉内容的支持。用户现在可以在电子表格中直接上传、分析、提取信息以及生成和编辑图片,无需编写代码。

    推荐理由:AI Sheets新增视觉能力支持图像提取与生成,用户可在电子表格中直接处理多模态数据并导出结构化结果。

10月17日周五
10月16日周四
10月15日周三
10月14日周二
10月7日周二
  1. Hugging Face Blog68

    BigCodeArena发布:支持实时执行的代码生成模型评估平台

    BigCode项目推出BigCodeArena,这是首个允许用户通过实际运行代码来评估和比较AI代码生成模型的众包平台。该平台支持Python、JavaScript等10种语言及React、PyGame等8种执行环境,用户可提交任务并投票选择表现更好的模型。

    推荐理由:BigCodeArena通过引入实时执行反馈解决了代码生成评估中静态对比的局限,其数据揭示了不同模型在特定运行环境下的鲁棒性差异。

10月2日周四
10月1日周三
9月29日周一
9月26日周五
  1. Hugging Face Blog58

    Hugging Face 发布 swift-transformers v1.0,聚焦端侧 LLM 与智能体支持

    Hugging Face 正式发布 swift-transformers v1.0,标志着该 Swift 库在 Apple Silicon 平台本地模型集成上的稳定性成熟。新版本将 Tokenizers 和 Hub 升级为顶级独立模块,引入更快的 Jinja 模板引擎并移除冗余依赖以简化开发体验。官方表示未来将重点深化对 MLX 框架的支持以及 MCP 等智能体应用场景的探索。

9月23日周二
9月22日周一
  1. Hugging Face Blog40

    SyGra:面向 LLM 与 SLM 的一站式数据构建框架

    Hugging Face 推出 SyGra,这是一款专为大语言模型(LLM)和小语言模型(SLM)设计的一站式低代码/无代码数据构建框架。SyGra 支持 vLLM、Hugging Face TGI、Triton 和 Ollama 等多种推理后端,可简化从 Q&A 生成到 DPO 对齐等复杂数据集的创建与转换流程。该框架旨在通过自动化数据处理减少工程负担,加速模型对齐并提升数据质量。

  2. Hugging Face Blog68

    Hugging Face 发布 Gaia2 智能体基准与 ARE 开源框架

    Hugging Face 联合 Meta 推出 Gaia2 智能体评估基准及配套开源框架 ARE,旨在通过模拟真实世界中的噪声、时间敏感性和 API 故障来测试 AI Agent 的鲁棒性。

    推荐理由:原文提供了 Gaia2 基准与 ARE 框架的完整技术细节及初步模型评测结果,为开发者调试和评估智能体在复杂真实场景下的表现提供了可复用的开源工具链。

9月19日周五
9月18日周四
9月17日周三
9月16日周二
9月15日周一
9月12日周五
9月11日周四
  1. Hugging Face Blog65

    Hugging Face 详解 transformers 如何复用 OpenAI GPT-OSS 的 MXFP4 量化与并行技术

    Hugging Face 发布博客介绍 transformers 库为支持 OpenAI GPT-OSS 模型所做的多项核心升级,包括原生 MXFP4 量化、张量并行、专家并行及动态滑动窗口缓存等特性。

    推荐理由:原文详细拆解了 transformers 库为适配 GPT-OSS 所做的底层优化,提供了可直接复用的代码片段和性能基准数据。

  2. Hugging Face Blog60

    Together AI 支持从 Hugging Face Hub 微调任意 LLM

    Together AI 宣布新功能,允许用户直接通过其基础设施对 Hugging Face Hub 上的任意兼容 LLM 进行微调。开发者只需指定基础模板和自定义模型参数,即可在几分钟内启动训练任务,并将微调后的模型自动上传回 Hub 或用于推理部署。该集成旨在降低传统微调的复杂度和成本,加速团队基于开源社区模型进行领域适配和迭代优化的速度。

    推荐理由:Together AI 与 Hugging Face Hub 打通微调流程,开发者可直接调用平台基础设施定制任意兼容模型并回传社区。

9月10日周三
  1. Hugging Face Blog68

    Hugging Face 发布 Jupyter Agent:通过合成数据与简化脚手架增强小模型数据分析能力

    Hugging Face 推出 Jupyter Agent 项目,旨在通过构建高质量训练数据和优化代理脚手架,提升小型语言模型在数据科学任务中的表现。团队利用 Kaggle Notebook 数据集经过多阶段清洗和合成生成约 51k 条轨迹,对 Qwen3-4B 进行全参数微调,使其在 DABStep 基准测试的简单任务上准确率提升至 75%。

    推荐理由:原文公开了从数据清洗到微调的完整流水线及代码,展示了小模型在特定脚手架下性能提升的具体路径。

9月9日周二
9月4日周四
  1. Hugging Face Blog80

    Google 发布 EmbeddingGemma:面向端侧的高效多语言嵌入模型

    Google DeepMind 发布 EmbeddingGemma,这是一款拥有 308M 参数、支持 100 多种语言的开源多语言文本嵌入模型。该模型基于 Gemma3 架构并采用双向注意力机制,量化后内存占用低于 200 MB,在 MTEB 排行榜上位居同尺寸纯文本模型前列。

    推荐理由:原文展示了308M参数模型在MMTEB上的表现及多框架集成方案,读者可据此评估其在移动端RAG和检索任务中的落地可行性。

9月3日周三
9月2日周二
  1. Hugging Face Blog65

    Hugging Face 发布指南:在 ZeroGPU Spaces 中使用 PyTorch AoT 编译提升性能

    Hugging Face 发布技术指南,介绍如何在 ZeroGPU Spaces 中利用 PyTorch 的 ahead-of-time (AoT) 编译来优化模型推理速度。

    推荐理由:文章详细演示了如何在 ZeroGPU Spaces 中集成 PyTorch AoT 编译,提供了从基础配置到 FP8 量化及动态形状的高级优化代码与实测加速数据。

8月21日周四
8月19日周二
8月18日周一
  1. Hugging Face Blog58

    Hugging Face 发布 CUDA 内核构建与生产级部署指南

    Hugging Face 发布了关于使用 kernel-builder 库构建和部署自定义 CUDA 内核的详细指南。文章演示了如何从零开始编写图像转灰度内核,将其注册为原生 PyTorch 算子,并通过 Nix 实现可复现构建。此外,还介绍了如何利用 Hugging Face Hub 进行多架构编译、语义化版本管理以及生成 Python wheels 以支持生产环境部署。

8月14日周四
8月13日周三
8月12日周二
  1. Hugging Face Blog30

    Hugging Face 发布 FilBench:评估 LLM 在菲律宾语言中的能力

    Hugging Face 推出 FilBench,用于系统评估大语言模型在 Tagalog、Filipino 和 Cebuano 上的表现。该基准涵盖文化知识与生成等四大类共12项任务,测试了20多个前沿模型。结果显示,SEA-LION 等区域专用开源模型虽参数效率高,但整体性能仍落后于 GPT-4o,且所有模型在翻译生成任务中均面临挑战。