跳到正文

#Hugging Face

今日 0 条
9月29日周五
9月28日周四
9月26日周二
9月22日周五
9月19日周二
  1. Hugging Face Blog24

    Rocket Money 与 Hugging Face 合作:在生产环境中扩展易变 ML 模型

    Rocket Money 选择 Hugging Face Inference API 托管其 BERT 系列文本分类模型,以替代原有正则表达式系统处理每月超 1 亿笔交易。该方案解决了小团队缺乏 MLOps 专业知识的痛点,实现了动态扩展和低延迟推理。经过三个月评估,Hugging Face 凭借快速部署能力和合作伙伴支持成为最终选择。

9月18日周一
  1. Hugging Face Blog38

    Hugging Face 发布目标检测排行榜及评估指标详解

    Hugging Face 推出 Object Detection Leaderboard,对 Hub 上的开源目标检测模型进行排名。该博客深入解析 IoU、Average Precision (AP) 和 Average Recall (AR) 等核心评估指标的计算方法。文章旨在帮助开发者理解不同报告间结果差异的原因,从而更批判性地评估模型性能并选择最适合应用需求的模型。

9月15日周五
  1. Hugging Face Blog62

    Hugging Face 详解 LLM 生产环境优化:低精度、Flash Attention 与架构创新

    Hugging Face 发布博客文章,系统介绍了大语言模型在生产环境中降低显存需求和提升推理效率的三大核心技术:低精度量化(8-bit/4-bit)、Flash Attention 算法以及针对长文本优化的模型架构(如 RoPE、ALiBi、MQA 和 GQA)。

    推荐理由:原文通过代码实测对比了低精度量化、Flash Attention 及 MQA/GQA 架构在显存占用与推理速度上的具体差异,为 LLM 生产环境优化提供了可复用的技术选型依据。

9月13日周三
  1. Hugging Face Blog45

    使用 PyTorch FSDP 微调 Llama 2 70B

    Hugging Face 演示如何利用 PyTorch FSDP、Transformers、Accelerate 和 TRL 微调 Llama 2 70B。通过仅在 rank 0 加载权重并广播至其他设备,解决了多 GPU 并行加载导致的 CPU 内存溢出问题。该方案在 2 节点 16 张 A100 GPU 环境下运行,显著降低了显存占用并提升了训练速度。

9月12日周二
  1. Hugging Face Blog50

    Hugging Face Transformers 原生支持量化方案概览:bitsandbytes 与 auto-gptq 对比

    Hugging Face Transformers 原生集成 bitsandbytes 和 auto-gptq 两种量化方案,分别适用于零样本推理/微调及高速文本生成。bitsandbytes 支持多模态模型且无需校准数据,但 4-bit 权重暂不支持序列化;auto-gptq 在文本生成上速度更快并支持 AMD GPU,但需数小时进行模型校准。

9月11日周一
9月8日周五
  1. Hugging Face Blog60

    Hugging Face 发布 SDXL 的 T2I-Adapter 支持指南与模型权重

    Hugging Face Diffusers团队联合T2I-Adapter作者发布了针对Stable Diffusion XL (SDXL)的T2I-Adapter支持,提供sketch、canny、lineart、depth和openpose等多种条件的预训练检查点。

    推荐理由:原文提供了T2I-Adapter在SDXL上的训练细节、参数对比及diffusers库中的具体代码用法,便于开发者复现高效可控生成。

9月6日周三
  1. Hugging Face Blog82

    Hugging Face 上线 TII Falcon 180B 开源大模型

    TII 发布的 Falcon 180B 正式登陆 Hugging Face Hub,提供 base 和 chat 版本。该模型拥有 1800 亿参数,基于 RefinedWeb 数据集在 3.5 万亿 tokens 上完成预训练,是当时最大的公开可用语言模型。其性能在多项基准测试中超越 Llama 2 70B,接近 PaLM-2 Large,但商用许可对托管使用有严格限制。

    推荐理由:原文给出了 Falcon 180B 的参数量、训练数据规模及硬件需求,读者可据此评估其在开源大模型中的性能定位与部署门槛。

9月1日周五
  1. Hugging Face Blog15

    Fetch 利用 Amazon SageMaker 与 Hugging Face 将 ML 处理延迟降低 50%

    Fetch 通过迁移至 Amazon SageMaker 并集成 Hugging Face AWS Deep Learning Container,成功将其最慢扫描的机器学习处理延迟降低 50%,同时文档理解模型准确率提升 200%。该方案支持每周处理超过 8000 万张收据,利用多 GPU 实例和并行训练实现了高并发下的快速推理与规模化部署。

8月30日周三
  1. Hugging Face Blog62

    Hugging Face 发布 AudioLDM 2 在 Diffusers 中的推理加速教程

    Hugging Face 发布教程展示如何在 🧨 Diffusers 库中优化 AudioLDM 2 模型的推理速度,将生成 10 秒音频的时间从约 30 秒缩短至不到 1 秒。

    推荐理由:原文通过逐步演示代码优化技巧,展示了如何将 AudioLDM 2 的推理时间缩短十倍以上,为开发者提供了可直接复用的性能调优方法。

8月25日周五
  1. Hugging Face Blog86

    Hugging Face 发布 Code Llama 集成支持

    Hugging Face 宣布在生态系统中集成 Meta 发布的 Code Llama 模型系列,提供 transformers 4.33+ 支持、Text Generation Inference 部署及 VS Code 扩展。

    推荐理由:原文给出了 Code Llama 在 Hugging Face 生态中的集成方式、不同参数规模的能力差异以及具体的部署与微调建议,读者可以据此判断如何将其接入现有开发工作流。

8月23日周三
8月22日周二
  1. Hugging Face Blog70

    Hugging Face 发布开源视觉语言模型 IDEFICS

    Hugging Face 推出开源视觉语言模型 IDEFICS,作为 DeepMind Flamingo 的公开复现版本。该模型提供 9B 和 80B 参数两种规模及指令微调变体,支持图文交错输入与文本生成。训练数据包含新创建的 115B token 数据集 OBELICS,模型权重在 Hugging Face Hub 上线并集成至 transformers 库。

    推荐理由:原文公开了基于 Flamingo 架构的开源复现细节及 OBELICS 数据集,为社区提供了可验证的多模态大模型训练基准。

  2. Hugging Face Blog40

    Hugging Face 推出企业级代码助手 SafeCoder

    Hugging Face 发布 SafeCoder,这是一款基于 StarCoder 模型的企业级自托管代码助手解决方案。该方案允许客户在自有基础设施上微调专有代码库,确保数据在训练和推理期间不离开 VPC。SafeCoder 支持 NVIDIA、AMD 等多种硬件加速部署,旨在提供合规且私有的“内部 GitHub Copilot”体验。

8月10日周四
  1. Hugging Face Blog27

    Hugging Face Hub 上线 AWS Marketplace,支持使用 AWS 账户付费

    Hugging Face Hub 正式入驻 AWS Marketplace,用户现可通过 AWS 账户直接订阅并支付 Inference Endpoints、Spaces Hardware Upgrades 及 AutoTrain 等服务费用。该集成计费方式允许组织成员统一通过 AWS 账单结算,无需绑定信用卡,旨在降低企业采用 Llama 2、StarCoder 等大语言模型的技术门槛。

8月9日周三
  1. Hugging Face Blog26

    使用 BentoML 部署 Hugging Face DeepFloyd IF 模型实战

    BentoML 开源平台支持将 Hugging Face 上的 DeepFloyd IF 文本生成图像模型部署至生产环境。该流程涵盖定义模型、创建 Service、构建 Bento 及容器化部署,利用 T5-XXL-1.1 编码提示词并分三阶段在像素空间生成 1024x1024 px 图像。开发者可独立扩展各 Stage Runner 以优化 GPU 资源分配与推理性能。

8月8日周二
  1. Hugging Face Blog73

    Hugging Face 发布 Swift Transformers 等工具以支持在苹果设备运行 LLM

    Hugging Face 发布 swift-transformers、swift-chat 及更新的模型导出工具,旨在帮助开发者在 Mac 和 iPhone 等苹果设备上通过 Core ML 运行 Llama 2 等大语言模型。

    推荐理由:原文提供了在苹果设备上运行大语言模型的完整工具链和转换指南,开发者可据此评估本地化部署的可行性。

  2. Hugging Face Blog77

    Hugging Face 发布使用 DPO 微调 Llama 2 的实践指南

    Hugging Face 博客介绍了如何在 TRL 库中使用直接偏好优化(DPO)方法微调 Llama v2 7B 模型。文章详细演示了从监督微调(SFT)到 DPO 训练的全流程,包括数据格式准备、QLoRA 配置及关键超参数 beta 的设置,并提供了可复用的代码示例和最终模型链接。

    推荐理由:提供了在TRL库中使用DPO微调Llama 2的完整代码与流程,展示了如何绕过复杂RLHF步骤直接优化偏好数据。

8月4日周五
8月2日周三
8月1日周二
7月27日周四
  1. Hugging Face Blog65

    Hugging Face 发布 Stable Diffusion XL 在 Mac 上的 Core ML 部署与高级量化指南

    Hugging Face 联合 Apple 发布 Stable Diffusion XL 的 Core ML 版本,并介绍混合位量化技术以优化 Mac 端运行效率。该技术在保持高画质的同时将模型体积压缩至 1.4 GB(减少 71%),支持在 macOS 14 beta 上通过 CPU+GPU 运行。官方已开源转换脚本、推理 Demo 及预计算量化配方,开发者可直接复用或应用于其他微调模型。

    推荐理由:文章详解了混合位量化技术原理及在 Stable Diffusion XL 上的应用,提供了从模型转换到性能测试的完整开源工具链。

7月24日周一
  1. Hugging Face Blog45

    Hugging Face 推出 Agents.js:为 LLM 提供 JavaScript 工具调用能力

    Hugging Face 发布 Agents.js,这是一个允许在浏览器或服务器端通过 JavaScript 赋予大语言模型工具访问权限的新库。该库默认使用 OpenAssistant/oasst-sft-4-pythia-12b-epoch-3.5 模型,支持自定义 LLM 及扩展多模态工具,但直接运行代码存在安全风险,建议配合 generateCode 和 evaluateCode 方法使用。

  2. Hugging Face Blog40

    Hugging Face 联合发布欧盟 AI 法案开放机器学习考量立场文件

    Hugging Face 与 Creative Commons、Eleuther AI、GitHub、LAION 及 Open Future 联合发布立场文件,阐述开放 ML 开发对欧盟 AI 法案目标的支持作用。该文件提出五项建议,包括明确定义 AI 组件、澄清开源协作开发不受法案约束、支持 AI Office 与开源生态协调、确保 R&D 例外实用性以及为“基础模型”设定比例要求。

7月18日周二
6月26日周一
  1. Hugging Face Blog28

    Hugging Face 探讨文本到图像模型中的偏见来源与检测工具

    Hugging Face 发布伦理与社会通讯,深入分析 Stable Diffusion、DALL-E 2 等文本到图像模型的偏见成因。文章指出训练数据(如 LAION-5B)、CLIP 推理偏差及潜在空间结构均会导致刻板印象输出。Hugging Face 通过 Stable Bias 项目展示相关探索工具,强调需结合技术手段与社会语境共同应对多模态生成中的公平性挑战。

6月23日周五
  1. Hugging Face Blog65

    Hugging Face 解析 Open LLM Leaderboard 中 MMLU 评分差异原因

    Hugging Face 团队分析了 Open LLM Leaderboard 上 MMLU 分数与论文数据不一致的原因,指出不同评估实现导致结果显著差异。文章对比了 EleutherAI Harness、Stanford HELM 和原始实现三种方法在提示词构造及概率计算上的区别,展示了同一模型在不同方法下的得分变化。最终确认社区维护的评估库更新后已对齐原始实现,并将重新运行排行榜以修正数据。

    推荐理由:原文通过对比三种 MMLU 实现方式,揭示了评估细节对模型分数的巨大影响,为理解 LLM 评测差异提供了具体案例。

6月20日周二
6月19日周一
6月16日周五
6月15日周四
  1. Hugging Face Blog68

    Hugging Face 发布基于 Core ML 的 Stable Diffusion 加速方案

    Hugging Face 联合 Apple 推出基于 Core ML 的 Stable Diffusion 加速方案,利用 6-bit palettization 技术显著降低模型体积并提升 iPhone、iPad 和 Mac 上的推理速度。

    推荐理由:官方展示了 Core ML 6-bit 量化在 iPhone 上的实测提速与内存节省,并提供了可直接下载的优化模型及自定义转换指南。