跳到正文

#Hugging Face

今日 0 条
9月20日周五
9月18日周三
  1. Hugging Face Blog63

    Hugging Face 详解如何将 LLM 微调至 1.58bit 极限量化

    Hugging Face 发布技术博客,介绍如何通过特定技巧将现有的 Llama3 8B 模型微调至 BitNet 架构支持的 1.58bit 极限量化水平。团队通过引入动态 lambda 值逐步应用量化以解决权重分布突变导致的性能损失,最终在仅使用 10B tokens 微调的情况下使模型在 MMLU 基准测试中超越 Llama 1 7B。

    推荐理由:原文详细拆解了将 Llama3 微调至 1.58bit 的量化技巧与动态 lambda 调度策略,为低精度模型部署提供了可复现的工程路径。

9月17日周二
  1. Hugging Face Blog68

    Hugging Face 推出 Datasets SQL Console

    Hugging Face Hub 为 Datasets 推出了新的 SQL Console 功能,允许用户直接在浏览器中通过 SQL 查询、过滤和发现数据集。该控制台由 DuckDB WASM 驱动,支持完整的 DuckDB 语法及正则、JSON 等内置函数,且无需任何服务器依赖。用户可将查询结果导出为 Parquet 文件或通过链接分享,目前内存限制约为 3GB,适用于大多数常规查询场景。

    推荐理由:官方介绍了基于 DuckDB WASM 的浏览器内 SQL 查询功能,无需后端即可直接筛选和转换数据集,适合需要快速处理 Parquet 数据的开发者。

9月16日周一
  1. Hugging Face Blog63

    HuggingChat 推出 Community Tools 功能

    HuggingFace 在 HuggingChat 中发布 Community Tools 功能,允许用户将任何公开的 HuggingFace Space 转化为模型可直接调用的工具。

    推荐理由:官方展示了将任意 Space 转为工具的流程,并提供了 RAG 模板,读者可据此扩展聊天助手的多模态能力。

9月13日周五
9月4日周三
  1. Hugging Face Blog35

    Hugging Face 与 TruffleHog 合作集成密钥扫描功能

    Hugging Face 宣布与 Truffle Security 合作,将开源工具 TruffleHog 的密钥扫描功能集成至平台。该集成扩展了自动安全扫描管道,新增针对密码、令牌和 API 密钥的检测能力,并在发现已验证泄露时通知用户。同时推出原生 `trufflehog huggingface` 命令,支持用户主动扫描模型、数据集及 Spaces 中的敏感信息。

8月27日周二
8月22日周四
  1. Hugging Face Blog48

    Hugging Face 五大被低估工具详解

    Hugging Face Hub 推出 ZeroGPU、多进程 Docker、Gradio API、Webhooks 和 Nomic Atlas 五项功能,助力构建 AI 解决方案。ZeroGPU 基于 Nvidia A100 提供免费 GPU 配额,Nomic Atlas 支持语义搜索可视化。这些工具通过 Reddit 数据源案例演示了如何低成本实现自动更新的语义搜索应用。

8月21日周三
8月19日周一
8月14日周三
  1. Hugging Face Blog60

    Hugging Face 复盘 Infini-attention 实验:为何其长上下文性能随压缩次数下降

    Hugging Face 团队分享了复现 Google Infini-attention 的实验结果,发现随着内存压缩次数增加,模型在长上下文任务中的性能显著下降且不可靠。

    推荐理由:作者详细记录了复现Infini-attention的调试过程与失败原因,揭示了长上下文扩展中压缩记忆的性能瓶颈及收敛难点。

8月13日周二
  1. Hugging Face Blog45

    ggml 入门指南:轻量级 Transformer 推理库核心概念与编译

    ggml 是一个专注于 Transformer 推理的开源 C/C++ 机器学习库,被 llama.cpp、Ollama 等项目用于实现端侧 LLM。其核心优势在于极简主义(少于 5 个文件)、轻量级(二进制小于 1MB)及支持 x86_64、ARM、Apple Silicon 等多硬件后端。开发者需理解 ggml_context、ggml_cgraph 等底层概念以进行高效计算图调度与内存管理。

8月12日周一
8月8日周四
  1. Hugging Face Blog65

    Hugging Face 宣布收购 XetHub 以优化大文件存储与协作

    Hugging Face 正式宣布收购西雅图初创公司 XetHub,旨在将其技术整合至 Hub 以替代 Git LFS 作为存储后端。XetHub 团队由前 Apple ML 基础设施成员组成,其核心技术支持 TB 级仓库的 chunked files 和去重功能,能显著减少如 Parquet 文件或 GGUF 模型更新时的重复上传量。

    推荐理由:原文披露了收购动机及具体技术场景,读者可据此理解 Hugging Face 如何通过替换存储后端解决超大模型文件的版本管理痛点。

8月6日周二
  1. Hugging Face Blog37

    Hugging Face 与 Albumentations AI 推出 TextImage 文档图像增强技术

    Hugging Face 联合 Albumentations AI 发布 TextImage 数据增强管线,专为视觉语言模型微调设计。该多模态方法通过随机插入、删除或交换文本并同步修复图像背景,在保留语义的同时生成合成训练数据。开发者可通过 `albumentations` 库调用,支持 IDL 和 PDFA 数据集以解决小样本下的 OCR 精度问题。

  2. Hugging Face Blog23

    Hugging Face 2024年安全功能亮点

    Hugging Face 发布2024年安全功能概览,涵盖细粒度令牌、双因素认证及提交签名等默认防护机制。平台通过 ClamAV 和 picklescan 实现自动化恶意软件与密钥扫描,保障 Hub 用户资产安全。企业版额外提供 SSO 单点登录及资源组隔离等高级控制选项。

7月31日周三
7月30日周二
7月29日周一
7月25日周四
7月23日周二
  1. Hugging Face Blog95

    Hugging Face 上线 Llama 3.1 405B/70B/8B 模型及全栈集成指南

    Hugging Face 正式上架 Meta 发布的 Llama 3.1 系列模型,包含 8B、70B 和 405B 三种尺寸的基座与指令微调版本,以及 Llama Guard 3 和 Prompt Guard 安全模型。

    推荐理由:原文详细列出了 Llama 3.1 各尺寸模型的显存需求、量化方案及微调代码,为开发者评估部署成本和集成路径提供了具体参考。

7月22日周一
  1. Hugging Face Blog68

    Hugging Face 详解 WWDC 24 Core ML 新特性运行 Mistral 7B

    Hugging Face 发布教程,指导开发者利用 WWDC 24 引入的 Core ML 新特性在 Mac 上运行 Mistral 7B 模型。通过 Swift Tensor、Stateful Buffers 和块量化技术,该方案能将 70 亿参数模型的内存占用降至 4GB 以下。

    推荐理由:原文详细演示了利用WWDC 24新特性将Mistral 7B转换为Core ML模型并实现端侧高效推理的完整流程。

7月18日周四
  1. Hugging Face Blog65

    Hugging Face TGI 发布 Multi-LoRA 服务功能

    Hugging Face 为 Text Generation Inference (TGI) 推出 Multi-LoRA serving 功能,支持在单次部署的基础模型上动态加载并服务多达 30 个 LoRA 适配器。

    推荐理由:TGI 新增 Multi-LoRA 功能,允许在单一基础模型部署中动态加载多个微调适配器,显著降低多模型服务的运维成本与复杂度。

7月16日周二
7月11日周四
7月10日周三
7月9日周二
  1. Hugging Face Blog24

    Banque des Territoires 联合 Polyconseil 与 Hugging Face 构建主权 RAG 方案支持 EduRénov 计划

    Banque des Territoires、Polyconseil 与 Hugging Face 合作开发基于开源生态的主权 RAG 解决方案,以优化法国 EduRénov 学校翻新计划的邮件响应效率。该方案利用 Text Generation Inference 等工具保障数据主权,旨在通过生成式 AI 简化对 10,000 个公共教育设施项目的支持流程。

7月8日周一
7月3日周三
7月1日周一
  1. Hugging Face Blog68

    Hugging Face 发布基于 Transformers Code Agent 的 GAIA 基准测试方案

    Hugging Face 使用基于 transformers.agents(现已升级为 smolagents)构建的 ReactCodeAgent 在 GAIA 基准验证集上取得 44.2% 的成绩,位列第一。该方案核心在于让 LLM 生成并执行 Python 代码而非 JSON,通过自底向上构建的安全解释器限制操作权限,并结合 Web 浏览、文件检查等工具及简单的规划组件实现多智能体协作。

    推荐理由:原文详细拆解了基于代码动作的 Agent 架构与安全执行机制,并展示了在 GAIA 基准上的具体得分与多智能体编排策略。

6月27日周四
  1. Hugging Face Blog86

    Google 发布 Gemma 2 开源大语言模型

    Google 发布了最新一代开源大语言模型 Gemma 2,包含 9B 和 27B 两种参数规模的基座与指令微调版本。该模型引入了滑动窗口注意力、Logit 软封顶、知识蒸馏和模型合并等四项主要技术进步,上下文长度为 8K tokens。Hugging Face 已同步提供 Transformers 集成、Inference Endpoints 部署支持以及基于 TRL 的微调示例代码。

    推荐理由:原文详细解析了Gemma 2在滑动窗口注意力、软封顶及知识蒸馏上的技术改进,并提供了基于Transformers的微调与部署指南。

6月25日周二
6月24日周一
  1. Hugging Face Blog53

    Florence-2 微调教程:在 DocVQA 数据集上实现视觉问答

    Hugging Face 发布教程展示如何微调 Microsoft 的 Florence-2 模型以支持 DocVQA 任务。通过冻结视觉编码器并在单张 A100 GPU 上使用 batch size 6 进行 7 个 epoch 的训练,验证集上的 Levenshtein 相似度从 0 提升至 57.0。该过程证明了小参数量视觉语言模型在受限资源下适配下游任务的可行性。