跳到正文

全部动态

今日 12 条
8月28日周一
8月25日周五
  1. Hugging Face Blog86

    Hugging Face 发布 Code Llama 集成支持

    Hugging Face 宣布在生态系统中集成 Meta 发布的 Code Llama 模型系列,提供 transformers 4.33+ 支持、Text Generation Inference 部署及 VS Code 扩展。

    推荐理由:原文给出了 Code Llama 在 Hugging Face 生态中的集成方式、不同参数规模的能力差异以及具体的部署与微调建议,读者可以据此判断如何将其接入现有开发工作流。

8月24日周四
8月23日周三
8月22日周二
  1. Hugging Face Blog70

    Hugging Face 发布开源视觉语言模型 IDEFICS

    Hugging Face 推出开源视觉语言模型 IDEFICS,作为 DeepMind Flamingo 的公开复现版本。该模型提供 9B 和 80B 参数两种规模及指令微调变体,支持图文交错输入与文本生成。训练数据包含新创建的 115B token 数据集 OBELICS,模型权重在 Hugging Face Hub 上线并集成至 transformers 库。

    推荐理由:原文公开了基于 Flamingo 架构的开源复现细节及 OBELICS 数据集,为社区提供了可验证的多模态大模型训练基准。

  2. Hugging Face Blog40

    Hugging Face 推出企业级代码助手 SafeCoder

    Hugging Face 发布 SafeCoder,这是一款基于 StarCoder 模型的企业级自托管代码助手解决方案。该方案允许客户在自有基础设施上微调专有代码库,确保数据在训练和推理期间不离开 VPC。SafeCoder 支持 NVIDIA、AMD 等多种硬件加速部署,旨在提供合规且私有的“内部 GitHub Copilot”体验。

8月16日周三
8月15日周二
8月10日周四
  1. Hugging Face Blog27

    Hugging Face Hub 上线 AWS Marketplace,支持使用 AWS 账户付费

    Hugging Face Hub 正式入驻 AWS Marketplace,用户现可通过 AWS 账户直接订阅并支付 Inference Endpoints、Spaces Hardware Upgrades 及 AutoTrain 等服务费用。该集成计费方式允许组织成员统一通过 AWS 账单结算,无需绑定信用卡,旨在降低企业采用 Llama 2、StarCoder 等大语言模型的技术门槛。

8月9日周三
  1. Hugging Face Blog26

    使用 BentoML 部署 Hugging Face DeepFloyd IF 模型实战

    BentoML 开源平台支持将 Hugging Face 上的 DeepFloyd IF 文本生成图像模型部署至生产环境。该流程涵盖定义模型、创建 Service、构建 Bento 及容器化部署,利用 T5-XXL-1.1 编码提示词并分三阶段在像素空间生成 1024x1024 px 图像。开发者可独立扩展各 Stage Runner 以优化 GPU 资源分配与推理性能。

8月8日周二
  1. Hugging Face Blog73

    Hugging Face 发布 Swift Transformers 等工具以支持在苹果设备运行 LLM

    Hugging Face 发布 swift-transformers、swift-chat 及更新的模型导出工具,旨在帮助开发者在 Mac 和 iPhone 等苹果设备上通过 Core ML 运行 Llama 2 等大语言模型。

    推荐理由:原文提供了在苹果设备上运行大语言模型的完整工具链和转换指南,开发者可据此评估本地化部署的可行性。

  2. Hugging Face Blog77

    Hugging Face 发布使用 DPO 微调 Llama 2 的实践指南

    Hugging Face 博客介绍了如何在 TRL 库中使用直接偏好优化(DPO)方法微调 Llama v2 7B 模型。文章详细演示了从监督微调(SFT)到 DPO 训练的全流程,包括数据格式准备、QLoRA 配置及关键超参数 beta 的设置,并提供了可复用的代码示例和最终模型链接。

    推荐理由:提供了在TRL库中使用DPO微调Llama 2的完整代码与流程,展示了如何绕过复杂RLHF步骤直接优化偏好数据。

8月4日周五
8月2日周三
8月1日周二
7月27日周四
  1. Hugging Face Blog65

    Hugging Face 发布 Stable Diffusion XL 在 Mac 上的 Core ML 部署与高级量化指南

    Hugging Face 联合 Apple 发布 Stable Diffusion XL 的 Core ML 版本,并介绍混合位量化技术以优化 Mac 端运行效率。该技术在保持高画质的同时将模型体积压缩至 1.4 GB(减少 71%),支持在 macOS 14 beta 上通过 CPU+GPU 运行。官方已开源转换脚本、推理 Demo 及预计算量化配方,开发者可直接复用或应用于其他微调模型。

    推荐理由:文章详解了混合位量化技术原理及在 Stable Diffusion XL 上的应用,提供了从模型转换到性能测试的完整开源工具链。

7月26日周三
7月24日周一
  1. Hugging Face Blog45

    Hugging Face 推出 Agents.js:为 LLM 提供 JavaScript 工具调用能力

    Hugging Face 发布 Agents.js,这是一个允许在浏览器或服务器端通过 JavaScript 赋予大语言模型工具访问权限的新库。该库默认使用 OpenAssistant/oasst-sft-4-pythia-12b-epoch-3.5 模型,支持自定义 LLM 及扩展多模态工具,但直接运行代码存在安全风险,建议配合 generateCode 和 evaluateCode 方法使用。

  2. Hugging Face Blog40

    Hugging Face 联合发布欧盟 AI 法案开放机器学习考量立场文件

    Hugging Face 与 Creative Commons、Eleuther AI、GitHub、LAION 及 Open Future 联合发布立场文件,阐述开放 ML 开发对欧盟 AI 法案目标的支持作用。该文件提出五项建议,包括明确定义 AI 组件、澄清开源协作开发不受法案约束、支持 AI Office 与开源生态协调、确保 R&D 例外实用性以及为“基础模型”设定比例要求。

7月21日周五
7月20日周四
  1. OpenAI News67

    OpenAI 发布新产品功能更新

    OpenAI 通过官方新闻源发布了新的产品功能更新。该消息源自 OpenAI News RSS 订阅,具体功能细节未在标题中展开,需查阅原文获取完整信息。

    推荐理由:官方公告确认了 OpenAI 平台的一项新功能上线,读者可据此了解当前可用的产品能力变化。

7月18日周二
7月7日周五
6月29日周四
6月28日周三
6月26日周一
  1. Hugging Face Blog28

    Hugging Face 探讨文本到图像模型中的偏见来源与检测工具

    Hugging Face 发布伦理与社会通讯,深入分析 Stable Diffusion、DALL-E 2 等文本到图像模型的偏见成因。文章指出训练数据(如 LAION-5B)、CLIP 推理偏差及潜在空间结构均会导致刻板印象输出。Hugging Face 通过 Stable Bias 项目展示相关探索工具,强调需结合技术手段与社会语境共同应对多模态生成中的公平性挑战。

6月23日周五
  1. Hugging Face Blog65

    Hugging Face 解析 Open LLM Leaderboard 中 MMLU 评分差异原因

    Hugging Face 团队分析了 Open LLM Leaderboard 上 MMLU 分数与论文数据不一致的原因,指出不同评估实现导致结果显著差异。文章对比了 EleutherAI Harness、Stanford HELM 和原始实现三种方法在提示词构造及概率计算上的区别,展示了同一模型在不同方法下的得分变化。最终确认社区维护的评估库更新后已对齐原始实现,并将重新运行排行榜以修正数据。

    推荐理由:原文通过对比三种 MMLU 实现方式,揭示了评估细节对模型分数的巨大影响,为理解 LLM 评测差异提供了具体案例。

6月20日周二
6月19日周一
6月16日周五
6月15日周四
  1. Hugging Face Blog68

    Hugging Face 发布基于 Core ML 的 Stable Diffusion 加速方案

    Hugging Face 联合 Apple 推出基于 Core ML 的 Stable Diffusion 加速方案,利用 6-bit palettization 技术显著降低模型体积并提升 iPhone、iPad 和 Mac 上的推理速度。

    推荐理由:官方展示了 Core ML 6-bit 量化在 iPhone 上的实测提速与内存节省,并提供了可直接下载的优化模型及自定义转换指南。

  2. Hugging Face Blog21

    Hugging Face 更新内容指南与政策

    Hugging Face 发布更新后的内容指南与政策,旨在支持开放、协作且负责任的机器学习社区。新政策重点强调“同意”作为核心价值,以应对 AI 技术对用户隐私、形象及权利带来的新挑战。平台通过跨团队专家协作制定规则,并鼓励利用 Community Tab 促进用户间的协作解决冲突。

6月13日周二
  1. Hugging Face Blog45

    Hugging Face 与 AMD 合作加速 CPU 和 GPU 平台上的前沿模型

    Hugging Face 宣布 AMD 加入其硬件合作伙伴计划,双方将合作优化 AMD CPU 和 GPU 上的 Transformer 性能。初期测试显示,AMD MI250 训练 BERT-Large 速度比直接竞争对手快 1.2 倍,GPT2-Large 快 1.4 倍。该合作旨在通过 ROCm SDK 集成及新 Optimum 库,为社区提供更具成本效益的训练与推理方案。