跳到正文

全部动态

今日 42 条
7月10日周三
7月9日周二
  1. Hugging Face Blog24

    Banque des Territoires 联合 Polyconseil 与 Hugging Face 构建主权 RAG 方案支持 EduRénov 计划

    Banque des Territoires、Polyconseil 与 Hugging Face 合作开发基于开源生态的主权 RAG 解决方案,以优化法国 EduRénov 学校翻新计划的邮件响应效率。该方案利用 Text Generation Inference 等工具保障数据主权,旨在通过生成式 AI 简化对 10,000 个公共教育设施项目的支持流程。

7月8日周一
7月3日周三
7月1日周一
  1. Hugging Face Blog68

    Hugging Face 发布基于 Transformers Code Agent 的 GAIA 基准测试方案

    Hugging Face 使用基于 transformers.agents(现已升级为 smolagents)构建的 ReactCodeAgent 在 GAIA 基准验证集上取得 44.2% 的成绩,位列第一。该方案核心在于让 LLM 生成并执行 Python 代码而非 JSON,通过自底向上构建的安全解释器限制操作权限,并结合 Web 浏览、文件检查等工具及简单的规划组件实现多智能体协作。

    推荐理由:原文详细拆解了基于代码动作的 Agent 架构与安全执行机制,并展示了在 GAIA 基准上的具体得分与多智能体编排策略。

6月27日周四
  1. Hugging Face Blog86

    Google 发布 Gemma 2 开源大语言模型

    Google 发布了最新一代开源大语言模型 Gemma 2,包含 9B 和 27B 两种参数规模的基座与指令微调版本。该模型引入了滑动窗口注意力、Logit 软封顶、知识蒸馏和模型合并等四项主要技术进步,上下文长度为 8K tokens。Hugging Face 已同步提供 Transformers 集成、Inference Endpoints 部署支持以及基于 TRL 的微调示例代码。

    推荐理由:原文详细解析了Gemma 2在滑动窗口注意力、软封顶及知识蒸馏上的技术改进,并提供了基于Transformers的微调与部署指南。

6月25日周二
6月24日周一
  1. Hugging Face Blog53

    Florence-2 微调教程:在 DocVQA 数据集上实现视觉问答

    Hugging Face 发布教程展示如何微调 Microsoft 的 Florence-2 模型以支持 DocVQA 任务。通过冻结视觉编码器并在单张 A100 GPU 上使用 batch size 6 进行 7 个 epoch 的训练,验证集上的 Levenshtein 相似度从 0 提升至 57.0。该过程证明了小参数量视觉语言模型在受限资源下适配下游任务的可行性。

6月21日周五
6月20日周四
6月19日周三
6月18日周二
  1. OpenAI News15

    Paf 通过自定义 GPTs 提升开发者生产力

    Paf 在全公司采用 ChatGPT Enterprise,工程师利用自定义 GPTs 加速日常开发任务。该公司还将 ChatGPT Enterprise 集成至 grit:lab 编码学院,用于培训下一代软件开发者。目前 70% 的 Paf 员工活跃使用 ChatGPT Enterprise,覆盖财务、人力资源等业务团队。

6月17日周一
6月13日周四
6月12日周三
  1. Hugging Face Blog82

    Hugging Face 集成 Stable Diffusion 3 Medium 模型

    Stable Diffusion 3 Medium(2B 参数)已上线 Hugging Face Hub 并支持通过 🧨 Diffusers 库使用。该模型采用多模态扩散 Transformer (MMDiT) 架构和 Rectified Flow Matching 训练目标,引入了新的 FlowMatchEulerDiscreteScheduler 调度器。

    推荐理由:官方给出了 SD3 Medium 的架构细节、显存优化方案及微调脚本,开发者可据此评估其在不同硬件上的部署可行性。

6月10日周一
6月8日周六
6月7日周五
6月6日周四
6月5日周三
  1. Mistral AI53

    Mistral AI 发布模型定制服务

    Mistral AI 在 la Plateforme 上推出模型定制功能,提供开源微调 SDK、无服务器微调服务及自定义训练服务三种入口。开发者可使用 mistral-finetune 代码库基于 LoRA 范式在自有基础设施上微调开源模型,或通过 API 调用 Mistral 7B 和 Mistral Small 的托管微调服务以降低成本并提升效率。

  2. Mistral AI16

    Mistral AI 启动微调黑客松活动

    Mistral AI 宣布举办虚拟微调黑客松,参赛者需使用其新推出的 fine-tuning API 提交项目。活动时间为 6 月 5 日至 30 日,前 3 名获胜者各获 €2,500 API 积分,部分参与者可申请 $100 免费额度。

6月4日周二