跳到正文

开源生态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

130条精选相关主题模型发布Hugging FaceAI 编码

最新精选

第 21–40 条 · 共 130 条
6月9日周二
  1. Google DeepMind82

    Google DeepMind 发布 Gemma 4 12B:统一无编码器多模态模型

    Google DeepMind 发布 Gemma 4 12B,这是一款旨在笔记本电脑上运行的高性能多模态模型。它采用独特的无编码器统一架构,将视觉和音频输入直接融入 LLM 主干网络,支持原生音频输入。

    推荐理由:该模型采用无编码器统一架构,在16GB显存设备上实现接近26B MoE的多模态推理能力,适合关注本地部署效率的开发者。

6月8日周一
6月4日周四
  1. Hugging Face Blog72

    Hugging Face 发布面向智能体优化的 hf CLI 及基准测试结果

    Hugging Face 重构了官方命令行工具 hf,使其同时适配人类用户和编码智能体(如 Claude Code、Codex)。通过自动检测环境变量,CLI 为智能体提供无 ANSI 码、不截断的 TSV 结构化输出,并引入下一步命令提示和非阻塞重试机制。

    推荐理由:官方展示了针对智能体优化的CLI设计细节与基准测试数据,揭示了在复杂多步任务中相比原生SDK能显著降低Token消耗并提升成功率。

  2. Google Research68

    Google 开源水文模型框架以增强全球洪水韧性

    Google Research 在 GitHub 上开源了其水文建模框架,旨在帮助国家气象和水文服务机构将先进的 AI 洪水预测集成到自身工作流中。该 Python 包基于 PyTorch 实现,包含 LSTM 架构和训练管道,支持使用 Caravan 数据集及用户自定义的本地数据进行微调。

    推荐理由:Google 开源水文模型框架,允许各国气象机构利用本地数据训练 AI 洪水预测模型,降低技术门槛并提升预警精度。

6月2日周二
  1. Hugging Face Blog75

    Holo3.1 系列模型发布:支持快速本地推理的计算机使用智能体

    Hcompany 发布 Holo3.1 系列计算机使用模型,旨在提升在 Web、桌面和移动环境以及不同 Agent 框架下的鲁棒性。该系列包含 0.8B、4B、9B 和 35B-A3B 四种尺寸,并首次提供 FP8、Q4 GGUF 和 NVFP4 量化检查点以支持本地推理。

    推荐理由:原文给出了跨环境鲁棒性提升及首次发布的量化权重,读者可据此评估本地化部署的可行性与性能损耗。

5月28日周四
  1. Mistral AI68

    Mistral AI 发布开源搜索工具包 Search Toolkit

    Mistral AI 推出开源搜索工具包 Search Toolkit 的公开预览版,这是一个用于构建生产级 AI 应用搜索管道的可组合框架。它将数据摄取、检索和评估整合在单一框架中,支持 BM25、密集向量及混合检索,并提供内置的召回率、精确度等评估指标。该工具包可在云、本地或边缘环境运行,旨在解决企业搜索基础设施碎片化问题,帮助开发者通过标准适配器接口快速集成多源数据并优化 RAG 工作流。

    推荐理由:该框架将检索、索引与评估整合为统一接口,有助于团队减少基础设施维护成本并聚焦于提升搜索质量。

5月22日周五
5月15日周五
4月16日周四
  1. Hugging Face Blog68

    Hugging Face 发布用于将 Transformers 模型移植至 MLX 的 Agent Skill 及测试框架

    Hugging Face 推出了一套专用 Skill 和测试框架,旨在帮助贡献者利用代码代理将语言模型从 transformers 库高效移植到 mlx-lm。该工具不仅自动生成符合人类审查标准的 PR,还配套了独立的非智能体测试框架以验证数值一致性和生成效果,确保在提升移植速度的同时维持开源项目的代码质量与设计契约。

    推荐理由:原文提供了将 transformers 模型移植到 mlx-lm 的专用 Skill 及非智能体测试框架,展示了在代码代理时代如何平衡自动化效率与开源代码质量。

4月3日周五
  1. Google DeepMind90

    Google DeepMind 发布 Gemma 4:号称每字节性能最强的开源模型家族

    Google DeepMind 正式推出 Gemma 4 系列开源大模型,包含 E2B、E4B、26B MoE 和 31B Dense 四种规格,采用 Apache 2.0 许可证。

    推荐理由:Google DeepMind 发布 Gemma 4 系列开源模型,提供从移动端到工作站的多种尺寸及 Apache 2.0 许可,展示了其在智能体工作流和边缘计算上的最新进展。

4月2日周四
  1. Hugging Face Blog96

    Gemma 4 系列多模态模型发布

    Gemma 4 系列多模态模型正式发布,包含 E2B、E4B、12B Unified、31B 和 26B A4B 五种尺寸,支持图像、文本和音频输入,采用 Apache 2.0 许可证。

    推荐理由:原文给出了五种尺寸的多模态架构细节与跨框架部署方案,读者可据此评估其在端侧推理和智能体工作流中的实际可用性。

4月1日周三
  1. Hugging Face Blog70

    TII 发布 Falcon Perception 0.6B 早期融合模型及 Falcon OCR 0.3B 模型

    Technology Innovation Institute (TII) 发布 Falcon Perception(0.6B 参数)和 Falcon OCR(0.3B 参数),两者均采用单一早期融合 Transformer 架构处理图像补丁与文本。

    推荐理由:原文展示了早期融合架构在开放词汇分割与OCR任务上的性能优势及推理细节,为小参数模型替代复杂视觉管线提供了可复用的技术路径。

  2. Hugging Face Blog60

    Hugging Face 推出 gradio.Server 支持任意自定义前端连接 Gradio 后端

    Hugging Face 发布 gradio.Server,这是一个基于 FastAPI 扩展的新功能,允许开发者使用 React、Svelte 或纯 HTML/JS 等任意前端框架,同时复用 Gradio 的队列系统、并发控制、MCP 支持和 Spaces 上的 ZeroGPU 基础设施。

    推荐理由:gradio.Server 允许开发者在保留 Gradio 队列和 ZeroGPU 等后端能力的同时使用任意前端框架,解决了自定义 UI 需脱离 Gradio 的痛点。

3月27日周五
3月18日周三
  1. Hugging Face Blog75

    Hugging Face 发布 2026 春季开源 AI 现状报告:中国模型下载量超越美国

    Hugging Face 发布《2026 年春季开源 AI 现状》报告,指出过去一年平台用户数接近翻倍至 1300 万,且中国模型的月度及总下载量已超越美国,占据约 41% 的份额。数据显示行业贡献比例从 70% 降至 37%,而独立开发者和小型团体的下载占比升至 39%,机器人数据集数量激增成为增长最快的子社区之一。

    推荐理由:基于平台数据揭示中国模型下载量超越美国及独立开发者占比上升,为判断开源AI地缘格局与社区演变提供量化依据。

3月17日周二
3月9日周一
  1. Hugging Face Blog68

    LeRobot v0.5.0 发布:支持 Unitree G1 人形机器人与新策略模型

    LeRobot v0.5.0 正式发布,这是该框架迄今最大规模的更新,包含超过 200 个合并 PR 和 50 多位新贡献者。新版本首次全面支持 Unitree G1 人形机器人(含全身控制),引入 Pi0-FAST 自回归 VLA、Real-Time Chunking 等六项新策略,并推出 EnvHub 以直接从 Hugging Face Hub 加载仿真环境。

    推荐理由:该版本新增人形机器人支持与多项策略模型,并优化数据管线与仿真环境加载,为具身智能研发提供更完整的开源工具链。

2月26日周四
2月20日周五