跳到正文

开源生态

开源模型、框架与仓库动态:权重开放、社区项目爆火、开源与闭源的力量消长。

130条精选相关主题模型发布Hugging FaceAI 编码

最新精选

第 61–80 条 · 共 130 条
7月11日周五
7月8日周二
  1. Hugging Face Blog78

    Hugging Face 发布 SmolLM3:支持 128k 上下文与双模式推理的开源 3B 模型

    Hugging Face 推出完全开源的 3B 参数模型 SmolLM3,包含 Base 和 Instruct/Reasoning 版本,支持英语、法语等 6 种语言及最高 128k 上下文窗口。

    推荐理由:Hugging Face 发布了 SmolLM3 及其完整训练配方,展示了在 3B 规模下通过公开数据实现长上下文和双模式推理的工程路径。

6月26日周四
  1. Hugging Face Blog84

    Gemma 3n正式登陆开源生态,支持transformers、MLX等主流框架

    Gemma 3n现已全面支持transformers、timm、MLX、llama.cpp、Ollama等主流开源库,实现本地化多模态运行。该模型包含E2B和E4B两种规格,通过Per-Layer Embeddings技术将实际5B/8B参数的显存占用降至2GB/3GB,并首次引入MobileNet-v5视觉编码器与USM音频编码器。

    推荐理由:原文详细列出了Gemma 3n在主流开源库中的集成方式及显存优化原理,为开发者提供了从推理到微调的完整落地路径。

6月10日周二
  1. Mistral AI80

    Mistral AI 发布首个推理模型 Magistral

    Mistral AI 发布其首个推理模型 Magistral,分为开源的 Magistral Small(24B 参数)和企业版 Magistral Medium。

    推荐理由:原文给出了双版本参数规模、AIME2024 具体得分及多语言原生推理特性,读者可据此评估其在专业领域与合规场景下的实际能力边界。

6月3日周二
  1. Hugging Face Blog65

    Hugging Face 发布 SmolVLA:基于社区数据训练的高效开源视觉语言动作模型

    Hugging Face 推出 SmolVLA-450M,这是一款紧凑的开源视觉语言动作(VLA)模型,专为机器人设计且可在消费级硬件上运行。该模型仅使用 LeRobot 社区共享的数据集进行预训练,在 LIBERO、Meta-World 模拟环境及 SO100/SO101 真实任务中表现优于 ACT 等更强基线。

    推荐理由:原文展示了仅用社区数据训练的紧凑视觉语言动作模型,在消费级硬件上实现高效推理并超越更大基线,为机器人研究提供了可复现的低门槛方案。

5月21日周三
  1. Mistral AI80

    Mistral 发布 Devstral:面向软件工程任务的开源智能体大模型

    Mistral AI 联合 All Hands AI 推出 Devstral,这是一款专为解决真实 GitHub 问题设计的智能体大模型。Devstral 在 SWE-Bench Verified 基准测试中取得 46.8% 的成绩,比此前开源最佳模型高出 6% 以上,并超越了 Deepseek-V3-0324 和 Qwen3 232B-A22B 等更大参数量的模型。

    推荐理由:该模型在SWE-Bench Verified上大幅超越现有开源基准,且支持单卡本地部署,为隐私敏感场景提供了高性价比的编码智能体方案。

5月15日周四
  1. Hugging Face Blog65

    Hugging Face 确立 Transformers 为跨框架模型定义标准

    Hugging Face 宣布将 Transformers 库打造为机器学习生态系统的核心枢纽,旨在统一模型定义标准。目前该库支持超过 300 种模型架构,并已与 vLLM、SGLang、llama.cpp 等主流推理引擎及 Axolotl、Unsloth 等训练框架深度集成,实现“一次贡献,全生态可用”。未来团队将进一步简化建模代码 API,降低新模型接入门槛,推动从训练到部署的全链路互操作性。

    推荐理由:Hugging Face 将 Transformers 定位为跨框架的模型定义标准,通过简化贡献流程实现与主流推理引擎及训练框架的深度互操作。

4月14日周一
  1. Hugging Face Blog65

    Hugging Face 收购 Pollen Robotics 并推出售价 7 万美元的开源人形机器人 Reachy 2

    Hugging Face 宣布收购拥有 9 年开源机器人研发经验的 Pollen Robotics,这是其第五次收购。双方将共同推进开源机器人战略,目前提供的首款产品是面向研究和教育的开源人形机器人 Reachy 2,支持 VR 遥操作,售价为 70,000 美元。

    推荐理由:原文披露了收购细节及首款开源人形机器人 Reachy 2 的定价与能力,为观察 AI 巨头布局实体硬件提供了具体样本。

4月5日周六
3月17日周一
  1. Mistral AI77

    Mistral AI 发布 Mistral Small 3.1 开源多模态模型

    Mistral AI 发布 Mistral Small 3.1,这是一款 Apache 2.0 许可的开源模型,支持 128k tokens 上下文窗口和多模态理解。该模型推理速度达 150 tokens/s,可在单张 RTX 4090 或 32GB RAM Mac 上运行,目前已上线 Hugging Face 和 La Plateforme API。

    推荐理由:官方公布小参数模型在文本、多模态及长上下文维度的性能数据与硬件适配细节,为端侧部署提供具体参考。

3月12日周三
  1. Hugging Face Blog92

    Google 发布 Gemma 3:支持多模态、140+语言及128k上下文的开源大模型

    Google 发布新一代开源多模态大模型 Gemma 3,包含 1B、4B、12B 和 27B 四种参数规模。除 1B 版本仅支持文本外,其余版本均支持图像输入,上下文窗口最高达 128k tokens,并支持 140 多种语言。

    推荐理由:原文详细列出了Gemma 3各尺寸参数、上下文长度及多语言支持,并提供了在Hugging Face生态中的具体部署与推理代码示例。

3月4日周二
  1. Hugging Face Blog65

    Cohere For AI 发布 Aya Vision 8B/32B 开源多模态模型

    Cohere For AI 推出 Aya Vision 8B 和 32B 两款开源权重视觉语言模型(VLM),旨在解决多模态模型的多语言性能挑战。该系列基于 SigLIP2 视觉编码器和 Aya Expanse 语言模型,采用动态图像分块、Pixel Shuffle 降采样以及多模态模型合并等技术,支持 23 种语言的图像描述、视觉问答及 OCR 等任务。

    推荐理由:Cohere For AI 发布 Aya Vision 系列开源多模态模型,通过合成标注与模型合并技术提升23种语言下的视觉理解能力。

2月25日周二
  1. Hugging Face Blog78

    Hugging Face 发布 FastRTC:面向 Python 的实时通信库

    Hugging Face 推出 FastRTC,这是一个专为 Python 设计的实时通信库,旨在简化实时音频和视频 AI 应用的构建。它内置了自动语音检测、轮次管理以及基于 Gradio 的 UI,支持 WebRTC 和 WebSocket,并可一键部署为 FastAPI 应用或获取免费电话号码进行通话测试。

    推荐理由:该库通过封装 WebRTC 和自动语音检测,让 Python 开发者能低门槛构建实时音视频 AI 应用,并支持快速部署与电话接入。

2月14日周五
  1. Hugging Face Blog73

    Hugging Face 用 Math-Verify 重新评估 Open LLM Leaderboard 全部模型

    Hugging Face 使用 Math-Verify 对 Open LLM Leaderboard 上所有 3,751 个提交模型进行了重新评估,以解决旧版 MATH-Hard 任务中因格式解析和符号比较导致的评分偏差问题。

    推荐理由:原文展示了 Math-Verify 修复旧评估器缺陷的具体案例及重测数据,为开发者提供了更可靠的模型数学能力对比依据。

2月4日周二
  1. Hugging Face Blog80

    Hugging Face 开源 DeepResearch 复现框架

    Hugging Face 发布开源项目 Open Deep Research,旨在复现 OpenAI Deep Research 的功能并公开其智能体框架。该项目利用 smolagents 库构建代码代理(CodeAgent),在 GAIA 验证集上达到 55.15% 的成绩,优于此前开源框架约 46% 的水平。

    推荐理由:Hugging Face 开源了基于 smolagents 的 DeepResearch 复现框架,展示了代码代理在 GAIA 基准测试中相比传统 JSON 动作生成的显著性能提升。

2月2日周日
  1. Hugging Face Blog65

    Hugging Face 发布 Open-R1 项目进展:复现 DeepSeek-R1 训练管线与数据

    Hugging Face 更新 Open-R1 项目进展,旨在复现 DeepSeek-R1 缺失的训练管线和合成数据。团队已在 MATH-500 基准上验证评估结果,并将 GRPO 集成至 TRL v0.14 以支持并行训练。

    推荐理由:原文公开了复现 DeepSeek-R1 的训练管线与合成数据生成细节,提供了可参考的工程实现方案。

1月30日周四
  1. Mistral AI82

    Mistral AI 发布 Mistral Small 3:24B 参数 Apache 2.0 开源模型

    Mistral AI 发布 Mistral Small 3,这是一款基于 Apache 2.0 许可证的 24B 参数低延迟优化模型。该模型在 MMLU 上准确率超过 81%,推理速度达 150 tokens/s,比同硬件上的 Llama 3.3 70B 快 3 倍以上。

    推荐理由:原文给出了24B参数模型的Apache 2.0许可、3倍于竞品的推理速度及本地部署门槛,读者可据此评估其在低延迟场景下的替代价值。

1月28日周二
  1. Hugging Face Blog65

    Hugging Face 启动 Open-R1 项目以完全复现 DeepSeek-R1

    Hugging Face 宣布启动 Open-R1 项目,旨在系统性重建 DeepSeek-R1 的数据和训练流程。该项目计划通过蒸馏高质量推理数据集、复现纯强化学习管线以及展示多阶段训练方法,来填补官方未公开代码和数据集的空白,推动开源推理模型的发展。

    推荐理由:原文详细拆解了 DeepSeek-R1 的训练配方并规划了复现路径,为社区提供了构建开源推理模型的具体方法论和数据策略参考。

1月27日周一
  1. Hugging Face Blog65

    Diffusers 团队解析开源视频生成模型现状及低显存推理优化指南

    Hugging Face Diffusers 团队发布博客,综述了当前开源视频生成模型(如 CogVideoX, Hunyuan, LTX-Video)的能力、局限性及技术架构。

    推荐理由:文章梳理了开源视频生成模型的现状与局限,并提供了在 Diffusers 中通过量化、卸载等优化手段降低显存需求及微调的具体代码方案。