跳到正文

全部动态

今日 42 条
9月15日周一
9月12日周五
9月11日周四
  1. OpenAI News60

    OpenAI 发布最新公司动态

    OpenAI 通过官方新闻渠道发布了最新的企业动态公告。该消息源自 OpenAI News RSS 订阅源,具体涉及公司层面的重大调整或战略更新。

    推荐理由:OpenAI 官方发布关于公司战略或治理变动的声明,读者可据此了解头部 AI 实验室的最新商业动向。

  2. Hugging Face Blog65

    Hugging Face 详解 transformers 如何复用 OpenAI GPT-OSS 的 MXFP4 量化与并行技术

    Hugging Face 发布博客介绍 transformers 库为支持 OpenAI GPT-OSS 模型所做的多项核心升级,包括原生 MXFP4 量化、张量并行、专家并行及动态滑动窗口缓存等特性。

    推荐理由:原文详细拆解了 transformers 库为适配 GPT-OSS 所做的底层优化,提供了可直接复用的代码片段和性能基准数据。

  3. Hugging Face Blog60

    Together AI 支持从 Hugging Face Hub 微调任意 LLM

    Together AI 宣布新功能,允许用户直接通过其基础设施对 Hugging Face Hub 上的任意兼容 LLM 进行微调。开发者只需指定基础模板和自定义模型参数,即可在几分钟内启动训练任务,并将微调后的模型自动上传回 Hub 或用于推理部署。该集成旨在降低传统微调的复杂度和成本,加速团队基于开源社区模型进行领域适配和迭代优化的速度。

    推荐理由:Together AI 与 Hugging Face Hub 打通微调流程,开发者可直接调用平台基础设施定制任意兼容模型并回传社区。

9月10日周三
  1. Hugging Face Blog68

    Hugging Face 发布 Jupyter Agent:通过合成数据与简化脚手架增强小模型数据分析能力

    Hugging Face 推出 Jupyter Agent 项目,旨在通过构建高质量训练数据和优化代理脚手架,提升小型语言模型在数据科学任务中的表现。团队利用 Kaggle Notebook 数据集经过多阶段清洗和合成生成约 51k 条轨迹,对 Qwen3-4B 进行全参数微调,使其在 DABStep 基准测试的简单任务上准确率提升至 75%。

    推荐理由:原文公开了从数据清洗到微调的完整流水线及代码,展示了小模型在特定脚手架下性能提升的具体路径。

9月9日周二
  1. Mistral AI62

    Mistral AI 完成 17 亿欧元 C 轮融资,ASML 领投

    Mistral AI 宣布完成 17 亿欧元的 C 轮融资,投后估值达 117 亿欧元。本轮融资由半导体设备制造商 ASML 领投,DST Global、Andreessen Horowitz、Bpifrance、General Catalyst、Index Ventures、Lightspeed 和 NVIDIA 等现有投资者参与。资金将用于推动科学研究,以应对关键行业面临的最复杂技术挑战。

    推荐理由:官方披露了由ASML领投的17亿欧元C轮融资细节及估值,读者可据此了解头部AI实验室当前的资本结构与战略绑定方向。

9月8日周一
9月5日周五
9月4日周四
  1. Hugging Face Blog80

    Google 发布 EmbeddingGemma:面向端侧的高效多语言嵌入模型

    Google DeepMind 发布 EmbeddingGemma,这是一款拥有 308M 参数、支持 100 多种语言的开源多语言文本嵌入模型。该模型基于 Gemma3 架构并采用双向注意力机制,量化后内存占用低于 200 MB,在 MTEB 排行榜上位居同尺寸纯文本模型前列。

    推荐理由:原文展示了308M参数模型在MMTEB上的表现及多框架集成方案,读者可据此评估其在移动端RAG和检索任务中的落地可行性。

9月3日周三
9月2日周二
  1. Mistral AI55

    Mistral AI 在 Le Chat 中推出 Memories 测试版功能

    Mistral AI 宣布在其聊天助手 Le Chat 中推出 Memories(beta)功能,旨在让 AI 能够记住、适应用户并提升工作效率。该功能基于透明度、自主权和主权三大原则设计,用户可以查看记忆来源、随时关闭或编辑特定记忆,并支持数据的导出与导入。

  2. Hugging Face Blog65

    Hugging Face 发布指南:在 ZeroGPU Spaces 中使用 PyTorch AoT 编译提升性能

    Hugging Face 发布技术指南,介绍如何在 ZeroGPU Spaces 中利用 PyTorch 的 ahead-of-time (AoT) 编译来优化模型推理速度。

    推荐理由:文章详细演示了如何在 ZeroGPU Spaces 中集成 PyTorch AoT 编译,提供了从基础配置到 FP8 量化及动态形状的高级优化代码与实测加速数据。

9月1日周一
8月28日周四
  1. OpenAI News78

    OpenAI 发布新多模态模型

    OpenAI 发布了一款新的多模态模型,支持更直接的语音交互。该模型旨在提升实时对话体验,具体技术细节和性能指标需参考官方文档。

    推荐理由:OpenAI 官方发布了新的多模态模型,提供了更直接的语音交互能力,适合评估其在实时对话场景中的表现。

8月27日周三
8月26日周二
8月22日周五
8月21日周四
8月19日周二
8月18日周一
  1. Hugging Face Blog58

    Hugging Face 发布 CUDA 内核构建与生产级部署指南

    Hugging Face 发布了关于使用 kernel-builder 库构建和部署自定义 CUDA 内核的详细指南。文章演示了如何从零开始编写图像转灰度内核,将其注册为原生 PyTorch 算子,并通过 Nix 实现可复现构建。此外,还介绍了如何利用 Hugging Face Hub 进行多架构编译、语义化版本管理以及生成 Python wheels 以支持生产环境部署。

8月14日周四
8月13日周三
8月12日周二