跳到正文

模型发布

新模型的发布、开源与迭代:大模型厂商的旗舰更新、开源权重放出、性能与价格变化的第一时间记录。

221条精选相关主题产品更新论文研究开源生态

最新精选

第 101–120 条 · 共 221 条
11月20日周四
11月19日周三
  1. Google Research80

    Google Research 发布端到端实时语音到语音翻译模型

    Google Research 推出了一种创新的端到端语音到语音翻译(S2ST)模型,实现了仅2秒延迟的实时翻译,并能保留原始说话人的声音特征。该模型基于 AudioLM 框架和 SpectroStream 编解码技术,通过可扩展的时间同步数据获取管道进行训练,解决了传统级联系统延迟高、错误累积和缺乏个性化的问题。

    推荐理由:Google Research 发布了端到端实时语音到语音翻译模型,将延迟降至2秒并保留原声,已在 Google Meet 和 Pixel 10 中部署。

  2. Hugging Face Blog63

    ServiceNow AI 发布 Apriel-H1:通过蒸馏将 15B 推理模型转为 Mamba 混合架构

    ServiceNow AI 团队发布 Apriel-H1 系列模型,成功将 15B 全注意力推理模型蒸馏为 Mamba 混合架构,在保持推理质量的同时实现 2.1 倍吞吐量提升。

    推荐理由:揭示了蒸馏推理模型时选择高质量推理轨迹而非预训练数据的关键洞察,并提供了可复现的分阶段混合架构转换方法。

11月17日周一
  1. Google DeepMind78

    Google DeepMind 发布 WeatherNext 2 气象预报模型

    Google DeepMind 与 Google Research 联合发布最新气象预报模型 WeatherNext 2。该模型生成预报的速度比前代快 8 倍,分辨率提升至小时级,并能从单一输入预测数百种可能的气象情景。

    推荐理由:原文给出了预测速度、分辨率提升及数据开放入口,读者可据此评估其对气象决策和现有工作流的实际改变。

11月13日周四
  1. Google DeepMind65

    Google DeepMind 发布 SIMA 2:具备推理与自我学习能力的虚拟世界智能体

    Google DeepMind 推出新一代通用 AI 智能体 SIMA 2,通过集成 Gemini 模型实现从指令跟随到交互式游戏伙伴的跨越。SIMA 2 具备复杂推理、多模态理解及跨环境泛化能力,能在未训练过的游戏(如 ASKA)和 Genie 3 生成的全新世界中执行任务。该模型还引入了基于试错和反馈的自我改进循环,目前作为有限研究预览向部分学者和游戏开发者开放。

    推荐理由:官方展示了集成 Gemini 推理能力的 SIMA 2 在虚拟世界中的泛化与自我改进机制,为具身智能研究提供了新的技术路径参考。

  2. OpenAI News80

    OpenAI 发布 GPT-5.1 模型

    OpenAI 正式推出 GPT-5.1 模型并开放 API 访问。该版本旨在提供更高的推理速度和更低的成本,同时保持或提升整体智能水平。

    推荐理由:官方直接发布了 GPT-5.1 的 API 接入信息,开发者可据此评估新模型在速度、成本及能力上的具体变化。

11月12日周三
  1. OpenAI News67

    OpenAI 发布新模型

    OpenAI 官方宣布发布新模型。该更新标志着 OpenAI 在前沿模型能力上的进一步演进,具体技术细节和基准表现需参考官方完整公告。

    推荐理由:OpenAI 官方宣布新模型发布,读者可据此了解最新前沿模型的能力变化与可用入口。

10月23日周四
  1. Google Research68

    Google Earth AI 发布新基础模型与地理空间推理智能体

    Google Earth AI 推出新的图像和人口基础模型及基于 Gemini 的地理空间推理智能体,旨在通过跨模态推理解决复杂的行星尺度问题。新模型在多个公开地球观测基准上达到 SOTA,其中文本图像搜索平均提升超 16%,零样本目标检测准确率翻倍。

    推荐理由:原文展示了基础模型与智能体协同在复杂地理空间推理中的性能提升,为开发者提供了评估其解决现实世界问题能力的具体基准。

9月30日周二
  1. OpenAI News78

    OpenAI 发布新模型

    OpenAI 通过其官方新闻渠道发布了一款新模型。该消息源自 OpenAI News RSS 订阅源,发布时间为 2025-09-30。

    推荐理由:OpenAI 官方渠道直接发布了新模型,提供了最权威的一手信息源。

9月4日周四
  1. Hugging Face Blog80

    Google 发布 EmbeddingGemma:面向端侧的高效多语言嵌入模型

    Google DeepMind 发布 EmbeddingGemma,这是一款拥有 308M 参数、支持 100 多种语言的开源多语言文本嵌入模型。该模型基于 Gemma3 架构并采用双向注意力机制,量化后内存占用低于 200 MB,在 MTEB 排行榜上位居同尺寸纯文本模型前列。

    推荐理由:原文展示了308M参数模型在MMTEB上的表现及多框架集成方案,读者可据此评估其在移动端RAG和检索任务中的落地可行性。

8月28日周四
  1. OpenAI News78

    OpenAI 发布新多模态模型

    OpenAI 发布了一款新的多模态模型,支持更直接的语音交互。该模型旨在提升实时对话体验,具体技术细节和性能指标需参考官方文档。

    推荐理由:OpenAI 官方发布了新的多模态模型,提供了更直接的语音交互能力,适合评估其在实时对话场景中的表现。

8月7日周四
  1. OpenAI News73

    OpenAI 在 API 平台推出 GPT-5

    OpenAI 正式在 API 平台推出 GPT-5。该模型具备高推理性能、新的开发者控制功能,并在真实编码任务中提供一流结果。

    推荐理由:官方宣布GPT-5进入API平台,强调高推理性能与开发者控制能力,为评估其在真实编码任务中的表现提供了直接入口。

  2. OpenAI News72

    OpenAI 发布新模型

    OpenAI 通过官方新闻渠道宣布发布一款新模型。该消息由 OpenAI 官方直接发出,标志着其最新技术进展的正式亮相。

    推荐理由:OpenAI 官方渠道直接发布了新模型,提供了最权威的一手信息源,读者可据此获取未经转述的原始更新细节。

8月5日周二
  1. OpenAI News78

    OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 开源权重模型

    OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 两款开源权重语言模型,采用 Apache 2.0 许可证。这两款模型在推理任务上优于同尺寸开源模型,具备强大的工具使用能力,并针对消费级硬件的高效部署进行了优化。

    推荐理由:官方发布了两款开源权重模型,明确了其在推理、工具调用及消费级硬件部署上的性能定位与许可协议。

  2. Hugging Face Blog98

    Hugging Face 欢迎 OpenAI 开源 GPT OSS 模型家族

    OpenAI 发布了名为 GPT OSS 的开源权重模型家族,包含 gpt-oss-120b 和 gpt-oss-20b 两个混合专家(MoE)模型,均采用 MXFP4 量化并遵循 Apache 2.0 许可证。

    推荐理由:原文详细说明了 GPT OSS 的架构特性、量化方案及在主流框架下的本地部署与微调方法,为开发者提供了从云端 API 到端侧运行的完整技术路径。

  3. OpenAI News80

    OpenAI 发布新模型

    OpenAI 官方新闻源发布了一条关于新模型发布的消息,但提供的文本内容仅包含标题和链接,未披露具体的模型名称、版本号或技术细节。

    推荐理由:原文仅包含标题和链接,未提供具体模型名称、版本或能力细节,无法提取有效阅读价值。