跳到正文

全部动态

今日 41 条
2月11日周三
2月10日周二
  1. Google DeepMind84

    Google DeepMind 发布两篇论文:Gemini Deep Think 加速数学与科学发现

    Google DeepMind 发布两篇研究论文,展示 Gemini Deep Think 模式在专家指导下解决数学、物理和计算机科学领域专业研究问题的能力。

    推荐理由:原文展示了 Gemini Deep Think 在纯数学、物理和计算机科学领域的具体科研突破案例及人机协作方法论,为评估 AI 在专业科研中的实际能力提供了详实依据。

2月9日周一
  1. Hugging Face Blog82

    Hugging Face 发布 Transformers.js v4:支持 Node/Bun/Deno 及新 WebGPU Runtime

    Hugging Face 正式发布 Transformers.js v4,该版本历时一年开发,现已在 NPM 上线。核心变化包括采用完全用 C++ 重写的 WebGPU Runtime,使模型可在浏览器、Node、Bun 和 Deno 中统一运行,并通过 ONNX Runtime 自定义算子实现最高约 4 倍的推理加速。

    推荐理由:Transformers.js v4 引入全新 WebGPU Runtime 并重构代码库,显著提升了跨环境运行性能与开发体验。

2月6日周五
2月5日周四
2月4日周三
  1. Google Research68

    Google Research 宣布与 Included Health 合作开展全美首个真实世界虚拟护理 AI 随机研究

    Google Research 宣布与 Included Health 合作,启动一项待 IRB 批准的全美前瞻性随机研究,以评估对话式 AI 在真实世界虚拟护理工作流中的表现。

    推荐理由:原文披露了从模拟验证到全美随机对照试验的研究路径,展示了医疗AI在真实临床工作流中评估安全性与效用的具体方法论。

1月30日周五
  1. Google DeepMind78

    Google DeepMind 向美国 AI Ultra 用户推出 Project Genie 交互世界原型

    Google DeepMind 即日起向美国 Google AI Ultra 订阅用户(18+)推出实验性研究原型 Project Genie。该应用由 Genie 3、Nano Banana Pro 和 Gemini 驱动,支持通过文本或图像提示创建、探索及混剪可交互的沉浸式世界,并能在移动时实时生成前方路径。

    推荐理由:官方开放了基于 Genie 3 的交互式世界原型,明确了实时生成路径与物理模拟的能力边界及当前限制。

1月28日周三
  1. Google Research40

    Google Research 提出 ATLAS:面向多语言模型的自适应迁移缩放定律

    Google Research 发布 ATLAS,基于 774 次训练、10M–8B 参数模型及 400+ 种语言数据,提出自适应迁移缩放定律以优化多语言预训练。该研究量化了语言间协同效应,指出支持两倍语言数量需将模型规模扩大 1.18 倍、数据量增加 1.66 倍。ATLAS 为构建者提供了平衡语言混合与模型效率的数据驱动指南,并在 ICLR 2026 展示。

  2. Mistral AI68

    Mistral 发布 Vibe 2.0 终端编码智能体及 Devstral 2 模型更新

    Mistral AI 发布 Mistral Vibe 2.0,这是其终端原生编码智能体的重大升级,由 Devstral 2 模型家族驱动。新版本支持构建自定义子代理、执行前多选项澄清、通过斜杠命令加载技能以及统一代理模式,并包含自动更新功能。

    推荐理由:Mistral Vibe 2.0 引入自定义子代理和斜杠命令技能,配合 Devstral 2 模型升级,为终端原生编码提供了更灵活的工作流配置。

1月27日周二
  1. OpenAI News18

    PVH 采用 ChatGPT Enterprise 重塑时尚未来

    Calvin Klein 和 Tommy Hilfiger 母公司 PVH Corp. 正式采用 ChatGPT Enterprise,将 AI 技术引入时尚设计、供应链管理及消费者互动环节。这一举措标志着传统时尚巨头通过企业级大模型工具加速数字化转型,旨在优化从创意到市场的全链路效率。

1月26日周一
1月24日周六
1月23日周五
1月22日周四
  1. Mistral AI62

    Mistral AI 分享 vLLM 内存泄漏调试深度解析

    Mistral AI 团队发布工程深度剖析文章,记录了在 vLLM 部署 Mistral Medium 3.1 模型时遭遇的内存泄漏排查过程。该问题仅在启用 Prefill/Decode 分离服务和 NIXL 传输时出现,表现为系统内存以每分钟 400 MB 的速度线性增长。

    推荐理由:详细记录了从 Python 层到内核层的内存泄漏排查过程,展示了在复杂依赖栈中定位隐蔽问题的具体工具链与方法。

1月21日周三
1月20日周二
1月18日周日
1月16日周五
  1. OpenAI News60

    OpenAI 宣布在美国市场测试广告业务

    OpenAI 宣布计划在美国市场开始测试广告业务。此举标志着该公司在商业化路径上的重要转变,旨在通过广告收入支持其 AI 服务的持续运营与扩展。

    推荐理由:OpenAI官方宣布将在美国市场测试广告业务,这一商业化转向直接影响其模型服务的成本结构与用户交互体验。