跳到正文

#部署/工程

今日 3 条
今天10月2日周五
  1. TechCrunch · AI73

    谷歌称Starship需发射1800次才能支撑太空数据中心

    谷歌发射首颗搭载Tensor Processing Unit (TPU)的轨道计算卫星,并发表关于轨道数据中心的同行评审论文。该研究指出,为实现具有成本效益的太空数据中心,SpaceX的Starship火箭需在十年内完成约1800次发射,将每公斤发射成本降至200美元左右。谷歌认为其芯片能在太空中承受辐射并处理推理负载,但大规模训练仍面临挑战。

  2. AWS Machine Learning Blog42

    AWS 使用上下文多臂老虎机优化 Amazon Payments 转化漏斗

    Amazon Payments 在 Amazon SageMaker AI 上部署多目标上下文多臂老虎机(MAB)以个性化产品获取漏斗。七周 A/B 测试显示,特定客户群体最终转化率提升高个位数百分比,但另一群体无改善,表明瓶颈在于内容而非模型。该方案采用 LinUCB 算法,基于行为信号向量进行实时决策与探索平衡。

10月1日周四
  1. AWS Machine Learning Blog25

    uniopen 定制 Amazon Nova 2 Lite 实现零售内容审核生产部署

    uniopen 通过监督微调将 Amazon Nova 2 Lite 适配至其零售审核策略,并在 Amazon SageMaker AI 中完成训练与部署。该方案结合提示词优化,在包含 737 个对话窗口的测试集上评估行为分类与主体识别性能。架构采用人工验证反馈闭环,利用硬/软门控机制控制模型晋升,确保生产环境下的合规性与稳定性。

9月29日周二
9月23日周三
9月10日周四
8月11日周二
  1. Mistral AI50

    Mistral 推出区域推理端点、优先层级并支持 GLM-5.2 等第三方开源模型

    Mistral 正式推出 Mistral Regional Endpoints 和处于公开预览阶段的 Mistral Priority Tier,提供欧洲或美国区域选择及 SLA 保障。平台开始支持 Z.ai 的 GLM-5.2 等第三方开源模型,使其运行于相同的区域控制与服务承诺下。Mistral 还组建联盟锁定长期算力,计划到 2030 年建成高达 1 GW 容量以强化 AI 主权。

7月29日周三
  1. Berkeley AI Research62

    Berkeley AI Research 提出 K-Search MLX 后端实现 CUDA 到 Apple Silicon 的内核优化迁移

    Berkeley AI Research 与 IBM Research 合作扩展了 K-Search 框架,新增 MLX 后端以自动将 CUDA 内核优化知识迁移至 Apple Silicon。

    推荐理由:原文展示了通过结构化翻译层将 CUDA 内核知识迁移至 Apple Silicon 的方法,并给出了在 Attention 和 Mamba SSM 内核上的具体性能提升数据。