跳到正文

#Anthropic

今日 3 条
今天10月2日周五
  1. AWS Machine Learning Blog28

    Amazon Bedrock 在首尔和新加坡推出 Anthropic Claude Opus 5 与 Sonnet 5 的区域内部推理

    Amazon Bedrock 在首尔支持 Claude Opus 5 和 Sonnet 5,在新加坡支持 Sonnet 5,提供区域内部推理。请求数据全程保留在指定 AWS Region 内,满足金融、医疗等行业的严格数据驻留要求。开发者可通过 bedrock-runtime 端点调用 Anthropic Messages API 或 InvokeModel/Converse API 集成模型。

9月29日周二
  1. AWS Machine Learning Blog65

    AWS 宣布 Claude Sonnet 5.5 上线 Amazon Bedrock

    AWS 宣布 Claude Sonnet 5.5 正式在 Amazon Bedrock 和 Claude Platform on AWS 上可用。该模型针对聚焦编码和知识工作进行了优化,具备更低的任务成本和更快的速度,并支持与 Opus 5.5 搭配使用以平衡判断力与执行效率。

    推荐理由:原文给出了 Sonnet 5.5 在 AWS 上的具体能力改进、与 Opus 5.5 的搭配策略以及代码调用示例,有助于评估其在企业级工作流中的落地成本。

8月19日周三
  1. Hugging Face Blog62

    IBM Research 提出 ALTK-Evolve 智能体记忆剂量校准方法

    IBM Research 发布关于 ALTK-Evolve 智能体记忆机制的研究,指出向上下文注入自蒸馏指南的效果取决于模型能力层级,需进行剂量校准而非简单累积。

    推荐理由:原文通过八模型对比实验,揭示了智能体记忆注入剂量需随模型能力校准,为低成本提升任务完成率提供了具体策略。

7月30日周四
3月27日周五
8月19日周二
2月2日周五
  1. Hugging Face Blog33

    Hugging Face 上线 NPHardEval 排行榜:基于复杂度类评估 LLM 推理能力

    Hugging Face 推出 NPHardEval 排行榜,利用密歇根大学等研发的基准测试大语言模型推理能力。该基准包含900道算法题,涵盖P、NP-complete及NP-hard复杂度类,并每月动态更新以防止过拟合。实验显示GPT 4 Turbo整体表现最佳,Claude 2在NP-complete问题上领先,Yi-34b等开源模型亦具竞争力。