跳到正文

全部动态

今日 11 条
12月18日周四
  1. OpenAI News28

    OpenAI 深化与美国能源部合作

    OpenAI 与美国能源部签署谅解备忘录,旨在深化在 AI 和先进计算领域的合作以支持科学发现。该协议建立在双方与国家实验室持续合作的基础上,并为在整个美国能源部生态系统中将 AI 应用于高影响力研究建立了框架。

  2. OpenAI News78

    OpenAI 发布 GPT-5.2-Codex 编程模型

    OpenAI 推出其最先进的编程模型 GPT-5.2-Codex。该模型支持长程推理和大规模代码转换,并增强了网络安全相关能力。

    推荐理由:官方明确该模型具备长程推理、大规模代码转换及增强的网络安全能力,为开发者评估其在复杂工程任务中的表现提供了核心依据。

12月17日周三
  1. Mistral AI60

    Mistral AI 发布 Mistral OCR 3 模型

    Mistral AI 正式发布 Mistral OCR 3,该模型在表单、扫描文档、复杂表格和手写内容上的整体胜率比 Mistral OCR 2 高出 74%。

    推荐理由:Mistral OCR 3 在表单、手写和复杂表格识别上较前代有显著提升,且以极低价格提供 API 服务,适合需要高精度文档解析的开发者评估。

  2. Google DeepMind86

    Google DeepMind 发布 Gemini 3 Flash:兼顾前沿智能与速度

    Google DeepMind 发布 Gemini 3 Flash,旨在以更低成本和更高速度提供接近 Pro 级别的前沿智能。该模型在 GPQA Diamond 得分 90.4%,SWE-bench Verified 得分 78%,比 Gemini 2.5 Pro 快 3 倍且平均少用 30% token。

    推荐理由:原文给出了 Gemini 3 Flash 在多项基准测试中的具体分数、定价及与上一代模型的性能对比,读者可据此评估其在速度与成本平衡上的实际竞争力。

  3. OpenAI News24

    OpenAI 推出面向新闻机构的 OpenAI Academy

    OpenAI 联合 American Journalism Project 和 The Lenfest Institute 推出 OpenAI Academy for News Organizations,旨在帮助新闻机构有效使用 AI。该学习中心提供培训、实际用例及负责任使用指南,支持记者、编辑和出版商在报道与运营中采用 AI。

  4. OpenAI News62

    OpenAI 发布新平台功能

    OpenAI 正式推出新的平台功能,允许开发者在 OpenAI 生态中构建和部署应用。该更新扩展了现有 API 的能力边界,为第三方集成提供了更丰富的工具支持。

    推荐理由:官方宣布新功能上线,开发者可据此评估在 OpenAI 生态中构建应用的新机会。

12月16日周二
  1. Google Research65

    Google Research 推出 Gemini 驱动的 Paper Assistant Tool 为 STOC 2026 提供自动反馈

    Google Research 推出名为 Paper Assistant Tool (PAT) 的实验性工具,利用 Gemini 2.5 Deep Think 为 STOC 2026 的理论计算机科学论文提供提交前的自动反馈。

    推荐理由:原文披露了基于 Gemini 2.5 Deep Think 的 Paper Assistant Tool 在 STOC 2026 的实验数据,展示了 AI 辅助理论计算机科学论文预审核的实际效果与用户反馈。

  2. Hugging Face Blog65

    IBM Research 发布 CUGA 智能体并上线 Hugging Face Spaces 演示

    IBM Research 宣布其开源通用智能体框架 CUGA (Configurable Generalist Agent) 正式集成至 Hugging Face Spaces,并提供在线演示。

    推荐理由:IBM Research 将 CUGA 智能体集成至 Hugging Face Spaces,提供基于 gpt-oss-120b 的可视化演示及 Langflow 低代码支持,便于开发者快速评估其在复杂任务中的表现。

12月13日周六
12月12日周五
12月11日周四
  1. Hugging Face Blog65

    llama.cpp 发布 Model Management 功能支持多模型动态切换

    llama.cpp server 推出 router 模式,允许在不重启服务的情况下动态加载、卸载和切换多个模型。该功能采用多进程架构,每个模型独立运行,单个模型崩溃不影响其他模型。用户可通过自动发现缓存或指定目录来管理 GGUF 文件,并支持按需加载、LRU 驱逐及请求路由,同时提供 Web UI 进行模型切换。

    推荐理由:llama.cpp 新增 router 模式实现多模型动态加载与切换,无需重启服务即可管理本地 LLM。

  2. OpenAI News70

    OpenAI 发布 GPT-5.2:强化科学与数学能力

    OpenAI 发布 GPT-5.2,称其为迄今在数学和科学领域最强的模型。该模型在 GPQA Diamond 和 FrontierMath 等基准测试中创下新的 SOTA 结果。官方展示其能解决开放理论问题并生成可靠的数学证明,推动实际科研进展。

    推荐理由:原文指出GPT-5.2在GPQA Diamond和FrontierMath等基准上刷新纪录,并展示了其在解决开放理论问题和生成可靠数学证明方面的实际科研进展。

  3. Google DeepMind35

    Google DeepMind 深化与英国 AI 安全研究所合作

    Google DeepMind 宣布与英国 AI 安全研究所(AISI)签署新谅解备忘录,将合作从模型测试扩展至基础安全研究。双方将共享专有模型数据,重点开展思维链监控、社会情感影响评估及经济系统模拟等前沿课题。此举旨在通过联合报告与技术协作,提升 Gemini 3 等先进模型的安全性并推动行业进步。

  4. Hugging Face Blog72

    Hugging Face 发布教程:使用 Codex 和 HF Skills 实现端到端开源模型训练

    Hugging Face 发布教程,指导用户通过 HF Skills 仓库配置 OpenAI Codex,使其能够自动完成大语言模型的微调、评估及发布全流程。该方案支持监督微调(SFT)、直接偏好优化(DPO)等生产级方法,Codex 可自动验证数据集格式、根据模型规模选择 GPU 硬件并提交任务至 Hugging Face Jobs。

    推荐理由:展示了如何通过 HF Skills 让 Codex 自动执行从数据验证、硬件选择到模型发布的全流程,为开发者提供了可复用的自动化训练工作流参考。

  5. OpenAI News74

    OpenAI 发布 GPT-5.2 模型

    OpenAI 正式发布 GPT-5.2 模型,定位为面向专业工作的新一代前沿模型。该版本在推理、编码和长上下文理解方面进行了优化,旨在提升复杂任务的处理效率与可靠性。

    推荐理由:OpenAI 官方宣布推出 GPT-5.2,强调其在专业工作场景下的推理与编码能力升级。

12月10日周三
12月9日周二