Google DeepMind 发布两篇论文:Gemini Deep Think 加速数学与科学发现
Google DeepMind 发布两篇研究论文,展示 Gemini Deep Think 模式在专家指导下解决数学、物理和计算机科学领域专业研究问题的能力。
推荐理由:原文展示了 Gemini Deep Think 在纯数学、物理和计算机科学领域的具体科研突破案例及人机协作方法论,为评估 AI 在专业科研中的实际能力提供了详实依据。
Google DeepMind 发布两篇研究论文,展示 Gemini Deep Think 模式在专家指导下解决数学、物理和计算机科学领域专业研究问题的能力。
推荐理由:原文展示了 Gemini Deep Think 在纯数学、物理和计算机科学领域的具体科研突破案例及人机协作方法论,为评估 AI 在专业科研中的实际能力提供了详实依据。
OpenAI for Government 宣布在 GenAI.mil 上部署定制版 ChatGPT,为美国国防团队提供安全且注重安全的 AI 服务。
Hugging Face 正式发布 Transformers.js v4,该版本历时一年开发,现已在 NPM 上线。核心变化包括采用完全用 C++ 重写的 WebGPU Runtime,使模型可在浏览器、Node、Bun 和 Deno 中统一运行,并通过 ONNX Runtime 自定义算子实现最高约 4 倍的推理加速。
推荐理由:Transformers.js v4 引入全新 WebGPU Runtime 并重构代码库,显著提升了跨环境运行性能与开发体验。
OpenAI 公布其 AI 本地化方法,旨在将全球共享的前沿模型适配至不同地区的语言、法律及文化环境。该策略强调在实现本地化适配的同时,确保不牺牲模型的安全性。
OpenAI 的 GPT-5 与 Ginkgo Bioworks 云自动化结合,通过闭环实验将无细胞蛋白质合成成本降低 40%。该自主实验室方案展示了大语言模型在生物制造领域的具体应用价值。
OpenAI 正式推出名为 Trusted Access 的网络安全访问计划。该机制旨在通过建立可信身份验证流程,在加强防御措施的同时,为合规用户提供必要的模型能力以应对网络威胁。
Google Research 推出 Natively Adaptive Interfaces (NAI) 框架,通过多模态 AI 将静态导航转化为动态、代理驱动的模块。该方案利用 Gemini 处理语音、视觉和文本,构建出 StreetReaderAI 等原型,实现实时交互式音频描述与环境查询。
OpenAI 发布名为 Frontier 的企业级平台,用于构建和管理具备共享上下文能力的 AI 智能体。该平台支持团队在统一环境中进行智能体的部署与协作。
OpenAI 发布 GPT-5.3-Codex,这是一款专为 Codex 设计的智能体模型。它将前沿编码性能与通用推理相结合,旨在支持长周期的真实世界技术工作。
推荐理由:官方明确该模型专为 Codex 设计,结合前沿编码与通用推理以支持长周期技术工作。
OpenAI 发布 GPT-5.3-Codex,称其为迄今最强大的智能体编码模型。该模型结合了 GPT-5.2-Codex 的前沿编码性能与 GPT-5.2 的推理及专业知识能力。
Mistral AI 发布 Voxtral Transcribe 2,包含面向批量处理的 Voxtral Mini Transcribe V2 和面向实时应用的 Voxtral Realtime。
推荐理由:官方发布了具备超低延迟和说话人分离能力的新一代语音转文字模型,其中实时版以 Apache 2.0 协议开源,提供了具体的性能基准和定价信息。
Google Research 推出 Sequential Attention,利用贪心选择与注意力评分在单次训练中实现自适应子集选择。该方法解决了特征选择的 NP-hard 难题,在多个神经网络基准测试中达到 SOTA 效果,显著降低训练开销并提升模型效率与可解释性。
OpenAI 推出 Codex App Server,这是一个基于 JSON-RPC 的双向通信服务器,旨在让客户端应用与 Codex agent 进行交互。该服务器支持流式响应、工具调用审批以及会话管理,允许开发者构建自定义界面来驱动 Codex agent 执行编程任务。通过这一组件,用户可以将 Codex 的能力嵌入到 IDE、Web 应用或其他工作流中,实现更灵活的代码生成与修改体验。
推荐理由:官方披露了 Codex App Server 的架构细节,开发者可据此评估如何集成其双向通信与工具调用能力。
Google Research 宣布与 Included Health 合作,启动一项待 IRB 批准的全美前瞻性随机研究,以评估对话式 AI 在真实世界虚拟护理工作流中的表现。
推荐理由:原文披露了从模拟验证到全美随机对照试验的研究路径,展示了医疗AI在真实临床工作流中评估安全性与效用的具体方法论。
H Company 推出最大规模 UI 本地化模型 Holo2-235B-A22B Preview,在 Screenspot-Pro 和 OSWorld G 上分别取得 78.5% 和 79.0% 的 SOTA 成绩。该模型通过 Agentic Localization 迭代优化预测,相比单步推理提升 10-20% 准确率。目前已在 Hugging Face 开放研究版本供下载。
Sora 信息流旨在激发创造力、促进连接并保障体验安全。其核心功能包括个性化推荐、家长控制及严格的安全护栏,以构建用户友好的内容分发环境。
OpenAI 与 Snowflake 达成一项价值 2 亿美元的合作伙伴关系,旨在将前沿智能直接引入企业数据环境。该合作允许在 Snowflake 平台内构建 AI 智能体并获取洞察,从而提升企业数据处理与分析能力。
OpenAI 正式推出适用于 macOS 的 Codex 应用程序。该应用旨在作为软件开发的指挥中心,提供统一的界面来管理多个并行运行的编程智能体任务。
OpenAI 封禁了与 Rybar 网络相关的账户,该网络部分源自俄罗斯。这些账户利用 AI 技术在多语言网站和社交平台上支持影响力活动。
OpenAI 封禁了与名为“Trolling Stone”的未公开影响力行动相关的账号。该行动利用 AI 生成关于阿根廷一名涉嫌俄罗斯邪教头目被捕的评论。
OpenAI 封禁了极可能源自柬埔寨的账号,这些账号利用 AI 伪装成恢复服务、律师事务所及执法机构。其目标直指遭受欺诈侵害的人群,旨在通过虚假身份实施进一步诈骗或误导。
OpenAI 封禁了极可能源自柬埔寨的账户,这些账户利用 AI 对印尼用户实施“Date Bait”诈骗。其手段包括使用 AI 进行翻译和互动以诱导受害者。
OpenAI 发布了关于平台安全治理的最新动态。该消息源自 OpenAI News 官方渠道,具体涉及对违规内容的处置或政策更新细节需参考原文完整内容。
OpenAI 封禁了利用 AI 支持浪漫诈骗工作流的账户,涵盖外联、翻译、受害者互动及投资欺诈诱饵等环节。此举旨在打击通过自动化手段实施的情感操控与金融诈骗行为。
OpenAI 封禁了一个与中国执法人员有关联的账户。该账户被用于策划影响力活动、骚扰及在线操作。
Google DeepMind 即日起向美国 Google AI Ultra 订阅用户(18+)推出实验性研究原型 Project Genie。该应用由 Genie 3、Nano Banana Pro 和 Gemini 驱动,支持通过文本或图像提示创建、探索及混剪可交互的沉浸式世界,并能在移动时实时生成前方路径。
推荐理由:官方开放了基于 Genie 3 的交互式世界原型,明确了实时生成路径与物理模拟的能力边界及当前限制。
OpenAI 构建了一个内部 AI 数据智能体,利用 GPT-5、Codex 和记忆功能对海量数据集进行推理。该智能体能够在几分钟内提供可靠的洞察结果。
Taisei Corporation 人力资源团队正在推广 ChatGPT Enterprise,以推动组织内的人工智能驱动人才培养。该举措旨在通过 AI 技术赋能员工发展,提升企业整体人才竞争力。
OpenAI 宣布将于 2026 年 2 月 13 日在 ChatGPT 中正式停用 GPT-4o、GPT-4.1、GPT-4.1 mini 和 OpenAI o4-mini。此次调整与此前公布的 GPT-5(Instant、Thinking 和 Pro)版本退役计划同步进行。目前 API 接口不受影响,暂无相关变更。
Google Research 发布新论文《Towards a Science of Scaling Agent Systems》,挑战“更多智能体更好”的假设,提出首个量化扩展原则。
推荐理由:通过180种配置的大规模评估,量化了多智能体系统在并行与串行任务中的性能差异及错误放大机制。
OpenAI 推出欧盟经济蓝图 2.0,旨在通过新数据、合作伙伴关系及倡议加速欧洲范围内的 AI 采用、技能提升与经济增长。该计划聚焦于推动 AI 技术在欧洲的普及与应用,以支持区域经济发展。
OpenAI 推出 EMEA Youth & Wellbeing Grant,提供 €500,000 资金资助 NGO 和研究者。该计划旨在支持 AI 时代下的青年安全与福祉项目。
OpenAI 介绍其内置安全措施,防止 AI Agent 在打开链接时发生基于 URL 的数据外泄和提示词注入。该机制旨在保护用户数据,确保智能体在处理外部链接时的安全性。
Google Research 发布 ATLAS,基于 774 次训练、10M–8B 参数模型及 400+ 种语言数据,提出自适应迁移缩放定律以优化多语言预训练。该研究量化了语言间协同效应,指出支持两倍语言数量需将模型规模扩大 1.18 倍、数据量增加 1.66 倍。ATLAS 为构建者提供了平衡语言混合与模型效率的数据驱动指南,并在 ICLR 2026 展示。
Mistral AI 发布 Mistral Vibe 2.0,这是其终端原生编码智能体的重大升级,由 Devstral 2 模型家族驱动。新版本支持构建自定义子代理、执行前多选项澄清、通过斜杠命令加载技能以及统一代理模式,并包含自动更新功能。
推荐理由:Mistral Vibe 2.0 引入自定义子代理和斜杠命令技能,配合 Devstral 2 模型升级,为终端原生编码提供了更灵活的工作流配置。
Calvin Klein 和 Tommy Hilfiger 母公司 PVH Corp. 正式采用 ChatGPT Enterprise,将 AI 技术引入时尚设计、供应链管理及消费者互动环节。这一举措标志着传统时尚巨头通过企业级大模型工具加速数字化转型,旨在优化从创意到市场的全链路效率。
TRUSTBANK 与 Recursive 合作,基于 OpenAI 模型构建了名为 Choice AI 的系统。该工具通过个性化对话推荐简化了日本“故乡税”(Furusato Nozei)礼品的发现过程。
OpenAI 发布 Prism,这是一个内置 GPT-5.2 模型的免费 LaTeX 原生工作区。该工具旨在帮助研究人员在一个平台内完成写作、协作与推理任务。
Indeed 首席营收官 Maggie Hulce 分享 AI 如何变革求职、招聘及雇主的人才获取流程。该观点旨在说明人工智能技术正在重塑求职者与雇主之间的互动方式,提升人才匹配效率。
Google Research 在 NeurIPS 2025 提出 GIST(Greedy Independent Set Thresholding)算法,通过平衡数据多样性与效用解决大规模数据集子集选择难题。该算法采用双准则贪心策略近似求解最大独立集问题,在图像分类等任务中超越 SOTA 基准,并提供解质量的数学保证。