OpenAI 封禁冒充执法机构的虚假恢复服务账号
OpenAI 封禁了极可能源自柬埔寨的账号,这些账号利用 AI 伪装成恢复服务、律师事务所及执法机构。其目标直指遭受欺诈侵害的人群,旨在通过虚假身份实施进一步诈骗或误导。
OpenAI 封禁了极可能源自柬埔寨的账号,这些账号利用 AI 伪装成恢复服务、律师事务所及执法机构。其目标直指遭受欺诈侵害的人群,旨在通过虚假身份实施进一步诈骗或误导。
OpenAI 封禁了极可能源自柬埔寨的账户,这些账户利用 AI 对印尼用户实施“Date Bait”诈骗。其手段包括使用 AI 进行翻译和互动以诱导受害者。
OpenAI 发布了关于平台安全治理的最新动态。该消息源自 OpenAI News 官方渠道,具体涉及对违规内容的处置或政策更新细节需参考原文完整内容。
OpenAI 封禁了利用 AI 支持浪漫诈骗工作流的账户,涵盖外联、翻译、受害者互动及投资欺诈诱饵等环节。此举旨在打击通过自动化手段实施的情感操控与金融诈骗行为。
OpenAI 封禁了一个与中国执法人员有关联的账户。该账户被用于策划影响力活动、骚扰及在线操作。
Google DeepMind 即日起向美国 Google AI Ultra 订阅用户(18+)推出实验性研究原型 Project Genie。该应用由 Genie 3、Nano Banana Pro 和 Gemini 驱动,支持通过文本或图像提示创建、探索及混剪可交互的沉浸式世界,并能在移动时实时生成前方路径。
推荐理由:官方开放了基于 Genie 3 的交互式世界原型,明确了实时生成路径与物理模拟的能力边界及当前限制。
OpenAI 构建了一个内部 AI 数据智能体,利用 GPT-5、Codex 和记忆功能对海量数据集进行推理。该智能体能够在几分钟内提供可靠的洞察结果。
Taisei Corporation 人力资源团队正在推广 ChatGPT Enterprise,以推动组织内的人工智能驱动人才培养。该举措旨在通过 AI 技术赋能员工发展,提升企业整体人才竞争力。
Hugging Face 推出开源 Python 库 Daggr,允许开发者通过代码构建连接 Gradio 应用、ML 模型和自定义函数的 AI 工作流。该工具自动生成交互式可视化画布,支持检查中间输出、单独重跑步骤及管理状态,旨在解决复杂管道调试难的问题。
推荐理由:原文介绍了 Daggr 如何通过代码定义工作流并自动生成可视化画布,为开发者提供了调试多步 AI 管道的轻量级方案。
OpenAI 宣布将于 2026 年 2 月 13 日在 ChatGPT 中正式停用 GPT-4o、GPT-4.1、GPT-4.1 mini 和 OpenAI o4-mini。此次调整与此前公布的 GPT-5(Instant、Thinking 和 Pro)版本退役计划同步进行。目前 API 接口不受影响,暂无相关变更。
Google Research 发布新论文《Towards a Science of Scaling Agent Systems》,挑战“更多智能体更好”的假设,提出首个量化扩展原则。
推荐理由:通过180种配置的大规模评估,量化了多智能体系统在并行与串行任务中的性能差异及错误放大机制。
OpenAI 推出欧盟经济蓝图 2.0,旨在通过新数据、合作伙伴关系及倡议加速欧洲范围内的 AI 采用、技能提升与经济增长。该计划聚焦于推动 AI 技术在欧洲的普及与应用,以支持区域经济发展。
OpenAI 推出 EMEA Youth & Wellbeing Grant,提供 €500,000 资金资助 NGO 和研究者。该计划旨在支持 AI 时代下的青年安全与福祉项目。
OpenAI 介绍其内置安全措施,防止 AI Agent 在打开链接时发生基于 URL 的数据外泄和提示词注入。该机制旨在保护用户数据,确保智能体在处理外部链接时的安全性。
Hugging Face 推出 `upskill` 工具,通过让 Claude Opus 4.5 等前沿模型解决复杂任务(如编写 CUDA kernels)来生成 Agent Skills,并将这些技能文件迁移给更便宜或本地的开源模型使用。
推荐理由:原文演示了利用大模型生成 CUDA 内核技能并迁移至小模型的完整流程,提供了可复用的 upskill 工具链与评估方法。
Google Research 发布 ATLAS,基于 774 次训练、10M–8B 参数模型及 400+ 种语言数据,提出自适应迁移缩放定律以优化多语言预训练。该研究量化了语言间协同效应,指出支持两倍语言数量需将模型规模扩大 1.18 倍、数据量增加 1.66 倍。ATLAS 为构建者提供了平衡语言混合与模型效率的数据驱动指南,并在 ICLR 2026 展示。
Mistral AI 发布 Mistral Vibe 2.0,这是其终端原生编码智能体的重大升级,由 Devstral 2 模型家族驱动。新版本支持构建自定义子代理、执行前多选项澄清、通过斜杠命令加载技能以及统一代理模式,并包含自动更新功能。
推荐理由:Mistral Vibe 2.0 引入自定义子代理和斜杠命令技能,配合 Devstral 2 模型升级,为终端原生编码提供了更灵活的工作流配置。
中国开源社区在DeepSeek R1后普遍转向MoE架构,Kimi K2、MiniMax M2及Qwen3等模型借此平衡性能与成本。StepFun和腾讯推动多模态竞争,Apache 2.0成为主流许可。DeepSeek-V3.2-Exp实现华为昇腾与寒武纪芯片Day-zero支持,蚂蚁Ling模型在国产芯片上训练成本降低约20%。
Hugging Face 团队推出 Alyah 基准,专门评估阿拉伯大语言模型对阿联酋方言的语言、文化及语用理解能力。该数据集包含 1,173 个由母语者手工收集的样本,涵盖问候、诗歌及历史知识等类别。研究测试了 54 个模型,结果显示 google/gemma-3-27b-pt 在基础模型中表现最佳,准确率达 74.68%。
Calvin Klein 和 Tommy Hilfiger 母公司 PVH Corp. 正式采用 ChatGPT Enterprise,将 AI 技术引入时尚设计、供应链管理及消费者互动环节。这一举措标志着传统时尚巨头通过企业级大模型工具加速数字化转型,旨在优化从创意到市场的全链路效率。
Hugging Face 团队验证了 GPT-OSS 在智能体强化学习中的适用性,指出其此前仅用于无工具调用的微调。实验发现 MoE 架构下的双前向传播导致对数概率不匹配,引发 KL 散度爆炸。通过修复 PPO 在线策略完整性,该方案成功支持 GPT-OSS-20B 及 120B 模型进行多步交互训练。
TRUSTBANK 与 Recursive 合作,基于 OpenAI 模型构建了名为 Choice AI 的系统。该工具通过个性化对话推荐简化了日本“故乡税”(Furusato Nozei)礼品的发现过程。
OpenAI 发布 Prism,这是一个内置 GPT-5.2 模型的免费 LaTeX 原生工作区。该工具旨在帮助研究人员在一个平台内完成写作、协作与推理任务。
Indeed 首席营收官 Maggie Hulce 分享 AI 如何变革求职、招聘及雇主的人才获取流程。该观点旨在说明人工智能技术正在重塑求职者与雇主之间的互动方式,提升人才匹配效率。
Google Research 在 NeurIPS 2025 提出 GIST(Greedy Independent Set Thresholding)算法,通过平衡数据多样性与效用解决大规模数据集子集选择难题。该算法采用双准则贪心策略近似求解最大独立集问题,在图像分类等任务中超越 SOTA 基准,并提供解质量的数学保证。
Codex CLI 通过 Responses API 协调模型、工具与提示词,实现智能体循环。该机制详细说明了如何编排上述组件以优化性能表现。
Google Research 在 EMNLP 2025 发表研究,提出通过分解屏幕摘要与意图提取两阶段流程,使小多模态大语言模型实现设备端用户意图理解。该方法在 Gemini 和 Qwen2 基座模型上验证,其中 Gemini 1.5 Flash 8B 以更低成本和速度达到接近 Gemini 1.5 Pro 的性能表现。
OpenAI 通过副本、缓存、限流和工作负载隔离技术,将 PostgreSQL 数据库扩展至每秒数百万次查询,以支撑 8 亿 ChatGPT 用户的并发需求。
OpenAI 发布数据驱动报告,揭示各行业员工使用 ChatGPT(基于 GPT-5)的现状。内容涵盖采用趋势、高频任务及部门模式,并探讨 AI 在工作中的未来。
Praktika 使用 GPT-4.1 和 GPT-5.2 构建自适应 AI 导师,通过个性化课程、进度追踪帮助学习者实现真实场景下的语言流利度。
Mistral AI 团队发布工程深度剖析文章,记录了在 vLLM 部署 Mistral Medium 3.1 模型时遭遇的内存泄漏排查过程。该问题仅在启用 Prefill/Decode 分离服务和 NIXL 传输时出现,表现为系统内存以每分钟 400 MB 的速度线性增长。
推荐理由:详细记录了从 Python 层到内核层的内存泄漏排查过程,展示了在复杂依赖栈中定位隐蔽问题的具体工具链与方法。
Higgsfield 利用 OpenAI 的 GPT-4.1、GPT-5 和 Sora 2,将用户的简单输入转化为具有电影质感的社交优先视频。该方案旨在帮助创作者高效生成符合社交媒体传播特性的视觉内容。
Hugging Face 推出 AssetOpsBench,专为工业资产管理场景设计,包含 2.3M 传感器遥测点、140+ 场景及 53 种结构化故障模式。该基准通过六个定性维度评估多智能体协作能力,重点考察决策轨迹质量与故障意识。其 TrajFM 管道结合 LLM 推理与统计聚类,自动发现并分析代理执行中的失败模式,提供可解释的反馈以优化工业 AI 智能体表现。
OpenAI 发布新计划“Edu for Countries”,旨在协助各国政府利用 AI 现代化教育体系并培养面向未来的劳动力。
OpenAI 最新报告揭示各国在先进 AI 采用上的显著差异,并提出新举措帮助国家获取 AI 带来的生产力收益。
OpenAI 与盖茨基金会联合启动 Horizon 1000 试点项目,旨在通过人工智能提升非洲基层医疗服务能力。该计划投入 5000 万美元,目标是在 2028 年前覆盖 1,000 家诊所。
OpenAI 公布 Stargate Community 计划,采用社区优先的 AI 基础设施策略。该计划依据社区反馈、能源需求及劳动力优先级制定本地化方案。
Hugging Face 发布博客回顾 DeepSeek R1 推出一年以来对中国及全球开源 AI 生态的影响。R1 通过 MIT 许可和开放推理路径降低了技术、采用和心理三重壁垒,促使百度、字节等大厂大幅增加开源发布,并将竞争焦点从单一模型性能转向生态系统与基础设施。数据显示,2025 年中国新创模型的下载量已超越美国,且西方社区在寻求商业部署替代方案时,也频繁基于或参考中国开源模型进行开发。
ServiceNow 扩展对 OpenAI 前沿模型的访问权限,以驱动企业级 AI 工作流。该集成覆盖摘要、搜索及语音功能,旨在提升 ServiceNow Platform 的智能化处理能力。
Microsoft 推出 Differential Transformer V2,通过增加查询头数量但保持键值头不变,实现与标准 Transformer 相当的解码速度且无需自定义内核。该版本移除了导致数值不稳定的逐头 RMSNorm,并采用每 token 每头的 λ 投影以消除注意力汇聚现象。