Hugging Face 披露 Spaces 密钥泄露事件并实施安全整改
Hugging Face 团队检测到对 Spaces 平台的未授权访问,怀疑部分 Spaces secrets 被非法获取。作为补救第一步,官方已撤销相关 HF tokens 并通知受影响用户,建议刷新密钥并切换至新的默认细粒度访问令牌。
推荐理由:Hugging Face 披露 Spaces 密钥泄露事件及补救措施,用户需立即轮换令牌并启用细粒度访问权限以保障账户安全。
Hugging Face 团队检测到对 Spaces 平台的未授权访问,怀疑部分 Spaces secrets 被非法获取。作为补救第一步,官方已撤销相关 HF tokens 并通知受影响用户,建议刷新密钥并切换至新的默认细粒度访问令牌。
推荐理由:Hugging Face 披露 Spaces 密钥泄露事件及补救措施,用户需立即轮换令牌并启用细粒度访问权限以保障账户安全。
OpenAI 终止了与隐蔽影响行动相关的账户,并指出其服务未导致受众显著增加。此举旨在破坏利用 AI 进行的欺骗性活动,防止相关操作通过平台扩大影响力。
OpenAI 启动新举措以提升其工具在非营利组织中的可访问性。该计划为 ChatGPT Team 和 Enterprise 提供折扣费率。
OpenAI 推出一项面向大学的平价服务,旨在帮助高校负责任地将 AI 引入校园。该方案专注于提供可负担的接入方式,支持教育机构在合规前提下部署人工智能技术。
Mistral AI 推出其首个专为代码生成设计的开放权重模型 Codestral。该模型参数量为 22B,支持 80 多种编程语言,拥有 32k 上下文窗口,并在 RepoBench 等长程代码生成评测中表现优于竞品。
推荐理由:官方详细披露了 Codestral 的架构参数、多语言支持及基准测试数据,并明确了非生产许可与商业授权路径,为开发者评估其实际编码能力提供了完整依据。
MavenAGI 推出基于 GPT-4 的 AI 客服智能体,Tripadvisor、Clickup 和 Rho 等公司已开始使用。该方案旨在帮助企业节省时间并提升客户服务体验。
Mistral AI 正式推出 Mistral AI 非生产许可证(MNPL),允许开发者将技术用于非商业目的及支持研究工作。该举措旨在平衡开源理念与商业可持续性,确保基于其模型构建业务的企业能公平贡献于公司的研发与独立发展。
推荐理由:Mistral AI 官方宣布推出非生产许可证 MNPL,明确了其模型在商业与非商业用途下的授权边界。
The Atlantic 宣布与 OpenAI 建立战略内容与产品合作伙伴关系,正式成为其平台内的优质新闻源。The Atlantic 的文章将在 ChatGPT 等 OpenAI 产品中可被检索发现。作为合作伙伴,The Atlantic 还将协助塑造未来实时发现产品中新闻的呈现方式。
OpenAI 与 Vox Media 达成多层面协议,Vox 内容将用于增强 ChatGPT 输出。Vox Media 还将基于 OpenAI 技术开发新产品,以更好地服务其受众和广告商。
Hugging Face 发布 Text Generation Inference (TGI) 的配套基准测试工具,旨在超越单纯吞吐量指标,帮助开发者通过权衡延迟与吞吐来调优 LLM 部署。该工具支持在 Hugging Face Space 中运行,提供预填充统计及 TTFT、Latency 等关键性能可视化分析,适用于不同用户场景下的推理服务优化。
Hugging Face 发布 Sentence Transformers 库中嵌入模型的微调与训练指南,详解数据集、损失函数、训练参数及评估器等核心组件。文章演示了如何使用 SentenceTransformerTrainer 进行单数据集及多数据集混合训练,并介绍了自动生成的模型卡片功能以记录训练细节和评估结果。
Meta 推出开源基准测试框架 CyberSecEval 2,用于评估 LLM 在代码解释器滥用、攻击性能力及提示注入方面的安全风险。数据显示,自 2023 年 12 月首版以来,LLM 协助网络攻击的平均合规率已从 52% 降至 28%,但提示注入防御仍是未解难题。
TII 发布 Falcon 2 系列新模型,包含 11B 参数的基础大语言模型(LLM)和支持图像理解的视觉语言模型(VLM)。
推荐理由:原文给出了11B参数模型的训练数据规模、架构细节及在英语和多语言基准上的具体评测分数,读者可据此评估其性能与开源可用性。
OpenAI 与 News Corp 建立多年全球合作伙伴关系。双方将利用 News Corp 的优质新闻内容丰富 OpenAI 的生成式 AI 产品和平台。
Hugging Face 宣布支持在 AWS Inferentia2 上部署超过 10 万个模型,新增 14 种架构和 6 类任务。Inference Endpoints 推出 Inf2-small($0.75/小时)和 Inf2-xlarge($12/小时)实例,适配 Llama 3 8B 与 70B。
OpenAI 阐述其安全实践,强调通用人工智能(AGI)虽能惠及生活各方面,但必须负责任地开发与部署。
Hugging Face 与 AMD 合作,使 AMD Instinct MI300 GPU 在 Hugging Face 平台获得一等公民集成。用户无需修改代码即可通过 transformers 和 text-generation-inference (TGI) 部署模型。
Hugging Face Spaces 发布 Dev Mode,允许开发者通过 VS Code 或 SSH 直接连接并编辑代码,无需 git push。该功能目前处于 beta 阶段,仅对 PRO 订阅用户开放。
Hugging Face 与 Microsoft 在 Azure Model Catalog 中新增 Llama 3、Mistral 7B 等开源大模型,支持一键部署。双方还推出基于 AMD MI300X 的 Azure VM 优化方案,并在 VS Code 中集成 Hugging Face Spaces Dev Mode(Beta)。
Hugging Face 与 Dell 联合发布 Dell Enterprise Hub,将开源大语言模型的本地训练与部署时间从数周缩短至几分钟。该中心提供 Llama 3、Mixtral 和 Gemma 等模型,支持通过脚本自动部署为 API 端点,并兼容 OpenAI Messages API。
OpenAI 与行业顶尖选角及导演专家合作,从超过 400 份提交中筛选出 ChatGPT 的 5 种语音。
ChatGPT 升级数据分析功能,支持用户直接交互表格和图表。新增从 Google Drive 和 Microsoft OneDrive 添加文件的能力,简化数据导入流程。
OpenAI 宣布与 Reddit 建立合作关系,将把 Reddit 的独特内容引入 ChatGPT 及 OpenAI 的其他产品中。
Canva 正在构建由 AI 驱动的 Magic Studio。该平台月活跃用户超 1.75 亿,旨在通过易用界面、海量素材库及省时工具,帮助缺乏设计训练的知识工作者轻松制作演示文稿、视频和社交媒体图形等视觉内容。
Hugging Face 在 Transformers 库中推出了 KV Cache 量化功能,通过降低键值缓存的精度来显著减少长文本生成的内存占用。该功能支持 int2、int4 和 int8 精度,其中 int4 量化在几乎不损失模型质量的情况下可实现约 2.5 倍的显存节省。
OpenAI 官方新闻页面标题显示,Ilya Sutskever 将离开 OpenAI,Jakub Pachocki 被任命为首席科学家。由于正文抓取失败,目前仅能确认这一人事变动信息。
Hugging Face 与 LangChain 联合推出 `langchain_huggingface` Python 包,旨在将 Hugging Face 生态最新功能同步至 LangChain。
谷歌推出开源视觉语言模型家族 PaliGemma,采用 SigLIP-So400m 作为图像编码器、Gemma-2B 作为文本解码器。该模型支持图像与文本输入并输出文本,提供预训练(PT)、混合任务微调(Mix)及特定基准微调(FT)三类检查点,涵盖 224x224、448x448、896x896 三种分辨率及多种精度格式。
推荐理由:原文详细拆解了PaliGemma的架构组成与推理流程,并提供了基于Transformers的微调代码示例,适合开发者快速上手该开源视觉语言模型。
Hugging Face 推出 Open Arabic LLM Leaderboard (OALL),旨在评估阿拉伯语大语言模型性能,服务全球超 3.8 亿使用者。该榜单整合 AlGhafa、ACVA 等基准数据集,采用归一化对数似然准确率作为核心指标,并基于 lighteval 库实现开箱即用的评测支持。
OpenAI 正式发布 GPT-4o(GPT-4 Omni),这是一款能够同时处理文本、音频和图像输入并生成相应输出的新旗舰模型。该模型旨在实现更自然的人机交互体验,支持实时语音对话及高级视觉分析功能。
推荐理由:OpenAI 官方宣布 GPT-4o 发布,强调其作为旗舰模型在音频、视觉和文本处理上的原生多模态能力。
OpenAI 官方宣布发布新模型。具体型号及能力细节未在标题中明确展示。
推荐理由:OpenAI 官方宣布新模型发布,提供了最权威的一手信息源。
OpenAI 于 2024-05-13 通过官方新闻源发布新模型,具体型号及能力细节未在标题中披露。
Hugging Face 发布 Transformers Agents 2.0,引入基于过去观察迭代解决复杂任务的新智能体类型,并将该模块升级为独立库 smolagents。新框架强调代码清晰性与模块化,支持社区共享选项,实测显示基于 Llama-3-70B-Instruct 的智能体在 GAIA Leaderboard 上超越了多个 GPT-4 基线智能体。
推荐理由:官方展示了新框架在GAIA基准测试中超越GPT-4智能体的实测数据,并提供了从Transformers迁移到独立库smolagents的清晰路径。
Hugging Face 现允许用户通过 AWS Marketplace 将组织升级为 Enterprise Hub。该高级订阅提供单点登录、GDPR 合规存储区域及 NVIDIA DGX Cloud 训练等安全与协作功能。升级后计费直接由 AWS 账户管理,价格与公开定价一致。
Intel 利用 OPEA 平台,结合 LangChain、BAAI/bge-base-en-v1.5 嵌入模型及 Redis,在 Granite Rapids CPU 和 Gaudi 2 加速器上部署企业级 RAG 应用。
OpenAI 发布关于数据与 AI 处理方法的说明,并推出面向创作者和内容所有者的新工具 Media Manager。该举措旨在回应 ChatGPT 上线一年多以来引发的关于 AI 时代数据的重要讨论。
OpenAI 推出新技术以协助研究人员识别由其工具生成的内容,并正式加入“内容来源与真实性联盟”(C2PA)指导委员会。此举旨在推动建立行业通用的数字内容溯源标准,增强网络信息的透明度与可信度。
OpenAI 与 Stack Overflow 宣布建立新的 API 合作伙伴关系。该合作旨在结合 Stack Overflow 作为全球领先技术知识平台的优势与 OpenAI 最流行的 LLM 模型,共同赋能开发者进行 AI 开发。
Hugging Face 发布首个专门评估希伯来语大语言模型的开放排行榜,旨在解决该低资源语言缺乏针对性基准的问题。该榜单包含问答、情感分析、Winograd Schema 和翻译四项任务,采用 few-shot prompt 格式测试模型对希伯来语复杂形态的理解能力。
Hugging Face 正式集成 Artificial Analysis LLM Performance Leaderboard,覆盖超过100个 serverless LLM API 端点。该榜单综合评估模型的质量(基于 MMLU、HumanEval 等)、上下文窗口、定价及推理速度(吞吐量与延迟),支持不同提示长度和并行查询场景下的性能对比。
推荐理由:Hugging Face 引入 Artificial Analysis 排行榜,整合了超过100个API端点的价格、速度和质量数据,为工程师选型提供多维参考。