OpenAI 从 GPT-4 中自动提取 1600 万个概念模式
OpenAI 使用新的稀疏自编码器扩展技术,自动识别出 GPT-4 计算过程中的 1600 万个模式。
推荐理由:OpenAI 用稀疏自编码器扩展技术从 GPT-4 中提取 1600 万个模式,关注可解释性方向的读者可以了解其规模化路径。
OpenAI 使用新的稀疏自编码器扩展技术,自动识别出 GPT-4 计算过程中的 1600 万个模式。
推荐理由:OpenAI 用稀疏自编码器扩展技术从 GPT-4 中提取 1600 万个模式,关注可解释性方向的读者可以了解其规模化路径。
Artificial Analysis 与 Hugging Face 推出基于人类偏好的 Text to Image 排行榜和 Image Arena,ELO 分数基于 Arena 收集的 45,000 多条人类图像偏好计算,每个模型生成 700 多张图像。
Mistral 在 la Plateforme 推出模型定制能力,提供三条路径:开源微调 SDK mistral-finetune(基于 LoRA,可在自有基础设施微调全部开源模型)、平台无服务器微调服务(兼容 Mistral 7B 和 Mistral Small,后续数周将新增模型)以及面向特定客户、支持持续预训练的定制训练服务。
推荐理由:官方同时开放自托管微调 SDK、平台托管服务与定制训练三条路径,读者可据此对比选择适合自己的模型定制方式。
Mistral AI 于 6 月 5 日至 30 日举办线上微调黑客松,参赛项目须使用其微调 API。前三名各获 2500 欧元 Mistral API 额度,部分参与者可申请 100 美元免费额度。参赛可个人或组队(最多 4 人),需提交代码链接、项目描述和不超过 2 分钟的视频,评分涵盖影响力、技术实现、创意与展示各占 25%。
Cubzh 和 Gigax 联合 Hugging Face 发布 NPC-Playground,一个可在浏览器直接体验的 3D 演示,玩家可与 LLM 驱动的 NPC 对话互动。
Hugging Face 将 assisted generation(基于 Speculative Sampling)适配并优化到 Intel Gaudi 处理器,现已合入 Optimum Habana,通过 .generate() 的 assistant_model 参数指定 draft 模型即可使用。
Hugging Face 通报其 Spaces 平台遭未授权访问,部分 Spaces 秘钥可能被读取,官方已撤销相关 HF token 并邮件通知受影响用户。官方建议用户刷新密钥或改用细粒度访问 token,已移除 org token、为 Spaces 秘钥部署 KMS,并计划在功能对齐后弃用经典读写 token,同时已报警并向数据保护机构报告。
推荐理由:官方通报了 Spaces 秘钥未授权访问事件、已撤销的 token 范围和 KMS 等整改措施,受影响用户可据此排查自身密钥。
OpenAI 终止了与隐蔽影响力行动相关的账号。这些行动试图利用其服务进行欺骗性内容生成,但未因使用 OpenAI 服务而获得显著的受众增长。
OpenAI 推出 OpenAI for Education,这是一项面向大学的经济实惠方案,帮助高校以负责任的方式将 AI 引入校园。该方案聚焦教育场景,降低院校部署 AI 的成本门槛。
OpenAI 发布 OpenAI for Nonprofits 新计划,提升其工具对非营利组织的可及性。该计划为非营利组织使用 ChatGPT Team 和 Enterprise 提供折扣价格。
Mistral AI 发布首个代码生成模型 Codestral,为 22B 开源权重模型,训练数据覆盖 80+ 编程语言,支持 32k 上下文窗口和 fill-in-the-middle 机制。
推荐理由:官方原文给出 22B 参数、32k 上下文、80+ 语言和多个基准对比,读者可以据此评估它在代码补全场景中的位置。
MavenAGI 推出一款基于 GPT-4 构建的 AI 客服智能体。Tripadvisor、Clickup 和 Rho 等公司已在使用该智能体,以节省时间并更好地服务客户。
Mistral AI 推出 Mistral AI 非生产许可(MNPL),允许开发者将技术用于非商业目的和科研工作,Codestral 当日即在该许可下发布。公司表示将继续在 Apache 2.0 下发布模型和代码,逐步形成两个许可家族并行,以在开放原则与商业化之间取得平衡。
推荐理由:官方说明 MNPL 许可的适用范围和与 Apache 2.0 并行的策略,可帮助开发者判断商用与研究的合规边界。
The Atlantic 宣布与 OpenAI 达成内容与产品战略合作,其文章将可在 ChatGPT 等 OpenAI 产品中被检索发现。作为合作伙伴,The Atlantic 还将参与塑造未来实时发现产品中新闻的呈现方式。
OpenAI 与 Vox Media 达成多项合作协议,Vox Media 的内容将用于增强 ChatGPT 的输出。Vox Media 还将基于 OpenAI 技术开发产品,以更好地服务其受众和广告主。
Hugging Face 介绍其 Text Generation Inference(TGI)附带的 TGI Benchmarking 工具,用于在吞吐之外同时测量延迟(含 TTFT),帮助用户根据场景权衡调优 LLM 部署。
Hugging Face 发布教程,介绍如何使用 Sentence Transformers 库微调或从零训练嵌入模型,覆盖数据集、损失函数、训练参数、评估器和 Trainer 五个组件。
Meta 发布开源评测框架 CyberSecEval 2,用于评估 LLM 在生成不安全代码、提示词注入、协助网络攻击、代码解释器滥用和自动化攻击能力等方面的安全风险。评测显示,LLM 平均协助网络攻击的合规率已从上一版的 52% 降至 28%;提示词注入防护仍未解决,模型在端到端漏洞利用上能力有限。全部代码开源,并提供 leaderboard,欢迎社区贡献。
TII 发布开源模型系列 Falcon 2,包含 11B 基础 LLM 和具备图像理解能力的 11B VLM,训练数据超过 5000B token,支持英语及另外 10 种语言。
OpenAI 宣布与 News Corp 签署多年期全球合作伙伴关系,将其优质新闻内容引入 OpenAI 的生成式 AI 产品和平台。
Hugging Face 宣布 Inference Endpoints 新增 AWS Inferentia2(Inf2)实例支持,可将 Hub 上模型几步点击部署到 Inferentia2。
OpenAI 表示,AGI 有潜力惠及生活的几乎各个方面,因此必须以负责任的方式开发和部署。
Hugging Face 与 AMD 合作,将 AMD Instinct MI300 GPU 深度集成到 Hugging Face 平台,用户在 Azure ND MI300x V5 上使用 transformers 和 text-generation-inference 无需改代码。
Hugging Face Spaces 推出 Dev Mode,用户可一键通过 VS Code 或 SSH 直连 Space 编辑代码,无需再用 git 推送本地更改,编辑后点“Refresh”即可测试。该功能目前处于 beta 阶段,仅面向 PRO 订阅用户开放,改动确认满意后可 commit 并 merge 持久保存。目前社区已创建超过 500,000 个 Spaces。
Hugging Face 宣布推出 Dell Enterprise Hub(dell.huggingface.co),用于在 Dell 平台上便捷地本地训练和部署开源模型。
Hugging Face 与 Microsoft 在 Microsoft Build 上深化合作,扩展 Azure Model Catalog 的 Hugging Face Collection,新增 Llama 3、Mistral 7B、Command R Plus、Qwen 1.5 110B 等,支持在 Azure AI Studio 一键部署。
OpenAI 与行业领先的选角和导演专业人士合作,从超过 400 份投稿中筛选,最终选定 ChatGPT 的 5 个语音。
OpenAI 改进了 ChatGPT 的数据分析功能,用户可与表格和图表交互,并直接从 Google Drive 和 Microsoft OneDrive 添加文件。
OpenAI 宣布与 Reddit 达成合作,将 Reddit 的独特内容引入 ChatGPT 及其产品。本条为官方公告摘要,feed 未提供完整正文。
推荐理由:OpenAI 官方宣布与 Reddit 达成合作,读者可据此关注 Reddit 内容进入 ChatGPT 后对产品信息来源的影响。
Hugging Face 在 Transformers 中新增 KV Cache 量化功能,通过降低缓存精度显著减少长上下文生成的内存占用,同时保持生成质量。
Canva 是一个视觉传播平台,每月有超过 175 million 人使用它制作演示文稿、视频、文档、网站和社交媒体图片等。世界上大多数知识工作者缺乏设计训练,Canva 凭借易用的界面、丰富的素材库和省时工具,让任何人都能创作出视觉效果出色的内容。
OpenAI 宣布 Ilya Sutskever 将离开公司,Jakub Pachocki 接任首席科学家。该消息由 OpenAI 官方发布,正文内容未能抓取,仅标题可用。
推荐理由:OpenAI 官宣核心人事变动,首席科学家由 Ilya Sutskever 更替为 Jakub Pachocki,可关注后续研究路线走向。
Google 发布 PaliGemma 视觉语言模型系列,采用 SigLIP-So400m 图像编码器加 Gemma-2B 文本解码器的架构,提供 pt、mix、ft 三类checkpoint,支持 224x224、448x448、896x896 三种分辨率和 bfloat16、float16、float32 三种精度。
推荐理由:原文由官方介绍模型架构、三种checkpoint类型、基准分数和transformers推理微调用法,可作为上手PaliGemma的实用参考。
Hugging Face 与 LangChain 联合发布合作伙伴包 langchain_huggingface,由双方共同维护,旨在让 LangChain 用户更快用上 Hugging Face 生态的新功能。
Hugging Face 与 TII 推出 Open Arabic LLM Leaderboard(OALL),为阿拉伯语大模型提供专门的评测与比较平台,服务全球超 3.8 亿阿拉伯语使用者。
OpenAI 宣布推出新旗舰模型 GPT-4o(GPT-4 Omni),该模型可实时对音频、视觉和文本进行推理。
推荐理由:官方宣布新旗舰模型 GPT-4o,可实时跨音频、视觉和文本推理,是了解该模型定位的直接信源。
OpenAI 发布 GPT-4o,并在 ChatGPT 中向免费用户开放更多能力。
推荐理由:OpenAI 官方宣布 GPT-4o,并提及免费用户可用性变化,适合想了解该模型基本定位的读者。
OpenAI 宣布推出最新旗舰模型 GPT-4o,并在 ChatGPT 中向免费用户开放更多能力。发布同时带来更多工具供免费用户使用。
推荐理由:OpenAI 官宣新旗舰模型,并说明同步向免费用户开放更多 ChatGPT 能力,适合关注模型可用范围变化。
Hugging Face 发布 Transformers Agents 2.0,新增可基于过往观察迭代的 ReactCodeAgent 与 ReactJsonAgent,并支持社区智能体分享。
推荐理由:官方详解新 Agent 框架的设计原则与多智能体用例,并给出基准结果,开源模型表现可作选型参考。
Hugging Face 组织现在可通过 AWS Marketplace 使用 AWS 账户订阅升级到 Enterprise Hub,费用与公开定价一致,由 AWS 账户结算。