Hugging Face Xet 团队用内容定义分块(CDC)改进 Hub 存储效率
Hugging Face 的 Xet 团队正用内容定义分块(CDC)替代 Git LFS 的文件级存储,只传输和保存修改过的 chunk,以提升 Hub 上 30 PB 模型、数据集与空间的存储效率。
Hugging Face 的 Xet 团队正用内容定义分块(CDC)替代 Git LFS 的文件级存储,只传输和保存修改过的 chunk,以提升 Hub 上 30 PB 模型、数据集与空间的存储效率。
Mistral AI 宣布对旗下免费 AI 助手 le Chat 进行重大更新,新增带引用的联网搜索、Canvas 创作界面、Agents 自动化工作流,并以免费 beta 形式提供。
推荐理由:官方公布 le Chat 一批免费 beta 功能及与 ChatGPT 等竞品的功能对比表,读者可以据此判断它作为替代方案的位置。
雅诗兰黛集团(The Estée Lauder Companies)使用 ChatGPT Enterprise 和自定义 GPT 分析消费者数据、挖掘洞察,加速美妆产品创新。OpenAI 展示了该企业级应用在数据驱动美容与创意领域的实际落地方式。
Hugging Face Hub 提供数据集托管与分享服务,可承载 TB 级数据集,Xet 团队正将单文件上限从 50 GB 提升至 500 GB。平台内置 Dataset Viewer(支持全文搜索和排序)、SQL Console,并兼容 Pandas、Spark、DuckDB 等第三方库,多数库一行代码即可加载或流式读取数据集。
Mistral 在 La Plateforme 上推出 Batch API,用于高吞吐量批量请求,价格比同步 API 调用低 50%。用户上传批处理文件,处理完成后下载输出文件即可,适用于情感分析、批量文档摘要与翻译、向量嵌入和数据标注等场景。该 API 支持平台上所有模型,每个工作区限 100 万个进行中请求,即将登陆云服务商伙伴平台。
Mistral AI 发布内容审核 API,与 Le Chat 的审核服务使用同一 API。该模型是基于 LLM 的分类器,可将文本输入分为 9 个类别,提供原始文本和对话内容两个端点,原生支持阿拉伯语、中文、英语、法语等 11 种语言。API 可帮助用户针对具体应用场景定制安全标准,政策类别涵盖不合格建议和 PII 等模型生成危害。
Hugging Face 发布 PyCharm 集成功能,开发者可在 IDE 内右键插入 HF 模型并自动获取示例代码。文章演示了用 microsoft/Phi-3.5-vision-instruct 十分钟内搭建图文对话应用,并介绍了悬停即显模型卡、本地模型缓存查看与清理等功能。该集成为 PyCharm Professional 专属,可用 PyCharm4HF 兑换 3 个月免费订阅。
Argilla 推出 2.4 新功能,无需写代码即可从 Hugging Face Hub 导入数据集并收集人工反馈。在 Argilla UI 中点击导入按钮即可开始,系统会根据数据集特征自动生成初始配置,可添加标签、评分、排序等问题;当前仅支持公开数据集,私有数据集支持尚未提供。该功能降低了领域专家参与数据集建设的门槛,部署推荐使用 Spaces 并默认启用 Hugging Face OAuth。
OpenAI 发布 ChatGPT search,可为用户提供快速、及时的答案,并附上相关网页来源链接。
推荐理由:OpenAI 官方宣布 ChatGPT 支持联网搜索并附来源链接,读者可据此了解其获取及时信息的新方式。
Decagon 与 OpenAI 合作,在大规模场景下提供高性能、完全自动化的客户支持服务。
Intel Labs 与 Hugging Face 推出 Universal Assisted Generation(UAG),通过双向 tokenizer 翻译让辅助生成不再要求目标模型与助手模型共享同一 tokenizer,可将任意 decoder 或 MoE 模型的推理加速 1.5x-2.0x 且几乎零开销。
推荐理由:原文解释了跨 tokenizer 助手模型的实现原理并给出多组加速数据,还提供 Transformers 4.46.0 的可用代码。
Hugging Face 发布 HUGS(Hugging Face Generative AI Services),为在自有基础设施中部署开源模型提供零配置的优化推理微服务。
Google DeepMind 与 Hugging Face 在 Transformers v4.46.0 中发布 SynthID Text,可通过 g-function 与 tournament sampling 为任意 LLM 的 model.generate() 输出添加人眼不可见的水印。
推荐理由:原文给出水印的实现方式、配置参数与检测训练流程,开发者可以据此把 SynthID Text 接入现有生成调用。
dottxt 与 Hugging Face 合作推出 outlines-core 0.1.0,将 Outlines 结构化生成核心算法移植到 Rust 并提供 Python 绑定。索引编译速度平均提升 2x,且通过 Rust 提前编译消除了此前 Numba JIT 带来的首次运行延迟。该库轻量、关注点分离,未来可绑定到 Python 之外的语言,方便更多库集成结构化生成。
Hugging Face 发布 Transformers.js v3,经一年多开发后正式推出,WebGPU 加速可比 WASM 快至 100 倍,支持架构总数达 120 个,Hub 上预转换模型超过 1200 个。
推荐理由:官方发布说明给出 WebGPU 加速、量化选项和迁移方式,读者可以据此评估是否升级到 v3。
Hugging Face 宣布与 Protect AI 合作,将后者的 Guardian 集成为第三方扫描器,自动扫描所有公开模型仓库。Guardian 可捕获 pickle 序列化和 Keras Lambda 层等格式中的任意代码执行漏洞,扫描结果已在新版前端展示,示例见 mcpotato/42-eicar-street;目前因超过 100 万模型仓库,部分模型可能暂未显示扫描结果。
Hugging Face 宣布 Gradio 5 稳定版发布,目标是让开发者用几行 Python 构建可上生产的机器学习 Web 应用。
推荐理由:官方宣布 Gradio 5 稳定版,列出性能、UI、流式与安全等具体改动和升级命令,开发者可据此评估迁移与使用。
Hugging Face 推出 Open FinLLM Leaderboard,一个专为金融领域设计的大模型评测榜单,填补通用 NLP 基准难以评估金融任务的空白。榜单覆盖信息提取、文本分析、问答、文本生成、预测、风险管理和决策七大类任务,采用 Accuracy、F1、ROUGE、MCC 等指标。评测采用 zero-shot 方式,测试模型在未见过的金融任务上的泛化能力。
OpenAI 宣布推出 canvas,一种与 ChatGPT 进行写作和编码的新方式。
推荐理由:官方宣布 ChatGPT 推出 canvas 界面,可用于写作和编码,产品发布信息明确。
OpenAI 发布 Realtime API,开发者可以在自己的应用中构建快速的语音到语音体验。
推荐理由:OpenAI 官方推出 Realtime API,开发者可直接在应用中构建低延迟的语音到语音体验。
OpenAI 宣布开发者现在可以在微调 API 中使用图像和文本对 GPT-4o 进行微调,以提升其视觉能力。
OpenAI 在 API 中推出 Prompt Caching 功能,对模型最近处理过的输入自动提供折扣。该功能为自动生效,面向使用 API 的开发者降低重复输入的成本。
OpenAI 在平台上推出模型蒸馏功能,可用大型前沿模型的输出对更具成本效率的模型进行微调。该功能在 OpenAI 平台内完成,链接为 https://openai.com/index/api-model-distillation。
AI 公司 Altera 使用 GPT-4o 构建智能体与人类协作的全新领域。原文未披露具体产品细节,仅说明 GPT-4o 是其实现这一协作方向的核心模型。
OpenAI 升级 Moderation API,推出一款基于 GPT-4o 构建的新多模态审核模型,能更准确地检测有害文本和图像。该模型面向开发者开放,用于构建更稳健的内容审核系统。
明尼苏达州企业翻译办公室(Enterprise Translation Office)使用 ChatGPT 来弥合语言沟通鸿沟。OpenAI 新闻报道了这一政府机构将 ChatGPT 应用于翻译工作的案例。
Mercado Libre 推出 AI 开发平台 Verdi,由 GPT-4o 驱动。该平台面向开发者提供基于 GPT-4o 的能力支持。
OpenAI 在巴西探索用 GPT-4 改善教学与学习,通过教育场景的应用帮助教师提升课堂效果、支持学生学习。该合作展示了大语言模型在教育资源补充方面的实际用途。
Mistral AI 宣布 la Plateforme 推出免费层供实验、评估和原型开发,并对全系模型降价,Mistral Small 与 Codestral 降价 80%,Mistral Large 降价 33%。同时发布 22B 参数的 Mistral Small v24.09(MRL 许可),Pixtral 12B 以 Apache 2.0 许可在 le Chat 上免费提供图像理解能力。
推荐理由:原文给出 la Plateforme 免费层、全线降价幅度和新模型细节,读者可据此比较部署与成本选项。
Hugging Face 宣布在 Hub 上推出 SQL Console,用户在每个数据集页面点击徽标即可运行 SQL 查询。查询由 DuckDB WASM 在浏览器本地完成,无需服务器,支持导出 Parquet 和通过链接分享结果;数据集前 5GB 会自动转换为 Parquet。
推荐理由:官方介绍浏览器内 SQL 查询数据集的能力与限制,文中示例可直接迁移到自己的数据集格式转换工作流。
Hugging Face 在 HuggingChat 上发布 Community Tools 功能,允许把任意公开 Space 转成模型可直接调用的工具,并借此扩展图像理解、视频生成和文本转语音等多模态能力。
推荐理由:官方介绍了把任意 Space 转成 HuggingChat 工具的做法,覆盖创建、配置参数和打包进助手的完整流程,读者可以照着复用。
Hugging Face 发布 Accelerate 1.0.0 的首个候选版本,该库在三年半间从简化 PyTorch 多 GPU/TPU 训练的工具,成长为 transformers、diffusers、peft、trl 等包的基础。
遗传学家 Catherine Brownstein 展示了如何用 OpenAI o1 加速罕见疾病诊断过程。o1 在该场景下用于辅助解码基因信息,缩短罕见疑难病症的诊断耗时。
量子物理学家 Mario Krenn 使用 OpenAI o1 协助解答物理问题。原文内容较为简短,仅说明他将该模型用于探索重大科学问题的研究工作。
Hugging Face 宣布与 Truffle Security 合作,将开源工具 TruffleHog 的密钥扫描集成到平台。
亚利桑那州立大学(Arizona State University)全校采用 ChatGPT,用于个性化学习、推进科研,并帮助学生为未来做好准备。此次合作为该校师生提供了基于 ChatGPT 的校园级应用支持。
Hugging Face 通过新 PR 和 DataCollatorWithFlattening 使无填充打包的指令微调训练兼容 Flash Attention 2,TRL 的 SFTTrainer 也可通过 padding_free=True 使用。
OpenAI 宣布 GPT-4o 现已支持微调,用户可使用自有数据对 GPT-4o 进行定制。
Hugging Face 宣布 Transformers 现已提供跨多个热门模型家族的统一工具调用 API,同一份代码可在 Mistral、Cohere、NousResearch 和 Llama 模型间基本无需修改地移植。
推荐理由:原文给出统一工具调用 API 的设计思路和完整代码示例,开源开发者可以照搬接入多个模型家族。
Mistral 宣布在 La Plateforme 上开放对 Mistral Large 2 和 Codestral 等旗舰及专家模型的定制,支持 base prompt、few-shot prompting 或 fine-tuning,可使用自己的数据集。