OpenAI API 推出 Prompt Caching,对模型近期见过的输入自动折扣
OpenAI 在 API 中推出 Prompt Caching 功能,对模型最近处理过的输入自动提供折扣。该功能为自动生效,面向使用 API 的开发者降低重复输入的成本。
OpenAI 在 API 中推出 Prompt Caching 功能,对模型最近处理过的输入自动提供折扣。该功能为自动生效,面向使用 API 的开发者降低重复输入的成本。
OpenAI 在平台上推出模型蒸馏功能,可用大型前沿模型的输出对更具成本效率的模型进行微调。该功能在 OpenAI 平台内完成,链接为 https://openai.com/index/api-model-distillation。
AI 公司 Altera 使用 GPT-4o 构建智能体与人类协作的全新领域。原文未披露具体产品细节,仅说明 GPT-4o 是其实现这一协作方向的核心模型。
OpenAI 升级 Moderation API,推出一款基于 GPT-4o 构建的新多模态审核模型,能更准确地检测有害文本和图像。该模型面向开发者开放,用于构建更稳健的内容审核系统。
明尼苏达州企业翻译办公室(Enterprise Translation Office)使用 ChatGPT 来弥合语言沟通鸿沟。OpenAI 新闻报道了这一政府机构将 ChatGPT 应用于翻译工作的案例。
Mercado Libre 推出 AI 开发平台 Verdi,由 GPT-4o 驱动。该平台面向开发者提供基于 GPT-4o 的能力支持。
OpenAI 在巴西探索用 GPT-4 改善教学与学习,通过教育场景的应用帮助教师提升课堂效果、支持学生学习。该合作展示了大语言模型在教育资源补充方面的实际用途。
Mistral AI 宣布 la Plateforme 推出免费层供实验、评估和原型开发,并对全系模型降价,Mistral Small 与 Codestral 降价 80%,Mistral Large 降价 33%。同时发布 22B 参数的 Mistral Small v24.09(MRL 许可),Pixtral 12B 以 Apache 2.0 许可在 le Chat 上免费提供图像理解能力。
推荐理由:原文给出 la Plateforme 免费层、全线降价幅度和新模型细节,读者可据此比较部署与成本选项。
Hugging Face 宣布在 Hub 上推出 SQL Console,用户在每个数据集页面点击徽标即可运行 SQL 查询。查询由 DuckDB WASM 在浏览器本地完成,无需服务器,支持导出 Parquet 和通过链接分享结果;数据集前 5GB 会自动转换为 Parquet。
推荐理由:官方介绍浏览器内 SQL 查询数据集的能力与限制,文中示例可直接迁移到自己的数据集格式转换工作流。
Hugging Face 在 HuggingChat 上发布 Community Tools 功能,允许把任意公开 Space 转成模型可直接调用的工具,并借此扩展图像理解、视频生成和文本转语音等多模态能力。
推荐理由:官方介绍了把任意 Space 转成 HuggingChat 工具的做法,覆盖创建、配置参数和打包进助手的完整流程,读者可以照着复用。
Hugging Face 发布 Accelerate 1.0.0 的首个候选版本,该库在三年半间从简化 PyTorch 多 GPU/TPU 训练的工具,成长为 transformers、diffusers、peft、trl 等包的基础。
遗传学家 Catherine Brownstein 展示了如何用 OpenAI o1 加速罕见疾病诊断过程。o1 在该场景下用于辅助解码基因信息,缩短罕见疑难病症的诊断耗时。
量子物理学家 Mario Krenn 使用 OpenAI o1 协助解答物理问题。原文内容较为简短,仅说明他将该模型用于探索重大科学问题的研究工作。
Hugging Face 宣布与 Truffle Security 合作,将开源工具 TruffleHog 的密钥扫描集成到平台。
亚利桑那州立大学(Arizona State University)全校采用 ChatGPT,用于个性化学习、推进科研,并帮助学生为未来做好准备。此次合作为该校师生提供了基于 ChatGPT 的校园级应用支持。
Hugging Face 通过新 PR 和 DataCollatorWithFlattening 使无填充打包的指令微调训练兼容 Flash Attention 2,TRL 的 SFTTrainer 也可通过 padding_free=True 使用。
OpenAI 宣布 GPT-4o 现已支持微调,用户可使用自有数据对 GPT-4o 进行定制。
Hugging Face 宣布 Transformers 现已提供跨多个热门模型家族的统一工具调用 API,同一份代码可在 Mistral、Cohere、NousResearch 和 Llama 模型间基本无需修改地移植。
推荐理由:原文给出统一工具调用 API 的设计思路和完整代码示例,开源开发者可以照搬接入多个模型家族。
Mistral 宣布在 La Plateforme 上开放对 Mistral Large 2 和 Codestral 等旗舰及专家模型的定制,支持 base prompt、few-shot prompting 或 fine-tuning,可使用自己的数据集。
OpenAI 在 API 中推出 Structured Outputs,模型输出现在能可靠地遵循开发者提供的 JSON Schema。
推荐理由:官方说明模型输出可稳定遵循开发者提供的 JSON Schema,对需要可靠结构化输出的工程场景有直接参考价值。
Hugging Face 盘点截至 2024 年 8 月 6 日 Hub 上的主要安全功能。所有用户可用细粒度 token、双因素认证(2FA)、GPG commit signing、组织级访问控制,以及自动安全扫描流水线(ClamAV 恶意软件扫描、picklescan 扫描 pickle 文件、trufflehog 扫描密钥)。
Hugging Face 推出 NVIDIA NIM API (serverless) 推理服务,面向 Enterprise Hub 组织,基于 NVIDIA DGX Cloud 的 H100 GPU 按请求计算时间计费,价格为 $8.25/小时(约 $0.0023/秒)。
OpenAI 正在测试 SearchGPT,这是一个新搜索功能的临时原型。它可以为用户提供快速、及时的答案,并附上清晰、相关的来源。
OpenAI 为 ChatGPT Enterprise 推出合规 API 集成(Compliance API)、SCIM 用户管理和 GPT 控制功能,用于支持企业合规计划、数据安全和大规模用户访问管理。
Hugging Face 在 TGI 中推出 Multi-LoRA serving,只部署一次基座模型 mistralai/Mistral-7B-v0.1,即可按请求动态选择 LoRA 适配器,一次部署相当于服务多个微调模型。
推荐理由:原文给出部署步骤、显存开销和成本对比数据,读者可以据此评估一次部署服务多个微调模型是否适合自己的场景。
Hugging Face 正在 Dataset Hub 上试验一项新功能,使用开源 PII 检测工具 Presidio 自动生成数据集中个人身份信息(PII)的报告。报告可帮助开发者在训练前评估数据集的 PII 风险,也帮助数据集所有者在发布前验证其 PII 过滤流程。Hugging Face 还感谢法国 CNIL 在 GDPR 合规方面提供的指导。
Hugging Face 宣布 Transformers 与 KerasHub 采用共享模型保存格式,KerasHub 现可直接加载 Hub 上 346,268 个 Transformers 库模型。
推荐理由:官方宣布 Transformers 与 KerasHub 共享模型保存格式,KerasHub 用户可直接加载 Hub 上 300K+ 模型并切换 TensorFlow、JAX 或 PyTorch 后端。
Hugging Face 宣布用户可在 Inference Endpoints 和 Spaces 上使用 Google Cloud TPU v5e 加速 AI 应用。
推荐理由:Hugging Face 官方宣布接入 Google TPU,给出了实例配置和价格,读者可据此评估推理部署的成本选项。
Hugging Face 为 Dataset Hub 的 Dataset Search 推出四项新功能:按模态(文本、图像、音频、表格等)、按行数大小、按存储格式、按兼容库筛选。行数信息基于文件元数据,元数据缺失时按前 5GB 内容估算。这些筛选可与 Language、Tasks、Licenses 等现有过滤器组合使用。
总部位于多伦多的知识产权 AI 公司 XLSCOUT 联合 Hugging Face Expert Support Program 推出专利嵌入模型 ParaEmbed 2.0,通过在专家精选的多领域专利数据上微调,准确率较 2023 年 10 月发布的 ParaEmbed 1.0 提升 23%。
Color Health 与 OpenAI 合作推出 Cancer Copilot 应用,利用 GPT-4o 识别缺失的诊断检查并生成个性化工作计划,帮助医护人员就癌症筛查和治疗做出循证决策,加速患者获得治疗的进程。
Hugging Face 在 TRL 中推出 RLOO(REINFORCE Leave One-Out)在线 RLHF 训练器,作为 PPO 的替代方案。
OpenAI 深入解析其文生语音模型 Voice Engine 的技术原理,并介绍围绕它开展的安全研究。文章探讨了该模型背后的技术机制。
Hugging Face 宣布面向 Amazon SageMaker 的 Embedding Container 正式可用(GA),基于 Text Embedding Inference(TEI),支持在 SageMaker 上高效部署嵌入模型以构建 RAG 等生成式 AI 应用。
Mistral 在 la Plateforme 推出模型定制能力,提供三条路径:开源微调 SDK mistral-finetune(基于 LoRA,可在自有基础设施微调全部开源模型)、平台无服务器微调服务(兼容 Mistral 7B 和 Mistral Small,后续数周将新增模型)以及面向特定客户、支持持续预训练的定制训练服务。
推荐理由:官方同时开放自托管微调 SDK、平台托管服务与定制训练三条路径,读者可据此对比选择适合自己的模型定制方式。
Mistral AI 于 6 月 5 日至 30 日举办线上微调黑客松,参赛项目须使用其微调 API。前三名各获 2500 欧元 Mistral API 额度,部分参与者可申请 100 美元免费额度。参赛可个人或组队(最多 4 人),需提交代码链接、项目描述和不超过 2 分钟的视频,评分涵盖影响力、技术实现、创意与展示各占 25%。
Cubzh 和 Gigax 联合 Hugging Face 发布 NPC-Playground,一个可在浏览器直接体验的 3D 演示,玩家可与 LLM 驱动的 NPC 对话互动。
OpenAI 推出 OpenAI for Education,这是一项面向大学的经济实惠方案,帮助高校以负责任的方式将 AI 引入校园。该方案聚焦教育场景,降低院校部署 AI 的成本门槛。
OpenAI 发布 OpenAI for Nonprofits 新计划,提升其工具对非营利组织的可及性。该计划为非营利组织使用 ChatGPT Team 和 Enterprise 提供折扣价格。
MavenAGI 推出一款基于 GPT-4 构建的 AI 客服智能体。Tripadvisor、Clickup 和 Rho 等公司已在使用该智能体,以节省时间并更好地服务客户。