ATV Big Air Tour 用 ChatGPT 把 3 天工作量压缩到 3 小时
ATV Big Air Tour 使用 ChatGPT Work 加速营销、商品运营等工作流程。团队曾把商品照片转化为库存网站,仅用时 15 分钟,将原本 3 天的工作量压缩到 3 小时。
ATV Big Air Tour 使用 ChatGPT Work 加速营销、商品运营等工作流程。团队曾把商品照片转化为库存网站,仅用时 15 分钟,将原本 3 天的工作量压缩到 3 小时。
Hugging Face 推出 BenchMIRT,一种基于多维 IRT 的方法,用于在题目层面审计 LLM 基准的真实测量内容。该方法基于 100 个 LLM、16 个基准和超过 34K 道题的结果训练,未事先标注即独立恢复出安全与通用推理两个维度。分析发现 BBQ 和 WMDP 得分与通用推理的关联强于安全,HarmBench 的版权类题目也更偏向通用推理。
Google 与 NASA JPL 在 PNAS 发表 MAPL-EMIT,一个基于 Swin-S 视觉 transformer 的框架,可自动检测、量化和定位 EMIT 高光谱数据中的甲烷羽流。
Google DeepMind 发布 agentic video understanding,覆盖 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite。
推荐理由:官方说明动态检索视频相比固定帧率处理的效率与精度变化,并给出 API 开启方式,适合评估长视频分析成本的开发者。
Basis、Clay 和 Exa Labs 三家 AI 原生公司利用 AI 智能体改进新员工入职、账户管理和开发者集成等核心流程。文章总结其实践经验,供企业领导者借鉴应用。
OpenAI 宣布 Astra 成为首个依据 Preparedness Framework 达到 Critical 网络安全能力阈值的模型,并称发布时将配备更强防护措施。
OpenAI 宣布 ChatGPT 可连接受信任的医疗数据,帮助临床医生安全访问患者背景信息和医学研究等内容。医疗机构还能将 EHR(电子健康记录)及其他行业数据接入 ChatGPT。
律所 Gilbert + Tobin 通过 CEO 主导的承诺、严格的治理机制和人类问责制度,在全所规模化部署 ChatGPT Enterprise 和 Codex。该案例展示了这家律所如何在保证合规与责任可追溯的前提下推进 AI 落地。
Hugging Face WebAI 团队发布 @huggingface/kernels 库和 207 个 WebGPU 内核(Apache-2.0),每个内核以带版本号的独立仓库发布,包含 manifest、正确性测试、基准用例和 WGSL shader 模板。
推荐理由:官方介绍了 207 个 WebGPU 内核的发布方式和与 ORT WebGPU 的实测对比,读者可以据此评估浏览器端推理优化的可用路径。
Google Research 发布时间序列基础模型 TimesFM-3,参数量 3.3 亿,预训练语料超过 1 万亿时间点,原生支持零样本多变量预测。模型可同时预测多个目标序列,支持过去协变量与过去-未来协变量,通过交替注意力与 Contiguous Patch Masking 在单次前向传播中完成整段预测,每步输出第 10 到第 90 百分位共 9 个分位数。
Microsoft Research 联合华盛顿大学和 Providence 发布 GigaPath-Flash 与 GigaTIME-Flash,以 Apache 2.0 许可在 HuggingFace 开放权重。
Polimill 利用 OpenAI GPT 模型和 Codex,帮助日本地方政府(municipalities)检索和使用行政知识,同时加速开发。该方案面向日本公共部门,构建新一代公共 AI 基础设施。
OpenAI 宣布支持加州 SB 1119 法案,推动为青少年建立强有力的、符合年龄特点的 AI 安全保障。该法案在加强防护的同时,保留青少年学习、创造和探索的机会。
OpenAI 的 ChatGPT Ads 年化收入运行率达到 10 亿美元,并向全球扩张。广告收入将支持通过免费和低价方案扩大 AI 的使用机会。
OpenAI 宣布,在 Cursor 被 SpaceX 收购后,决定终止向 Cursor 提供 OpenAI 模型的合同,逐步结束该合作。
OpenAI 与泰国高等教育部(MHESI)联合推出一个为期八周的加速器项目,帮助 10 家健康、养生和教育领域的初创企业将 AI 原型打磨成可信赖的产品。
Voice Arena 与 Hugging Face 合作,在 Open ASR Leaderboard 引入 Monsoon en-IN 和 Monsoon hi-IN 两套评测集,覆盖 4,888 名说话人,印地语是该多语言榜单上首个非欧洲语言。
推荐理由:原文给出 Monsoon 四个评测集的采集设计与区域误差分析样例,读者可以了解带说话人元数据的 ASR 评测能揭示什么。
Google 在 Earth AI 计划下推出实验性研究能力行星预测引擎(PPE),可从自然语言查询出发自主完成数据发现、清洗、特征工程、模型训练与评估。
Google DeepMind 发布 Gemini Omni 1.1 Flash,通过 Gemini API 和 Google AI Studio 面向开发者提供更可控的生成视频能力。
推荐理由:官方发布了能力细节和 API 用法,开发者可以据此评估它在视频生成工作流中的可控性和成本。
Google DeepMind 推出针对专有前沿模型的首个双盲评测,将外部评测限制在密码学安全的“盒子”环境中,防止模型提前看到测试题导致基准污染。此次与 Singapore AI Safety Institute、OpenMined、AVERI 和 MLCommons 合作,对一个 Gemini Flash Lite 模型在隐私保护环境下测试机密基准。
OpenAI 发布了一项覆盖 1000 多名学生的随机对照研究,考察在真实大学作业中使用 ChatGPT 与批判性思维训练的效果。研究关注 ChatGPT 对学生批判性思维、原创性和学业表现的影响,结果显示学生能获得更好的答案和更广的思考。
OpenAI 宣布扩展在巴西的业务,深化与当地开发者、企业和社区的合作,以支持 AI 在巴西的普及和应用。
Google Research 推出 GlucoFM,一个面向连续血糖监测(CGM)数据的自监督基础模型,采用双流编码器将慢速血糖趋势与短期偏差分离,并以潜在预测目标学习日上下文与时间演化。
Google DeepMind 推出 Gemini 3.5 Transcribe,定位为更精确的智能语音转写模型,能清除填充词、自动排版、支持自定义词表和 85 种以上语言。
推荐理由:官方发布文给出模型的能力细节、两项 API 入口和与 Chirp 3 的 WER 与延迟对比,开发者可据此评估语音转写方案选型。
OpenAI 发布新报告,探讨学生和教育者如何使用 ChatGPT 让学习更连续,获得课堂之外的支持。报告聚焦 AI 辅助学习如何延伸到课堂之外,帮助学习者随时随地持续学习。
OpenAI 宣布 ChatGPT for Teachers 扩展到 55 个美国学区,为超过 10 万名教育工作者和员工提供安全的 AI 工具、培训和支持。
OpenAI 公布了 Hugging Face 安全事件的调查发现,并介绍了加强 AI 模型安全、监控与对齐的相关措施。该事件及其后续加固步骤的细节由 OpenAI 官方披露。
loveholidays 使用 OpenAI Codex 让软件开发的门槛覆盖全公司,帮助各团队更快把想法变成产品。Codex 在该公司内部降低了开发的参与门槛,让非工程团队也能参与构建软件,加速从创意到产品的落地。
Sentence Transformers v6.0 引入第四种模型类型 MultiVectorEncoder,支持 ColBERT 式后期交互检索及完整训练流程。
推荐理由:作者实测比较了六种训练起点和各训练超参,给出可在单张消费级 GPU 上数小时完成的完整多向量模型微调配方。
Google 在 CHI 2026 发表研究原型 AgentHands,为 XR 中的 AI 智能体生成与语音同步的手势,使对话具备空间 grounding。系统通过眼动注视与场景重建注册物体 3D 边界框,由后端 LLM 在回复中内嵌 GestureEvents,并在头显端用词级时间戳与 TTS 同步播放动画。
IBM 发布 Granite 4.2 推理模型家族,含 3B、8B、30B 三个稠密模型,以 Apache 2.0 许可开源。
推荐理由:IBM 官方公开 Granite 4.2 从预训练到多阶段 RL 的完整训练细节,读者可以借此了解推理模型的可复现构建路径。
Multiverse Computing 发布 Quantization-Aware Healing(QAH)方法,将 GPT-OSS 120B 压缩到 60B 参数并量化为 MXFP4 后,模型在 9 项基准中的 7 项超过其 bfloat16 全精度版本,AA-LCR 提升 7.4 分、AIME 2025 提升 5.6 分。
OpenAI CFO Sarah Friar 阐述了芯片、算力、模型和产品各层的进步如何相互叠加,以更大规模、更低成本交付更有用的智能。
OpenAI 官方宣布 Jalapeño 自研推理芯片,称其提供更快、更省电的 AI 推理。官方表示该芯片面向现代模型,带来更高吞吐和更低延迟,并称首批结果显示其速度与效率达到行业领先水平。
Hugging Face 在 Gradio 中推出 gr.Workflow,把 AI 应用的多步骤流水线描述为类型化节点图,并提供可拖拽画布,每个节点可运行、中间结果可见。
推荐理由:原文来自官方,给出 gr.Workflow 的节点图机制、多个可复制的在线示例和 REST API 用法,读者可以直接上手复用这套搭建 AI 流水线的方法。
OpenAI 推出面向 ChatGPT Work 和 Codex 的 Admin 插件。管理员可用它分析工作区使用情况、管理成员和权限、调整限额,并处理管理员请求。
OpenAI 封禁了多个源自俄罗斯的账号,这些账号利用 AI 推广一个伪装成以色列智库的虚假机构及一份赞扬俄罗斯、批评西方的“主权”指数。该行动属隐蔽影响力行动,OpenAI 已将其破坏。
Mistral 与 HUMAIN 宣布建立战略合作,在沙特阿拉伯及中东地区推进主权 AI,合作规模达数亿欧元,覆盖 AI 基础设施、先进模型开发与 AI 方案部署。双方将开发并本地化先进模型,初期聚焦网络安全与语音,并计划打造阿拉伯语表现优异的前沿模型。两家公司还将探索利用 HUMAIN 数据中心基础设施满足当地算力需求,并在沙特面向受监管行业制定联合市场策略。
GPT‑5.6 现已在 Kiro 中可用,帮助开发者更高效地规划、构建、审查和测试软件,并提供更好的价格性能比。
Google Research 推出 Biomarker Discovery Framework,一个在人类监督下以迭代研究循环优先排序候选生物标志物的多智能体系统。