OpenAI 在 ChatGPT Work 中推出 Data agent
OpenAI 推出 ChatGPT Work 中的 Data agent,用户可用自然语言连接公司数据、发现洞察并构建交互式仪表盘。
OpenAI 推出 ChatGPT Work 中的 Data agent,用户可用自然语言连接公司数据、发现洞察并构建交互式仪表盘。
Mistral 与 Cloudera 宣布合作,将 Mistral 模型集成到 Cloudera 混合数据平台中。企业可在私有云、公有云、本地乃至完全物理隔离(air-gapped)环境中部署推理,并基于自有专有数据训练定制模型,同时保留数据与模型的所有权。
OpenAI 与美国总务管理局(GSA)合作,为符合条件的联邦、州、地方和部落政府提供免许可费、用量五折优惠,并扩展网络防御支持。该举措旨在扩大政府部门的 AI 访问范围。
OpenAI 推出 ChatGPT for Financial Services,内置金融数据并集成 GPT-6 Astra,用于金融研究、建模和制作面向客户的材料。
OpenAI 在 API 中推出 GPT-Live-1,带来自然的全双工语音对话能力。模型具有更强的指令遵循能力,并支持自定义语音和电话(telephony)接入。
推荐理由:官方摘要说明了 GPT-Live-1 的语音能力与开放入口,读者可以据此评估它对语音应用开发的可用性。
Hugging Face 博客介绍 TRL v1.14 的 AsyncGRPOTrainer 支持 LoRA 训练并仅向 vLLM 同步几 MB 的 adapter,训练与推理以独立 HF Jobs 运行,通过 Storage Bucket 挂载共享 adapter,前置代理负责加鉴权头、按 KV 前缀路由 rollout 并向所有副本广播 adapter 加载。
推荐理由:原文给出了跨机 LoRA GRPO 的完整架构与五轮瓶颈调优数据,500 步从 3 小时 27 分压到 53 分钟,方法可直接复用。
Hugging Face 发布 Workflow1111,用 gr.Workflow 在单个画布上重建了 AUTOMATIC1111 的大部分功能,包含 11 条媒体管线和 73 个节点。
推荐理由:用 73 个节点在单一画布上复刻 AUTOMATIC1111 主要功能,并展示每个输出可直接变成 REST 端点和 MCP 工具的做法。
OpenAI 发布 Agents API,这是一项由 Codex harness 驱动的托管服务,用于在云端构建和启动智能体。它提供编排、长时间运行会话和工具使用能力。
OpenAI 宣布 Paul Christiano 加入 OpenAI Foundation Board 及其安全与安全委员会。官方称他将带来在 AI 对齐、安全和标准方面的经验。
OpenAI 的 Chris Lehane 提出,AI 能力的增强需要更强的安全证据作为支撑。他呼吁趁政策窗口仍然开启之际,推动建立共享标准和持久的政策行动。
Mistral 帮助一家欧洲能源运营商把 40 万行 Fortran 77 油藏模拟器中的首期 4 万行迁移到 C++,先搭建数值对齐校验框架导出 Fortran 状态并用 C++ 测试框架验证。
OpenAI 发布 GPT-6 Astra,称其为面向商业的最强模型。该模型具备高级推理、计算机使用能力,写作和设计判断也更强。
一位 MIT 研究者使用 GPT-5.6 Sol 搭配 Codex 自主运行量子计算实验、分析结果并校准 qubit。该案例展示了 GPT-5.6 Sol 在科研实验自动化中的应用。
Google DeepMind 发布 AlphaGenome Atlas 平台,收录人类基因组约 90 亿个单核苷酸变体的分子效应预测,数据集达 1 PB,超过 AlphaFold 数据库 30 倍以上。
推荐理由:平台把 90 亿个单核苷酸变体的预测免费开放,配合 AVI 评分与案例结果,研究者在排序罕见病变体时可省去大量实验验证。
OpenAI 发布文章,探讨能力更强、成本更低的 AI 如何拓展个人和企业能完成的工作,并让增长更具经济性。
Mistral 宣布完成 30 亿欧元 Series D 融资,投后估值超 210 亿欧元,称其为欧洲科技公司史上最大股权融资。本轮由三星电子领投,Scaleup Europe Fund(EQT 管理)和 PSG Equity 联合领投,Advent、BlackRock、卢森堡大公国为新投资方,a16z、ASML、NVIDIA 等老股东跟投。
推荐理由:官方公告给出融资金额、估值和资方名单,读者可以据此了解欧洲主权开源模型路线的资金与商业基础。
OpenAI 推出 ChatGPT Images 2.5,可将想法、草图和参考照片转化为更个性化、更精致且更贴近用户构思的图像。
OpenAI 宣布扩大对新闻业的支持,为学生、教育工作者、记者和新闻机构提供工具、培训与合作伙伴关系。该计划覆盖从课堂到新闻编辑室的多类群体,是 OpenAI 在新闻领域合作的延伸。
OpenAI 宣布分享一个针对 Navier–Stokes 千禧年大奖难题的 AI 生成解法,内容包括论文式 writeup 和一份 Lean 形式化证明。
推荐理由:官方宣布 AI 生成纳维-斯托克斯问题解法并附 Lean 形式化证明,形式化验证为这类重大数学结论提供了可查证路径。
OpenAI 推出总额 500 万美元的资助计划,现开放申请,支持关于生成式 AI 如何影响青少年发展、福祉与安全的独立研究。
1Password 工程师使用 Codex 快速构建新功能和内部工具,在保持严格安全策略的同时达到生产就绪状态。工程生产力因此提升了 21%。
OpenAI 与 AIRPPU、WAN-IFRA 联合启动一项 AI 项目,帮助乌克兰新闻机构增强创新能力、韧性与独立新闻报道。项目面向乌克兰新闻组织开展,具体参与机构名单和培训细节未在公告中披露。
OpenAI 的 Jakub Pachocki 探讨能力日益增强的 AI 与保持其对齐的挑战。他呼吁建立更强的安全保障措施,并加强国际协调。
OpenAI 发布研究速览,介绍编程智能体在其内部 AI 研究中的应用。文章呈现了智能体使用情况、实验速度、任务复杂度等早期数据,展示智能体如何重塑 AI 研究并加速研究进程。
GitHub 推出 Project HydraFusion 研究预览,通过运行时多模型编排提供前沿级编码智能,所有 GitHub Copilot 计划用户可在 Copilot CLI 中通过 /experimental 使用,按各模型标准费率计费。
推荐理由:原文给出三种执行模式和跨基准的成本质量数据,读者可以据此判断多模型编排对编码工作流的实际取舍。
Google Research 评估了将 UK Biobank 欧洲人群 GWAS 训练的多基因风险评分(PRS)迁移到 Biobank Japan 近 20 万日本人群样本的效果,涵盖 BMI、血压、HDL、LDL、血糖等 8 个临床性状。
Google 与 HHMI Janelia、MRC 分子生物学实验室及剑桥大学等合作,在 Cell 发表雄性果蝇大脑和中央神经系统完整连接组,包含超过 166,000 个神经元和 1.25 亿个突触连接,是迄今按神经元数量计最大的脑图谱。
推荐理由:原文给出雄性果蝇全脑连接组的规模、验证方式和开源查看工具,也说明雌雄对照可用于研究性行为与个体差异。
GitHub Copilot app 支持同时运行多个 AI 智能体,各会话相互独立、互不干扰。每个会话可运行在各自的 Git worktree 上并保留独立上下文,并行执行不同任务。开发者可在 sessions 视图跟踪进度,把时间花在审查和决策上,无需逐个等待任务完成。
Google DeepMind 与 Google Research 发布 WeatherNext 3,据 Brightband 独立实时评测为其迄今最先进、最准确的全球天气 AI 模型。
推荐理由:官方原文给出分辨率、更新频率与降水精度等具体指标,读者可据此评估其对天气预报和清洁能源场景的实际改变。
OpenAI 推出 Daybreak for Frontline Defenders,承诺投入 10 亿美元。该计划将扩大前沿网络安全 AI 的使用,并为关键服务提供培训与支持。
H Company 发布 NeoMME 系列 260M 和 800M 多语言多模态编码器,用单个双向 Transformer 处理文本和 32×32 图像 patch,从零以掩码离散扩散目标训练,无需独立视觉塔或因果语言模型。
Playco 使用 GPT-6 Astra 从一个 grey box 基础构建了三个主题游戏原型,人工修复量比使用上一代模型减少 50%。
Legora 使用 GPT-6 Astra 在数分钟内审阅 41 份文档,找出全部四处植入错误,该财务审阅工作流性能提升近 40%。
OpenAI 发布 GPT-6 Astra,称其为客户度和对齐水平最高的新一代模型。官方称其在计算机操作、编码、网络安全和科学方面具备 SOTA 能力。
推荐理由:OpenAI 官方宣布新一代模型,可据此了解 GPT-6 Astra 的定位和重点能力方向。
Hugging Face 发布开源工具 funes,为 Claude Code、Codex、pi、Hermes 等编码智能体提供持久记忆层,基于机器上已有的会话记录构建,本地索引与检索,一条 funes add 命令即可接入。
推荐理由:官方介绍这款本地优先的智能体记忆层,给出了安装方式、检索管线设计和跨机器共享机制,可评估是否纳入自己的编码工作流。
Hugging Face 工程师用 TRL 和 OpenEnv 开源复现了 Surya Narreddi 的项目:训练语言模型写 JavaScript(通过 p5.brush)绘制水彩画。
Hugging Face 发布教程,展示用 TRL 库以 GRPO 微调 LiquidAI/LFM2.5-350M 提升结构化输出合规率。训练仅用约 500 样本和 100 步,可在免费版 Colab 或 Kaggle GPU 上运行,评测经 llama.cpp 在 MacBook 本地完成。
推荐理由:原文给出完整可复现的 GRPO 微调流程和量化前后对比,读者可以用同样低成本方法提升小模型的结构化输出合规率。
OpenAI 发布 GPT-6 Astra 安全概述,称其为公司最强广泛部署模型,也是首个在其 Preparedness Framework 下达到网络安全能力 Critical 级别的模型。
推荐理由:官方安全概述说明 GPT-6 Astra 达到 Preparedness Framework 网络安全 Critical 级,可帮助读者了解其部署风险定位。
Google DeepMind 推出 Fairwind 计划,向政府机构和受信任的合作伙伴开放先进的网络防御能力。该计划将 Gemini 3.8 Flash Cyber 模型与 CodeMender 结合,可自主查找、验证并修复漏洞,在几分钟内生成就绪的补丁,初始访问面向政府、关键基础设施运营商和核心技术平台。
Google DeepMind 发布 Gemini 3.8 Flash 和 3.8 Flash Cyber,称其为迄今最佳推理与编码模型,定价与 3.7 Flash 相同(每百万输入 token $0.75、输出 $3.75)。
推荐理由:官方公布了两个变体的基准数字、定价和 Cyber 版的申请入口,读者可据此评估升级成本与实际收益。