跳到正文

产品更新

AI 产品与应用的功能上新、改版与商业化动态——谁家的产品变强了、变贵了、能用了。

113条精选相关主题模型发布行业动态AI 编码

最新精选

第 21–40 条 · 共 113 条
5月12日周二
  1. Google DeepMind64

    Google DeepMind 发布多智能体科研系统 Co-Scientist 并向个人研究者开放

    Google DeepMind 在 Nature 发表 Co-Scientist 研究,推出基于 Gemini 的多智能体 AI 系统,通过生成、辩论和进化假设迭代产生科研新假设,并通过 Hypothesis Generation 实验工具向个人研究者开放,未来几周开始推出,可在 labs.google/science 注册。

    推荐理由:官方发布完整介绍了 Co-Scientist 的多智能体架构、验证机制和多所高校实验室的实际应用结果,还给出了个人研究者注册入口。

5月6日周三
4月30日周四
  1. Google DeepMind62

    Google DeepMind 发布 AI co-clinician 医疗协作智能体研究计划

    Google DeepMind 宣布 AI co-clinician 研究计划,探索在医生监督下辅助患者照护的 AI 智能体。在 98 个真实初级诊疗问题的盲评中 97 例零严重错误,在 RxQA 开放式用药问答上超越现有前沿模型;在 120 次远程医疗模拟会诊中,专家医生整体表现仍优于该系统,但在 140 项评估中有 68 项达到或超过初级保健医生水平,目前定位为辅助工具而非替代临床判断。

    推荐理由:原文同时给出医生端与患者端的评估设计和结果,读者可以据此了解该系统当前的真实边界与局限。

4月23日周四
  1. Google Research61

    Google Photos Auto frame 上线 3D 视角重构功能,可自动调整照片拍摄角度

    Google 宣布将一种新的照片视角重构方法作为 Google Photos Auto frame 功能上线,用 ML 模型估计 3D 点图和相机参数,再由生成式扩散模型补全新视角下未拍摄到的区域。方法分 3D 场景与相机估计、生成式修补两阶段,可自动矫正广角前摄的透视畸变,对含人物的合格照片提供一键重构视角的备选结果。

    推荐理由:原文解释了将照片当作 3D 场景重建并重定位虚拟相机的两阶段方法,读者可以了解生成式修图与经典裁剪的区别。

4月15日周三
  1. Hugging Face Blog64

    HCompany 发布 Chrome 扩展 HoloTab,基于 Holo3 实现网页任务自动化

    HCompany 推出 Chrome 扩展 HoloTab,将其 3 月 31 日发布的 computer-use 模型 Holo3 直接带到浏览器中,无需配置即可在任何网站自动化操作。其 Routines 功能通过录屏和讲解生成可重复运行或定时执行的例程,适合比价、找工作等重复任务;产品目前免费开放使用。

    推荐理由:原文介绍了浏览器智能体的录制生成例程能力和免费入口,读者可以据此了解它如何把 computer-use 模型带入日常工作流。

4月1日周三
  1. Hugging Face Blog66

    Gradio 推出 gradio.Server,支持任意自定义前端搭配 Gradio 后端

    Hugging Face 发布 gradio.Server,一个扩展自 FastAPI 的类,让开发者用 React、Svelte 或原生 HTML/JS 等任意前端框架,同时保留 Gradio 的排队、并发管理、SSE 流式、gradio_client 兼容和 Spaces 上的 ZeroGPU 支持。

    推荐理由:官方介绍了 gradio.Server 如何让任意自定义前端继续复用 Gradio 的排队、MCP 和 ZeroGPU 能力,并附完整代码示例。

3月31日周二
3月29日周日
  1. Google DeepMind60

    Google DeepMind 探索 AI 指针,将指向交互带入 Chrome 与 Googlebook

    Google DeepMind 发布由 Gemini 驱动的 AI 指针实验项目,提出维持心流、展示即告知、善用 this/that、把像素变成可操作实体四项交互原则,让用户通过指向和语音代替复杂提示词。

    推荐理由:原文给出了AI指针的四项交互原则和落地场景,读者可以据此了解指向加语音如何替代复杂提示词。

3月10日周二
  1. Hugging Face Blog67

    Hugging Face Hub 推出 Storage Buckets 可变对象存储

    Hugging Face 在 Hub 上推出 Storage Buckets,一种不版本控制的可变、类 S3 对象存储,用于存放 checkpoints、处理后的数据、Agent traces 等中间产物。

    推荐理由:官方发布后明确解释了为什么中间产物不适合放 Git 仓库,并给出 CLI、Python、fsspec 的完整上手路径,便于迁移现有训练和数据流程。

3月9日周一
3月5日周四
  1. Hugging Face Blog66

    Hugging Face 推出 Modular Diffusers,用可组合积木构建扩散流水线

    Hugging Face 发布 Modular Diffusers,将扩散流水线拆成文本编码、去噪、解码等可独立运行、自由增删互换的可复用块,作为现有 DiffusionPipeline 的灵活补充。

    推荐理由:原文展示了用可组合积木搭建扩散流水线的完整用法,包括自定义块、模块化仓库和 Mellon 可视化集成,方法可直接复用。

2月27日周五
2月19日周四
2月9日周一
  1. Hugging Face Blog71

    Transformers.js v4 登陆 NPM,新增 WebGPU 运行时与众多新模型

    Hugging Face 发布 Transformers.js v4,已可在 NPM 安装,核心变化是采用 C++ 重写的 WebGPU Runtime,同一套代码可运行于浏览器、Node、Bun 和 Deno。

    推荐理由:官方发布说明完整列出 WebGPU 运行时重写、新架构支持和构建性能数据,读者可评估在浏览器或服务端本地跑模型的可行性。

2月2日周一
  1. OpenAI News69

    OpenAI 发布 macOS 版 Codex app

    OpenAI 发布面向 macOS 的 Codex app,定位为 AI 编码与软件开发的指挥中心。它支持多个智能体协作、并行工作流和长时间运行的任务。

    推荐理由:官方介绍 macOS 版 Codex app 的定位,涵盖多智能体、并行工作流和长时任务,可帮助读者判断它与现有编码工具的关系。

1月30日周五
1月28日周三
  1. Mistral AI64

    Mistral 发布终端原生编码智能体 Mistral Vibe 2.0

    Mistral 发布 Mistral Vibe 2.0,升级其终端原生编码智能体,由 Devstral 2 模型家族驱动,新增自定义 subagent、多选澄清、斜杠命令技能和统一 agent 模式,CLI 持续自动更新。

    推荐理由:官方公布 Vibe 2.0 的新增控制能力与 Devstral 2 转付费后的具体价格,读者可据此评估团队编码工作流的成本与用法。

12月17日周三
  1. OpenAI News69

    OpenAI 开放开发者向 ChatGPT 提交应用

    OpenAI 宣布开发者现在可以提交应用供审核并发布到 ChatGPT,通过审核的应用将出现在新的产品内目录中便于发现。更新的工具、指南和 Apps SDK 帮助开发者构建聊天原生体验,将现实世界操作带入 ChatGPT。

    推荐理由:官方宣布 ChatGPT 开放应用提交通道和新目录,开发者可据此了解应用上架流程与 Apps SDK 支持情况。

12月16日周二