跳到正文

全部动态

今日 33 条
8月12日周三
  1. Google Research61

    Google Research 推出 AMIE (Video) 实现实时音视频临床问诊的专家级表现

    Google Research 发布 AMIE (Video),基于 Gemini 和 Project Astra 的实时视频问诊系统,采用 Talker、Planner、Perception 三个智能体并行工作的异步多智能体架构。

    推荐理由:原文给出研究架构、随机对照规模和关键结果,读者可以了解视频问诊 AI 与真人医生对比的具体依据和局限。

8月11日周二
  1. OpenAI News60

    OpenAI 开始在 ChatGPT 中测试广告

    OpenAI 开始在 ChatGPT 中测试广告,目的是支持免费访问。官方称广告将清晰标注、不影响回答独立性,并提供隐私保护与用户控制。

    推荐理由:OpenAI 官方说明在 ChatGPT 测试广告的定位与边界,涉及标注、答案独立性和用户控制,可帮助理解其商业化方向。

8月10日周一
8月7日周五
8月6日周四
  1. Google DeepMind78

    Google DeepMind 开源 WeatherNext 气旋预报模型,提前量超过 24 小时

    Google DeepMind 在 Nature 发表论文并开源 WeatherNext 2 和 WeatherNext Cyclones 模型,单一 AI 模型即可预测气旋路径、强度和风结构,平均多出超过 24 小时的预报提前量,相当于过去 20 年趋势下约十年的气象进步。

    推荐理由:Google DeepMind 官方发布并开源了模型权重,读者可以结合 Nature 论文数据评估其对气旋预报工作流的实际改进。

  2. Hugging Face Blog45

    Baseten 入驻 Hugging Face Inference Providers

    Baseten 正式成为 Hugging Face Hub 支持的 Inference Provider,为 Hub 模型页面增强 serverless 推理能力。初始集成支持对话和文本生成任务,可调用 Kimi K3、DeepSeek V4 Flash、GLM-5.2 等开放权重 LLM。用户可设置自己的 API key 直连或经 HF 路由计费,PRO 用户每月获 $2 推理额度。

8月5日周三
8月4日周二
  1. Mistral AI58

    Mistral 发布开源多模态安全分类模型 Shieldstral,Apache 2.0 权重可自由下载

    Mistral 发布 3B 开源多模态安全分类模型 Shieldstral,以 Apache 2.0 权重开放下载。它把内容审核建模为策略自适应的问答任务,推理时用自然语言写入审核政策即可返回校准的安全分数,无需重训练,可统一处理文本、图像及提示-回复对。官方称其在文本安全、拒答检测和多模态审核上匹配或超过最大 7 倍于其体积的开源护栏模型,可在单张 16GB GPU 上运行。

  2. Microsoft Research76

    Microsoft Research 开源 Orchard 智能体研究框架

    Microsoft Research 发布开源框架 Orchard,核心是可复用的 Kubernetes 环境服务 Orchard Env,支持软件工程、网页导航和个人助理智能体的训练与评估,并可直接在 Codex、OpenClaw、ZeroClaw 等真实部署 harness 中训练。

    推荐理由:开源框架把环境层做成可复用服务,并支持直接在真实部署 harness 中训练,为低成本研究智能体提供了可复用的路径。

8月3日周一
  1. Import AI48

    Import AI 467:自持自复制的 AI 病毒、AI 进展节奏与 AI 与创造力的困惑

    多伦多大学、Vector Institute、剑桥大学与 ServiceNow 的研究者构建了一个用开源权重 LLM 驱动的自复制计算机蠕虫原型:被攻陷主机的 GPU 上运行 LLM 进行推理,自主发现漏洞并感染新目标,单 GPU(80GB A100)即可运行且不依赖厂商 API。漏洞检测成功率约 80%,利用约 53%,自复制 88%,完整攻击总体成功率约 37%。

8月1日周六
7月31日周五