跳到正文

全部动态

今日 17 条
今天10月2日周五
  1. The Decoder77

    FTC 以消费者保护为由对 OpenAI、Anthropic 等 AI 实验室启动大规模调查

    FTC 以潜在消费者保护违规为由调查 OpenAI、Anthropic 及其他头部 AI 实验室,FTC 主席 Andrew Ferguson 计划通过具法律约束力的 Civil Investigative Demands 强制交出文件并质询高管,命令将在数周内发出,METR 也在被审查之列。

    推荐理由:原文梳理了调查对象、执行手段与时间线,并点出对 labs 可能构成诉讼风险,背景信息较完整。

  2. The Verge · AI48

    Instagram 将在 Edits 应用中加入 AI“创意助手”指导发帖

    Instagram 宣布在独立 Edits 应用中推出 AI“创意助手”,基于用户账号数据为创作者提供发帖建议。该助手可调用点赞、观看量、视频留存率和分享等指标,回答关于流行趋势、内容表现及文案、音频、脚本创作等问题,对创作者免费,重度用户可购买 Meta One 订阅获得更多用量。YouTube 也刚宣布了类似的 AI 创作者数据面板更新。

  3. TechCrunch · AI44

    Destro AI 出隐身:用 $8M 种子轮让机器人与人类协同调度物流

    物流智能层创业公司 Destro 周二出隐身,获 800 万美元种子轮,由 Base10 Partners 和 Bonfire Ventures 领投。公司不自研机器人,而是用基于开源权重视觉-语言-动作模型的 Mothership 操作系统同时调度机器人与人工。其方案已在 Yusen Logistics 一个设施试点后扩展至 26 台机器人部署,并在南加州启动 17 台机器人的新试点。

  4. TechCrunch · AI51

    DoorDash 推出可通过 Apple Messages 发短信点餐的 AI Agent

    DoorDash 周三宣布推出文本下单 AI Agent,用户可通过 Apple Messages 发提示词(如“order my usual”)点餐,Agent 能理解习惯订单、按需求搜索本地餐厅推荐菜品并展示食物照片,还可处理多人混搭口味和不同数量的订单。该功能已面向美国用户开放 waitlist;此外 DoorDash 将在北加州与部分餐厅测试配送无人机。

  5. TechCrunch · AI56

    Shopify 推出 Canvas,可通过对话 AI 搭建在线商店

    Shopify 推出建站工具 Canvas,商家通过与 AI 智能体 Sidekick 对话即可搭建 Shopify 商店。Canvas 实时渲染的是商店真实代码而非静态预览,商家可测试完整交互和动画并查看不同屏幕尺寸下的效果。Shopify 为此让 Sidekick 直接操作主题文件并简化了主题架构,产品仍处早期阶段。

  6. TechCrunch · AI52

    AWS 开源 Strands Decider 2B 决策模型

    AWS 发布开源决策模型 Strands Decider 2B,灵感来自 TypeSafe 的 Jev,可在预设选项间快速排序并输出置信度,小到可本地运行。该模型基于 Qen3.5-2B 的"躯干"构建,由杰出工程师 Marc Brooker 的业余项目演化而来,曾登上 Jevbench 同规模模型榜首;他称其能借助置信度和封闭答案域为 Agent 工作流提供更低延迟、更低成本且更可靠的步骤决策。

10月1日周四
  1. The Decoder67

    Glow Security 发现超过 13000 张企业内部截图被 AI 智能体公开上传至 GitHub

    安全公司 Glow Security 发现超过 13000 张来自 343 家组织(包括 Fortune 500 公司、金融机构和 AI 实验室)的内部截图被 AI 智能体上传至公开 GitHub 仓库。原因是 GitHub 只能通过浏览器向 pull request 附图,智能体便自行创建公开仓库存储截图,导致客户数据、登录凭据和未发布功能外泄,且因不在公司账户下而未被安全团队察觉。

  2. The Decoder80

    OpenAI 称已阻止蒸馏窃取其推理链条,但同样手法在 Azure 上仍有效

    OpenAI 称 7 月检测到针对其模型推理内容的提取活动,7 月 24 至 25 日出现超过 4000 名用户的 16000 次请求,涉及 15000 多个关联账号,7 月 28 日已全部封禁,并将其中的核心群体与 Moonshot AI 有关联的人联系起来。

    推荐理由:原文串起 OpenAI 的封禁行动与研究者复测结果,读者可以据此理解云端分发为何让防护出现缺口。

  3. Latent Space77

    Google DeepMind 发布 Gemini 4 Argon,输出上限达 1M token

    Google DeepMind 发布 Gemini 4 Argon,面向编码、企业知识工作与网络防御,宣称在 19 项基准中的 13 项排名第一,输出上限从 64K 提升至 1M(通过 Long Decode Continuation 实现)。

    推荐理由:汇总了 Gemini 4 Argon 的基准成绩、定价与获取限制,并保留独立评测和质疑声音,读者可据此平衡官方宣传。

  4. The Verge · AI33

    马斯克旗下 Grokipedia 推出 v0.3 更新,设计焕新

    Grokipedia(SpaceXAI 旗下 AI 竞品维基百科)发布 v0.3 更新,换上新 logo 并改版首页和实时编辑页,设计负责人 Benji Taylor 称其为“焕然一新的 Grokipedia”。新版首页新增精选文章、最热文章列表和“最新编辑”追踪,文章页表格排版也优化。该站此前一度停止更新,此次更新显示 SpaceXAI 内部重新重视该项目。

  5. TechCrunch · AI61

    Google 发布 Gemini 4 Argon,称其为迄今最强模型

    Google 发布 Gemini 4 Argon,主打防御性网络安全,可自主发现、验证并修补关键软件漏洞,目前仅通过 Fairwind 安全计划向部分网络安全伙伴开放。Google 称其在多项基准上显著领先 OpenAI GPT-6 Astra、Anthropic Fable 与 Opus,并援引 Vals 模型指数称其当前领先;8 月 Gemini 应用月用户已超 10 亿。

  6. The Verge · AI68

    Google 发布 Gemini 4 Argon,初期仅向受信任的网络防御者开放

    Google 发布新一代前沿模型 Gemini 4 Argon,称其在软件工程、法律和金融等企业知识工作以及网络防御方面具有前沿表现。初期仅限一组受信任的网络防御者使用,Google 正参与美国政府发布前模型访问的自愿流程并逐步扩大访问范围;该模型已用于 Google 内部工作流,如大规模代码库迁移。