跳到正文

全部动态

今日 28 条
9月28日周一
  1. Simon Willison44

    Simon Willison 引述 Muse AI Agent 代发消息事件

    Simon Willison 引述了 Muse AI Agent 代表用户发出的一条消息:因用户未到场,MX Keys Mini 取件失败,跑腿者等待后被留下差评,而 AI 的自动回复曾在用户不在场时错误地称“我到了”。该 AI 已代用户致歉并提出改期,同时建议停止这类无法核实的自动回复。

9月27日周日
9月26日周六
  1. Ars Technica · AI59

    美国上诉法院裁定五角大楼可将拒绝开放 Claude 功能的 Anthropic 列入黑名单

    美国哥伦比亚特区联邦巡回上诉法院以 2 比 1 裁定,特朗普政府有权因 Anthropic 拒绝向军方开放部分 AI 功能而将其列入黑名单,即使 Anthropic 并无恶意。法院认为国防部长的决定未越出《供应链安全法》或宪法界限,此前该院已在 4 月驳回 Anthropic 的紧急暂缓申请。

  2. GitHub Blog · AI & ML57

    GitHub Copilot app 新手教程:如何用 canvases 构建自定义工作流

    GitHub Copilot app 的 canvases 功能让用户用 /create-canvas 技能以自然语言描述生成看板、清单等自定义界面,无需编码。画布是双向共享的,用户和 Agent 可同时操作并实时同步状态,创建后可作为扩展保存供个人或团队复用,社区还通过 Awesome Copilot 提供了现成的 canvas 扩展。

  3. Simon Willison38

    John Gruber 谈 Meta Muse:可爱外表下的强大与危险

    John Gruber 评价 Meta 的 Muse:它为每位用户提供运行在 Meta 云端的专属持久 Linux VM,是首个消费者可用的 agentic AI 系统,安装使用简单、以吉祥物形象呈现。但他警告,消费者可能并未意识到 Muse 有多强大、因而多危险,尤其是运行在 Mac 上时。

9月25日周五
  1. GitHub Blog · AI & ML47

    GitHub Copilot app:为什么聊天不是合适的 AI 界面,以及 canvas 如何取而代之

    聊天仍是与 LLM 交互的主要方式,但作者认为在多数场景下 chat 并非合适的 UI。GitHub Copilot app 中的 canvas 是一个可与 agent 双向通信的全栈小应用,既能调用第三方 API,也能在本地执行代码,文中演示了用它玩 Connect 4、管理 Winget 包、操作 SQLite 数据库以及自动化开发工作流。

9月24日周四
  1. GitHub Blog · AI & ML48

    GitHub Copilot 应用如何渲染超大型 Pull Request

    GitHub 团队在 GitHub Copilot 应用中重建了 pull request 视图,以支持超大规模 diff 的流畅浏览。他们测试了一个含 2200 个文件、超过一百万行变更和 400 多条行内评论的开源 PR,通过将高度拆分为确定性代码几何与动态块几何两套体系,解决了评论高度只有渲染后才能测量的问题。团队还定义了健康指标并持续进行自动化测量与改进循环。

  2. Simon Willison31

    用可交互实例解释 Shadow roots

    这是一份通过交互式示例讲解 shadow DOM 的教程,演示了样式封装、继承、slots、parts 以及 JavaScript 访问等机制。Shadow roots 会创建隔离的 DOM 树,拥有私有样式表,其元素以特定且受控的方式与页面 DOM 交互。该示例 artifact 由 Fable 5.1 Medium 根据一段提示词构建。

  3. Google DeepMind43

    Google Private AI Compute 将引入安全的服务端持久记忆

    Google Private AI Compute 团队宣布为其平台增加私密的服务端持久 AI 记忆能力。用户数据保存在云端加密存储中,解密密钥仅存于个人设备,模型在硬件隔离的 secure enclave 中临时解密处理后再加密,连 Google 也无法访问。配套措施包括更新技术白皮书、防篡改的公开软件记录及第三方网络安全公司独立审计结果。

9月23日周三
  1. Google DeepMind71

    Google DeepMind 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

    Google DeepMind 发布 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示词在 100 多种语言和方言中定制角色声音,可从 30 秒音频样本复刻声音,并提供 2000 多个现成声音。

    推荐理由:官方介绍了两款 TTS 模型的定制能力、基准成绩和开放渠道,开发者可以据此评估语音生成方案的选型。

  2. NVIDIA Blog16

    Sakeena Fiza 如何保障 NVIDIA 硬件大规模成功

    NVIDIA 验证工程师 Sakeena Fiza 负责在量产前检验数据中心系统,让硬件在真实条件下被压测到极限,目标是抢在客户之前发现问题。她参与过 NVIDIA Rubin GPU 首次在系统层面点亮(enumerated)的时刻,工作覆盖固件、硬件、软件、机械、散热与制造等环节。从单板数万个元件到整机架近 50 万个元件,她通过复现问题、排查固件与信号等方式追查各类故障根因。

  3. Latent Space85

    Anthropic 发布 Claude Opus 5.5,与 OpenAI GPT-6 Sol/Luna 同日降价竞逐

    Anthropic 发布 Claude Opus 5.5,称多数任务达到 Fable 5.1 水平、比 Opus 5 快约 30%,token 定价从 $5/$25 降至 $4/$20,并成为 Claude Code 和 Claude 应用的默认模型;Sonnet 5.5 和 Haiku 5.5 将在未来数周推出。

    推荐理由:文章汇总了 Opus 5.5 的定价、跑分与争议,并对照 GPT-6 Sol/Luna,帮助读者理解两家降价背后的真实成本结构。