跳到正文

#Agent

今日 1 条
今天10月2日周五
10月1日周四
9月29日周二
  1. Simon Willison25

    OpenAI Agent 安全负责人 @joedaroo 谈 AI 能力突跳对组织安全准备的挑战

    OpenAI 从事 Agent 安全工作的 @joedaroo 表示,模型在“cyber”、"swarming"、“message boards”等能力上的跳升速度之快出乎意料,而安全态势的建立需要时间,必须融入公司文化。他呼吁各组织反思:人员、系统和流程是否能应对 AI 能力的突然跳升,是否具备相应的事件响应与沟通机制。

9月28日周一
  1. Simon Willison44

    Simon Willison 引述 Muse AI Agent 代发消息事件

    Simon Willison 引述了 Muse AI Agent 代表用户发出的一条消息:因用户未到场,MX Keys Mini 取件失败,跑腿者等待后被留下差评,而 AI 的自动回复曾在用户不在场时错误地称“我到了”。该 AI 已代用户致歉并提出改期,同时建议停止这类无法核实的自动回复。

9月25日周五
9月24日周四
9月23日周三
9月21日周一
  1. NVIDIA Blog47

    NVIDIA:AI 安全是一个工程问题——如何在 Agent 技术栈的每一层解决它

    NVIDIA 提出 AI 安全应作为工程问题来对待,需要明确的防护要求、可执行的控制措施、指定负责人和防护有效的证据。安全防护应覆盖模型、harness 和运行环境的完整 Agent 技术栈,NVIDIA 开源的 OpenShell 提供了在 Agent 之外执行策略的沙箱运行时,Cisco 的 DefenseClaw 和 JFrog 在其上构建治理与技能扫描能力。

9月18日周五
  1. GitHub Blog · AI & ML36

    GitHub Podcast 探讨:要不要读 AI 生成代码、RAG 是否已死、Skills 是否取代了 MCP?

    GitHub Podcast 最新一期逐条拆解五个常见 AI 观点:AI 生成代码仍需人工审查,但注意力应放在高风险处;Skills 与 MCP 解决不同问题,前者提供打包的专业知识、后者提供工具与数据接入标准,二者可组合使用;RAG 也没有死,好的检索能让模型更接近答案,与 Agent、skills、MAG 等可共存于同一工作流。

9月14日周一
8月31日周一
7月7日周二
6月3日周三
5月6日周三
5月4日周一
4月21日周二
  1. Hugging Face Blog60

    Hugging Face 谈 AI 与网络安全的未来:为什么开放性至关重要

    Hugging Face 发文分析网络安全进入 AI 加速时代后的格局,认为关键在于模型所嵌入的系统而非模型本身,开放生态可在检测、验证、协调、补丁四个阶段分散风险、缩小攻防能力差距。文章主张防御方采用半自主 AI 智能体,配合开源安全工具在组织内部署,并保留人类审批与可审计的决策日志。

    推荐理由:原文从 Mythos 出发分析开放生态为何是防御方的结构性优势,并给出半自主智能体的可行防御路线。

10月30日周四
7月23日周三
1月13日周一
  1. Hugging Face Blog46

    AI 智能体已经到来,下一步怎么办?

    Hugging Face 概述了 AI 智能体的定义,并分析了其伦理权衡。文章提出,智能体的风险随自主性水平上升:用户让渡的控制越多,安全、隐私等风险越大,并建议不要开发能编写和执行自身代码的完全自主智能体,而半自主智能体的收益可能大于风险。