Instagram 将在 Edits 应用中加入 AI“创意助手”指导发帖
Instagram 宣布在独立 Edits 应用中推出 AI“创意助手”,基于用户账号数据为创作者提供发帖建议。该助手可调用点赞、观看量、视频留存率和分享等指标,回答关于流行趋势、内容表现及文案、音频、脚本创作等问题,对创作者免费,重度用户可购买 Meta One 订阅获得更多用量。YouTube 也刚宣布了类似的 AI 创作者数据面板更新。
Instagram 宣布在独立 Edits 应用中推出 AI“创意助手”,基于用户账号数据为创作者提供发帖建议。该助手可调用点赞、观看量、视频留存率和分享等指标,回答关于流行趋势、内容表现及文案、音频、脚本创作等问题,对创作者免费,重度用户可购买 Meta One 订阅获得更多用量。YouTube 也刚宣布了类似的 AI 创作者数据面板更新。
AI 创业公司 Instinct 推出新功能 Instinct Selections,通过与本地厨师、设计师、旅行向导等合作,在餐饮、旅行、购物等领域提供人工精选的个性化商品推荐。
DoorDash 周三宣布推出文本下单 AI Agent,用户可通过 Apple Messages 发提示词(如“order my usual”)点餐,Agent 能理解习惯订单、按需求搜索本地餐厅推荐菜品并展示食物照片,还可处理多人混搭口味和不同数量的订单。该功能已面向美国用户开放 waitlist;此外 DoorDash 将在北加州与部分餐厅测试配送无人机。
Shopify 推出建站工具 Canvas,商家通过与 AI 智能体 Sidekick 对话即可搭建 Shopify 商店。Canvas 实时渲染的是商店真实代码而非静态预览,商家可测试完整交互和动画并查看不同屏幕尺寸下的效果。Shopify 为此让 Sidekick 直接操作主题文件并简化了主题架构,产品仍处早期阶段。
统一集团数字平台 uniopen 通过 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行监督微调,并做提示词级输出优化,使其学会自身业务专属的内容审核策略。
AllenAI 发布开源训练框架 Olmo-core 3, redesigned MoE 训练系统,目标是将 MoE 训练扩展到万亿参数规模。基准测试显示,在 512 块 NVIDIA B300 GPU 上运行 1.2 万亿总参数模型达到 858 TFLOP/s/GPU,新栈比旧 FSDP 实现吞吐高约 2.7 倍;MXFP8 使吞吐比 BF16 提高约 21%。
OpenAI 在 DevDay 上发布由 GPT-6 Astra 驱动的智能体 Dots,定位为可委派长周期知识工作的付费专业工具,暂时仅面向每月 20 美元起的 Pro 及以上订阅用户。
听力科技初创公司 Legato 周四宣布,其 AI 听力眼镜 Legato Frames 正式开售,起价 $999,面向轻中度听损成人。眼镜通过 AI 区分人声与背景噪声并放大语音,采用双扬声器定向传声,在离耳几英寸处将漏音降低 99%;所有处理均在眼镜本地完成,无摄像头、不录音。
Grokipedia(SpaceXAI 旗下 AI 竞品维基百科)发布 v0.3 更新,换上新 logo 并改版首页和实时编辑页,设计负责人 Benji Taylor 称其为“焕然一新的 Grokipedia”。新版首页新增精选文章、最热文章列表和“最新编辑”追踪,文章页表格排版也优化。该站此前一度停止更新,此次更新显示 SpaceXAI 内部重新重视该项目。
Latent Space 在 OpenAI DevDay 当天采访主持 Computer Use 的 Ari Weinstein 和 API 团队的 Nikunj Handa。
OpenAI 在 Dev Day 上发布 Decisions API,功能类似 TypeSafe AI 本月早些时候发布的 Jev:让 Luna 模型在预定义选项中快速、低成本地做出分类或智能体行为决策。
Google 在 Gemini 聊天中全球推出 Skills,取代对标 OpenAI Custom GPTs 的 Gems,OpenAI 也在逐步淘汰 Custom GPTs。
Meta 发布 Muse AI 智能体,宣称可代发邮件、在线购物,前提是用户愿把数据和信用卡交给它。Meta 还公布了类似 Tamagotchi 的 Muse Charm 配件、Mac 应用、智能眼镜集成等计划,但产品也出现地址泄露、漏洞被攻击者控制等问题,Amazon 已封禁 Muse 智能体。
Google DeepMind 推出 SynthID Bio,将水印技术引入合成生物学,在保持蛋白质生物功能的同时嵌入可验证签名。
推荐理由:原文给出水印嵌入方式与湿实验结果,读者可以了解在蛋白质设计层建立生物安全验证机制的可复用思路。
Amazon Bedrock 宣布在印度通过地理跨区域推理提供 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,请求仅在 ap-south-1(孟买)和 ap-south-2(海得拉巴)两个区域间路由,满足数据本地处理需求。
Amazon Bedrock 现支持 Anthropic Claude 模型区域内推理:首尔区域提供 Claude Opus 5 和 Claude Sonnet 5,新加坡区域提供 Claude Sonnet 5。
Hugging Face 推出 Open TTS Leaderboard,用客观指标评估开源、多语言的 TTS 模型和声音克隆能力。评估采用 Qwen3 ASR 计算的 WER/CER 衡量可懂度、H200 GPU 上的 RTFx 与 TTFA 衡量速度、WavLM 嵌入余弦相似度衡量说话人相似度,使单个模型评估从数周缩短到数小时。
GPT-6.1 Sol 现已在 Amazon Bedrock 正式可用,作为 GPT-6 Sol 的重大升级,面向智能体编码、计算机使用和专业工作负载提供更强推理。
推荐理由:官方公告给出 GPT-6.1 Sol 上架 Bedrock 后的代理编码、成本对比与数据安全控制,读者可评估生产部署的可行性。
Simon Willison 在旧金山 Fort Mason 现场直播 OpenAI DevDay 2026。
推荐理由:作者亲历现场并记录了演示翻车等一手细节,可以补充发布会通稿之外的现场视角。
Microsoft Research 推出 Quine,一个结合生物学多模态世界模型与连接科学工具、文献和 wet lab 的交互 harness 的 AI 研究系统。
推荐理由:官方介绍 Quine 的世界模型与工具环路设计,并给出胰腺癌化合物筛选的湿实验验证结果,读者可据此评估 AI 驱动生物研究的路径。
OpenAI DevDay 2026 带来超过 20 项发布,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全能力以及面向开发者的新工具。
OpenAI 推出 dots,定位为可在复杂项目和日常任务中持续推进工作的主动式助手。官方说明 dots 在工作推进的同时帮助用户保持掌控,详情见 https://openai.com/index/introducing-dots。
xAI 的 Grok 4.7 现已登陆 Amazon Bedrock,提供 500K token 上下文窗口和 low、medium、high、xhigh 四档推理力度,经 us.xai.grok-4.7 或 global.xai.grok-4.7 跨区域推理配置接入,支持 Responses、Chat Completions 和 Converse API。
Simon Willison 发布 Bluesky reply bot checker,通过分析发帖速度、发帖时间、互动模式和问号使用等行为信号,判断 Bluesky 账号是否为自动回复机器人,并展示全部测量规则和触发信号最多的示例回复。
Simon Willison 于 2026 年 9 月 24 日发布了关于 commit-rewriter 0.2 的短讯。正文未提供更多功能或版本细节。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将低延迟流式视频与原生实时对话结合,让模型具备唇形同步、自然表情和流畅轮次切换的动态视觉形象。
NVIDIA 与 Google DeepMind、EMBL-EBI 等机构合作,通过 AlphaFold Database 开放发布超过 2,800 种病毒蛋白复合物的预测 3D 结构。
Google 发布 gemini-3.8-flash-tts 和 gemini-3.8-flash-lite-tts 两款文本转语音模型,提供超过 2,000 个内置声音,并支持用 30 秒音频样本创建自定义声音。
Google Private AI Compute 团队宣布为其平台增加私密的服务端持久 AI 记忆能力。用户数据保存在云端加密存储中,解密密钥仅存于个人设备,模型在硬件隔离的 secure enclave 中临时解密处理后再加密,连 Google 也无法访问。配套措施包括更新技术白皮书、防篡改的公开软件记录及第三方网络安全公司独立审计结果。
Simon Willison 于 9 月 22 日发布了 LLM 工具的 0.36 版本。原文仅提供发布信息,未说明具体更新内容。
Simon Willison 于 2026 年 9 月 22 日发布了 llm-anthropic 0.29。原文未提供该版本的具体更新内容,仅提到其 llm 项目和 anthropic 相关条目,并附带每月 LLM 重要动态邮件简报的 $10/month 赞助订阅信息。
Simon Willison 推出 LLM 插件 llm-typesafe 0.1a0,为 TypeSafe AI 新的 Jev 模型提供支持。
NVIDIA 在多伦多 ROSCon 大会上发布 Isaac ROS 5.0,新增面向智能体的工作流、Isaac skills 和对 ROS Lyrical 与 Ubuntu 24.04 的支持。
Hugging Face 宣布 transformers 支持通过 from_pretrained 直接加载 GGUF 量化模型,复用 ggml 的 Metal 内核以接近 llama.cpp 的性能。
推荐理由:官方介绍 transformers 直接加载 GGUF 的用法、量化选择和与 llama.cpp 的对比数据,对想在 Mac 上本地推理的开发者有实用参考。
NVIDIA 指出 Physical AI 规模化部署需要贯穿硬件、软件、AI 与运行环境全生命周期的安全体系,并推出 Halos——首个也是唯一的 Physical AI 全栈安全系统。
NVIDIA 在纽约气候周介绍五家将 AI 融入清洁能源项目的公司。ThinkLabs AI 用 NVIDIA CUDA 平台构建数字孪生和智能体,使 Southern California Edison 的电网互联申请评估时间从 30-45 天缩短到两分钟。
Hugging Face 发布 tokenizers v1 的 release candidate,在 Apple M4 Max 单线程上编码速度比 v0.23 快 3 到 30 倍(低端 t5-base,高端 gpt2),八线程扩展达线性的 76%。
推荐理由:Hugging Face 官方实测数据说明 tokenizers v1 为何能比 v0.23 快 3 到 30 倍,读者可以借此判断升级对训练和推理工作流的影响。
Google Research 推出一项研究实验,让教师利用生成式 UI(GenUI)动态创建定制化、有引导的教育模拟互动内容。团队已发布 30 多个面向初高中 STEM 学科的英文学习互动示例,全部由 AI 生成并经教师审核。使用 Google Workspace for Education 的学校可通过 Google for Education Pilot Program 报名提供反馈。
Pawprint Studio 的免费开放世界生物捕捉 RPG《Aniimo》于 9 月 15 日上线 GeForce NOW,玩家可捕捉 Aniimo 伙伴、与其 Twine 变形解谜战斗,无需下载 45GB 即可跨设备串流。
GitHub 用 Copilot agent 将 Copilot agent runtime 从 TypeScript 完整重写为 832,378 行生产 Rust,AI 编写了大部分代码,历时约 14.5 周、128 个 PR,采用原地逐组件替换而非一次性切换,性能有数量级提升。
推荐理由:一手复盘给出原地迁移策略、缓存命中率与子会话协作细节,对规划大规模 agent 辅助重写有可借鉴方法。