Ideogram 发布 Ideogram 4.5 图像模型,主打局部编辑不影响画面其余部分
Ideogram 发布新模型 Ideogram 4.5,声称编辑图像局部时不会破坏其余部分,只改动用户指定的区域。模型提供四档质量,价格从每张 0.8 到 22 美分,均为原生 2K 分辨率,现已上线 Ideogram 平台和 API,合作方包括 Picsart、Runway、Pika 和 Leonardo AI,开源权重版本也将推出。
Ideogram 发布新模型 Ideogram 4.5,声称编辑图像局部时不会破坏其余部分,只改动用户指定的区域。模型提供四档质量,价格从每张 0.8 到 22 美分,均为原生 2K 分辨率,现已上线 Ideogram 平台和 API,合作方包括 Picsart、Runway、Pika 和 Leonardo AI,开源权重版本也将推出。
DeepSeek 与华为合作,开源了面向昇腾芯片的编程工具,核心是源自北京大学的 TileLang 语言,DeepSeek 称其比 CUDA 编程模型更简单,并已用约一年、现为公司 AGI 工作的主要工具。
Instagram 宣布在独立 Edits 应用中推出 AI“创意助手”,基于用户账号数据为创作者提供发帖建议。该助手可调用点赞、观看量、视频留存率和分享等指标,回答关于流行趋势、内容表现及文案、音频、脚本创作等问题,对创作者免费,重度用户可购买 Meta One 订阅获得更多用量。YouTube 也刚宣布了类似的 AI 创作者数据面板更新。
AI 创业公司 Instinct 推出新功能 Instinct Selections,通过与本地厨师、设计师、旅行向导等合作,在餐饮、旅行、购物等领域提供人工精选的个性化商品推荐。
DoorDash 周三宣布推出文本下单 AI Agent,用户可通过 Apple Messages 发提示词(如“order my usual”)点餐,Agent 能理解习惯订单、按需求搜索本地餐厅推荐菜品并展示食物照片,还可处理多人混搭口味和不同数量的订单。该功能已面向美国用户开放 waitlist;此外 DoorDash 将在北加州与部分餐厅测试配送无人机。
Shopify 推出建站工具 Canvas,商家通过与 AI 智能体 Sidekick 对话即可搭建 Shopify 商店。Canvas 实时渲染的是商店真实代码而非静态预览,商家可测试完整交互和动画并查看不同屏幕尺寸下的效果。Shopify 为此让 Sidekick 直接操作主题文件并简化了主题架构,产品仍处早期阶段。
统一集团数字平台 uniopen 通过 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行监督微调,并做提示词级输出优化,使其学会自身业务专属的内容审核策略。
OpenAI 在 DevDay 上发布由 GPT-6 Astra 驱动的智能体 Dots,定位为可委派长周期知识工作的付费专业工具,暂时仅面向每月 20 美元起的 Pro 及以上订阅用户。
听力科技初创公司 Legato 周四宣布,其 AI 听力眼镜 Legato Frames 正式开售,起价 $999,面向轻中度听损成人。眼镜通过 AI 区分人声与背景噪声并放大语音,采用双扬声器定向传声,在离耳几英寸处将漏音降低 99%;所有处理均在眼镜本地完成,无摄像头、不录音。
Grokipedia(SpaceXAI 旗下 AI 竞品维基百科)发布 v0.3 更新,换上新 logo 并改版首页和实时编辑页,设计负责人 Benji Taylor 称其为“焕然一新的 Grokipedia”。新版首页新增精选文章、最热文章列表和“最新编辑”追踪,文章页表格排版也优化。该站此前一度停止更新,此次更新显示 SpaceXAI 内部重新重视该项目。
OpenAI 在 Dev Day 上发布 Decisions API,功能类似 TypeSafe AI 本月早些时候发布的 Jev:让 Luna 模型在预定义选项中快速、低成本地做出分类或智能体行为决策。
Google 在 Gemini 聊天中全球推出 Skills,取代对标 OpenAI Custom GPTs 的 Gems,OpenAI 也在逐步淘汰 Custom GPTs。
Meta 发布 Muse AI 智能体,宣称可代发邮件、在线购物,前提是用户愿把数据和信用卡交给它。Meta 还公布了类似 Tamagotchi 的 Muse Charm 配件、Mac 应用、智能眼镜集成等计划,但产品也出现地址泄露、漏洞被攻击者控制等问题,Amazon 已封禁 Muse 智能体。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统配套 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 开放可用,Cognition 成为首个在生产中运行 Vera Rubin 的客户,早期测试显示其在 SWE-2 推理工作负载上相比 GB200 NVL72 token 总吞吐最高提升 4.8 倍。
Amazon Bedrock 宣布在印度通过地理跨区域推理提供 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,请求仅在 ap-south-1(孟买)和 ap-south-2(海得拉巴)两个区域间路由,满足数据本地处理需求。
Amazon Bedrock 现支持 Anthropic Claude 模型区域内推理:首尔区域提供 Claude Opus 5 和 Claude Sonnet 5,新加坡区域提供 Claude Sonnet 5。
OpenAI DevDay 2026 带来超过 20 项发布,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全能力以及面向开发者的新工具。
OpenAI 推出 dots,定位为可在复杂项目和日常任务中持续推进工作的主动式助手。官方说明 dots 在工作推进的同时帮助用户保持掌控,详情见 https://openai.com/index/introducing-dots。
Simon Willison 于 2026 年 9 月 24 日发布了关于 commit-rewriter 0.2 的短讯。正文未提供更多功能或版本细节。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将低延迟流式视频与原生实时对话结合,让模型具备唇形同步、自然表情和流畅轮次切换的动态视觉形象。
Google 发布 gemini-3.8-flash-tts 和 gemini-3.8-flash-lite-tts 两款文本转语音模型,提供超过 2,000 个内置声音,并支持用 30 秒音频样本创建自定义声音。
Google Private AI Compute 团队宣布为其平台增加私密的服务端持久 AI 记忆能力。用户数据保存在云端加密存储中,解密密钥仅存于个人设备,模型在硬件隔离的 secure enclave 中临时解密处理后再加密,连 Google 也无法访问。配套措施包括更新技术白皮书、防篡改的公开软件记录及第三方网络安全公司独立审计结果。
Simon Willison 于 9 月 22 日发布了 LLM 工具的 0.36 版本。原文仅提供发布信息,未说明具体更新内容。
Simon Willison 于 2026 年 9 月 22 日发布了 llm-anthropic 0.29。原文未提供该版本的具体更新内容,仅提到其 llm 项目和 anthropic 相关条目,并附带每月 LLM 重要动态邮件简报的 $10/month 赞助订阅信息。
Simon Willison 推出 LLM 插件 llm-typesafe 0.1a0,为 TypeSafe AI 新的 Jev 模型提供支持。
NVIDIA 在多伦多 ROSCon 大会上发布 Isaac ROS 5.0,新增面向智能体的工作流、Isaac skills 和对 ROS Lyrical 与 Ubuntu 24.04 的支持。
Hugging Face 宣布 transformers 支持通过 from_pretrained 直接加载 GGUF 量化模型,复用 ggml 的 Metal 内核以接近 llama.cpp 的性能。
推荐理由:官方介绍 transformers 直接加载 GGUF 的用法、量化选择和与 llama.cpp 的对比数据,对想在 Mac 上本地推理的开发者有实用参考。
TypeSafe AI 上周发布 Jev,作者称其为 System One 或决策模型:接受文本输入但输出对应类别、是非题和评分的浮点数及置信度。定价只按输入 token 计费,为 $0.042/百万 token,低于 GPT-5 Nano 的 $0.05,适合分类、排序和搜索重排,作者同时提醒其黑箱性和潜在偏差风险。
NVIDIA 指出 Physical AI 规模化部署需要贯穿硬件、软件、AI 与运行环境全生命周期的安全体系,并推出 Halos——首个也是唯一的 Physical AI 全栈安全系统。
NVIDIA 在纽约气候周介绍五家将 AI 融入清洁能源项目的公司。ThinkLabs AI 用 NVIDIA CUDA 平台构建数字孪生和智能体,使 Southern California Edison 的电网互联申请评估时间从 30-45 天缩短到两分钟。
Google Research 推出一项研究实验,让教师利用生成式 UI(GenUI)动态创建定制化、有引导的教育模拟互动内容。团队已发布 30 多个面向初高中 STEM 学科的英文学习互动示例,全部由 AI 生成并经教师审核。使用 Google Workspace for Education 的学校可通过 Google for Education Pilot Program 报名提供反馈。
Pawprint Studio 的免费开放世界生物捕捉 RPG《Aniimo》于 9 月 15 日上线 GeForce NOW,玩家可捕捉 Aniimo 伙伴、与其 Twine 变形解谜战斗,无需下载 45GB 即可跨设备串流。
Mistral 与 Mozilla 宣布合作,Firefox Smart Window(beta)AI 浏览助手现由 Mistral 模型驱动,首先面向法国和北美用户,英国和德国预计年内跟进。对话默认不保存在 Mozilla 服务器,Mistral 承诺零数据保留,模型针对地区语言、方言和文化语境做了微调。
曼彻斯特大学团队利用 NVIDIA Earth-2 的 CorrDiff 生成式模型训练出覆盖全英国、分辨率 2-3 平方公里的空气污染预报模型,训练仅在 Isambard-AI 超算的单个 8-GPU 节点上耗时两天完成。
Hugging Face 发布 Workflow1111,用 gr.Workflow 在单个画布上重建了 AUTOMATIC1111 的大部分功能,包含 11 条媒体管线和 73 个节点。
推荐理由:用 73 个节点在单一画布上复刻 AUTOMATIC1111 主要功能,并展示每个输出可直接变成 REST 端点和 MCP 工具的做法。
Google DeepMind 发布 AlphaGenome Atlas 平台,收录人类基因组约 90 亿个单核苷酸变体的分子效应预测,数据集达 1 PB,超过 AlphaFold 数据库 30 倍以上。
推荐理由:平台把 90 亿个单核苷酸变体的预测免费开放,配合 AVI 评分与案例结果,研究者在排序罕见病变体时可省去大量实验验证。
GitHub 推出 Project HydraFusion 研究预览,通过运行时多模型编排提供前沿级编码智能,所有 GitHub Copilot 计划用户可在 Copilot CLI 中通过 /experimental 使用,按各模型标准费率计费。
推荐理由:原文给出三种执行模式和跨基准的成本质量数据,读者可以据此判断多模型编排对编码工作流的实际取舍。
Hugging Face 发布开源工具 funes,为 Claude Code、Codex、pi、Hermes 等编码智能体提供持久记忆层,基于机器上已有的会话记录构建,本地索引与检索,一条 funes add 命令即可接入。
推荐理由:官方介绍这款本地优先的智能体记忆层,给出了安装方式、检索管线设计和跨机器共享机制,可评估是否纳入自己的编码工作流。
Google DeepMind 推出 Fairwind 计划,向政府机构和受信任的合作伙伴开放先进的网络防御能力。该计划将 Gemini 3.8 Flash Cyber 模型与 CodeMender 结合,可自主查找、验证并修复漏洞,在几分钟内生成就绪的补丁,初始访问面向政府、关键基础设施运营商和核心技术平台。
Google DeepMind 发布 agentic video understanding,覆盖 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite。
推荐理由:官方说明动态检索视频相比固定帧率处理的效率与精度变化,并给出 API 开启方式,适合评估长视频分析成本的开发者。