uniopen 如何定制 Amazon Nova 以适配其零售内容审核策略并投入生产部署
统一集团数字平台 uniopen 通过 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行监督微调,并做提示词级输出优化,使其学会自身业务专属的内容审核策略。
统一集团数字平台 uniopen 通过 Amazon SageMaker AI 对 Amazon Nova 2 Lite 进行监督微调,并做提示词级输出优化,使其学会自身业务专属的内容审核策略。
CoreWeave 宣布 NVIDIA Vera Rubin NVL72 系统配套 Spectrum-X 102.4T 以太网在 CoreWeave Cloud 开放可用,Cognition 成为首个在生产中运行 Vera Rubin 的客户,早期测试显示其在 SWE-2 推理工作负载上相比 GB200 NVL72 token 总吞吐最高提升 4.8 倍。
Amazon Bedrock 宣布在印度通过地理跨区域推理提供 Anthropic 的 Claude Opus 5、Claude Sonnet 5 和 Claude Haiku 4.5,请求仅在 ap-south-1(孟买)和 ap-south-2(海得拉巴)两个区域间路由,满足数据本地处理需求。
Amazon Bedrock 现支持 Anthropic Claude 模型区域内推理:首尔区域提供 Claude Opus 5 和 Claude Sonnet 5,新加坡区域提供 Claude Sonnet 5。
OpenAI DevDay 2026 带来超过 20 项发布,涵盖 GPT-6 Astra、ChatGPT、Codex、API、安全能力以及面向开发者的新工具。
OpenAI 推出 dots,定位为可在复杂项目和日常任务中持续推进工作的主动式助手。官方说明 dots 在工作推进的同时帮助用户保持掌控,详情见 https://openai.com/index/introducing-dots。
Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,将低延迟流式视频与原生实时对话结合,让模型具备唇形同步、自然表情和流畅轮次切换的动态视觉形象。
Google Private AI Compute 团队宣布为其平台增加私密的服务端持久 AI 记忆能力。用户数据保存在云端加密存储中,解密密钥仅存于个人设备,模型在硬件隔离的 secure enclave 中临时解密处理后再加密,连 Google 也无法访问。配套措施包括更新技术白皮书、防篡改的公开软件记录及第三方网络安全公司独立审计结果。
invideo 使用 GPT‑6 Astra 提升视频编辑精度,色彩校正与调色效率提升三倍,并可在一天内制作 50 个自定义特效。
NVIDIA 在多伦多 ROSCon 大会上发布 Isaac ROS 5.0,新增面向智能体的工作流、Isaac skills 和对 ROS Lyrical 与 Ubuntu 24.04 的支持。
Hugging Face 宣布 transformers 支持通过 from_pretrained 直接加载 GGUF 量化模型,复用 ggml 的 Metal 内核以接近 llama.cpp 的性能。
推荐理由:官方介绍 transformers 直接加载 GGUF 的用法、量化选择和与 llama.cpp 的对比数据,对想在 Mac 上本地推理的开发者有实用参考。
NVIDIA 指出 Physical AI 规模化部署需要贯穿硬件、软件、AI 与运行环境全生命周期的安全体系,并推出 Halos——首个也是唯一的 Physical AI 全栈安全系统。
Higgsfield AI 使用 GPT-6 Astra 在一天内推出新的视频功能,为小企业简化视频广告制作,并更快地将新创意工具推向市场。
NVIDIA 在纽约气候周介绍五家将 AI 融入清洁能源项目的公司。ThinkLabs AI 用 NVIDIA CUDA 平台构建数字孪生和智能体,使 Southern California Edison 的电网互联申请评估时间从 30-45 天缩短到两分钟。
Google Research 推出一项研究实验,让教师利用生成式 UI(GenUI)动态创建定制化、有引导的教育模拟互动内容。团队已发布 30 多个面向初高中 STEM 学科的英文学习互动示例,全部由 AI 生成并经教师审核。使用 Google Workspace for Education 的学校可通过 Google for Education Pilot Program 报名提供反馈。
Pawprint Studio 的免费开放世界生物捕捉 RPG《Aniimo》于 9 月 15 日上线 GeForce NOW,玩家可捕捉 Aniimo 伙伴、与其 Twine 变形解谜战斗,无需下载 45GB 即可跨设备串流。
OpenAI 推出 AI 驱动的广告新体验,包括 Sponsored Agents 赞助智能体、面向营销人员的工具,以及与 HubSpot 和 Shopify 的集成。
ChatGPT Work 和 Codex analytics 可帮助团队了解 AI 使用与支出情况,识别培训需求,并将 AI 采用与业务成果关联起来,从而把 AI 使用转化为可衡量的业务价值。
Mistral 与 Mozilla 宣布合作,Firefox Smart Window(beta)AI 浏览助手现由 Mistral 模型驱动,首先面向法国和北美用户,英国和德国预计年内跟进。对话默认不保存在 Mozilla 服务器,Mistral 承诺零数据保留,模型针对地区语言、方言和文化语境做了微调。
曼彻斯特大学团队利用 NVIDIA Earth-2 的 CorrDiff 生成式模型训练出覆盖全英国、分辨率 2-3 平方公里的空气污染预报模型,训练仅在 Isambard-AI 超算的单个 8-GPU 节点上耗时两天完成。
Hugging Face 发布 Workflow1111,用 gr.Workflow 在单个画布上重建了 AUTOMATIC1111 的大部分功能,包含 11 条媒体管线和 73 个节点。
推荐理由:用 73 个节点在单一画布上复刻 AUTOMATIC1111 主要功能,并展示每个输出可直接变成 REST 端点和 MCP 工具的做法。
Google DeepMind 发布 AlphaGenome Atlas 平台,收录人类基因组约 90 亿个单核苷酸变体的分子效应预测,数据集达 1 PB,超过 AlphaFold 数据库 30 倍以上。
推荐理由:平台把 90 亿个单核苷酸变体的预测免费开放,配合 AVI 评分与案例结果,研究者在排序罕见病变体时可省去大量实验验证。
GitHub 推出 Project HydraFusion 研究预览,通过运行时多模型编排提供前沿级编码智能,所有 GitHub Copilot 计划用户可在 Copilot CLI 中通过 /experimental 使用,按各模型标准费率计费。
推荐理由:原文给出三种执行模式和跨基准的成本质量数据,读者可以据此判断多模型编排对编码工作流的实际取舍。
Playco 使用 GPT-6 Astra 从一个 grey box 基础构建了三个主题游戏原型,人工修复量比使用上一代模型减少 50%。
Hugging Face 发布开源工具 funes,为 Claude Code、Codex、pi、Hermes 等编码智能体提供持久记忆层,基于机器上已有的会话记录构建,本地索引与检索,一条 funes add 命令即可接入。
推荐理由:官方介绍这款本地优先的智能体记忆层,给出了安装方式、检索管线设计和跨机器共享机制,可评估是否纳入自己的编码工作流。
Google DeepMind 推出 Fairwind 计划,向政府机构和受信任的合作伙伴开放先进的网络防御能力。该计划将 Gemini 3.8 Flash Cyber 模型与 CodeMender 结合,可自主查找、验证并修复漏洞,在几分钟内生成就绪的补丁,初始访问面向政府、关键基础设施运营商和核心技术平台。
ATV Big Air Tour 使用 ChatGPT Work 加速营销、商品运营等工作流程。团队曾把商品照片转化为库存网站,仅用时 15 分钟,将原本 3 天的工作量压缩到 3 小时。
Google DeepMind 发布 agentic video understanding,覆盖 Gemini 3.7 Flash、3.6 Flash 和 3.5 Flash-Lite。
推荐理由:官方说明动态检索视频相比固定帧率处理的效率与精度变化,并给出 API 开启方式,适合评估长视频分析成本的开发者。
Polimill 利用 OpenAI GPT 模型和 Codex,帮助日本地方政府(municipalities)检索和使用行政知识,同时加速开发。该方案面向日本公共部门,构建新一代公共 AI 基础设施。
Voice Arena 与 Hugging Face 合作,在 Open ASR Leaderboard 引入 Monsoon en-IN 和 Monsoon hi-IN 两套评测集,覆盖 4,888 名说话人,印地语是该多语言榜单上首个非欧洲语言。
推荐理由:原文给出 Monsoon 四个评测集的采集设计与区域误差分析样例,读者可以了解带说话人元数据的 ASR 评测能揭示什么。
Google DeepMind 发布 Gemini Omni 1.1 Flash,通过 Gemini API 和 Google AI Studio 面向开发者提供更可控的生成视频能力。
推荐理由:官方发布了能力细节和 API 用法,开发者可以据此评估它在视频生成工作流中的可控性和成本。
Google DeepMind 推出 Gemini 3.5 Transcribe,定位为更精确的智能语音转写模型,能清除填充词、自动排版、支持自定义词表和 85 种以上语言。
推荐理由:官方发布文给出模型的能力细节、两项 API 入口和与 Chirp 3 的 WER 与延迟对比,开发者可据此评估语音转写方案选型。
Hugging Face 在 Gradio 中推出 gr.Workflow,把 AI 应用的多步骤流水线描述为类型化节点图,并提供可拖拽画布,每个节点可运行、中间结果可见。
推荐理由:原文来自官方,给出 gr.Workflow 的节点图机制、多个可复制的在线示例和 REST API 用法,读者可以直接上手复用这套搭建 AI 流水线的方法。
OpenAI 推出面向 ChatGPT Work 和 Codex 的 Admin 插件。管理员可用它分析工作区使用情况、管理成员和权限、调整限额,并处理管理员请求。
GPT‑5.6 现已在 Kiro 中可用,帮助开发者更高效地规划、构建、审查和测试软件,并提供更好的价格性能比。
Mistral 发布 Agentic Search,为模型提供 search、open、navigate、read、grep 五个工具,在现有索引上执行多步检索循环以处理复杂文档。
推荐理由:原文给出 Agentic Search 在 FinanceBench 和 OfficeQA Pro 上的具体数字,读者可以对照自己场景估算检索收益。
OpenAI 推出 ChatGPT for Teens,帮助青少年学习、培养批判性思维并自信地使用 AI。该版本内置更强的安全防护和健康使用功能,并为家长提供额外的控制选项。
Hugging Face 的 OlmoEarth Studio 现已支持计算并导出 OlmoEarth 开源基础模型的 embedding 向量,用于相似性搜索、分割等下游任务。
Mistral 推出三项主权 AI 举措:Mistral Regional Endpoints 正式可用,客户可选择推理在欧洲或美国运行;Mistral Priority Tier 进入公开预览,提供自定义速率限制和 uptime SLA。
NVIDIA 发布 Magpie TTS Multilingual,364M 参数开源权重模型,新增现代标准阿拉伯语、韩语和巴西葡萄牙语,共支持 12 种语言。