avatarin 如何用 GPT-Realtime 打造 24/7 零售智能体
avatarin 利用 OpenAI 的 GPT-Realtime 为 Yamada Denki 购物者提供 24/7 多语言客服支持。上线两周内该智能体已服务 30,000 名用户,92% 的调查反馈为正面评价。
avatarin 利用 OpenAI 的 GPT-Realtime 为 Yamada Denki 购物者提供 24/7 多语言客服支持。上线两周内该智能体已服务 30,000 名用户,92% 的调查反馈为正面评价。
OpenAI 向 100,000 名学术研究人员免费提供 ChatGPT 最先进的 AI 模型,用于加速科学研究、协作与发现。
OpenAI 发布的一份领域报告显示,科学家正借助 AI 编程智能体升级科学计算,加速软件开发与科学发现,应用涵盖基因组学等领域。
Hugging Face 宣布 Diffusers 原生支持 Nunchaku 的 SVDQuant 4-bit 推理,通过 Nunchaku Lite 集成路径直接用 from_pretrained() 加载量化 checkpoint,无需独立推理引擎或本地 CUDA 编译。
推荐理由:Diffusers 原生集成 Nunchaku,W4A4 量化在降显存的同时也降低推理延迟,是可复现的部署方案变化。
OpenAI 在 ChatGPT 中推出 Health 功能,符合条件的美国用户可安全连接医疗记录和 Apple Health,获得更个性化的健康洞察,更好地理解自身健康状况。
OpenAI 推出 OpenAI Presence,一个企业级 AI 智能体平台,帮助组织部署可信的语音和聊天智能体,用于客户服务及内部工作流程。
NTT DATA Group 使用 ChatGPT Enterprise 和 Codex 帮助 9,000 名员工实现工作自动化,并将事故分析时间缩短至 30 分钟。该公司同时推进安全的 AI 规模化落地。
OpenAI 推出 ChatGPT for Small Businesses 计划,帮助创业者建立 AI 技能、自动化日常工作,并借助 ChatGPT Work 实现业务增长。该计划面向小企业主,提供 AI 技能培训与工作自动化支持。
Pollen Robotics 发布开源低成本系统 Grabette,用手持夹爪录制操作任务并自动转成机器人可用的 LeRobot 数据集,无需机器人或遥操作设备。
OpenAI 阐述青少年应获得安全 AI 访问的理由,并介绍其保护措施。OpenAI 正在为 ChatGPT 增加年龄适配的防护、学习工具和家长控制,并与专家合作。
Google DeepMind 与 Isomorphic Labs 于 2026 年 7 月 16 日发布联合的生物韧性方法,目标是防止模型被滥用,并帮助政府、科学家等利用 AI 提升应对未来疫情的能力。
Cars24 使用 OpenAI 驱动的语音与聊天智能体,每月处理超过 100 万分钟对话,并挽回 12% 的流失线索。公司还将智能体工作流推广到内部多个团队,加快业务构建速度。
OpenAI 推出自动化红队系统 GPT-Red,通过自博弈(self-play)机制实现鲁棒性的自我提升。该系统用于改进 AI 安全、对齐和提示词注入防御能力。
Google DeepMind 在印度推出 ATL Saathi 试点,这是一款基于 Gemini 的教育 Web 应用,为 Atal Tinkering Labs 教师提供 24/7 的备课与培训助手。
OpenAI 宣布 GPT-5.6 现已成为 Microsoft 365 Copilot 的首选模型。该模型为 Word、Excel、PowerPoint、Chat 和 Cowork 带来更强的 AI 能力,帮助用户更快完成更高质量的工作。
Mistral 推出 Studio,为企业的 Prompts 与 Skills 提供统一的 system of record,实现版本化、明确归属和全程可追溯。每个资产拥有不可变版本、审计日志和分类标签,支持快速迭代与受控上线,业务人员无需工程师也能直接改进生产指令。该功能现已向 Mistral Studio 客户开放,Skills 可作为 MCP servers 从 Studio 直接调用。
OpenAI 推出 GPT-5.5 Bio Bug Bounty 计划,公布该生物安全赏金项目的相关细节。
OpenAI 官方宣布推出 ChatGPT Work 智能体,可跨用户的应用和文件采取行动,必要时可持续跟进一个项目数小时,把目标变成完成的工作。
推荐理由:官方宣布 ChatGPT 可跨应用与文件执行操作,读者可以据此判断它能承接多长时间的自主项目式工作。
Hugging Face 宣布 vLLM 的 transformers modeling backend 在多类 LLM 架构上已达到甚至超过 vLLM 手写原生实现的吞吐。
推荐理由:原文给出三档 Qwen3 模型的吞吐对比和实现原理,读者可据此评估 transformers backend 能否替代手写 vLLM 实现来省掉移植成本。
Hugging Face 与 Amazon SageMaker AI 推出深度链接集成,开发者点击模型页上的 "Customize on SageMaker AI" 或 "Deploy on SageMaker AI" 按钮,即可直接进入 SageMaker Studio,模型已预加载、环境已配置。
Microsoft 在 Build 2026 上推出 Foundry Managed Compute,并在 Foundry 模型目录中上线 Hugging Face 精选模型集,数以千计的开源权重模型每周更新,可一键部署到 NVIDIA A100、H100 或 AMD MI300X 加速器。
推荐理由:原文来自双方官方博客,详细说明了精选目录、curation 流程、运行时选择和部署模板,读者可以据此评估在 Foundry 上部署开源模型的实际路径。
Australian Payments Plus(AP+)使用 ChatGPT Enterprise 和 Codex 应对支付业务的复杂性,从而加快工作速度。该公司节省了时间、提升了质量,并保持人工判断处于核心地位。
LeRobot v0.6.0 发布,引入 VLA-JEPA、FastWAM、LingBot-VA 三种会预测未来的世界模型策略,新增 GR00T N1.7、MolmoAct2、EO-1 等多个 VLA,以及统一奖励模型 API(Robometer、TOPReward)。
推荐理由:官方发布页完整列出各项新能力与配套工具,读者可以据此评估这次版本更新对机器人学习工作流的实际影响。
SkyPilot 与 Hugging Face 联合推出 store: hf,用一条 hf:// URL 即可将 Hugging Face Bucket 或任意 Hub 仓库挂载进 SkyPilot 任务,作业可调度到 20+ 云、Kubernetes 和本地集群。
推荐理由:原文给出 hf:// 挂载、零 egress 读费与 Xet 去重的具体数字,读者可据此评估多云 GPU 任务的数据存储方案。
Hugging Face 官方博客总结 🤗 Kernels 项目近几个月的重大更新。Hub 新增 kernel 仓库类型,可查看内核支持的加速器、操作系统和后端版本;默认只加载受信任发布者的内核,非受信来源需显式传 trust_remote_code=True,并引入基于 Sigstore cosign 的代码签名(加载时尚未默认验证)。
Hugging Face 与 Cerebras 发布开源级联语音到语音管线,语音识别用 Nvidia Parakeet,语言模型为 Google DeepMind Gemma 4 31B 并在 Cerebras 上推理,语音合成用 Qwen3TTS。
Google Research 将建筑级屋顶反照率数据扩展至 9 个国家的 50 多座城市,包括伦敦、里约热内卢和纽约,并通过新的高分辨率 Heat Resilience Earth Engine App 开放访问。
Hugging Face 宣布 Every Eval Ever(EEE)与 Community Evals 互通,支持交叉发布评测结果并链接完整 EEE 记录,官方账号提交的结果在 EvalEval 显示认证标记。
Google 将 Multi-Token Prediction(MTP)头附加到冻结权重的 Gemini Nano v3 模型上,已面向 Pixel 9 和 10 系列推出,可开箱即用地加速端侧 AI。
Google DeepMind 宣布 computer use 成为 Gemini 3.5 Flash 的内置工具,此前该能力仅以独立 Gemini 2.5 computer use 模型提供。
推荐理由:原文说明 computer use 从独立模型转为 Gemini 3.5 Flash 内置工具,并给出 API 入口和企业级安全防护选项。
Mistral 推出多项 Connectors 新功能:管理员可按 workspace 或 org 设置连接器访问权限并逐个开关工具,API keys 支持 connector scope 防止自动化任务冒充用户身份,多账号连接器支持一个连接器绑定多个登录账号。
OpenAI 推出 Daybreak 系列安全工具,包括 Codex Security 和 GPT-5.5-Cyber,帮助各类组织大规模查找、验证并修补漏洞。这些工具面向全球企业的安全防护场景。
OpenAI 推出 Patch the Planet,这是 Daybreak 旗下的一项计划,旨在帮助开源维护者借助 AI 和专家评审来发现、验证并修复安全漏洞。
OpenAI 为 ChatGPT Enterprise 推出全新的支出管控与用量分析功能。此次更新帮助企业更好地管理成本,更有信心地规模化部署 AI。
OpenAI 通过 GPT-5.5 Instant 改进 ChatGPT 的健康与养生类回答,带来更强的推理能力和更好的上下文理解。改进还包括更清晰的沟通表达,以及基于医生参与评估的评测方式。
研究人员使用 OpenAI 推理模型辅助诊断罕见遗传病,在以往未解决的病例中识别出 18 个新诊断。该成果针对的是影响儿童的罕见遗传疾病。
Hugging Face 联合 Microsoft、Google、GoDaddy 等贡献者发布 Agentic Resource Discovery(ARD)开放规范草案,定义如何通过联邦注册表对 Agent 能力进行编目、索引和自然语言搜索,让 Agent 在运行时发现 MCP 工具、A2A Agent 和 Skills,而无需预先安装配置。
推荐理由:原文介绍了 ARD 开放规范的设计细节和 Hugging Face 的参考实现,附 CLI 和 API 用法,可直接上手做运行时能力发现。
Google DeepMind 正与英国政府、Google Cloud、Faculty 及 Barnet、Dorset、Camden 三个地方规划部门合作,开发基于 Gemini 的 AI 规划原型,目标是把住宅规划申请的决策时间缩短 50%,以支持 2029 年前新建 150 万套住房的目标。
Google 发布 Farmscapes 的矢量化数据集,将英格兰高分辨率地图转化为可操作的树篱、石墙和小片林地清单,用于英国景观修复与碳核算。
Google DeepMind 发布 AI Control Roadmap,把内部 AI 智能体视为潜在未对齐的系统,在对齐之上叠加系统级安全防护。方案基于 MITRE ATT&CK 构建 AI 威胁建模框架,采用可信模型监督器做检测与拦截,并按模型逃避检测和造成危害的能力划分 D1-D4 与 R1-R3 安全等级。
推荐理由:原文提出以模型不可信为前提的系统级 AI Control 框架,并给出检测分级和百万轨迹的落地实践,对构建智能体安全有参考价值。