Endava 如何用 Codex 构建智能体组织
Endava 使用 Codex 构建智能体组织,加速软件交付,并将需求分析时间从数周缩短到数小时。
Endava 使用 Codex 构建智能体组织,加速软件交付,并将需求分析时间从数周缩短到数小时。
Mistral AI 发布开源框架 Search Toolkit 公共预览版,将数据摄取、检索与评估整合为单一框架,供企业构建生产级搜索管线。内置 BM25、稠密向量与混合检索,以及 recall、precision、MRR、NDCG 评估指标,模块共享统一配置接口;已在金融、制造、公共服务等行业验证,CMA CGM 配合 Voxtral 用于假新闻检测,音频管线端到端 15 秒内返回告警。
Mistral 收购 Emmi AI,进入物理 AI 领域,为工业工程构建新的基础能力。物理 AI 模型从求解器输出中学习,在单 GPU 上数秒内从几何与边界条件直接预测物理场,而传统 CFD/FEM 仿真每个设计变体需数小时到数周。该能力支持快速设计探索、工装与工艺优化和实时数字孪生,已服务于 ASML、Airbus、Safran 和 Siemens Energy 等合作伙伴。
OpenAI 与 Thrive、Crete 基于 Codex 构建了能自我改进的税务智能体,实现申报自动化。该智能体提升了准确性并加快了工作流程。
Hugging Face 在 TRL 中合入 Delta Weight Sync 功能(PR huggingface/trl#5417),将相邻 RL 步之间约 99% 未变化的 bf16 权重剔除,只编码变化元素为稀疏 safetensors 文件,经 Hub Bucket 供 vLLM 拉取。
Mistral 发布 Studio 中的 Connectors(Public Preview),内置连接器与自定义 MCP 可通过 API/SDK 用于所有模型和 Agent 调用。
Virgin Atlantic 使用 Codex 在固定的假日出行截止期限前完成了新版移动 App 的交付。该团队借此实现了接近全覆盖的单元测试,并做到零 P1 缺陷。
OpenAI 推进 AI 内容溯源,推出 Content Credentials、SynthID 及一款验证工具,帮助用户识别并信任 AI 生成的媒体内容。这些举措旨在提升 AI 生态的透明度与可信度。
Google DeepMind 介绍科学家 Omar Abudayyeh 与 Jonathan Gootenberg 实验室用 Co-Scientist 加速抗衰老基因研究。该系统扫描数万篇论文提出 20 多个可测试的新遗传因子,部分经实验验证能推动细胞脱离衰老状态、功能改善;原先需约六个月的筛选数据分析被缩短到几天。
PaddleOCR 3.5 通过新增 engine 参数让支持的模型(如 PP-OCRv5、PaddleOCR-VL 1.5)可用 Hugging Face Transformers 作为推理后端,并提供 engine_config 配置 dtype、设备与 attention 实现等选项。
Google DeepMind 在 Project Genie 中推出 Street View 街景落地能力,用户可选美国地点并套用 Ocean World、B&W film 等风格生成可交互世界,底层由 Maps Imagery Grounding 支撑。
Google 发布 Gemini for Science,包含 Google Labs 上三个实验性工具和 Google Antigravity 中的 Science Skills。
Google 于 2026 年 5 月宣布扩展内容透明度与验证工具,覆盖 Search、Gemini、Chrome、Pixel 和 Cloud。
推荐理由:原文给出 SynthID 验证入口扩展和 C2PA 检测的具体落地范围,读者可以据此了解内容溯源工具在自家产品中的可用变化。
剑桥大学 Clare Bryant 教授使用 Google DeepMind 的 Co-Scientist 研究病原体跨物种传播(如禽流感和人流感)时引发脓毒症等重症的分子开关。
Google DeepMind 的 AI 工具 Co-Scientist 正被 Calico Life Sciences 用于衰老研究,帮助整合零散的生物学发现并生成可检验的假设。Calico 团队利用它提出了关于整合应激反应(ISR)如何受代谢调控的新假设,并借助它优化实验设计。相关实验带来对 ISR 在健康与疾病中作用的新发现,团队计划发表结果。
爱丁堡大学 Filippo Menolascina 团队使用 Co-Scientist 研究 MASH(代谢功能障碍相关脂肪性肝炎),梳理文献并筛选候选联合疗法。系统针对为何药物 resmetirom 只对部分患者有效这一问题,提出 NLRP3 炎性小体是连接炎症与代谢的分子桥梁的假设,该假设后来经实验验证,或可推动靶向双重疗法。
MIT 的 Ritu Raman 与波士顿儿童医院的 Ryan Flynn 借助 Google DeepMind 的 Co-Scientist 跨领域合作研究 ALS。Co-Scientist 帮助 Raman 快速梳理原本需数月的庞杂文献,生成可检验的假设并按可行性与风险收益排序。双方正据此寻找可靶向 ALS 的 RNA 新机制,乃至潜在的 RNA 药物。
OpenAI 在 ChatGPT 中推出个人理财功能。用户可以连接自己的账户,追踪消费与投资、管理订阅、创建预算并规划财务目标。
OpenAI 宣布 Codex 可在 ChatGPT 手机应用中使用,支持随时处理编码任务。用户可以在移动设备与远程环境中实时监控、调整和批准编码任务。
Google DeepMind 在 Nature 发表 Co-Scientist 研究,推出基于 Gemini 的多智能体 AI 系统,通过生成、辩论和进化假设迭代产生科研新假设,并通过 Hypothesis Generation 实验工具向个人研究者开放,未来几周开始推出,可在 labs.google/science 注册。
推荐理由:官方发布完整介绍了 Co-Scientist 的多智能体架构、验证机制和多所高校实验室的实际应用结果,还给出了个人研究者注册入口。
NVIDIA 的工程与研究团队使用 Codex(搭配 GPT-5.5)交付生产系统,并把研究想法转化为可运行的实验。
OpenAI 开放 Campus Network 学生社团兴趣报名表,面向全球学生社团开放加入。成员可使用 AI 工具、举办活动,共同建设 AI 驱动的校园社区。
OpenAI 推出企业部署公司 DeployCo,帮助各组织将前沿 AI 投入生产环境,并转化为可衡量的业务成果。
OpenAI 宣布以 GPT-5.5 与 GPT-5.5-Cyber 扩展 Trusted Access for Cyber 项目,面向经核验的防御者开放。该项目旨在帮助安全研究人员加速漏洞研究,并保护关键基础设施。
Parloa 利用 OpenAI 模型构建可规模化的语音驱动 AI 客服智能体,帮助企业设计、模拟并部署可靠的实时交互服务。该方案让企业能够运行客户愿意与之对话的服务智能体。
OpenAI 在 ChatGPT 中推出可选安全功能 Trusted Contact:当检测到严重自我伤害风险时,会通知用户指定的信任联系人。
Google DeepMind 汇总 Gemini 驱动的编码智能体 AlphaEvolve 一年来的应用成果,并通过 Google Cloud 将其带给商业客户。
推荐理由:官方汇总了 AlphaEvolve 在医疗、电网、数学和商业客户中的具体成果数字,读者可以据此评估这类算法进化智能体的实际落地范围。
OpenAI 介绍了 ChatGPT 如何在了解世界的同时保护用户隐私:减少训练中的个人数据,并让用户可以选择自己的对话是否用于改进 AI 模型。
OpenAI 推出 ChatGPT Futures 2026 届,汇集 26 名运用 AI 进行构建、研究和推动现实影响的学生创新者。该项目展示了这一代人如何借助 ChatGPT 重新定义学习、创造力与机会。
Singular Bank 基于 ChatGPT 和 Codex 构建了内部助手 Singularity,帮助银行家在会议准备、投资组合分析和后续跟进等工作中每天节省 60–90 分钟。
OpenAI 以 Beta 形式扩展 ChatGPT 广告,推出自助式 Ads Manager、CPC 竞价和增强的衡量工具。官方称新功能以保护隐私为目标,广告与用户对话相互分离。
Google DeepMind 宣布 AI co-clinician 研究计划,探索在医生监督下辅助患者照护的 AI 智能体。在 98 个真实初级诊疗问题的盲评中 97 例零严重错误,在 RxQA 开放式用药问答上超越现有前沿模型;在 120 次远程医疗模拟会诊中,专家医生整体表现仍优于该系统,但在 140 项评估中有 68 项达到或超过初级保健医生水平,目前定位为辅助工具而非替代临床判断。
推荐理由:原文同时给出医生端与患者端的评估设计和结果,读者可以据此了解该系统当前的真实边界与局限。
OpenAI 解释了 GPT-5 行为中“地精”输出的来源,梳理了这类人格驱动的怪异输出在模型中传播的时间线、根本原因及修复措施。
DeepInfra 现已成为 Hugging Face Hub 支持的 Inference Provider,为开发者提供按 token 计价的低成本 serverless 推理服务。
OpenAI 宣布 GPT 模型、Codex 和 Managed Agents 现已登陆 AWS,企业可在 AWS 环境中构建安全的 AI 应用。
OpenAI 宣布 ChatGPT Enterprise 和 OpenAI API 获得 FedRAMP Moderate 授权,使美国联邦机构能够在合规框架下安全采用 AI。授权覆盖企业版产品与 API 两条使用路径。
Mistral AI 发布 Workflows 公开预览版,这是构建于 Studio 之上的企业 AI 编排层,提供持久执行、可观测性和人在环节点审批,帮助 AI 流程从概念验证走向生产环境。
食品分销公司 Choco 使用 OpenAI API 构建 AI 智能体,实现食品分销流程自动化。该方案帮助 Choco 提升了生产力并释放增长空间,是 AI 在实际业务中落地应用的客户案例。
Google 宣布将一种新的照片视角重构方法作为 Google Photos Auto frame 功能上线,用 ML 模型估计 3D 点图和相机参数,再由生成式扩散模型补全新视角下未拍摄到的区域。方法分 3D 场景与相机估计、生成式修补两阶段,可自动矫正广角前摄的透视畸变,对含人物的合格照片提供一键重构视角的备选结果。
推荐理由:原文解释了将照片当作 3D 场景重建并重定位虚拟相机的两阶段方法,读者可以了解生成式修图与经典裁剪的区别。
OpenAI 将 ChatGPT for Clinicians 免费提供给经认证的美国医生、执业护士和药剂师使用。该服务支持临床诊疗、文书记录和研究工作。