Google 推出 Gemini for Science:面向科学发现的 AI 实验与工具
Google 发布 Gemini for Science,包含 Google Labs 上三个实验性工具和 Google Antigravity 中的 Science Skills。
Google 发布 Gemini for Science,包含 Google Labs 上三个实验性工具和 Google Antigravity 中的 Science Skills。
Google 于 2026 年 5 月宣布扩展内容透明度与验证工具,覆盖 Search、Gemini、Chrome、Pixel 和 Cloud。
推荐理由:原文给出 SynthID 验证入口扩展和 C2PA 检测的具体落地范围,读者可以据此了解内容溯源工具在自家产品中的可用变化。
Google DeepMind 与新加坡政府合作,推动 AI 在医疗、教育、科研和可持续发展领域落地,包括探索 AI co-clinician 辅助诊疗、向全国中小学教师提供 Gemini for Education,并在亚太推出 "Google DeepMind Accelerator: AI for the Planet"。
剑桥大学 Clare Bryant 教授使用 Google DeepMind 的 Co-Scientist 研究病原体跨物种传播(如禽流感和人流感)时引发脓毒症等重症的分子开关。
Google DeepMind 的 AI 工具 Co-Scientist 正被 Calico Life Sciences 用于衰老研究,帮助整合零散的生物学发现并生成可检验的假设。Calico 团队利用它提出了关于整合应激反应(ISR)如何受代谢调控的新假设,并借助它优化实验设计。相关实验带来对 ISR 在健康与疾病中作用的新发现,团队计划发表结果。
爱丁堡大学 Filippo Menolascina 团队使用 Co-Scientist 研究 MASH(代谢功能障碍相关脂肪性肝炎),梳理文献并筛选候选联合疗法。系统针对为何药物 resmetirom 只对部分患者有效这一问题,提出 NLRP3 炎性小体是连接炎症与代谢的分子桥梁的假设,该假设后来经实验验证,或可推动靶向双重疗法。
MIT 的 Ritu Raman 与波士顿儿童医院的 Ryan Flynn 借助 Google DeepMind 的 Co-Scientist 跨领域合作研究 ALS。Co-Scientist 帮助 Raman 快速梳理原本需数月的庞杂文献,生成可检验的假设并按可行性与风险收益排序。双方正据此寻找可靶向 ALS 的 RNA 新机制,乃至潜在的 RNA 药物。
Stanford 大学医学院 Gary Peltz 团队在 Advanced Science 发表研究,用 Google DeepMind 的 Co-Scientist 从已有药物文献中筛选可重定位治疗肝纤维化的候选药。
Google DeepMind 发布复盘,其 AI 气象模型 WeatherNext 帮助美国国家飓风中心提前五天以 80% 置信度预测飓风 Melissa 将以五级强度登陆牙买加,三天前置信度升至接近 100%。
推荐理由:官方复盘了 WeatherNext 提前五天高置信度预测飓风 Melissa 强度跃升的过程,读者可以了解 AI 气象模型在路径与强度预测上的实际表现。
OpenAI 与马耳他达成合作,向所有公民提供 ChatGPT Plus,并提供培训帮助公民掌握实用 AI 技能、负责任地使用 AI。
Google DeepMind 发布 Gemini 3.5 模型系列,首个型号 3.5 Flash 当天全量开放,3.5 Pro 预计下月推出。
推荐理由:官方正文给出具体基准分数、速度对比和开放渠道,读者可据此评估 3.5 Flash 在智能体与编码场景的实用性。
ChatGPT Work 提供一套实操工作流,覆盖立项简报、战略更新、决策包和进度汇报等运营场景,帮助团队在具体工作中直接使用 ChatGPT。
OpenAI 在 ChatGPT 中推出个人理财功能。用户可以连接自己的账户,追踪消费与投资、管理订阅、创建预算并规划财务目标。
Databricks 在企业 Agent 工作流中采用 GPT-5.5。此前 GPT-5.5 在 OfficeQA Pro 基准上创下新的 SOTA 成绩。
Sea Limited 的 CPO 阐述了公司为何在工程团队中部署 Codex,以加速亚洲 AI 原生软件开发。文章讨论了 Sea 对智能体软件开发未来的看法。
IBM 发布 Granite Embedding Multilingual R2 两款 Apache 2.0 多语言嵌入模型:97M 紧凑版在 MTEB Multilingual Retrieval 得 60.3。
推荐理由:原文给出完整基准数据、训练方法与框架集成示例,读者可按规模和场景直接选型。
OpenAI 宣布 Codex 可在 ChatGPT 手机应用中使用,支持随时处理编码任务。用户可以在移动设备与远程环境中实时监控、调整和批准编码任务。
OpenAI 更新 ChatGPT 的安全功能,提升其在敏感对话中的上下文感知能力。新机制可随时间推移持续识别风险迹象,并作出更安全的回应。
Hugging Face 讲解如何将 CPU 与 GPU 工作负载分离,实现异步 continuous batching 以提升 LLM 推理性能。在使用 8B 模型、batch size 32 生成 8K token 的测试中,同步批处理有 24.0% 的时间 GPU 处于空闲等待,总耗时 300.6 秒;消除 CPU 开销可带来约 24% 的免加速。
OpenAI 构建了一个安全沙箱,使 Codex 能够在 Windows 上运行,并通过受控的文件访问和网络限制来保障安全。
OpenAI 介绍 ChatGPT Work 在财务场景中的实用工作流,涵盖报告、差异分析、预测、月度复盘及可直接用于决策的财务交付物。文章属于实操指南,重点展示如何把这些日常财务任务交给 ChatGPT Work 处理。
Google DeepMind 在 Nature 发表 Co-Scientist 研究,推出基于 Gemini 的多智能体 AI 系统,通过生成、辩论和进化假设迭代产生科研新假设,并通过 Hypothesis Generation 实验工具向个人研究者开放,未来几周开始推出,可在 labs.google/science 注册。
推荐理由:官方发布完整介绍了 Co-Scientist 的多智能体架构、验证机制和多所高校实验室的实际应用结果,还给出了个人研究者注册入口。
NVIDIA 的工程与研究团队使用 Codex(搭配 GPT-5.5)交付生产系统,并把研究想法转化为可运行的实验。
OpenAI 举办 Parameter Golf 活动,汇聚 1000+ 参与者和 2000+ 提交作品,探索 AI 辅助机器学习研究。活动在严格约束下覆盖 coding agents、量化和新型模型设计等方向。
德国汽车平台 AutoScout24 使用 OpenAI 的 Codex 与 ChatGPT 加速开发周期、提升代码质量,并扩大 AI 在工程团队中的应用。
Hugging Face 与 AWS 分析了基础模型预训练、后训练和推理生命周期所需的基础设施,提出由加速计算、高带宽低延迟网络和分布式存储构成的分层架构。
OpenAI 数据显示,ChatGPT 的使用在 2026 年第一季度大幅增长,其中 35 岁以上用户增长最快,性别使用分布也更加均衡。这表明 AI 正加速进入更广泛的主流人群。
Institute for Law & AI 研究者提出"激进可选性"(Radical Optionality)监管思路:短期内避免过度监管,同时提前投入建设应对强大 AI 的机构、信息渠道和法律权限。
OpenAI 探讨企业如何把 AI 从早期试验推进到规模化复利影响,关键在于建立信任、完善治理、优化工作流设计,并在规模化中保证质量。
OpenAI 开放 Campus Network 学生社团兴趣报名表,面向全球学生社团开放加入。成员可使用 AI 工具、举办活动,共同建设 AI 驱动的校园社区。
OpenAI 推出企业部署公司 DeployCo,帮助各组织将前沿 AI 投入生产环境,并转化为可衡量的业务成果。
OpenAI 介绍其如何在内部安全运行 Codex 编码智能体,做法包括沙箱隔离、审批机制、网络策略和面向 Agent 的遥测,以支持安全合规的编码智能体落地。
Berkeley AI Research 发布对并行推理领域的综述分析,主张让模型自主决定何时分解任务、并行多少线程以及如何协调。文章指出串行推理 token 线性增长会导致上下文过载(context-rot)和长达数十分钟的延迟,并评述了 ParaThinker、GroupThink、Hogwild! Inference 等近期方法,指出现有方法的并行结构仍由外部固定设定,而非模型自适应决定。
OpenAI 宣布以 GPT-5.5 与 GPT-5.5-Cyber 扩展 Trusted Access for Cyber 项目,面向经核验的防御者开放。该项目旨在帮助安全研究人员加速漏洞研究,并保护关键基础设施。
Parloa 利用 OpenAI 模型构建可规模化的语音驱动 AI 客服智能体,帮助企业设计、模拟并部署可靠的实时交互服务。该方案让企业能够运行客户愿意与之对话的服务智能体。
OpenAI 在 API 中发布新的 realtime 语音模型,支持推理、翻译和语音转写。官方称这些模型可支撑更自然、更智能的语音体验。
Simplex 采用 ChatGPT Enterprise 和 Codex 提升软件开发效率,缩短了设计、构建和测试所需的时间,并扩展了 AI 驱动的工作流。
OpenAI 在 ChatGPT 中推出可选安全功能 Trusted Contact:当检测到严重自我伤害风险时,会通知用户指定的信任联系人。
PipelineRL 在从 vLLM V0(0.8.5)迁移到 V1(0.18.1)时发现 train-inference 不匹配,影响 GSPO 训练的 clip rate、KL、entropy 和 reward。
Google DeepMind 汇总 Gemini 驱动的编码智能体 AlphaEvolve 一年来的应用成果,并通过 Google Cloud 将其带给商业客户。
推荐理由:官方汇总了 AlphaEvolve 在医疗、电网、数学和商业客户中的具体成果数字,读者可以据此评估这类算法进化智能体的实际落地范围。