OpenAI 推出金融服务 AI 资源中心
OpenAI 为金融服务业提供一站式 AI 资源,包括提示词包、GPTs、指南和工具,帮助金融机构安全地部署和扩展 AI 应用。
OpenAI 为金融服务业提供一站式 AI 资源,包括提示词包、GPTs、指南和工具,帮助金融机构安全地部署和扩展 AI 应用。
OpenAI 发布 ChatGPT 提示词基础指南,讲解如何编写清晰、有效的 prompt,以从 ChatGPT 获得更好、更有用的回答。原文信息较少,核心就是提供提示词写作的基础方法,帮助用户提升与 ChatGPT 的对话效果。
Google Research 发布 ConvApparel 数据集,包含 4,000 多段服装购物领域的人机多轮对话(近 15,000 轮),用于量化 LLM 用户模拟器与真实人类行为的“真实感差距”。
Overworld 发布实时视频世界模型 Waypoint-1.5,权重已上传 Hugging Face。在 RTX 3090 至 5090 桌面硬件上可实时生成最高 720p、60 FPS 的交互环境,另提供面向游戏笔记本等更广消费级硬件的 360p 档位,Apple Silicon 支持即将推出。
推荐理由:原文给出两档模型的具体硬件门槛、帧率分辨率和约百倍数据训练规模,读者可据此判断自己的设备能否本地运行。
Hugging Face 发布 Sentence Transformers v5.4,用户可用同一套 API 对文本、图像、音频和视频进行嵌入编码与相关性重排。
推荐理由:官方教程给出 v5.4 多模态嵌入与重排的完整用法、代码示例和支持模型清单,读者可以直接照着搭建跨模态检索或 RAG 流程。
CyberAgent 在广告、媒体和游戏业务中使用 ChatGPT Enterprise 和 Codex,安全地扩大 AI 应用规模。此举帮助公司提升质量并加快决策速度。
Google Research 推出两个学术智能体框架:PaperVizAgent(原 PaperBanana)用于从论文文本生成可发表的学术图表,ScholarPeer 则自动执行严格的同行评审。
OpenAI 阐述企业 AI 的下一个阶段,称各行业的企业级 AI 采用正在加速。该阶段的核心包括 Frontier、ChatGPT Enterprise、Codex 以及覆盖全公司的 AI 智能体。
OpenAI 推出儿童安全蓝图(Child Safety Blueprint),为负责任地构建 AI 提供路线图。该蓝图涵盖安全防护措施、适龄设计,以及协作机制,旨在保护并赋能网络上的青少年。
Hugging Face 宣布 Safetensors 作为基金会托管项目加入 PyTorch Foundation(隶属 Linux Foundation),与 DeepSpeed、vLLM、Ray 等并列。
OpenAI 宣布推出 Safety Fellowship 试点项目,支持独立的安全与对齐研究。该项目旨在培养下一代 AI 安全领域人才。
Google Research 发布评估 LLM 行为倾向对齐的研究,基于 IRI、ERQ 等标准化心理问卷生成情境判断测试(SJT),在职业沉着、冲突解决、订旅行等现实场景中比较模型与 550 名参与者的人类偏好分布。
Google DeepMind 发布 Gemma 4 开源模型,基于 Gemini 3 技术,主打高级推理和智能体工作流。提供 E2B、E4B、26B MoE(推理时仅激活 3.8B 参数)和 31B Dense 四种尺寸,31B 在 Arena AI 文本排行榜上位列全球开源模型第 3,采用 Apache 2.0 许可,支持 128K-256K 上下文窗口、原生多模态和 140+ 语言。
推荐理由:原文给出了四个尺寸、基准排名和部署细节,读者可以据此判断在本地和端侧硬件上的可用性。
OpenAI 宣布收购科技媒体 TBPN,以加速全球范围内围绕 AI 的对话并支持独立媒体,拓展与开发者、企业及更广泛科技社区的交流。
OpenAI 的 Codex 为 ChatGPT Business 和 Enterprise 用户新增按量付费定价,为团队提供更灵活的采用与扩展方式。此前团队用户只能按固定套餐使用,新模式可帮助团队从少量使用起步并随需求增长扩大规模。
Google DeepMind 发布 Gemma 4 多模态模型系列,共五个尺寸(E2B、E4B、12B Unified、31B、26B A4B MoE),采用 Apache 2.0 许可,支持图像、文本和音频输入,上下文窗口最高 256K。
推荐理由:Hugging Face 官方详解 Gemma 4 架构、多模态能力与全生态部署方式,还覆盖 DiffusionGemma 和推理加速等上手细节。
TII Falcon Vision 团队发布 Falcon Perception,一个 0.6B 参数的早融合 Transformer,用混合注意力掩码处理图像块与文本,做自然语言提示的开放词汇定位与分割,在 SA-Co 上达到 68.0 Macro-F1(SAM 3 为 62.3),但在 presence calibration 上落后(MCC 0.64 vs 0.82)。
推荐理由:TII 自述用单一早融合 Transformer 做开放词汇感知,读者可以看到架构、数据配方和 SA-Co 与 PBench 上的具体对比依据。
Gradient Labs 基于 GPT-4.1 和 GPT-5.4 mini、nano 构建 AI 智能体,为每位银行客户提供 AI 客户经理,自动化银行支持工作流程。该方案具备低延迟和高可靠性。
Hugging Face 发布 gradio.Server,一个扩展自 FastAPI 的类,让开发者用 React、Svelte 或原生 HTML/JS 等任意前端框架,同时保留 Gradio 的排队、并发管理、SSE 流式、gradio_client 兼容和 Spaces 上的 ZeroGPU 支持。
推荐理由:官方介绍了 gradio.Server 如何让任意自定义前端继续复用 Gradio 的排队、MCP 和 ZeroGPU 能力,并附完整代码示例。
Google Research 在论文 "Forest vs Tree: The (N,K) Trade-off in Reproducible ML Evaluation" 中研究了 AI 评测中每题标注数(K)与标注条目数(N)之间的可复现性权衡,模拟器已开源在 GitHub。
IBM 发布 Granite 4.0 3B Vision,一个面向企业文档理解的小型视觉语言模型,以 LoRA 适配器形式叠加在 Granite 4.0 Micro 上,主打表格提取、图表理解和语义键值对提取。
OpenAI 宣布获得 1220 亿美元新融资,用于在全球扩展前沿 AI、投资下一代算力,并满足 ChatGPT、Codex 和企业 AI 日益增长的需求。
推荐理由:OpenAI 官方公布融资规模和三项资金投向,读者可以据此了解其下一步资源布局。
Mistral AI 发布面向人类开发者和 Agent 的 Spaces CLI,三条命令即可从零搭建带热重载、数据库和生成 Dockerfile 的多服务项目并部署。
推荐理由:Mistral 以自家 CLI 为例,总结了一套让同一工具同时服务人类与 Agent 的可复用设计原则,细节具体。
OpenMed 构建了覆盖结构预测、序列设计与密码子优化的端到端蛋白质 AI 流水线。在对比多种 transformer 架构后,CodonRoBERTa-large-v2 胜出,困惑度 4.10、Spearman CAI 相关性 0.40,显著超过 ModernBERT;团队随后扩展到 25 个物种,用 55 GPU 小时训练了 4 个生产模型,建立了其他开源项目没有的物种条件化系统。
Hugging Face 发布 TRL v1.0,将六年迭代的后训练代码库正式转为稳定库,已实现超过 75 种后训练方法,月下载量达 300 万次。
推荐理由:原文解释了 v1.0 的稳定与实验分层契约和反抽象设计取舍,读者可以借此理解后训练库如何应对快速变化的算法领域。
OpenAI 与盖茨基金会在亚洲举办灾害响应工作坊,帮助灾害响应团队把 AI 应用于实际救灾行动。活动聚焦让一线团队学会将 AI 能力转化为可落地的应对方案。
Google DeepMind 发布由 Gemini 驱动的 AI 指针实验项目,提出维持心流、展示即告知、善用 this/that、把像素变成可操作实体四项交互原则,让用户通过指向和语音代替复杂提示词。
推荐理由:原文给出了AI指针的四项交互原则和落地场景,读者可以据此了解指向加语音如何替代复杂提示词。
拥有 230 年历史的 STADLER 使用 ChatGPT 转型知识工作,覆盖 650 名员工,节省时间并加速生产力提升。
Hugging Face 发文称 Anthropic 正在限制 Pro/Max 订阅者在开放智能体平台使用 Claude 模型,并给出两条迁移路径。
Google DeepMind 发布实时语音模型 Gemini 3.1 Flash Live,称其为迄今最高质量的音频模型,延迟更低、对话更自然。在 ComplexFuncBench Audio 上得分 90.8%,在开启 thinking 的 Scale AI Audio MultiChallenge 上得分 36.1%,均领先前代模型。
推荐理由:官方给出两项音频基准分数和多产品开放入口,读者可以据此评估它对语音智能体开发的实际改进。
Google DeepMind 发布关于 AI 有害操纵的新研究,称建立了首个经实证验证的评估工具包,用于测量 AI 以负面和欺骗性方式改变人类思想与行为的能力,并公开运行人类被试研究所需的全部材料。
推荐理由:原文给出覆盖三国万余名参与者的实验设计和效能与倾向双维度框架,为理解和测量 AI 有害操纵风险提供了可复用的方法入口。
Google DeepMind 推出 Lyria 3 Pro,可生成最长 3 分钟的曲目,并支持按前奏、主歌、副歌、桥段等结构元素定制。模型已进入 Vertex AI 公开预览、AI Studio 与 Gemini API、Google Vids、Gemini 应用和 ProducerAI;输出均嵌入 SynthID 水印,且不模仿具名艺术家。
OpenAI 介绍其 Model Spec 作为模型行为的公开框架,在安全、用户自由和问责之间取得平衡,以应对 AI 系统的持续演进。Model Spec 界定了模型应如何表现,是 OpenAI 规范模型行为的核心公开文档。
Google 宣布 Vibe Coding XR,将 Gemini 与基于 WebXR、three.js 和 LiteRT.js 的开源 XR Blocks 框架结合,把自然语言直接转为可运行的物理感知 Android XR 应用,官方称可在 60 秒内完成。
OpenAI 推出安全漏洞赏金计划(Safety Bug Bounty),征集 AI 滥用与安全风险线索。覆盖范围包括智能体漏洞、提示词注入和数据外泄。
Google Research 推出 TurboQuant 压缩算法(将发表于 ICLR 2026),通过 PolarQuant 高质量压缩与仅 1 bit 的 QJL 零开销纠错两步,实现大幅模型压缩且零精度损失,同时支持 KV cache 压缩与向量搜索。
Google Research 在 Earth AI 计划下推出 S2Vec,一个自监督框架,将建成环境栅格化为多层级特征图像,再用 masked autoencoding 学习通用地理位置嵌入。评测显示 S2Vec 在零样本地理外推任务(如全美人口密度、中位收入预测)上通常是表现最好的单一模型,与图像嵌入做多模态融合后整体优于任一单一模态,但在树冠覆盖、海拔等环境类任务上仍需改进。
OpenAI 发布了一套基于提示词的青少年安全策略,供开发者在 gpt-oss-safeguard 中使用,帮助审核 AI 系统中的年龄特定风险。该策略面向开发者,用于构建更安全的青少年 AI 体验。
OpenAI 基金会宣布计划投入至少 10 亿美元,用于疾病治愈、经济机会、AI 韧性和社区项目。
OpenAI 宣布 ChatGPT 推出更丰富的视觉沉浸式购物体验,采用 Agentic Commerce Protocol。该功能支持商品发现、并排比较和商家接入。