跳到正文

#模型发布

今日 0 条
11月19日周三
11月17日周一
11月13日周四
  1. OpenAI News73

    OpenAI 在 API 中推出 GPT-5.1

    OpenAI 宣布 GPT-5.1 在 API 中可用,带来更快的自适应推理、扩展的提示词缓存和更好的编码性能,并新增 apply_patch 与 shell 工具。

    推荐理由:官方说明 GPT-5.1 API 版的能力变化点,开发者可以据此判断是否迁移现有调用。

11月12日周三
  1. OpenAI News76

    OpenAI 发布 GPT-5.1,更聪明也更会聊天的 ChatGPT

    OpenAI 升级 GPT-5 系列,推出更温暖、能力更强的 GPT-5.1,并为 ChatGPT 新增语气和风格的自定义方式。GPT-5.1 从发布当天起向付费用户逐步推出。

    推荐理由:原文直接给出 GPT-5 系列升级方向、语气定制能力和面向付费用户的开放节奏,读者可据此评估升级是否影响自身使用。

10月29日周三
  1. OpenAI News63

    OpenAI 发布 gpt-oss-safeguard-120b 与 gpt-oss-safeguard-20b 开放权重模型及技术报告

    OpenAI 发布 gpt-oss-safeguard-120b 和 gpt-oss-safeguard-20b 两个开放权重推理模型,由 gpt-oss 模型后训练而来,可根据给定策略推理并对内容进行标注。技术报告描述了其能力,并以底层 gpt-oss 模型为基线提供了安全评估结果。

    推荐理由:原文给出两个安全审核模型的训练思路和基线安全评估来源,读者可以据此了解其按策略标注内容的能力定位。

10月28日周二
10月27日周一
9月30日周二
  1. OpenAI News76

    OpenAI 发布 Sora 2 视频生成模型

    OpenAI 发布 Sora 2,一个支持同步对话与音效的视频生成模型。同时原文提到 Sora 产品已不再可用。

    推荐理由:官方宣布 Sora 2 带同步对话与音效的视频生成能力,读者可借此了解其与此前版本的能力差异。

  2. OpenAI News74

    OpenAI 发布 Sora 2 视频与音频生成模型

    OpenAI 发布新一代视频与音频生成模型 Sora 2。相较初代 Sora,新模型具备更准确的物理表现、更强的真实感、同步音频、更高的可控性和更广的风格范围。

    推荐理由:官方说明列出 Sora 2 在物理准确性、音画同步和可控性上的能力变化,可帮助读者比较视频模型迭代方向。

9月15日周一
  1. OpenAI News61

    OpenAI 发布 GPT-5-Codex:针对 Codex 智能体编码优化

    OpenAI 在 GPT-5 系统卡附录中发布新模型 GPT-5-Codex,是针对 Codex 中智能体编码进一步优化的 GPT-5 版本。该模型会根据任务复杂度更动态地调整思考力度,简单对话或小任务快速响应,复杂任务则可独立长时间工作。

    推荐理由:原文说明新模型在思考力度上按任务复杂度动态调整,读者可了解其与 GPT-5 在编码场景下的差异。

9月12日周五
9月10日周三
  1. Hugging Face Blog64

    Hugging Face 发布 Jupyter Agent:微调 Qwen3-4B 提升 DABStep 数据科学任务表现

    Hugging Face 发布 Jupyter Agent 项目,用约 2TB Kaggle 笔记本构建 51k 条合成轨迹、近 0.2B tokens 的数据集,微调 Qwen3-4B-Instruct-2507 与 Qwen3-4B-Thinking-2507。

    推荐理由:原文完整给出从数据清洗到微调的管线与消融数字,读者可复用其中提升小模型数据科学能力的做法。

9月9日周二
9月4日周四
  1. Hugging Face Blog67

    Google 发布 EmbeddingGemma 高效多语言嵌入模型

    Google 发布开源嵌入模型 EmbeddingGemma,308M 参数、2K 上下文窗口,支持超过 100 种语言,量化后内存占用低于 200 MB,适合端侧 RAG 和 Agent 场景。

    推荐理由:官方博客给出架构、基准和各框架用法,还附完整微调示例,读者可以据此判断如何把它接入现有检索流程。

8月28日周四
8月22日周五
8月21日周四
8月14日周四
8月12日周二
8月7日周四
  1. OpenAI News74

    OpenAI 面向开发者发布 GPT-5

    OpenAI 在 API 平台推出 GPT-5,面向开发者提供高推理性能和新的控制选项。该模型在真实编码任务上取得同类领先的评测结果。

    推荐理由:OpenAI 官方宣布 GPT-5 上线 API,读者可以据此了解其在推理和编码任务上的定位以及面向开发者的新控制能力。

  2. OpenAI News41

    GPT-5 与工作新纪元

    OpenAI 发文称 GPT-5 是其最先进的模型,将变革企业级 AI、自动化与劳动力生产力。文章把 GPT-5 定位为智能工作新纪元的核心驱动力,聚焦企业场景下的自动化与工作效率提升。

  3. OpenAI News82

    OpenAI 发布 GPT-5 系统卡,介绍统一模型路由机制

    OpenAI 发布 GPT-5 系统卡,说明统一模型路由系统如何在 gpt-5-main、gpt-5-thinking 和轻量版 gpt-5-thinking-nano 之间分配请求,以兼顾快速和智能的响应。各变体针对不同任务和开发者使用场景做了优化。

    推荐理由:官方系统卡说明 GPT-5 的统一路由机制,读者可以据此理解不同 gpt-5 变体如何按任务分配响应。

8月5日周二
  1. Hugging Face Blog92

    OpenAI 开源 GPT OSS 模型家族:gpt-oss-120b 与 gpt-oss-20b

    OpenAI 发布开源权重模型 GPT OSS,包含 117B 参数的 gpt-oss-120b 和 21B 参数的 gpt-oss-20b,均采用 MoE 架构和 MXFP4 4-bit 量化,分别可装入单张 H100 和 16GB 显存,采用 Apache 2.0 许可证。

    推荐理由:文章给出两个模型的参数量、量化方案和各硬件平台的具体推理优化建议,读者可按自己的 GPU 直接选择部署路径。

  2. OpenAI News85

    OpenAI 发布开放权重模型 gpt-oss-120b 和 gpt-oss-20b

    OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 两款开放权重语言模型,采用 Apache 2.0 许可证。官方称二者在推理任务上优于同等规模的开源模型,具备较强的工具调用能力,并针对消费级硬件上的高效部署做了优化。

    推荐理由:OpenAI 官方发布两款开放权重模型,读者可以据此了解其推理表现、工具调用能力和在消费级硬件上的部署定位。

7月16日周三
7月15日周二
7月11日周五
7月10日周四
7月8日周二
  1. Hugging Face Blog66

    Hugging Face 发布开源 3B 模型 SmolLM3,支持 128k 长上下文与双模式推理

    Hugging Face 发布完全开源的 SmolLM3-3B,用 11.2T tokens 分三阶段预训练,性能超越 Llama-3.2-3B 和 Qwen2.5-3B,并与 Qwen3-4B、Gemma3-4B 等更大模型竞争力相当。

    推荐理由:官方同步放出模型、三阶段预训练配比和双模式推理完整训练配方,适合想复现或改进同级小模型的研究者对照学习。

6月28日周六
6月26日周四
  1. Hugging Face Blog73

    Gemma 3n 正式登陆开源生态,发布 E2B 与 E4B 两档端侧多模态模型

    Google Gemma 3n 正式开源,发布 E2B 和 E4B 两个尺寸、各含 base 与 instruct 版本,支持图像、文本、音频和视频输入。E2B/E4B 实际参数为 5B/8B,但借助 MatFormer 架构与 Per-Layer Embeddings,仅需 2GB/3GB GPU 内存即可运行,E4B 还在 LMArena 上取得 1300+ 分数。

    推荐理由:原文给出模型的有效参数设计、显存需求和各开源库用法,端侧开发者可以据此选择部署方式。

6月10日周二
6月3日周二
5月28日周三