OpenAI 发布 GPT-5.1-Codex-Max 系统卡
OpenAI 发布 GPT-5.1-Codex-Max 系统卡,说明该模型实施的安全措施。系统卡涵盖模型层缓解措施,包括针对有害任务和提示注入的专门安全训练,以及产品层缓解措施,如智能体沙箱和可配置网络访问。
推荐理由:系统卡披露了 GPT-5.1-Codex-Max 在模型层与产品层分别采取的安全措施,可供评估其智能体沙箱与网络访问配置。
与落地强相关的大模型进展:新模型发布、能力边界变化、价格与可用性——只收对部署决策有影响的。
OpenAI 发布 GPT-5.1-Codex-Max 系统卡,说明该模型实施的安全措施。系统卡涵盖模型层缓解措施,包括针对有害任务和提示注入的专门安全训练,以及产品层缓解措施,如智能体沙箱和可配置网络访问。
推荐理由:系统卡披露了 GPT-5.1-Codex-Max 在模型层与产品层分别采取的安全措施,可供评估其智能体沙箱与网络访问配置。
GPT-5.1 已在 API 中开放,带来更快的自适应推理、扩展的 prompt caching 和改进的编码表现,并新增 apply_patch 与 shell 工具。
推荐理由:GPT-5.1 进入 API 并新增 apply_patch 与 shell 工具,开发者可据此判断是否调整现有调用与工具链。
OpenAI 升级 GPT-5 系列,推出 GPT-5.1,官方称新模型更温暖、能力更强,并新增自定义 ChatGPT 语气和风格的方式。GPT-5.1 当天起向付费用户逐步推送。
推荐理由:OpenAI 官方发布 GPT-5.1,付费用户当天开始推送,可据此判断升级节奏与可用范围。
OpenAI 发布 gpt-oss-safeguard,这是一组开放权重的推理模型,用于安全分类。开发者可以应用并迭代自定义策略。
推荐理由:OpenAI 发布开放权重安全分类推理模型,开发者可据此按自有策略迭代内容安全判定。
OpenAI 发布 gpt-oss-safeguard 技术报告,介绍 gpt-oss-safeguard-120b 和 gpt-oss-safeguard-20b 两个开源权重推理模型。这两个模型基于 gpt-oss 模型后训练,能够依据给定策略进行推理,从而按该策略对内容打标。报告描述了模型能力,并以底层 gpt-oss 模型为基线给出安全评测结果。
推荐理由:OpenAI 公开 gpt-oss-safeguard 两个开源权重模型的技术报告,并给出以 gpt-oss 为基线的安全评测结果。
Doppel 使用 GPT-5 和强化微调构建 AI 防御系统,在深度伪造与冒充攻击扩散前将其拦截,使分析师工作量下降 80%,响应时间从数小时缩短到数分钟。
推荐理由:原文给出 Doppel 用 GPT-5 与强化微调拦截深度伪造攻击的场景,以及分析师工作量和响应时长的具体变化。
Wrtn 借助 GPT-5 将 AI 应用在韩国的用户规模扩展到 650 万,打造融合生产力、创造力与学习的“生活方式 AI”,目前正向东亚其他地区扩张。
推荐理由:Wrtn 用 GPT-5 在韩国把 AI 应用做到 650 万用户,可看生活方式类 AI 的规模化路径。
SchoolAI 使用 GPT-4.1、图像生成和 TTS 构建安全、由教师引导的 AI 工具,覆盖超过 100 万间教室,用于提升参与度、监督能力和个性化学习。
推荐理由:材料给出 SchoolAI 用 GPT-4.1 等能力覆盖超 100 万间教室的场景,可看教育场景中教师主导的 AI 落地方式。
OpenAI 发布新研究,解释语言模型产生幻觉的原因。研究结果显示,改进评测方式有助于提升 AI 的可靠性、诚实性与安全性。
推荐理由:OpenAI 从评测角度解释大模型幻觉的成因,读者可据此理解评测改进与模型可靠性之间的关系。
OpenAI 与 Retro Bio 使用专用 AI 模型 GPT-4b micro,为干细胞疗法和长寿研究设计出更有效的蛋白质。该模型面向生命科学场景,用于蛋白质工程。
OpenAI 在 API 平台推出 GPT-5,提供高推理性能、面向开发者的新控制项,并在真实编码任务上取得领先结果。
推荐理由:OpenAI 在 API 平台上线 GPT-5,开发者可据此了解新模型在推理与真实编码任务上的定位。
OpenAI 发布 GPT-5,称其为 OpenAI 最先进的模型,面向企业 AI、自动化和智能工作时代的办公效率。原文未披露具体参数、版本细节或可用范围。
推荐理由:OpenAI 官方对 GPT-5 的定位说明,可了解其面向企业 AI、自动化和办公效率的落点。
OpenAI 发布文章介绍 GPT-5 在编程和设计方面带来的新可能,正文仅提供摘要,未给出具体功能、版本号或性能数据。
OpenAI 发布 GPT-5 系统卡,说明其通过统一模型路由系统实现快速与智能响应,涉及 gpt-5-main、gpt-5-thinking 以及 gpt-5-thinking-nano 等轻量版本,并针对不同任务和开发者用途做了优化。
推荐理由:系统卡披露 GPT-5 用统一路由在 gpt-5-main、gpt-5-thinking 与轻量版本间调度,可据此判断不同任务的模型选型。
OpenAI 发布 GPT-5,称其为目前最强的 AI 系统,在智能水平上较此前所有模型有显著跃升。官方称 GPT-5 在编程、数学、写作、健康、视觉感知等方向达到当前最优表现。
推荐理由:OpenAI 官方发布 GPT-5,说明其在编程、数学、写作、健康与视觉感知等方向的能力定位,可作为模型选型的参考。
OpenAI 发布 GPT-5,并展示一组领先开发者首次使用该模型的过程。原文仅提供摘要,未披露具体功能、版本号或性能数据。
OpenAI 推出 gpt-oss-120b 和 gpt-oss-20b 两个开放权重推理模型,采用 Apache 2.0 许可并适用其 gpt-oss 使用政策。材料仅提供摘要,未披露模型参数规模、性能指标或部署要求等细节。
推荐理由:OpenAI 公开两个开放权重推理模型的许可与使用政策,可据此判断自部署的合规与选型空间。
OpenAI 发布其能力最强的开放权重模型,称这是让先进 AI 更开放、更灵活、更易获取的重要一步。OpenAI 表示,其使命是让尽可能多的人用上 AI,而 AI 的下一个前沿不只关乎能力,也关乎谁能使用它。
推荐理由:OpenAI 发布其能力最强的开放权重模型,关注开放权重路线与模型可及性的读者可了解这一动作。
OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 两款开放权重语言模型,采用 Apache 2.0 许可。官方称这两款模型在推理任务上优于同规模开放模型,具备较强的工具调用能力,并针对消费级硬件的高效部署做了优化。
推荐理由:OpenAI 发布两款开放权重模型,给出参数规模、Apache 2.0 许可与消费级硬件部署定位,便于评估自部署选型。
OpenAI 发布 o3 与 o4-mini 系统卡,两款模型将前沿推理能力与完整工具能力结合,支持网页浏览、Python、图像与文件分析、图像生成、canvas、自动化、文件搜索和记忆。
推荐理由:系统卡摘要列出 o3 与 o4-mini 的推理能力与工具调用范围,可据此判断两款模型在落地场景中的能力边界。