OpenAI 发布 macOS 版 Codex 应用
OpenAI 发布面向 macOS 的 Codex 应用,定位为 AI 编程与软件开发的指挥中心,支持多个智能体、并行工作流和长时间运行的任务。
推荐理由:OpenAI 官方发布 macOS 版 Codex 应用,读者可据此了解其多智能体并行与长任务编排的定位。
OpenAI 发布面向 macOS 的 Codex 应用,定位为 AI 编程与软件开发的指挥中心,支持多个智能体、并行工作流和长时间运行的任务。
推荐理由:OpenAI 官方发布 macOS 版 Codex 应用,读者可据此了解其多智能体并行与长任务编排的定位。
OpenAI 说明了 AI 智能体打开链接时保护用户数据的机制,通过内置防护防止基于 URL 的数据外泄和提示注入。
OpenAI 发布 Prism,一款内置 GPT-5.2 的免费 LaTeX 原生工作空间,帮助研究人员在同一处完成写作、协作与推理。
推荐理由:OpenAI 推出内置 GPT-5.2 的免费 LaTeX 原生工作空间,读者可了解其面向科研写作与协作的定位。
OpenAI 发布 OpenAI for Healthcare,提供安全的企业级 AI,支持 HIPAA 合规,用于减轻行政负担并支持临床工作流。
推荐理由:OpenAI 面向医疗场景推出企业级 AI 产品,读者可了解其在合规与临床工作流上的定位。
OpenAI 发布 ChatGPT Health,这是一个专门体验,可安全连接用户的健康数据与应用。官方称其具备隐私保护,并采用医生参与设计的方式。
推荐理由:OpenAI 官方发布 ChatGPT Health,说明其可安全连接健康数据与应用,并强调隐私保护与医生参与设计。
OpenAI 正在用强化学习训练的自动化红队加固 ChatGPT Atlas,抵御提示注入攻击。这一发现与修补的循环有助于尽早识别新型攻击手法,并在 AI 愈发智能体化的过程中强化浏览器智能体的防御。
推荐理由:OpenAI 披露用强化学习训练的自动化红队持续发现并修补 ChatGPT Atlas 的提示注入漏洞,可了解浏览器智能体的安全加固思路。
OpenAI 发布 GPT-5.2-Codex,称其为 OpenAI 最先进的编码模型,具备长周期推理、大规模代码转换和增强的网络安全能力。
推荐理由:OpenAI 官方公布 GPT-5.2-Codex 的定位与三项能力方向,可据此判断其是否适合长周期编码任务。
OpenAI 发布 GPT-5.2 系统卡增补文件,涉及 GPT-5.2-Codex。该页面正文未能抓取,目前仅有标题信息。
OpenAI 宣布开发者可以向 ChatGPT 提交应用,经审核通过后会在产品内新的应用目录中展示,便于用户发现。官方同时更新了工具、指南和 Apps SDK,帮助开发者构建把真实世界操作带入 ChatGPT 的对话原生体验。
推荐理由:OpenAI 开放 ChatGPT 应用提交与审核,并给出 Apps SDK 与指南,开发者可据此判断接入路径与上架门槛。
OpenAI 推出一个真实场景评测框架,用于衡量 AI 加速湿实验室生物研究的能力。该工作使用 GPT-5 优化分子克隆实验方案,同时探讨 AI 辅助实验的潜力与风险。
推荐理由:OpenAI 用真实湿实验场景评测 GPT-5 优化分子克隆流程的能力,为判断 AI 在生物实验中的可用边界提供参照。
OpenAI 发布 GPT-5.2,称其是自家在数学与科学方面最强的模型,在 GPQA Diamond 和 FrontierMath 等基准上刷新了最优结果。官方表示这些提升已转化为实际研究进展,包括解决一个开放理论问题并生成可靠的数学证明。
推荐理由:GPT-5.2 在 GPQA Diamond 与 FrontierMath 上刷新结果,并给出解决开放理论问题、生成可靠数学证明的实例。
GPT-5.2 是 GPT-5 系列中的最新模型系列,其安全缓解方案与 GPT-5 系统卡和 GPT-5.1 系统卡所述基本一致。与 OpenAI 其他模型一样,GPT-5.2 模型在多样化数据集上训练,包括互联网公开信息、与第三方合作获取的信息,以及用户或人类训练师与研究人员提供或生成的信息。
OpenAI 发布 GPT-5.2,称其是面向日常专业工作最先进的前沿模型,具备领先的推理、长上下文理解、编码和视觉能力。该模型可在 ChatGPT 和 OpenAI API 中使用,用于支撑更快、更可靠的智能体工作流。
推荐理由:OpenAI 官方发布 GPT-5.2,读者可据此了解其在推理、长上下文、编码与视觉上的定位及可用渠道。
OpenAI 为 ChatGPT Enterprise、ChatGPT Edu 和 API Platform 扩展数据驻留,符合条件的客户可将静态数据存储在本地区域内。
推荐理由:OpenAI 把数据驻留扩展到 ChatGPT Enterprise、ChatGPT Edu 和 API Platform,企业可据此判断合规部署的可用范围。
JetBrains 正在旗下编码工具中集成 GPT-5,帮助数百万开发者更快地设计、推理和构建软件。该消息由 OpenAI 官方发布,未披露具体接入的产品线、上线时间与功能细节。
推荐理由:JetBrains 把 GPT-5 接入旗下编码工具,读者可据此判断主流 IDE 厂商的模型选型方向。
OpenAI 发布 GPT-5.1-Codex-Max,一款面向 Codex 的更快、更智能的智能体编程模型。该模型面向长时间运行的项目级工作,在推理能力和 token 效率上有所增强。
推荐理由:OpenAI 发布面向 Codex 的智能体编程模型,读者可据此判断长周期项目级编码任务的模型选型方向。
OpenAI 发布 GPT-5.1-Codex-Max 系统卡,说明该模型实施的安全措施。系统卡涵盖模型层缓解措施,包括针对有害任务和提示注入的专门安全训练,以及产品层缓解措施,如智能体沙箱和可配置网络访问。
推荐理由:系统卡披露了 GPT-5.1-Codex-Max 在模型层与产品层分别采取的安全措施,可供评估其智能体沙箱与网络访问配置。
GPT-5.1 已在 API 中开放,带来更快的自适应推理、扩展的 prompt caching 和改进的编码表现,并新增 apply_patch 与 shell 工具。
推荐理由:GPT-5.1 进入 API 并新增 apply_patch 与 shell 工具,开发者可据此判断是否调整现有调用与工具链。
OpenAI 升级 GPT-5 系列,推出 GPT-5.1,官方称新模型更温暖、能力更强,并新增自定义 ChatGPT 语气和风格的方式。GPT-5.1 当天起向付费用户逐步推送。
推荐理由:OpenAI 官方发布 GPT-5.1,付费用户当天开始推送,可据此判断升级节奏与可用范围。
OpenAI 发布 Aardvark,一款 AI 驱动的安全研究员,可自主发现、验证并协助修复大规模软件漏洞。该系统目前处于私有测试阶段,可报名参与早期测试。
推荐理由:OpenAI 官方发布智能体安全研究员 Aardvark,可自主发现并验证软件漏洞,目前处于私有测试阶段。
OpenAI 官方发文详解支撑 ChatGPT Atlas 浏览器的新架构 OWL,其核心是与 Chromium 解耦,从而实现快速启动、丰富 UI 以及由 ChatGPT 驱动的智能体式浏览。原文为深度技术解析,未披露更多实现细节。
推荐理由:OpenAI 官方披露 ChatGPT Atlas 浏览器底层架构 OWL 的设计取舍,可了解其如何支撑智能体式浏览。
OpenAI 发布 gpt-oss-safeguard,这是一组开放权重的推理模型,用于安全分类。开发者可以应用并迭代自定义策略。
推荐理由:OpenAI 发布开放权重安全分类推理模型,开发者可据此按自有策略迭代内容安全判定。
OpenAI 发布 gpt-oss-safeguard 技术报告,介绍 gpt-oss-safeguard-120b 和 gpt-oss-safeguard-20b 两个开源权重推理模型。这两个模型基于 gpt-oss 模型后训练,能够依据给定策略进行推理,从而按该策略对内容打标。报告描述了模型能力,并以底层 gpt-oss 模型为基线给出安全评测结果。
推荐理由:OpenAI 公开 gpt-oss-safeguard 两个开源权重模型的技术报告,并给出以 gpt-oss 为基线的安全评测结果。
OpenAI 在 ChatGPT 中推出 Company knowledge,把企业应用中的上下文带入 ChatGPT,用于回答与业务相关的问题。该功能提供清晰的引用,并具备安全、隐私和管理员控制,现已面向 Business、Enterprise 和 Edu 用户开放。
推荐理由:OpenAI 把企业应用上下文接入 ChatGPT 并给出引用与权限控制,读者可据此判断企业知识问答的可用边界。
OpenAI 发布 ChatGPT Atlas,一款内置 ChatGPT 的浏览器。该帖同时说明,Atlas 此后已被弃用。
推荐理由:OpenAI 官方发布内置 ChatGPT 的浏览器 Atlas,并说明该产品此后已停止运营,可了解其产品尝试与结局。
OpenAI Codex 现已正式开放(generally available),面向开发者新增多项功能:Slack 集成、Codex SDK,以及用量看板和工作区管理等管理工具。官方称这些更新让 Codex 更易使用,也更容易在规模化场景下管理。
推荐理由:Codex 正式开放并补齐 Slack 集成、SDK 与用量看板,读者可据此判断团队规模化接入的可行性。
OpenAI 在 ChatGPT 内推出新一代可对话的应用,开发者即日起可用新的 Apps SDK 开始构建,该 SDK 目前处于预览阶段。
推荐理由:OpenAI 在 ChatGPT 内推出可对话应用并开放 Apps SDK 预览,开发者可据此判断接入路径。
OpenAI 发布 AgentKit、扩展的 Evals 能力以及面向智能体的强化微调(RFT),用于帮助开发者更快从原型走向生产。官方称这三项工具面向智能体开发流程,但未在摘要中给出具体功能细节与可用范围。
推荐理由:OpenAI 官方发布 AgentKit、扩展的 Evals 与面向智能体的强化微调,读者可据此判断智能体开发工具链的补齐方向。
OpenAI 在 ChatGPT 中推出即时结账(Instant Checkout)和智能体商务协议(Agentic Commerce Protocol),让用户、AI 智能体和商家可以在 ChatGPT 内一起完成购物。OpenAI 称这是其在 ChatGPT 中推进智能体商务的第一步。
推荐理由:OpenAI 在 ChatGPT 内上线即时结账并推出智能体商务协议,可了解 AI 智能体参与购物的早期形态。
OpenAI 为 ChatGPT 推出共享项目、更智能的连接器,以及合规与安全方面的更新,帮助团队完成更多工作。官方称这些更新面向团队协作与工具接入场景。
推荐理由:OpenAI 官方公布 ChatGPT 团队协作与连接器更新,可据此了解其在企业办公场景的能力边界。
OpenAI 推出 GDPval,一项衡量模型在真实经济价值任务上表现的新评测,覆盖 44 个职业。
推荐理由:OpenAI 推出覆盖 44 个职业的 GDPval 评测,读者可据此了解模型在真实经济价值任务上的衡量方式。
OpenAI 宣布 Codex 升级,速度更快、更可靠,在实时协作和独立处理任务方面表现更好。升级后的 Codex 可在终端、IDE、网页乃至手机上使用。
推荐理由:Codex 本次升级集中在速度、可靠性与实时协作,并扩展到终端、IDE、网页和手机多端使用。
OpenAI 发布 GPT-5 系统卡增补,公布新模型 GPT-5-Codex,这是 GPT-5 针对 Codex 中智能体编程进一步优化的版本。GPT-5-Codex 会根据任务复杂度更动态地调整思考投入,对简单对话查询或小任务快速响应,对更复杂的任务则独立工作更长时间。
推荐理由:GPT-5 系统卡增补披露 GPT-5-Codex 按任务复杂度动态调整思考投入,可据此判断其在智能体编程场景的定位。
OpenAI 正与专家合作,为 ChatGPT 加强青少年保护并引入家长控制功能,同时将敏感对话路由至推理模型处理。
OpenAI 发布更先进的语音到语音模型 gpt-realtime,并更新 Realtime API,新增 MCP server 支持、图像输入和 SIP 电话呼叫支持。
推荐理由:OpenAI 发布语音到语音模型 gpt-realtime,并同步扩展 Realtime API 的 MCP、图像输入与 SIP 通话能力。
OpenAI 在 API 平台推出 GPT-5,提供高推理性能、面向开发者的新控制项,并在真实编码任务上取得领先结果。
推荐理由:OpenAI 在 API 平台上线 GPT-5,开发者可据此了解新模型在推理与真实编码任务上的定位。
OpenAI 发布 GPT-5,称其为 OpenAI 最先进的模型,面向企业 AI、自动化和智能工作时代的办公效率。原文未披露具体参数、版本细节或可用范围。
推荐理由:OpenAI 官方对 GPT-5 的定位说明,可了解其面向企业 AI、自动化和办公效率的落点。
OpenAI 发布文章介绍 GPT-5 在编程和设计方面带来的新可能,正文仅提供摘要,未给出具体功能、版本号或性能数据。
OpenAI 发布文章介绍 GPT-5 在医学研究中的用途。原文未披露具体功能、参数或可用性细节。
OpenAI 发布 GPT-5 系统卡,说明其通过统一模型路由系统实现快速与智能响应,涉及 gpt-5-main、gpt-5-thinking 以及 gpt-5-thinking-nano 等轻量版本,并针对不同任务和开发者用途做了优化。
推荐理由:系统卡披露 GPT-5 用统一路由在 gpt-5-main、gpt-5-thinking 与轻量版本间调度,可据此判断不同任务的模型选型。