OpenAI 发布 GPT-5
OpenAI 发布 GPT-5,称其为目前最强的 AI 系统,在智能水平上较此前所有模型有显著跃升。官方称 GPT-5 在编程、数学、写作、健康、视觉感知等方向达到当前最优表现。
推荐理由:OpenAI 官方发布 GPT-5,说明其在编程、数学、写作、健康与视觉感知等方向的能力定位,可作为模型选型的参考。
OpenAI 发布 GPT-5,称其为目前最强的 AI 系统,在智能水平上较此前所有模型有显著跃升。官方称 GPT-5 在编程、数学、写作、健康、视觉感知等方向达到当前最优表现。
推荐理由:OpenAI 官方发布 GPT-5,说明其在编程、数学、写作、健康与视觉感知等方向的能力定位,可作为模型选型的参考。
OpenAI 发布 GPT-5,并展示一组领先开发者首次使用该模型的过程。原文仅提供摘要,未披露具体功能、版本号或性能数据。
OpenAI 推出 gpt-oss-120b 和 gpt-oss-20b 两个开放权重推理模型,采用 Apache 2.0 许可并适用其 gpt-oss 使用政策。材料仅提供摘要,未披露模型参数规模、性能指标或部署要求等细节。
推荐理由:OpenAI 公开两个开放权重推理模型的许可与使用政策,可据此判断自部署的合规与选型空间。
OpenAI 发布其能力最强的开放权重模型,称这是让先进 AI 更开放、更灵活、更易获取的重要一步。OpenAI 表示,其使命是让尽可能多的人用上 AI,而 AI 的下一个前沿不只关乎能力,也关乎谁能使用它。
推荐理由:OpenAI 发布其能力最强的开放权重模型,关注开放权重路线与模型可及性的读者可了解这一动作。
OpenAI 发布 gpt-oss-120b 和 gpt-oss-20b 两款开放权重语言模型,采用 Apache 2.0 许可。官方称这两款模型在推理任务上优于同规模开放模型,具备较强的工具调用能力,并针对消费级硬件的高效部署做了优化。
推荐理由:OpenAI 发布两款开放权重模型,给出参数规模、Apache 2.0 许可与消费级硬件部署定位,便于评估自部署选型。
OpenAI 发布 ChatGPT agent 系统卡,介绍这款智能体模型将研究、浏览器自动化和代码工具整合在一起,并在 Preparedness Framework 下设置防护措施。
推荐理由:OpenAI 公开 ChatGPT agent 的系统卡,说明其如何把研究、浏览器自动化与代码工具整合并在 Preparedness Framework 下设置防护。
OpenAI 发布 ChatGPT agent,官方称它能思考并行动,调用工具完成研究、预订和幻灯片等任务,全程由用户引导。
推荐理由:OpenAI 官方发布 ChatGPT agent,说明其可调用工具完成研究、预订和幻灯片等任务,读者可据此判断办公智能体的能力边界。
Wix 的 AI Website Builder 由 OpenAI 提供技术支持,用户只需通过对话描述想法,即可在几分钟内创建完整网站。
OpenAI 将 Operator 的底层模型从 GPT-4o 替换为 OpenAI o3,API 版本仍基于 4o。该变动作为 OpenAI o3 与 o4-mini 系统卡附录公布。
OpenAI 发布 Responses API 的新工具与功能更新,具体内容暂未获取到。
OpenAI 发布 Codex。
OpenAI 发布 o3 和 o4-mini 系统卡附录,介绍云端编码智能体 Codex。Codex 由 codex-1 驱动,后者是 OpenAI o3 针对软件工程优化的版本。codex-1 通过强化学习在多种环境的真实编码任务上训练,生成的代码贴近人类风格与 PR 偏好,能精确遵循指令并反复运行测试直至通过。
推荐理由:材料说明 Codex 由 o3 衍生版本 codex-1 驱动,并交代其训练方式,可据此判断该编码智能体的能力来源。
OpenAI 在亚洲推出数据驻留,延续其面向全球客户的企业级数据隐私、安全与合规体系。
OpenAI 公布 ChatGPT 企业版 2025 年 4 月更新内容,包括 o3、图像生成、增强记忆和内部知识四项能力,并提供了上手演示视频。
推荐理由:OpenAI 官方列出 ChatGPT 企业版 4 月新增的 o3、图像生成、增强记忆与内部知识四项能力,可据此判断企业版能力边界。
OpenAI 发布 o3 与 o4-mini 系统卡,两款模型将前沿推理能力与完整工具能力结合,支持网页浏览、Python、图像与文件分析、图像生成、canvas、自动化、文件搜索和记忆。
推荐理由:系统卡摘要列出 o3 与 o4-mini 的推理能力与工具调用范围,可据此判断两款模型在落地场景中的能力边界。
OpenAI 发布 o3 和 o4-mini 两款模型,官方称这是其迄今最智能、能力最强的模型,并支持完整的工具调用。
推荐理由:OpenAI 发布 o3 与 o4-mini,官方称其为目前最强模型并支持完整工具调用,可据此判断模型选型。
OpenAI 在 API 中推出 GPT-4.1 系列模型,在编码、指令遵循和长上下文理解方面均有整体提升,并首次发布 nano 模型。该系列模型即日起面向全球开发者开放。
推荐理由:OpenAI 在 API 上线 GPT-4.1 系列并首次推出 nano 版本,开发者可据此判断模型选型与接入时机。
OpenAI 发布 BrowseComp,一个面向浏览智能体(browsing agents)的基准测试。
OpenAI 在 API 中推出新一代音频模型,开发者首次可以指示文本转语音模型以特定方式说话,例如“像一位有同理心的客服人员那样说话”,为语音智能体带来新的定制能力。
推荐理由:OpenAI 在 API 中上线新一代音频模型,开发者可指定语音风格,为语音智能体定制提供新选项。
OpenAI 发布 ChatGPT for Business 的 2025 年 3 月更新,介绍最新一批功能发布。官方称 ChatGPT 正变得更可交互、更贴合团队工作方式,并更具智能体能力。
OpenAI 发布 GPT-4.5 的研究预览,并同步公布系统卡。OpenAI 称这是其目前规模最大、知识量最多的模型。
推荐理由:OpenAI 公布 GPT-4.5 系统卡并放出研究预览,读者可据此了解该版本在模型规模与知识量上的定位。
OpenAI 发布 deep research 系统卡,说明该功能发布前开展的安全工作,包括外部红队测试、按 Preparedness Framework 进行的前沿风险评估,以及针对关键风险领域构建的缓解措施概览。
OpenAI 发布 SWE-Lancer 基准,用真实自由职业软件工程任务检验前沿 LLM 能否赚到 100 万美元。该基准以真实外包工作为评测对象,衡量模型在软件工程交付中的经济价值。
推荐理由:OpenAI 用真实自由职业软件工程任务衡量前沿 LLM 的经济价值,可据此判断模型在真实交付场景中的能力边界。
OpenAI 面向欧洲客户推出数据驻留功能,作为其企业级数据隐私、安全与合规体系的一部分。该功能支持全球客户在本地留存数据,具体可用范围与上线时间未在原文中披露。
OpenAI 发布文章介绍如何用 ChatGPT 钓大比目鱼。原文仅给出这一使用场景,未披露具体方法、模型版本或功能细节。
OpenAI 发布 deep research,一个利用推理能力整合大量在线信息、替用户完成多步骤研究任务的智能体。该功能今日面向 Pro 用户开放,Plus 和 Team 用户随后可用。
推荐理由:OpenAI 官方发布 deep research 智能体,读者可了解其面向 Pro 用户开放及后续 Plus、Team 的推送节奏。
OpenAI 发布 o3-mini 模型,原文链接为 https://openai.com/index/openai-o3-mini,正文未抓取到,暂无更多细节。
OpenAI 发布 Operator 系统卡,基于其既有安全框架说明多层防护思路,包括为防范提示工程与越狱而实施的模型和产品层缓解措施,以及隐私与安全保护。文档还介绍了外部红队工作、安全评估,以及持续改进这些防护措施的后续工作。
推荐理由:OpenAI 公开 Operator 的系统卡,说明其在提示工程与越狱防护、隐私安全上的多层缓解措施和外部红队评测安排。
OpenAI 发布 o1 模型,同时带来 Realtime API 改进、一种新的微调方法以及面向开发者的其他更新。官方未在摘要中给出各项更新的具体参数与上线细节。
推荐理由:OpenAI 官方一次性公布 o1 模型与面向开发者的多项工具更新,可据此了解其开发者侧能力布局。
OpenAI 发布内容,介绍让 AI 为产品团队所用。原文未披露具体产品名、版本号、参数规模或可用性信息。
OpenAI 发布 ChatGPT Pro,用于扩大前沿 AI 的使用范围。该消息来自 OpenAI 官方,正文仅给出这一句说明。
OpenAI 发布 o1 与 o1-mini 的系统卡,说明模型发布前开展的安全工作,包括外部红队测试以及依据 Preparedness Framework 进行的前沿风险评测。
推荐理由:系统卡披露了 o1 与 o1-mini 发布前的外部红队测试和前沿风险评测流程,可了解其安全评估框架。
OpenAI 发布 canvas,一种在 ChatGPT 中写作和编程的新方式。官方称其面向写作与代码场景,具体功能与可用范围未在摘要中说明。
推荐理由:OpenAI 官方发布 ChatGPT 的 canvas 写作与编程新界面,读者可据此了解其产品形态变化。
OpenAI 发布 Realtime API,开发者现在可以把快速的语音到语音体验集成进自己的应用。
推荐理由:OpenAI 开放 Realtime API,开发者可在应用中直接构建语音到语音交互,是评估实时语音能力接入成本的参考。
OpenAI 宣布在微调 API 中引入视觉能力,开发者现在可以用图像和文本对 GPT-4o 进行微调,以提升其视觉表现。
推荐理由:OpenAI 在微调 API 中加入图像输入,开发者可据此判断视觉微调是否纳入自己的模型定制流程。
OpenAI 在 API 中推出模型蒸馏功能,可用大型前沿模型的输出微调一个成本更低的模型,全部流程在 OpenAI 平台上完成。
推荐理由:OpenAI 在 API 中上线模型蒸馏能力,读者可据此判断用大模型输出微调小模型的成本路径。
Mercado Libre 推出 AI 开发者平台 Verdi,该平台由 GPT-4o 提供支持。
OpenAI 发布 o1 模型,官方页面标题为 Introducing OpenAI o1。该材料抓取失败,除标题外无正文内容可供进一步说明。
OpenAI 发布 o1-mini,官方定位为在推理能力上追求成本效率的模型。该条目来自 OpenAI 官方新闻源,正文仅给出“Advancing cost-efficient reasoning”这一说明,未披露参数、价格或基准数据。
OpenAI 发布 o1 模型贡献说明,原文仅提供标题,未给出具体贡献者名单或技术细节。