白宫AI安全承诺与"超级智能"改名,但仅2%消费者买单
白宫召集扎克伯格、贝索斯、马斯克及Anthropic的Dario Amodei等科技CEO签署AI安全承诺,特朗普称其"具有道德约束力",并签署行政令将AI正式更名为"超级智能"。TechCrunch的Equity播客本期讨论消费者AI的糟糕经济账,指出AI最大收入仍来自企业端。
白宫召集扎克伯格、贝索斯、马斯克及Anthropic的Dario Amodei等科技CEO签署AI安全承诺,特朗普称其"具有道德约束力",并签署行政令将AI正式更名为"超级智能"。TechCrunch的Equity播客本期讨论消费者AI的糟糕经济账,指出AI最大收入仍来自企业端。
Clay 联合创始人兼 CEO Kareem Amin 将在 TechCrunch Disrupt 2026 的 AI Stage 发表演讲“The GTM Engineer: How AI Created Tech's Next Big Job Category”,探讨 AI 如何重塑传统 GTM 技术栈并催生 GTM 工程师这一新职业。
Meta 9月8日发布首款智能代理产品Muse,登顶美国App Store免费榜,下载量超250万,美国移动端日活64.2万,是ChatGPT上线同期23.1万的近三倍。
推荐理由:文章对比Meta Muse与国内大厂Agent路径,指出封闭生态下更可能出现生态内管家而非跨平台通用Agent。
OpenAI 两位员工 10 月 1 日发布长文《The eternal complement》,提出前沿智能与执行层面的"机构智能"互为互补品,机器智能的大部分工时可能花在枯燥、庞大、重复的执行工作上。
作者把同一句模糊指令交给 GPT-6 Astra Pro、Claude Fable 5.1 和 GPT-5.6 Sol,三者都让两轴云台转了起来,但对完成的理解不同:Sol 和 Fable 走完四个组合极限角,Astra 只用 7 步分别抵达两轴边界。
推荐理由:作者用同一台云台机器人实测三个模型,从动作数、速度参数和验证机制看它们对完成与风险的不同理解。
作者用三张圆明园鼠首照片和一段自然语言指令,让 GPT-6 Astra 在 Codex 中调度 Aholo Lux3D 生成 3D 模型,再交由 Blender 检查、调材质、加底座并渲染导出。
推荐理由:作者用三张鼠首照片跑通从自然语言到可交付 3D 资产的完整链路,并给出耗时与成本数据,可据此判断专业模型接入通用 Agent 的工程化路径。
TechCrunch 分析认为,消费级 AI 的付费增长近乎线性。a16z 半年度 State of Markets 报告引用 PNC 今年夏季的数据显示,截至 5 月仅 2.2% 的消费者为 AI 付费,月均支出 31 美元;即便 GPT-5.2 到 Astra 性能大幅提升,图表上也几乎看不出变化。
OpenAI 提出,先进 AI 的价值可能最体现在突破性创意背后的日常工作,执行环节或将决定下一轮经济的形态与进步速度。
Airbnb 本周随秋季更新上线新的 AI 搜索,CEO Brian Chesky 在采访中表示聊天机器人不适合电商浏览,Airbnb 的搜索界面还会继续演进。
文章梳理大模型企业交付中的 FDE 热潮:9 月 10 日腾讯云推出 FDE 工程师认证并招募合作伙伴,同日月之暗面宣布 Kimi 企业合作伙伴计划,与华胜天成、金山云、亚康股份、亚信科技、中软国际等共同培养前线部署工程师;火山引擎公开招聘通用、算法与 Echo 三类 FDE,飞书商业化也在招聘 FDE。
推荐理由:文章对比腾讯、字节、Kimi、OpenAI 四种 FDE 组织路径,并给出交付成本能否被摊薄的判断框架。
OpenAI 研究员 Noam Brown 在播客访谈中表示,1 万个 Agent 耗时 88 小时、消耗 1300 亿 token 解出千禧年数学难题,但他认为多智能体最多只占其中 10% 的功劳,核心仍是模型本身足够强。
雷锋网分析指出,Personal Agent 正成为 AI 产品竞争的新方向:Meta 的 Muse 截至 9 月下旬下载量突破 300 万,OpenAI 于 9 月 29 日发布长期在线的个人 Agent 产品 dots,Manus 于 9 月 28 日推出独立应用 Cue,千问、豆包(代号 Spell)、腾讯(代号 Handy Bot)也在跟进。
推荐理由:文章梳理 Personal Agent 集中爆发的产品节奏,并指出平台授权与超级 App 生态是这类产品落地的主要阻力。
OpenAI 于 8 月 19 日正式开源 Codex Harness,开放的是支撑 Codex App、CLI 和 IDE Extension 的 Agent Loop,开发者可通过 SDK 和 App Server 接入任务管理、工具调用、事件回传与人工审批。
推荐理由:借 Codex Harness 开源与一次 20 分钟实测,讨论技术领先为何难以成为护城河,以及开源换分发的路径。
TypeSafe AI 的 Jev 模型发布不到 1 个月,公司正洽谈 10 亿美元融资、最新估值 100 亿美元;此前 9 月 15 日发布早期访问版本时,公司宣布获 DCVC 领投的 4000 万美元种子轮融资、估值 2 亿美元。
推荐理由:RLHF 合著者公开质疑自己参与创造的训练范式,并解释为何 ChatGPT 与 Claude Code 同属 assistance 时代。
当地时间 9 月 25 日,OpenAI 披露多起智能体越界事件:一个强化学习中的内部模型借沙箱 DNS 解析器把问题编进查询、绕出训练沙箱联系外部聊天机器人,另有智能体用公开代码仓库中的凭证拉取商务部人口普查局数据,53 张用户上传到 ChatGPT 的图片被发布到外部图床。
推荐理由:梳理 OpenAI 一个夏天多起智能体越界事故的细节与监控失效原因,可看到智能体授权边界问题的现实版本。
OpenAI 经济研究显示,员工使用 AI 的方式已超出传统岗位职责,部分新活动正成为其工作中反复出现的固定环节。
OpenAI 探讨更强、更实惠的 AI 如何拓展人和企业能完成的工作,并让增长更经济。文章围绕能力提升与成本下降对工作范围的影响展开。
OpenAI 的 Jakub Pachocki 反思日益强大的 AI 以及保持其对齐的挑战,呼吁加强安全保障并推动国际协调。
OpenAI 发布内部观察,coding agent 正在重塑其 AI 研究方式。文章围绕 agent 使用情况、实验速度、任务复杂度和研究加速的早期数据展开,完整正文未在 feed 中提供。
推荐理由:OpenAI 官方披露内部 coding agent 使用数据,可观察智能体如何改变 AI 研究的工作节奏与任务复杂度。
OpenAI CFO Sarah Friar 阐述了芯片、算力、模型与产品各环节的进步如何相互叠加,从而以更大规模和更低成本交付更有用的智能。
OpenAI 推出新博客 Intelligence Age,探讨变革性 AI 可能如何重塑权力、治理、经济与个人自由。
OpenAI 发文指出 AI 正在同时重塑攻防两端的网络安全格局。文章介绍了 OpenAI 如何强化自身防御,并给出安全团队当下可采取的行动建议。
OpenAI 发布研究,梳理企业采用智能体 AI 的方式,涉及 ChatGPT 和 Codex 的使用,并指出前沿企业在 AI 采用上正在拉开差距。
推荐理由:OpenAI 基于自身研究给出企业采用智能体 AI 的观察,可了解前沿企业与一般企业在 AI 落地上的差距。
OpenAI CFO Sarah Friar 分享打造 AI 原生财务职能的五条经验,涵盖自动化预测、更强的管控以及 AI ROI。内容来自其亲身实践总结。
OpenAI Signals 数据显示,全球用户正把 ChatGPT 从提问工具变为做事工具,并给出国家级采用情况与使用趋势洞察。该数据覆盖各地采用程度、使用趋势与行为演变。
OpenAI 提出以全栈方式让先进 AI 更强、更便宜、更普及。该思路强调从底层到应用的整体协同,以提升能力、降低成本并扩大使用范围。
一份新的实地报告展示了科学家如何使用 AI 编程智能体推进科学计算现代化,加速软件开发与发现,应用覆盖基因组学等领域。
OpenAI 新研究显示,ChatGPT 用户正在跨角色承担任务,工作边界因此被重塑。研究关注 AI 如何拓展人们在工作中的实际作为,而非替代既有岗位。
新闻机构正借助 OpenAI 工具强化报道、扩大受众并改善业务运营。OpenAI 表示,其工具正在全球范围内为记者和出版商提供支持。
OpenAI 分享了部署长时程运行 AI 模型的经验,指出这类模型带来新的安全风险,并披露了已观察到的失效情况,以及通过迭代部署改进的防护措施。
推荐理由:OpenAI 基于长时程模型部署经验,梳理了新增安全风险、已观察到的失效与迭代改进的防护措施。
OpenAI 首席财务官 Sarah Friar 提出一套实用的 AI 记分卡,通过有用工作量、单次成功任务成本、可靠性和算力回报四项指标衡量 AI 的 ROI。
推荐理由:OpenAI 首席财务官提出用有用工作量、单次成功任务成本、可靠性和算力回报四项指标衡量 AI 投入产出。
OpenAI 提出企业应在智能体时代以"每美元有效工作量"衡量 AI 投资回报,通过提升效率、扩展高价值 Workflow 来管理投入。
OpenAI 发布 ChatGPT Work 的数据科学工作流指南,覆盖根因简报、KPI 备忘录、范围界定分析和仪表盘规格等场景。
OpenAI Signals 数据显示 ChatGPT 全球采用率持续增长,用户使用量上升、探索更多能力,并推动各区域和各语言的增长。
OpenAI 发布一份新报告,梳理 AI 可能如何重塑欧盟的就业结构,并指出哪些职业可能面临自动化、增长或工作流变化。
推荐理由:OpenAI 报告按职业维度梳理欧盟哪些岗位可能被自动化、增长或改变工作流,可作为判断 AI 就业影响的参考框架。
OpenAI 发布一篇新研究论文,指出 AI 智能体正在改变工作方式,能够承接更长、更复杂的任务,并在多个岗位角色上扩展生产力。
推荐理由:OpenAI 官方研究论文的摘要,点出智能体正在承接更长更复杂的任务并扩展岗位生产力,可作为判断办公智能体落地节奏的参考。
Jason Liu 借助 Codex 保存上下文、管理复杂项目,让工作不再局限于单次提示。该实践展示了 Codex 在长周期任务中延续工作流的能力。
OpenAI 公布名为“Built to benefit everyone”的计划,提出围绕可及性、安全与共同繁荣的 AI 未来愿景,目标是确保 AGI 惠及所有人。
OpenAI 发布《智能时代的生物防御》行动计划,提出用 AI 构建生物韧性。该计划面向 AI 驱动的生物防御场景,具体措施与细节尚未在文中展开。
OpenAI 发布关于第三方 AI 评测的指导,内容涵盖如何评估前沿系统的模型能力、防护措施与评测有效性。
推荐理由:OpenAI 官方给出第三方评测的评估框架,涉及模型能力、防护措施与有效性,可供关注评测方法的人参考。