OpenAI 更新 Agents SDK,加入原生沙箱执行与模型原生 harness
OpenAI 更新 Agents SDK,新增原生沙箱执行和模型原生 harness,帮助开发者在文件和工具之间构建安全、长时间运行的智能体。
推荐理由:OpenAI 官方说明 Agents SDK 新增原生沙箱执行与模型原生 harness,读者可据此判断长时运行智能体的构建方式变化。
OpenAI 更新 Agents SDK,新增原生沙箱执行和模型原生 harness,帮助开发者在文件和工具之间构建安全、长时间运行的智能体。
推荐理由:OpenAI 官方说明 Agents SDK 新增原生沙箱执行与模型原生 harness,读者可据此判断长时运行智能体的构建方式变化。
Cloudflare 将 OpenAI 的 GPT-5.4 和 Codex 引入 Agent Cloud,让企业能够构建、部署并规模化运行面向真实任务的 AI 智能体,并强调速度与安全。
推荐理由:Cloudflare 把 OpenAI 的 GPT-5.4 与 Codex 接入 Agent Cloud,读者可了解企业构建和部署智能体的新入口。
OpenAI 推出 Safety Bug Bounty 计划,用于发现 AI 滥用与安全风险,覆盖范围包括智能体漏洞、提示注入和数据外泄。
推荐理由:OpenAI 把智能体漏洞、提示注入和数据外泄纳入漏洞赏金范围,可了解其安全风险的外部发现机制。
OpenAI 介绍其如何用思维链监控研究内部编码智能体的偏离行为,通过分析真实部署来发现风险并强化 AI 安全防护措施。
推荐理由:OpenAI 公开其内部编码智能体的思维链监控做法,为团队观察智能体偏离行为提供一种可参考的工程思路。
OpenAI 详解 Codex Security 为何不依赖传统 SAST,转而采用 AI 驱动的约束推理与验证来发现真实漏洞,并减少误报。
OpenAI 官方发文说明 ChatGPT 如何抵御提示注入与社交工程攻击,方式是在智能体工作流中限制高风险动作并保护敏感数据。原文仅提供摘要,未展开具体机制与案例。
推荐理由:OpenAI 官方说明 ChatGPT 在智能体工作流中如何通过限制高风险动作与保护敏感数据来抵御提示注入。
OpenAI 介绍如何用 Responses API、shell 工具和托管容器构建智能体运行时,让智能体在文件、工具和状态支持下安全、可扩展地运行。
推荐理由:OpenAI 官方说明如何用 Responses API、shell 工具与托管容器搭建智能体运行时,可了解其安全与扩展思路。
OpenAI 推出 Codex Security,这是一款 AI 应用安全智能体,可分析项目上下文来检测、验证并修复复杂漏洞,官方称其置信度更高、噪声更少。该产品目前处于研究预览阶段。
推荐理由:OpenAI 官方发布 Codex Security 研究预览,读者可了解其以项目上下文检测、验证并修复漏洞的定位。
Balyasny Asset Management 结合严格的模型评测、对 OpenAI 全平台的使用以及智能体工作流,重构投资研究流程。原文未披露具体业务指标与实施细节。
推荐理由:材料仅给出场景与做法方向,缺少具体指标,读者可先了解资管机构如何把模型评测与智能体工作流接入投研。
OpenAI 在 Amazon Bedrock 推出面向智能体的有状态运行时环境,为多步 AI 工作流提供持久编排、记忆与安全执行能力。该运行时面向由 OpenAI 驱动的多步 AI 工作流。
推荐理由:OpenAI 与 Amazon Bedrock 的智能体运行时补齐持久编排与记忆,可据此判断多步工作流的部署方式。
OpenAI 宣布推出 Frontier Alliance Partners,帮助企业从 AI 试点阶段迈向生产环境,实现安全、可扩展的智能体部署。
推荐理由:OpenAI 推出 Frontier Alliance Partners,指向企业从 AI 试点走向规模化智能体部署的生态合作路径。
OpenAI 与 Paradigm 联合推出 EVMbench,用于评测 AI 智能体检测、修补和利用高危智能合约漏洞的能力。该基准覆盖漏洞检测、补丁修复与漏洞利用三类任务。
推荐理由:OpenAI 与 Paradigm 联合推出智能体安全评测基准,关注 AI 在智能合约漏洞检测与修复上的能力边界。
OpenAI 技术人员 Ryan Lopopolo 提出 Harness engineering,探讨在智能体优先的世界中如何利用 Codex。文章围绕这一理念展开,强调以 AI 智能体为核心的工作方式。
OpenAI 发布企业平台 OpenAI Frontier,用于构建、部署和管理 AI 智能体。该平台提供共享上下文、入职引导、权限与治理能力。
推荐理由:OpenAI 官方发布企业级智能体平台 Frontier,可据此了解其在共享上下文、权限与治理上的产品定位。
OpenAI 发布 GPT-5.3-Codex,这是一款 Codex 原生的智能体,将前沿编码性能与通用推理能力结合,用于支持长周期、真实世界的技术工作。
推荐理由:OpenAI 发布 Codex 原生智能体 GPT-5.3-Codex,读者可据此判断其编码能力与通用推理结合后的长周期任务定位。
OpenAI 发布 GPT-5.3-Codex 系统卡,称其为迄今能力最强的智能体编码模型。该模型结合了 GPT-5.2-Codex 的前沿编码性能与 GPT-5.2 的推理和专业领域知识能力。
推荐理由:OpenAI 官方系统卡给出 GPT-5.3-Codex 的能力定位,读者可据此判断它在智能体编码任务上的升级幅度。
OpenAI 发布 Codex App Server,这是一个双向 JSON-RPC API,用于把 Codex 智能体嵌入到应用中。该接口支持流式进度、工具调用、审批和 diff 等能力。
推荐理由:OpenAI 官方说明 Codex App Server 如何以双向 JSON-RPC API 把 Codex 智能体嵌入自有应用。
OpenAI 发布面向 macOS 的 Codex 应用,定位为 AI 编程与软件开发的指挥中心,支持多个智能体、并行工作流和长时间运行的任务。
推荐理由:OpenAI 官方发布 macOS 版 Codex 应用,读者可据此了解其多智能体并行与长任务编排的定位。
OpenAI 介绍了其自建内部 AI 数据智能体,该智能体使用 GPT-5、Codex 和记忆机制对大规模数据集进行推理,可在数分钟内给出可靠洞察。
推荐理由:OpenAI 公开自建内部数据智能体的技术组合,读者可了解其用 GPT-5、Codex 与记忆机制处理大规模数据集的做法。
OpenAI 说明了 AI 智能体打开链接时保护用户数据的机制,通过内置防护防止基于 URL 的数据外泄和提示注入。
OpenAI 发布技术深度文章,拆解 Codex 的智能体循环,说明 Codex CLI 如何借助 Responses API 编排模型、工具、提示词与性能。文章为技术向解读,未在摘要中给出具体实现细节或性能数字。
推荐理由:OpenAI 官方拆解 Codex CLI 如何用 Responses API 编排模型、工具与提示词,可了解智能体循环的工程实现思路。
Datadog 采用 OpenAI 的 Codex 进行系统级代码审查。该方案将 Codex 用于代码审查环节,具体部署规模、审查效率等细节尚未披露。
Netomi 借助 GPT-4.1 和 GPT-5.2 规模化企业级 AI 智能体,通过并发、治理与多步推理支撑可靠的生产工作流。这是 OpenAI 官方发布的 Netomi 落地经验分享,正文仅提供摘要。
推荐理由:Netomi 用 GPT-4.1 与 GPT-5.2 支撑企业级智能体的并发、治理与多步推理,可看规模化落地的工程取舍。
Tolan 基于 GPT-5.1 打造了一款语音优先的 AI 伴侣,结合低延迟响应、实时上下文重建和记忆驱动的人格,实现自然对话。
OpenAI 正在用强化学习训练的自动化红队加固 ChatGPT Atlas,抵御提示注入攻击。这一发现与修补的循环有助于尽早识别新型攻击手法,并在 AI 愈发智能体化的过程中强化浏览器智能体的防御。
推荐理由:OpenAI 披露用强化学习训练的自动化红队持续发现并修补 ChatGPT Atlas 的提示注入漏洞,可了解浏览器智能体的安全加固思路。
OpenAI 用 Codex 在 28 天内完成 Sora 安卓版的交付。团队借助 AI 辅助规划、翻译和并行编码工作流,以精简人力实现快速且可靠的开发。
推荐理由:OpenAI 用 Codex 在 28 天内完成 Sora 安卓版交付,可看到 AI 辅助规划与并行编码在真实项目中的分工方式。
OpenAI 发布 GPT-5.2,称其是面向日常专业工作最先进的前沿模型,具备领先的推理、长上下文理解、编码和视觉能力。该模型可在 ChatGPT 和 OpenAI API 中使用,用于支撑更快、更可靠的智能体工作流。
推荐理由:OpenAI 官方发布 GPT-5.2,读者可据此了解其在推理、长上下文、编码与视觉上的定位及可用渠道。
OpenAI 在 Linux 基金会下联合发起 Agentic AI Foundation,并捐出 AGENTS.md,用于支持安全智能体 AI 的开放、可互操作标准。
推荐理由:OpenAI 把 AGENTS.md 捐给 Linux 基金会下的新基金会,读者可据此观察智能体标准与生态归属的走向。
OpenAI 发布 GPT-5.1-Codex-Max,一款面向 Codex 的更快、更智能的智能体编程模型。该模型面向长时间运行的项目级工作,在推理能力和 token 效率上有所增强。
推荐理由:OpenAI 发布面向 Codex 的智能体编程模型,读者可据此判断长周期项目级编码任务的模型选型方向。
OpenAI 发布 GPT-5.1-Codex-Max 系统卡,说明该模型实施的安全措施。系统卡涵盖模型层缓解措施,包括针对有害任务和提示注入的专门安全训练,以及产品层缓解措施,如智能体沙箱和可配置网络访问。
推荐理由:系统卡披露了 GPT-5.1-Codex-Max 在模型层与产品层分别采取的安全措施,可供评估其智能体沙箱与网络访问配置。
OpenAI 发布 Aardvark,一款 AI 驱动的安全研究员,可自主发现、验证并协助修复大规模软件漏洞。该系统目前处于私有测试阶段,可报名参与早期测试。
推荐理由:OpenAI 官方发布智能体安全研究员 Aardvark,可自主发现并验证软件漏洞,目前处于私有测试阶段。
Consensus 使用 GPT-5 和 OpenAI 的 Responses API 构建多智能体研究助手,可在数分钟内阅读、分析并综合证据,服务超过 800 万名研究人员,加速科学发现。
推荐理由:Consensus 用 GPT-5 与 Responses API 搭建多智能体研究助手,可看到模型能力如何嵌入科研检索场景。
OpenAI Codex 现已正式开放(generally available),面向开发者新增多项功能:Slack 集成、Codex SDK,以及用量看板和工作区管理等管理工具。官方称这些更新让 Codex 更易使用,也更容易在规模化场景下管理。
推荐理由:Codex 正式开放并补齐 Slack 集成、SDK 与用量看板,读者可据此判断团队规模化接入的可行性。
OpenAI 发布 AgentKit、扩展的 Evals 能力以及面向智能体的强化微调(RFT),用于帮助开发者更快从原型走向生产。官方称这三项工具面向智能体开发流程,但未在摘要中给出具体功能细节与可用范围。
推荐理由:OpenAI 官方发布 AgentKit、扩展的 Evals 与面向智能体的强化微调,读者可据此判断智能体开发工具链的补齐方向。
OpenAI 宣布 Codex 升级,速度更快、更可靠,在实时协作和独立处理任务方面表现更好。升级后的 Codex 可在终端、IDE、网页乃至手机上使用。
推荐理由:Codex 本次升级集中在速度、可靠性与实时协作,并扩展到终端、IDE、网页和手机多端使用。
OpenAI 发布 GPT-5 系统卡增补,公布新模型 GPT-5-Codex,这是 GPT-5 针对 Codex 中智能体编程进一步优化的版本。GPT-5-Codex 会根据任务复杂度更动态地调整思考投入,对简单对话查询或小任务快速响应,对更复杂的任务则独立工作更长时间。
推荐理由:GPT-5 系统卡增补披露 GPT-5-Codex 按任务复杂度动态调整思考投入,可据此判断其在智能体编程场景的定位。
OpenAI 发布更先进的语音到语音模型 gpt-realtime,并更新 Realtime API,新增 MCP server 支持、图像输入和 SIP 电话呼叫支持。
推荐理由:OpenAI 发布语音到语音模型 gpt-realtime,并同步扩展 Realtime API 的 MCP、图像输入与 SIP 通话能力。
Intercom 分享了构建可扩展 AI 平台的三条经验,涵盖评估体系与架构设计,目标是引领客户支持的未来。
Outtake 使用 GPT-4.1 和 OpenAI o3 驱动 AI 智能体,检测和处置数字威胁的速度比此前快 100 倍。
推荐理由:原文给出 Outtake 用 GPT-4.1 与 o3 驱动智能体处理数字威胁的场景和提速倍数,可看 AI 安全运营的落地方式。
Model ML CEO Chaz Englander 在 OpenAI Executive Function 系列访谈中,讲述 AI 原生基础设施与自主智能体如何重塑金融服务工作流。