OpenAI 更新 Agents SDK,加入原生沙箱执行与模型原生 harness
OpenAI 更新 Agents SDK,新增原生沙箱执行和模型原生 harness,帮助开发者在文件和工具之间构建安全、长时间运行的智能体。
推荐理由:OpenAI 官方说明 Agents SDK 新增原生沙箱执行与模型原生 harness,读者可据此判断长时运行智能体的构建方式变化。
把智能体送进生产环境的工程实践:Agent 架构、工作流设计、工具调用、评测与可观测性。
OpenAI 更新 Agents SDK,新增原生沙箱执行和模型原生 harness,帮助开发者在文件和工具之间构建安全、长时间运行的智能体。
推荐理由:OpenAI 官方说明 Agents SDK 新增原生沙箱执行与模型原生 harness,读者可据此判断长时运行智能体的构建方式变化。
Cloudflare 将 OpenAI 的 GPT-5.4 和 Codex 引入 Agent Cloud,让企业能够构建、部署并规模化运行面向真实任务的 AI 智能体,并强调速度与安全。
推荐理由:Cloudflare 把 OpenAI 的 GPT-5.4 与 Codex 接入 Agent Cloud,读者可了解企业构建和部署智能体的新入口。
OpenAI 推出 Safety Bug Bounty 计划,用于发现 AI 滥用与安全风险,覆盖范围包括智能体漏洞、提示注入和数据外泄。
推荐理由:OpenAI 把智能体漏洞、提示注入和数据外泄纳入漏洞赏金范围,可了解其安全风险的外部发现机制。
OpenAI 介绍其如何用思维链监控研究内部编码智能体的偏离行为,通过分析真实部署来发现风险并强化 AI 安全防护措施。
推荐理由:OpenAI 公开其内部编码智能体的思维链监控做法,为团队观察智能体偏离行为提供一种可参考的工程思路。
OpenAI 官方发文说明 ChatGPT 如何抵御提示注入与社交工程攻击,方式是在智能体工作流中限制高风险动作并保护敏感数据。原文仅提供摘要,未展开具体机制与案例。
推荐理由:OpenAI 官方说明 ChatGPT 在智能体工作流中如何通过限制高风险动作与保护敏感数据来抵御提示注入。
OpenAI 介绍如何用 Responses API、shell 工具和托管容器构建智能体运行时,让智能体在文件、工具和状态支持下安全、可扩展地运行。
推荐理由:OpenAI 官方说明如何用 Responses API、shell 工具与托管容器搭建智能体运行时,可了解其安全与扩展思路。
OpenAI 推出 Codex Security,这是一款 AI 应用安全智能体,可分析项目上下文来检测、验证并修复复杂漏洞,官方称其置信度更高、噪声更少。该产品目前处于研究预览阶段。
推荐理由:OpenAI 官方发布 Codex Security 研究预览,读者可了解其以项目上下文检测、验证并修复漏洞的定位。
Balyasny Asset Management 结合严格的模型评测、对 OpenAI 全平台的使用以及智能体工作流,重构投资研究流程。原文未披露具体业务指标与实施细节。
推荐理由:材料仅给出场景与做法方向,缺少具体指标,读者可先了解资管机构如何把模型评测与智能体工作流接入投研。
OpenAI 在 Amazon Bedrock 推出面向智能体的有状态运行时环境,为多步 AI 工作流提供持久编排、记忆与安全执行能力。该运行时面向由 OpenAI 驱动的多步 AI 工作流。
推荐理由:OpenAI 与 Amazon Bedrock 的智能体运行时补齐持久编排与记忆,可据此判断多步工作流的部署方式。
OpenAI 宣布推出 Frontier Alliance Partners,帮助企业从 AI 试点阶段迈向生产环境,实现安全、可扩展的智能体部署。
推荐理由:OpenAI 推出 Frontier Alliance Partners,指向企业从 AI 试点走向规模化智能体部署的生态合作路径。
OpenAI 与 Paradigm 联合推出 EVMbench,用于评测 AI 智能体检测、修补和利用高危智能合约漏洞的能力。该基准覆盖漏洞检测、补丁修复与漏洞利用三类任务。
推荐理由:OpenAI 与 Paradigm 联合推出智能体安全评测基准,关注 AI 在智能合约漏洞检测与修复上的能力边界。
OpenAI 发布企业平台 OpenAI Frontier,用于构建、部署和管理 AI 智能体。该平台提供共享上下文、入职引导、权限与治理能力。
推荐理由:OpenAI 官方发布企业级智能体平台 Frontier,可据此了解其在共享上下文、权限与治理上的产品定位。
OpenAI 发布 GPT-5.3-Codex,这是一款 Codex 原生的智能体,将前沿编码性能与通用推理能力结合,用于支持长周期、真实世界的技术工作。
推荐理由:OpenAI 发布 Codex 原生智能体 GPT-5.3-Codex,读者可据此判断其编码能力与通用推理结合后的长周期任务定位。
OpenAI 发布 GPT-5.3-Codex 系统卡,称其为迄今能力最强的智能体编码模型。该模型结合了 GPT-5.2-Codex 的前沿编码性能与 GPT-5.2 的推理和专业领域知识能力。
推荐理由:OpenAI 官方系统卡给出 GPT-5.3-Codex 的能力定位,读者可据此判断它在智能体编码任务上的升级幅度。
OpenAI 发布 Codex App Server,这是一个双向 JSON-RPC API,用于把 Codex 智能体嵌入到应用中。该接口支持流式进度、工具调用、审批和 diff 等能力。
推荐理由:OpenAI 官方说明 Codex App Server 如何以双向 JSON-RPC API 把 Codex 智能体嵌入自有应用。
OpenAI 发布面向 macOS 的 Codex 应用,定位为 AI 编程与软件开发的指挥中心,支持多个智能体、并行工作流和长时间运行的任务。
推荐理由:OpenAI 官方发布 macOS 版 Codex 应用,读者可据此了解其多智能体并行与长任务编排的定位。
OpenAI 介绍了其自建内部 AI 数据智能体,该智能体使用 GPT-5、Codex 和记忆机制对大规模数据集进行推理,可在数分钟内给出可靠洞察。
推荐理由:OpenAI 公开自建内部数据智能体的技术组合,读者可了解其用 GPT-5、Codex 与记忆机制处理大规模数据集的做法。
OpenAI 发布技术深度文章,拆解 Codex 的智能体循环,说明 Codex CLI 如何借助 Responses API 编排模型、工具、提示词与性能。文章为技术向解读,未在摘要中给出具体实现细节或性能数字。
推荐理由:OpenAI 官方拆解 Codex CLI 如何用 Responses API 编排模型、工具与提示词,可了解智能体循环的工程实现思路。
Netomi 借助 GPT-4.1 和 GPT-5.2 规模化企业级 AI 智能体,通过并发、治理与多步推理支撑可靠的生产工作流。这是 OpenAI 官方发布的 Netomi 落地经验分享,正文仅提供摘要。
推荐理由:Netomi 用 GPT-4.1 与 GPT-5.2 支撑企业级智能体的并发、治理与多步推理,可看规模化落地的工程取舍。
OpenAI 正在用强化学习训练的自动化红队加固 ChatGPT Atlas,抵御提示注入攻击。这一发现与修补的循环有助于尽早识别新型攻击手法,并在 AI 愈发智能体化的过程中强化浏览器智能体的防御。
推荐理由:OpenAI 披露用强化学习训练的自动化红队持续发现并修补 ChatGPT Atlas 的提示注入漏洞,可了解浏览器智能体的安全加固思路。