Wayfair 用 OpenAI 模型提升商品目录准确率与客服速度
Wayfair 使用 OpenAI 模型改进电商客服与商品目录准确率,自动化工单分流,并大规模优化数百万条商品属性。
推荐理由:Wayfair 用 OpenAI 模型做客服工单分流和商品属性补全,可看电商场景的自动化落点。
Wayfair 使用 OpenAI 模型改进电商客服与商品目录准确率,自动化工单分流,并大规模优化数百万条商品属性。
推荐理由:Wayfair 用 OpenAI 模型做客服工单分流和商品属性补全,可看电商场景的自动化落点。
Descript 借助 OpenAI 推理模型实现大规模内容库的自动本地化,在不丢失时间轴和语义的前提下完成多语言视频配音。
OpenAI 发布 GPT-5.4,称其为面向专业工作能力最强且高效的前沿模型,具备领先的编码、computer use、工具检索能力和 1M token 上下文。该模型由 OpenAI 官方发布,目前仅有摘要信息。
推荐理由:OpenAI 官方发布 GPT-5.4,给出编码、computer use、工具检索与 1M 上下文等能力定位,可供评估模型选型。
OpenAI 发布 GPT-5.4 Thinking 系统卡,正文内容未能获取,仅标题可用。
OpenAI 发布 GPT-5.3 Instant 系统卡,正文内容未获取到。
OpenAI 发布 GPT-5.3 Instant,官方称其在日常对话中更顺畅、更实用。该条信息仅有标题,正文未抓取到。
OpenAI 发布 GPT-5.3-Codex-Spark,称其为公司首个实时编程模型,生成速度提升 15 倍,支持 128k 上下文。该模型目前面向 ChatGPT Pro 用户开放研究预览。
推荐理由:OpenAI 推出首个实时编程模型,15 倍生成速度与 128k 上下文对编程场景的落地选型有参考意义。
OpenAI 分享了其 AI 本地化思路:全球共享的前沿模型可在不牺牲安全的前提下,适配各地的语言、法律与文化。
OpenAI 的 GPT-5 与 Ginkgo Bioworks 的云自动化结合组成自主实验室,通过闭环实验将无细胞蛋白质合成成本降低 40%。
推荐理由:原文给出 GPT-5 与 Ginkgo Bioworks 云自动化结合的闭环实验案例,可了解模型在生物实验降本上的具体幅度。
OpenAI 发布 GPT-5.3-Codex,这是一款 Codex 原生的智能体,将前沿编码性能与通用推理能力结合,用于支持长周期、真实世界的技术工作。
推荐理由:OpenAI 发布 Codex 原生智能体 GPT-5.3-Codex,读者可据此判断其编码能力与通用推理结合后的长周期任务定位。
OpenAI 发布 GPT-5.3-Codex 系统卡,称其为迄今能力最强的智能体编码模型。该模型结合了 GPT-5.2-Codex 的前沿编码性能与 GPT-5.2 的推理和专业领域知识能力。
推荐理由:OpenAI 官方系统卡给出 GPT-5.3-Codex 的能力定位,读者可据此判断它在智能体编码任务上的升级幅度。
OpenAI 介绍了其自建内部 AI 数据智能体,该智能体使用 GPT-5、Codex 和记忆机制对大规模数据集进行推理,可在数分钟内给出可靠洞察。
推荐理由:OpenAI 公开自建内部数据智能体的技术组合,读者可了解其用 GPT-5、Codex 与记忆机制处理大规模数据集的做法。
OpenAI 发布 Prism,一款内置 GPT-5.2 的免费 LaTeX 原生工作空间,帮助研究人员在同一处完成写作、协作与推理。
推荐理由:OpenAI 推出内置 GPT-5.2 的免费 LaTeX 原生工作空间,读者可了解其面向科研写作与协作的定位。
Praktika 利用 GPT-4.1 和 GPT-5.2 构建自适应 AI 导师,实现课程个性化、学习进度追踪,帮助学习者达成真实场景的语言流利度。该产品采用对话式教学路径,将大模型能力嵌入语言学习全流程。
OpenAI 最新报告揭示各国在先进 AI 采用上存在显著差异,并提出新举措帮助各国从 AI 中获取生产力收益。报告聚焦如何终结"能力悬置"(capability overhang)——即 AI 能力已具备但尚未被广泛采用的现象。
Tolan 基于 GPT-5.1 打造了一款语音优先的 AI 伴侣,结合低延迟响应、实时上下文重建和记忆驱动的人格,实现自然对话。
OpenAI 发布 GPT-5.2-Codex,称其为 OpenAI 最先进的编码模型,具备长周期推理、大规模代码转换和增强的网络安全能力。
推荐理由:OpenAI 官方公布 GPT-5.2-Codex 的定位与三项能力方向,可据此判断其是否适合长周期编码任务。
OpenAI 发布 GPT-5.2 系统卡增补文件,涉及 GPT-5.2-Codex。该页面正文未能抓取,目前仅有标题信息。
OpenAI 发布企业 AI 应用现状的数据驱动观察,展示组织如何从试验阶段走向实际生产力提升与新能力构建。
OpenAI 发布 GPT-5.2,称其是自家在数学与科学方面最强的模型,在 GPQA Diamond 和 FrontierMath 等基准上刷新了最优结果。官方表示这些提升已转化为实际研究进展,包括解决一个开放理论问题并生成可靠的数学证明。
推荐理由:GPT-5.2 在 GPQA Diamond 与 FrontierMath 上刷新结果,并给出解决开放理论问题、生成可靠数学证明的实例。
GPT-5.2 是 GPT-5 系列中的最新模型系列,其安全缓解方案与 GPT-5 系统卡和 GPT-5.1 系统卡所述基本一致。与 OpenAI 其他模型一样,GPT-5.2 模型在多样化数据集上训练,包括互联网公开信息、与第三方合作获取的信息,以及用户或人类训练师与研究人员提供或生成的信息。
OpenAI 发布 GPT-5.2,称其是面向日常专业工作最先进的前沿模型,具备领先的推理、长上下文理解、编码和视觉能力。该模型可在 ChatGPT 和 OpenAI API 中使用,用于支撑更快、更可靠的智能体工作流。
推荐理由:OpenAI 官方发布 GPT-5.2,读者可据此了解其在推理、长上下文、编码与视觉上的定位及可用渠道。
OpenAI 发布 2025 企业 AI 现状报告,基于其企业数据指出各行业 AI 采用正在加速、集成程度加深,并带来可量化的生产力提升。
推荐理由:OpenAI 基于自身企业数据给出 2025 年企业 AI 采用加速、集成加深与可量化生产力提升的年度判断。
Virgin Atlantic 正在用 AI 加快开发速度、改善决策并提升客户体验。该公司 CFO Oliver Byers 分享了这些应用方向。
OpenAI 宣布收购 Neptune,以加深对模型行为的可见性,并强化研究人员用于追踪实验和监控训练的工具。
推荐理由:OpenAI 收购 Neptune 以增强模型行为可见性,读者可据此了解其在训练监控与实验追踪工具链上的布局。
JetBrains 正在旗下编码工具中集成 GPT-5,帮助数百万开发者更快地设计、推理和构建软件。该消息由 OpenAI 官方发布,未披露具体接入的产品线、上线时间与功能细节。
推荐理由:JetBrains 把 GPT-5 接入旗下编码工具,读者可据此判断主流 IDE 厂商的模型选型方向。
OpenAI 发布 GPT-5.1-Codex-Max 系统卡,说明该模型实施的安全措施。系统卡涵盖模型层缓解措施,包括针对有害任务和提示注入的专门安全训练,以及产品层缓解措施,如智能体沙箱和可配置网络访问。
推荐理由:系统卡披露了 GPT-5.1-Codex-Max 在模型层与产品层分别采取的安全措施,可供评估其智能体沙箱与网络访问配置。
GPT-5.1 已在 API 中开放,带来更快的自适应推理、扩展的 prompt caching 和改进的编码表现,并新增 apply_patch 与 shell 工具。
推荐理由:GPT-5.1 进入 API 并新增 apply_patch 与 shell 工具,开发者可据此判断是否调整现有调用与工具链。
OpenAI 升级 GPT-5 系列,推出 GPT-5.1,官方称新模型更温暖、能力更强,并新增自定义 ChatGPT 语气和风格的方式。GPT-5.1 当天起向付费用户逐步推送。
推荐理由:OpenAI 官方发布 GPT-5.1,付费用户当天开始推送,可据此判断升级节奏与可用范围。
OpenAI 将提示注入视为 AI 系统的前沿安全挑战,并说明了这类攻击的运作方式。OpenAI 正从推进研究、训练模型和构建用户防护措施三方面应对该问题。
OpenAI 发文指出 AI 正在快速进步,人类有机会塑造其发展方向,使其走向科学发现、安全与惠及所有人的更好未来。
CRED 正与 OpenAI 合作,用 GPT 驱动的工具提升印度市场的高端客户体验,提高客服准确率、缩短响应时间并提升客户满意度。
OpenAI 发布 gpt-oss-safeguard,这是一组开放权重的推理模型,用于安全分类。开发者可以应用并迭代自定义策略。
推荐理由:OpenAI 发布开放权重安全分类推理模型,开发者可据此按自有策略迭代内容安全判定。
OpenAI 发布 gpt-oss-safeguard 技术报告,介绍 gpt-oss-safeguard-120b 和 gpt-oss-safeguard-20b 两个开源权重推理模型。这两个模型基于 gpt-oss 模型后训练,能够依据给定策略进行推理,从而按该策略对内容打标。报告描述了模型能力,并以底层 gpt-oss 模型为基线给出安全评测结果。
推荐理由:OpenAI 公开 gpt-oss-safeguard 两个开源权重模型的技术报告,并给出以 gpt-oss 为基线的安全评测结果。
Doppel 使用 GPT-5 和强化微调构建 AI 防御系统,在深度伪造与冒充攻击扩散前将其拦截,使分析师工作量下降 80%,响应时间从数小时缩短到数分钟。
推荐理由:原文给出 Doppel 用 GPT-5 与强化微调拦截深度伪造攻击的场景,以及分析师工作量和响应时长的具体变化。
Wrtn 借助 GPT-5 将 AI 应用在韩国的用户规模扩展到 650 万,打造融合生产力、创造力与学习的“生活方式 AI”,目前正向东亚其他地区扩张。
推荐理由:Wrtn 用 GPT-5 在韩国把 AI 应用做到 650 万用户,可看生活方式类 AI 的规模化路径。
SchoolAI 使用 GPT-4.1、图像生成和 TTS 构建安全、由教师引导的 AI 工具,覆盖超过 100 万间教室,用于提升参与度、监督能力和个性化学习。
推荐理由:材料给出 SchoolAI 用 GPT-4.1 等能力覆盖超 100 万间教室的场景,可看教育场景中教师主导的 AI 落地方式。
OpenAI 基于迄今规模最大的 ChatGPT 使用研究,揭示该工具如何通过个人与职业用途创造经济价值。研究显示,ChatGPT 的采用正从早期用户向更广泛人群扩展,逐步缩小差距并融入日常生活。
SafetyKit 借助 OpenAI GPT-5 扩展风险智能体,用于内容审核与合规执行,在准确性上超越传统安全系统。
OpenAI 发布新研究,解释语言模型产生幻觉的原因。研究结果显示,改进评测方式有助于提升 AI 的可靠性、诚实性与安全性。
推荐理由:OpenAI 从评测角度解释大模型幻觉的成因,读者可据此理解评测改进与模型可靠性之间的关系。