大模型一体机开始缩水:满血版遇冷,轻量化 AI BOX 兴起
大模型一体机市场正从追捧 671B 满血版转向轻量化设备,多数中端机型最多只能运行 70B 级别模型。文章归因于需求挤泡沫、模型能力密度提升、高端芯片供给受限和内存涨价,并指出满血高端机型仍集中在有强合规要求的央国企和金融机构。
推荐理由:梳理大模型一体机从满血版遇冷到轻量化 AI BOX 兴起的市场分层,并给出高端机型仍适用的合规与生产场景。
大模型一体机市场正从追捧 671B 满血版转向轻量化设备,多数中端机型最多只能运行 70B 级别模型。文章归因于需求挤泡沫、模型能力密度提升、高端芯片供给受限和内存涨价,并指出满血高端机型仍集中在有强合规要求的央国企和金融机构。
推荐理由:梳理大模型一体机从满血版遇冷到轻量化 AI BOX 兴起的市场分层,并给出高端机型仍适用的合规与生产场景。
独立股票分析师 MBI 在财经播客《The Synopsis》中表示,测试 Meta 的 Muse AI 智能体约 10 天后清仓了重仓的 Airbnb 并加仓 Meta,理由是智能体可能绕过 Airbnb 等平台直接完成预订。
推荐理由:独立分析师以实测 Muse 的体验为据,推演 AI 智能体绕过 OTA 平台直接完成预订对平台经济的冲击。
白宫召集扎克伯格、贝索斯、马斯克及Anthropic的Dario Amodei等科技CEO签署AI安全承诺,特朗普称其"具有道德约束力",并签署行政令将AI正式更名为"超级智能"。TechCrunch的Equity播客本期讨论消费者AI的糟糕经济账,指出AI最大收入仍来自企业端。
Clay 联合创始人兼 CEO Kareem Amin 将在 TechCrunch Disrupt 2026 的 AI Stage 发表演讲“The GTM Engineer: How AI Created Tech's Next Big Job Category”,探讨 AI 如何重塑传统 GTM 技术栈并催生 GTM 工程师这一新职业。
埃森哲2026财年总收入约742亿美元,本币增长5%,全年新签订单845亿美元,其中Managed Services收入373亿美元,四年间贡献接近八成的收入增量。文章认为AI减少了单项任务所需人力,却扩大了企业在数据、系统、权限和流程上的改造范围,超过400个客户首次启动与埃森哲合作的Advanced AI项目。作者据此判断,服务商的价值正从给出答案转向把AI装进真实企业并长期运营。
推荐理由:文章用埃森哲财年数据与ISG合同结构,解释AI压缩人工投入后咨询收入为何仍增长,并给出服务商竞争位置的三条判断。
Meta 9月8日发布首款智能代理产品Muse,登顶美国App Store免费榜,下载量超250万,美国移动端日活64.2万,是ChatGPT上线同期23.1万的近三倍。
推荐理由:文章对比Meta Muse与国内大厂Agent路径,指出封闭生态下更可能出现生态内管家而非跨平台通用Agent。
贝恩公司报告称,全球 AI 行业到 2031 年每年需创造 6 万亿美元营收,才能支撑当前数据中心建设的巨额资本投入;现有消费级和企业级 AI 服务最多贡献 1.8 万亿美元,还需找到 4.2 万亿美元新增收入,可能来自自动化机器、机器人以及药物研发、心理健康和能源生产等起步阶段市场。
推荐理由:贝恩给出 AI 行业 2031 年需 6 万亿美元年营收的测算,并指出基础设施投入已跑在需求前面,可供判断算力投资节奏。
OpenAI 两位员工 10 月 1 日发布长文《The eternal complement》,提出前沿智能与执行层面的"机构智能"互为互补品,机器智能的大部分工时可能花在枯燥、庞大、重复的执行工作上。
作者用同一份脏销售流水和同一句提示词实测 WorkBuddy、千问办公和豆包工作,三家都交付了 Excel、PPT 和摘要,但算出的季度总额最高比最低多出 57.7%。
推荐理由:作者用同一份脏数据和同一句提示词实测三款办公 Agent,并拆开安装包对比执行环境,可看到三家在纠错方式与责任归属上的差异。
作者把同一句模糊指令交给 GPT-6 Astra Pro、Claude Fable 5.1 和 GPT-5.6 Sol,三者都让两轴云台转了起来,但对完成的理解不同:Sol 和 Fable 走完四个组合极限角,Astra 只用 7 步分别抵达两轴边界。
推荐理由:作者用同一台云台机器人实测三个模型,从动作数、速度参数和验证机制看它们对完成与风险的不同理解。
作者用三张圆明园鼠首照片和一段自然语言指令,让 GPT-6 Astra 在 Codex 中调度 Aholo Lux3D 生成 3D 模型,再交由 Blender 检查、调材质、加底座并渲染导出。
推荐理由:作者用三张鼠首照片跑通从自然语言到可交付 3D 资产的完整链路,并给出耗时与成本数据,可据此判断专业模型接入通用 Agent 的工程化路径。
TechCrunch 分析认为,消费级 AI 的付费增长近乎线性。a16z 半年度 State of Markets 报告引用 PNC 今年夏季的数据显示,截至 5 月仅 2.2% 的消费者为 AI 付费,月均支出 31 美元;即便 GPT-5.2 到 Astra 性能大幅提升,图表上也几乎看不出变化。
OpenAI 提出,先进 AI 的价值可能最体现在突破性创意背后的日常工作,执行环节或将决定下一轮经济的形态与进步速度。
Airbnb 本周随秋季更新上线新的 AI 搜索,CEO Brian Chesky 在采访中表示聊天机器人不适合电商浏览,Airbnb 的搜索界面还会继续演进。
阶跃星辰9月20日发布Step 5 Preview,原生支持文本与视觉输入,重点面向编程、软件工程、专业知识工作和长程Agent任务,第三方平台Artificial Analysis智能指数中与Kimi K3并列全球开源第二,但随小米MiMo-V2.6发布后下滑至第三。
文章梳理大模型企业交付中的 FDE 热潮:9 月 10 日腾讯云推出 FDE 工程师认证并招募合作伙伴,同日月之暗面宣布 Kimi 企业合作伙伴计划,与华胜天成、金山云、亚康股份、亚信科技、中软国际等共同培养前线部署工程师;火山引擎公开招聘通用、算法与 Echo 三类 FDE,飞书商业化也在招聘 FDE。
推荐理由:文章对比腾讯、字节、Kimi、OpenAI 四种 FDE 组织路径,并给出交付成本能否被摊薄的判断框架。
阿里云在云栖大会上沿模型生产、智能落地、系统自进化三条效率线,升级从数据入湖、训练集生产、模型训练、推理服务到系统自我优化的整条链路,并强调「芯云模一体」的协同设计。
推荐理由:阿里云在云栖大会对数据、训练、推理到自进化链路的整体升级,呈现了 Agent 负载对基础设施提出的新要求。
OpenAI 研究员 Noam Brown 在播客访谈中表示,1 万个 Agent 耗时 88 小时、消耗 1300 亿 token 解出千禧年数学难题,但他认为多智能体最多只占其中 10% 的功劳,核心仍是模型本身足够强。
量子位对话节目邀请西门子Xcelerator中国销售与生态成功负责人顾欣和阿丘科技创始人兼CEO黄耀,复盘工业AI从落地到规模化的链路。黄耀以半导体晶圆切割为例,称导入智能体技术后设备OEE和产能可提升25%左右,并认为当前机会集中在高价值、数据ready、技术可行三者交叉的场景。
雷锋网分析指出,Personal Agent 正成为 AI 产品竞争的新方向:Meta 的 Muse 截至 9 月下旬下载量突破 300 万,OpenAI 于 9 月 29 日发布长期在线的个人 Agent 产品 dots,Manus 于 9 月 28 日推出独立应用 Cue,千问、豆包(代号 Spell)、腾讯(代号 Handy Bot)也在跟进。
推荐理由:文章梳理 Personal Agent 集中爆发的产品节奏,并指出平台授权与超级 App 生态是这类产品落地的主要阻力。
作者在 Claude Code 中用同一任务实测同日发布的 Qwen3.8-Flash 与 GLM-5.3-Flash,要求从零开发一个含任务、日程、笔记、Dashboard 和全局搜索的个人工作台。
推荐理由:同一任务下对比两款 Flash 模型的办公工作台开发表现,并给出任务成本估算,可作选型参考。
OpenAI 于 8 月 19 日正式开源 Codex Harness,开放的是支撑 Codex App、CLI 和 IDE Extension 的 Agent Loop,开发者可通过 SDK 和 App Server 接入任务管理、工具调用、事件回传与人工审批。
推荐理由:借 Codex Harness 开源与一次 20 分钟实测,讨论技术领先为何难以成为护城河,以及开源换分发的路径。
雷锋网用同一道长任务对比 OpenClaw v2026.7.1-2 与 v2026.8.1(2.0),两版总耗时基本持平(103.3 分钟对 106.1 分钟),但 2.0 的 LLM 请求从 74 次降到 46 次、工具调用从 100 次降到 65 次。
推荐理由:同一道长任务对比 OpenClaw 1.x 与 2.0,给出请求次数、token 与上下文压缩的后台数据,可判断其长任务托管能力。
雷锋网把 AgnesCode + Agnes 3.0 Flash 与 Codex + GPT-5.6 Sol 放进众智 FlagOS 开放计算全球大赛的 DeepSeek-V3 解码阶段融合 QKV-A 下投影算子题(Task66: dsv3_fused_a_gemm),在 8 款芯片上接受赛事官方自动化评测。
推荐理由:雷锋网用同一道算子优化题对比免费 AgnesCode 与付费 Codex,给出跨芯片加速比与耗时数据,可作 Agent 底层工程能力的参照。
36氪 AI 测评发起轻访谈栏目《了不起的OPC,你在用AI做什么?》,邀请在真实工作、创业或创作中持续使用 AI 的实践者线下出镜,聊 AI 实操、真实效果与踩过的坑。访谈约半小时,内容经图文稿与剪辑视频制作后,在 36氪 App、PC 端及 AI 测评网等渠道发布。
TypeSafe AI 的 Jev 模型发布不到 1 个月,公司正洽谈 10 亿美元融资、最新估值 100 亿美元;此前 9 月 15 日发布早期访问版本时,公司宣布获 DCVC 领投的 4000 万美元种子轮融资、估值 2 亿美元。
推荐理由:RLHF 合著者公开质疑自己参与创造的训练范式,并解释为何 ChatGPT 与 Claude Code 同属 assistance 时代。
在云栖大会 AI Native 组织论坛上,阿里巴巴集团 CPO 蒋芳与阿里云 CIO 蒋林泉首次由两条线共同讨论 AI 时代的组织变革,核心判断是超级个体的集合并不会自然形成超级组织。
推荐理由:阿里 CPO 与 CIO 两条线首次同台,给出 AI Native 组织转型的岗位合并、系统开放与数字员工等具体做法。
阿里将 QoderWork、钉钉悟空、Mulerun 等 AI 办公产品和团队整合为千问办公,9 月 22 日云栖大会期间发布企业上下文、协作功能、QwenNote A2 和自定义行业工作台,核心概括为 Context is all you need。
推荐理由:千问办公负责人束骏亮谈企业 Agent 的身份权限、上下文归属与 FDE 现场共创,可看到阿里企业 AI 战略的取舍。
OPPO ColorOS 智慧产品研发总监姜昱辰认为,云端大模型能力趋同后,AI 手机的差异将来自端侧模型、记忆与 AIOS,而按“说一句话把事办了”的标准,目前没有一台手机及格。
推荐理由:OPPO 智慧产品研发总监解释为何把 AI 手机能力压在端侧与记忆,并给出与腾讯地图 A2A 合作的具体改造与留存数据。
在云栖大会「AI 原生重塑企业生产力」论坛上,千问办公事业部陈宇森提出,衡量 AI 原生组织要看有多少工作量由 AI 真实闭环,而非贴标签。阿里巴巴披露与 Token 相关的 MaaS 业务 ARR 达 160 亿元,加上 AI 云后超过 400 亿元。
推荐理由:文章用派兹互连、信永中和等案例,呈现企业把业务交给 Agent 后组织与成本结构的变化,可对照自身流程判断改造门槛。
阿里巴巴集团 CEO 吴泳铭在 9 月 22 日杭州云栖大会演讲中提出,未来机器供给的思考总量将是人类的 1000 倍以上,并明确 AI 模型、AI 芯片和 AI 云为机器智能时代三大基石。阿里同步推进全栈优化,从平头哥真武 V900、倚天 CPU 到千问 AI 平台、Agent Studio 和 AgentCore,瞄准 Agent 落地中的算力效率、长任务可靠性与成本问题。
OpenAI 经济研究显示,员工使用 AI 的方式已超出传统岗位职责,部分新活动正成为其工作中反复出现的固定环节。
OpenAI 探讨更强、更实惠的 AI 如何拓展人和企业能完成的工作,并让增长更经济。文章围绕能力提升与成本下降对工作范围的影响展开。
OpenAI 的 Jakub Pachocki 反思日益强大的 AI 以及保持其对齐的挑战,呼吁加强安全保障并推动国际协调。
OpenAI 发布内部观察,coding agent 正在重塑其 AI 研究方式。文章围绕 agent 使用情况、实验速度、任务复杂度和研究加速的早期数据展开,完整正文未在 feed 中提供。
推荐理由:OpenAI 官方披露内部 coding agent 使用数据,可观察智能体如何改变 AI 研究的工作节奏与任务复杂度。
OpenAI CFO Sarah Friar 阐述了芯片、算力、模型与产品各环节的进步如何相互叠加,从而以更大规模和更低成本交付更有用的智能。
OpenAI 推出新博客 Intelligence Age,探讨变革性 AI 可能如何重塑权力、治理、经济与个人自由。
OpenAI 发文指出 AI 正在同时重塑攻防两端的网络安全格局。文章介绍了 OpenAI 如何强化自身防御,并给出安全团队当下可采取的行动建议。
OpenAI 发布研究,梳理企业采用智能体 AI 的方式,涉及 ChatGPT 和 Codex 的使用,并指出前沿企业在 AI 采用上正在拉开差距。
推荐理由:OpenAI 基于自身研究给出企业采用智能体 AI 的观察,可了解前沿企业与一般企业在 AI 落地上的差距。
OpenAI CFO Sarah Friar 分享打造 AI 原生财务职能的五条经验,涵盖自动化预测、更强的管控以及 AI ROI。内容来自其亲身实践总结。