阿里云云栖大会升级全栈 AI 基础设施,提出 Agent 时代「芯云模一体」
阿里云在云栖大会上沿模型生产、智能落地、系统自进化三条效率线,升级从数据入湖、训练集生产、模型训练、推理服务到系统自我优化的整条链路,并强调「芯云模一体」的协同设计。
推荐理由:阿里云在云栖大会对数据、训练、推理到自进化链路的整体升级,呈现了 Agent 负载对基础设施提出的新要求。
与落地强相关的大模型进展:新模型发布、能力边界变化、价格与可用性——只收对部署决策有影响的。
阿里云在云栖大会上沿模型生产、智能落地、系统自进化三条效率线,升级从数据入湖、训练集生产、模型训练、推理服务到系统自我优化的整条链路,并强调「芯云模一体」的协同设计。
推荐理由:阿里云在云栖大会对数据、训练、推理到自进化链路的整体升级,呈现了 Agent 负载对基础设施提出的新要求。
DeepSeek 将算子开发产品 TileLang 官宣原生支持华为昇腾 950 NPU,并同步推出 DeepGEMM、DeepEP、FlashMLA、TileKernels、DeepSelect 五大核心计算与通信库的昇腾版本。
推荐理由:原文梳理了 TileLang 原生支持昇腾 950 的架构设计与基准数据,可据此判断国产算子工具链的跨平台适配路径。
作者在 Claude Code 中用同一任务实测同日发布的 Qwen3.8-Flash 与 GLM-5.3-Flash,要求从零开发一个含任务、日程、笔记、Dashboard 和全局搜索的个人工作台。
推荐理由:同一任务下对比两款 Flash 模型的办公工作台开发表现,并给出任务成本估算,可作选型参考。
雷锋网把 AgnesCode + Agnes 3.0 Flash 与 Codex + GPT-5.6 Sol 放进众智 FlagOS 开放计算全球大赛的 DeepSeek-V3 解码阶段融合 QKV-A 下投影算子题(Task66: dsv3_fused_a_gemm),在 8 款芯片上接受赛事官方自动化评测。
推荐理由:雷锋网用同一道算子优化题对比免费 AgnesCode 与付费 Codex,给出跨芯片加速比与耗时数据,可作 Agent 底层工程能力的参照。
斯坦福团队项目 HomeBody 让 GPT-6 Astra 接上宇树 G1 进入厨房干活,机器人先探索陌生厨房并保存空间记忆,再按语言指令收拾物品、丢弃纸盒,甚至从视野外的抽屉取药递给人。
推荐理由:斯坦福 HomeBody 项目展示了 GPT-6 Astra 调度技能库控制宇树 G1 完成厨房任务,读者可了解大模型控制机器人的技能调用分工方式。
DeepSeek 在知乎独家发布技术长文,首次系统阐释支撑 DeepSeek-V4 全部训练、评测与数据预处理流程的沙盒基础设施 DeepSeek 弹性计算(DSec),相关技术报告已公开至 arXiv,由 DeepSeek 联合清华大学发布,作者团队超过 130 人。
推荐理由:DeepSeek 公开了支撑 V4 系列 Agent 训练的沙盒基础设施细节,读者可了解大规模 Agent RL 训练的工程约束与解法。
9月30日,DeepSeek 正式开源面向昇腾算力平台的基础设施组件,涵盖 TileLang 高级语言编译工具、高性能计算库与分布式通信库,与此前面向 GPU 平台开源的组件一一对应。
推荐理由:DeepSeek 把面向昇腾的基础设施组件开源,并给出超节点部署的实测吞吐数据,可据此判断国产算力承载大模型的成熟度。
AMD 宣布以约 82 亿美元全股票收购李飞飞创办的 World Labs,预计 2026 年底前完成交割,仍需通过监管审批,这是 AMD 历史上第二大收购。交割后李飞飞将出任 AMD 执行副总裁兼首席科学家,直接向 CEO 苏姿丰汇报。AMD 表示这笔交易看重的是 World Labs 的模型经验,用以理解推理、机器人和物理 AI 等负载如何演变,从而塑造未来的芯片技术路线图。
推荐理由:AMD 以 82 亿美元全股票收购 World Labs,读者可借此理解芯片公司为何要买模型团队来提前定义算力需求。
OpenAI 发布 GPT-6.1 Sol,面向编码、电脑操作和专业工作,具备接近 Astra 的智能水平。其标准 API 输入与输出 token 价格均为 Astra 的五分之一。
推荐理由:OpenAI 发布 GPT-6.1 Sol,主打编码、电脑操作与专业工作,API 价格降至 Astra 的五分之一。
极客公园梳理了外媒披露的 Anthropic IPO 招股书中的 7 个细节。2025 年约 420 亿美元净亏损中约 340 亿美元是融资工具估值上升带来的会计费用,收入从 3.86 亿美元增至 45.9 亿美元,经营亏损从 29.8 亿美元扩大到 80.6 亿美元。
推荐理由:梳理 Anthropic 招股书中 420 亿美元亏损、650 亿美元年化收入与 50.1% 投票权等细节,帮助理解前沿大模型公司上市时的估值与治理逻辑。
沙利文联合头豹发布的《2026 年中国汽车 AI 云市场追踪报告(26H1)》显示,阿里云在中国汽车公有云市场份额达 45.2%,在智能驾驶、智能座舱、工业提效等六项市场及细分赛道均列第一。
推荐理由:沙利文报告给出阿里云在中国汽车公有云 45.2% 的份额,并串起座舱 Agent、智驾数据产线与车企组织 AI 三条落地线索。
TypeSafe AI 的 Jev 模型发布不到 1 个月,公司正洽谈 10 亿美元融资、最新估值 100 亿美元;此前 9 月 15 日发布早期访问版本时,公司宣布获 DCVC 领投的 4000 万美元种子轮融资、估值 2 亿美元。
推荐理由:RLHF 合著者公开质疑自己参与创造的训练范式,并解释为何 ChatGPT 与 Claude Code 同属 assistance 时代。
Anthropic 与 Akamai 签署为期 7 年、价值 116 亿美元的合同,Akamai 以分布式 AI 基础设施满足其 CPU 工作负载需求,该承诺对应 Akamai 55 亿美元额外资本支出,双方还可将合同扩大最多 90 亿美元。
推荐理由:汇总了 Anthropic 算力协议、OpenAI 订阅层级与 DeepSeek 桌面版等多条动态,可快速了解 AI 基础设施与产品线的近期变化。
Hyper3D 近日上线智能交互功能 Agentic Mode,将 Hyper3D Rodin 与 LLM 多模态上下文分析整合进同一流程,自主理解输入、优化素材并按任务选择建模路径,生成能力从创意资产延伸到带尺寸产品图纸的工业设计建模。
推荐理由:Hyper3D 把输入理解与建模路径选择交给 Agent,读者可据此判断专业 3D 能力接入 Agent 工作流的门槛变化。
Harvey 使用 GPT-6 Astra 生成结构更清晰、更贴合语境的法律文书,让律师能把精力放在策略上。该消息来自 OpenAI 官方,正文仅提供摘要,未披露具体功能细节或落地数据。
invideo 使用 GPT-6 Astra 后,剪辑规划精度提高,色彩校正与调色效率提升 3 倍,并能在一天内产出 50 个自定义特效。
推荐理由:原文给出 invideo 使用 GPT-6 Astra 后的剪辑规划精度与调色效率变化,可作模型在视频编辑场景落地的参考。
9 月 22 日 2026 杭州云栖大会上,平头哥发布新一代训推一体 AI 芯片真武 V900,搭载 216GB 显存、片间互联带宽 1200GB/s,单芯片性能是上一代真武 M890 的 3 倍,原生支持 FP8 和 FP4,计划 2027 年第一季度量产销售。
推荐理由:平头哥在云栖大会发布真武 V900 及算存网全栈产品,读者可了解 Agentic 负载下 AI 芯片与互联、CPU 协同的设计思路。
Airbnb 正在扩大对 GPT-6 Astra 和 OpenAI 前沿模型的接入,用于帮助工程团队排查缺陷、设计系统并加快交付。原文仅提供摘要,未披露具体使用规模、接入方式或效果数据。
OpenAI 宣布 GPT-6 改进了 prompt caching,带来更高的缓存命中率、新的诊断能力、显式断点以及可降低延迟和成本的控制项。原文未给出具体命中率、延迟或成本数字。
OpenAI 发布 GPT-6 Sol 和 Luna 两款模型,面向日常工作场景提供前沿智能,在能力与成本之间采用不同的平衡方式。