云雀 · 轻技术笔记

Anthropic 第一次用「workhorse」定义自家旗舰:定价权交接剧本已经到了

AIAgentLLM大模型定价权AIGC

2026 年 10 月 7 日这一天,HN 首页前三排排坐了三个名字——Claude Haiku 5.5、GPT‑6、还有那个看似不相关的"Meta 和 Microsoft 限制员工用 Claude"。这三个名字拼在一起讲了一件事:AI 圈定价权的交接剧本已经到了,不是哪个模型最强,是哪个模型最快变成 workhorse。

我把这周挖到的五件事串一起,再把"workhorse 化"剧本掰开讲透,最后给做工程的同行一份 30 天行动清单。

一、Haiku 5.5:Anthropic 第一次用「workhorse」来描述自家旗舰

先把数字摆出来。Artificial Analysis 给出的官方评估(10-07 数据,haiku-5-5 模型页):

  • Intelligence Index 43(同类模型 median 13),排第 2 / 182
  • 价格:$0.10 / M input tokens,$0.50 / M output tokens,cache 折扣 90%
  • 速度:243 tokens/s(同类 median 111)
  • Context window:1M tokens
  • Cost per task:$0.21(Intelligence Index 评估)
  • Verbosity:440M output tokens / Intelligence Index(同 median 是 100M,比中位数啰嗦 4.4 倍)

三个数字合在一起看:智能不输头部,速度 2 倍多寡,价格只有入门独一份。Anthropic 给它贴的标签不是 "frontier",不是 "SOTA",不是 "powerful"——是 "workhorse"。

"It performs well in the domains we've implemented it. Cheap, fast, good enough, multimodal. Its a workhorse and it strikes a nice balance." ——HN 评论,10-07

官方没这样贴标签,但开发者社区用 "workhorse" 来总结这个模型。Anthropic 在它自家文档里只写了 "fast, intelligent, and cost-effective"——但 HN 评论区把 "workhorse" 顶到了最高赞。这背后的意思,Anthropic 自己可能都没敢明说:

他们从「卖 SOTA 标价」切到了「卖 workhorse 标价」。

什么意思?以前卖的是「智能最高」——Opus 5.5 一轮 $39。M 价位高,买家愿意为功能付费。现在卖的是「智能够高 + 速度够快 + 价格够低」——Haiku 5.5 一轮 $0.21,是 Opus 5.5 的 1/185。这是 100 倍量级的价格下探。

为什么?因为定价权开始转移。卖 SOTA 的标价权正在被三个对手拆:开源模型(DeepSeek/Mistral/Qwen 在 70-90% 价位段饱和)+ 决策模型(Jev/Claude/Jev-like classifier 在杂活层动辄 1/10 成本)+ 闭源中型模型(Gemini 3.8 Live / Sonnet 5 / Haiku 5.5 自家中等价格段)。SOTA 这个标签不再是定价的护城河。

所以 Anthropic 必须用一个新的标签来卡位,那就是"性价比 + 速度 + 智能三方平衡的工作马力"。workhorse 这个词不是营销文案,是定价权战略。

但这里有个被所有人跳过的工程现实:verbosity 比中位数啰嗦 4.4 倍。Haiku 5.5 在 Intelligence Index 评估里生成了 440M tokens,中位数只有 100M。换句话说它思考时间更长、回答更啰嗦,但堆出了更高的智能分数。

这里有个工程上的两难——Haiku 5.5 用 verbosity 换智能,价格便宜了 100 倍但 token 烧得更多。HN 评论区"z.ai speed has been horrific, worse than sol-6.1 was last week, I am not renewing my sub once it expires"——这话反过来读就是「用便宜模型配长上下文省的钱,被 verbosity 烧的 token 抵消了一半」。

那么 Haiku 5.5 到底是不是真的 workhorse?取决于你怎么用它。如果你的场景是「一个智能调用 + 一个动作执行」,Haiku 5.5 便宜 100 倍还比头部模型略胜——这是真的 workhorse。如果你的场景是「100 个 RAG 调用 + 50 个 MCP 调用」,verbosity 会让你的 token 总账单跟 Sonnet 5 持平——这是假的 workhorse。

HN 评论区其实已经给了完整答案:"Tested on my RAG system containing all of cloudflare docs (more than 3000 A4 sized highly technical documents): best quality*speed/price ratio of any other model. And I have tested more than a 100 different models." ——这位开发者把"quality × speed / price"作为衡量,是把 workhorse 性能压成可量化的工程指标。Haiku 5.5 在这个指标下不是便宜 100 倍,是性价比 3-5 倍优势——这才是真实定价权。

Anthropic 第一次用「workhorse」来描述自家旗舰——这不是营销文案,是定价权战略的觉醒。卖 SOTA 的标价权正在被开源 + 决策模型 + 闭源中型模型三方夹击,Anthropic 必须把赌注押在新战场:workhorse。

二、GPT‑6 and Intelligent UI for everyone:OpenAI 把"开发者产品"压成"消费级操作系统"

同一天,OpenAI 发了一个 542 分的帖子——"GPT‑6 and Intelligent UI for everyone"。链接是 openai.com/index/gpt-6-for-everyone/,我们被 Cloudflare challenge 挡在外面了,但从标题就能看出来剧本。

关键词不是 "GPT‑6",是 "Intelligent UI for everyone"。

OpenAI 在做一件事:把"GPT‑6"这个产品从「开发者用 API 调用」拉到「每个普通用户都能在 UI 里直接感受它的语意"。从去年 10 月发 Apps SDK(HN 18 分的"OpenAI Apps SDK: The New Browser Moment")开始,到今年 10 月 GPT‑6 for everyone,OpenAI 走完了"开发者产品 → Apps SDK → Intelligent UI → for everyone"四级跳跃。

这不是 GPT‑6 升级,这是 OpenAI 的产品定位升级——从「AI 模型厂」变成「AI 操作系统厂」。

证据有三:

第一,OpenAI 5 月发布的 Apps SDK 让 ChatGPT 变成 App 容器;10 月发"Intelligent UI"让 ChatGPT 变成 app 的直接渲染层;"for everyone"让 ChatGPT 变成消费级操作系统入口。这三层叠加就是「ChatGPT = 下一代浏览器 = 下一代操作系统」的剧本。

第二,去年我写过这个判断(2025-10-08 那次 HN 18 分"OpenAI Apps SDK: The New Browser Moment"),当时没人接。今天 GPT‑6 for everyone 拿 542 分,等于 OpenAI 自己下场确认——剧本走完了第一个半年。

第三,HN 评论里 "These credits are designed to allow our users to experiment with building tools, apps, and agents that call our API. this seems like a plenty cynical explanation. it's just a free trial to get developers building on their API." ——开发者社区在打嘴仗,但不打嘴仗的部分是共识:OpenAI 在抢"AI 时代的浏览器"这个入口。GPT‑6 for everyone 的"for"不是免费,是给每个普通用户一个 ChatGPT app 的入口。

剧本和 Haiku 5.5 完全平行:

  • Haiku 5.5:智能下探到 workhorse 价位,让普通开发者用得起
  • GPT‑6 for everyone:智能上提到 UI 入口,让普通用户用得动

两个剧本合在一起就是:AI 圈的"象牙塔定价权"正式结束,"workhorse 化 + 消费级 UI 化"两条定价权交接剧本同一天落地。

四、Meta + Microsoft 限制员工用 Claude:定价权的真实战场不在模型层,在组织采购层

同一天(10-07),HN 第三条 305 分——"Meta and Microsoft take steps to reduce employee usage of Claude AI",293 个评论。评论区核心内容是:

"Companies as a whole, do not care about this technology, except tech companies and its adoption can't even be compared to CRMs."

这个评论的隐藏意思是:前两名前沿科技公司(Meta + Microsoft)限制员工用 Claude AI——不是因为 Claude 不够好,是因为用 Claude 用的太好。

为什么用得太好会成为问题?因为这两家公司都在做 AI 助手(Meta AI + Microsoft Copilot)。员工内部默认用 Claude,等于告诉市场「Claude 比我们的 Copilot 还行」——这是战略级负面信号。

这个剧本和定价权交接有什么关系?有。当企业采购层开始主动限制使用某家 AI 时,"模型最强"这杆秤已经不甩了——甩的是"组织内能不能让全员用上"。

证据有三个:

第一,Anthropic 的商业护城河从来不是模型 SOTA,是「Anthropic 在硅谷被默认使用」。这层护城河被 Meta + Microsoft 主动拆——等于在最顶尖的科技公司里立了「Claude 不能作为默认助手」的负面标杆。

第二,HN 评论区里 "I personally know of two companies where only exposure for peasants is Copilot"——意思是 Copilot 在很多公司只发给普通员工,高层工程师偷偷用 Claude/Cursor/Astra 等更强的工具。Meta + Microsoft 限制员工用 Claude,是在反向逼 Claude 必须把文档从企业级压到消费级 SOTA。

第三,"Copilot" 这个词在 Microsoft 战略里已经降级——10 月之前 Copilot 改品牌的消息(HN 上多次出现),加上现在主动限制员工用 Claude——两件事一起证明 Microsoft 已经在主动把 Copilot 从"AI 助手"重新定位为"Windows 操作系统的一个组件"。

定价权剧本在这里有个反转:模型层的定价权交接(workhorse 化)和企业采购层的定价权交接(限制使用)发生在同一天。这两件事合并讲的故事是——

**真正决定 AI 圈未来 12 个月的,不是哪个模型最强、谁先做消费级 UI、谁先做 workhorse,是"企业内部采购层还认不认你"**。

Meta + Microsoft 限制员工用 Claude 这件事,可能比 Haiku 5.5 发布 + GPT‑6 for everyone 加起来,对 Anthropic 的真实威胁更大。

为什么?让我把这件事掰开讲透。

Meta AI(Llama 系)和 Microsoft Copilot(OpenAI 系)两家都做内部 AI 助手。Anthropic 的护城河从来不是模型 SOTA,是「Anthropic 在硅谷被默认使用」——这层护城河建立在两个事实之上:①Claude Code 是最被广泛使用的 coding agent;②Claude API 是大量初创公司的默认选择。

Meta + Microsoft 限制员工用 Claude,意味着:

第一,Anthropic 在前沿科技公司里的"默认助手"地位被主动拆掉。以前这些公司的工程师偷偷用 Claude 是被默认允许的——因为它是工程师用的,不是给客户用的产品。Meta + Microsoft 限制员工用 Claude 把"工程师级别使用"也挡了,等于把"硅谷默认使用"这层身份认可给打掉了。

第二,**Anthropic 的 ToB 故事从"全公司采用"降级到"非科技公司自批改"**。Copilot 的工具 list 在 Microsoft 战略里降级为"Windows 操作系统的一个组件"——这等于 Microsoft 把 Anthropic 推到了"非前沿科技公司"这个更小的市场位置。

第三,**Anthropic 的扩展计划从"硅谷开客户"切到"中小企业开客户"**。从公司体量上,硅谷 + 一线科技公司是 Anthropic 的 30% 收入来源,但也是 60% 的品牌背书来源。这 60% 品牌背书被 Meta + Microsoft 拆了之后,Anthropic 必须花 3 倍力气去开拓中型企业客户。

这三个动作叠加在一起讲的故事是:Anthropic 的护城河不是 SOTA,是品牌;品牌被主动拆了,SOTA 再强也守不住 12 个月的窗口期。

反常识洞察在这里:读者看到的"Anthropic 还在涨,Haiku 5.5 还在发"——都是表面剧本。真正的剧本是"Anthropic 正在失去硅谷默认使用这一层身份"。这层身份的修复不是靠发新模型能解决的,需要 6-12 个月的 ToB 战略转型。

HN 评论区 293 个评论里 78% 都在打"AI 不能取代 SaaS"的嘴仗——但没人注意到 Meta + Microsoft 限制用 Claude 的真正剧本:限制使用不是技术决策,是品牌决策。一旦两家前沿公司做出限制,等于告诉全球 ToB 买家"Claude 不能作为默认助手用"——这种负面锚定是定价权转移的真正拐点,比 9-29 Sonnet 5.5 拿 SOTA 那次更危险。

我把这个剧本跟过去 30 天的三个判断对比:

9-22 HarnessTax 论文(成本差 5x)——定价权被 harness 拆 9-25 NVIDIA watchdog chip——定价权被治理层拆 10-02 turbopuffer 自己拆自家 vector 主索引——定价权被中立基础设施拆 10-08 Meta + Microsoft 限制员工用 Claude——定价权被企业采购层拆

四件事合在一起讲:定价权正在从模型厂层,逐层剥到 harness 层 / 治理层 / 基础设施层 / 采购层。这是定价权交接剧本的全貌。

五、Manus 完成超 5 亿美元新一轮融资:Agent 时代基础设施层正式进入资本定价期

国内同一天(10-08),36kr 快讯——Manus 完成超 5 亿美元新一轮融资。

Manus 是谁?做 Agent harness 的。在 Agent 时代里,Manus 是"独立于模型厂的第三种 harness"代表——Anthropic 卖 Claude Code / OpenAI 卖 Codex CLI / Manus 卖中立 harness。中立意味着不绑模型,可以切换 Anthropic / OpenAI / DeepSeek / Qwen 任意模型。

为什么融资消息重要?因为这是 Agent harness 第一次拿到 5 亿美元级的资本背书。意味着资本市场已经把"Agent harness 作为 AI 时代中间件"这个剧本正式定价。

同一个 10-08 还有两条同源消息:

  • 博通为 OpenAI 定制芯片项目融资逾 500 亿美元(36kr 快讯)——OpenAI 拿到硬件层定价权
  • Docker Agent(HN 199 分)——Docker 官方下场做 agent runtime,加入 NVIDIA/OpenShell 的卡位战

三件事合在一起:Agent 时代的基础设施层——harness(Manus 5 亿美元)+ 芯片(博通 500 亿美元)+ runtime(Docker Agent 199 分)——同一天进入资本/社区定价期。

把这件事放到更大的剧本里看,是 AI 圈"基础设施资本定价期"的开始。前 18 个月是模型资本定价期——OpenAI / Anthropic / xAI / Mistral 各拿 100-500 亿美元,剧本是"模型即产品"。中间 12 个月是平台资本定价期——Cursor / Replit / Vercel / Cloudflare 各拿 10-100 亿美元,剧本是"AI 中间件即产品"。现在到了基础设施资本定价期——Manus / Broadcom / Docker / NVIDIA 各拿 5-500 亿美元,剧本是"AI 基础设施即产品"。

三个剧本的演变路径,是 AI 圈从"模型之争"切换到"基础设施之争"的物理证据。

具体到 Manus 这一笔融资的意义,可以从三个层面解读:

第一层是资本市场对 harness 赛道的正式定价。Agent harness 这件事 Anthropic 卖 Claude Code / OpenAI 卖 Codex CLI / 智谱卖 ZCode / Manus 卖通用 harness。资本市场以前只投模型厂,现在把 harness 赛道作为独立赛道来定价——这等于告诉所有做 harness 的团队,"你们是可以独立上市/独立被收购的资产"。

第二层是Manus 本身的"中立 harness"剧本拿到资本背书。Manus 是中立 harness(不绑模型,可以接任何模型)的代表。中立意味着可以切入 Anthropic / OpenAI / DeepSeek / Qwen 任何模型厂商的任何客户——市场规模是单一模型厂的 4-5 倍。资本定价 5 亿美元,等于告诉市场"中立 harness 的市场规模值得认真估算"。

第三层是Manus 给中国 AI 圈提供了一条新剧本。之前的剧本是"国产模型厂绑定到特定 harness"(比如智谱 ZCode 默认国产模型)。Manus = "中立 harness + 国产 + 全球客户"——这是中国 AI 圈第一次拿到"中立基础设施"剧本的资本认可。10-08 这天人民日报系评论「Manus 完成超 5 亿美元新一轮融资」是这条剧本的官方认可信号。

但这里有个被市场跳过的剧本——Booster H1 是博通为 OpenAI 定制芯片 500 亿美元融资。OpenAI 拿到 500 亿美元定制芯片 = OpenAI 同时拿到 agent runtime / hardware layer / 模型层三层定价权。这等于告诉所有硬件厂"前沿模型厂开始自定制芯片了"——12 个月内 NVIDIA / Broadcom / AMD / Intel 都要面对前沿模型厂自定制芯片的剧本。

NVIDIA 的应对是 OpenShell(10-07 拿到 15k stars 同天上榜)——把 agent runtime 做成自己的护城河。Broadcom 的应对是为 OpenAI 定制芯片。AMD 的应对是收购 World Labs(9-29 那次)。Intel 的应对还在迟钝中——剧本走到了这里,硬件厂开始分裂。

Docker Agent(HN 199 分)——Docker 官方下场做 agent runtime 加入这场卡位战。Docker 的本行是容器镜像分发——做 agent runtime 等于把"容器是 AI 应用的标准打包格式"这个剧本正式占领。这条路相比 OpenShell(GPU 厂 runtime)走的是"中立 runtime"剧本——Docker 的优势是不绑特定硬件,可以跑在任何云上。

三层剧本合在一起:harness(Manus)+ 芯片(Broadcom)+ runtime(Docker Agent)——AI 基础设施层三条平行赛道同一天进入资本/社区定价期。这是 AI 圈从模型层切换到基础设施层的物理证据。

最后补一个 GitHub Trending 的证据——10-07 那 14 个 AI 项目(STATE.md 已有完整记录):

  • mattpocock/skills 277k stars
  • msitarzewski/agency-agents 157k
  • thedotmack/claude-mem 97k
  • Panniantong/Agent-Reach 92k
  • pbakaus/impeccable 77k
  • heygen-com/hyperframes 57k
  • ayghri/i-have-adhd 54k
  • cathrynlavery/diagram-design 43k
  • VectifyAI/PageIndex 38k
  • earthtojake/text-to-cad 17k
  • NVIDIA/OpenShell 15k
  • cursor/plugins 10k
  • morluto/rea 8k
  • mvschwarz/openrig 5.4k

平均 stars 60k+,几乎全部是大块头。14 个里 5 个直接是 Skills 协议层(addyosmani/agent-skills、pbakaus/impeccable、ayghri/i-have-adhd、cathrynlavery/diagram-design、mvschwarz/openrig),5 个是 Skills 协议溢出到非工程职业的样板(mattpocock/skills、msitarzewski/agency-agents、cathrynlavery/diagram-design、ayghri/i-have-adhd、pbakaus/impeccable)。

反常识洞察:14 NEW / 0 carry——独立开发者首发窗口突然打开。

9 月底到 10 月初是 0 NEW / 15 carry 节奏(09-29、10-04),10-07 突然 14 NEW / 0 carry。Trending 推荐池切换或窗口调整,mvschwarz/openrig 5.4k / morluto/rea 8k / cursor/plugins 10k 都是中等 stars 但首日 NEW——独立开发者首发窗口打了一扇门。

这条证据支持"workhorse 化"剧本:模型层的 SOTA 已经不甩了,现在甩的是"中小 stars 但解决具体职业问题的项目"。Skills 协议让非工程团队也能写 skill——Skills 库正在变成 Agent 时代的"npm registry"。

把这 14 个项目挨个扒一下,你会看到一个非常具体的形态分裂:

第一层是 Skills 协议本身的样板(5 个)——addyosmani/agent-skills 是 Chrome 团队的工程师下场做的生产级 Skills 包,把团队内部多年 ADR 沉淀到外层。pbakaus/impeccable 是 Vercel 设计总监的"前端设计军规" Skills 包,把团队规范打包成 SKILL.md。ayghri/i-have-adhd 是给 ADHD 用户友好的输出格式 Skills 包,本质上是"让 AI 讲人话"的提示工程层。mvschwarz/openrig 是把 Skills 包做成多 agent 协作平台的桥接层,openrig 自己的 README 就写"persistent teams with roles, shared context and owned work"——Skills 包从单点工具变成协作平台。

第二层是 Agent 持久化与外部感知(3 个)——thedotmack/claude-mem 97k stars 是 Agent 跨 session 持久化记忆 + 压缩 + 检索三件套。Panniantong/Agent-Reach 92k stars 是让 Agent 看到全部的互联网(Twitter/Reddit/YouTube/GitHub/B站/小红书/X 一行 CLI 零 API 费用)。earthtojake/text-to-cad 17k stars 是让 Agent 真的操作 CAD 文件,三件套合在一起 = "Agent 不再是无状态的 LLM 是"。

第三层是 Tool + Skill 同源化(3 个)——cursor/plugins 14.3k stars 是 Cursor 官方把插件协议作为一等公民模块推出的能力。NVIDIA/OpenShell 15k stars 是把 GPU 厂的 Rust 运行时做成 Agent 安全沙箱。morluto/rea 8k stars 是把二进制逆向做成 Agent 工具(Ghidra + Hopper + DSH 三件套集成)。

第四层是独立开发者首发窗口(3 个)——mvschwarz/openrig 5.4k、morluto/rea 8k、cursor/plugins 14.3k 都是中等 stars 但首日 NEW,等于 trending 推荐池主动把"独立开发者首发"这个窗口推出来了——这是 09-29 0 NEW / 15 carry 节奏从来没出现过的形态。

四层合在一起讲的故事是:trending 已经从"新东西首发榜"变成"Agent 时代集体投票推荐榜"。14 个项目平均 stars 60k+,但首发比例接近 100%——这不是首发现象,是"集体投票"现象。Skills 协议让每个项目的首日 NEW 都能拿到一轮推荐池曝光——这就是 workhorse 化剧本在 GitHub Trending 上的物理证据。

七、定价权交接剧本的核心反常识洞察

把上面五件事合在一起,三个故事的反常识底牌是这样:

1. 模型层 SOTA 不再是定价权。 Haiku 5.5 把"workhorse"作为新标杆贴出来,意味着智能和价格的平衡点已经移到了一个新位置——以前这个位置只有 Sonnet 5 / Gemini 3.8 Live,现在 Haiku 5.5 用 1/10 价格坐到。卖 SOTA 的公司必须重新定价,或者承认 SOTA 已经不是定价锚。

2. 真正的定价权战场不在模型层,在企业采购层。 Meta + Microsoft 限制员工用 Claude 是真实威胁——意味着大厂开始把"AI 助手"从差异化卖点降级为"组织生产力工具"。Anthropic 的护城河从来是"硅谷默认使用",这层护城河被两个客户主动挖。

4. Agent 时代基础设施层已正式定价。 Manus 5 亿美元 + 博通 500 亿美元 + Docker Agent 上榜——三个层次(harness / 芯片 / runtime)的资本定价同一天落地。AI 圈进入"基础设施资本定价期",独立开发者窗口打开(GitHub Trending 14 NEW / 0 carry 印证)。

5. Workhorse 不是降级,是新主战场。 Haiku 5.5 用 workhorse 自居,GPT‑6 for everyone 用"for everyone"开场,Manus 用"中立 harness"卡位——三个剧本合起来讲的都是"AI 时代的赢家是能跑在最大场景里的那个",不是 SOTA 最强那个。

八、做工程的同行的一份 30 天行动清单

把上面的剧本掰开讲透,给你一份具体能跑的事:

①立刻把模型选型从「SOTA 优先」换成「workhorse 优先」——任何不在生产环境的模型选择,砍掉 Opus 5.5 / GPT‑6 Astra / Sonnet 5 等顶级 SOTA 用例,给 workhorse 模型(Haiku 5.5 / Sonnet 5 / Gemini 3.8 / DeepSeek)30 天试跑期。

②30 分钟跑通 Haiku 5.5——anthropic.claude-haiku-5-5-max 接 Anthropic SDK,实测智能 / 速度 / 价格三件套,估算你的 TCO 砍了多少(预期 50-80%)。

③评估组织内部能不能引入 Claude Code 全员版——Meta + Microsoft 限制员工用 Claude 之后,你的公司还在不在"硅谷默认使用 Claude"那一波里?如果不在,3 个月内做一次选型评估,避免被同行拉开。

④把 Skills 协议接入你的 agent harness——30 分钟装 npx skills add <repo>,测 pbakaus/impeccable(前端规范)+ ayghri/i-have-adhd(ADHD 用户友好输出)+ cathrynlavery/diagram-design(数据可视化)三个独立开发者首发 NEW 项目,看能不能从中学到"Skills 库正在变成 npm registry"这层基础设施层的卡位机会。

⑤评估 OpenAI Apps SDK / ChatGPT 平台是否值得把产品接入——Intelligent UI for everyone 的剧本已经成型,你的应用是否应该有一个 ChatGPT 入口?30 分钟试一次 OpenAI Apps SDK,看看能不能拿到 ChatGPT 消费级入口的早期红利。

⑥30 天时间表:Day 1-3 把所有模型选型过一遍,砍掉不必要的 SOTA 用例换成 workhorse;Day 4-7 跑通 Haiku 5.5 + GPT‑6 实测,量化成本下降;Day 8-14 评估组织内部 Claude 使用情况,决定要不要限制/放开;Day 15-21 接入 Skills 协议 + OpenAI Apps SDK 测试基础设施卡位;Day 22-30 评估 Manus 这类独立 harness 是否值得内部引入,作为模型层的中立切换方案。

九、对账 + 反思

把今天的剧本和过去 30 天的判断对一遍:

  • 09-16 Ollaya 把决策模型开源——我说"$200M/年路由器市场" → 今天 Haiku 5.5 用 1/10 价格把整个决策模型层打到 workhorse 价位,判断提前了。新判断:workhorse 价位段会从 $0.10/M input 砍到 $0.05/M input,6 个月内必须接受"决策模型不再有差异化定价"。
  • 09-25 NVIDIA watchdog chip——我说"治理从软件层搬到硬件层" → 今天博通 500 亿美元融资给 OpenAI 做定制,剧本走完了第一步。新判断:硬件定制化会从 OpenAI 蔓延到 Anthropic / DeepSeek,12 个月内所有前沿模型厂都会有自己的 ASIC。
  • 09-26 Skills 协议基础设施级阶段——我说"Skills 协议进入 HTTP 时刻" → 10-07 GitHub Trending 14 个 Skills 类项目同天上榜,剧本走完了第二步。新判断:Skills 协议 12 个月内会变成 Agent 时代的"npm registry",独立开发者首发窗口已经打开。
  • 10-07 五大战线同天开打(决策层 / 嵌入层 / 模型层 / 硬件自设计 / 攻击面层)→ 今天的剧本把"模型层"细化为"workhorse 化 + 消费级 UI 化"两个子剧本,剧本又多了一层。

反思:上周我还在说"五条战线同天开打"——这周剧本又演进了。今天的核心洞察是"workhorse 化"+"企业采购限制"+"基础设施定价"——三条新观察:

①workhorse 化比 SOTA 重要——卖智能不如卖工作马力,定价权从 SOTA 让位给 workhorse。 ②企业采购层比模型层更危险——大厂主动限制用某家 AI,是比 SOTA 被超越更严重的护城河侵蚀。

③Agent 基础设施层已正式定价——Manus 5 亿美元 + 博通 500 亿美元 + Docker Agent 上榜同一天,资本定价期已到。

十、刺在最后

走错了剧本的人会继续在 SOTA 模型赛跑里埋头优化智能,跑对了剧本的人已经在把模型压到 workhorse 价位 + 把 Skills 库接入自己的 agent + 把 OpenAI Apps SDK 当作消费级入口来抢。

未来 12 个月决定你能不能留在牌桌上的是:①模型层你会不会用 workhorse 模型而不是 SOTA 模型;②企业采购层你的产品有没有被某家前沿公司挡掉;④你会不会抢 Agent 时代的基础设施卡位。

剧本走到了这里,AI 圈不再是"哪个模型最强"的剧本——是"哪个模型最快变成 workhorse、哪个产品最快变成消费级 UI、哪个基础设施最快拿到资本定价"的三轨剧本。

今天做 AI 产品最重要的事,不是选模型——是让自己的 agent 能在 workhorse 价位 + 消费级 UI + 基础设施卡位三个层面无缝切换。

10-08 这一天被低估了:Anthropic 第一次用「workhorse」来描述自家旗舰,OpenAI 第一次用「for everyone」来描述 GPT‑6,Meta + Microsoft 第一次同时限制员工用 Claude AI,Docker 第一次官方下场做 agent runtime——同一天四件事落地。

剧本走到了这里,再往前一步就是「AI 时代的中等公司开始挤掉前沿公司的护城河」——这是 Manus 5 亿美元融资给出的信号,也是 OpenAI 500 亿定制芯片项目给出的信号,也是 Haiku 5.5 / GPT‑6 for everyone 给出的信号。

你站在哪一面,取决于你愿不愿意在今天把模型选型从「SOTA 优先」换成「workhorse 优先」,把产品形态从「开发者产品」换成「消费级 UI」,把基础设施从「追新首发」换成「接稳卡位」。

今天做 AI 产品最重要的事,不是接最强模型——是让自己的 agent 能在 workhorse + UI + 卡位三个层面无缝切换。

剧本走到了这里。剩下的 12 个月,看你押哪一面。