模型的新货架:从 Grok 4.6 上架 Pi 说起 pi model distribution Agent AgentEngineering Pi Distribution AI工程
1408 字
7 分钟

模型的新货架:从 Grok 4.6 上架 Pi 说起

先声明立场:我是 Pi 团队的人,这篇难免「利益相关」。但正因为在场内,有些观察比外面看得早一点——下面所有数据都是公开可查的。

先说结论#

模型分发的主战场,正在从「上架应用商店」变成「进 agent 运行时」。

过去一周有两件事让我对这个判断确定下来:

  1. 8 月 13 日,xAI 官宣 Grok 4.6 可以在 Pi 使用。 模型发布次日单独发一条平台上架公告——这个动作本身比那条帖子重要。
  2. DeepSeek Harness 的模型适配层 dsh-llm-pi-ai,底层就是我们的 @earendil-works/pi-ai 这是我上一篇写 Harness 插件时亲手发现的:156k star 的仓库,模型接入的缝是用 Pi 的 SDK 铺的。

一个是模型厂商把 Pi 当渠道来官宣,一个是框架作者把 Pi 当底座来依赖。方向一致:agent 运行时正在变成模型的货架。

两件事的细节#

Grok 4.6 登陆 Pi#

Grok 4.6 是 8 月 12 日发的,主打长程 agent、跨代码库分析和自我验证。首发帖累计 2500 万浏览、近 3 万赞。第二天,官方账号单独发了一条:「Grok 4.6 is now available in Pi」——10.4 万浏览、1273 赞。

把这两条帖子的关系看清楚:模型发布是新闻,「在哪个运行时里可用」是后续剧情。 剧情线还在继续:Perplexity 的 CEO 拿 Grok 4.6 当 orchestrator 跑了 Wide-And-Deep-Research 基准,结论是它在性能-成本曲线上位于帕累托前沿。注意这个用法——模型的评价场景已经从「聊天打分」迁移到「在某个运行时的编排下表现如何」。

pi-ai 在 Harness 的地基里#

上一篇插件教程里我提过这事,这里补上量化的一面:

@earendil-works/pi-ai
周下载(8-15 ~ 8-21):4,236,540
最新版本:0.84.2(8-14 发布)

DeepSeek Harness 把它用作 LLM seam——README 原话是 “Generic multi-provider adapter for the harness LLM seam backed by @earendil-works/pi-ai”。翻译一下:Harness 里每一次换模型、配 provider、接 OpenAI 兼容网关,底下跑的都是 pi-ai 的抽象。

这不是我们去找 DeepSeek 谈的合作,是他们选型选中的。被当成基础设施用,是对一个库最好的验证方式——比任何 benchmark 都硬。

为什么货架会易主#

回头看技术产品史,分发渠道的迁移有迹可循:

  • 搜索引擎时代,浏览器默认搜索引擎是渠道,Google 付费买位
  • 移动时代,App Store 上架位是渠道,首发渠道能决定一款应用的命运
  • 云时代,**云市场(Marketplace)**是渠道,企业软件先上 AWS Marketplace 再谈销售

AI 时代的等价物正在显形。模型能力在快速同质化——DeepSeek 8 月三连发(V4-Pro → V4-Flash API → Vision-Exp)、GLM、Kimi、Qwen 都在月更节奏里,当供给过剩,渠道价值就上升。而 token 消耗最大的场景已经不是聊天框,是 agent:一个长任务动辄几百次调用。模型厂商要抓住的,是这些调用的入口。

入口在哪?就在运行时的那个模型选择器里。上一篇我在 dsh 的 Web UI 里把 provider 从 DeepSeek 切到自定义的 mock——那个下拉菜单就是货架。用户在那个菜单里能看到谁、默认是谁、切换成本多高,决定了模型的实际市场份额。

DeepSeek 自己看得最明白:低价 API 加自研 harness,模型和货架一手抓。这是官方版答案。而 xAI 选择的是另一条路——不自己造货架,把模型铺进别人已有的货架,Pi 是其中之一。

站在货架上是什么感觉#

坦白讲,感受是复杂的。

好的那一面:pi-ai 五个月做到周下载四百多万,说明「多 provider 抽象」这个判断做对了——开发者不想为每家模型写一遍适配,模型厂商也不想让集成成本挡住试用。

不安的那一面:当一个库从产品变成公共契约,它的错误预算就没了。 以前发个 0.x 版本改接口,坏的是自己的项目;现在底下压着 Harness 这样的框架和它们身后成千上万的会话,兼容性和版本语义就是别人的生产环境。dev preview 可以随便破兼容,底座不行——这也是我从 Harness 文档里读到 “breaking changes expected” 时格外有共鸣的原因:他们可以这么说,我们不能。

接下来会怎样#

三个预测,放在这里等着验证:

  1. 「available in X」会成为模型发布的标准动作。 X 是一张运行时清单,就像今天 App 官宣支持 iOS/Android 一样自然。下一个官宣登陆某个 agent 运行时的模型,不用等太久。
  2. 运行时的竞争会从功能转向生态位。 功能会被抄平,「谁的模型选择器里有谁」「谁是新模型的首发渠道」不会。Harness 开源五天 7174 个插件仓库抢的就是这个位置。
  3. 模型评测表会多出一列:在哪些运行时可用。 单独的分数不够了,编排质量正在成为模型表现的一部分——Perplexity 那个 orchestrator 实测就是预演。

对我们自己,结论也简单:渠道不是终点。被依赖就要配得上依赖——接下来 pi-ai 的每个版本号,都是对下游的一份承诺。

参考资料#

模型的新货架:从 Grok 4.6 上架 Pi 说起
https://bangwu.me/posts/pi-model-distribution/
作者
棒无
发布于
2026-08-22
许可协议
CC BY-NC-SA 4.0