AI推理市场全景解析,加密项目如何突围?
更新时间:2026-06-27 15:58作者:辣辣辣条
现在AI算力市场的竞争情况,早就不是只靠云服务商一家独大,各方像下棋一样瓜分地盘。大型云公司专门做企业客户生意,网络厂商把控数据传输,去中心化算力平台抢占普通开放市场。前几年大家都忙着训练大模型,现在才看清,AI实时应答这块业务利润空间很大。很多人不懂推理是什么,训练是做出AI,那么推理就是你向AI提问,它给出回答的整个过程。下面本文将带你深入了解AI推理市场为什么是当前真正占据经济利益的核心,以及其价值的转变对于加密行业的影响。

AI推理市场概览
训练环节之所以占据头条,是因为它支撑着那些令人惊叹的输出。但实际上,推理目前拿走了大部分经济利益——每一个提示、代理循环、图像生成、交易执行、工具调用和代码编辑,都必须在某个地方运行。
路由器是真正的瓶颈
在「风险」棋局中,最有价值的领地往往是那些狭窄的瓶颈,它们决定下一步如何移动。在推理市场中,路由器扮演着完全相同的角色。它们位于需求与供给之间,决定每个请求流向何处、哪家提供商能拿到报酬。
其中一个典型例子是Open Router,其协议上周就处理了4700万亿个token。
这种经济活动丝毫没有放缓迹象,尤其是随着数万亿代理即将上线。

那么,一个完整的推理市场需要什么?核心要素包括:
- token正成为记账单位
- OpenRouter正迅速成为核心的交易所层,上周通过其LLM市场使用的token量就达4700万亿。
- 专业供给侧:Fireworks、Together、Replicate、Baseten、Groq以及各大超大规模云服务商。
- 加密AI网络:Chutes、Akash、io.net、Nosana、Targon、Venice、NuNet等项目,正在构建底层的无许可版本。
不要把所有这些提供商当成在同一个市场竞争——它们根本不是。
传统提供商销售的是可靠性、开发者体验和企业级采购流程。
加密AI网络则主打更便宜的供给、开放访问、隐私性、可验证性以及全新的激励循环。
最近Anthropic禁止美国以外用户使用其Mythos模型(Fable5)的事件,让很多人重新意识到过度依赖单一前沿专有模型的风险。
有趣的是,两个世界开始出现重叠:隐私、保密计算或代理原生支付(Venice和Targon在这方面表现突出)。
如何看待AI算力市场
更好的视角是把市场分为传统与加密两大阵营:

传统侧卖的是可靠性、开发者体验和企业采购。
加密网络则主要竞争开放访问、更低成本供给、隐私、可验证性和新型激励机制,以全球无缝协调资本。
为什么推理才是真正的AI市场
模型层依然重要,但模型质量正在以超出预期的速度压缩。开源模型已达到前沿模型90-95%的质量,却只需其10%的成本(例如Z.ai的GLM-5.2)。

开源模型持续迭代,中国实验室不断压低价格。前沿模型仍能维持溢价,但在其之下,代币定价竞争已非常激烈。

这正是路由层变得关键的原因:同一个开源模型可能由五家不同提供商以五种不同价格提供,开发者不想永远硬编码一个端点,他们需要路由器。

路由器可以根据价格、延迟、隐私、可靠性等多种因素进行选择。

它位于所有提供商之上,将混乱的格局变成一个干净统一的界面。
这正是OpenRouter做对的地方,也解释了为什么风险投资基金在最近的B轮融资中投入了1.13亿美元,来抓住这个路由机会。

OpenRouter正快速成为市场界面:一把钥匙就能访问数百个跨多家提供商的模型。真正的价值不在于模型列表,而在于同一个请求能被路由到最适合该任务的提供商。
这开始像能源市场:用户不在乎哪家电厂发了电,他们只关心灯是否亮起、价格是否公道、系统是否稳定。

AI用户也将越来越这样思考——他们不在乎哪个GPU集群服务了这个代币,只关心响应是否快速、便宜、私密且可靠。
传统推理提供商

传统侧正在分化成四类:
i)超大规模云服务商(Hyperscalers):AWS、Google、Microsoft
它们掌控着「fortifiedcontinents」(坚固大陆)。它们获胜并非因为永远最便宜,而是因为早已控制企业采购、合规、身份、安全和账单体系。正面攻击这个阵地成本极高。
它们靠企业信任取胜。大公司购买的不仅是token,更是合规、安全、采购便利以及出问题时有人负责。
ii)路由市场:OpenRouter及各类AI网关
路由器位于模型提供商之上,将每个请求发送到最佳选项。随着模型领导地位每周变化,硬编码单一模型显得越来越脆弱。AI需要聚合器,就像加密领域一样。
iii)优化开源模型服务:Together、Fireworks、Baseten、Groq
它们不只是廉价API,而是专注速度、批处理、扩展、微调、自定义端点和生产支持的性能基础设施公司。
iv)模型市场:Replicate及类似HuggingFace的平台
推理远不止聊天。图像、视频、语音、嵌入、机器人模型、模拟和多模态代理都需要模型运行。市场让长尾模型需求变得易于获取。
加密AI推理提供商
去中心化网络是「游击领地」
加密推理网络并不试图在AWS的主战场上花费更多资金。它们开辟新战线:无审查模型、更便宜的GPU供给、私密推理、代理原生支付,以及不需要超大规模云服务商级别可靠性的工作负载。
加密侧常被简单归为「去中心化算力」,这个说法太模糊了,至少有五类不同方向:
- 无服务器推理网络
- 去中心化GPU市场
- 保密计算网络
- 私密AI应用与网关
- 编排层
它们不应被同等分析。
i)Chutes:加密原生推理
@chutes_ai最好理解为去中心化推理平台,而非单纯的GPU市场。
核心在于:开发者不想租用GPU或管理基础设施,他们想要一个能正常工作的端点。Chutes通过熟悉的API服务开源模型,底层使用去中心化GPU供给。
关键问题是能否将头部使用量转化为付费、recurring(recurring)需求。便宜代币有用,但前提是开发者信任其正常运行时间、延迟和可靠性。
其每万亿代币收入持续上升,显示出可持续盈利/可行性的潜力。

ii)Akash:GPU拍卖层
@akashnet是去中心化云市场。
用户定义所需算力,提供商竞价供应,工作负载通过租约运行。它更像算力市场,而非直接推理路由器。
其最适合价格敏感、能容忍基础设施波动且不需要深度集成AWS/Azure/GoogleCloud的工作负载。费用与代币价格有一定相关性且呈上升趋势。
iii)io.net:去中心化GPU云
@ionet更接近去中心化GPU云提供商。
核心卖点是以更低成本和更快配置速度访问分布式GPU供给,适合需要算力但不想签订长期云合同或接受超大规模定价的AI团队。
挑战在于执行:硬件验证、可靠性、调度、支持和一致性能。原始GPU访问有价值,但更高利润层仍是路由、管理推理和编排。
io.net过去30天表现突出,年化收入达1230万美元。

iv)Targon:保密计算
@Targon Compute(由@manifoldlabs打造)专注于AI工作负载的保密计算。
它解决的问题显而易见:许多用户不愿在未知第三方运营的基础设施上运行敏感提示、模型或数据。
Targon通过可信执行环境、加密虚拟机、远程证明和保密GPU基础设施提供受保护执行。简单说,就是证明工作负载在安全环境中运行,并减少运营商能看到的内容。
这对金融、医疗和企业AI等领域的私密推理尤为相关。保密计算并非魔法,它将信任转移到硬件、固件和证明系统上。
去年该协议报告年收入1040万美元,并与Intel共同撰写了关于「不可信硬件上的去中心化算力」的研究论文。

v)Darkbloom:闲置Mac上的私密推理
Darkbloom(由@eigenlabs打造)走的是不同路线。
它不把大模型分片到随机GPU上,而是把闲置的AppleSiliconMac变成私密推理网络。Mac本地运行模型,请求被加密并路由到经过验证的提供商。
卖点是隐私和成本,而非最大化前沿模型性能。
这很有用,因为「没有节点持有完整模型」并不自动意味着提示是私密的。Darkbloom更明确地针对隐私问题,但仍需证明供给规模、性能和开发者信任。
目前网络已有300台机器,服务了20亿token和100万次请求。

vi)Venice:面向消费者的私密推理
@AskVenice所处位置与Akash或io.net等网络不同。它更像是私密AI应用和推理网关,而非主要GPU市场。
其网关吞吐量已达每日850亿token(@ErikVoorhees数据)。

大多数用户想要一个尊重隐私、能访问强大模型且不大量收集数据的AI产品。
Venice将基础设施理念包装成面向消费者的体验,围绕私密提示、开源模型、无审查访问、API功能以及通过VVV和DIEM实现的代币化算力。
DIEM组件特别有趣,它指向更广泛的代理经济理念:提供每日1美元算力访问。市场最近已为这一概念赋予了不错的价格标签。
如果代理需要持续访问推理,那么算力积分开始像代理原生资产,整个二级市场都可以围绕它构建。
一个能直接持有和花费算力权利的代理,比依赖人类定期刷信用卡的代理更实用。
这凸显了更深层的加密AI论点:代理最终需要访问资金、身份、记忆和算力,而加密系统为这些资源的编程化提供了框架。
Venice并非在模型广度上直接与OpenRouter竞争,而是竞争隐私、访问和代币化算力。这是一个legitimate(合理)利基,但关键问题是私密AI产品的需求是否会大到足以支撑代币模型超越当前叙事周期。我的判断是,随着AI普及,隐私叙事只会越来越强。
vii)NuNet:分布式算力编排
@nunet_global常被归入去中心化算力项目,但更有用的框架是「编排」。
编排涉及将工作负载匹配到最合适的算力资源,并在不同机器、环境和位置间协调执行。

随着AI超越中心化云基础设施,这变得越来越重要。
未来AI系统很可能跨越云GPU、边缘设备、本地服务器、机器人、手机、传感器和去中心化提供商网络运行。
仓库机器人可能等不及跨区域API响应;无人机不能假设时刻有完美连接;野外机器人需要在网络不可靠时本地执行推理。
因此,编排正成为一个独立且有意义的类别。
NuNet的挑战在于能否将这个协调问题转化为具备足够供给、需求和开发者采用的functioning(functioning)经济网络。
viii)OpenServ:代理编排,而非纯推理
@openservai最好理解为代理基础设施和编排平台,而非去中心化推理网络。
这很重要,因为代理是未来最清晰的推理需求来源之一。普通聊天机器人可能只调用一次模型,而代理会反复调用模型:推理、使用工具、检查输出、调用另一个模型、采取行动,然后循环。
这创造了沉重的推理需求,已在加密圈内引起注意。
OpenServ因此从需求侧而非供给侧与推理市场相关。如果该平台能成为开发者构建、部署和协调代理的有用场所,它自然会成为底层路由推理到不同提供商的层。
关键问题是OpenServ能否成为真正的代理执行层,还是只是另一个附带代币的代理市场。
与团队多次交流后,我认为其能力不止于后者,其推理框架有若干notable(显著)基准表现,路线图上还有自有专有模型。
如果OpenServ能掌控代理化运营工作流,推理就成为平台的输入而非主要产品。
在代理化世界中,最有价值的层将是代理花费大量持续时间和资源的场所。
ix)DolphinAI:产品驱动的去中心化推理
@dphnAI有趣之处在于它从模型需求而非GPU市场起步。
Dolphin模型家族已有无审查开源模型的口碑,这让网络有了更清晰的存在理由。
这很重要,因为许多去中心化推理项目都是供给先行:「我们有GPU,现在谁来买?」
Dolphin则相反:从人们已经想用的模型集合出发,然后围绕该需求构建去中心化推理网络。
其架构常被称为peer-to-pool:GPU所有者将容量贡献到特定模型池中,而不是每个买家直接租用特定节点。请求路由到池中,可用节点处理。
这对不可靠的消费者供给来说是更好的设计。如果有人贡献闲置游戏GPU,他们可能不会永远保持在线,池化模型能比一对一租赁市场更自然地吸收这种波动。
更有趣的是验证。Dolphin正在推动live-weightproofs(实时权重证明)。简单说,就是检查服务过程中实际加载的模型权重是否与节点声称运行的模型一致。
这很重要,因为作弊是去中心化推理中最难的问题之一。节点可能声称运行昂贵模型,却偷偷服务更小、更便宜或量化版本的模型。如果网络无法检测,整个市场就会失去可信度。
x)c0mpute:面向代理的分布式推理
@c0mputeAI值得关注,因为它试图解决去中心化推理中最难的问题之一:在开放互联网上跨分散GPU运行大模型。
其Shard引擎将模型拆分到多台机器上,而非要求一台巨型服务器容纳完整模型。这对可能太大或受限而无法通过常规托管路线的前沿规模开源模型尤其相关。
@virtuals_io的链接是关键需求侧角度。Virtuals正在构建代理经济,而代理是重度推理用户:它们规划、调用工具、交易、检查结果并循环。这创造了对廉价、开放且抗审查推需求。
caveat是这仍处于早期阶段。c0mpute需要证明真实负载下的性能、节点可靠性、验证和提示隐私。
但方向很重要:GPU市场销售算力访问;c0mpute正试图分发模型本身。
传统vs加密推理
两者将共存,各有明显且值得理解的独特优势。

需要关注什么
i)付费token量
市场应减少对原始token处理统计的关注,除非这些代币产生收入。免费层活动和补贴使用能制造亮眼数字,却无法证明真实的产品市场契合。
付费推理需求才是关键指标——它更可持续,能支撑长期可行性。
ii)每GPU收入
去中心化算力网络只有在GPU在网络内赚取的价值高于外部时才可持续。如果排放是提供商参与的主要原因,一旦激励下降,供给就会消失。GPU提供商会计算机会成本。
iii)路由器集成:分发
分发往往比基础设施本身更重要。
OpenRouter集成、编码代理、钱包、支付端点、开发者工具和消费者应用,都是潜在需求来源。
支付端点是软件可通过API直接支付服务的通道。
iv)验证
GPU欺骗、虚假容量和不可靠提供商仍是真实风险。
网络需要robust(robust)的硬件验证、加密流量、声誉系统和对不良行为的meaningful(有意义)惩罚。
v)隐私保障
私密推理仍是加密AI最强机会之一,但保障必须真实。营销隐私容易;安全执行、本地优先架构、数据最小化和可审计基础设施则难得多。
vi)代币价值捕获
最强的代币模型将需求直接与真实推理使用挂钩。这可能涉及回购、销毁、质押要求、算力权利或与收入挂钩的机制。
仅靠宽泛的AI叙事长期来看不太够。
核心结论
终局是需求控制
在「风险」棋局中,仅拥有零散领地是不够的。你需要连通的区域、增援路线和持久的补给线。
在推理市场中同样如此。赢家将掌控需求、路由、验证和结算;仅拥有GPU本身不够。
推理市场让AI开始resemble(resemble)金融系统:
- 每一个生成的代币都携带成本,
- 每一个端点都带有利润,
- 每一个代理循环都创造需求,
- 每一个路由器都像做市商,
- 每一个GPU网络都成为供给来源……
传统提供商目前主导开发者体验和企业信任层。
加密AI网络则在探索另一条前沿:无许可供给、私密推理、可验证算力、代币化访问以及代理原生(无KYC限制)支付。
短期内,赢家不太可能是最去中心化的网络,而更可能是让去中心化推理感觉普通且可靠的网络——通过快速端点、强文档、可靠正常运行时间、透明定价、验证供给和genuine(真实)付费需求。
Chutes仍是值得重点关注的项目之一,因为它最接近将Bittensor支持的算力转化为functioning(functioning)推理市场,而非单纯的GPU叙事。EigenLabs的「Darkbloom」也是如此。
Akash和io.net代表供给侧挑战者,Targon代表保密计算论点,Venice代表私密AI需求层,NuNet代表更分布式算力未来的编排。
更广泛的论点:
「AI模型可能越来越商品化,但推理市场不太可能遵循相同路径。」
最大价值将归属于那些路由工作、验证工作、结算工作并捕获需求的实体。
这正是下一个加密AI机会可能出现的地方……至少在物理AI在社会中胜任之前。
-
什么是隐私币?2026年五大龙头隐私币盘点2026-07-17
-
加密货币新手入门完整指南:50个币圈基础问题解答2026-07-15
-
加密货币钱包完全指南:冷钱包、热钱包、硬件钱包和软钱包详解2026-07-15
-
山寨币是什么?山寨币与主流币,是竞争还是共生?2026-07-15
-
比特币挖矿入门教学:什么是挖矿?比特币怎么挖矿?2026-07-14
-
一文盘点:2026下半年10大值得关注的加密赛道2026-07-13
-
熊市生存指南:十本Web3精神书单推荐2026-07-13
-
稳定币新时代:收益型稳定币如何改变DeFi资金运作?2026-07-13
-
加密货币获利如何报税?海外所得申报指南2026-07-13
-
盘点加密产业2026年下半年最具成长潜力的10大领域2026-07-13
| 币种 | 美元价格 | 24H涨跌幅 |
|---|---|---|
USDT Tether USDT |
$0 0 |
0% |
USDC 美元稳定币 |
$1.00064 0.00007 |
0.01% |
XLM 恒星币 |
$0.1917 0.0046 |
2.46% |
BCH 比特现金 |
$216.4 -4.6 |
-2.08% |
DOGE 狗狗币 |
$0.07218 -0.00021 |
-0.29% |
TRX 波场,波场币 |
$0.3272 0.0015 |
0.46% |
SOL 索拉纳 |
$76.02 0.58 |
0.77% |
BNB 币安币 |
$569.52 -1.53 |
-0.27% |
XRP 瑞波币 |
$1.0944 0.0001 |
0.01% |
BTC 比特币 |
$64460 -250.66 |
-0.39% |
| 币种 | 总市值($) | 变化幅度 |
|---|---|---|
TAO |
$21.99亿 | -5.06 |
SHIB |
$24.52亿 | -38.65 |
HBAR |
$29.20亿 | 10.51 |
SUI |
$30.43亿 | 69.35 |
AVAX |
$27.85亿 | 11.68 |
LTC |
$36.53亿 | 33.63 |
TON |
$44.40亿 | -12.36 |
XMR |
$62.75亿 | 252.37 |
LINK |
$62.48亿 | -9.46 |
LEO |
$90.22亿 | 7.12 |
