科技智东西··AI 生成
对话PPIO姚欣:Token的第一客户不再是人,而是Agent
在与智东西的对话中,PPIO创始人姚欣提出核心判断:AI Agent时代,Token的第一消费者将从人类转向Agent。基于此,PPIO发布全新定位“Agentic Cloud”与智能模型网关,旨在构建面向Agent的“Token工厂”。文章详细阐述了其技术架构,包括混合模型(MoM)融合推理、智能调度降本、基于microVM的Agent沙箱(上线一年增长123倍)以及Harness工具链。文章以大量具体数据(如日均Token消耗1.2万亿、成本降低50-60%)支撑其从分布式云基础设施向Agent原生云服务商转型的战略叙事,适合关注AI基础设施、云服务演进及Agent产业化的从业者阅读。原文 ↗原文 ↗
核心观点
- ▍Token的第一客户不再是人,而是AI Agent,这要求云服务商从“人用云”转向“Agent用云”,即Agentic Cloud。
- ▍通往AGI的路径不仅在于模型参数,更在于模型之外的工程化手段,如混合模型(MoM)融合推理,同样能大幅提升智能水平并降低成本。
- 01Agent任务单次消耗的Token数量从早期的数百增长到数万甚至数十万,尽管推理成本以每年10倍以上速度下降,但综合成本压力不降反升。
- 02PPIO推出的智能模型网关通过“混合模型(MoM)”机制,将问题分发给多个专家模型交叉验证,在DRACO基准测试中,性能接近Claude Fable 5,智能水平提升20%,同时成本降低50%-60%。
- 03PPIO Agent沙箱基于microVM技术,实现毫秒级冷启动(<200ms),自去年WAIC发布以来业务规模增长超123倍。
- 04PPIO日均Token调用量超1.2万亿,在中国独立AI云计算服务商中排名第一,AI云收入自2025年起增长逾十倍,2025年营收达7.703亿元。
- 05PPIO平均GPU利用率高于75%,远超行业平均40%-50%,归因于利用全球时区差异的“削峰填谷”调度能力。
- 06PPIO入选中国信通院首批“企业级Token服务性能攀登基线”,实现TPS≥55个/秒、TTFT≤0.9秒、调用成功率≥99.9%。
反方 / 局限
- — 文章主要呈现PPIO的技术路线与战略,未深入讨论该路线(如MoM混合推理)的工程复杂度、可靠性风险,或与端侧Agent、小模型路线的竞争关系。
前置背景
平行视角
未来推演
延伸追问