2026年7月,上海世博展览馆。世界人工智能大会(WAIC 2026)主论坛上,一个此前只存在于技术文档中的概念被推到了聚光灯下——Token经济首次被列为大会核心议题。会场内外,“Token Factory”(Token工厂)成了最热门的词汇之一。
超聚变、科大讯飞、智微智能、范式、优刻得……至少五家企业在大会前后密集发布了各自的Token Factory解决方案。这不是巧合,而是一个信号:AI的竞争正在从“模型参数”转向“Token生产”。无问芯穹联合创始人兼CEO夏立雪在大会期间说了一句话,点破了这波热潮的本质:“既然叫工厂,本质上就是用确定性的资源投入,去最大化地生产某一类商品。这个商品就是Token。”

▲ Token Factory 的本质:将算力、模型、数据等“原料”转化为标准化的Token输出
一组关键数字:超聚变AI一体机市场份额17%位居国内首位;科大讯飞星火Token Factory智能路由决策延迟小于100毫秒,同等昇腾算力可支撑接近翻倍的业务请求量;智微智能Token Factory已开启试运营,深度适配GLM5.2、DeepSeek V4 Pro等主流大模型。
Token Factory到底是什么?
简单来说,Token Factory是一套把算力转化为可度量、可结算、可服务化的Token输出的基础设施。超聚变算力事业部总裁唐启明给出的定义更具体:Token Factory是“标准化、规模化生产Token的模块化算力工厂”。
Token(词元)是大模型处理文本的基本单位。每一次模型调用,消耗的都是Token。随着AI从“试点”走向“规模化落地”,企业对Token的需求已经从“锦上添花”变成了“核心刚需”。Token Factory要做的事情,就是像建一座工厂一样,把算力、模型、数据等“原料”组织起来,稳定、规模化地生产Token。
超聚变副总经理、CIO蓝文广在WAIC上指出,Token Factory“不是一台设备,也不是单一产品,而是企业在AI时代面向生产系统构建的新型生产平台”。优刻得的表述更为完整,将其定义为覆盖“Token生产—分发—调用—治理—运营”的完整基础设施。
为什么是现在?一个被Token卡住的行业
Token Factory在2026年夏天集中爆发,背后有一个现实原因:企业的AI落地正在被Token“卡脖子”。
一方面,Token的消耗量正在以几何级数增长。大模型从单点试点走向多业务、多场景、多团队协同应用,企业往往需要同时接入多个模型。模型调用规模越大,Token消耗越快,成本也越难以控制。
另一方面,大多数企业缺乏管理Token的能力。不同任务对模型能力的要求差异巨大——文本分类等简单任务,与长文档分析、复杂推理等高复杂度任务,对模型能力和资源消耗的需求完全不同。但实际应用中,企业往往用同一个大模型处理所有任务,导致资源浪费和成本失控。
超聚变在WAIC上提出了一个判断:行业重心正在“从参数竞赛转向商业落地”。Token Factory的密集出现,正是这一转向的直接体现。
五家厂商,五种打法
虽然都叫Token Factory,但不同厂商的切入角度并不相同。
超聚变:从算力到Token的完整链路。 超聚变Token Factory以“算力、模型服务、Token运营”三层架构为核心,将全场景算力承载、模型部署、推理加速、智能体运行和运营管理等能力组织起来。超聚变还提出了一个值得留意的概念——“以Token为成本中心、以Agent为利润中心”的双中心模式。换句话说,企业应该把Token当作生产成本来管理,把智能体当作利润来源来经营。
科大讯飞:企业级AI的“智能路由中间层”。 7月19日,科大讯飞正式推出星火Token Factory。它的定位是企业应用与大模型之间的统一中间层。核心能力是智能路由——根据任务复杂度,自动匹配最合适的模型。简单任务调用小模型省钱,复杂任务调用大模型保效果。整个决策平均延迟控制在100毫秒以内。在国产硬件私有部署场景下,星火Token Factory围绕昇腾硬件做了端到端优化,同等算力可支撑接近翻倍的业务请求量。
智微智能:把算力“工厂化”。 智微智能联合腾云智算、元川微在WAIC开幕当天发布Token工厂。目前已开启试运营,首批面向企业级用户,深度适配GLM5.2、DeepSeek V4 Pro等主流大模型。智微智能的打法很直接——把算力生产工厂化,通过“卖智能”的模式,让算力像水电一样触手可及。费用方面不按硬件售卖,而是直接交付规模化、标准化的“智能输出”。
范式(Phancy):全栈AI云服务。 范式在WAIC上完整展示了“Token工厂”的智能化逻辑。其全栈AI云服务平台涵盖从GPU管理(HAMi)、模型适配(ModelHub XC)到智能体框架(PhanthyMotus)的完整能力。范式在WAIC上被选为“全球工业AI旗舰案例”和首批“可信赖全球工业AI解决方案”。
优刻得:词元工厂。 6月30日,优刻得正式发布“词元工厂(Token Factory)解决方案”。定位同样是覆盖Token生产、分发、调用、治理、运营的完整基础设施。
除了上述五家,韩国最大电信运营商KT也宣布了一项18万亿韩元的投资计划,其中包括建设Token Factory。Token Factory正在从一个中国概念变成全球趋势。
一个被低估的信号:Token首次被列为AI核心生产要素
WAIC 2026有一个细节值得注意:大会首次将Token经济列为核心议题,围绕标准体系、算力基建、场景落地等维度展开全产业链研讨。业内将此视为“Token从技术参数升级为AI核心生产要素的标志性节点”。
这个判断并不夸张。当AI从“炫技”走向“落地”,Token就是那把度量一切的尺子——它衡量算力的消耗、模型的效率、业务的成本、甚至智能体的价值。Token Factory的集体爆发,本质上是行业在回答一个问题:当AI成为基础设施,谁来管理这个基础设施的“水电煤”?
超聚变在WAIC上展示了一条清晰的价值链:WATT → FLOPS → TOKENS → AGENTS → VALUES。从电力到算力,从算力到Token,从Token到智能体,从智能体到业务价值——Token处在承上启下的关键位置。
谁在用?用在哪?
企业AI规模化落地的运营者。 当企业同时接入多个大模型、支撑多个业务场景时,Token Factory提供统一接入、智能路由、成本优化和治理能力。
AI Agent开发与批量推理业务。 智微智能Token Factory已面向企业Agent开发和批量推理业务提供算力支撑。
国产硬件私有部署场景。 科大讯飞星火Token Factory围绕昇腾硬件做了端到端优化,让国产硬件私有部署兼顾性能与成本。
从中心到边缘的AI生产体系。 超聚变Token Factory面向中心数据中心、边缘现场和企业本地空间,提供全场景算力承载能力。
常见问题解答
Token Factory和之前说的“大模型”有什么关系?
大模型是“发动机”,Token Factory是“生产线”。大模型负责生成Token,Token Factory负责把Token的生产、调度、成本、治理全部管理起来,让企业像管理生产线一样管理AI能力。
Token Factory能省钱吗?
能。核心逻辑是“让合适的模型处理合适的任务”。通过智能路由,简单任务调用小模型、复杂任务调用大模型,避免“杀鸡用牛刀”式的资源浪费。科大讯飞的数据显示,同等昇腾算力下可支撑接近翻倍的业务请求量。
Token Factory是硬件还是软件?
都不是,是一套完整的生产体系。它包含算力基础设施、模型服务平台、Token运营管理系统等多个层面。
现在能用吗?
部分已开放。智微智能Token Factory已开启试运营,面向企业级用户开放。科大讯飞星火Token Factory已于7月19日正式发布。
Token Factory的下一步
Token Factory在2026年夏天的密集爆发,不是终点,而是起点。
无问芯穹CEO夏立雪在WAIC上给出了一个判断:“Token工厂仍有10倍降本空间”。如果这个判断成立,意味着Token的成本还将持续下降,AI的规模化落地门槛还将进一步降低。
超聚变算力事业部总裁唐启明在论坛上提出了一个更宏大的愿景:“让AI真正扎根产业、创造实效”。Token Factory要做的,就是为这个愿景提供一套可度量、可管理、可运营的生产体系。
当Token成为AI时代的“石油”,Token Factory就是那个“炼油厂”。
一句话总结:Token Factory是将算力转化为标准化Token输出的AI生产基础设施。2026年WAIC期间,超聚变、科大讯飞、智微智能、范式、优刻得等企业密集发布相关解决方案,标志着AI竞争从“模型参数”转向“Token生产运营”。适合 企业AI负责人、技术决策者、云服务商、AI基础设施从业者 重点关注。
了解更多:访问各厂商官网了解Token Factory详情
© 版权声明
© 本站文章版权归 众享AI 所有,未经许可禁止转载。
相关文章
暂无评论...



