词元经济时代:从参数竞赛转向效率竞逐
截至2026年3月,我国日均词元调用量已突破140万亿次,较2024年初增长超千倍。5月,国家数据局正式将词元经济纳入工作体系;6月,国家数据局发布高质量数据集建设相关方案,首次提出“词元交易”。一个以词元为核心的万亿级智能经济新形态已然成型。
词元经济的崛起,正在从根本上重构AI算力的竞争逻辑。当前,国内AI算力产业已告别单一架构依赖,呈现出TPU、GPU、ASIC等多条技术路线并行繁荣的局面。据业内专家介绍,TPU凭借在张量计算密集场景下的能效优势,尤其适合大规模推理与高并发词元生成类任务,正逐步成为大模型规模化落地阶段的关键算力选项。不久前在上海举行的2026世界人工智能大会期间,中昊芯英首次实物展出新一代TPU架构AI专用芯片“须臾®”及泰则®2.0人工智能服务器。
据大会现场技术人员介绍,“须臾®”单芯片混合精度浮点算力达896TFLOPS,是第一代芯片“刹那®”的3倍,8-bit推理算力高达1792TOPS;单芯片额定功耗仅600W,相较于算力性能持平的传统芯片功耗降低50%,搭载“须臾®”的泰则®2.0,整机能耗仅为传统GPU服务器的80%。这一能效优势在词元经济语境下具有直接的商业价值:低功耗意味着更低的运营电费与碳排放,直接压低单Token的生产成本。中昊芯英CEO杨龚轶凡透露,“须臾”设计目标是大幅压低单位Token成本,从一代到二代直接减半,后续迭代有望降到原有的1/10。
词元经济的落地,不仅需要单芯片的能效突破,更需要集群部署与产业协同的全链条支撑。记者了解到,2026世界人工智能大会期间,中昊芯英联合杭州电信、中兴通讯宣布,华东地区(杭州)首个国产TPU智算千卡集群(一期)项目落成,共部署1024片“刹那®”芯片,算力规模达400P。作为中国电信体系内首个大规模部署国产TPU架构的智算集群,三方各司其职:中昊芯英提供芯片到集群的核心算力支撑;中兴通讯提供全栈通信方案;杭州电信“息壤”算力平台将集群资源利用率从30%提升至60%以上。据悉,项目正规划二期扩容至10000P,将采用新一代“须臾®”芯片进一步扩大算力规模。
多位业内人士表示,词元计费模式的普及,让算力规则从“卖硬件”变为“卖Token”,核心考核指标变成单Token交付成本、有效产出效率与服务稳定性。针对这一变化,国产专用算力正在一条不同于通用芯片的道路上加速奔跑——不是比拼单卡峰值参数的“纸面算力”,而是围绕词元生产效率,构建端到端的综合竞争力。以TPU为代表的专用芯片路线,正在词元经济时代迎来真正的价值验证周期。(胡其峰)
(来源:国搜数据观)

发表回复