【#token到底多少钱谁也说不清#】#同解一道题token消耗差近10倍# @北京日报 记者在调查中发现,同一个模型、同一道题,不同平台消耗的Token数量能相差十几倍。
作为AI时代的“水电煤”,Token(词元,即大语言模型处理文本及多模态信息的最小语义单元)正从技术术语,变成和普通人息息相关的消费品,运营商也推出了词元套餐。但记者调查发现,新兴的词元套餐背后,存在计费规则不透明、跨平台标准混乱等情况。
记者用一道经典数学题“鸡兔同笼,共有30个头,88只脚。求笼中鸡兔各有多少只?”进行了横向测试。在中国移动云盘App的MClaw中,选择调用通义千问Qwen3.5-plus模型,回答该问题消耗1.8万词元。而在模型开发方阿里云百炼平台,用同款Qwen3.5-plus模型作答,相同问题仅消耗1733Token——竟差出9.5倍。
还是这道“鸡兔同笼”题,在天翼云大模型平台调用DeepSeekV3,消耗了2091Token;在联通元景Maas平台调用DeepSeekV3,消耗了425Token,前者是后者的近5倍。
计量单位的不统一,让这笔账更加糊涂。记者订阅的北京移动云电脑套餐,月费39.99元,包含云电脑服务及2500个“云算粒”Token包。但“云算粒”与词元的换算关系,并未明确标注。随后,记者输入一句“你好”,消耗2.05个云算粒;提问上述“鸡兔同笼”问题,消耗2.21个云算粒。
回答质量也不尽相同。记者用同一款Qwen3.5-plus模型,提出一个信息收集类问题:“梳理一下三大运营商的Token套餐,费用和明细,并列出表格。”
在中国移动云电脑上,系统回复无法获取最新套餐,转而给出客服热线电话和部分手机资费信息,但完全未涉及Token套餐,消耗了8.74个云算粒。在中国移动云盘MClaw中,相同模型、相同问题,消耗15万Token,给出的答案依然是5G手机套餐资费,而非Token套餐信息。而当记者转至研发该模型的“原厂”厂商平台上,同一模型、同一问题仅消耗4244Token,便输出了一份包含手机通信套餐及三大运营商大模型Token计费信息的表格。
同一模型为何在不同平台接入,“智商”大相径庭?清华大学计算机系长聘教授、清程极智首席科学家翟季冬打了个比方:“当我们用电时,不用担心发出来的电有差异,但Token不同,同样的模型、同样的价格,Token质量却可能参差不齐。”他解释,有些供应商为了节省算力成本,会把“高精度版”模型压缩成“低精度版”提供给用户,好处是一份算力能服务更多人,代价就是模型能力被“裁剪”,不再“原汁原味”。即便不做压缩,不同团队的技术水平也高下有别,同样的模型、同样的硬件,部署出来效果和效率可能差出数倍。
通信与互联网领域分析师马继华呼吁,运营商需与智能体、AI应用厂商深度协同,推动AI应用进一步走向手机端。只有当人们通过手机高频消耗词元时,Token才能像流量包一样无缝融入大众套餐。同时,运营商应该合作建立统一的词元计量、质量评估和服务定价标准体系。探索动态分层、分级定价策略,或者包月按次等收费模式,让计费规则清晰透明。(@北京日报 记者 孙奇茹 夏骅)http://t.cn/AXKCRpp6
