算力账单持续走高 大厂收紧AI Token用量 内容创作团队直面成本波动考验,普通用户暂时没有受到影响

  原因

算力账单持续走高 大厂收紧AI Token用量 内容创作团队直面成本波动考验	,普通用户暂时没有受到影响-第1张图片

  控制成本防止浪费,减少高额无效支出

算力账单持续走高 大厂收紧AI Token用量 内容创作团队直面成本波动考验,普通用户暂时没有受到影响-第2张图片

  除了字节跳动、腾讯完成内部Token额度精细化改革外 ,阿里 、京东、美团等国内头部互联网企业也同步出台限流规则,以压缩无效Token消耗 。

算力账单持续走高 大厂收紧AI Token用量 内容创作团队直面成本波动考验,普通用户暂时没有受到影响-第3张图片

  有大厂员工透露 ,行业普遍无额度限制、无场景约束 ,不少员工滥用高端付费大模型处理简单办公 、检索、总结 文案等基础工作,甚至为冲考核、堆工作量刻意刷取无效Token,叠加Agent循环调用 、长文本无意义生成等行为 ,造成企业算力成本持续无序飙升,资源浪费问题愈发严重。

  专家认为,此番全行业收紧Token使用规则 ,核心目的就是出清算力泡沫 、杜绝无效成本内耗。从行业落地数据来看,头部互联网企业完成Token精细化管控后,在不影响正常业务开展的前提下 ,整体外部AI算力采购成本可下降40%~60%,部分管控彻底、模型替换全面的企业,无效算力成本降幅可达70% 。有业内人士结合字节跳动官方报销新规、全员岗位配比及研发人数测算 ,仅外部第三方模型采购费用一项,字节跳动每月即可减少超亿元的无效AI开支,单月可节约算力成本超1亿元。

  海外科技同样因成本问题对Token使用限流。Uber全年34亿美元AI总预算 ,仅4个月就耗尽 ,工程师单人月均Token开销高达500美元至2000美元,成本失控速度远超企业预期 。Meta曾推行Token消耗排名 榜激励员工使用AI,放任全员无上限调用算力 ,直接导致单月员工总Token消耗突破70万亿,月度算力成本超1亿美元,高额无效支出倒逼平台紧急叫停用量排名机制 ,为全员配发固定算力配额,严控无效调用 。与此同时,微软 、亚马逊也相继关停第三方高价模型内部授权 ,废除AI用量考核榜单,全面开启算力成本精细化管控。

  为何大厂纷纷对员工限流?曾在腾讯网络安全部门任职的科技行业从业者李铁军分析,AI算力背后是高昂的成本 ,核心压力集中在GPU硬件采购运维与机房电力消耗两大板块。

  硬件层面,支撑大模型运行的高端GPU采购单价极高,企业需批量采购组建算力集群 ,前期硬件投入动辄数十亿元;同时高负载持续运算会大幅缩短显卡、服务器等设备的使用寿命 ,设备更换、日常维修保养都会持续产生大额支出,无节制调用Token会加速硬件老化,拉高长期设备摊销成本 。

  电力层面 ,算力集群24小时不间断高负荷运转,机房制冷 、设备运行均会产生巨额电费,批量、无意义的Token调用会持续增加机房能耗开支。双重成本叠加下 ,放任员工无上限使用AI会造成企业算力费用无序暴涨,这也是各大互联网企业出台Token配额、限制员工滥用算力资源的核心原因。

  影响

  C端用户基本无感,B端专业团队直面压力

  很多人对此现象产生疑惑:大厂严控内部Token ,普通人日常用AI会不会变少 、热度持续下滑?国家数据局公开数据显示,国内大模型日均Token调用量持续攀升,豆包、文心一言等国产C端产品月活、日均对话量连续8周上涨 ,全民AI渗透率突破72%,8亿网民常态化使用AI工具 。

  记者调查发现,此次大厂政策调整对普通大众用户几乎无影响。普通用户日常仅使用AI进行简单问答 、文案润色、生活询问 、轻度配图等场景 ,单次Token消耗极低 ,使用频次 、调用总量有限,远未触及平台限流阈值。

  因而,真正受到显著冲击的 ,是依赖大算力 、高频批量调用AI的专业从业者与中小内容企业 。广州科韵路某游戏公司从业者表示,游戏初创公司对算力需求大,算力对其成本影响更大 ,在不同平台购买Token,成本浮动多达数万元。

  应对

  不少平台借机降价抢用户和市场

  记者梳理行业最新动态发现,本轮Token成本管控呈现明显差异化格局 ,并非所有大模型供应商都选取 收紧配额、抬高使用成本,不少平台反向调整策略,通过降本、降价 、优化算力体系抢占市场。以金山办公为代表的企业走出差异化路径 ,搭建精细化Token统筹体系,依靠资源整合、拦截无效算力,直接降低内部员工办公AI的Token使用成本;国产大模型厂商DeepSeek此前更是推出大规模永久降价方案 ,旗下V4-Pro整体降幅达75% ,缓存命中场景百万Token单价低至0.025元 。

  有业内分析师表示,大厂收紧商用B端Token额度是为了减少无效算力损耗,而对普通用户、中小开发者降价让利是核心竞争策略。用户体量直接决定大模型数据迭代速度与市场话语权 ,厂商愿意压缩商用业务利润,持续下调调用成本 、放宽免费额度。7月7日,微信公开课发布消息 ,小程序成长计划再度升级,全面搭载混元Hy3大模型与Hy Image 3.0生图模型,大幅加码AI算力扶持 ,降低开发者落地AI小程序的成本 。据介绍,本次升级核心资源实现10倍扩容,大模型Token额度由1亿提升至10亿 ,AI生图额度增至10万张,资源包申请后6个月有效 。

  与供需紧张形成鲜明对比的是Token定价的混乱。共绩算力联合创始人王鹏早前曾表示,当前Token市场呈现“各自定价、各自为战”的态势 ,不同平台、不同模型下同一量级的Token费用 可能相差数倍 ,“有的百万Token只要两元,有的要几十元,普通用户很难判断其真实价值。 ”

  名词解释

  Token

  Token中文名为词元 ,是AI大模型识别 、处理信息的最小基础单位 。和AI对话、查询问题、生成文字 、分析内容时,所有输入与输出信息,都会被拆解为Token完成运算。AI的算力消耗、额度限制、收费定价 ,全部以Token作为统一核算依据。近来 国内没有统一收费标准,轻量化经济型模型每百万Token低至0.4~2元,旗舰高端模型每百万Token可达10~60元 ,不同厂商 、不同能力等级模型价差悬殊 。

(文章来源:信息时报)

文章推荐

  • 疫情后旅游怎么选取地区(疫情后旅游怎么选取地区比较好)

      原因  控制成本防止浪费,减少高额无效支出  除了字节跳动、腾讯完成内部Token额度精细化改革外,阿里、京东、美团等国内头部互联网企业也同步出台限流规则,以压缩无效Token消耗。  有大厂员工透露,行业普遍无额度限制、无场景约束,不少员工滥用高端付费大...

    2026年07月22日
    6
  • 中国疫情黄色地区有哪些/中国疫情区域有哪些

      原因  控制成本防止浪费,减少高额无效支出  除了字节跳动、腾讯完成内部Token额度精细化改革外,阿里、京东、美团等国内头部互联网企业也同步出台限流规则,以压缩无效Token消耗。  有大厂员工透露,行业普遍无额度限制、无场景约束,不少员工滥用高端付费大...

    2026年07月22日
    6
  • 【浙江省疫情高危地区,浙江省疫情高中低风险地区】

      原因  控制成本防止浪费,减少高额无效支出  除了字节跳动、腾讯完成内部Token额度精细化改革外,阿里、京东、美团等国内头部互联网企业也同步出台限流规则,以压缩无效Token消耗。  有大厂员工透露,行业普遍无额度限制、无场景约束,不少员工滥用高端付费大...

    2026年07月22日
    10
  • 国外限行/国外限号限行措施

      原因  控制成本防止浪费,减少高额无效支出  除了字节跳动、腾讯完成内部Token额度精细化改革外,阿里、京东、美团等国内头部互联网企业也同步出台限流规则,以压缩无效Token消耗。  有大厂员工透露,行业普遍无额度限制、无场景约束,不少员工滥用高端付费大...

    2026年07月22日
    6