Featured image of post 单人月烧19万Token,微软紧急收紧AI成本管控

单人月烧19万Token,微软紧急收紧AI成本管控

微软内部曝出最高月Token消耗达2.8万美元,公司启动预算与用量监控机制。

微软启动AI成本紧急管控

微软内部治理行动浮出水面:公司已开始收紧员工AI使用权限与预算,系统性记录每位员工的Token消耗。此前流传的一张内部表格显示,约350名美国员工填报了28天内的AI支出,最高纪录达到2.8万美元(约19万元人民币),相当于每日烧掉1000美元——超过一名硅谷工程师的日均人力成本。

  • 管控措施:部门级预算生效、个人Token支出进入内部仪表盘、默认模型切换为OpenAI GPT-5.6 Sol
  • 数据口径:28天用量统计,全公司自愿填报中位数为300美元(约2000元)
  • 部门分化明显:CoreAI中位数975美元(全公司3倍以上),Azure与Experiences and Devices部门分别约241与250美元
  • T0人上限:CoreAI部门最高单人达1.6万美元,客户与合作伙伴解决方案部门保持总纪录

Tokenmaxxing现象:从生产力到绩效表演

员工自发将AI用量与薪资并列填报,揭示了一个隐性职场新指标。一种被称为“tokenmaxxing”的行为已形成内部竞赛机制,具体做法包括故意塞满上下文窗口、堆叠巨型prompt、运行自动化代理,目的是让用量看板数字好看。

反差点在于:高用量者并未换来更高薪酬回报。同一张表格对照显示,AI支出激增与加薪、奖金、升职之间无显著正相关。微软执行副总裁Jay Parikh在8月内部备忘录中明确指出:“Tokenmaxxing并非我们追求的目标,聚焦真正为客户与业务创造改变的结果才是重点。”

类似现象亦见于其他巨头:Uber全年AI编程预算仅4个月告罄;Meta员工曾自建排名工具,单人30天消耗2810亿Token,折合估值约140万美元,该看板在曝光两天后即被下线。

成本治理三步走:从放开到紧缩

微软对AI成本的管理在一年内经历了三阶段剧变:

时间动作备注
2025年12月开放Claude Code予数千员工鼓励全面启用AI工具
2026年5月取消多数员工Claude Code许可以“工具链统一”为由,保留Copilot CLI入口
2026年8月GitHub Copilot默认模型切换GPT-5.6 SolAndroid Headlines指此举优化成本流向

时间点隐含财年逻辑:5月限制措施设于6月30日财年末,新财年即于8月落地预算制与仪表盘监控。微软CoreAI部门负责人Jay Parikh将AI支出定义为“与管理其他关键资源同等纪律”,正式设立Token预算科目。

值得注意的是,啊哈科技的OpenClaw开发者Peter Steinberger于2026年5月晒出130.5万美元月账单,验证了“若Token免费未来如何写软件”的假设——100个并行智能体实例由3人维护。

落地建议

  • 适合谁用:有明确产出目标、能将AI嵌入工作流闭环的团队,更适合采用精细化用量监控模式
  • 建议再等等:尚无清晰流程定义的部门应暂缓大规模推广,避免重蹈“表演性Token消耗”覆辙
  • 行动提示:企业可分三步走:先建立用量可见性工具,再设定部门预算阈值,最后将产出质量纳入评估体系

写在最后

AI成本治理已从财务附件上升为组织管理命题。当单一指标被公开 displayed,就会异化为被操控对象。微软的转向揭示真相:问题从不在于Token价格本身,而在于组织对“被看见的数字”的本能反应。只要衡量标准保持单一可见,就会催生新的姿态性劳动。

原文配图1
原文配图1|新闻截图