Back to News

Microsoft sets internal AI token budgets, defaults to GPT-5.6

#microsoft#ai-token-budget#gpt-5.6#copilot

Microsoft has introduced AI token budget targets for all business units starting July 2026, according to internal emails and updated Copilot usage guidelines. The company has also switched its internal default model to GPT-5.6, citing lower cost, and employees can now track their personal token spending. Executive Vice President Jay Parikh stated that 'tokenmaxxing' is not an optimization goal, and further restrictions may follow based on monitoring.

Coverage timeline

  1. 量子位量子位

    微软叫停Tokenmaxxing!预算卡死,超限自负 听雨 2026-08-05 14:33:40 来源: 量子位 内部默认用GPT-5.6 听雨 发自 凹非寺 量子位 | 公众号 QbitAI 不是, 连微软都开始心疼token了?? 根据内部邮件,从今年7月开始,微软已经为各业务部门设置了「AI Token预算目标」。 还将GPT-5.6设置为内部默认模型 ,原因是 更便宜 。 微软,那你这就是没见识过来自东方的神秘力量了。 要论便宜,你咋不直接上DeepSeek呢… 微软执行副总裁Jay Parikh也在内部亲自放话: Tokenmaxxing不是我们优化的目标。 在微软,用AI也得勒紧裤腰带 根据Parikh的内部邮件和更新后的Copilot使用指南,微软新政可以拆成几条: 第一, 设预算 。从2026年7月起,微软各业务部门都有了「AI token预算目标」。 但具体的支出目标数值,目前尚未公布。 第二, 看得见花费 。员工可以查看自己的个人AI token支出。 内部数据显示,许多工程师每月token花费在 几百到几千美元 之间。 第三, 换默认模型 。内部默认模型从原来的选项切换为 GPT-5.6 ,原因是比其他模型更便宜。 这还没完,微软表示,后续可能会根据监控情况施加进一步限制。 Parikh在内部邮件中说,「像管理其他所有关键资源一样管理token花费」。 他要求员工在用GitHub Copilot加速业务的同时,「每个人都应该意识到自己是如何消耗token的」。 其实这事儿也不是空穴来风。纳德拉6月份在一期播客上就说过,微软内部存在很多Tokenmaxxing。 甚至,他还承认自己也是个Tokenmaxxer,疯狂刷token,看着用量上高昂的数字,确实很上瘾。 但作为老板还是得算账。于是他又人间清醒了: 生产率提升的边际收益,必须匹配token的边际成本 。 不是每个问题都值得调用最强、最贵的前沿模型。模型跑得更久、上下文塞得更满、Agent开得更多,也不等于最终成果更好。 两个月后,这个判断就从CEO的播客发言,变成了微软的内部政策。 不过,微软员工倒是非常不满。一位员工表示: 一家在AI上重金投入、补贴了海量推理的公司,现在居然引导自家员工省钱?? 这名员工的质疑相当尖锐:如果连托管AI基础设施的公司,都需要担心自己能否负担内部AI产品,