1 minArielle Shipperrss原文 ↗

我们的 AI 账单暴涨 230%,但我暂时不设 token 预算

为什么值得读Every CEO 狂测新模型把日花销飚到平时 2.5 倍的幕后故事。关于「创新 vs 预算」的真实困境:人人都在实验,设限制随时过时,不设又怕破产。

我们的 AI 账单暴涨 230%,但我暂时不设 token 预算

作者:Arielle Shipper(Every)

七月初的一个早晨,我被 OpenAI 和 Ramp 的告警淹没:额度用尽。卡被拒付。我出了一身冷汗——前一晚十点,信用余额是满的,自动充值开着,Ramp 卡里余额充足。不知怎么,不到 12 小时账户就被清零了。

这场风暴的源头是我哥哥、Every 的 CEO Dan Shipper:他在为当天的模型测评「Vibe Check」测试 Sol (ultra)——用资深工程师级别的任务。上午十点我们给 Ramp 卡充了值,以为风波平息。但当天剩余时间我们的 token 消耗一直高得反常,而且从那以后再没有正常过。

GPT-5.6 Sol 上线后的头五个完整工作日里,我们的日均消耗从 11,520 credits 涨到 26,685——几乎是前一周基线的 2.5 倍。我花了几周防着 Fable 炸掉预算,没想到没看见的是 Sol 这场风暴。突然间我必须想办法既不掐灭日常工作,又不把我们搞破产。

同事们的反应从「放开跑,月底见分晓!」到「现在就得设限,该研究本地跑模型了」不一而足。与此同时,我们每几天就烧掉一个月的 token 预算。

没有轻松的解法。在 Every,实验是每个人的本职——从工程到商务拓展,人人都要弄清这些模型能做什么、在哪里有用。因为宝贵的洞见可能来自公司任何角落,所以人人都需要有花钱的权限。

如果可以重来,你还愿意花这段时间读它吗?

· 匿名阅读记录只用于改进推荐