数据核对时间:2026年7月下旬。文中标注“网络测算”的数字均非官方数据,仅供方向参考;具体以各厂商官方文档为准。
你可能也遇到过这种情况:豆包平时用得好好的,某天突然弹出一句“今日额度已用完”。你没觉得自己做了什么特别重的操作,但服务就是停在这里了。
免费额度看起来像一个产品规则,其实背后是一笔账。厂商每天都在算:一个免费用户最多可以消耗多少算力?这些消耗能不能被转化、数据、生态位或者广告收入补回来?一旦这笔账变了,额度就会跟着变。
这篇文章聊的就是这件事:AI工具的免费额度到底是怎么算出来的,为什么有时会突然收紧。
一、免费额度先看成本账

免费不是厂商一拍脑袋决定的。更接近真实情况的算法,大概是这样:
免费额度上限 ≈ 厂商愿意为每个免费用户承担的成本上限 = 这个用户能带来的预期回报(数据反哺、转化概率、生态位、广告收入)− 服务这个用户的边际成本
右边任何一个变量变了,左边的免费额度就会被重新算一遍。所以免费额度很少是一个永远不动的承诺,它更像一个会随成本和商业压力调整的预算线。
这个成本也不轻。网络上有过一组针对豆包的粗略测算,口径不是官方数据,只能看方向:假设日活用户500万,其中30%的人每天用5次生成、转写、解析这类核心功能,日均调用量就是750万次。只算这几类基础操作,硬件成本每天就可能到六位数。这里还没把模型训练、内容安全审核、峰值并发预留的冗余算力算进去。
所以,免费不是技术天然带来的结果,更多时候是厂商用资本、生态位或者增长目标换来的让利。融资节奏变慢、算力成本变高、商业化压力上来,免费额度就很难一直按原来的尺度给。
二、厂商不会告诉你花了多少钱,只会改规则
厂商不会在页面上写“你今天最多只能消耗X元算力”。它会把这笔预算翻译成几种你能感知到的产品规则:几点重置、还能问多少次、还能不能用最强模型。
第一种,是时间窗口。Claude免费版和Pro版都不简单按“每天0点重置”来算,而是用滚动的5小时窗口,再叠加每周总量。规则看起来复杂,目的其实很直接:把用户请求摊到全天,避免大家卡在同一个重置点一起涌进来。
第二种,是按模型分层给次数。Gemini走的是这条路。综合多个独立开发者社区对Google官方限额页面的追踪,口径有差异,但方向一致:轻量级的Flash系列免费额度比较宽,可能到每天1500次请求;旗舰级的Pro系列就收得很紧,每天可能只有50次左右,每分钟请求数也被压到个位数。同样叫免费版,背后用的算力并不是同一档,越贵的模型,免费额度越少。
第三种,是模型降级。很多人以为免费层只是“同一个模型,少给几次机会”,实际更常见的是限次再加降级。你仍然在同一个入口提问,但系统可能已经把你切到更便宜的模型、更低的推理深度,或者更弱的功能组合上。ChatGPT免费版就是类似逻辑:消息数、文件上传、图像生成分别计数,默认模型和推理能力也会受限,免费用户很难稳定使用最强推理模式。
| 机制 | 代表产品 | 逻辑 |
|---|---|---|
| 滚动时间窗口 | Claude免费版(5小时+每周) | 平滑并发,不按自然日重置 |
| 按模型分层的固定次数 | Gemini(Flash系列约1500次/天,Pro系列约50次/天) | 越贵的模型,免费额度收得越紧 |
| 消息数/功能项独立计数+模型降级 | ChatGPT免费版 | 各项功能分别限额,且默认模型和推理深度打了折扣 |
还有一层更隐蔽:厂商会把功能拆到免费墙和付费墙两侧,而不是简单地对整个产品收费。以豆包为例,免费层保留了大量高频但单次价值密度不高的功能,比如日常聊天、简单文案;长文档精读、批量视频生成、深度数据分析这类明显提高单次产出质量、也更耗资源的功能,则更容易被放进付费区。

轻度用户每天聊几句、改几段文字,基本感受不到这堵墙。会撞上它的,通常是消耗远高于平均值的重度用户。
三、豆包为什么走到收费这一步
回头看豆包的调整,它不是一次孤立的商业新闻,更像是免费额度这笔账算到某个阶段后的结果。
多方媒体报道显示,2026年5月4日,字节跳动旗下豆包在苹果App Store上线三档付费方案:标准版68元/月、加强版200元/月、专业版500元/月。官方口径是“基础功能永久免费+高阶增值付费”,日常聊天、简单文案、简单翻译等核心功能承诺永久免费且不限次。
这个消息之所以引发讨论,不只是因为豆包开始收费,而是用户马上会担心:免费版会不会变慢?会不会排队?会不会把好模型藏起来?官方没有宣布免费额度缩水,但用户的反应说明了一件事,额度收紧很多时候不会写在公告里,而是慢慢体现在体验上。
第一,用户规模已经大到不能忽略成本。据QuestMobile数据,2026年第一季度豆包月活跃用户约3.45亿。到了这个体量,单个免费用户哪怕只多消耗几分钱,乘起来也是很大的成本。

第二,上游成本也在变贵。2026年5月9日起,腾讯云宣布AI算力相关产品价格上调5%;阿里云部分产品价格出现上调,公开报道中的最高涨幅达到34%;智谱AI相关订阅和API价格也在年内多次调整,2月GLM Coding Plan提价超过30%,3月GLM-5-Turbo API价格上调20%,4月GLM-5.1继续提价10%。
智谱这几次调价可以单独看一下。假如是在同一条产品线上连续上调,复合涨幅会是:
| |
这意味着同一产品连续涨三次,理论累计涨幅会接近72%。但这里要把边界说清楚:这三次提价分别对应GLM Coding Plan、GLM-5-Turbo API、GLM-5.1,不是同一个SKU连续涨价,所以不能直接写成“同一件商品涨了72%”。更稳的说法是,这几次调价方向一致、间隔很近,反映出2026年上半年模型服务成本在收紧。
第三,收费也是一种用户分层。豆包3.45亿月活里,大量消耗算力的深度用户只占一小部分,但他们的token消耗会远高于平均水平。三档定价的作用,就是把这部分重度用户筛出来,让高消耗和付费对应起来。绝大多数轻度用户每天聊几句、翻译几段文字,可能几乎感觉不到变化。
免费额度收紧最常见的样子,大多不是全面砍掉免费版,而是先卡高消耗场景。ChatGPT从免费版到Go、Plus、Pro多档分层,背后也是同一条路,轻度用户尽量留住,重度用户自然进入付费层。
写在最后
免费额度很难看成厂商的长期承诺,它更像一套会被反复重算的成本模型。算力成本涨了,用户规模大了,变现压力来了,任何一个变量变化,额度都会被重新评估。
只不过这个过程通常不会直接告诉你。它更多会变成限速、排队、次数减少、模型降级,最后落到你的使用体验里。
所以下次再看到一款AI工具说自己完全免费,可以换个角度看:它的用户增长和算力成本是不是越拉越开。两条曲线背离得越明显,免费额度被收紧的可能性就越高。
数据与资料来源
以下链接为本文用到的公开资料。官方文档优先;涉及豆包付费、QuestMobile数据、阿里云和智谱调价的部分,部分来源为媒体报道或第三方测算。
- Anthropic Claude Pro用量说明:https://support.claude.com/en/articles/8325606-what-is-the-pro-plan
- Claude官网价格页与用量限制说明:https://claude.com/pricing
- Google Gemini API速率限制说明:https://ai.google.dev/gemini-api/docs/rate-limits
- OpenAI ChatGPT Free Tier FAQ:https://help.openai.com/en/articles/9275245-chatgpt-free-tier-faq
- OpenAI ChatGPT Go说明:https://help.openai.com/en/articles/11989085-what-is-chatgpt-go
- 豆包App Store页面:https://apps.apple.com/cn/app/%E8%B1%86%E5%8C%85-%E9%9A%8F%E6%97%B6%E5%B8%AE%E5%BF%99%E7%9A%84-ai-%E5%8A%A9%E6%89%8B/id6459478672
- IT之家关于豆包三档付费订阅的报道:https://m.ithome.com/html/946236.htm
- QuestMobile2026年一季度AI应用洞察:https://www.questmobile.com.cn/research/report/2046482337382842370/
- 腾讯云AI算力、容器服务、EMR相关产品价格调整公告:https://cloud.tencent.com/announce/detail/2254
- 阿里云AI算力和存储产品调价报道:https://finance.sina.com.cn/stock/relnews/2026-03-18/doc-inhrkskt7573252.shtml
- 智谱GLM Coding Plan价格调整报道:https://www.ithome.com/0/921/258.htm
- 21财经关于智谱2026年多轮调价的报道:https://m.21jingji.com/article/20260617/herald/cf85ded89035d5023752dc7d692669f6.html
- 智谱GLM Coding Plan套餐概览:https://docs.bigmodel.cn/cn/coding-plan/overview
- 豆包免费层成本测算参考,非官方数据:https://bbs.csdn.net/weixin_27064205/article/details/100174535