@seclink: 确实token plan 不太透明。 小米送的 16亿 token,我不到一周(只计工作日)就给它用完了。 仔细想想折算下来,每天都超过1个亿用量了。 想想,全国有1000万个像我这样的程序员, 2026年,算力荒还是有的 ...

X AI KOLs Following 新闻

摘要

用户抱怨小米赠送的16亿token很快用完,认为token计划不透明,并预测2026年将出现算力荒。

确实token plan 不太透明。 小米送的 16亿 token,我不到一周(只计工作日)就给它用完了。 仔细想想折算下来,每天都超过1个亿用量了。 想想,全国有1000万个像我这样的程序员, 2026年,算力荒还是有的 ...
查看原文
查看缓存全文

缓存时间: 2026/05/12 14:53

确实token plan 不太透明。

小米送的 16亿 token,我不到一周(只计工作日)就给它用完了。

仔细想想折算下来,每天都超过1个亿用量了。

想想,全国有1000万个像我这样的程序员,

2026年,算力荒还是有的 …

相似文章

@yibie: 推荐这篇硬核实测。一个工程师用了一周追踪自己的 coding agent session,发现任务本身只消耗了 0.67% 的 token——其余 99% 全花在搬运工具目录、skill 描述和系统 prompt 上。工作对开销比 1:1…

X AI KOLs Timeline

An engineer tracked his coding agent's token usage over a week, finding that only 0.67% of tokens were spent on actual tasks, with 99% consumed by tool directories, skill descriptions, and system prompts. He provides optimization strategies, including shell output filtering which saved 46.9% of tokens.

@Vincent_AINotes: 本地部署大模型,就算你显卡性能拉满,稳定每秒跑100Token,24小时不间断满载运行,一天满打满算也就跑出8.64M Token。 拿这点吞吐量去搞什么Agent自动化集群、海量合成数据或者大批量业务分析,简直是杯水车薪。本地部署图个数…

X AI KOLs Following

本地部署大模型受限于硬件吞吐量,即使显卡性能满载,一天仅能处理约8.64M Token,不足以支持Agent自动化集群或大规模数据分析,因此规模化应用仍需依赖云端API。