人们如何让OpenClaw/Hermes代理24/7运行而不耗尽API预算?

Reddit r/AI_Agents 新闻

摘要

一位从业者寻求建议,希望在不产生高额API成本的情况下让AI代理24/7运行,询问本地模型、云GPU或托管API,并希望获得兼顾可靠性和推理质量的成本效益方案。

我运行几个轻量级AI代理,主要进行: * 阅读新闻, * 抓取竞争对手更新的网站, * 监控变化, * 发送警报。 即使工作量如此之小,我每小时在令牌上的花费已经约为0.50美元,连续运行下来大概每个月360美元。这让我好奇人们是如何让24/7的代理设置在经济上大规模可行的。大多数人: 1. 运行本地/开源模型? * 如果是,你使用什么模型和硬件? * 自托管何时比API更便宜? 2. 租用云GPU并自行托管模型? * AWS、RunPod、Vast、Lambda等? * 你的月成本是多少? 3. 坚持使用托管API(OpenAI/Anthropic等)并接受令牌成本? 我很想知道人们实际使用哪些设置来平衡: * 可靠性, * 不错的推理质量, * 以及24/7运行代理的合理月成本。 尤其对人们找到的最具成本效益的设置感兴趣。请分享你的经验。
查看原文

相似文章