若成本仍不可见,语音通话就不算“完成”
摘要
一位开发者认为,语音通话日志必须包含成本和Token数据,而不仅仅是时长和状态,才能正确评估语音代理的经济性。他分享了压力测试中的一个教训:成本字段最初为空。
数周以来,我完成的通话中最重要的两个字段均为null。`totalTokensUsed: null` `costCents: null` 通话完成了,转录存在,状态显示已完成。但我仍然无法回答那个在超越演示阶段后至关重要的问题:那次通话完成实际花费了多少?
这些字段第一次真正有数据,是在一次长时间的压力测试中:764秒,140,034个token。那个数字改变了我对整行结果的看法。时长和最终状态并不足够。如果通话可能超时、重试、进入语音信箱、被中断或需要人工跟进,成本就必须紧挨着结果呈现。
我现在遵循的规则是:在你信任语音代理的定价之前,先运行十次糟糕的通话,而不是十次干净的演示。对于每次完成的通话,我想要:
- 时长
- 超时/重试次数
- token/成本
- 结果
- 负责人
- 是否仍需人工跟进
如果成本数据存在于另一个独立的仪表盘中,你就没有一份完整的通话收据。你有的只是转录和一张之后才会发现的账单。
这里的各位在将经济性称为“已知”之前,每次通话会记录哪些内容?
相似文章
在计算语音AI通话实际成本时学到的经验
对语音AI通话相关实际成本的分析,涵盖API使用、延迟和服务商定价等因素。
语音AI在生产中表现不佳,实际让你付出什么代价?
一位从业者回顾了在呼叫中心使用语音AI的经历,详细说明了解决方案在生产中表现不佳时的隐性成本,并希望从有类似实际经验的人那里获得诚实的反馈。
通话在音频结束后并未完成
本文认为,由AI代理处理的通话在音频结束时并未完成;真正的检验标准是承诺(如回电)是否被正确记录到工作队列中,并附有负责人、截止日期和证据,而不仅仅是有一份漂亮的转录文本。
编程代理是否变得昂贵,还是我们对成本的衡量方式有误?
本文质疑编程代理的真实成本是否包含隐藏的人力监督和调试,认为真正的价值应以可信输出来衡量,而非原始 token 消耗。
当我最终对智能体的工具调用进行监控时,成本分解让我感到惊讶。几点经验教训。
作者分享了监控AI智能体工具调用的经验教训,揭示了像web_search这样的工具可能占支出的约50%,并强调了追踪p95延迟以及按工作流或客户归因成本的重要性,以避免意外。