标题:我正在寻找喜欢解决正确性而非AI问题的工程师
摘要
作者分享了自己构建原型以验证AI生成的财务声明的经验,重点关注系统与工程挑战,如证据对账和确定性验证,并邀请志同道合的工程师进行交流。
过去几个月,我一直在围绕一个我无法停止思考的问题构建原型:如何判断AI生成的财务声明是否真正可信?显而易见的答案是“使用更好的模型”。但构建得越多,我越不认为那是真正的解决方案。更困难的问题实际上是:跨多个文档呈现证据、对账冲突的财务数值、确定性规则评估、计算可追溯性、版本化验证逻辑、决定哪些内容可以实际验证、哪些应保持范围之外。这与其说是聊天机器人问题,不如说是一个系统、数据和工程问题。这正是我喜欢研究它的原因。我仍处于原型阶段,但每周这个项目都越来越不关乎提示大语言模型,而更多是构建可信AI的基础设施。如果你是那种会对以下领域感到兴奋的工程师:C++、分布式系统、编译器、形式化方法、金融系统、文档智能、验证、评估、确定性软件,我真心希望听听你在解决什么样的问题。今天并非招聘。主要是想认识喜欢构建困难系统的人。我遇到的一些最佳机会始于技术讨论而非面试。
相似文章
我构建了一个确定性引擎,能在AI的财务计算错误发布之前就抓住它们——想找人挑刺
作者构建了一个确定性验证层,重新计算AI副驾生成的财务数字以捕捉错误,并正在寻求金融和AI从业者的反馈。
我正在为AI生成的声明构建一个独立验证层,并寻找研究人员和合作伙伴与我们共同构建。
作者正在开发一个用于AI生成声明的确定性验证引擎,专注于形式化验证方法,并寻求研究人员和合作伙伴进行合作。
AutoFlow 研究计划 —— 寻找深度技术思考者
AutoFlow 研究计划正在招募深度技术思考者,以构建能够独立验证 AI 生成的声明(从财务分析开始)的系统,并已加入 NVIDIA Inception 计划。
AI生成的声明在数学上如何定义为“真实”、“合理”和“可信”?
一位研究者描述了一个项目,旨在以数学形式化AI生成声明的真实性、合理性和可信度,并寻求关于形式化方法、逻辑和概率论的意见,以构建一个“信任引擎”。
Open ai
文章讨论了行业共识:人工智能正变得极其强大,但在高风险任务上的可靠性仍是一个未解决的工程问题。强调当前系统优化的是合理性而非确定性真理,前进方向是分层验证系统而非单一完美模型。