标题:我正在寻找喜欢解决正确性而非AI问题的工程师
摘要
作者分享了自己构建原型以验证AI生成的财务声明的经验,重点关注系统与工程挑战,如证据对账和确定性验证,并邀请志同道合的工程师进行交流。
过去几个月,我一直在围绕一个我无法停止思考的问题构建原型:如何判断AI生成的财务声明是否真正可信?显而易见的答案是“使用更好的模型”。但构建得越多,我越不认为那是真正的解决方案。更困难的问题实际上是:跨多个文档呈现证据、对账冲突的财务数值、确定性规则评估、计算可追溯性、版本化验证逻辑、决定哪些内容可以实际验证、哪些应保持范围之外。这与其说是聊天机器人问题,不如说是一个系统、数据和工程问题。这正是我喜欢研究它的原因。我仍处于原型阶段,但每周这个项目都越来越不关乎提示大语言模型,而更多是构建可信AI的基础设施。如果你是那种会对以下领域感到兴奋的工程师:C++、分布式系统、编译器、形式化方法、金融系统、文档智能、验证、评估、确定性软件,我真心希望听听你在解决什么样的问题。今天并非招聘。主要是想认识喜欢构建困难系统的人。我遇到的一些最佳机会始于技术讨论而非面试。
相似文章
AutoFlow 研究计划 —— 寻找深度技术思考者
AutoFlow 研究计划正在招募深度技术思考者,以构建能够独立验证 AI 生成的声明(从财务分析开始)的系统,并已加入 NVIDIA Inception 计划。
Open ai
文章讨论了行业共识:人工智能正变得极其强大,但在高风险任务上的可靠性仍是一个未解决的工程问题。强调当前系统优化的是合理性而非确定性真理,前进方向是分层验证系统而非单一完美模型。
@thaiscbranco_:招聘 AI 工程师——不是随便那种,而是能把模型输出从“垃圾”变成“大厨之吻”、对评估与数据质量走火入魔、痛恨紫色渐变、热爱创意、为测试脚手架狂喜、坚信“记忆”才是 AI 最大瓶颈的顶尖高手
招聘方寻找精英 AI 工程师:专注打磨模型输出、死磕评估与数据质量,热衷底层工具而非花哨界面。
我们正在尝试解决“AI代理持有生产凭证”的问题。寻求反馈。
作者正在开发一种用于管理AI代理的生产凭证的解决方案,并寻求社区反馈。
我们是在培养AI工程师,还是仅仅是AI工具的使用者?
文章观察到,初级AI工程师倾向于专注于提示工程和低代码平台等高层次工具,而非深入理解基础知识,这引发了对面试中解决问题能力的担忧。