标签
提出了CASE,一个结合训练时因果对齐与推理时结构强化的框架,旨在提升大语言模型思维链推理的忠实性,在多个基准测试中平均实现了37%的思维链忠实性提升。
一份白皮书,识别了AI智能体工作流中的24种失效模式,并提出了一种包含三层约束、任务图和验证的结构性约束架构,以及一个基于Common Lisp的参考实现。