SemaPLC:基于项目与验证门控的PLC代码生成代理工具
摘要
SemaPLC是一个用于PLC代码生成的验证门控代理工具,通过外部编译和实时运行时执行,实现比基线方法更高的验证通过率。
查看缓存全文
缓存时间: 2026/08/20 04:03
论文页面 - SemaPLC:一种基于项目、验证门控的PLC代码生成代理框架
来源:https://huggingface.co/papers/2608.18565
发布于 8月19日
·
由 https://huggingface.co/Allenyltu 提交
Allen (https://huggingface.co/Allenyltu) 于 8月20日
#2 当日精选论文 (https://huggingface.co/papers/date/2026-08-20)
作者:
,
,
,
,
,
,
,
,
,
,
摘要
SemaPLC 是一种验证门控的代理框架,它通过外部编译和实时运行时执行来验证生成的PLC逻辑,实现了高于基线方法的严格验证通过率。
可编程逻辑控制器(PLCs)(https://huggingface.co/papers?q=Programmable%20logic%20controllers%20(PLCs)) 运行着工业工厂,而大型语言模型已经能够为其生成独立的程序组织单元(POUs)(https://huggingface.co/papers?q=program%20organization%20units%20(POUs))。然而,这种逻辑是否能够集成到现有的PLC项目中并正确运行,仅在有限的测试中被检查过。我们提出了 SemaPLC (https://huggingface.co/papers?q=SemaPLC),一个基于项目且经过验证门控的代理框架 (https://huggingface.co/papers?q=verification-gated%20agent%20harness),它由常规工具组装而成,但受严格的完成规则约束。SemaPLC 不会在模型判断其输出足够时就停止,而是仅在记录的外部检查确认后才宣布任务完成。这些检查涵盖了规范、编译以及在实时运行时 (https://huggingface.co/papers?q=live%20runtime) 上的行为。
在匹配现有基准的 117 个独立 POU 任务上,它在所有七个模型上都取得了最高的严格验证通过率(平均 72.6%)。在一个包含 65 个任务的项目上下文轨道上,其生成的逻辑必须在真实项目中编译和运行,它在集成编译 (https://huggingface.co/papers?q=integrated%20compilation)、静态行为 (https://huggingface.co/papers?q=static%20behavior) 和动态行为 (https://huggingface.co/papers?q=dynamic%20behavior) 上均获得了最高的平均分。在这三个层次中,动态行为 (https://huggingface.co/papers?q=dynamic%20behavior) 最具揭示性。我们通过将生成逻辑和参考逻辑部署到实时 PLC 运行时并比较它们的执行跟踪 (https://huggingface.co/papers?q=executed%20traces) 来进行测量。所有方法在静态评分上的差距都在 10 个点以内,而动态分数则清晰地将它们区分开来:基线方法得分在 22.4 到 31.4 之间,而 SemaPLC (https://huggingface.co/papers?q=SemaPLC) 得分为 52.2。
总体而言,我们的验证门控框架在每一层都提升了平均分,并且在运行时层提升最为显著。执行,而非静态评分,才是检验生成的控制逻辑是否真正有效的忠实测试。SemaPLC (https://huggingface.co/papers?q=SemaPLC) 已在 https://github.com/midea-ai/SemaPLC (https://huggingface.co/papers?q=SemaPLC) 开源。
查看 arXiv 页面 (https://arxiv.org/abs/2608.18565) 查看 PDF (https://arxiv.org/pdf/2608.18565) GitHub30 (https://github.com/midea-ai/SemaPLC) 添加到收藏夹 (https://huggingface.co/login?next=%2Fpapers%2F2608.18565)
在你的代理中获取此论文:
hf papers read 2608\.18565
没有最新的 CLI? curl \-LsSf https://hf\.co/cli/install\.sh \| bash
引用此论文的模型 0
无模型链接此论文
在模型 README.md 中引用 arxiv.org/abs/2608.18565 以从本页链接。
引用此论文的数据集 0
无数据集链接此论文
在数据集 README.md 中引用 arxiv.org/abs/2608.18565 以从本页链接。
引用此论文的 Spaces 0
无 Space 链接此论文
在 Space README.md 中引用 arxiv.org/abs/2608.18565 以从本页链接。
包含此论文的合集 0
无合集包含此论文
将此论文添加到一个合集 (https://huggingface.co/new-collection) 以从本页链接。
相似文章
ESBMC-PLC:基于SMT模型检查的IEC 61131-3梯形图程序形式化验证
本文提出了ESBMC-PLC,这是首个原生支持IEC 61131-3梯形图程序并使用基于SMT的模型检查的开源形式化验证器,实现了对安全关键工业控制逻辑的自动化验证。
使用ESBMC-PLC+检测IEC 61131-3 PLC程序中的梯形逻辑炸弹:一种带有触发综合的形式化验证方法
本文提出ESBMC-LLB,一种通过综合触发器并使用ESBMC-PLC+作为验证引擎来检测IEC 61131-3 PLC程序中梯形逻辑炸弹的形式化验证方法,在公开数据集上实现了高检测率。
CPPL:一种电路提示编程语言
CPPL是一个编译器中介框架,通过使用Python领域特定语言和基于JSON的中间表示,连接大语言模型与硬件设计,从而实现可静态检查、可优化的RTL生成。
SBCO:面向规划智能体的自监督、基于验证器的框架优化
介绍了SBCO,一种面向规划智能体的自监督、基于验证器的框架优化器,它通过近似块坐标上升法改进智能体输出,以远少于自修改基线的计算量达到或超越其性能。
从提示到契约:面向可审计企业级LLM代理的约束工程
介绍了一种约束工程方法,用于构建可审计的企业级LLM代理,通过将确定性行为转移到代码、模式和验证工件中,并在韩国企业数据上通过故障注入和模型替换测试进行了演示。