Hugging Face · Daily Papers

SemaPLC:面向PLC代码生成的基于项目、验证门控的Agent框架

SemaPLC: A Project-Grounded, Verification-Gated Agent Harness for PLC Code Generation

Yanlun Tu, Huacan Wang, Ziyue Zhou, Jie Zhou, Ningyan Zhu, Ge Chen, Wangyi Chen, Tengfei Zhou 等 13 位
来自 Midea AI Research Center
二〇二六年八月二十日 · arXiv:2608.18565 · PDF · Code

可编程逻辑控制器(PLC)运行着工业工厂,而大型语言模型已经能够为它们生成独立的程序组织单元(POU)。然而,此类逻辑能否集成到现有PLC项目中并正确运行,此前仅在有限的测试中得到验证。我们提出SemaPLC,一个基于项目且以验证为门槛的代理框架,它由常规工具组装而成,但受严格完成规则的约束。SemaPLC并非在模型自行判断输出足够时停止,而是仅在记录的外部检查确认通过后才宣布任务完成。这些检查涵盖规格说明、编译过程以及实时运行时的行为表现。

在117个与现有基准匹配的独立POU任务上,SemaPLC在所有七个模型上取得了最高的严格验证通过率(平均72.6%)。在包含65个任务的项目上下文轨道中,生成的逻辑必须在真实项目内编译并运行,SemaPLC在集成编译、静态行为和动态行为方面均取得了最高平均值。在这三个层面中,动态行为最具揭示性。我们通过将生成的逻辑和参考逻辑部署到实时PLC运行时并比较其执行轨迹来测量动态行为。所有方法在静态得分上相差均在10个百分点以内,而动态得分则显著拉开差距,基线方法从22.4到31.4不等,而SemaPLC达到52.2。总体而言,我们的验证门槛框架在每个层面都提升了平均值,且在运行时提升最为显著。执行,而非静态评分,才是检验生成的控制逻辑是否真正有效的忠实标准。SemaPLC已在https://github.com/midea-ai/SemaPLC开源。

译自 Hugging Face · Daily Papers · arXiv:2608.18565 · 录于 二〇二六年八月二十日