SemaPLC testet PLC-Code-Agenten mit Live-Laufzeitprüfungen
Das Testsystem verifiziert generierte PLC-Logik anhand von Spezifikationen, Kompilierung und Verhalten im Einsatz.
Warum es wichtig ist
Die Arbeit verlagert die Bewertung von PLC-Code von isolierter Generierung hin zu Integration und Laufzeitverifikation, was dem industriellen Einsatz näherkommt. Sie zeigt außerdem, dass Prüfungen des dynamischen Verhaltens Probleme aufdecken können, die Kompilierung oder statische Tests möglicherweise übersehen.
Die Kernpunkte
- 1.SemaPLC verlangt externe Prüfungen, bevor PLC-Code-Aufgaben als abgeschlossen gelten.
- 2.Bei unabhängigen POU-Aufgaben erreichte es eine mittlere verifizierte Erfolgsquote von 72,6 %.
- 3.Das dynamische Laufzeitverhalten war die aufschlussreichste Bewertungsebene.
Forscher haben SemaPLC vorgestellt, ein projektbezogenes, verifikationsgesteuertes Agenten-Testsystem für die Generierung von PLC-Code. Das System markiert eine Aufgabe erst dann als abgeschlossen, wenn protokollierte externe Prüfungen Spezifikation, Kompilierung und Verhalten auf einer Live-PLC-Laufzeitumgebung bestätigen. Bei 117 unabhängigen POU-Aufgaben erreichte SemaPLC über sieben Modelle hinweg eine mittlere streng verifizierte Erfolgsquote von 72,6 % und erzielte in einem 65-Aufgaben-Track mit Projektkontext die besten Durchschnittswerte bei integrierter Kompilierung, statischem Verhalten und dynamischem Verhalten.
⚡ Heute ausprobieren
Nutzen Sie Live-Laufzeitvergleiche von Traces, wenn Sie von LLMs generierte PLC-Logik für reale Projekte bewerten.
Quellen & Originalberichte
Dieser Brief fasst die Berichterstattung der folgenden Medien zusammen und verlinkt sie.
Hat dir dieses Briefing gefallen? Erhalte das nächste per Mail.
Mehr in Forschung
Startup sieht Daten als Schlüssel für Fortschritte bei KI gegen Krebs
TechCrunch berichtet, das Startup argumentiere, KI sei ohne bessere Daten noch nicht kurz davor, Krebs zu heilen.
HarnessRisk bewertet Sicherheitsversagen in Agent-Harnesses
Der Benchmark testet Angriffe über verschiedene Phasen von Agent-Harnesses hinweg, während verwandte Arbeiten aufgabenspezifische Bereitstellung untersuchen.
Agent Lightning v1.0 zielt auf agentisches RL mit Harness ab
Das Framework verbindet beliebige Agent-Harnesses mit Post-Training per Reinforcement Learning.