Microsoft, yapay zekâ ajanlarının hangi noktalarda hata yaptığını ölçmek için run-assert-eval adlı açık kaynaklı bir araç yayımladı.
Sistem, bir ajanın karşılaşabileceği riskleri belirliyor, hataların ne sıklıkla oluştuğunu ölçüyor ve bu bulgulara göre çalışma sırasında uygulanabilecek güvenlik kuralları oluşturuyor. Microsoft, aracın ardından aynı testleri yeniden çalıştırarak yapılan düzeltmenin gerçekten işe yarayıp yaramadığını da doğrulayabildiğini belirtiyor.