Комплексне дослідження показує, що провідні AI-моделі для написання коду не мають універсальних переваг у безпеці, а їх ефективність суттєво змінюється залежно від використовуваного фреймворку. Командам слід оцінювати моделі на основі контекстуальних показників безпеки, а не вартості, оскільки більші витрати не гарантують створення безпечнішого коду.