Исследователи обнаружили, что объемные корпоративные регламенты не способны надежно регулировать работу автономных языковых моделей в профессиональной среде. Результаты показывают, что даже продвинутые модели часто игнорируют установленные правила и допускают ошибки в соблюдении инструкций при выполнении рутинных задач.