Thoughtworks описала harness, среду с ограничениями инструментов, границами контекста и автоматической обратной связью для агентов, пишущих код. По мнению авторов, harness превращает возможности модели в безопасный, надёжный и проверяемый процесс поставки ПО.
В этой схеме guides направляют агента до того, как он начнёт действовать, а sensors проверяют результат после действия. К guides авторы относят инструкции, задающие область работы, инструменты с минимальными правами и явные решения вместо догадок.
Sensors используют модульные тесты, линтеры, статические проверки типов и архитектурные правила. Человеческое подтверждение авторы предлагают оставлять для необратимых или затрагивающих много систем решений, например изменений схемы или публичного API.
Проверка утверждений:
- Thoughtworks описала harness как среду с ограничениями инструментов, границами контекста и автоматической обратной связью для агентов, пишущих код. (подтверждено самой публикацией: доказательство; «harness engineering supplies the structured environment, tool constraints, context boundaries and feedback loops that transforms raw intelligence into a safe, reliable and auditable delivery system.»)
- По мнению авторов, harness превращает возможности модели в безопасный, надёжный и проверяемый процесс поставки ПО. (подтверждено самой публикацией: доказательство; «harness engineering supplies the structured environment, tool constraints, context boundaries and feedback loops that transforms raw intelligence into a safe, reliable and auditable delivery system.»)
- В этой схеме guides направляют агента до того, как он начнёт действовать, а sensors проверяют результат после действия. (подтверждено самой публикацией: доказательство; «Guides (Pre-action steering): Mechanisms that constrain and direct the agent before it takes action or writes code. 2. Sensors (Post-action verification): Automated feedback loops that inspect and validate the output after the agent acts.»)
- К guides авторы относят инструкции, задающие область работы, инструменты с минимальными правами и явные решения вместо догадок. (подтверждено самой публикацией: доказательство; «Effective guidance relies on four core patterns: Scoped instructions and progressive disclosure Least-privilege tools Explicit defaults instead of guesses»)
- Sensors используют модульные тесты, линтеры, статические проверки типов и архитектурные правила. (подтверждено самой публикацией: доказательство; «Sensors wrap standard software engineering checks like unit tests, linters, static type checkers and architecture rules into the agent loop.»)
- Человеческое подтверждение авторы предлагают оставлять для необратимых или затрагивающих много систем решений, например изменений схемы или публичного API. (подтверждено самой публикацией: доказательство; «human confirmation gates are reserved for irreversible or high-blast-radius choices, such as multi-repository scope changes, schema migrations or public API modifications.»)
Первоисточники:
оценка 52,6 из 100 · тип: руководство