
Anthropic이 장시간 실행되는 AI 에이전트의 새 청사진을 공개했습니다.
Anthropic이 장시간 실행되는 AI 에이전트용 하네스를 어떻게 설계하고 있는지 쉽게 정리한 영상입니다.
context reset, adversarial evaluation, planner-generator-evaluator 구조가 왜 필요한지 핵심만 빠르게 보실 수 있습니다.
- 장시간 실행 에이전트가 중간에 포기하거나 일을 끝냈다고 착각하는 이유
- context anxiety와 poor self-evaluation이라는 두 가지 대표 실패 패턴
- planner, generator, evaluator를 분리했을 때 품질이 좋아지는 방식
- Opus 4.6에서는 왜 하네스를 더 단순하게 가져갈 수 있었는지
- 실제 2D 게임 메이커와 브라우저 DAW 실험에서 확인된 설계 포인트
#Anthropic #AIAgents #Claude #AI자동화 #하네스설계 #ContextEngineering #개발 #AI
📎 관련 링크:
https://www.theaiautomators.com/?utm_source=youtube&utm_medium=video&utm_campaign=tutorial&utm_content=anthropic-harness-v2
https://www.anthropic.com/engi....neering/harness-desi
https://www.youtube.com/watch?v=I2K81s0OQto
https://github.com/theaiautoma....tors/claude-code-age
https://www.anthropic.com/engi....neering/effective-ha
https://www.anthropic.com/news/claude-opus-4-6
https://stripe.dev/blog/minion....s-stripes-one-shot-e


