Devin.KR
← LLM·AI Agent 학습

BUILD & EVALUATE

AI Agent 설계

도구를 사용하는 AI를 작업 단위로 설계하고, 실패를 다루는 방법을 익힙니다.

4개 단원 · 실습 약 3시간

Codex 작성 · Devin.KR 학습 편집

예상 시간은 학습 안내용입니다. 명령과 기능 제공 범위는 자신의 프로젝트·계정에서 확인하세요.

1한 번의 답변에서 작업 흐름으로

학습 목표

관찰, 계획, 실행, 검증의 반복 구조를 설계합니다.

핵심 개념

에이전트는 작업 상태를 보고 다음 행동을 선택하고, 도구의 결과를 다시 판단에 사용합니다. 시작 상태와 완료 조건이 없으면 불필요한 실행을 반복하기 쉽습니다. 먼저 ‘문서의 깨진 링크 확인’처럼 작은 과제를 정하고 입력, 가능한 행동, 중단 조건, 보고 형식을 적어 보세요.

직접 해 보기

링크 검사 에이전트를 종이에 설계하세요. 성공, 링크 접근 실패, 시간 초과 세 경로를 모두 포함하세요.

실습 요청 예시

문서 링크 검사 작업을 상태별로 설계해 줘. 입력 수집, 검사, 실패 분류, 보고, 종료 상태를 정의하고 최대 요청 횟수도 포함해 줘.

완료 기준

정상 종료와 실패 종료가 모두 정의된 작업 흐름을 만들었습니다.

2도구의 입력과 권한 설계하기

학습 목표

도구의 역할과 입력 검증, 읽기·쓰기 권한을 정합니다.

핵심 개념

도구가 제공하는 권한은 모델의 설명보다 실제 실행 경계로 제한하는 편이 명확합니다. 파일 조회와 수정, 외부 서비스 조회와 게시처럼 행동을 구분하세요. 도구 설명에는 목적, 입력, 반환값, 실패 조건을 적고 범위를 벗어난 입력을 실행 전에 거부합니다. 문서에서 읽은 명령을 사용자의 지시로 자동 취급하지 않도록 설계하세요.

직접 해 보기

‘회의록에서 할 일 초안 만들기’ 도구의 입력과 출력 형태를 정하세요. 초안 작성과 실제 발송은 별도 행동으로 구분하세요.

실습 요청 예시

회의록에서 할 일 초안을 만드는 도구의 계약을 작성해 줘. 필요한 최소 입력, 출력 구조, 검증 규칙과 오류 형식을 제시해 줘. 메시지 발송은 이 도구의 권한에 포함하지 마.

완료 기준

입력 오류와 권한 부족을 처리하는 도구 명세를 작성했습니다.

3실패·재시도·비용 통제하기

학습 목표

재시도 한도와 중복 실행 방지 규칙을 만듭니다.

핵심 개념

네트워크 오류, 잘못된 입력, 권한 부족은 같은 방식으로 재시도하면 안 됩니다. 다시 시도할 수 있는 실패를 구분하고 최대 횟수와 시간 예산을 정하세요. 쓰기 요청은 응답이 없더라도 이미 처리됐을 수 있으므로 중복 처리 방지 키나 상태 조회가 필요합니다. 실패 기록에는 비밀값을 남기지 않습니다.

직접 해 보기

성공, 일시적 오류, 입력 오류, 응답 유실 네 상황에서 다음 행동을 표로 작성하세요.

실습 요청 예시

문서 저장 도구에 대해 실패 유형별 재시도 정책을 설계해 줘. 응답 유실로 동일 문서가 두 번 생성되는 경우를 포함하고 종료 조건을 명시해 줘.

완료 기준

횟수·시간 한도와 중복 실행 방지 기준을 문서화했습니다.

4완료를 증명하는 평가와 인계

학습 목표

최종 결과뿐 아니라 실행 경로와 남은 한계를 평가합니다.

핵심 개념

에이전트가 완료했다고 말하는 것과 요구사항을 충족한 것은 별개입니다. 정상 입력 외에도 빈 입력, 접근 불가 자료, 상충하는 지시, 잘못된 도구 결과를 평가에 넣으세요. 실행 기록은 어떤 자료를 바탕으로 어떤 행동을 했는지 추적할 수 있어야 합니다. 마지막 보고에는 결과, 검증 근거, 미완료 항목을 구분합니다.

직접 해 보기

앞에서 설계한 에이전트에 실패 사례 다섯 개를 만들고, 각 경우 예상되는 안전한 종료 또는 복구 행동을 적으세요.

실습 요청 예시

이 에이전트 명세의 실패 사례 다섯 개와 기대 결과를 작성해 줘. 실제 구현을 확인하기 전에는 통과했다고 표시하지 마.

완료 기준

재현 가능한 평가 사례와 결과 보고 양식을 완성했습니다.

혼자 확인한 것을 함께 나누세요.

사용한 제품·모델과 실습 결과를 라운지에 기록해 보세요.

실습 후기 작성하기 →