AWS는 2025년 8월 6일, Amazon Bedrock Guardrails의 Automated Reasoning Check 기능을 정식으로 출시했다고 발표했다. 이 기능은 AI가 생성하는 응답이 사전에 정의된 정책과 도메인 지식을 벗어나지 않도록 수학적 논리와 형식 검증(formal verification) 기법을 적용한다. 이를 통해 AI 환각(hallucination) 현상을 최소화하고, 특히 금융, 의료, 공공 등 규제가 엄격한 산업 환경에서 최대 99%의 검증 정확도를 제공할 수 있다.
기존의 AI 출력 검증 방식은 주로 확률적 접근법을 사용해 결과의 신뢰도를 추정했으나, Automated Reasoning Check는 논리적 규칙과 수학적 증명을 기반으로 결과의 정확성을 판별한다. 이 방식은 결과가 다의적으로 해석될 수 있는 경우 모호성 탐지(ambiguity detection) 기능을 지원해, 개발자가 정책을 개선하거나 AI 응답을 재작성하는 데 도움을 준다. 이러한 접근은 특히 규제 준수가 필수적인 환경에서 AI의 오작동 가능성을 사전에 차단하는 효과를 제공한다.
이번 출시를 통해 AWS는 다양한 신규 기능을 제공한다. 첫째, 최대 80K 토큰, 약 100페이지 분량의 대용량 문서를 단일 처리할 수 있어 방대한 정책 문서를 한 번에 변환하고 검증할 수 있다. 둘째, 정책 검증을 단순화해 저장된 테스트를 반복 실행함으로써 정책 변경 시에도 안정적으로 검증 절차를 유지할 수 있다. 셋째, 정의된 규칙으로부터 자동으로 테스트 시나리오를 생성해 초기 정책 품질 점검을 신속하게 수행할 수 있다. 넷째, 자연어 기반의 정책 변경 제안을 제공해 비전문가도 정책을 개선할 수 있도록 지원한다. 마지막으로, 검증 신뢰도 임계값을 사용자가 조정할 수 있어 상황에 맞는 검증 강도를 설정할 수 있다.
AWS는 이 기능의 활용 예시로 모기지 승인 정책을 제시했다. 은행 직원이 고객의 모기지 대출 적격 여부를 판단하는 과정에서, 다운페이먼트 비율, 신용 점수, 자금 출처 등 다양한 변수를 논리 규칙으로 변환하여 AI가 검토하도록 한다. 예를 들어, 다운페이먼트가 매매가의 20% 이상인 경우에만 일반 모기지가 가능하다는 규칙이나, 특정 자금 출처는 인정되지 않는다는 조건 등이 자동으로 적용된다. 테스트 시나리오를 자동 생성하고 실행한 결과, 모든 시나리오가 정책에 부합하는 것으로 나타났다.
산업별 활용 가능성도 높다. 금융권에서는 대출, 보험, 투자 자문 등에서 규제 준수 여부를 검증하는 데 적용할 수 있다. 제약·헬스케어 분야에서는 임상 데이터 분석과 치료 지침 준수 여부를 확인할 수 있으며, 공공 부문에서는 법령과 행정 절차를 자동으로 검증할 수 있다. 에너지·인프라 산업에서는 긴급 대응 계획과 프로토콜이 규정에 맞는지 실시간으로 점검하는 데 활용 가능하다.
기업 입장에서 Automated Reasoning Check의 도입은 여러 이점을 제공한다. 우선, AI 도입 시 필수적인 출력 검증 체계를 수학적으로 구현함으로써 신뢰성을 높일 수 있다. 둘째, 규제 준수에 필요한 검증 절차를 자동화해 컴플라이언스 리스크를 줄일 수 있다. 셋째, 반복적인 정책 검증 업무를 자동화하여 운영 효율성을 높인다. 넷째, Amazon Bedrock뿐만 아니라 OpenAI, Google Gemini 등 외부 모델에도 동일하게 적용 가능하다는 점에서 기술 확장성이 크다.
AWS와 협력한 PwC의 Matt Wood는 “규제가 엄격한 산업에서 AI의 잘못된 출력은 금전적 피해를 넘어 심각한 신뢰 손실을 초래할 수 있다”며, “AWS와의 협력을 통해 수학적으로 검증된 안전장치를 상용화함으로써 신뢰성을 확보했다”고 강조했다.
Automated Reasoning Check는 현재 미국 동부(오하이오, 버지니아 북부), 미국 서부(오리건), 유럽(프랑크푸르트, 아일랜드, 파리) 리전에서 사용할 수 있으며, 처리한 텍스트 양에 따라 과금된다. AWS는 이 기능을 Amazon Bedrock Guardrails의 다른 모듈인 콘텐츠 필터링, 컨텍스트 근거 확인 등과 함께 사용해 AI 안전성과 신뢰성을 한층 강화할 수 있다고 밝혔다.



















댓글
0