기본 콘텐츠로 건너뛰기

효과적 테스트와 효율적 테스트 - 리스크 기반 테스팅

테스트 프로젝트의 경우 수많은 형태의 프로젝트가 존재하고 수많은 형태의 방법론이 적용되고 있는 것이 현실이다.

그 많은 프로젝트들을 일일이 나열하기는 힘들지만 대다수의 프로젝트들이 수행되는 형태를 본다면 크게 2가지를 생각해 볼 수 있다.

하나는 효과적 테스트이고 다른 하나는 효율적 테스트이다.

효과적 테스트는 말 그대로 테스트의 효과를 극대화 하는 것을 목적으로 하는 테스트이다. 즉, 결함을 많이 발견하거나 품질을 극대화 하는 방향으로 모든 테스트의 방향이 결정되는 테스트를 말한다.

이러한 유형은 공식적인 테스트 설계기법을 적용하고 커버리지 등의 매트릭으로 품질을 측정하며 여러 특정 분야의 전문가들이 테스트 프로젝트에 투입되게 된다.

결론적으로는 결함이 적은 제품이 출시되게 되겠지만 문제가 된다면 개발기간과 예산이 한없이 들어갈 수 있다는 것이다.

대표적인 예로는 의료, 항공, 우주 산업과 같은 경우를 들 수 있다.

반면 효율적 테스트는 시간과 예산을 절감하는 방향을 목적으로 하는 테스트 이다. 주변의 많은 프로젝트들이 겉으로는 효과적 테스트를 말하지만 실상은 효율적 테스트를 수행하는 곳들이 많은 것이 사실이다.

왜냐하면 테스트 프로젝트를 수행함에 있어서 예산과 시간은 항상 정해져 있는 경우가 많기 때문이다. 이렇게 정해진 예산과 시간마저도 다른 개발 일정과 예산에 따라 우선순위에서 뒤로 밀리는 경우도 다반사이다.

효율적 테스트의 가장 대표적인 방법은 테스트 자동화이다. 테스트 자동화는 시간을 넘어서 테스트 업계에서 가장 큰 이슈로 누구나 꿈꾸는 이상향이다.

하지만 테스트 자동화의 치명적인 약점이라면 살충제 페러독스이다. 테스트 자동화가 분명 효율적 테스트에 일부 기여하는 바는 있지만 그 유지보수에 있어서 오히려 효율이 떨어질 수도 있으며, 유지보수가 지속되지 않는다면 제품의 품질 또한 떨어질 수도 있다.

효율적 테스트의 또다른 부작용이라 한다면 일정과 예산에 따라 반드시 수행되어야 할 테스트가 생략되거나 계약직과 같은 비전문가들에 대한 테스트 수행 등으로 인해 신뢰성이 저하된다거나 테스트 결과를 신뢰할 수 없는 등의 부작용이 있을 수 있다.

이러한 효과적 테스트와 효율적 테스트는 반비례 관계에 있다.

즉, 효과적 테스트를 강조하다보면 테스트 프로젝트는 그만큼 비효율적이 되고 효율적인 테스트를 강조하다 보면 효과적 테스트를 소홀히 하게 된다.

이 두가지 유형의 테스트는 절대로 공존할 수 없는 것처럼 보인다.

실제로 많은 회사에서는 매번 이 두가지 유형의 테스트 사이에서 갈등하며 그때 그때마다 그 상황에 맞는 한쪽을 선택하게 된다.

이러한 선택이 아슬 아슬하게 맞아 떨어져 간다면 회사는 그럭저럭 유지되겠지만 어떤 포인트를 넘어서게 된다면 회사는 돌이킬 수 없는 타격을 받을 수 있고 그런 경우 회사가 망하는 경우도 있을 수 있다.

아래는 그러한 순환 논리를 간단하게 도식화 해 본 것이다. 실제의 경우에는 좀 더 구체적인 정황이 들어가겠지만 그다지 큰 차이는 없다고 생각한다.

그렇다면 과연 이 두가지 유형의 테스트 사이에서 시소게임을 하는 것만이 최선의 방법인 것일까? 다른 방법은 정말 없는 것일까?

적은 예산과 짧은 개발 기간동안 사용자가 원하는 좋은 품질의 제품을 개발할 수는 없는 것일까?

테스트 수행에 관한 수많은 방법론들이 위 질문에 대한 해답을 내놓기 위해 수많은 사례와 연구를 반복했었다.

그리고 그 중 가장 성공확률이 높고 이론적으로 완성도가 높은 방법론을 꼽는다면 리스크 기반 테스트를 추천해 줄 수 있다.

결론적으로 리스크 기반 테스팅은 리스크가 높은 곳은 효과적 테스트를 수행하고 리스크가 낮은 곳은 효율적 테스트를 수행하는 것을 말한다.

리스크에 따라 제한된 리소스를 적절하게 배분하고 각각의 목적을 다르게 설정함으로써 그 중도를 찾고자 하는 것이다.

즉, 사람들은 효과와 효율이 모두 높은 A 영역에 해당하는 방법을 찾고 있지만 실제적으로 그러한 방법은 없다고 볼 수 있다. 그러한 방법을 찾고자 하는 노력으로 인하여 갈등만 증폭되고 문제는 해결되지 않고 점점 더 어려워지는 것이다.

현실은 B와 D사이를 시소게임을 하는 것과 같이 진동하고 있는 것이다. 그리고 그러한 과정에서 많은 자원이 낭비되고 있고 조직과 회사 자체의 리스크는 항상 아슬아슬한 상태로 조절되고 있다.

어떤 회사들은 C 영역에서 머물면서 현실을 인식하지 못하는 곳들도 있다.

리스크 기반 테스팅은 제품의 리스크에 따라 두 영역을 모두 취함으로써 평형상태에 이르고자 하는 것이다. 리스크가 높은 곳에서는 B 영역의 방법을 리스크가 낮은 곳은 D 영역의 방법을 취하는 것이다.

하지만 이론적으로 완벽해 보이고 설득력이 있는 리스크 기반 테스트 역시 실무에 적용할 경우 많은 어려움이 있다.

대표적인 어려움만 생각해 본다면
  1. 리스크를 판별할 기준 선정(리스크 펙터)
  2. 리스크를 식별할 범위 선정(리스크 아이템)
  3. 리스크를 분석하는 사람들의 개인적인 수준차와 리스크 아이템에 대한 이해와 인식의 수준차
  4. 분석 및 협의에 들어가는 시간적인 지연
  5. 개발기간동안 변동되는 리스크에 대한 통제와 제어
등을 생각해 볼 수 있다.

하지만 실제적으로 리스크 기반 테스팅은 조직에서 그 수행이 체득화 될수만 있다면 현재까지 소개된 수많은 방법론 중에서는 가장 합리적인 방법론 중 하나인 것만은 의심의 여지가 없는 사실이라고 생각된다.

댓글

이 블로그의 인기 게시물

합성 사용자(Synthetic Users)의 5가지 유형과 AI 테스팅 현장에서의 활용법

AI와 생성형 모델 기술이 발전하면서, 사용자 경험(UX) 연구와 테스팅 현장에서 가상 퍼소나를 활용해 테스트 데이터를 수집하거나 사용성을 평가하려는 시도가 급격히 늘고 있습니다. 이를 흔히 '합성 사용자(Synthetic Users)'라고 부릅니다. 하지만 막연히 "AI에게 사용자 역할을 시켜 테스트를 돌린다"고 할 때, 그 가상 사용자가 어떤 방식과 데이터로 생성되었는지 명확히 구분하지 않으면 자칫 왜곡된 결과에 빠질 위험이 있습니다. UX 및 사용성 리서치 분야의 권위 있는 기관인 MeasuringU에서 이 합성 사용자의 개념을 명쾌하게 분류한 아티클을 공개했습니다. 바로 "What Are the Different Types of Synthetic Users?"라는 글입니다. (출처: MeasuringU - What Are the Different Types of Synthetic Users? / Jeff Sauro, PhD & Jim Lewis, PhD) https://measuringu.com/what-are-the-different-types-of-synthetic-users/ Jeff Sauro와 Jim Lewis 박사는 합성 사용자를 단순히 하나의 개념으로 뭉뚱그리지 않고, 생성 기술의 근거와 데이터 기반에 따라 크게 5가지 유형으로 깔끔하게 정리해 줍니다. 첫째는 규칙 기반(Rule-Based) 합성 사용자입니다. AI 모델이 아니라 사전 정의된 조건문, 정규식, 시나리오 스크립트에 따라 움직이는 전통적인 형태의 가상 사용자입니다. 예측 가능하고 정확하지만, 인간 사용자의 복잡한 정서나 미묘한 변수를 반영하진 못합니다. Selenium, Playwright, K6 같은 도구를 통해 지정된 경로대로 버튼을 누르고 데이터를 입력하는 방식을 들 수 있습니다. 둘째는 퍼소나 기반 LLM(Persona-Based LLM) 합성 사용자입니다. 생성형 AI에게 "너는 50대 비테크놀로지 사용...

AI 에이전트의 환각과 프롬프트 폭증을 막는 '컨텍스트 엔지니어링(Context Engineering)'과 아키텍처의 미래

AI 코딩 에이전트나 생성형 LLM을 소프트웨어 개발에 접목하는 시도가 늘어나면서, 엔지니어들이 마주하는 가장 큰 기술적 병목 중 하나는 바로 '컨텍스트(Context)'의 관리입니다. 저 역시 최근 AI와 바이브 코딩(Vibe Coding)을 활용해 여러 프로젝트를 진행하고 있는데, 하나의 대화창(세션)을 오래 켜둔 채 작업을 계속 이어가다 보면 AI가 초기 맥락을 잊어버리거나 이전에 지켜달라고 했던 제약조건을 놓치며 실수를 저지르는 경우를 자주 겪곤 합니다. 그래서 저는 목적별로 대화창을 명확하게 분리해서 작업하거나, 어느 정도 작업 단계가 진행되면 지금까지의 구현 내용과 의사결정을 요약 정리한 뒤 새 대화창에서 AI에게 이를 다시 학습시키는 방식으로 맥락을 관리하고 있습니다. 그렇다면 엔지니어링 아키텍처 차원에서는 이 문제를 어떻게 접근하고 있을까요? InfoQ의 발표 아티클 "Architecture / Context Engineering"에서는 바로 이 지점, 즉 단순한 프롬프트 엔지니어링을 넘어 시스템 아키텍처 수준에서 컨텍스트를 제어하는 '컨텍스트 엔지니어링(Context Engineering)'의 필요성과 구체적인 프레임워크를 다루고 있습니다. (출처: InfoQ - Architecture / Context Engineering) https://www.infoq.com/presentations/architecture-context-engineering/ 발표자들은 코딩 에이전트나 자율형 에이전트가 현장에서 실패하는 가장 큰 이유로 '비대해진 컨텍스트 윈도우(Bloated Context Windows)'와 무분별하게 채워진 프롬프트(Stuffed Prompts)를 꼽습니다. AI에게 너무 많은 정보를 한 번에 주면, 모델의 주의력(Attention)이 분산되거나 논리적 우선순위를 놓치는 현상이 발생합니다. 마치 인간 엔지니어에게 백과사전 수십 권을 던져주고 "이거 다 읽고 10초 ...

AI가 만들고 사람이 고친 글, 과연 'AI 생성물'일까? — 무너지는 경계선과 각국의 표기 가이드라인

이미지, 음성, 텍스트를 가리지 않고 생성형 AI의 산출물이 전 세계 디지털 공간에 폭포수처럼 쏟아져 나오고 있습니다. 가짜 뉴스, 딥페이크 오정보, 저작권 침해 등 여러 사회적 문제를 일으키면서, 최근 EU를 비롯한 세계 각국의 규제 기관들이 "AI가 만든 콘텐츠에는 반드시 표시(Labelling)를 하라"는 강제 가이드라인을 잇달아 꺼내 들고 있습니다. 이와 관련해 Smashing Magazine에 비탈리 프리드만(Vitaly Friedman)이 기고한 아티클은 EU의 최신 규제가 실무 인터페이스(UI/UX)에 어떤 변화를 요구하는지 잘 보여줍니다. (출처: Smashing Magazine - New EU Guidelines For AI Labelling / Vitaly Friedman) https://www.smashingmagazine.com/2026/08/eu-guidelines-ai-labelling/ EU AI Act 제50조 투명성 규정에 따르면, 딥페이크나 AI 챗봇 대화, 인간의 검수 없이 AI가 100% 작성한 공공 텍스트 등에는 전용 AI 마크나 암호화된 메타데이터(Watermark)를 반드시 내장해야 합니다. 기존에 서비스들이 유행처럼 쓰던 모호한 '반짝이 아이콘(✨ Sparkles)' 수준으로는 법적 기준을 충족할 수 없게 된 것입니다. 하지만 현장의 개발자, 에디터, 테스터들이 마주한 진짜 혼란은 규제의 유무가 아닙니다. 바로 "도대체 어디까지를 AI가 만들었다고 볼 것이며, 어디서부터를 사람이 만든 것으로 정의할 것인가?"라는 근본적인 경계선의 모호함입니다. 프롬프트 한 줄 던져서 AI가 뽑아낸 초안을 사람이 문장 몇 개 다듬었다면, 이것은 AI 산출물일까요, 인간의 글일까요? AI가 코딩한 1,000줄의 소스 코드를 엔지니어가 한 시간 동안 디버깅하고 검수했다면 이 코드의 주인은 누구일까요? 글로벌 규제 기관들도 이 모호함을 인지하고 명확한 자격 기준을 세우기 위해 격렬한 논의를 ...