기본 콘텐츠로 건너뛰기

테스트 케이스 딜레마

소프트웨어 테스트를 하면서 제일 어려운 것이 무엇일까요?

이 질문보다 어리석은 질문이 또 있을까? 싶군요.

사실 테스트를 수행하는 것 자체가 어렵고 그와 관련된 모든 것들이 어느 하나 쉬운 것이 없는것이 현실입니다.

저는 그 중에서 테스트 케이스에 대한 이야기를 하려고 합니다.

소프트웨어 테스트는 계획 분석/설계 수행 리포팅 마감활동의 순서로 진행되지만 실상 현업에서 가장 주된 단계는 대체로 수행 쪽입니다.

그런데 테스트를 수행하려면 어디서부터 어디까지 어느 정도의 강도록 어쩐 절차를 거쳐서 수행을 해야하는지에 대한 정의가 필요합니다.

이 정의를 담고 있는 문서가 바로 테스트 케이스라고 할 수 있습니다.

그런데, 이 테스트 케이스는 만드는 것부터가 참 쉽지 않습니다.

우선 결함의 판단 기준이 되고 테스트 케이스 작성의 소스가 되는 테스트 베이시스가 없거나 취득하기 어려운 경우가 태반입니다.

다음으로는 테스트 케이스를 만드는 법을 모르는 경우가 부지기 수입니다. 물론 경험적으로 동등분할, 경계값 분석같은 간단한 기법들은 아시는 분들이 많지만 체계적으로 테스트 베이시스나 제품을 분석해서 테스트 케이스를 도출하는 설계 기법에 대해서 알고 있거나 현업에 적용하고 계신 분들이 중소기업을 기준으로 본다면 많지 않습니다.

그러다보니 어쩌다 만든 테스트 케이스도 도무지 확신이 없습니다.

그리고 이제 막 테스트 설계 기법을 배우신 분들이 가장 많이 하시는 실수 중 하나는 설계 기법을 은총알로 생각하신다는 점입니다.

그런데.. 사실 테스트 케이스로 테스트의 충분함을 논하는거 자체가 우스울 정도로 테스트 케이스를 잘 만들어서 수행하는것만으로 테스트가 충분하다고 말할 수가 없다는게 또 현실입니다.

그리고 테스트 케이스를 설계 기법을 적용하여 제대로 만들면 테스트 분량이 줄어드느냐? 절대 아니죠. 일반적으로 테스트 분량이 정말 눈물 쏙 나도록 늘어납니다.

그러다보니 현업에서는 그냥 옛날에 하던 테스트 방법이 더 좋았어.. 라며 테스트 설계 기법 적용을 포기하는 경우도 생깁니다.

또한 실무에서 테스트 케이스를 잘 안만들게 되는 경우는 유지보수가 정말 육두문자가 튀어나올정도로 쉽지 않다는 점입니다.

자.. 이쯤에서 제가 말하고자하는 테스트 케이스 딜레마는 아래와 같습니다.

1. 뽀대나게 테스트를 하려면 테스트 설계 기법으로 테스트 케이스를 만들고 싶은데.. 설계 기법이 먼가요?

2. 테스트는 얼마나 하면 충분한건가요? 이거 기준이 먼가요?

3. 설계 기법으로 테스트 케이스를 만들면 테스트 케이스가 줄어든다고 하던데.. 뻥이었나봐요.. 오히려 늘어나서 죽을거 같아요.

4. 테스트 케이스를 친절하게 상세하게 만들었더니 유지보수 하려니 미칠거 같아요.

5. 테스트 케이스를 안만들고 테스트 하려니 테스트에 확신은 안생기고 만들어서 하려니 시간이 허락하지를 않아요. 우리 회사는 분석이나 설계는 고려해주지 않아요.

6. 테스트 케이스 그거 꼭 만들어야 하나요? 그거 안만들고 테스트 해도 결함 잘 발견되고 제품 출시해서 큰 문제 없었는데요.

이외에도 현업에서는 테스트 케이스에 대한 여러 의견과 논란이 있습니다.

여러분은 이러한 문제들, 딜레마에 대해 어떤 해법을 가지고 계신가요?

저는 대체로 테스트 케이스를 문서화하지 않는 편입니다.

만들지 않는 것이 아니라 인터넷에 떠도는 그런 흔한 형식의 테스트 케이스를 잘 만들지 않습니다.

왜냐하면 사전 조건, 진행 절차, 기대결과, 실제 결과 등등 여러 필드로 구성된 엑셀이나 테스트 링크와 같은 도구를 사용하여 작성된 표 형식의 테스트 케이스는 대체로 보기가 힘들고 전체를 파악하기가 쉽지 않습니다.

유지보수도 어렵습니다.

그래서 저는 대체로 그림을 그리는 편입니다. 그리고 상세한 테스트 케이스는 결함보고서에 집어 넣습니다.

그리고 체크리스트를 많이 활용합니다.

벽 한쪽에 커다란 전지를 붙이고 전체 기능들과 테스트 데이터, 사전 조건등을 깨알같이 그려놓고 한쪽부터 차근 테스트를 하면서 지워나가는 방식을 선호합니다.

설계기법 추종론자들은 그래서 저를 별로 좋아하지 않습니다.

특히 문서화가 잘 되지 않아서 더 좋아하지 않습니다.

하지만 전 설계기법이나 문서화보다 더 중요한 것은 빠진것 없이 중요한 부분부터 꼼꼼하게 테스트를  하는 것이라고 생각합니다.

여러분은 테스트 케이스를 설계해서 만들고 계신가요?

만들고 계시다면 어떻게 만들고 계신가요?

유지보수는 어떻게 하고 계신가요?

테스트 케이스에 대한 경험만 공유하더라도 하루짜리 워크샵이나 컨퍼런스도 거뜬할 거라고 생각됩니다만.. 아직 그런 행사를 보지는 못했습니다.

여러분도 여러분들만의 경험을 공유해주시면 좀 더 좋은 세상이 될거라고 생각합니다.

댓글

이 블로그의 인기 게시물

AI 에이전트의 환각과 프롬프트 폭증을 막는 '컨텍스트 엔지니어링(Context Engineering)'과 아키텍처의 미래

AI 코딩 에이전트나 생성형 LLM을 소프트웨어 개발에 접목하는 시도가 늘어나면서, 엔지니어들이 마주하는 가장 큰 기술적 병목 중 하나는 바로 '컨텍스트(Context)'의 관리입니다. 저 역시 최근 AI와 바이브 코딩(Vibe Coding)을 활용해 여러 프로젝트를 진행하고 있는데, 하나의 대화창(세션)을 오래 켜둔 채 작업을 계속 이어가다 보면 AI가 초기 맥락을 잊어버리거나 이전에 지켜달라고 했던 제약조건을 놓치며 실수를 저지르는 경우를 자주 겪곤 합니다. 그래서 저는 목적별로 대화창을 명확하게 분리해서 작업하거나, 어느 정도 작업 단계가 진행되면 지금까지의 구현 내용과 의사결정을 요약 정리한 뒤 새 대화창에서 AI에게 이를 다시 학습시키는 방식으로 맥락을 관리하고 있습니다. 그렇다면 엔지니어링 아키텍처 차원에서는 이 문제를 어떻게 접근하고 있을까요? InfoQ의 발표 아티클 "Architecture / Context Engineering"에서는 바로 이 지점, 즉 단순한 프롬프트 엔지니어링을 넘어 시스템 아키텍처 수준에서 컨텍스트를 제어하는 '컨텍스트 엔지니어링(Context Engineering)'의 필요성과 구체적인 프레임워크를 다루고 있습니다. (출처: InfoQ - Architecture / Context Engineering) https://www.infoq.com/presentations/architecture-context-engineering/ 발표자들은 코딩 에이전트나 자율형 에이전트가 현장에서 실패하는 가장 큰 이유로 '비대해진 컨텍스트 윈도우(Bloated Context Windows)'와 무분별하게 채워진 프롬프트(Stuffed Prompts)를 꼽습니다. AI에게 너무 많은 정보를 한 번에 주면, 모델의 주의력(Attention)이 분산되거나 논리적 우선순위를 놓치는 현상이 발생합니다. 마치 인간 엔지니어에게 백과사전 수십 권을 던져주고 "이거 다 읽고 10초 ...

AI의 UX, 단 5개 문항으로 측정하는 방법: SUXAI

테스트 관리에는 아주 유명한 명언이 있습니다. 어쩌면 이 말은 테스트 관리에서만 유용한 얘기는 아닐거고.. 어쩌면 여러분도 다른 곳에서 들었을 수도 있습니다. "측정할 수 없으면 개선할 수 없다" 지난 글(https://murianwind.blogspot.com/2026/07/ai_01010698011.html)에서 생성형 AI 시대에는 기존의 일반적인 사용성 지표(SUS 등)만으로는 부족하며 정확성, 신뢰성, 설명 가능성, 제어 가능성이라는 AI 에 특화된 품질 특성이 필요하다고 정리해 드린 바 있습니다. 하지만 실무자의 입장에서 항상 부딪히는 현실적인 고민이 있습니다. "이론은 좋은데, 당장 매주 업데이트되는 AI 기능의 UX를 바쁜 현장에서 어떻게 빠르고 정량적으로 측정할 것인가?"라는 점이죠. MeasuringU에서 이에 대한 명확하고 실용적인 해답을 제시하는 후속 아티클을 공개했습니다. 바로 "Streamlined Measurement of the UX of AI"입니다. (출처: MeasuringU - Streamlined Measurement of the UX of AI / Jeff Sauro, PhD & Jim Lewis, PhD) https://measuringu.com/streamlined-measurement-of-the-ux-of-ai/ Jeff Sauro와 Jim Lewis 박사는 실무 연구자들과 테스터들이 긴 설문이나 복잡한 프레임워크 없이도 AI 제품의 핵심 품질을 빠르게 측정할 수 있도록 SUXAI(Streamlined UX of AI)라는 간소화된 측정 모델을 구축했습니다. 기존에 수많은 문항으로 분산되어 있던 지표들을 통계적 요인 분석을 통해 쥐어짜고 압축하여, 핵심적인 5가지 5점 척 문항 으로 표준화했습니다. SUXAI를 구성하는 5가지 핵심 평가 문항 정확성 (Accuracy): "이 AI가 생성한 결과물은 정확하다." 신뢰성 (Trust/Re...

합성 사용자(Synthetic Users)의 5가지 유형과 AI 테스팅 현장에서의 활용법

AI와 생성형 모델 기술이 발전하면서, 사용자 경험(UX) 연구와 테스팅 현장에서 가상 퍼소나를 활용해 테스트 데이터를 수집하거나 사용성을 평가하려는 시도가 급격히 늘고 있습니다. 이를 흔히 '합성 사용자(Synthetic Users)'라고 부릅니다. 하지만 막연히 "AI에게 사용자 역할을 시켜 테스트를 돌린다"고 할 때, 그 가상 사용자가 어떤 방식과 데이터로 생성되었는지 명확히 구분하지 않으면 자칫 왜곡된 결과에 빠질 위험이 있습니다. UX 및 사용성 리서치 분야의 권위 있는 기관인 MeasuringU에서 이 합성 사용자의 개념을 명쾌하게 분류한 아티클을 공개했습니다. 바로 "What Are the Different Types of Synthetic Users?"라는 글입니다. (출처: MeasuringU - What Are the Different Types of Synthetic Users? / Jeff Sauro, PhD & Jim Lewis, PhD) https://measuringu.com/what-are-the-different-types-of-synthetic-users/ Jeff Sauro와 Jim Lewis 박사는 합성 사용자를 단순히 하나의 개념으로 뭉뚱그리지 않고, 생성 기술의 근거와 데이터 기반에 따라 크게 5가지 유형으로 깔끔하게 정리해 줍니다. 첫째는 규칙 기반(Rule-Based) 합성 사용자입니다. AI 모델이 아니라 사전 정의된 조건문, 정규식, 시나리오 스크립트에 따라 움직이는 전통적인 형태의 가상 사용자입니다. 예측 가능하고 정확하지만, 인간 사용자의 복잡한 정서나 미묘한 변수를 반영하진 못합니다. Selenium, Playwright, K6 같은 도구를 통해 지정된 경로대로 버튼을 누르고 데이터를 입력하는 방식을 들 수 있습니다. 둘째는 퍼소나 기반 LLM(Persona-Based LLM) 합성 사용자입니다. 생성형 AI에게 "너는 50대 비테크놀로지 사용...