기본 콘텐츠로 건너뛰기

열린 카드 소팅

------------------------------------------------------------

1. 사용성 테스팅(Massive and Rapid Usability Testing)

 가. 사용성 테스팅의 정의

 나. Rapid Usbility Testing

 다. Massive Usability Testing vs. Rapid Usability Testing

2. 사용성 테스팅 계획(개발 수명주기에서의 사용성 테스팅)

 가. 사용성 테스팅은 언제 수행하나요?

3. 참가자 선정

 가. 사용성 테스팅에 얼마나 많은 참가자가 적당한가?

 나. 사용성 테스팅에서 사용자란 누구인가?

4. 사용성 테스팅 수행

 가. 사용자 테스팅
  - 사용자 테스팅 소개
  - 테스트 과제와 시나리오 작성
  - 관찰실
  - 테스트 진행
  - 회고 그리고 보고서
  - 체크리스트
  - 사용자 테스팅의 장점과 단점

 나. 카드 소팅
  - 카드 소팅 소개
  - 열린 카드 소팅

 다. 소원의 나무

5. 정리(?)

------------------------------------------------------------

무려 4개월만의 연재 재개입니다.

그동안 알게 모르게 바뻤다고 뻥칩니다.

이번 글은 카드소팅 2번째 시간 열린 카드 소팅에 대해서 소개해 드리겠습니다.

이번 글에 소개된 자료는 작년 12월 19일 워크샵을 통해 실제 진행된 내용을 기초로 하고 있습니다.

------------------------------------------------------------

먼저 열린 카드 소팅에 대해 알아보도록 하겠습니다.

열린 카드 소팅은 크게 2가지 방법으로 진행됩니다.

하나는 집단 지성을 활용하여 모두 모여 주어진 카드를 분류하며 그룹을 생성하는 방법이 있습니다.

다른 하나는 열린 카드 소팅에 참여한 각 사람이 자신만의 그룹을 생성하고 그 결과를 가지고 인지 거리 매트릭스를 만든 후 계층적 군집 분석을 통해 적합도 매트릭스를 산출하는 방식 또는 다차원 크기 조정 또는 MDS를 이용하여 분석하는 방식이 있습니다.

저는 일반적으로 각각의 사람들이 그룹을 생성하도록 한 후 계층적 군집 분석을 취하는 방법을 선호하는 편입니다.

가볍고 빠르고 즐겁게 하시기를 원하시면 여러명이 모여서 같이 그룹을 만드시는 것도 한 방법입니다.

다차원 크기 조정 또는 MDS를 이용하는 방법은 도구 가격도 가격이거니와 방법 자체가 난해한 부분이 있어서 저는 애용하지 않습니다. 디자이너 분들이라면 하실 수 있겠지만 저는 테스터이기 때문에 이정도로 깊은 내용까지 다루지는 않겠습니다.

우선 카드 소팅을 진행하기 위해 참가자들에게 아래 30개의 카드를 배포했습니다.



위 카드들은 http://sten.or.kr 의 실제 메뉴들 중 일부분입니다.

이번 오프 카드 소팅에는 6분의 참가자가 참여하였습니다.

아래는 6명의 참가자 각각의 결과를 토대로 만들어진 인지거리 매트릭스입니다.



인지거리 매트릭스를 만드는 방법은
  • 참여자가 같은 그룹에 카드를 넣는 경우 1점을
  • 참여자가 다른 그룹에 카드를 넣는 경우 0점을
주면 됩니다.

즉, 위 인지거리 매트릭스에서 1번 카드와 2번 카드는 6명의 참가자 모두가 같은 그룹에 카드를 넣었다는 뜻입니다.

반면 1번 카드와 4번 카드를 같은 그룹에 넣은 사용자는 없습니다.

이렇게 전체 거리 매트릭스가 완성이 되면 다음에는 계층적 군집 분석입니다.

계층적 군집 분석을 정확히 수행하기 원하신다면 도구를 사용하시는 방법이 편합니다.

실제 이 작업을 사람이 수작업으로 할 경우 매우 힘들고 지난한 작업입니다.

저는 테스트를 위해서 전체적인 맥락을 파악하는 용도록 사용하기 때문에 디자이너들처럼 정교한 작업까지는 수행하지는 않습니다.

아래는 위 전체 거리 매트릭스를 기초로 만들어진 계층적 군집 분석 결과입니다.



6점 부터 0점까지 각각에 대하여 수직면을 취하고 각각에 해당하는 카드를 모아서 그룹을 생성하는 작업입니다.

계층적 군집 분석은 참여자들이 같은 그룹에 넣은 카드들을 서로 가깝게 놓아서 트리 다이어그램을 만드는 작업입니다.

저는
  • 1번, 2번 5번을 같은 그룹으로
  • 11, 13, 21, 22번을 같은 그룹으로
  • 8번, 23, 24번을 같은 그룹으로
  • 26번, 27번을 같은 그룹으로
총 4개의 그룹을 생성했습니다.

그 위로 각각에 대하여 그룹을 생성하였습니다.

이러한 계층적 군집 분석에서 알고자 하는 것은 각각의 카드가 가지고 있는 연관성과 그 연관성에 따라 카드들이 서로 결합하는 지점을 살펴보고자 하는 것입니다.

이러한 트리 다이어그램은 웹사이트의 구조를 설계할 때 매우 유용하게 사용됩니다.

이러한 트리 다이어그램이 완성되고 나면 그 다음에 하는 작업은 계층적 군집 분석 결과와 참가자 각각에 대한 결과를 비교하거나 실제 사이트와 비교하여 적합도를 구하는 것입니다.

예를 들면, 계층적 군집 분석 결과 4개의 그룹이 생성되었는데 실제 사이트에서는 2개의 그룹만 일치한다면 적합도는 50%가 될것입니다.

이러한 적합도 수치를 토대로 사용성을 개선하는 작업에 대한 결정을 내리기도 하고 여러 결정들에 대한 기초 데이터로 활용하기도 합니다.

그리고 이렇게 도출된 오픈 카드 소팅 결과를 재검증하기 위해서 특정한 경우 닫힌 카드 소팅을 진행하기도 합니다.

다음 시간에는 닫힌 카드 소팅에 대해서 소개해 드리도록 하겠습니다.

해서 조만간 실제로 닫힌 카드 소팅을 진행하는 워크샵을 진행하고 해당 워크샵 내용을 추가하도록 하겠습니다.

관심 있으신 분들은 나중에 워크샵이 진행된다면 많이 참여해주시면 좋겠습니다.

댓글

이 블로그의 인기 게시물

피드백 루프: AI 시대 테스터가 지켜내야 할 핵심 엔진

소프트웨어 개발과 테스팅 현장에서 가장 자주 언급되지만, 막상 시스템이 복잡해질수록 쉽게 경시되곤 하는 핵심 개념이 바로 '피드백 루프(Feedback Loop)'입니다. 코드를 수정하고, 빌드하고, 테스트 결과를 확인하고, 다시 개선하는 그 순환 과정의 속도와 정확도가 결국 소프트웨어의 품질을 결정짓기 때문입니다. 품질 전문가 매슈 하이저(Matthew Heusser)가 자신의 블로그 Quality Remarks에 기고한 "One Loop After Another" 아티클은 바로 이 피드백 루프의 다층적 구조와, AI 시대에 우리가 놓치지 말아야 할 품질 검증의 본질을 날카롭게 되짚어 줍니다. (출처: Quality Remarks - One Loop After Another / Matthew Heusser) https://qualityremarks.com/one-loop-after-another/ 매슈 하이저는 소프트웨어 개발 생태계가 단순히 하나의 커다란 테스트 루프로 돌아가는 것이 아니라, 시간 축과 관점에 따라 겹겹이 쌓인 '연쇄적인 피드백 루프들(One Loop After Another)'로 이루어져 있다고 설명합니다. 초단기 루프 (Inner Loop): 개발자가 코드를 작성하는 몇 초~몇 분 단위의 루프입니다. 단위 테스트(Unit Test)나 IDE의 Linter, AI 자동 완성이 즉각적인 피드백을 주는 영역입니다. 단기 루프 (Daily / CI Loop): 커밋과 푸시가 이루어지고, CI/CD 파이프라인에서 통합 테스트와 정적 분석이 실행되는 몇 시간 단위의 루프입니다. 중기 루프 (Iteration / Exploration Loop): 스프린트 단위로 탐색적 테스팅(Exploratory Testing)을 수행하고, 실제 사용자 시나리오나 엣지 케이스를 사람이 직접 검증하며 시스템의 유기적 작동을 확인하는 며칠~몇 주 단위의 루프입니다. 장기 루프 (Outer / Market Loop): 실제 ...

에이전틱 AI 프로젝트에서 테스터의 5가지 핵심 원칙

AI 코딩 에이전트와 자율형 에이전트가 빠르게 개발 워크플로우에 통합되면서, 단순히 코드를 잘 짜는 것을 넘어 '에이전트와 어떻게 협업하고 통제할 것인가'가 개발자와 아키텍트들의 가장 큰 화두로 떠올랐습니다. 윤석찬 님의 아티클 "AI 에이전트 시대, 개발자는 어떻게 일해야 하는가? – 프론티어 엔지니어링의 10가지 원칙"은 에이전틱 AI 시대에 엔지니어가 마주하는 패러다임 변화와, 실무 현장에서 일하는 방식을 어떻게 재정의해야 하는지 아주 명확한 가이드라인을 제시해 줍니다. (출처: channy.creation.net - 윤석찬 님의 블로그) https://channy.creation.net/blog/1989 비록 대규모 에이전트 오케스트레이션이나 초거대 인프라 시스템을 개인이 직접 구축하고 운용하는 것은 비용적·기술적으로 현실적인 한계가 있습니다. 하지만 개인 프로젝트에서 AI와 바이브 코딩(Vibe Coding)을 활용하며 겪었던 맥락 손실, 환각, 통제 불능의 경험들을 떠올려보면, 이 아티클이 제시하는 10가지 프론티어 엔지니어링 원칙은 소규모 개인 개발 환경에서도 대단히 깊은 공감을 불러일으킵니다. 이 글은 단순히 "AI 도구를 잘 쓰자"는 수준에 머무르지 않습니다. AI 에이전트가 생성해내는 불확실성 속에서 인간 엔지니어가 시스템의 맥락을 주도하고, 오작동을 제어하며, 품질의 키(Steering Wheel)를 쥐기 위한 구조적 사고법을 다룹니다. 그렇다면 프론티어 엔지니어링의 원칙을 바탕으로, 시스템의 신뢰성과 안전성을 검증해야 하는 테스터는 과연 어떤 실무 원칙을 세워나갈 수 있을까요? 윤석찬 님이 제시한 엔지니어링 원칙을 테스팅 관점으로 재해석해 보면, 다음과 같은 5가지 원칙으로 정리할 수 있을 것 같습니다. 1. 결정론적 검증에서 '경계선 및 허용 오차(Boundary)' 테스팅으로 전환하라 에이전트 기반 시스템은 같은 입력을 주어도 매번 다른 추론 경로를 거치는 확률적(Stoc...

결국 테스팅은 어렵다

 AI 코딩 에이전트와 대형 언어 모델(LLM)이 코드를 순식간에 쏟아내고 테스트 스크립트까지 자동으로 만들어주는 시대가 되면서, 일각에서는 "이제 테스팅도 버튼 하나 누르면 끝나는 쉽고 단순한 일 아닌가?"라는 착각에 빠지곤 합니다. 하지만 품질 전문가 매슈 하이저(Matthew Heusser)가 자신의 블로그 Quality Remarks에 기고한 "Turns Out Testing is Hard" 아티클은, 기술이 아무리 화려하게 발전하더라도 소프트웨어의 '진짜 품질'을 검증하는 일은 여전히 지독하게 어렵고 복잡하다는 현실을 서늘하게 되짚어 줍니다. (출처: Quality Remarks - Turns Out Testing is Hard / Matthew Heusser) https://qualityremarks.com/turns-out-testing-is-hard/ 이 아티클이 말하는 핵심은 간단합니다. 단순한 스크립트 실행이나 표면적인 기능 작동 여부를 확인하는 '체크(Checking)'는 AI나 도구를 통해 얼마든지 자동화하고 속도를 높일 수 있지만, 시스템의 숨겨진 리스크를 탐색하고 비판적으로 질문을 던지는 '진짜 테스팅(Testing)'의 난이도는 오히려 이전보다 더 올라갔다는 점입니다. AI 코딩 에이전트가 단 몇 초 만에 수백 줄의 코드를 생성을 해내면서 당장 눈앞의 기능은 돌아가는 것처럼 보입니다. 하지만 그 이면에서는 오작동이 일어날 수 있는 엣지 케이스, 시스템 간의 미묘한 맥락 단절, 그리고 나중에 거대한 장애로 돌아올 인지부채가 순식간에 쌓여갑니다. 매슈 하이저는 왜 테스팅이 여전히 지독히 어려운 과제로 남아있는지 몇 가지 근본적인 이유를 제시합니다. 첫째, '모호함과의 싸움'입니다. 소프트웨어 요구사항은 언제나 비어있는 행간과 모호함을 품고 있습니다. AI는 주어진 텍스트 그대로 명시적인 조건만 테스트하지만, 실제 인간 테스터는 명시되지 않은 사용...