기본 콘텐츠로 건너뛰기

소극장을 만들어라. - 관찰실과 관찰자

------------------------------------------------------------

1. 사용성 테스팅(Massive and Rapid Usability Testing)

 가. 사용성 테스팅의 정의

 나. Rapid Usbility Testing

 다. Massive Usability Testing vs. Rapid Usability Testing

2. 사용성 테스팅 계획(개발 수명주기에서의 사용성 테스팅)

 가. 사용성 테스팅은 언제 수행하나요?

3. 참가자 선정

 가. 사용성 테스팅에 얼마나 많은 참가자가 적당한가?

 나. 사용성 테스팅에서 사용자란 누구인가?

4. 사용성 테스팅 수행

 가. 사용자 테스팅
  - 사용자 테스팅 소개
  - 테스트 과제와 시나리오 작성
  - 관찰실
  - 테스트 진행
  - 회고 그리고 보고서
  - 체크리스트
  - 사용자 테스팅의 장점과 단점

 나. 카드 소팅

 다. 소원의 나무

5. 정리(?)

------------------------------------------------------------

사용자 테스팅은 한편의 아름다운 연극과 같습니다.

하지만 아무리 아름다운 연극이라고 해도 지켜보는 관객이 없다면 의미가 없을 것입니다.

마찬가지로 사용자 테스팅과 진행자와 참가자 못지 않게 중요한 사람들이 관찰자들입니다.

여러분이 사용자 테스팅을 하실 때에는 되도록 많은 관찰자들을 부르시기 바랍니다.

관리자, 개발자, 디자이너, 편집자, 카피라이터, 사장님을 포함한 임원진 등 제품 개발에 관련된 사람들이라면 누구든지 상관없습니다.

되도록 많은 사람들을 부르기 위해 할 수 있는 모든 것을 하시기 바랍니다.

되도록 많은 사람들을 초대하기 위한 방법 중 아래와 같은 방법들은 좋은 효과가 있습니다.

1. 사장님을 포함한 임원진들을 모셔라!!
그렇습니다. 경영진이 잠깐이라도 참여를 하게 된다면 보다 많은 사람들이 테스트에 관심을 가지게 됩니다.
그리고 테스트를 무시하기 힘들게 됩니다.
경영진의 참석은 다른 사람들을 테스트에 참여하도록 설득하기 가장 쉬우면서도 가장 강력한 방법 중 하나입니다.
단점은 경영진의 참여를 이끌어내는 것이 어렵다는 것입니다.

2. 빵빵한 간식을 제공한다.
사람들은 은근히 먹을것에 취약합니다. 고급스런 간식과 점심을 보장한다면 많은 사람들이 올 수 있을 겁니다.
언제 만들었는지 모를 김밥이나 정성이라고는 눈꼽만치 없는 피자나 햄버거 보다는 커피 전문점의 상큼한 케익 한조각에 홍차 한잔의 간식은 천양지차입니다.

3. 사람들이 참여하기 쉬운 시간으로 정한다.
되도록이면 테스트 날짜를 그 주의 또는 그 달의 가장 한가한 시간으로 정하시기 바랍니다.
게임회사라면 업데이트가 몰리는 매월 말일과 같은 지옥과 같은 시간을 피하시기 바랍니다.

그 외에도 여러분이 생각할 수 있는 가능한 방법들을 동원하여 되도록 많은 사람들이 참여할 수 있도록 독려하시기 바랍니다.

그렇다면 사용자 테스팅에 참여하는 관찰자들은 어떤 일을 하게 될까요?

관찰자들이 하는 일은 간단합니다.

1. 참가자의 행동을 보고 참가자의 생각을 듣고 필요한 내용을 받아 적습니다.
2. 하나의 세션이 끝나고 나면 자신이 생각하는 가장 심각한 문제점 3개를 골라 적습니다.
3. 진행자가 참가자에게 했으면 하는 질문을 제안합니다.
4. 간신을 맛있게 먹습니다.
5. 회고를 위한 점심 식사에 참가합니다.

간단합니다. 이게 전부입니다.

관찰자로 초대하고 싶은 사람이 참가에 부담을 느낀다면 전혀 어려운 일은 없으며, 오셔서 맛있는 간식과 함께 연극 또는 영화 한편을 본다고 생각하시면 된다는 점을 강조하시면 됩니다.

아래는 관찰자들에게 제공하는 안내문 예시입니다.


다음은 관찰자들이 사용자 테스트를 관찰할 관찰실입니다.

관찰실은 일반적으로 회의실을 사용하시면 됩니다.

만약 참가하는 관찰자들이 정말 많다면 강당이나 소극장등을 사용하셔도 됩니다.

인터넷이 제공되고 빔 프로젝트가 있으며, 참가자의 음성을 들을 수 있는 곳이라면 어디든 상관 없습니다.

다만 한가지 고려할 점은 이전에도 얘기한 것처럼 테스트실과 관찰실이 물리적으로 같은 공간안에 있지 않도록 하는 것이 좋다는 것입니다.

이유는 여러가지가 있지만 참가자의 행동에 관찰자들이 소리내어 웃거나 비난하는 경우 참가자가 상처를 받을 수도 있으며, 많은 관찰자들은 참가자와 이야기 하기 위해 무던히도 애를 쓰기 때문입니다.

절대로 관찰실의 관찰자들이 테스트실의 위치를 알지 못하도록 해야하며, 두 공간이 같은 공간에 있지 않도록 주의하시기 바랍니다.

관찰실에는 다음과 같은 장비들이 구비되어야 합니다.

1. 인터넷 접속이 가능하고 화면 공유 소프트웨어가 설치된 컴퓨터
2. 빔 프로젝터(아니면 엄청 큰 텔레비젼)
3. 스피커(소리만 잘 나오면 됩니다. 5.1 채널 스피커 같은 고가의 장비는 있으면 좋겠지만 필수는 아닙니다.)
4. 빵빵한 간식!! (이것은 정말 중요한 것입니다. 베이글이나 머핀과 커핀 한잔이면 충분하다. 만약 관찰실에 있는 사람들이 즐겨 먹는 간식이 있다면 그것도 좋은 선택이 될 것입니다. Jolt Coke 한 캔이면.. 오우~~)
5. 스피커폰 또는 메신저(테스트실과 연락하기 위해서 필요합니다. 저는 화면 공유 소프트웨어가 같이 제공되는 스카이프를 즐겨 사용합니다.)

관찰실이 준비되었다면 이제 관찰실에서 관찰자들을 통제하고 안내하고 도와줄 관찰실 모니터링 요원이 필요합니다.

관찰실 모니터링 요원은 당신의 동료 중 가장 믿을만하고 친한 사람 중 한사람에게 부탁하시면 됩니다.

아래는 관찰실 모니터링 요원을 위한 안내문입니다.


위의 안내문에 적힌 내용 외에 관찰실 모니터링 요원이 수행해야할 가장 중요한 활동이 있습니다.

그것은 각 세션이 끝나고 관찰자들이 제출하는 가장 심각한 사용성 문제 3가지를 정리하는 작업입니다.

이 작업은 절대 간단한 작업이 아닙니다.

예를 들어 관찰실에 20명의 관찰자가 참여한다면 한 세션당 무려 60개의 사용성 문제가 제출될 것입니다.

이렇게 3개의 세션이 진행되면 전체 사용성 문제는 무려 180개나 됩니다. 이 많은 의견들을 취합하고 같은 내용을 분류하여 정리를 하는 일은 결코 간단하지 않습니다.

원활한 회고 진행을 위해서는 관찰실 모니터링 요원이 회고가 시작되기 전에 이 작업을 끝마칠 필요가 있습니다.

때문에 관찰실 모니터링 요원을 지정하실 때에는 타자가 눈이 부실만큼 빠르고 데이터 정리를 잘하는 사람을 뽑으시는 것도 좋은 방법입니다.

이런 이유로 사용자 테스트에는 되도록 많은 관찰자가 참여하는 것이 좋지만 참여하는 관찰자의 수를 제한하기도 합니다. 저는 개인적으로 10~20명 정도의 관찰자를 추천해 드립니다.

아니면 관찰실 모니터링 요원을 2명 이상 운용하시는 방법도 있습니다.

이제 테스트 과제와 시나리고 그리고 관찰실과 테스트실의 준비가 끝나셨다면 다음은 실제 테스트 진행입니다.

다음 포스트에는 실제 테스트를 진행하는 부분에 대해서 다루도록 하겠습니다.

댓글

이 블로그의 인기 게시물

AI 에이전트의 환각과 프롬프트 폭증을 막는 '컨텍스트 엔지니어링(Context Engineering)'과 아키텍처의 미래

AI 코딩 에이전트나 생성형 LLM을 소프트웨어 개발에 접목하는 시도가 늘어나면서, 엔지니어들이 마주하는 가장 큰 기술적 병목 중 하나는 바로 '컨텍스트(Context)'의 관리입니다. 저 역시 최근 AI와 바이브 코딩(Vibe Coding)을 활용해 여러 프로젝트를 진행하고 있는데, 하나의 대화창(세션)을 오래 켜둔 채 작업을 계속 이어가다 보면 AI가 초기 맥락을 잊어버리거나 이전에 지켜달라고 했던 제약조건을 놓치며 실수를 저지르는 경우를 자주 겪곤 합니다. 그래서 저는 목적별로 대화창을 명확하게 분리해서 작업하거나, 어느 정도 작업 단계가 진행되면 지금까지의 구현 내용과 의사결정을 요약 정리한 뒤 새 대화창에서 AI에게 이를 다시 학습시키는 방식으로 맥락을 관리하고 있습니다. 그렇다면 엔지니어링 아키텍처 차원에서는 이 문제를 어떻게 접근하고 있을까요? InfoQ의 발표 아티클 "Architecture / Context Engineering"에서는 바로 이 지점, 즉 단순한 프롬프트 엔지니어링을 넘어 시스템 아키텍처 수준에서 컨텍스트를 제어하는 '컨텍스트 엔지니어링(Context Engineering)'의 필요성과 구체적인 프레임워크를 다루고 있습니다. (출처: InfoQ - Architecture / Context Engineering) https://www.infoq.com/presentations/architecture-context-engineering/ 발표자들은 코딩 에이전트나 자율형 에이전트가 현장에서 실패하는 가장 큰 이유로 '비대해진 컨텍스트 윈도우(Bloated Context Windows)'와 무분별하게 채워진 프롬프트(Stuffed Prompts)를 꼽습니다. AI에게 너무 많은 정보를 한 번에 주면, 모델의 주의력(Attention)이 분산되거나 논리적 우선순위를 놓치는 현상이 발생합니다. 마치 인간 엔지니어에게 백과사전 수십 권을 던져주고 "이거 다 읽고 10초 ...

합성 사용자(Synthetic Users)의 5가지 유형과 AI 테스팅 현장에서의 활용법

AI와 생성형 모델 기술이 발전하면서, 사용자 경험(UX) 연구와 테스팅 현장에서 가상 퍼소나를 활용해 테스트 데이터를 수집하거나 사용성을 평가하려는 시도가 급격히 늘고 있습니다. 이를 흔히 '합성 사용자(Synthetic Users)'라고 부릅니다. 하지만 막연히 "AI에게 사용자 역할을 시켜 테스트를 돌린다"고 할 때, 그 가상 사용자가 어떤 방식과 데이터로 생성되었는지 명확히 구분하지 않으면 자칫 왜곡된 결과에 빠질 위험이 있습니다. UX 및 사용성 리서치 분야의 권위 있는 기관인 MeasuringU에서 이 합성 사용자의 개념을 명쾌하게 분류한 아티클을 공개했습니다. 바로 "What Are the Different Types of Synthetic Users?"라는 글입니다. (출처: MeasuringU - What Are the Different Types of Synthetic Users? / Jeff Sauro, PhD & Jim Lewis, PhD) https://measuringu.com/what-are-the-different-types-of-synthetic-users/ Jeff Sauro와 Jim Lewis 박사는 합성 사용자를 단순히 하나의 개념으로 뭉뚱그리지 않고, 생성 기술의 근거와 데이터 기반에 따라 크게 5가지 유형으로 깔끔하게 정리해 줍니다. 첫째는 규칙 기반(Rule-Based) 합성 사용자입니다. AI 모델이 아니라 사전 정의된 조건문, 정규식, 시나리오 스크립트에 따라 움직이는 전통적인 형태의 가상 사용자입니다. 예측 가능하고 정확하지만, 인간 사용자의 복잡한 정서나 미묘한 변수를 반영하진 못합니다. Selenium, Playwright, K6 같은 도구를 통해 지정된 경로대로 버튼을 누르고 데이터를 입력하는 방식을 들 수 있습니다. 둘째는 퍼소나 기반 LLM(Persona-Based LLM) 합성 사용자입니다. 생성형 AI에게 "너는 50대 비테크놀로지 사용...

AI가 만들고 사람이 고친 글, 과연 'AI 생성물'일까? — 무너지는 경계선과 각국의 표기 가이드라인

이미지, 음성, 텍스트를 가리지 않고 생성형 AI의 산출물이 전 세계 디지털 공간에 폭포수처럼 쏟아져 나오고 있습니다. 가짜 뉴스, 딥페이크 오정보, 저작권 침해 등 여러 사회적 문제를 일으키면서, 최근 EU를 비롯한 세계 각국의 규제 기관들이 "AI가 만든 콘텐츠에는 반드시 표시(Labelling)를 하라"는 강제 가이드라인을 잇달아 꺼내 들고 있습니다. 이와 관련해 Smashing Magazine에 비탈리 프리드만(Vitaly Friedman)이 기고한 아티클은 EU의 최신 규제가 실무 인터페이스(UI/UX)에 어떤 변화를 요구하는지 잘 보여줍니다. (출처: Smashing Magazine - New EU Guidelines For AI Labelling / Vitaly Friedman) https://www.smashingmagazine.com/2026/08/eu-guidelines-ai-labelling/ EU AI Act 제50조 투명성 규정에 따르면, 딥페이크나 AI 챗봇 대화, 인간의 검수 없이 AI가 100% 작성한 공공 텍스트 등에는 전용 AI 마크나 암호화된 메타데이터(Watermark)를 반드시 내장해야 합니다. 기존에 서비스들이 유행처럼 쓰던 모호한 '반짝이 아이콘(✨ Sparkles)' 수준으로는 법적 기준을 충족할 수 없게 된 것입니다. 하지만 현장의 개발자, 에디터, 테스터들이 마주한 진짜 혼란은 규제의 유무가 아닙니다. 바로 "도대체 어디까지를 AI가 만들었다고 볼 것이며, 어디서부터를 사람이 만든 것으로 정의할 것인가?"라는 근본적인 경계선의 모호함입니다. 프롬프트 한 줄 던져서 AI가 뽑아낸 초안을 사람이 문장 몇 개 다듬었다면, 이것은 AI 산출물일까요, 인간의 글일까요? AI가 코딩한 1,000줄의 소스 코드를 엔지니어가 한 시간 동안 디버깅하고 검수했다면 이 코드의 주인은 누구일까요? 글로벌 규제 기관들도 이 모호함을 인지하고 명확한 자격 기준을 세우기 위해 격렬한 논의를 ...