기본 콘텐츠로 건너뛰기

합성 사용자(Synthetic Users)의 5가지 유형과 AI 테스팅 현장에서의 활용법

AI와 생성형 모델 기술이 발전하면서, 사용자 경험(UX) 연구와 테스팅 현장에서 가상 퍼소나를 활용해 테스트 데이터를 수집하거나 사용성을 평가하려는 시도가 급격히 늘고 있습니다. 이를 흔히 '합성 사용자(Synthetic Users)'라고 부릅니다.

하지만 막연히 "AI에게 사용자 역할을 시켜 테스트를 돌린다"고 할 때, 그 가상 사용자가 어떤 방식과 데이터로 생성되었는지 명확히 구분하지 않으면 자칫 왜곡된 결과에 빠질 위험이 있습니다.

UX 및 사용성 리서치 분야의 권위 있는 기관인 MeasuringU에서 이 합성 사용자의 개념을 명쾌하게 분류한 아티클을 공개했습니다. 바로 "What Are the Different Types of Synthetic Users?"라는 글입니다.

(출처: MeasuringU - What Are the Different Types of Synthetic Users? / Jeff Sauro, PhD & Jim Lewis, PhD)

https://measuringu.com/what-are-the-different-types-of-synthetic-users/

Jeff Sauro와 Jim Lewis 박사는 합성 사용자를 단순히 하나의 개념으로 뭉뚱그리지 않고, 생성 기술의 근거와 데이터 기반에 따라 크게 5가지 유형으로 깔끔하게 정리해 줍니다.

첫째는 규칙 기반(Rule-Based) 합성 사용자입니다. AI 모델이 아니라 사전 정의된 조건문, 정규식, 시나리오 스크립트에 따라 움직이는 전통적인 형태의 가상 사용자입니다. 예측 가능하고 정확하지만, 인간 사용자의 복잡한 정서나 미묘한 변수를 반영하진 못합니다. Selenium, Playwright, K6 같은 도구를 통해 지정된 경로대로 버튼을 누르고 데이터를 입력하는 방식을 들 수 있습니다.

둘째는 퍼소나 기반 LLM(Persona-Based LLM) 합성 사용자입니다. 생성형 AI에게 "너는 50대 비테크놀로지 사용자이고 금융 앱을 처음 써보는 사람이야"와 같이 특정 퍼소나와 제약조건을 프롬프트로 부여하여 인터랙션을 모사하도록 만드는 방식입니다. 프롬프트 입력만으로 서베이나 인터뷰 반응을 예측해 주는 정량/정성 UX 리서치 전용 SaaS 서비스들이 이 방식을 채택하고 있습니다. 대표적으로 Synthetic Users나 Askable AI가 여기에 속합니다.

셋째는 행동 데이터 학습 기반(Behavioral Data-Trained) 합성 사용자입니다. 실제 인간 사용자들이 남긴 로그, 마우스 클릭 궤적, 과업 수행 시간, 눈동자 추적(Eye-tracking) 데이터 등을 대량으로 학습하여, 특정 UI 인터페이스에서 인간이 보일 법한 확률적 행동 패턴을 수학적으로 재생성해 내는 모델입니다. 유저의 클릭 히트맵, 마우스 이동 경로, 화면 내 시선 분산을 AI가 학습해 디자인의 시선 집중도와 이탈 지점을 시뮬레이션합니다. 대표적인 AI 히트맵 예측 도구로 3M VAS, Attention Insight, Hotjar AI 등이 활용됩니다.

넷째는 심리/특성 기반(Psychometric/Attribute-Based) 합성 사용자입니다. 사용자의 기술 친화도, 성격 5대 요소(Big Five), 독해력 수준, 작업 기억 용량(Working Memory) 등 인지 심리학적 특성을 변수로 입력하여, 해당 인지 특성을 가진 사람이 시스템에서 겪을 법한 인지적 과부하나 오류를 시뮬레이션합니다. 우울증 치료용 디지털 치료제(DTx)나 항공 관제·차량 인포테인먼트 등 고위험군 UI를 설계할 때 필수적입니다. 인간의 피로도, 주의력 감소, 작업 기억 용량 한계를 정밀하게 함수화한 인지 아키텍처 모델(ACT-R)이나, 에이전트에 인지적 특성을 직접 이식하는 멀티 에이전트 프레임워크(Generative Agents)가 사용됩니다.

다섯째는 혼합형(Hybrid) 합성 사용자입니다. 앞서 언급한 실제 행동 데이터와 심리적 특성, 프롬프트 기반 퍼소나를 결합하여 상황에 맞게 상호작용 능력을 극대화한 가상 사용자입니다. 대규모 이커머스/핀테크의 결제 절차 개편이나 자율주행 차량의 음성+터치 UX 테스트에 활용됩니다. Microsoft의 AutoGen이나 CrewAI 같은 프레임워크를 활용해 실제 유저의 행동 로그 데이터를 학습 데이터로 피딩(Feeding)하고, 여러 인지적 특성을 가진 AI 에이전트 패널을 동시에 구동하여 시뮬레이션합니다.

저 역시 개인적으로 무언가를 만들 때 제 자신을 기준으로 AI에게 부여하고 가상의 사용성 테스트를 시도해 본 적이 있습니다. 확실히 빠르게 초기 허점을 잡아내거나 엣지 케이스 시나리오를 도출하는 데는 쓸모가 있었지만 실제 제가 구현된 제품을 사용할 때는 예상하지 못한 문제가 발생하고는 했습니다.

결론적으로 아직은 합성 사용자가 진짜 인간 사용자를 완전히 '대체'하는 존재가 될 수는 없습니다.

합성 사용자가 내놓는 반응은 결국 과거 데이터나 LLM의 확률적 예측 결과일 뿐이며, 실제 인간이 새로운 화면을 마주했을 때 느끼는 정서적 당혹감이나 독특한 맥락상의 미숙함까지 완벽히 복제할 수는 없기 때문입니다.

결국 합성 사용자의 진짜 가치는 '인간 대상 테스트를 진행하기 전, 시스템의 치명적인 결함과 논리적 구멍을 빠르게 솎아내는 전처리 도구(Pre-screening Tool)'로 활용할 때 빛을 발합니다.

합성 사용자로 1차 경계선을 빠르게 점검하고, 거기서 살아남은 시나리오를 바탕으로 진짜 인간 사용자를 인터뷰하고 관찰하는 2단계 검증 구조를 세우는 것이 좋습니다.

기술이 만들어낸 가상의 유저에 안주하여 인간의 실제 맥락을 놓치는 '자동화 편향'을 경계하고, 정교하게 분류된 합성 사용자 유형을 적재적소에 배치하는 지혜가 필요한 시점입니다.

댓글

이 블로그의 인기 게시물

피드백 루프: AI 시대 테스터가 지켜내야 할 핵심 엔진

소프트웨어 개발과 테스팅 현장에서 가장 자주 언급되지만, 막상 시스템이 복잡해질수록 쉽게 경시되곤 하는 핵심 개념이 바로 '피드백 루프(Feedback Loop)'입니다. 코드를 수정하고, 빌드하고, 테스트 결과를 확인하고, 다시 개선하는 그 순환 과정의 속도와 정확도가 결국 소프트웨어의 품질을 결정짓기 때문입니다. 품질 전문가 매슈 하이저(Matthew Heusser)가 자신의 블로그 Quality Remarks에 기고한 "One Loop After Another" 아티클은 바로 이 피드백 루프의 다층적 구조와, AI 시대에 우리가 놓치지 말아야 할 품질 검증의 본질을 날카롭게 되짚어 줍니다. (출처: Quality Remarks - One Loop After Another / Matthew Heusser) https://qualityremarks.com/one-loop-after-another/ 매슈 하이저는 소프트웨어 개발 생태계가 단순히 하나의 커다란 테스트 루프로 돌아가는 것이 아니라, 시간 축과 관점에 따라 겹겹이 쌓인 '연쇄적인 피드백 루프들(One Loop After Another)'로 이루어져 있다고 설명합니다. 초단기 루프 (Inner Loop): 개발자가 코드를 작성하는 몇 초~몇 분 단위의 루프입니다. 단위 테스트(Unit Test)나 IDE의 Linter, AI 자동 완성이 즉각적인 피드백을 주는 영역입니다. 단기 루프 (Daily / CI Loop): 커밋과 푸시가 이루어지고, CI/CD 파이프라인에서 통합 테스트와 정적 분석이 실행되는 몇 시간 단위의 루프입니다. 중기 루프 (Iteration / Exploration Loop): 스프린트 단위로 탐색적 테스팅(Exploratory Testing)을 수행하고, 실제 사용자 시나리오나 엣지 케이스를 사람이 직접 검증하며 시스템의 유기적 작동을 확인하는 며칠~몇 주 단위의 루프입니다. 장기 루프 (Outer / Market Loop): 실제 ...

에이전틱 AI 프로젝트에서 테스터의 5가지 핵심 원칙

AI 코딩 에이전트와 자율형 에이전트가 빠르게 개발 워크플로우에 통합되면서, 단순히 코드를 잘 짜는 것을 넘어 '에이전트와 어떻게 협업하고 통제할 것인가'가 개발자와 아키텍트들의 가장 큰 화두로 떠올랐습니다. 윤석찬 님의 아티클 "AI 에이전트 시대, 개발자는 어떻게 일해야 하는가? – 프론티어 엔지니어링의 10가지 원칙"은 에이전틱 AI 시대에 엔지니어가 마주하는 패러다임 변화와, 실무 현장에서 일하는 방식을 어떻게 재정의해야 하는지 아주 명확한 가이드라인을 제시해 줍니다. (출처: channy.creation.net - 윤석찬 님의 블로그) https://channy.creation.net/blog/1989 비록 대규모 에이전트 오케스트레이션이나 초거대 인프라 시스템을 개인이 직접 구축하고 운용하는 것은 비용적·기술적으로 현실적인 한계가 있습니다. 하지만 개인 프로젝트에서 AI와 바이브 코딩(Vibe Coding)을 활용하며 겪었던 맥락 손실, 환각, 통제 불능의 경험들을 떠올려보면, 이 아티클이 제시하는 10가지 프론티어 엔지니어링 원칙은 소규모 개인 개발 환경에서도 대단히 깊은 공감을 불러일으킵니다. 이 글은 단순히 "AI 도구를 잘 쓰자"는 수준에 머무르지 않습니다. AI 에이전트가 생성해내는 불확실성 속에서 인간 엔지니어가 시스템의 맥락을 주도하고, 오작동을 제어하며, 품질의 키(Steering Wheel)를 쥐기 위한 구조적 사고법을 다룹니다. 그렇다면 프론티어 엔지니어링의 원칙을 바탕으로, 시스템의 신뢰성과 안전성을 검증해야 하는 테스터는 과연 어떤 실무 원칙을 세워나갈 수 있을까요? 윤석찬 님이 제시한 엔지니어링 원칙을 테스팅 관점으로 재해석해 보면, 다음과 같은 5가지 원칙으로 정리할 수 있을 것 같습니다. 1. 결정론적 검증에서 '경계선 및 허용 오차(Boundary)' 테스팅으로 전환하라 에이전트 기반 시스템은 같은 입력을 주어도 매번 다른 추론 경로를 거치는 확률적(Stoc...

에이전틱 AI 시대에 테스팅은?

 "소프트웨어 엔지니어링은 과연 끝난 것일까?" 최근 AI 코딩 에이전트와 바이브 코딩(Vibe Coding)의 급부상 속에서, 엔지니어들과 아키텍트들이 스스로에게 던지는 가장 뼈아픈 질문입니다. 이 질문에 대해 기술 현장의 날카로운 시선을 담은 이원국 님의 아티클 "소프트웨어 엔지니어링의 종말"과 arXiv 논문 "Agentic Software: How AI Agents Are Restructuring the Software Paradigm"은 아주 근본적인 패러다임의 변화를 짚어내고 있습니다. (출처: blog.wonkooklee.com - 소프트웨어 엔지니어링의 종말) https://blog.wonkooklee.com/blog/20260913_02/ (출처: arXiv - Agentic Software: How AI Agents Are Restructuring the Software Paradigm) https://arxiv.org/html/2606.05608v2 이원국님의 아티클과 논문에서 공통적으로 말하는 핵심은, 우리가 알고 있던 '인간이 직접 코드를 다듬고 작성하던 전통적 소프트웨어 엔지니어링'의 정체성은 종말을 고하고 있으며, 그 자리를 '에이전트 패러다임(Agentic Paradigm)'이 빠르게 대체하고 있다는 사실입니다. arXiv 논문 "Agentic Software"에서는 소프트웨어 구축의 단위가 단순히 결정론적(Deterministic) 알고리즘이나 코드에서, 목표를 스스로 자율 추론하고 도구를 호출하며 과업을 완수하는 'AI 에이전트 오케스트레이션'으로 이동하고 있음을 말하고 있습니다. 이제 개발자는 시스템의 메서드나 API 하나하나를 직접 타이핑하는 존재가 아닙니다. AI 에이전트가 코드를 생성하고, 실행하고, 테스트를 돌리고, 스스로 디버깅하는 일련의 자율 루프(Autonomous Loop)를 설계하는 '시스템...