기본 콘텐츠로 건너뛰기

사용성과 UX - 오류 부재의 궤변

근래에 가장 우리에게 친숙해진 언어를 꼽자면 UX를 꼽을 수 있습니다.

그리고 그 이전에 사용성이라는 것이 있었습니다.

그런데 많은 분들이 사용성과 UX를 동일시 하시는 경우가 있습니다. 결론부터 말하자면 사용성은 UX가 아닙니다. UX가 조금은 더 큰 개념이죠. 사용성은 UX를 구성하는 중요한 요소들 중 하나입니다.

그러면 사용성 테스팅으로 UX를 개선할 수 있을까요?

UX를 이야기 하는 곳에 여러번 나가보고 얘기를 들어보았지만 막상 사용성 테스팅을 이야기하는 것을 많이 듣지 못했습니다.

모두가 UX 개선을 이야기 하지만 그 개선이 정말 개선이 된 것인지에 대한 테스팅은 이야기하지 않습니다.

그 이면에는 사용성 테스팅으로는 UX를 측정할 수도 개선할 수도 없다는 생각이 깔려 있는 것 같습니다.(물론 저 혼자만의 착각일 수도 있겠죠.)

하지만 최근에는 사용성 테스팅도 UX의 발전만큼 많은 부분에서 괄목한만한 발전을 보여주고 있고 몇몇분들께서는 최근의 트렌드를 이끌어 주시는 분들도 계십니다.

지금부터 제가 하는 이야기는 어디까지나 제 개인적인 경험과 생각을 토대로 한 글이므로 딴지는 환영하지만 비방은 사양하겠습니다.

기존의 사용성 테스팅은 목적 중심이었다고 할 수 있습니다.

무슨 이야기인고 하니 사용성 테스팅이 작업 완료 시간, 작업 성공율 과 같은 시험에 의한 데이터를 수집하고 분석해서 그것을 토대로 개선을 이끌어내는 작업이었다고 할 수 있습니다.

하지만 최근의 사용성 테스트는 이러한 기존의 사용성에 더해서 사용자와의 피드백에 좀 더 적극적으로 개입해서 그들의 이야기를 듣고 그 이야기에서 인사이트를 얻고자 하는 방법을 많이 시도하고 있습니다.

이것을 저는 목표 중심의 사용성 테스트라고 부릅니다.

기존에는 제품이 사용자에게 어떤 것을 얼마나 빠르고 간편하게 제공하는 가를 측정하는 것이 사용성 테스팅이였다면 최근의 사용성 테스트는 이것에 더해서 그러한 것들에 대해 사용자가 어떻게 인식하고 어떤 생각을 가지는 가 역시 측정하려는 노력을 많이 하고 있습니다.

예전이 매트릭과 지표 중심의 사용성 테스팅에서 최근에는 좀 더 심리적인 부분에 대한 접근을 더 많이 시도하고 있습니다.

문제는 이러한 접근법은 정량적인 결과로 도출되지 않고 데이터가 정량화되지 못하다 보니 개선 의견에 대한 설득력이 떨어질 수 있다는 것입니다.

물론 지금도 세계 곳곳에서는 이러한 문제점을 극복하고 좀 더 나은 결과를 도출하기 위해 많은 분들이 애쓰고 계시죠.(가장 많이 사용되는 방법은 통계적인 데이터를 제공하는 방법입니다.)

그런데 이러한 사용성과 UX의 차이 그리고 사용성 테스팅의 변화 자체를 바라보면서 문득 든 생각이 오류 부재의 궤변입니다.

오류 부재의 궤변은 오류가 하나도 없는 제품이라도 그것의 품질이 좋다고는 절대 말할 수 없다는 것입니다.

마찬가지로 사용성이 아무리 좋다고 한들 그것이 고객에게 정말 좋은 경험과 상호작용을 갖는지는 여전히 미지수입니다.

어떻게 하면 좀 더 확실하고 간편하게 이러한 것들을 알 수 있을까요? 우리가 만든 제품이 고객에게 어떤 첫인상을 주고 고객은 우리의 제품을 통해 어떤 경험을 하고 어떻게 우리 제품을 사용하고 있는 것인지 그러한 것들을 사용성 테스팅을 통해 미리 예측하고 개선할 수 있을까요?

그러한 질문에 저를 포함한 많은 분들이 도전하고 있습니다. 여러분은 어떤 방법을 가지고 계시나요?

댓글

이 블로그의 인기 게시물

AI 에이전트의 환각과 프롬프트 폭증을 막는 '컨텍스트 엔지니어링(Context Engineering)'과 아키텍처의 미래

AI 코딩 에이전트나 생성형 LLM을 소프트웨어 개발에 접목하는 시도가 늘어나면서, 엔지니어들이 마주하는 가장 큰 기술적 병목 중 하나는 바로 '컨텍스트(Context)'의 관리입니다. 저 역시 최근 AI와 바이브 코딩(Vibe Coding)을 활용해 여러 프로젝트를 진행하고 있는데, 하나의 대화창(세션)을 오래 켜둔 채 작업을 계속 이어가다 보면 AI가 초기 맥락을 잊어버리거나 이전에 지켜달라고 했던 제약조건을 놓치며 실수를 저지르는 경우를 자주 겪곤 합니다. 그래서 저는 목적별로 대화창을 명확하게 분리해서 작업하거나, 어느 정도 작업 단계가 진행되면 지금까지의 구현 내용과 의사결정을 요약 정리한 뒤 새 대화창에서 AI에게 이를 다시 학습시키는 방식으로 맥락을 관리하고 있습니다. 그렇다면 엔지니어링 아키텍처 차원에서는 이 문제를 어떻게 접근하고 있을까요? InfoQ의 발표 아티클 "Architecture / Context Engineering"에서는 바로 이 지점, 즉 단순한 프롬프트 엔지니어링을 넘어 시스템 아키텍처 수준에서 컨텍스트를 제어하는 '컨텍스트 엔지니어링(Context Engineering)'의 필요성과 구체적인 프레임워크를 다루고 있습니다. (출처: InfoQ - Architecture / Context Engineering) https://www.infoq.com/presentations/architecture-context-engineering/ 발표자들은 코딩 에이전트나 자율형 에이전트가 현장에서 실패하는 가장 큰 이유로 '비대해진 컨텍스트 윈도우(Bloated Context Windows)'와 무분별하게 채워진 프롬프트(Stuffed Prompts)를 꼽습니다. AI에게 너무 많은 정보를 한 번에 주면, 모델의 주의력(Attention)이 분산되거나 논리적 우선순위를 놓치는 현상이 발생합니다. 마치 인간 엔지니어에게 백과사전 수십 권을 던져주고 "이거 다 읽고 10초 ...

합성 사용자(Synthetic Users)의 5가지 유형과 AI 테스팅 현장에서의 활용법

AI와 생성형 모델 기술이 발전하면서, 사용자 경험(UX) 연구와 테스팅 현장에서 가상 퍼소나를 활용해 테스트 데이터를 수집하거나 사용성을 평가하려는 시도가 급격히 늘고 있습니다. 이를 흔히 '합성 사용자(Synthetic Users)'라고 부릅니다. 하지만 막연히 "AI에게 사용자 역할을 시켜 테스트를 돌린다"고 할 때, 그 가상 사용자가 어떤 방식과 데이터로 생성되었는지 명확히 구분하지 않으면 자칫 왜곡된 결과에 빠질 위험이 있습니다. UX 및 사용성 리서치 분야의 권위 있는 기관인 MeasuringU에서 이 합성 사용자의 개념을 명쾌하게 분류한 아티클을 공개했습니다. 바로 "What Are the Different Types of Synthetic Users?"라는 글입니다. (출처: MeasuringU - What Are the Different Types of Synthetic Users? / Jeff Sauro, PhD & Jim Lewis, PhD) https://measuringu.com/what-are-the-different-types-of-synthetic-users/ Jeff Sauro와 Jim Lewis 박사는 합성 사용자를 단순히 하나의 개념으로 뭉뚱그리지 않고, 생성 기술의 근거와 데이터 기반에 따라 크게 5가지 유형으로 깔끔하게 정리해 줍니다. 첫째는 규칙 기반(Rule-Based) 합성 사용자입니다. AI 모델이 아니라 사전 정의된 조건문, 정규식, 시나리오 스크립트에 따라 움직이는 전통적인 형태의 가상 사용자입니다. 예측 가능하고 정확하지만, 인간 사용자의 복잡한 정서나 미묘한 변수를 반영하진 못합니다. Selenium, Playwright, K6 같은 도구를 통해 지정된 경로대로 버튼을 누르고 데이터를 입력하는 방식을 들 수 있습니다. 둘째는 퍼소나 기반 LLM(Persona-Based LLM) 합성 사용자입니다. 생성형 AI에게 "너는 50대 비테크놀로지 사용...

AI가 만들고 사람이 고친 글, 과연 'AI 생성물'일까? — 무너지는 경계선과 각국의 표기 가이드라인

이미지, 음성, 텍스트를 가리지 않고 생성형 AI의 산출물이 전 세계 디지털 공간에 폭포수처럼 쏟아져 나오고 있습니다. 가짜 뉴스, 딥페이크 오정보, 저작권 침해 등 여러 사회적 문제를 일으키면서, 최근 EU를 비롯한 세계 각국의 규제 기관들이 "AI가 만든 콘텐츠에는 반드시 표시(Labelling)를 하라"는 강제 가이드라인을 잇달아 꺼내 들고 있습니다. 이와 관련해 Smashing Magazine에 비탈리 프리드만(Vitaly Friedman)이 기고한 아티클은 EU의 최신 규제가 실무 인터페이스(UI/UX)에 어떤 변화를 요구하는지 잘 보여줍니다. (출처: Smashing Magazine - New EU Guidelines For AI Labelling / Vitaly Friedman) https://www.smashingmagazine.com/2026/08/eu-guidelines-ai-labelling/ EU AI Act 제50조 투명성 규정에 따르면, 딥페이크나 AI 챗봇 대화, 인간의 검수 없이 AI가 100% 작성한 공공 텍스트 등에는 전용 AI 마크나 암호화된 메타데이터(Watermark)를 반드시 내장해야 합니다. 기존에 서비스들이 유행처럼 쓰던 모호한 '반짝이 아이콘(✨ Sparkles)' 수준으로는 법적 기준을 충족할 수 없게 된 것입니다. 하지만 현장의 개발자, 에디터, 테스터들이 마주한 진짜 혼란은 규제의 유무가 아닙니다. 바로 "도대체 어디까지를 AI가 만들었다고 볼 것이며, 어디서부터를 사람이 만든 것으로 정의할 것인가?"라는 근본적인 경계선의 모호함입니다. 프롬프트 한 줄 던져서 AI가 뽑아낸 초안을 사람이 문장 몇 개 다듬었다면, 이것은 AI 산출물일까요, 인간의 글일까요? AI가 코딩한 1,000줄의 소스 코드를 엔지니어가 한 시간 동안 디버깅하고 검수했다면 이 코드의 주인은 누구일까요? 글로벌 규제 기관들도 이 모호함을 인지하고 명확한 자격 기준을 세우기 위해 격렬한 논의를 ...