상세 컨텐츠

본문 제목

지금 이 화면, 누가 보고 있을까요?

일한당/조금 아는 거로 있어 보이기

by zzi_119 2026. 9. 29. 15:00

본문

지금 화면을 보고 있는 건 사람일까요?

웹사이트에 들어오고, 메뉴를 찾고, 버튼을 누르고, 정보를 비교하고, 무언가를 작성하는.

우리는 지금까지 이 모든 행동을 사람이 한다고 생각했습니다.

 

그래서 '사람'이란 사용자가 쉽게 목적을 달성할 수 있도록

UX 기획자는 화면의 구조와 흐름을 설계하고,

디자이너는 시각적 경험을 디자인하고,

개발자는 서비스가 정확하게 작동하도록 만들었습니다.

 

이제는 우리가 익숙하게 생각해 온사용자의 모습이 조금씩 달라지고 있습니다.

바로 AI 에이전트(AI Agent)​의 등장 때문입니다.

 

 

AI 에이전트는 사람 대신 웹사이트에 들어가 상품을 찾고, 조건을 비교하고, 폼을 작성하고, 다음에 무엇을 해야 할지 스스로 판단하며 행동합니다.

그래서 어쩌면 앞으로는 우리가 만든 화면을 사용하는 주체가 꼭 사람만은 아닐 수도 있습니다.

 

Nielsen Norman Group에서도 최근 AI Agents as Users라는 관점으로 AI 에이전트를 새로운 사용자 유형으로 바라보기 시작했습니다.

이에 따라, UX에서도 새로운 질문이 생기고 있습니다.

 

AI 에이전트도 이제 새로운 서비스의 사용자로 봐야 하지 않을까?

 


 

챗봇과 AI 에이전트는 뭐가 다를까요?

그렇다면 우리가 흔히 알고 있는 챗봇과 AI 에이전트의 차이는 무엇일까요?

 

둘의 가장 큰 차이는 답변에서 끝나는지, 실제 행동까지 이어가는지에 있습니다.

 

예를 들어, 챗봇에게 "제주도 여행 갈 때 무엇을 준비해야 해?"라고 물어보면 필요한 준비물을 알려줍니다.

반면, AI 에이전트에게 “다음 주말 제주도 여행을 준비해 줘”라고 요청하면 조금 다르게 움직일 수 있습니다.

 

항공편을 검색하고
가격과 시간을 비교하고
조건에 맞는 후보를 고르고
호텔을 찾아보고

예약 화면에서 정보를 입력하고

 

AI 에이전트는 목표를 이루기 위한 여러 행동을 이어서 수행합니다.

(물론! 결제나 최종 예약처럼 중요한 단계에서는 사용자의 확인이 필요할 수 있습니다 🤓)

 

Nielsen Norman Group에서는 AI 에이전트를 단순히 대화를 잘하는 AI가 아니라,

목표를 향해 행동하고, 진행 상황을 확인하고, 다음 행동을 스스로 결정하는 시스템으로 설명하고 있습니다.

 

그래서 챗봇과 AI 에이전트는 뭐가 다를까요?

챗봇은 말해주고, 에이전트는 해줍니다.

 

이 차이가 UX에서는 꽤나 중요합니다.

AI가 단순히 정보를 읽는 수준을 넘어, 버튼을 직접 누르고 판단하여 서비스를 이용하기 시작하면, AI를 더 이상 서비스 밖에 있는 기술이라고만 볼 수 없기 때문입니다.

 

AI도 우리 서비스 안으로 들어오는 하나의 사용자가 되어가고 있습니다.

그렇다면 이런 에이전트는 실제로 어떤 방식으로 웹을 사용하고 있을까요?

 

 


 

브라우저 속 AI일까, AI 속 브라우저일까?

여기서 한 가지 재미있는 변화가 더 있습니다.

요즘 AI가 웹을 사용하는 모습은 크게 두 가지 방향으로 나타나고 있습니다.

 

하나는 Comet이나 Aside처럼 브라우저 안에 AI 에이전트가 들어가는 방식입니다.

 

우리가 브라우저를 사용하고 있는 동안 AI가 현재 페이지나 여러 탭의 내용을 이해하고, 필요한 경우 검색하거나 버튼을 누르며 작업을 함께 수행합니다.

즉, 브라우저가 중심이고 그 안에 AI가 함께 들어와 있는 모습에 가깝습니다.

 

Comet은 공식적으로 AI 기능과 에이전틱 워크플로우를 결합한 브라우저로 소개되고 있고,

Aside 역시 웹사이트와 로그인된 계정을 활용하여 작업하는 브라우저를 강조하고 있습니다.

 

반대로 AI 에이전트가 브라우저를 하나의 도구로 사용하는 방식도 있습니다.

이 경우 사용자는 브라우저를 직접 탐색하기보다 AI에게 먼저 목표를 전달합니다.

 

"이 조건에 맞는 상품을 찾아줘"

그러면 AI가 필요할 때 브라우저를 열고, 여러 사이트를 이동하고, 정보를 읽고, 다음 행동을 수행합니다.

 

브라우저 속 AI는

'내가 웹을 돌아다니는데 AI가 옆에서 함께 움직이는 것'

AI 속 브라우저는

'AI에게 일을 맡겼더니 AI가 필요할 때 브라우저를 꺼내 사용하는 것'에 가깝습니다.

 

두 방식은 조금 다르지만, 한 가지 중요한 변화를 보여줍니다.

AI가 웹페이지를 단순히 읽는 것을 넘어, 실제 사용자처럼 화면을 탐색하고 행동하기 시작했다는 점입니다.

 

Comet
Aside


 

AI는 화면을 어떻게 볼까요?

그렇다면 AI가 사람처럼 눈이 있는 것도 아닌데 어떻게 화면을 볼까요?

 

현재 AI 에이전트가 웹사이트를 이해하는 방법은 크게 세 가지가 있습니다.

 


 

1️⃣ 사람처럼 화면을 이미지로 보는 방법

스크린샷을 찍고, "여기 파란색 버튼이 있네", "오른쪽 아래에 다음 버튼이 있네"라고 이미지 자체를 분석합니다.

사람이 화면을 보는 방식과 가장 비슷하지만, 이미지를 계속 분석해야 하기 때문에 상대적으로 처리해야 할 정보가 많고,

버튼이나 요소의 의미를 잘못 이해할 가능성도 있습니다.

 

2️⃣ 웹사이트 안에 숨겨진 구조를 읽는 방법

버튼인지, 제목인지, 입력창인지, 메뉴인지처럼 화면 뒤에 정의된 정보를 읽습니다.

AI는 이런 정보를 활용해 "이건 검색 버튼이구나", "여기는 이메일을 입력하는 곳이구나"처럼 화면의 의미를 파악할 수 있습니다.

이때 활용할 수 있는 대표적인 구조가 바로 접근성 트리(Accessibility Tree)입니다.

 

 

3️⃣ 아예 화면을 보지 않는 방법

웹사이트가 제공하는 API를 통해 필요한 정보를 직접 주고받는 방식입니다.

사람으로 비유하면, 매장에 들어가 진열대를 하나씩 둘러보는 대신, 직원에게 "이 조건에 맞는 상품 목록을 바로 주세요"라고 요청하는 것에 가깝습니다.

 


앞으로는 API나 MCP(Model Context Protocol)​처럼 AI와 서비스가 직접 정보를 주고받는 방식도 점점 늘어날 수 있습니다.

하지만 모든 서비스가 AI가 사용할 수 있는 API를 제공하는 것은 아닙니다.

그래서 AI가 직접 화면을 보고, 화면의 구조를 읽으며 서비스를 이용하는 방식도 여전히 중요합니다.

 

그리고 바로 이 지점에서 UX와 연결되는 흥미로운 부분이 생깁니다.

AI가 화면을 더 잘 이해하도록 만들다 보면, 결국 우리가 오랫동안 이야기해 온 접근성의 원칙과 만나게 됩니다.

 


 

접근성이 좋으면 AI에게 어떤 점이 좋을까요?

접근성은 장애인이나 고령자 등 모든 사용자가 서비스를 문제 없이 사용할 수 있도록 만드는 원칙입니다.

 

예를 들어 화면에 '🔍' 아이콘 하나만 있다고 생각해볼게요.

사람은 모양과 위치를 보고 "검색 버튼이구나~" 라고 이해할 수 있습니다.

 

하지만 화면을 볼 수 없는 사용자가 스크린 리더(화면 디스플레이에 표시된 내용을 비시각적 방식으로 이해하는 소프트웨어)를 이용한다면 이야기가 달라집니다.

화면 뒤의 구조에 이 버튼이 무엇을 의미하는지 제대로 정의되어 있지 않다면, 스크린리더는 단순히 버튼이라고만 읽을 수도 있습니다.

화면의 구조를 활용하는 AI도 비슷합니다.

 

반대로 버튼에 검색이라는 명확한 이름이 붙어 있다면 어떨까요?

스크린리더도 더 정확하게 안내할 수 있고, AI 에이전트도 "아! 이건 검색을 위한 버튼이구나"하며 이해하기 쉬워집니다.

 

우리가 그동안 이야기해 온 접근성이 좋은 서비스와 앞으로 중요해질 AI가 이해하기 좋은 서비스가 생각보다 꽤 비슷한 방향을 바라보고 있다는 것을 알 수 있습니다.

 

결국, 접근성이 좋은 서비스는 사람에게만 친절한 것이 아닙니다.

화면의 의미와 구조가 명확할수록 AI도 그 서비스를 더 정확하게 이해할 수 있습니다.

그렇다면 실제 UX에서는 어떤 화면이 AI에게도 이해하기 쉬울까요?


 

AI가 좋아하는 화면은 무엇일까요?

AI라는 새로운 사용자를 위해 완전히 새로운 화면을 만들어야 할까요?

의외로 그렇지 않습니다.

AI가 이해하기 쉬운 화면을 살펴보면, 사실 우리가 그동안 좋은 UX라고 이야기해 온 것들과 크게 다르지 않습니다.

 


 

🔤 이름표를 제대로 붙여주세요

예를 들어 버튼 하나를 생각해 볼까요?

여기 클릭

자세히

→

처럼 주변 문맥을 보지 않으면 무엇을 하는지 알 수 없는 버튼보다,

 

요금제 자세히 보기

예약 변경하기

결제하기

처럼 버튼만 봐도 어떤 행동으로 이어지는지 명확한 표현이 훨씬 이해하기 쉽습니다.

무엇을 누르면 어떤 일이 일어날지 분명한 화면은 사람에게도, AI에게도 친절합니다.

 

 

✏️ 갑자기 규칙을 바꾸지 마세요

어떤 화면에서는 다음 버튼이 오른쪽 아래에 있고, 다른 화면에서는 위쪽에 있고,

또 다른 화면에서는 버튼 대신 텍스트 링크가 나타난다면, 사람도 잠시 멈칫하게 됩니다.

 

AI 역시 앞에서 익힌 방식이 다음 화면에서 이어질수록 서비스를 이해하고 다음 행동을 결정하기 쉬워집니다.

우리가 디자인 시스템에서 중요하다고 이야기해 온 일관성이 AI 시대에도 그대로 중요해집니다.

 

 

🔗 예쁘게만 묶지 말고 구조적으로도 묶어주세요

화면에서는

상품명
가격
혜택
신청 버튼

이 하나의 카드처럼 보이는데, 화면 뒤의 구조에서는 서로 관련 없는 정보처럼 떨어져 있으면 어떨까요?

 

사람은 위치와 모양을 보고 하나의 상품 정보로 이해할 수 있지만, AI는 화면의 구조를 읽기에 관계를 제대로 파악하지 못할 수도 있습니다.

그래서 눈으로 보이는 정보의 관계가 화면 뒤의 구조에서도 잘 이어지는 것이 중요합니다.

 

 

 


 

사용자는 이제 한 명이 아닐지도 모릅니다

우리는 지금까지 UX에서는 화면을 직접 사용하는 사람을 중심으로 생각해 왔습니다.

하지만 AI 에이전트가 사람 대신 행동하기 시작하면 이야기가 조금 달라집니다.

 

사람이 "가장 저렴한 요금제로 바꿔줘"라고 요청하고, AI 에이전트가 서비스에 들어와 조건을 비교하고 요금제를 찾는다면 어떨까요?

목표를 가진 사람은 따로 있고, 실제로 서비스를 조작하는 사용자는 AI가 됩니다.

 

조금 재미있게 표현하면 앞으로의 UX에는 두 명의 사용자가 생기는 셈입니다.

원하는 사람과, 실행하는 AI

 

우리는 이제 화면을 사용하는 주체뿐만 아니라,

누가 목표를 정하고, 누가 실제 행동을 수행하는가? 까지 함께 고민해야 할지도 모릅니다.

 


 

그렇다면 모든 서비스를 AI에게 열어줘야 할까요?

여기까지 읽다 보면 이런 생각이 들 수 있습니다.

"그럼 모든 서비스를 빨리 AI 친화적으로 만들어야 하는 걸까?"

 

꼭 그렇지는 않습니다.

AI 에이전트를 새로운 사용자로 인정하는 것과, 서비스의 모든 행동을 AI에게 허용하는 것은 다른 문제입니다.

 

어떤 서비스는 AI가 대신 움직여줄수록 편리합니다.

여러 상품의 가격을 비교하거나, 복잡한 조건 속에서 나에게 맞는 상품을 찾는 일은 우리에게 아주 편리할 수 있습니다.

 

하지만 모든 서비스가 그런 것은 아닙니다.

 

사용자가 직접 방문하고 콘텐츠를 탐색하거나 경험하는 것 자체가 중요한 서비스라면, AI가 모든 과정을 대신하는 것이 반드시 좋은 일만은 아닐 수 있습니다.

특히, 금융이나 의료처럼 중요한 결정을 다루는 서비스에서는 사람이 직접 확인하는 과정이 필요할 수 있습니다.

우리가 가끔 귀찮다고 느끼는 추가 인증이나 확인 화면 역시 사실은 실수나 잘못된 결정을 막기 위해 만들어놓은 의도적인 마찰일 수 있습니다.

 

그렇다고 AI의 접근을 무조건 막는 것도 답은 아닙니다.

 

앞으로 AI 에이전트가 사람들이 새로운 서비스를 발견하고 비교하고 선택하는 또 하나의 입구가 된다면 어떨까요?

그때는 AI가 이해하고 접근하기 어려운 서비스는 사용자의 선택지에서 밀려날 가능성도 생각해야 합니다.

 

결국 에이전트에게 어디까지 허용할지는 단순한 UX 문제가 아니라 서비스 전략의 문제이기도 합니다.

그래서 중요한 질문은 AI를 받을까요, 막을까요?가 아닙니다.

 

먼저 이렇게 물어야 합니다.

이 일을 AI에게 맡겨도 되는가?

 

그리고 한 걸음 더 나아가, 

그렇게 했을 때 우리 서비스가 만들고자 하는 경험과 목표와도 잘 맞는가?

이 두 가지를 함께 판단해야 합니다.

 


 

그렇다면 지금 무엇을 해야 할까요?

그렇다고 내일부터 갑자기 AI 전용 UX 가이드를 만들어야 합니다!라고 외칠 필요는 없습니다.

 

오히려 지금 필요한 것은 새로운 무언가가 아니라, 우리가 늘 이야기해 온 UX의 기본을 더 잘 지키는 것에 가깝습니다.

 

버튼의 이름을 명확하게 정하고
일관된 UI 패턴을 적용하고
화면의 정보 관계가 잘 드러난 구조를 만들고
접근성을 꼼꼼히 지키는 것

 

우리가 그동안 좋은 UX의 기본이라고 이야기해 온 것들입니다.

이제 그 기본을 지켜야 하는 이유가 하나 더 생겼습니다.

 

명확하고 일관되며 접근성이 잘 갖춰진 서비스는 사람에게 사용하기 편한 서비스일 뿐만 아니라, AI가 이해하고 행동하기 쉬운 서비스가 될 가능성이 높습니다.

어쩌면 Agentic AI 시대를 준비하는 가장 첫 번째 UX 전략은 지금 우리가 가진 서비스를 더 명확하게 만드는 것 일지도 모릅니다.

 

지금까지 UX 기획자는 늘 이렇게 고민해 왔습니다.

"사용자가 이 화면을 어떻게 이해할까?"

 

그런데 이제 질문이 하나 더 생겼습니다.

"그 사용자가 꼭 사람이어야 할까?"

 

지금 이 화면을 보고, 읽고, 이해하고, 선택하고 있는 사용자는 사람이 아니라 AI일지도 모릅니다.

UX는 이제 사람만을 위한 경험을 넘어 무엇을 설계해야 할까요?

 

 

 

 

 

 


*본 블로그에 사용된 이미지는 AI를 활용하여 제작되었습니다.

관련글 더보기

댓글 영역