본문으로 이동

가상 비서

위키백과, 우리 모두의 백과사전.
픽셀 XL 스마트폰에서 실행 중인 구글 어시스턴트

가상 비서(假想祕書, 영어: Virtual assistant, VA)는 음성 명령을 포함한 사용자의 입력이나 질문을 바탕으로 다양한 작업이나 서비스를 수행할 수 있는 소프트웨어 에이전트다. 이러한 기술은 작업 실행을 효율화하기 위해 종종 챗봇 기능을 통합한다. 일부 가상 비서는 인간의 언어를 해석하고 합성된 음성을 통해 응답할 수 있기 때문에 텍스트, 그래픽 인터페이스 또는 음성을 통해 상호작용이 이루어질 수 있다.

많은 경우, 사용자는 가상 비서에게 질문을 하거나 홈 오토메이션 기기 및 미디어 재생을 제어하고, 이메일, 할 일 목록, 일정 관리와 같은 기본적인 작업을 모두 음성 명령으로 관리할 수 있다.[1] 최근 몇 년 동안 소비자용으로 널리 사용되는 주요 가상 비서로는 애플 Siri, 아마존 알렉사, 구글 어시스턴트 (제미나이), 마이크로소프트 코파일럿, 삼성 빅스비 등이 있다.[2] 또한 다양한 산업 분야의 기업들이 고객 서비스나 지원에 가상 비서 기술을 도입하고 있다.[3]

2020년대 들어 챗GPT와 같은 인공지능 기반 챗봇의 등장은 가상 비서 제품 및 서비스 분야에 향상된 기능과 관심을 불러일으켰다.[4][5][6]

역사

[편집]

실험적 시기: 1910년대–1980년대

[편집]

라디오 렉스(Radio Rex)는 1916년에 특허를 받고[7] 1922년에 출시된 최초의 음성 인식 장난감이다.[8] 이것은 개 모양의 나무 장난감으로, 이름을 부르면 집 밖으로 나왔다.

1952년, 벨 연구소는 자동 숫자 인식 장치인 "오드리(Audrey)"를 선보였다. 이 장치는 6피트 높이의 릴레이 랙을 차지했고 상당한 전력을 소비했으며, 수많은 케이블과 복잡한 진공관 회로와 관련된 관리 문제를 안고 있었다. 오드리는 언어의 기본 단위인 음소를 인식할 수 있었으나, 지정된 화자가 발음하는 숫자 인식에만 국한되었다. 따라서 음성 다이얼링에 사용될 수 있었으나, 대부분의 경우 숫자를 직접 말하는 것보다 버튼을 눌러 전화를 거는 것이 더 저렴하고 빨랐다.[9]

디지털 음성 인식을 수행할 수 있었던 또 다른 초기 도구로는 IBM 쇼박스 음성 인식 계산기가 있다. 1961년 처음 출시된 후 1962년 시애틀 세계 박람회에서 대중에게 공개되었다. 1981년 첫 IBM PC가 도입되기 약 20년 전에 개발된 이 초기 컴퓨터는 16개의 단어와 0부터 9까지의 숫자를 인식할 수 있었다.

최초의 자연어 처리 컴퓨터 프로그램이자 챗봇인 ELIZA는 1960년대 MIT 교수인 조셉 웨이젠바움에 의해 개발되었다. 이는 "인간과 기계 사이의 통신이 피상적이라는 것을 증명하기 위해" 만들어졌다.[10] ELIZA는 패턴 매칭과 대치 방법론을 대본화된 응답에 사용하여 대화를 시뮬레이션했으며, 이는 프로그램이 대화를 이해하고 있다는 착각을 불러일으켰다.

웨이젠바움의 비서는 ELIZA와 진짜 대화를 나누고 싶다며 웨이젠바움에게 방에서 나가달라고 요청하기도 했다. 웨이젠바움은 이에 놀라 나중에 다음과 같이 적었다. "비교적 간단한 컴퓨터 프로그램에 극히 짧은 시간 노출되는 것만으로도 평범한 사람들에게 강력한 망상적 사고를 유발할 수 있다는 사실을 깨닫지 못했다."[11]

이 현상은 컴퓨터의 행동이 인간의 행동과 유사하다고 무의식적으로 가정하는 경향인 일라이자 효과, 즉 의인화라는 이름을 낳았으며, 이는 가상 비서와의 상호작용에서도 나타나는 현상이다.

음성 인식 기술 발전의 다음 이정표는 1970년대 피츠버그카네기 멜런 대학교에서 달성되었다. 미국 국방부DARPA의 전폭적인 지원을 받아 최소 1,000개 단어의 어휘력을 목표로 5년간의 음성 이해 연구 프로그램을 진행했다. IBM, 카네기 멜런 대학교(CMU), 스탠퍼드 연구소 등 학계와 기업들이 이 프로그램에 참여했다.

그 결과물인 "하피(Harpy)"는 3세 아동 수준인 약 1,000개의 단어를 마스터했고 문장을 이해할 수 있었다. 하피는 미리 프로그래밍된 어휘, 발음, 문법 구조를 따르는 음성을 처리하여 어떤 단어 시퀀스가 서로 의미가 통하는지 판단함으로써 음성 인식 오류를 줄일 수 있었다.

1986년 탕고라(Tangora)는 쇼박스의 업그레이드 버전으로, 음성 인식 타자기였다. 당시 세계에서 가장 빠른 타자수의 이름을 딴 이 기기는 20,000개의 단어 어휘력을 가졌으며, 과거에 했던 말을 바탕으로 가장 가능성 높은 결과를 결정하기 위해 예측 기능을 사용했다. IBM의 방식은 디지털 신호 처리 기술에 통계를 더한 은닉 마르코프 모형에 기반했다. 이 방법은 특정 음소 다음에 올 가능성이 가장 높은 음소를 예측할 수 있게 해주었다. 하지만 여전히 각 화자가 타자기에 자신의 목소리를 개별적으로 학습시켜야 했고, 단어 사이마다 멈춤이 필요했다.

1983년 거스 서시(Gus Searcy)는 전자 음성 홈 컨트롤러 시스템인 "버틀러 인 어 박스(Butler In A Box)"를 발명했다.[12]

스마트 가상 비서의 탄생: 1990년대–2010년대

[편집]

1990년대에 디지털 음성 인식 기술은 IBM, 필립스, 러나웃 & 하스피(Lernout & Hauspie)가 고객 확보 경쟁을 벌이면서 개인용 컴퓨터의 기능이 되었다. 훨씬 나중인 1994년 최초의 스마트폰 IBM 사이먼의 출시는 오늘날 우리가 알고 있는 스마트 가상 비서의 토대를 마련했다.

1997년 드래곤(Dragon)의 내추럴리스피킹 소프트웨어는 단어 사이의 멈춤 없이 자연스러운 인간의 언어를 인식하여 분당 100단어의 속도로 문서에 기록할 수 있었다. 내추럴리스피킹 버전은 오늘날에도 여전히 다운로드 가능하며, 예를 들어 미국의 많은 의사들이 의료 기록을 문서화하는 데 사용하고 있다.

2001년 ColloquisAIMMSN 메신저와 같은 플랫폼에서 스마터차일드(SmarterChild)를 공개 출시했다. 완전히 텍스트 기반이었지만 스마터차일드는 게임을 하고, 날씨를 확인하며, 사실을 검색하고, 어느 정도 수준까지 사용자와 대화할 수 있었다.[13]

스마트폰에 설치된 최초의 현대적인 디지털 가상 비서는 Siri로, 2011년 10월 4일 아이폰 4S의 기능으로 도입되었다.[14] 애플DARPA미국 국방부가 자금을 지원한 연구 기관인 SRI 인터내셔널에서 분사한 시리(Siri Inc.)를 2010년에 인수한 후 Siri를 개발했다.[15] 그 목적은 문자 메시지 보내기, 전화 걸기, 날씨 확인 또는 알람 설정과 같은 작업을 돕는 것이었다. 시간이 지나면서 식당 추천, 인터넷 검색 및 운전 경로 안내를 제공하는 수준으로 발전했다.[16]

2014년 11월, 아마존은 에코와 함께 알렉사를 발표했다.[17] 2016년, 세일즈포스는 플랫폼의 기술 기반으로 개발된 아인슈타인(Einstein)을 선보였다.[18] 아인슈타인은 2024년 9월 에이전트형 AI인 에이전트포스(Agentforce)로 대체되었다.[19]

2017년 4월, 아마존은 모든 유형의 가상 비서나 인터페이스를 위한 대화형 인터페이스를 구축하는 서비스를 출시했다.

대형 언어 모델: 2020년대–현재

[편집]

2020년대에는 챗GPT와 같은 인공지능(AI) 시스템이 텍스트 기반 대화에 대해 인간과 유사한 응답을 생성하는 능력으로 인기를 얻었다. 2020년 2월, 마이크로소프트는 당시 "170억 개의 매개변수로 발표된 역대 최대 규모의 언어 모델"인 Turing Natural Language Generation (T-NLG)을 도입했다.[20] 2022년 11월 30일, 챗GPT가 시제품으로 출시되었으며 많은 지식 영역에 걸친 상세한 응답과 정연한 답변으로 빠르게 주목을 받았다. 챗GPT의 등장과 대중 공개는 이 분야의 관심과 경쟁을 고조시켰다. 2023년 2월, 구글은 에서 수집된 정보를 바탕으로 질문에 대한 텍스트 응답을 생성하는 LaMDA 프로그램을 기반으로 한 실험적 서비스 "바드(Bard)"를 도입하기 시작했다.

챗GPT와 최신 생성형 AI 기반의 범용 챗봇들이 가상 비서와 관련된 다양한 작업을 수행할 수 있는 반면, 보다 특정한 상황이나 요구 사항을 겨냥해 설계된 전문적인 형태의 기술들도 존재한다.[21][4]

상호작용 방식

[편집]
알렉사 가상 비서가 실행 중인 아마존 에코 닷 스마트 스피커

가상 비서는 다음을 통해 작동한다:

많은 가상 비서는 여러 방법을 통해 액세스할 수 있어, 사용자가 채팅, 음성 명령 또는 기타 통합 기술을 통해 상호작용할 수 있는 다재다능함을 제공한다.

가상 비서는 자연어 처리(NLP)를 사용하여 사용자의 텍스트나 음성 입력을 실행 가능한 명령에 매칭한다. 일부 비서는 기계 학습생활환경지능을 포함한 인공지능 기술을 사용하여 지속적으로 학습한다.

음성을 사용해 가상 비서를 활성화하려면 호출어(wake word)가 사용될 수 있다. 이는 "헤이 시리(Hey Siri)", "오케이 구글(OK Google)" 또는 "헤이 구글(Hey Google)", "알렉사(Alexa)", "헤이 마이크로소프트(Hey Microsoft)"와 같은 단어나 단어 그룹이다.[24] 가상 비서가 대중화됨에 따라 관련된 법적 위험도 증가하고 있다.[25]:815

기기 및 대상

[편집]
사용자가 가상 비서 Siri에게 시청할 콘텐츠를 찾아달라고 요청할 수 있는 Apple TV 리모컨

가상 비서는 다양한 유형의 플랫폼에 통합되거나 아마존 알렉사처럼 여러 플랫폼에 걸쳐 있을 수 있다:

서비스

[편집]

가상 비서는 다음과 같은 다양한 서비스를 제공할 수 있다:[33]

  • 날씨, 위키백과 또는 IMDb의 사실 정보 등 정보 제공, 알람 설정, 할 일 목록 및 쇼핑 목록 작성
  • 스포티파이판도라 라디오와 같은 스트리밍 서비스의 음악 재생, 라디오 방송 청취, 오디오북 읽기
  • TV에서 넷플릭스 등의 동영상, TV 프로그램 또는 영화 스트리밍 재생
  • 대화형 상거래(아래 참조)
  • 정부와 대중의 상호작용 지원 (정부의 인공 지능 참조)
  • 의료, 판매, 은행 업무 등의 분야에서 인간 고객 서비스 전문가를 보완하거나 대체.[34] 한 보고서에 따르면 자동화된 온라인 비서가 인간이 담당하는 콜 센터의 업무량을 30% 감소시킨 것으로 추정된다.[35]
  • 차 안에서 Siri나 알렉사와 같은 가상 비서와 상호작용할 수 있게 하여 운전 경험 향상

대화형 상거래

[편집]

대화형 상거래는 음성 비서를 포함한 다양한 메시징 수단을 통한 전자 상거래를 말하며,[36] 전자 상거래 웹사이트라이브 채팅, 위챗, 페이스북 메신저, WhatsApp과 같은 메시징 앱의 라이브 채팅,[37] 그리고 메시징 앱이나 웹사이트의 챗봇을 통해서도 이루어진다.

고객 지원

[편집]

가상 비서는 기업의 고객 지원 팀과 협력하여 고객에게 24/7 서비스를 제공할 수 있다. 빠른 응답을 제공하여 고객 경험을 개선한다. 서비스 산업의 기업들은 예약 관리나 주문 접수와 같은 일상적인 고객 상호작용, 특히 업무 시간 외 지원을 처리하기 위해 AI 음성 비서를 도입했다.[38] 이러한 구현에는 해당 분야의 용어를 이해하고 기존 비즈니스 소프트웨어와 통합하기 위해 산업별 교육이 사용되는 경우가 많다.

제3자 서비스

[편집]

아마존은 알렉사 "스킬(Skills)"을, 구글은 "액션(Actions)"을 허용하는데, 이는 기본적으로 비서 플랫폼에서 실행되는 애플리케이션이다.

개인정보 보호

[편집]

가상 비서는 다양한 개인정보 보호 관련 우려와 연관되어 있다. 음성 활성화 기능은 기기가 항상 듣고 있어야 하므로 위협이 될 수 있다.[39] 가상 비서를 위한 다층 인증을 만들기 위해 가상 보안 버튼과 같은 개인정보 보호 모드가 제안되기도 했다.[40]

구글 어시스턴트

[편집]

구글 어시스턴트의 개인정보 처리방침에 따르면 사용자의 허가 없이 오디오 데이터를 저장하지 않지만, 경험을 맞춤화하기 위해 대화 기록을 저장할 수 있다. 맞춤화는 설정에서 끌 수 있다. 사용자가 구글 어시스턴트가 오디오 데이터를 저장하기를 원하면 음성 및 오디오 활동(VAA)으로 이동하여 이 기능을 켤 수 있다. 오디오 파일은 클라우드로 전송되어 구글이 구글 어시스턴트의 성능을 개선하는 데 사용되지만, 이는 VAA 기능이 켜져 있는 경우에만 해당된다.[41]

아마존 알렉사

[편집]

아마존의 가상 비서인 알렉사의 개인정보 처리방침에 따르면 알렉사, 아마존, 에코와 같은 호출어가 사용될 때만 대화를 듣는다. 호출어가 불린 후 대화 녹음을 시작하고, 8초간 침묵이 흐르면 녹음을 중단한다. 녹음된 대화는 클라우드로 전송된다. 알렉사 앱의 '알렉사 개인정보 보호'를 방문하여 클라우드에서 녹음 내용을 삭제할 수 있다.[42]

애플 Siri

[편집]

애플은 Siri를 개선하기 위해 오디오를 녹음하지 않는다고 밝혔다. 대신 텍스트 기록을 사용한다고 주장한다. 기록 데이터는 분석에 중요하다고 판단되는 경우에만 전송된다. 사용자는 Siri가 기록을 클라우드로 전송하는 것을 원하지 않을 경우 언제든지 거부할 수 있다.[43]

마이크로소프트 코타나

[편집]

코타나는 단일 인증 방식의 음성 전용 가상 비서다.[44][45][46] 이 음성 활성화 장치는 날씨 확인이나 전화 걸기와 같은 일반적인 작업을 수행하기 위해 사용자 데이터에 액세스하는데, 2차 인증 수단이 부족하여 개인정보 보호 우려를 낳고 있다.[47][48]

소비자 관심

[편집]

새로운 상호작용 방식으로서의 부가가치

[편집]

가상 비서의 부가가치는 다음과 같은 요인에서 비롯될 수 있다:

  1. 편리성: 음성이 유일한 통신 수단인 분야가 있으며, 일반적으로 두 손과 시야를 자유롭게 하여 다른 활동을 병행할 수 있게 하거나 장애인을 돕는다.
  2. 신속성: 음성은 키보드 입력보다 효율적이다. 키보드로 분당 60단어를 쓰는 것에 비해 분당 최대 200단어까지 말할 수 있다. 또한 더 자연스러워 노력이 적게 든다(단, 텍스트 읽기는 분당 700단어에 달할 수 있다).[49]
  • 가상 비서는 자동화를 통해 많은 시간을 절약해 준다: 소비자가 다른 일을 하는 동안 예약을 잡거나 뉴스를 읽어줄 수 있다. 또한 회의 일정을 잡도록 요청할 수 있어 시간 정리를 돕는다. 새로운 디지털 스케줄러 설계자들은 기계 학습 과정과 작업 시간 및 자유 시간의 완전한 조직화를 통해, 이러한 달력들이 소비자의 시간을 더 효율적으로 사용할 수 있게 하겠다는 야심을 밝혔다. 예를 들어 소비자가 휴식 시간을 갖고 싶어 하면, 가상 비서는 이를 위해 최적인 순간(예: 생산성이 떨어지는 요일이나 시간대)에 휴식을 배치하며, 장기적으로는 업무 효율성을 보장하기 위해 자유 시간까지 예약하고 조직하는 것을 목표로 한다.[50]

인지된 관심도

[편집]
소비자가 가상 비서에 관심을 갖는 이유를 포착한 연구 결과의 그래픽 요약
  • 최근 연구(2019년)에 따르면, 소비자가 가상 비서를 사용하는 두 가지 이유는 인지된 유용성과 인지된 즐거움이다. 이 연구의 첫 번째 결과는 인지된 유용성과 인지된 즐거움 모두 가상 비서 사용 의지에 동일하게 매우 강력한 영향을 미친다는 것이다.
  • 이 연구의 두 번째 결과는 다음과 같다:
  1. 제공되는 콘텐츠의 품질은 인지된 유용성에 매우 강력한 영향을 미치고 인지된 즐거움에 강력한 영향을 미친다.
  2. 시각적 매력은 인지된 즐거움에 매우 강력한 영향을 미친다.
  3. 자동화는 인지된 유용성에 강력한 영향을 미친다.[51]

논란

[편집]

인공지능 관련 논란

[편집]
  • 가상 비서는 필립 버블을 조장한다: 소셜 미디어와 마찬가지로, 가상 비서의 알고리즘은 소비자의 이전 활동을 기반으로 관련 데이터를 보여주고 나머지는 버리도록 훈련된다. 관련 데이터란 소비자가 관심을 가질 만하거나 즐거워할 만한 데이터다. 결과적으로 사용자는 자신의 견해와 상충되는 데이터로부터 소외되어 자신만의 지적 거품 속에 갇히게 되고 자신의 의견만을 강화하게 된다. 이 현상은 가짜뉴스반향실 효과를 강화하는 것으로 알려져 있다.[52]
  • 가상 비서는 가끔 실제보다 과대평가되었다는 비판을 받는다. 특히 안토니오 카실리는 가상 비서의 AI가 지능적이지도 인공적이지도 않다고 두 가지 이유를 들어 지적한다:
  1. 지능적이지 않은 이유는 그들이 하는 일은 인간의 비서 역할에 불과하며, 인간이 쉽게 할 수 있는 일들(정보, 제안 또는 문서의 검색, 분류, 제시 등)을 매우 제한적인 범위에서 수행하기 때문이다. 또한 가상 비서는 스스로 결정을 내리거나 상황을 예측할 수 없다.
  2. 인공적이지 않은 이유는 마이크로 워크를 통한 인간의 라벨링 없이는 불가능하기 때문이다.[53]
  • 가상 비서는 기본적으로 여성의 목소리와 인격을 갖는 경우가 많아 성 역할에 대한 논란을 불러일으킨다. J. 링겔과 K. 크로포드는 가상 비서가 비서라는 문화적 형상을 소환하여 보조적이고 유능하며 여성화된 종속적 역할을 체현한다고 주장한다.[54] 이러한 설계 선택은 누구의 이익이 우선시되는지를 반영하는 계층적 권력 구조에 봉사한다. 역사적으로 비서직은 여성에게는 종착점이었으나 남성에게는 경력 개발의 발판으로 활용될 수 있는 자리였다.[55] 따라서 이 논란은 여성 노동과 결부될 때 발생하는 노동 가치 절하에 대한 더 넓은 우려와 연결된다.[56]

윤리적 함의

[편집]

2019년 프랑스의 사회학자 안토니오 카실리는 인공지능과 가상 비서에 대해 다음과 같이 비판했다:

첫째로, 소비자가 종종 자신도 모르는 사이에 가상 비서의 훈련과 개선을 위해 무료 데이터를 제공한다는 사실은 윤리적으로 불편한 문제다.

하지만 둘째로, 이러한 AI들이 이 데이터를 통해 어떻게 훈련되는지를 아는 것은 훨씬 더 윤리적으로 충격적일 수 있다.

인공지능은 방대한 양의 레이블 데이터를 필요로 하는 인공신경망을 통해 훈련된다. 그러나 이 데이터는 인간의 과정을 거쳐 라벨링되어야 하며, 이것이 지난 10년 동안 마이크로 워크가 급증한 이유다. 즉, 전 세계의 사람들을 원격으로 고용하여 가상 비서의 음성 데이터를 듣고 받아쓰는 것과 같은 반복적이고 매우 단순한 작업을 단 몇 센트의 보수를 주고 시키는 것이다. 마이크로 워크는 그것이 초래하는 고용 불안정과 규제 부족으로 비판받아 왔다. 2010년 평균 임금은 시간당 1.38달러였으며,[57] 의료 보험, 퇴직금, 질병 수당, 최저임금 등도 제공되지 않는다. 따라서 가상 비서와 그 설계자들은 고용 불안을 조장한다는 점에서 논란의 여지가 있으며, 그들이 제안하는 AI는 수백만 명의 인간 노동자의 마이크로 워크 없이는 불가능하다는 점에서 여전히 인간적이다.[53]

개인정보 보호 문제는 음성 명령이 암호화되지 않은 형태로 가상 비서 제공자에게 노출될 수 있고, 이에 따라 제3자와 공유되거나 무단 또는 예상치 못한 방식으로 처리될 수 있다는 사실에서 발생한다.[58] 녹음된 음성의 언어적 내용 외에도 사용자의 표현 방식과 목소리 특성에는 생체 인식 신원, 성격 특성, 체형, 신체적 및 정신적 건강 상태, 성별, 기분과 감정, 사회경제적 지위 및 지리적 출신에 대한 정보가 암묵적으로 포함될 수 있다.[59]

가상 비서의 여성화

[편집]

Siri, 코타나, 알렉사와 같은 대부분의 가상 비서는 기본적으로 여성의 목소리와 인격을 특징으로 하는데, 이는 비서 업무의 노동 정치학 문제로 관심을 끈다. 이러한 가상 비서 목소리의 여성화는 여성 노동에 대한 뿌리 깊은 성적 편향에 대한 우려를 낳고, 사용자와 상호작용할 때 여성의 순종이라는 아이디어를 강화한다. 가상 비서로서 이러한 비서들은 여성이 보조적이고 위협적이지 않은 서비스 업무를 수행한다는 성 고정관념과 연결된다.[60]

학자들은 기술에서의 성별 기반 문제를 다루며 가상 비서의 여성화된 목소리에 주목한다. 성별 편향적인 기술은 여성의 대상화와 성 고정관념을 심화시킬 수 있고 성별 격차를 벌릴 수 있기 때문에 이는 중요한 관심사다. 또한 여성과 명령을 하나로 묶어버리는 무의식적 편향이 아이들과 성인들에게 고착화되면서 성차별적 서사를 강화한다는 우려도 있다.[61]

개발자 플랫폼

[편집]

가상 비서를 위한 주요 개발자 플랫폼은 다음과 같다:

  • 아마존 렉스(Amazon Lex)는 2017년 4월 개발자들에게 공개되었다. 이는 자동 음성 인식과 결합된 자연어 이해 기술을 포함하며 2016년 11월에 처음 소개되었다.[62]
  • 구글은 개발자들이 구글 어시스턴트를 위한 "액션"을 만들 수 있도록 Actions on GoogleDialogflow 플랫폼을 제공한다.[63]
  • 애플은 개발자들이 Siri용 확장 프로그램을 만들 수 있도록 SiriKit을 제공한다.
  • IBM왓슨은 때때로 가상 비서로 언급되기도 하지만, 실제로는 일부 가상 비서, 챗봇 및 다양한 유형의 솔루션을 구동하는 전체 인공지능 플랫폼이자 커뮤니티다.[64][65]

이전 세대

[편집]

이전 세대의 텍스트 채팅 기반 가상 비서에서는 비서가 종종 아바타(즉, 인터랙티브 온라인 캐릭터 또는 자동화 캐릭터)로 표현되었으며, 이는 체현된 에이전트로 알려졌다.

경제적 관련성

[편집]

개인 측면

[편집]

가상 비서에 의해 가능해진 디지털 경험은 최근의 주요 기술 발전이자 가장 유망한 소비자 트렌드 중 하나로 간주된다. 전문가들은 디지털 경험이 '실제' 경험에 필적하는 지위를 갖게 되거나, 오히려 더 많은 선호와 가치를 얻게 될 것이라고 주장한다.[66] 이러한 경향은 높은 이용자 빈도와 전 세계 가상 디지털 비서 사용자 수의 상당한 성장으로 입증된다. 2017년 중반 기준으로 전 세계 디지털 가상 비서의 빈번한 사용자 수는 약 10억 명으로 추산된다.[67] 또한 가상 디지털 비서 기술은 더 이상 스마트폰 애플리케이션에 국한되지 않고 자동차, 통신, 소매, 의료 및 교육을 포함한 많은 산업 분야에 존재한다.[68] 모든 부문의 기업들이 지출하는 상당한 연구개발비와 모바일 기기의 구현 증가에 힘입어, 음성 인식 기술 시장은 2016년부터 2024년까지 전 세계적으로 연평균 34.9%의 성장률(CAGR)을 보이며 2024년까지 75억 달러 규모를 넘어설 것으로 예측된다.[68] Ovum의 연구에 따르면 "네이티브 디지털 비서 설치 기반"은 2021년까지 활성 음성 AI 가능 기기 수가 75억 대에 달해 세계 인구수를 추월할 것으로 예상된다.[69] Ovum에 따르면 그 시점까지 "구글 어시스턴트가 23.3%의 시장 점유율로 음성 AI 가능 기기 시장을 지배할 것이며, 삼성 빅스비(14.5%), 애플 Siri(13.1%), 아마존 알렉사(3.9%), 마이크로소프트 코타나(2.3%)가 그 뒤를 이을 것"이다.[69]

시장 선도 기업의 지역적 분포를 고려할 때, BYOD(내 기기 가져오기) 및 기업용 모빌리티 비즈니스 모델의 상당한 영향으로 향후 몇 년간 북미 기업(예: 뉘앙스 커뮤니케이션즈, IBM, eGain)이 산업을 지배할 것으로 예상된다. 또한 스마트폰 지원 플랫폼에 대한 수요 증가는 북미 지능형 가상 비서(IVA) 산업 성장을 더욱 촉진할 것으로 보인다. 북미 시장에 비해 규모는 작지만, 인도와 중국에 주요 업체가 있는 아시아 태평양 지역의 지능형 가상 비서 산업은 2016~2024년 기간 동안 연평균 40%(전 세계 평균 이상)의 성장률을 기록할 것으로 예측된다.[68]

기업의 경제적 기회

[편집]

가상 비서는 개인을 위한 가젯으로만 보아서는 안 되며, 기업에 실질적인 경제적 유용성을 가질 수 있다. 예를 들어 가상 비서는 백과사전적 지식을 갖춘 상시 대기 비서 역할을 수행할 수 있다. 회의를 조직하고, 재고를 확인하며, 정보를 검증할 수 있다. 가상 비서가 중소기업에 통합되는 것은 종종 보다 글로벌한 사물인터넷(IoT)의 적응과 사용을 향한 쉬운 첫 단계라는 점에서 더욱 중요하다. 실제로 IoT 기술은 중소기업들에게 매우 중요하지만 사용하기에는 너무 복잡하고 위험하며 비용이 많이 드는 기술로 인식되곤 한다.[70]

보안

[편집]

2018년 5월, 캘리포니아 대학교 버클리의 연구원들은 인간의 귀로는 감지할 수 없는 음성 명령을 음악이나 구어 텍스트에 직접 삽입하여 사용자가 알아채지 못하게 가상 비서를 조종해 특정 동작을 수행하게 할 수 있다는 논문을 발표했다.[71] 연구원들은 오디오 파일에 미세한 변화를 주어 음성 인식 시스템이 감지하도록 되어 있는 사운드 패턴을 상쇄했다. 대신 시스템에 의해 다르게 해석될 소리들로 대체하여 전화번호를 걸거나, 웹사이트를 열거나, 심지어 돈을 송금하도록 명령했다.[71] 이러한 가능성은 2016년부터 알려져 왔으며,[71] 애플, 아마존, 구글의 기기들에 영향을 미친다.[72]

의도하지 않은 행동과 음성 녹음 외에도 지능형 가상 비서와 관련된 또 다른 보안 및 개인정보 위험은 악의적인 음성 명령이다. 공격자가 사용자를 사칭하여 악의적인 음성 명령을 내려, 예를 들어 스마트 도어를 열어 집이나 차고에 무단 침입하거나 사용자가 모르는 사이에 온라인으로 물건을 주문할 수 있다. 비록 일부 IVA는 이러한 사칭을 방지하기 위해 음성 학습 기능을 제공하지만, 시스템이 유사한 목소리를 구별하는 것은 어려울 수 있다. 따라서 IVA 기능이 활성화된 기기에 접근할 수 있는 악의적인 인물은 시스템을 속여 자신이 실제 소유자인 것처럼 행동하게 하여 범죄나 짓궂은 행위를 저지를 수 있다.[73]

주요 비서 비교

[편집]
지능형 개인 비서 개발사 자유 소프트웨어 오픈 소스 하드웨어 HDMI 출력 외부 I/O IOT 크롬캐스트 통합 스마트폰 앱 상시 작동 기기 간 음성 채널 스킬 언어
알렉사 (일명 에코) 아마존 아니요 아니요 아니요 아니요 아니요 ? JavaScript
알리사 얀덱스 아니요 빈칸 빈칸 빈칸 아니요 빈칸 ?
AliGenie 알리바바 그룹 아니요 아니요 빈칸 빈칸 아니요 빈칸 ?
어시스턴트 Speaktoit 아니요 빈칸 빈칸 빈칸 아니요 아니요 아니요 빈칸 ?
빅스비 삼성전자 아니요 빈칸 빈칸 빈칸 아니요 아니요 빈칸 빈칸 JavaScript
블랙베리 어시스턴트 블랙베리 아니요 빈칸 빈칸 빈칸 아니요 아니요 아니요 빈칸 ?
브라이나 Brainasoft 아니요 빈칸 빈칸 빈칸 아니요 아니요 아니요 빈칸 ?
클로바 네이버 아니요 빈칸 빈칸 빈칸 아니요 빈칸 ?
코타나 마이크로소프트 아니요 빈칸 빈칸 빈칸 아니요 빈칸 ?
두어 바이두[74]
Evi 아마존True Knowledge 아니요 빈칸 빈칸 빈칸 아니요 아니요 아니요 빈칸 ?
구글 어시스턴트 구글 아니요 빈칸 빈칸 빈칸 빈칸 C++
구글 나우 구글 아니요 빈칸 빈칸 빈칸 빈칸 ?
마이크로프트[75] Mycroft AI Python
SILVIA Cognitive Code 아니요 빈칸 빈칸 빈칸 아니요 아니요 아니요 빈칸 ?
Siri 애플 아니요 아니요 빈칸 빈칸 아니요 빈칸 ?
Viv 삼성전자 아니요 빈칸 빈칸 빈칸 아니요 아니요 빈칸 ?
샤오웨이 텐센트 ?
셀리아 화웨이 아니요 아니요 빈칸 빈칸 아니요 빈칸 ?

같이 보기

[편집]

각주

[편집]
  1. Hoy, Matthew B. (2018). Alexa, Siri, Cortana, and More: An Introduction to Voice Assistants. Medical Reference Services Quarterly 37. 81–88쪽. doi:10.1080/02763869.2018.1404391. PMID 29327988. S2CID 30809087.
  2. Siri vs Alexa vs Google Assistant vs Bixby: Which one reigns supreme?. Android Authority. 2024년 1월 29일.
  3. The Magic of Virtual Assistants and Their Impact on Customer Service.
  4. 1 2 The One Thing You Should Definitely be Using AI Chatbot for. 2023년 4월 7일.
  5. A.I. Means everyone gets a 'white-collar' personal assistant, Bill Gates says.
  6. Chat GPT: What is it? (미국 영어). uca.edu. 2024년 2월 8일에 확인함.
  7. US 1209636, Christian Berger, "Sound-Operated Circuit Controller", issued 1916-12-19, assigned to Submarine Wireless Company
  8. Markowitz, Judith. Toys That Have a Voice. SpeechTechMag.
  9. Moskvitch, Katia (2017년 2월 15일). The machines that learned to listen. BBC. 2020년 5월 5일에 확인함.
  10. Epstein, J; Klinkenberg, W. D (2001년 5월 1일). From Eliza to Internet: a brief history of computerized assessment. Computers in Human Behavior 17. 295–314쪽. doi:10.1016/S0747-5632(01)00004-8. ISSN 0747-5632.
  11. Weizenbaum, Joseph (1976). Computer power and human reason : from judgment to calculation. Oliver Wendell Holmes Library Phillips Academy. San Francisco : W. H. Freeman.
  12. The $15,000 A.I. From 1983. YouTube. 2024년 3월 6일.
  13. Smartphone: your new personal assistant – Orange Pop. 2017년 7월 10일. 2017년 7월 10일에 원본 문서에서 보존된 문서. 2020년 5월 5일에 확인함.
  14. Murph, Darren (2011년 10월 4일). iPhone 4S hands-on!. Engadget.com. 2017년 12월 10일에 확인함.
  15. Feature: Von IBM Shoebox bis Siri: 50 Jahre Spracherkennung – WELT [From IBM Shoebox to Siri: 50 years of speech recognition] (독일어). Die Welt (Welt.de). 2012년 4월 20일. 2017년 12월 10일에 확인함.
  16. Cipriani, Jason; Jacobsson Purewal, Sarah (2017년 11월 27일). The complete list of Siri commands (영어). CNET. 2025년 8월 7일에 확인함.
  17. Kundu, Kishalaya (2023). Amazon expands Echo lineup with new smart speaker, earbuds, and more. XDA. 2023년 5월 26일에 확인함.
  18. Miller, Ron (2016년 9월 18일). Salesforce Einstein delivers artificial intelligence across the Salesforce platform (미국 영어). TechCrunch. 2025년 8월 7일에 확인함.
  19. Schmeiser, Lisa; Vartabedian, Matt (2024년 9월 12일). Salesforce Debuts Einstein Successor Agentforce (영어). www.nojitter.com. 2025년 8월 7일에 확인함.
  20. Sterling, Bruce (2020년 2월 13일). Web Semantics: Microsoft Project Turing introduces Turing Natural Language Generation (T-NLG). Wired. ISSN 1059-1028. 2020년 7월 31일에 확인함.
  21. Gupta, Aman (2023년 3월 21일). GPT-4 takes the world by storm - List of companies that integrated the chatbot. mint.
  22. Conversica Raises $31 Million in Series C Funding to Fuel Expansion of Conversational AI for Business. Bloomberg.com. 2018년 10월 30일. 2020년 10월 23일에 확인함.
  23. Herrera, Sebastian (2019년 9월 26일). Amazon Extends Alexa's Reach Into Wearables. 월스트리트 저널. 2019년 9월 26일에 확인함.
  24. S7617 – Developing Your Own Wake Word Engine Just Like 'Alexa' and 'OK Google'. GPU Technology Conference. 2020년 11월 30일에 원본 문서에서 보존된 문서. 2017년 7월 17일에 확인함.
  25. Van Loo, Rory (2019년 3월 1일). Digital Market Perfection. Michigan Law Review 117. 815쪽. doi:10.36644/mlr.117.5.digital. S2CID 86402702.
  26. La, Lynn (2017년 2월 27일). Everything Google Assistant can do on the Pixel. CNET. 2017년 12월 10일에 확인함.
  27. Morrison, Maureen (2014년 10월 5일). Domino's Pitches Voice-Ordering App in Fast-Food First | CMO Strategy. AdAge. 2017년 12월 10일에 확인함.
  28. O'Shea, Dan (2017년 1월 4일). LG introduces smart refrigerator with Amazon Alexa-enabled grocery ordering. Retail Dive. 2017년 12월 10일에 확인함.
  29. Gibbs, Samuel (2017년 2월 7일). Amazon's Alexa escapes the Echo and gets into cars | Technology. The Guardian. 2017년 12월 10일에 확인함.
  30. What is Google Assistant, how does it work, and which devices offer it?. Pocket-lint. 2017년 10월 6일. 2017년 12월 10일에 확인함.
  31. 'Ask Jenn', Alaska Airlines website. Alaska Airlines. 2017년 1월 2일. 2017년 12월 10일에 확인함.
  32. AT&T Tech Channel (2013년 6월 26일). "American Airlines (US Airways) – First US Airline to Deploy Natural Language Speech" (video), Nuance Enterprise on YouTube. 2025년 10월 13일에 원본 문서에서 보존된 문서. 2017년 12월 10일에 확인함 YouTube 경유. YouTube title: Airline Information System, 1989 – AT&T Archives – speech recognition
  33. Martin, Taylor; Priest, David (2017년 9월 10일). The complete list of Alexa commands so far. CNET. 2017년 12월 10일에 확인함.
  34. Kongthon, Alisa; Sangkeettrakarn, Chatchawal; Kongyoung, Sarawoot; Haruechaiyasak, Choochart (2009년 1월 1일). Implementing an online help desk system based on conversational agent. Proceedings of the International Conference on Management of Emergent Digital EcoSystems. MEDES '09. New York, NY, USA: ACM. 69:450–69:451쪽. doi:10.1145/1643823.1643908. ISBN 9781605588292. S2CID 1046438.
  35. O'Donnell, Anthony (2010년 6월 3일). Aetna's new "virtual online assistant". Insurance & Technology. 2010년 6월 7일에 원본 문서에서 보존된 문서.
  36. How to prepare your products and brand for conversational commerce. VentureBeat. 2018년 3월 6일. 2020년 9월 29일에 원본 문서에서 보존된 문서. 2018년 3월 14일에 확인함.
  37. Taylor, Glenn (2018년 3월 5일). Retail's Big Opportunity: 87% Of U.S. Consumers Grasp The Power Of Conversational Commerce – Retail TouchPoints.
  38. Anvoa. Central Florida Startup Turns Missed Calls Into Booked Revenue With Human-Grade AI Voice Receptionists. PRLog. 2026년 1월 17일에 확인함.
  39. Zhang, Guoming; Yan, Chen; Ji, Xiaoyu; Zhang, Tianchen; Zhang, Taimin; Xu, Wenyuan (2017). DolphinAttack. Proceedings of the 2017 ACM SIGSAC Conference on Computer and Communications Security - CCS '17. 103–117쪽. arXiv:1708.09537. doi:10.1145/3133956.3134052. ISBN 9781450349468. S2CID 2419970.
  40. Lei, Xinyu; Tu, Guan-Hua; Liu, Alex X.; Li, Chi-Yu; Xie, Tian (2017). The Insecurity of Home Digital Voice Assistants – Amazon Alexa as a Case Study. arXiv:1712.03327 [cs.CR].
  41. Doing more to protect your privacy with the Assistant (영어). Google. 2019년 9월 23일. 2020년 2월 27일에 확인함.
  42. Alexa, Echo Devices, and Your Privacy. Amazon.com. 2020년 2월 27일에 확인함.
  43. Improving Siri's privacy protections (영어). Apple Newsroom. 2020년 2월 27일에 확인함.
  44. Soper, Mark Edward (2015년 8월 20일). Easy Windows 10 (영어). Addison-Wesley. ISBN 978-0-13-407753-6.
  45. López, Gustavo; Quesada, Luis; Guerrero, Luis A. (2018). Alexa vs. Siri vs. Cortana vs. Google Assistant: A Comparison of Speech-Based Natural User Interfaces (영어). Nunes, Isabel L. (편집). Advances in Human Factors and Systems Interaction. Advances in Intelligent Systems and Computing 592. Cham: Springer International Publishing. 241–250쪽. doi:10.1007/978-3-319-60366-7_23. hdl:10669/74729. ISBN 978-3-319-60366-7.
  46. Customer care with AI Chatbot. lucidgen.com. 2023년 4월 25일. 2024년 10월 14일에 확인함.
  47. End of support for Cortana - Microsoft Support. support.microsoft.com. 2024년 10월 14일에 확인함.
  48. Forrest, Conner (2015년 8월 4일). Windows 10 violates your privacy by default, here's how you can protect yourself (미국 영어). TechRepublic. 2024년 10월 14일에 확인함.
  49. Minker, W.; Néel, F. (2002). Développement des technologies vocales. Le Travail Humain 65. 261쪽. doi:10.3917/th.653.0261. ISSN 0041-1868.
  50. Wajcman, Judy (2019). The Digital Architecture of time Management (PDF). Science, Technology, & Human Values 44. 315–337쪽. doi:10.1177/0162243918795041. S2CID 149648777.
  51. Yang, Heetae; Lee, Hwansoo (2018년 6월 26일). Understanding user behavior of virtual personal assistant devices. Information Systems and E-Business Management 17. 65–87쪽. doi:10.1007/s10257-018-0375-1. ISSN 1617-9846. S2CID 56838915.
  52. Tisseron, Serge (2019). La famille sous écoute. L'École des Parents 632. 16–18쪽. doi:10.3917/epar.632.0016. ISSN 0424-2238. S2CID 199344092.
  53. 1 2 Casilli, Antonio A. (2019). En attendant les robots. Enquête sur le travail du clic.. Editions Seuil. ISBN 978-2-02-140188-2. OCLC 1083583353.
  54. Lingel, Jessa; Crawford, Kate (2020년 5월 15일). Alexa, Tell Me about Your Mother": The History of the Secretary and the End of Secrecy (영어). Catalyst: Feminism, Theory, Technoscience 6. 1쪽. doi:10.28968/cftt.v6i1.29949. ISSN 2380-3312.
  55. Lingel, Jessa; Crawford, Kate (2020년 5월 15일). Alexa, Tell Me about Your Mother": The History of the Secretary and the End of Secrecy (영어). Catalyst: Feminism, Theory, Technoscience 6. 7쪽. doi:10.28968/cftt.v6i1.29949. ISSN 2380-3312.
  56. Mulvaney, Kelly (2013년 6월 20일). For what it's worth: An examination of the persistent devaluation of "women's work" in capitalism and considerations for feminist politics. GENDER 5. 9–10쪽. doi:10.3224/gender.
  57. Horton, John Joseph; Chilton, Lydia B. (2010). The labor economics of paid crowdsourcing. Proceedings of the 11th ACM conference on Electronic commerce. EC '10. New York, New York, USA: ACM Press. 209–218쪽. arXiv:1001.0627. doi:10.1145/1807342.1807376. ISBN 978-1-60558-822-3. S2CID 18237602.
  58. Apple, Google, and Amazon May Have Violated Your Privacy by Reviewing Digital Assistant Commands. Fortune. 2019년 8월 5일. 2020년 5월 13일에 확인함.
  59. Kröger, Jacob Leon; Lutz, Otto Hans-Martin; Raschke, Philip (2020). Privacy Implications of Voice and Speech Analysis – Information Disclosure by Inference. Privacy and Identity Management. Data for Better Living: AI and Privacy. IFIP Advances in Information and Communication Technology 576. 242–258쪽. doi:10.1007/978-3-030-42504-3_16. ISBN 978-3-030-42503-6. ISSN 1868-4238.
  60. Linge, Jessa; Crawford, Kate (2020년 5월 15일). Alexa, Tell Me about Your Mother" The History of the Secretary and the End of Secrecy. Catalyst: Feminism, Theory, Technoscience 6. 1–22쪽. doi:10.1016/j.dcm.2024.100833.
  61. Sindoni, Maria Grazia (December 2024). The femininization of AI-powered voice assistants: Personification, anthropomorphism and discourse ideologies. Discourse, Context & Media 62 (Elsevier). doi:10.1016/j.dcm.2024.100833.
  62. Amazon Lex, the technology behind Alexa, opens up to developers. TechCrunch. 2017년 4월 20일. 2017년 12월 10일에 확인함.
  63. Actions on Google | Google Developers. 2017년 12월 10일에 확인함.
  64. Watson – Stories of how AI and Watson are transforming business and our world. Ibm.com. 2017년 12월 10일에 확인함.
  65. Memeti, Suejb; Pllana, Sabri (January 2018). PAPA: A parallel programming assistant powered by IBM Watson cognitive computing technology. Journal of Computational Science 26. 275–284쪽. doi:10.1016/j.jocs.2018.01.001.
  66. 5 Consumer Trends for 2017. TrendWatching. 2016년 10월 31일. 2017년 12월 10일에 확인함.
  67. Richter, Felix (2016년 8월 26일). Chart: Digital Assistants – Always at Your Service. Statista. 2017년 12월 10일에 확인함.
  68. 1 2 3 Virtual Assistant Industry Statistics. Global Market Insights. 2017년 1월 30일. 2017년 12월 10일에 확인함.
  69. 1 2 Virtual digital assistants to overtake world population by 2021 (영어). ovum.informa.com. 2018년 5월 11일에 확인함.
  70. Jones, Nory B.; Graham, C. Matt (February 2018). Can the IoT Help Small Businesses?. Bulletin of Science, Technology & Society 38. 3–12쪽. doi:10.1177/0270467620902365. ISSN 0270-4676. S2CID 214031256.
  71. 1 2 3 Alexa and Siri Can Hear This Hidden Command. You Can't. (미국 영어). The New York Times. 2018년 5월 10일. ISSN 0362-4331. 2018년 5월 11일에 확인함.
  72. As voice assistants go mainstream, researchers warn of vulnerabilities (영어). CNET. 2018년 5월 10일. 2018년 5월 11일에 확인함.
  73. Chung, H.; Iorga, M.; Voas, J.; Lee, S. (2017). Alexa, Can I Trust You?. Computer 50. 100–104쪽. doi:10.1109/MC.2017.3571053. ISSN 0018-9162. PMC 5714311. PMID 29213147.
  74. Baidu unveils 3 smart speakers with its Duer digital assistant. VentureBeat. 2018년 1월 8일. 2019년 4월 20일에 원본 문서에서 보존된 문서. 2018년 8월 28일에 확인함.
  75. MSV, Janakiram (2015년 8월 20일). Meet Mycroft, The Open Source Alternative To Amazon Echo. Forbes. 2016년 10월 27일에 확인함.