[SOH] 애플이 주변 대화를 듣고 요약해 저장하는 스마트워치 기능을 내놓으면서 대화 상대방의 동의 문제가 새로운 사생활 쟁점으로 떠올랐다.
'컨스피러시뉴스'에 따르면 애플은 지난 9월 9일 신제품 발표 행사에서 애플워치 시리즈 12와 애플워치 울트라 4용 대화 처리 기능 ‘라이브 리와인드’와 ‘시리 리캡’을 공개했다. 두 기능은 애플의 인공지능 서비스 가운데 소리를 다루는 ‘오디오 인텔리전스’ 분야에 속하며, 올해 안에 영어를 시작으로 베타 버전이 배포된다.
애플은 두 기능 모두 착용자가 직접 켜야 작동하는 선택형이라고 강조했다. 하지만 착용자와 마주 앉아 이야기하는 상대방에게는 기능을 켜고 끌 선택권 자체가 없다. 라이브 리와인드가 작동하면 직전 15초 동안 오간 대화가 시계 화면에 글자로 나타난다. 착용자는 시계 옆면의 회전식 버튼인 디지털 크라운을 두 번 누르기만 하면 된다. 애플은 음성 처리가 시계에 내장된 S11 칩 안의 격리된 보안 영역에서만 이뤄지고, 원본 음성은 처리 직후 삭제된다고 설명했다.
기능이 작동할 때는 무음 모드에서도 알림음이 울리고 화면에 애니메이션과 마이크 표시가 함께 뜬다. 저장하거나 시리에 넘기지 않은 텍스트 조각은 화면이 어두워진 뒤 약 30초가 지나면 사라진다.
시리 리캡은 대화가 끝나면 그 내용을 제목과 핵심 요점, 짧은 요약으로 정리해 시리 앱에 보관한다. 착용자는 이 기능을 상시 켜 두거나, 정해진 시간에만 돌아가도록 예약하거나, 완전히 끌 수 있다. 처리 과정에는 시계와 연결된 아이폰이 동원된다. 아이폰이 대화를 받아 적어 압축하면, 암호화된 압축본이 애플의 자체 클라우드 인공지능 연산 시스템인 ‘프라이빗 클라우드 컴퓨트’로 전송돼 요약된 뒤 시계로 돌아온다. 요약본은 종단간 암호화를 거쳐 아이클라우드로 착용자의 여러 기기에 동기화되며, 애플은 자사도 이 데이터에 접근할 수 없고 원본 음성은 저장하지 않는다고 덧붙였다.
시리 리캡 요약본은 기본 설정에서 7일 뒤 자동으로 삭제된다. 착용자가 요약본을 저장하거나 외부로 내보내면 이 기한은 적용되지 않고, 기록은 제한 없이 남는다. 요약에는 대화 중 언급된 사람의 이름이 들어갈 수 있으며, 누가 어떤 말을 했는지는 구분하지 않는다.
애플은 금융 정보나 신분증 번호 같은 민감 정보를 걸러내도록 설계했지만 이 장치가 늘 제대로 작동하지는 않을 수 있다고 인정했다. 고객지원 문서에도 요약과 텍스트 조각이 불완전하거나 부정확할 수 있다는 안내가 실렸다. 누군가의 말이 부정확하게 요약된 기록이 당사자도 모르는 사이 기한 없이 보관될 수 있는 구조다.
미국 캘리포니아주를 비롯한 일부 주는 대화를 녹음하려면 참여자 전원의 동의를 받도록 법으로 정하고 있다. 한국의 통신비밀보호법은 대화 당사자의 녹음은 허용하지만 공개되지 않은 타인 간의 대화를 녹음하거나 청취하는 행위를 금지한다. 상시 모드의 시리 리캡은 착용자가 끼어 있지 않은 옆자리 대화까지 받아 적고 요약할 수 있다.
원본 음성을 남기지 않고 글자로 바꿔 요약만 저장하는 방식이 법이 금지하는 청취에 해당하는지는 아직 다뤄진 적 없는 쟁점이다. 지금은 영어만 지원되지만 한국어 지원이 시작되면 같은 문제가 국내에서도 불거질 수밖에 없다.
애플은 시리 리캡 요약본을 대화 뒤에 적어 두는 메모와 비슷하다고 소개한다. 그러나 사람의 불완전한 기억과, 기계가 음성을 받아 적고 처리해 무기한 저장할 수 있는 디지털 요약 사이에는 큰 차이가 있다.
과거에는 사적인 대화를 기록하려면 녹음기를 꺼내거나 메모 앱을 여는 의도적인 행동이 필요했지만, 이제는 손목 위의 시계가 그 일을 조용히 대신한다. 인공지능이 휴대전화와 시계를 넘어 안경, 자동차, 텔레비전으로 파고드는 지금, 질문은 내 기기가 나를 엿듣는가를 넘어 다른 사람의 기기가 내 말을 듣고 있는가로 옮겨 가고 있다.
■ 애플만 그럴까?
물론 애플만 이런 것은 아니다. 사실상 글로벌 빅테크 기업 전체가 '실시간 대화 인지'와 'AI 자동 요약'을 차세대 기기의 스탠다드(기본 사양)로 밀어붙이고 있다.
삼성전자 역시 갤럭시 AI의 '텍스트 변환 어시스트' 기능으로 대화나 회의 녹음 시 최대 10명의 화자를 분리하고, 그 요약본을 스마트폰에 기간 제한 없이 저장하는 기술을 이미 일상화했다. 비록 사용자가 직접 녹음 버튼을 눌러야 작동하는 방식이지만, 한 번 녹음된 타인의 목소리가 동의 없이 요약본 형태로 누군가의 기기에 평생 남을 수 있는 점은 마찬가지다.
구글 역시 자사 하드웨어 브랜드인 '픽셀(Pixel) 폰'과 '픽셀 워치'에 AI 비서인 '제미나이 라이브(Gemini Live)'를 탑재해, 기기가 주변 맥락과 대화를 실시간으로 인지하고 분석하는 환경을 구축해 나가고 있다.
시각적 요소까지 결합된 메타(Meta)의 스마트 안경은 한 걸음 더 나아간다. 착용자가 마주 앉은 상대를 바라보는 것만으로도 상대방의 음성과 얼굴 데이터가 AI 연산 시스템으로 전송된다. 최소한의 작동 알림음이나 LED 표시등이 존재하지만, 상대방이 이를 쉽게 인지하기 어렵다는 한계는 모든 기기가 안고 있는 문제다.
이들 기업이 내세우는 방어 논리 역시 애플의 주장과 궤를 같이한다. "원본 음성은 처리 즉시 삭제하며, 텍스트 요약본만 남기기 때문에 안전하다"는 것이다. 그러나 이는 기존 법적 규제의 맹점을 파고든 기술적 우회책에 가깝다.
국내 통신비밀보호법을 비롯한 전 세계 도청 관련 법률은 기본적으로 '음성 원본의 녹음과 청취'를 처벌 기준으로 삼는다. 소리를 실시간으로 가로채 글자로 바꾼 뒤 무기한 저장하는 이 '새로운 형태의 기록'이 법이 금지하는 도청에 해당하는지는 아직 법조계조차 명확한 답을 내리지 못한 공통의 회색지대다.
결국 편리함이라는 명분 아래, 내가 모르는 사이 타인의 손목(애플·삼성)과 타인의 시선(메타)에 의해 내 발언이 불완전하게 요약되어 기록으로 남는 사생활 침해 우려는 단순한 사생활 노출을 넘어 디지털 전체주의를 경계하는 사회적 시선의 주목이 요구된다.
디지털뉴스팀
(ⓒ SOH 희망지성 국제방송 soundofhope.kr)