콤퓨타이슈 자동차·가전·안경으로 확장되는 생성형 AI, 최근 발표로 본 생활형 디바이스의 변화
Tesla Grok의 차량 제어부터 삼성의 기존 가전 업데이트, Meta의 AI 안경까지. 대화·시각 인식·기능 실행이 일상 제품에 결합되는 현황을 살펴본다.
페이지 정보
본문
작성일
자동차에 목적지를 설명하던 대화가 음악 재생과 온도 조절로 이어진다. 냉장고는 소프트웨어 업데이트로 더 다양한 식재료를 인식하고, 안경 제조사는 사용자가 바라보는 대상을 개인 AI 에이전트의 작업에 연결하겠다고 발표한다. 생성형 AI가 생활형 디바이스에 들어오는 방식이 제품별로 구체화되고 있다.
최근 발표의 변화는 ‘AI 탑재’라는 문구만으로는 잘 드러나지 않는다. 어떤 제품은 음성 대화의 문맥을 실제 기능 실행에 연결하고, 어떤 제품은 카메라로 확보한 정보를 활용한다. 또 어떤 회사는 이미 판매한 기기에 새로운 AI 기능을 배포하고 있다. 사용자가 AI 서비스를 따로 실행해 질문하는 방식에 더해, 평소 사용하는 제품에서 AI를 호출하는 접점이 늘어나는 상황이다.
특히 9월에는 삼성전자의 기존 가전 업데이트, Google의 새로운 실시간 음성 모델, Grok의 음성 인식 모델 개선, Meta의 AI 안경·개인 에이전트 연결 발표가 이어졌다. 앞서 자동차 업계가 공개한 자연어 기반 기능 실행 사례와 함께 보면, 무엇이 새로 추가되고 있으며 실제 사용 범위는 어디까지인지 구분할 수 있다.
기능 실행: Tesla Grok은 길 안내·전화·미디어·공조 등과 연결된다. BMW와 GM도 대화 맥락을 반영하는 차량 인터페이스를 도입하거나 배포 계획을 발표했다.
기존 제품의 확장: 삼성전자는 9월부터 일부 기존 냉장고와 세탁 가전에 Tizen 10.0 기반 업데이트를 순차 제공한다고 밝혔다.
착용형 AI: Meta는 Connect 2026에서 AI 안경에 개인 에이전트 Muse를 연결하는 계획과 새 안경 제품군을 공개했다.
음성 기술의 변화: 최근 모델 발표에서는 대화를 이어가며 도구를 호출하는 기능과 소음·다국어 환경의 음성 인식 개선이 함께 제시됐다.
01. Tesla Grok이 보여주는 변화는 ‘말투’보다 넓다
Tesla의 차량용 Grok은 운전자가 AI의 목소리와 성격(Personality)을 고를 수 있게 한다. 공식 문서에 등장하는 Storyteller와 Unhinged 같은 선택지는, 자동차의 음성 인터페이스가 정해진 안내문을 읽는 기능에만 머물지 않는다는 점을 보여준다. 이용자는 어떤 방식으로 대화할지도 선택한다.
그러나 이 사례의 중심은 독특한 말투만이 아니다. Tesla는 Grok의 지원 기능으로 내비게이션, 전화, 음악 검색·재생, 실내 온도 조절, 글로브박스 열기 등을 안내하고 있다. 질문에 답하는 AI와 차량의 소프트웨어 기능이 하나의 음성 접점에 연결돼 있다.
8월 19일 공개된 Grok Voice의 Tesla 적용 사례에서는 여러 경유지가 포함된 이동 요청을 소개한다. 운전자가 귀가 중 장을 보고 아이를 수영 연습 장소에 데려다주는 일정을 설명하면, Grok이 관련 장소와 주소를 찾고 경유지를 구성한다는 내용이다. 회사는 같은 인터페이스에서 공조나 미디어 기능도 이용할 수 있다고 설명한다.
사용자가 직접 장소 검색 결과를 확인하고 주소를 옮겨 적고 경유지를 추가하던 조작을 자연어 요청으로 연결하는 사례다. 여기에서 변화하는 것은 자동차의 주행 원리가 아니라 목적과 조건을 소프트웨어 기능에 전달하는 방식이다. 경유지 설정과 조향·가속·제동을 수행하는 자율주행은 별개의 기능이다.
실행 권한도 대화 설정에 따라 다르다. Tesla 매뉴얼은 차량 명령을 수행하려면 Assistant 성격을 선택해야 하며, 다른 성격은 일반 대화만 지원한다고 명시한다. 대화의 성향과 기기 조작 권한이 제품 설정에서 나뉘어 있는 것이다. 기존 음성 명령도 그대로 유지된다.
Grok은 현재 베타로 제공된다. 공식 지원 문서가 제시한 기본 요건은 AMD 프로세서, 차량 소프트웨어 2025.26 이상, Premium Connectivity 또는 Wi-Fi 연결이다. 실제 기능은 차량 구성과 시장에 따라 달라진다. 따라서 ‘차량에 AI가 들어간다’는 표현은 차량 내부에서 모든 AI 계산을 수행한다는 뜻과도 구별해야 한다.
근거: Tesla 지원 안내 · 차량 매뉴얼 · Grok Voice 차량 적용 사례
02. BMW·GM은 기존 차량으로, Mercedes-Benz·Volkswagen은 차량 내부 처리로
차량용 AI 도입은 회사마다 서로 다른 경로를 택하고 있다. 기존 음성비서를 생성형 AI로 확장하는 사례, 이미 판매한 차량에 업데이트하는 사례, 차량 내부에서 AI를 실행하기 위한 설계를 마련하는 사례가 함께 등장한다. 같은 ‘차량용 AI’라도 적용 대상과 계산 위치가 다르다.
BMW: 목적지와 조건을 대화로 전달
BMW는 Amazon Alexa+의 일부 기능을 BMW 지능형 개인 비서(BMW Intelligent Personal Assistant)에 통합했다. 공식 설명에 따르면 이용자가 이동 계획을 자유롭게 말하고 필요한 배경을 덧붙이면, 시스템이 원하는 목적지를 내비게이션에 전달한다. 여러 정류장을 포함한 경로도 자연어로 구성할 수 있다.
BMW는 5월 말부터 기존 iX3 차량에 소프트웨어 업데이트로 해당 기능을 도입했다고 밝혔다. 하반기에는 BMW Operating System 9와 X를 사용하는 추가 모델에 순차 확대하는 계획이다. 초기 시장은 독일과 미국이며 영어·독일어 버전을 소개했다. 신차 발표에만 포함되는 기능이 아니라 지원되는 기존 차량의 인터페이스도 바꾸는 업데이트라는 점이 구체적인 변화다.
GM: 약 400만 대를 Gemini 업데이트 대상으로 제시
GM이 4월 28일 발표한 대상은 Google built-in을 지원하는 2022년형 이후 Cadillac·Chevrolet·Buick·GMC 차량이다. 회사는 미국 약 400만 대가 업데이트 대상이라고 밝혔다. 이는 설치 완료 대수가 아니라 적용 가능한 차량의 규모이며, 배포는 여러 달에 걸쳐 진행하도록 안내했다.
GM이 제시한 예시에서는 가까운 카페를 찾으면서 가족에게 늦는다는 메시지를 보내고, 이어서 야외 좌석이 있는 카페로 조건을 바꾸는 요청이 등장한다. 음악 재생으로 화제를 바꾸는 대화도 같은 흐름에서 처리한다. 메시지 요약·수정·번역도 포함된다. 핵심은 명령의 개수보다 직전 요청의 대상을 유지하면서 조건을 수정할 수 있다는 점이다.
GM은 이 Gemini 업데이트와 자사 차량 데이터를 활용하는 더 깊은 통합형 AI 비서 계획을 따로 설명한다. Gemini가 들어간다는 사실만으로 차량의 모든 데이터와 제어 기능에 곧바로 접근하는 것은 아니다. 발표에 명시된 초기 조건에는 OnStar 연결, Google Play 로그인, 미국 영어 설정과 이용 동의가 포함된다.
Mercedes-Benz·Volkswagen: AI를 어디에서 실행할 것인가
Mercedes-Benz는 4월 23일 Liquid AI와의 협력을 발표하면서, 북미의 3·4세대 MBUX 탑재 모델을 대상으로 음성·언어 이해·추론의 주요 기능을 차량 내부에 넣는 방향을 제시했다. 기기 자체에서 처리하는 온디바이스 AI(On-device AI)를 통해 지연을 줄이고 지속적인 클라우드 데이터 교환에 대한 의존을 낮추겠다는 설명이다. 첫 양산 적용 목표는 하반기로 제시됐으며, 기존 클라우드 기반 모델을 보완하는 접근이다.
Volkswagen은 중국 시장용 전자 아키텍처인 CEA 기반 차량에 차내 대규모 언어 모델(LLM)을 사용하는 AI 에이전트를 도입하는 로드맵을 발표했다. 회사는 사용자의 의도를 해석해 여러 시스템에 걸친 작업을 실행하는 구조라고 설명한다. 2027년 CEA 2.0에는 운전·실내 경험·외부 서비스를 담당하는 에이전트를 조정하는 멀티 에이전트(Multi-Agent) 구조를 계획했다.
이들 발표는 대화 모델의 이름을 고르는 문제에 더해, 기존 차량에 어떻게 배포할지, 클라우드와 차내 처리를 어떻게 나눌지, 여러 기능을 어떤 소프트웨어 구조로 연결할지를 다룬다. 다만 Mercedes-Benz의 양산 목표와 Volkswagen의 차세대 구조는 발표된 계획으로, 그 일정 자체가 실제 배포 완료를 증명하지는 않는다.
근거: BMW · GM · Mercedes-Benz · Volkswagen 공식 발표
03. 삼성전자, 이미 판매한 냉장고와 세탁 가전의 AI 기능 확대
삼성전자는 9월 7일 일부 기존 냉장고와 세탁 가전에 Tizen 10.0 기반 업데이트를 순차 제공한다고 발표했다. 신제품을 구매하지 않아도 지원되는 하드웨어에서 새로운 기능을 받는 방식이다.
Google Gemini 기반 AI Vision의 대상은 카메라와 AI Vision을 갖춘 2021~2025년형 21.5·32인치 Family Hub와 일부 2025년형 9인치 냉장고다. 회사는 브랜드·지역별 포장식품을 포함해 식품 인식 범위를 넓힌다고 설명했다.
세탁 가전에서는 일부 2024·2025년형 세탁건조기·세탁기·건조기에 최신 Bixby 경험과 화면 개선을 제공한다. 완료 시점을 물으면 남은 시간을 문장으로 알려주는 대화가 예시로 제시됐다. 배포 시점과 기능은 국가·모델별로 다르다.
냉장고의 시각 인식과 세탁기의 상태 안내는 서로 다른 기능이다. 이번 발표는 모든 가전이 같은 생성형 모델로 움직인다는 의미보다, 기존 제품의 인식·대화 기능을 업데이트로 확장하는 구체적인 사례로 읽을 수 있다.
근거: 삼성전자 기존 가전 AI 소프트웨어 업데이트 발표
04. 스마트홈은 개별 기기 제어에서 생활 맥락의 연결로
여러 가전을 함께 사용하는 환경에서는 요청의 대상이 하나의 제품에 그치지 않는다. Google이 소개한 Gemini for Home의 활용 예시에는 조명을 어둡게 하면서 온도를 조절하는 요청, 침실을 제외한 집 안의 조명을 끄는 요청이 포함된다. 기기 이름을 하나씩 나열하는 대신 대상의 범위와 예외를 문장으로 설명하는 방식이다.
이 서비스는 지난해 발표된 뒤 지원 국가·언어의 스피커와 디스플레이를 대상으로 조기 이용 배포가 시작됐다. 현재 지원 문서는 해당 가정에 이용 가능 안내가 도착하면 전환할 수 있다고 설명한다. 기본 음성비서 기능과 Gemini Live 등 구독이 필요한 고급 기능은 제공 범위가 다르다. 따라서 최초 발표를 이번 달의 신제품 소식으로 볼 수는 없지만, 최근의 AI 홈 발표와 비교할 수 있는 실제 서비스 사례다.
LG전자가 IFA 2026에서 공개한 ThinQ Claw는 생활의 맥락을 더 직접적으로 다룬다. LG는 이를 문자 대화 기반 AI 에이전트 경험으로 소개했다. 사용자의 일정, 생활 패턴, 집 안 환경과 가전 사용 정보를 토대로 필요한 행동을 제안하고 관련 기기와 서비스를 연결하는 구조다.
LG가 제시한 사례에는 손님을 맞이할 때 조리기기를 관리하는 일, 귀가 전 실내 공기질과 온도를 확인하는 일이 있다. 캘린더 같은 생활 서비스와의 연계도 포함된다. 복잡한 자동화 규칙을 직접 작성하는 대신 계획이나 현재 상황을 대화로 전달하도록 설계했다는 설명이다. ThinQ Claw의 공개 범위는 IFA 전시·시연이며, 발표문은 전체 가전의 상용 배포 완료를 뜻하지 않는다.
두 사례가 다루는 차이는 요청의 범위에서 드러난다. 특정 방의 조명을 끄는 일은 기기 선택과 제어가 중심이다. 일정과 귀가 상황을 반영하는 일에는 기기 밖의 정보까지 연결된다. 대화 기능의 확장이 곧 연결 가능한 기기와 서비스의 확장 문제로 이어지고 있는 것이다.
근거: Gemini for Home 발표 · Google 현재 이용 안내 · LG IFA 2026 발표
05. Meta Connect의 새 발표: 안경에서 개인 에이전트를 부른다
9월 23일 열린 Meta Connect 2026에서는 자동차·가전과 다른 형태의 생활형 AI 접점이 제시됐다. Meta는 개인 AI 에이전트 Muse를 향후 수개월에 걸쳐 AI 안경에 연결하겠다고 발표했다. 안경을 통해 에이전트를 호출하고, 카메라로 보고 있는 대상을 작업의 맥락으로 전달하는 방향이다.
Meta가 제시한 예시에는 매장 진열대의 제품, 벽에 붙은 안내문, 학교 준비물 목록을 보며 에이전트에게 일을 요청하는 상황이 포함된다. 사용자가 눈앞의 내용을 길게 설명하거나 별도로 타이핑하는 과정을 줄이려는 구성이다. 회사는 대화를 이어가는 동안 에이전트가 백그라운드에서 작업하는 음성 모드도 소개했다.
외부 서비스를 연결하는 커넥터(Connector) 확대도 함께 발표했다. 쇼핑·결제·일상 업무 서비스를 에이전트가 이용할 수 있도록 연결하는 내용이다. 안경이 정보를 받아들이는 창구가 되고, 연결된 서비스가 작업을 수행하는 통로가 되는 구조다. 다만 이는 공개된 제품 방향과 제공 계획이며, 발표 시점에 안경에서 Muse의 모든 작업을 사용할 수 있다는 뜻은 아니다.
같은 행사에서 공개된 하드웨어도 이 접근을 보여준다. Ray-Ban Meta Audio는 음성 중심 모델로, 회사가 제시한 무게는 43g이다. 음악·통화·AI 대화를 지원하며 최대 12시간의 배터리 사용 시간을 안내했다. 미국 기준 349달러부터 사전 주문을 받고 10월 13일 배송 예정이라고 밝혔다.
카메라가 포함된 Ray-Ban Meta Gen 3에는 AI에 바로 접근하는 사용자 지정 액션 버튼이 추가됐다. Meta는 최대 9시간의 배터리, 6개 마이크, 12MP 카메라 등을 소개했고 미국 기준 449달러부터 판매한다고 발표했다. 이 수치는 제조사 발표 기준이다. 음성 중심 모델과 카메라 모델을 나누어 보면, 같은 ‘AI 안경’이라도 입력 수단과 가능한 활용이 다르다는 점을 알 수 있다.
안경 제품의 판매와 Muse 연결 일정 역시 별개다. 새로운 하드웨어를 구매할 수 있다는 사실이 발표된 모든 에이전트 기능의 즉시 이용을 뜻하지는 않는다. 이번 소식의 핵심은 스마트 안경이 통화·촬영 기기를 넘어 개인 에이전트에 접근하는 제품으로 확장되도록 설계되고 있다는 데 있다.
근거: Meta Connect 2026 주요 발표 · Ray-Ban Meta 새 제품군 발표
06. 스마트폰도 ‘AI 앱을 실행하는 기기’에서 역할을 넓힌다
스마트폰 역시 별도의 채팅 앱을 실행하는 통로에만 머무르지 않는다. Google은 9월 Android 업데이트 발표에서 Gemini와 Find Hub를 연결해 물건의 보관 위치를 기록하는 기능을 예고했다. 추적 태그를 붙이지 않은 여권이나 여분 열쇠도 어디에 두었는지 말하고 사진을 덧붙인 뒤, 나중에 질문하거나 목록에서 확인하는 방식이다.
이 기능은 물건이 움직인 위치를 자동 추적하는 기능과 다르다. 사용자가 알려준 보관 정보를 저장하고 다시 찾는 구성이다. 발표에서 제시한 대상은 Gemini와 Find Hub가 지원되는 국가의 Android 16 이상 기기이며, 출시 예정으로 안내됐다. 음성 요청이 답변 생성뿐 아니라 기기의 다른 서비스에 정보를 기록하는 동작으로 이어지는 사례다.
같은 발표의 Guided vision은 스마트폰 카메라를 Gemini Live와 연결한다. 시각장애·저시력 이용자를 고려해 식품 라벨의 작은 글씨, 어두운 곳의 메뉴, 집 안 물건 등을 설명하고, 카메라 방향이 맞지 않으면 다시 비추도록 음성으로 안내하는 기능이다. Google은 Android 9 이상과 지원 국가를 대상으로 제공을 예고했다.
기기의 설정을 자연어로 조작하는 사례도 있다. 삼성전자가 올해 2월 소개한 One UI 8.5의 새 Bixby는 이용자가 화면을 보고 있는 동안 꺼지지 않게 해 달라는 요구를 말하면 관련 설정을 켜는 식으로 동작한다. 정확한 메뉴 이름을 모르더라도 원하는 결과를 설명해 기능에 접근하도록 한 것이다.
최근 Android 발표와 앞선 Bixby 사례는 AI가 기기에서 맡는 서로 다른 역할을 보여준다. 보관 정보를 다른 서비스에 기록하는 역할, 카메라가 포착한 대상을 설명하는 역할, 기기 설정을 찾아 실행하는 역할이다. 이를 모두 ‘대화가 자연스러워졌다’는 말로 묶으면 실제로 추가된 기능의 차이를 놓치게 된다.
근거: Google 9월 Android 업데이트 · 삼성전자 Bixby 발표
07. 최근 음성 AI의 개선점: 대화 중 실행, 소음 속 인식, 시각적 맥락
제품의 변화와 함께 그 기반이 되는 음성 모델의 발표도 이어지고 있다. 최신 발표에서 확인할 수 있는 개선 대상은 단순히 더 자연스러운 목소리만이 아니다. 작업을 수행하는 동안 대화가 끊기지 않게 하는 기능, 짧고 시끄러운 발화를 정확히 받아들이는 기능, 사용자가 보고 있는 장면을 대화에 반영하는 기능이 함께 제시된다.
Grok Voice: 말하는 동안 추론하고 도구 호출
7월 29일 발표된 Grok Voice Think Fast 2.0은 음성을 출력하면서 추론을 병렬로 수행한다고 설명한다. 개발사는 추론 효율을 높여 실제 운영 환경에서 도구 호출이 대개 첫 문장이 끝나기 전에 이루어지도록 했다고 밝혔다. 사용자가 작업 결과를 기다리는 동안 길게 침묵하는 상황을 줄이려는 설계다.
대화 방식에 대한 학습도 공개했다. 짧은 문장을 사용하고 한 번에 하나씩 질문하며 불필요한 말을 줄이는 방향으로 강화학습을 적용했다는 내용이다. 차량이나 착용형 기기처럼 화면을 계속 보지 않는 환경에서는 무엇을 실행하는지 음성으로 전달하는 방식 자체가 제품 사용 경험에 포함된다.
9월의 음성 인식 업데이트: 짧은 명령과 생활 소음
9월 18일 공개된 Grok Voice Transcribe 2.0은 음성을 문자로 변환하는 모델이다. 개발사는 소음과 여러 언어가 섞인 실제 환경의 데이터를 활용했으며, 전화 음성·일반 대화·계정 정보·짧은 다국어 명령을 나눈 내부 평가를 공개했다.
발표에서 특히 구체적인 수치는 짧은 발화 평가의 단어 오류율이 20.6%에서 6.8%로 낮아졌다는 결과다. 차량 명령처럼 문장이 짧으면 언어를 식별할 문맥도 적다는 설명이 함께 제시됐다. 이는 개발사의 해당 평가 세트 결과이며 모든 차량과 소음 환경의 실사용 오류율을 뜻하지 않는다.
발화 종료 감지, 화자 구분, 제품명 같은 특정 용어 인식 보정도 지원 기능으로 소개됐다. 음성 에이전트가 언제 사용자의 말을 받아들이고 언제 답변을 시작할지 판단하는 데 필요한 요소들이다. 다만 음성 인식 모델의 공개와 Tesla 개별 차량에 적용되는 소프트웨어 버전은 별도로 확인해야 한다.
Google: 시각 정보를 반영하며 대화를 이어가는 모델
Google은 9월 16일 한국어 공식 발표를 통해 Gemini 3.8 Live와 Gemini 3.8 Live Extended Thinking을 소개했다. 3.8 Live에는 시각적 맥락 이해와 97개 언어의 자동 감지·전환을, Extended Thinking에는 더 복잡한 다단계 작업을 위한 추론을 주요 특징으로 제시했다.
회사 설명에 따르면 모델은 대화를 이어가면서 백그라운드에서 도구와 API를 호출한다. 더 복잡한 작업에서는 추론과 발화를 동시에 수행하며 진행 상황을 말로 전달한다. 여기서 도구 사용(Tool Use)은 검색·조회·외부 서비스 실행처럼 모델 바깥의 기능을 이용하는 것을 뜻한다.
이 발표는 개발자용 API와 Google 자체 서비스의 제공 경로를 설명하는 자료다. 같은 Gemini 이름을 사용하는 GM 차량이나 Gemini for Home에 새 모델이 동시에 적용됐다고 추정할 수는 없다. 모델의 기능 공개와 완성품의 기능 배포를 구분하면서도, 최근 음성 AI가 어떤 문제를 개선하고 있는지는 확인할 수 있다.
근거: Grok Voice Think Fast 2.0 · Grok Voice Transcribe 2.0 · Gemini 3.8 Live 공식 발표
08. 최근 발표에서 확인되는 세 가지 사용 경험의 변화
서로 다른 제품의 발표를 비교하면, 현재 추가되고 있는 기능은 세 가지 측면에서 정리할 수 있다. 이는 업계가 합의한 세대 구분이 아니라 앞선 공식 사례들을 읽기 위한 분류다.
첫째, 기능의 이름 대신 원하는 상황을 설명하는 요청이 늘어난다. BMW의 복합 이동 계획, Google Home의 예외를 포함한 조명 제어, Bixby의 화면 설정 사례가 여기에 해당한다. 이용자가 모든 메뉴 경로를 알지 못해도 지원되는 기능에 도달할 수 있도록 만든다. 다만 기존 음성비서에도 자연어 처리는 있었으므로, 자연어 자체의 발명보다 처리할 수 있는 문맥과 작업 범위의 확장으로 보는 것이 정확하다.
둘째, 기기가 확보한 정보가 AI 요청의 일부가 된다. 삼성 냉장고에서는 내부 영상이 식품 인식의 입력이 되고, Google Guided vision에서는 스마트폰 카메라가 주변 대상을 전달한다. Meta가 발표한 Muse의 안경 연결도 보는 대상과 작업 요청을 결합한다. 사용자가 모든 내용을 문자나 말로 다시 설명하지 않아도 되도록 제품의 센서를 활용하는 사례들이다.
셋째, 한 제품의 기능을 넘어 다른 서비스와 작업이 이어진다. GM의 목적지·메시지 요청, LG의 일정·가전 연계 시연, Gemini와 Find Hub의 정보 기록, Meta의 커넥터 확대가 해당한다. 제품에 대화 창을 붙이는 것에 더해, AI가 어떤 정보를 받고 어떤 소프트웨어 기능까지 호출할 수 있는지가 구체적인 서비스 범위를 결정한다.
한편 제품의 제공 형태는 균일하지 않다. 삼성은 지원되는 기존 가전의 순차 업데이트를 발표했고, LG는 전시 시연을 공개했으며, Meta는 판매하는 하드웨어와 이후 연결할 에이전트 기능을 함께 발표했다. 다음 표는 최근 소식과 이를 이해하기 위한 앞선 발표를 나누어 정리한 것이다.
| 발표·확인 시점 | 제품·기술 | 추가·확장 내용 | 자료가 명시한 단계 |
|---|---|---|---|
| 9월 23~24일 | Meta AI 안경·Muse | 개인 에이전트 연결, 음성 중심·카메라형 제품군 확대 | Gen 3 판매 발표 / Audio 사전 주문 / Muse 안경 연결은 향후 제공 |
| 9월 18일 | Grok Voice Transcribe 2.0 | 소음·다국어·짧은 명령 인식 개선 | 음성 인식 모델 공개. 차량별 적용과 별개 |
| 9월 16일 한국어 발표 | Gemini 3.8 Live 계열 | 대화 중 도구 호출, 시각적 맥락, 병렬 추론 | API·자체 서비스 경로별 순차 제공 안내 |
| 9월 7일 | 삼성 기존 AI 가전 | Gemini 기반 AI Vision·최신 Bixby 등 | 지원 모델에 9월부터 순차 업데이트 |
| IFA 2026 | LG ThinQ Claw | 문자 대화로 일정·기기·서비스 연결 | 전시 공개·시연 |
| 9월 1일 | Android·Gemini | Find Hub 보관 정보 기록·Guided vision | 관련 두 기능은 출시 예정으로 안내 |
| 8월 19일 적용 사례 | Tesla Grok Voice | 복합 경로와 차량 기능의 음성 실행 | 지원 차량 대상 베타. Assistant에서 차량 명령 |
| 올해 도입·확대 안내 | BMW Alexa+ 비서 | 맥락 기반 대화와 내비게이션 연결 | iX3 도입 시작, 추가 모델 확대 계획 |
| 4월 발표 | GM Gemini | 지원 차량 약 400만 대 업데이트 대상 | 미국 대상 순차 배포 계획. 완료 대수 아님 |
| 4월 발표 | Mercedes-Benz·Liquid AI / Volkswagen CEA | 차량 내부 AI 처리 및 에이전트 구조 | 하반기 적용 목표·도입 계획, 차세대 구조는 후속 로드맵 |
09. 지금 확인되는 것은 ‘인터페이스의 소멸’이 아니라 사용 경로의 확장
생활형 디바이스의 생성형 AI를 모두 같은 수준의 자율적 에이전트로 부르는 것은 정확하지 않다. 식품을 인식하는 모델, 대화형 음성비서, 외부 도구를 사용하는 에이전트, 차량 내부 추론 모델은 맡는 일이 다르다. 최신 발표를 읽을 때에는 AI라는 이름보다 실제 입력과 실행 기능을 보는 편이 제품의 변화를 구체적으로 설명한다.
현재 자료가 보여주는 것은 버튼과 화면이 일괄적으로 없어졌다는 상황도 아니다. Tesla는 기존 음성 명령을 유지하고, 삼성의 가전 업데이트에는 화면 인터페이스 개선도 함께 포함된다. AI 대화와 기존 조작 수단이 병행되면서, 사용자가 목적을 전달할 수 있는 방법이 늘어나고 있다.
사용자의 정보가 처리되는 방식도 제품마다 다르다. Tesla는 Grok에 네트워크 연결이 필요하다고 안내하는 한편, 전화 기능에 사용하는 연락처를 Grok 개발사로 보내지 않는다고 설명한다. Mercedes-Benz와 Volkswagen은 차량 내부 처리에 초점을 둔 설계를 발표했다. ‘AI 탑재’ 하나로 동일한 데이터 흐름을 가정할 수 없는 이유다.
최근 소식들을 연결하는 공통점은 분명하다. AI가 답변을 보여주는 창구에 더해, 사용자의 말·기기 상태·카메라 입력을 받아 지원되는 작업과 연결하는 제품 인터페이스로 적용되고 있다. 구체적인 변화는 이미 일부 제품의 기능과 업데이트에서 확인되며, 다른 일부는 전시 시연과 출시 계획의 형태로 제시돼 있다.
종합 근거: Tesla의 연결·데이터 처리 안내 · 기존 조작 수단 유지 · 차내 AI 처리 설계 · 가전 기능·화면 업데이트
최근 생활형 AI 소식의 중심은 대화가 가능한 제품의 증가만이 아니다. 기존 차량·가전으로의 소프트웨어 배포, 카메라와 생활 정보의 활용, 대화 중 외부 기능 실행이 함께 진행되고 있다. Tesla의 차량 제어, 삼성의 기존 가전 업데이트, Meta의 안경·에이전트 연결 발표는 서로 다른 제품에서 이 변화가 구현되는 사례다. 실제 제공 범위는 각 제품의 지원 조건과 배포 단계에 따라 구분된다.
용어집
- 생성형 AI(Generative AI)
- 입력과 문맥을 바탕으로 문장·음성·이미지 등의 내용을 생성하는 AI. 기기의 외부 기능이나 다른 서비스와 연결해 사용할 수도 있다.
- 자연어(Natural Language)
- 사람이 일상에서 사용하는 말과 글. 정해진 메뉴명이나 명령 코드와 달리 다양한 표현으로 요구를 전달할 수 있다.
- AI 에이전트(AI Agent)
- 사용자의 목표에 따라 도구를 선택하고 여러 단계의 작업을 수행하도록 구성된 소프트웨어 시스템. 모든 AI 기능이 에이전트인 것은 아니다.
- 대규모 언어 모델(Large Language Model, LLM)
- 대량의 언어 데이터를 학습해 문맥에 맞는 언어 처리와 생성을 수행하는 모델. 외부 기능 실행에는 이를 연결하는 소프트웨어가 필요하다.
- 도구 사용(Tool Use)·도구 호출(Tool Calling)
- 모델이 검색·조회·기기 제어 등의 외부 기능을 이용하는 방식과 그 기능을 요청하는 동작. 실제 수행 범위는 제공된 기능과 권한에 의해 정해진다.
- 연결 인터페이스(API)
- 소프트웨어가 다른 소프트웨어의 데이터나 기능을 정해진 방식으로 요청하고 결과를 받는 접점.
- 커넥터(Connector)
- AI 서비스와 특정 외부 서비스 사이의 기능·데이터 연결을 제공하는 구성요소. 서비스별 인증과 지원 기능에 따라 할 수 있는 일이 달라진다.
- 온디바이스 AI(On-device AI)
- AI 계산의 일부 또는 전부를 원격 서버가 아닌 기기 자체에서 수행하는 방식. 제품에 AI 기능이 있다는 사실만으로 온디바이스 방식이라고 할 수는 없다.
- 멀티 에이전트(Multi-Agent)
- 역할이 다른 여러 에이전트가 작업을 나누거나 조정하는 구성. 이 글에서는 Volkswagen이 발표한 차세대 차량 구조에 등장한다.
- 성격(Personality)
- AI의 말투나 응답 성향을 정하는 대화 설정. Tesla Grok에서는 설정에 따라 차량 명령 지원 여부도 달라진다.
- 단어 오류율(Word Error Rate, WER)
- 정답 문장과 음성 인식 결과를 비교해 단어의 대체·삭제·삽입 오류를 계산한 지표. 낮을수록 해당 평가에서 인식 오류가 적지만, 평가 환경이 다르면 수치를 그대로 비교할 수 없다.
- 베타·조기 이용(Beta·Early Access)
- 기능과 안정성을 개선하면서 제한된 조건이나 이용자 범위에 제공하는 단계. 전체 사용자에게 모든 기능이 제공된다는 뜻은 아니다.
공식 출처
최근 발표는 뉴스의 중심 자료로, 앞선 발표와 현재 지원 문서는 적용 배경과 이용 범위를 확인하는 자료로 사용했다. 제조사의 기능·성능 설명과 시연은 독립적인 실사용 검증 결과와 구분했다.
- Tesla — Grok 지원 안내 · 현재 기능·요건·데이터 처리 안내.
- Tesla — Model Y Owner’s Manual: Grok (Beta) · 성격별 차량 명령 지원·기존 음성 명령 유지.
- Grok 개발사 — How Tesla enables drivers to control the car with Grok Voice · 2026년 8월 19일.
- BMW Group — Milestone in in-car speech interaction thanks to AI integration · 최초 2026년 1월 5일 표기, 현재 본문에 5월 말 도입·하반기 확대 안내 포함.
- General Motors — GM brings Google Gemini to millions of vehicles on the road · 2026년 4월 28일.
- Mercedes-Benz — Next Generation in-car intelligence · 2026년 4월 23일.
- Volkswagen Group — Auto China 2026: Agentic AI Roadmap for China · 2026년 4월 21일.
- 삼성전자 — Refrigerators and Laundry Appliances: AI-Focused Software Updates · 2026년 9월 7일.
- Google — Gemini for Home: Your household’s new, more helpful assistant · 2025년 8월 20일. 기존 서비스의 기능 배경.
- Google — Gemini for Home 음성비서 제공 범위 · 기능 이용 안내.
- LG — LG Electronics Unveils the Next Evolution of AI Home at IFA 2026 · 본문 발표 2026년 8월 31일, 게시일 9월 1일.
- Meta — The Biggest News From Connect 2026 · 9월 23일 행사, 2026년 9월 24일 게시.
- Meta — Introducing Ray-Ban Meta Audio and More AI Glasses Styles · 2026년 9월 23일.
- Google — September Android Drop · 2026년 9월 1일.
- 삼성전자 — Samsung Introduces the New Bixby in One UI 8.5 · 2026년 2월 20일. 기기 설정 연동의 배경 사례.
- Grok 개발사 — Introducing Grok Voice Think Fast 2.0 · 2026년 7월 29일.
- Grok 개발사 — Introducing Grok Voice Transcribe 2.0 · 2026년 9월 18일.
- Google — Gemini 3.8 Live 및 Extended Thinking 소개 · 한국어 공식 발표 2026년 9월 16일.
- 이전글음성 AI는 어떻게 기기를 제어할까? 음성 인식부터 도구 호출까지 26.10.02
- 다음글브라우저 호환성이란? 웹사이트가 여러 브라우저에서 동작하는 원리 26.09.30
