자주 묻는 질문
Auvi – 실시간 자막 및 번역
Auvi 소개
Auvi는 홍콩 특별행정구에 설립된 회사 Creative Machines Limited가 만들었습니다. 홍콩에 거주하는 영국인 개발자가 설립했으며 – 선전과 세계 전자제품의 수도 바로 옆에서 – Auvi는 한 가족에게 실시간 자막을 선사한 화제의 Raspberry Pi 프로젝트에서 탄생했습니다. 수많은 분들이 제대로 된 앱을 요청해 주셔서 저희가 만들게 되었습니다.
저희는 접근성이 비싸서는 안 되며, 여러분의 대화는 여러분의 것이어야 한다고 믿습니다. 그래서 Auvi는 클라우드도, 계정도, 데이터 수집도 없이 모든 것을 여러분의 기기에서 처리합니다.
시작하기
Auvi란 무엇인가요?
Auvi는 iPhone과 iPad용 실시간 자막 및 번역 앱입니다. 대화를 듣고 색상으로 구분된 실시간 자막을 표시하며, 각 화자에게 자동으로 고유한 색상을 부여합니다. 모든 처리는 전적으로 여러분의 기기에서 이루어집니다 – 인터넷 연결도, 클라우드도, 계정도 필요 없습니다.
사람들은 다양한 이유로 Auvi를 사용합니다. 시끄러운 환경에서 대화를 따라가거나, 회의와 강의에 자막을 달거나, 해외 여행 중에 번역을 하거나, 중요한 대화를 기록으로 남기거나, 일상적인 접근성 도구로 사용합니다. 저희는 모두를 위해 Auvi를 만들었습니다.
Auvi는 어떤 기기에서 작동하나요?
Auvi는 iOS 17 이상을 실행하는 iPhone 또는 iPad가 필요합니다. watchOS 10 이상용 Apple Watch 동반 앱도 제공되며, iPhone에서 손목으로 실시간 자막을 전송합니다.
자막의 품질과 속도는 기기에 따라 달라질 수 있습니다. 처리 성능이 더 높은 최신 기기일수록 더 빠르고 정확한 결과를 제공합니다. iOS 26 이상을 실행하는 기기에서는 Auvi가 Apple의 내장 음성 인식 프레임워크를 사용할 수 있으며, 이는 이미 기기에 설치되어 있을 수 있고 앱 메모리를 전혀 사용하지 않습니다.
인터넷 연결이 필요한가요?
구버전 iOS에서 앱이 음성 인식 모델을 다운로드해야 할 수 있는 초기 설정 시에만 필요합니다. 그 이후에는 Auvi가 완전히 오프라인으로 작동합니다 – 비행기 모드, 지하, 병원 병동 등 어디서나 가능합니다.
최신 버전의 iOS(26 이상)에서는 필요한 모델이 이미 기기에 있을 수 있으므로 다운로드가 전혀 필요하지 않을 수 있습니다 – 즉시 자막을 시작할 수 있습니다.
Auvi는 저장 공간이 얼마나 필요한가요?
구버전 iOS에서는 약 700MB의 일회성 모델 다운로드가 필요합니다. 앱은 다운로드를 시작하기 전에 알려드리며 Wi-Fi에 연결하시기를 권장합니다. 다운로드가 중단되면 자동으로 재개됩니다.
iOS 26 이상에서는 Auvi가 기기에 이미 설치된 음성 모델을 사용할 수 있어 이 다운로드를 완전히 건너뛸 수도 있습니다. 앱 자체는 작으며, 저장 공간 요구 사항은 거의 전부 음성 인식 모델입니다.
무료 체험이 있나요?
네. Auvi는 Plus와 Translation을 포함한 모든 기능에 완전히 접근할 수 있는 7일 무료 체험을 제공합니다. 계정도 신용카드도 필요 없습니다. 체험 후에는 Standard(핵심 기능에 대한 일회성 결제)를 구매하거나, 선택형 추가 기능으로 Plus 또는 Translation을 구독할 수 있습니다.
기능
화자 식별은 어떻게 작동하나요?
Auvi는 기기 내 화자 식별을 사용해 서로 다른 음성을 구별합니다. 각 화자에게는 자동으로 색상이 부여됩니다 – 설정, 라벨 지정, 음성 등록이 필요 없습니다. 식별 엔진이 백그라운드에서 오디오를 짧은 조각으로 처리하므로 색상은 텍스트 직후에 나타납니다.
긴 대화에서도 Auvi는 화자 일관성을 유지하여 같은 사람이 항상 같은 색상으로 표시됩니다. Plus를 사용하면 세션 간에 화자를 기억하는 음성 프로필을 만들 수 있습니다 – 그래서 동료, 가족, 친구가 다음에 자동으로 인식됩니다.
Auvi는 어떤 언어를 지원하나요?
Auvi는 40개 이상의 언어로 음성을 자막으로 변환할 수 있습니다. 설정에서 자막 언어를 선택할 수 있습니다. 다른 언어와 영어를 오가는 다국어 대화의 경우 Mixed with English 모드를 켜세요 – Auvi가 영어 단어를 망가뜨리지 않고 두 언어를 모두 인식합니다. Translation 추가 기능을 사용하면 Auvi가 31개 언어로 자막을 실시간 번역할 수 있으며, 모두 기기 내에서 처리됩니다. 번역된 자막을 탭하면 소리내어 읽어줍니다.
실시간 번역은 어떻게 작동하나요?
Translation 추가 기능은 Apple의 기기 내 번역 프레임워크를 사용해 자막이 나타나는 대로 원하는 언어로 변환합니다. 지원되는 31개 언어 모두 로컬에서 처리됩니다 – 어떤 것도 서버로 전송되지 않습니다.
또한 번역된 자막을 탭해 소리내어 듣게 할 수 있으며, Type-to-Speak를 사용해 답장을 입력하면 두 언어 중 하나로 읽어줍니다. Quick-Reply Phrasebook은 여행과 일상 대화에 흔히 쓰는 문구를 한 번의 탭으로 사용할 수 있게 해줍니다.
비싼 하드웨어 기기가 필요 없습니다. 별도의 번역 기기(Pocketalk 등)와 달리, Auvi는 이미 가지고 계신 iPhone에서 작동합니다.
전화 사기 감지란 무엇인가요?
Auvi는 말하고 있는 단어를 분석하여 대화가 전화 사기에 사용되는 알려진 패턴과 일치하면 알려줄 수 있습니다. 공무원 사칭, 은행 계좌 관련 거짓 긴급 상황, 상품권 요구 등 25가지 전화 사기 수법 카테고리를 다중 키워드 가중치 점수로 다룹니다.
민감도를 높음, 보통, 낮음으로 설정할 수 있으며, 이 기능은 추가 비용 없이 Standard에 포함되어 있습니다. 모든 분석은 기기 내에서 이루어지며, 대화 내용은 어디에도 전송되지 않습니다.
여행자 사기 감지란 무엇인가요?
여행자 사기 감지는 별도의 선택형 기능(Beta로 표시)으로, 찻집 유인, 가짜 단속 벌금, 택시 바가지, 주의 분산 절도 등 여행과 관련된 10가지 사기 카테고리를 다룹니다. 전화 사기 감지와 동일한 기기 내 감지 엔진을 사용하며 독립적으로 구성할 수 있습니다. Standard에 포함되어 있으며 해외 여행 시 특히 유용합니다.
소리 알림은 어떻게 작동하나요?
소리 알림은 중요한 주변 소리를 감지하여 하나가 감지되면 시각적 배너를 표시합니다. 지원되는 소리에는 초인종, 연기 감지기, 화재 경보, 사이렌, 노크 등이 포함됩니다 – 세 가지 긴급도 등급에 걸쳐 15가지 소리를 지원합니다. 화재 경보와 같은 위급한 소리는 소리 알림의 나머지 기능이 꺼져 있더라도 더 강한 햅틱 알림과 더 눈에 띄는 배너를 발생시킵니다.
이름 언급 알림이란 무엇인가요?
설정에서 자신의 이름(과 이름 변형)을 구성할 수 있습니다. 대화 중에 누군가 여러분의 이름을 말하면 Auvi가 텍스트를 강조 표시하고 휴대폰과 Apple Watch에 햅틱 탭을 전달합니다. 자막을 읽느라 누군가 직접 말을 거는 것을 놓칠 수 있는 그룹 대화에서 유용합니다.
Auvi를 외부 마이크와 함께 사용할 수 있나요?
네. Auvi는 iPhone이나 iPad가 지원하는 모든 오디오 입력과 함께 작동합니다. 내장 마이크, AirPods, Bluetooth 마이크, USB-C 마이크, Lightning 액세서리, 유선 헤드셋 등을 사용할 수 있습니다. 오디오 소스는 언제든지 전환할 수 있습니다.
시끄러운 환경이나 테이블 건너편에서 최상의 결과를 얻으려면 옷깃 마이크나 지향성 Bluetooth 회의용 마이크가 정확도를 크게 높일 수 있습니다.
Picture-in-Picture 모드란 무엇인가요?
Picture-in-Picture(PiP)는 다른 앱 위에 떠 있는 자막 오버레이를 계속 표시합니다. 휴대폰에서 무언가를 확인하려고 Auvi를 벗어나도, 자막은 화면에서 옮길 수 있는 작은 창에 계속 나타납니다. PiP는 활성 자막 세션 중에 앱을 백그라운드로 전환하면 자동으로 시작됩니다.
Apple Watch에서 Auvi를 사용할 수 있나요?
네. Apple Watch 동반 앱(watchOS 10 이상)은 iPhone에서 전송된 실시간 자막을 손목에 바로 표시합니다. 휴대폰을 꺼내지 않고도 Watch에서 자막을 시작하고 중지할 수 있습니다. 대화에서 여러분의 이름이 감지되면 Watch가 손목을 탭해 알려줍니다.
Type-to-Speak란 무엇인가요?
Type-to-Speak를 사용하면 메시지를 입력해 기기가 소리내어 읽게 할 수 있습니다. 말로 답하고 싶지만 글로 소통하는 것을 선호할 때 유용합니다. Quick-Reply Phrasebook은 흔히 쓰는 문구를 한 번의 탭으로 사용할 수 있게 해주며, 자신만의 맞춤 문구를 추가할 수 있습니다.
회의록과 메타데이터란 무엇인가요?
Plus를 사용하면 Auvi가 저장된 대화에서 실행 항목, 결정 사항, 날짜, 참가자를 자동으로 추출할 수 있습니다. 실행 항목은 iOS 미리 알림으로, 날짜는 캘린더로 바로 보낼 수 있습니다. 대화는 분류되고 요약되며, 전문적인 회의록을 이메일로 내보낼 수 있습니다 – 모두 기기 내에서 처리됩니다.
어떤 내보내기 형식을 사용할 수 있나요?
Plus를 사용하면 자막을 일반 텍스트, PDF 또는 자막 형식(SRT 및 VTT)으로 내보낼 수 있습니다. 자막 내보내기에는 타임스탬프와 화자 정보가 포함되어 동영상 콘텐츠에 자막을 달거나 접근성 목적으로 사용하기에 적합합니다. 자막에서 직접 텍스트를 복사하고 iOS 공유 시트를 통해 공유할 수도 있습니다.
개인정보 보호 및 보안
Auvi가 제 대화를 녹음하나요?
아니요. Auvi는 절대로 오디오 파일을 만들지 않습니다. 음성을 실시간으로 텍스트로 변환하며, 기본적으로 그 텍스트는 메모리에만 존재합니다 – 자막을 중지하거나 앱을 닫는 순간 사라집니다. 설정에서 자막 저장(Plus 기능)을 켜기로 선택하면 텍스트만 여러분의 기기에 로컬로 저장됩니다. 오디오는 절대 디스크에 기록되거나 어디로도 전송되지 않습니다.
Auvi는 어떤 데이터를 수집하나요?
전혀 없습니다. Auvi의 App Store 개인정보 라벨에 “데이터 미수집”이라고 적혀 있는 것은 말 그대로 사실이기 때문입니다. 분석, 텔레메트리, 충돌 보고기, 사용 추적, 계정이 전혀 없습니다. 어떤 것도 여러분의 기기를 벗어나지 않습니다. Auvi는 초기 모델 다운로드가 완료된 후에는 어떤 네트워크 요청도 하지 않습니다.
제 고용주가 Auvi의 기능을 제어할 수 있나요?
네. Auvi는 관리형 앱 구성(MDM)을 지원하며, 이를 통해 IT 관리자가 관리되는 기기 전체에 개인정보 설정을 적용할 수 있습니다. 관리자는 MDM 프로필을 통해 자막의 저장, 복사, 내보내기를 영구적으로 비활성화할 수 있습니다. 관리자가 설정을 잠그면 해당 토글은 앱에서 숨겨집니다. Apple Business Manager 또는 대량 구매 프로그램을 통해 표준 App Store 가격으로 배포하세요.
Auvi는 HIPAA를 준수하나요?
Auvi의 개인정보 보호 아키텍처는 HIPAA 원칙과 강하게 부합합니다. 모든 처리는 기기 내에서 이루어지고, 데이터는 전송되지 않으며, 데이터는 수집되지 않고, 저장은 기본적으로 비활성화되어 있습니다. 다만 HIPAA 준수는 단순히 기술적인 문제가 아니라 조직적이고 계약적인 사안입니다. 의료 환경에 Auvi를 도입하신다면 컴플라이언스 팀과 상담하시기를 권장합니다.
요금 및 구독
Auvi는 얼마인가요?
Auvi는 모든 기능을 포함하는 7일 무료 체험으로 시작합니다. 체험 후 Standard는 핵심 자막 기능에 대한 일회성 구매입니다. Plus와 Translation은 월간 또는 연간으로 제공되는 선택형 자동 갱신 구독이며, 할인된 Bundle로도 이용할 수 있습니다. 정확한 가격은 App Store에 표시되며 지역에 따라 다릅니다.
Standard, Plus, Translation의 차이는 무엇인가요?
Standard(일회성 구매) – 40개 이상 언어의 실시간 자막, 화자 식별, 사기 감지, 소리 알림, Apple Watch, Picture-in-Picture, 이름 언급 알림, 모든 접근성 기능.
Plus(구독) – Standard의 모든 기능에 더해 자막 기록, 검색, 메타데이터가 포함된 회의록, 실행 항목 → 미리 알림, 날짜 → 캘린더, 내보내기 및 공유, 자막 내보내기(SRT/VTT), 텍스트 복사, 북마크, 맞춤 어휘, 분야별 팩, 음성 프로필.
Translation(구독) – Standard의 모든 기능에 더해 31개 언어의 실시간 기기 내 번역, 탭하여 듣기, Type-to-Speak, Quick-Reply Phrasebook.
Bundle – Plus + Translation을 할인된 가격으로 함께 제공합니다.
환불을 받을 수 있나요?
모든 구매는 Apple App Store를 통해 처리됩니다. 환불은 Apple의 환불 정책에 따라 Apple이 처리합니다. 환불을 요청하려면 reportaproblem.apple.com을 방문하세요. 기기에서 설정 > [사용자 이름] > 구독으로 이동하여 언제든지 Apple ID 설정에서 구독을 관리하거나 취소할 수 있습니다.
가족 또는 교육 할인이 있나요?
현재 Auvi는 별도의 가족 요금제나 교육용 가격 등급을 제공하지 않습니다. 여러 기기에 Auvi를 배포하려는 조직은 Apple Business Manager 또는 대량 구매 프로그램(VPP)을 통해 표준 App Store 가격으로 배포할 수 있습니다. 기관 배포에 대해 궁금한 점이 있으시면 support@creativemachines.ai로 이메일을 보내주세요.
문제 해결
자막이 나타나기 전에 지연이 있는 이유는 무엇인가요?
Auvi는 오디오를 음성 인식 엔진으로 보내기 전에 짧은 조각으로 처리합니다. 첫 자막은 보통 약 15초 후에 나타납니다. 이는 정상입니다 – 자막이 시작되기 전에 작은 오디오 버퍼가 쌓여야 합니다. 일단 자막이 나타나기 시작하면 계속 업데이트됩니다.
최신 기기와 iOS 버전에서는 더 효율적인 처리 덕분에 자막이 더 빨리 나타날 수 있습니다.
자막이 그다지 정확하지 않은 것 같아요
자막 정확도는 여러 요인에 따라 달라집니다.
- 기기 및 iOS 버전 – 처리 성능이 더 높은 최신 기기일수록 더 정확한 결과를 제공합니다. iOS 26 이상은 Apple의 최신 음성 인식을 사용하며 상당히 더 나을 수 있습니다.
- 마이크 거리 – 기기를 들거나 화자로부터 약 1미터 이내에 두세요.
- 배경 소음 – 가능한 한 주변 소음을 줄이거나 외부 마이크를 사용하세요.
- 언어 설정 – 설정의 자막 언어가 말하고 있는 언어와 일치하는지 확인하세요. 대화가 다른 언어와 영어를 자주 오간다면 Mixed with English를 켜서 두 언어의 인식을 개선하세요.
- 어휘 팩 – 분야별 용어(의료, 법률, 기술)를 사용하는 경우 설정에서 관련 어휘 팩을 켜세요.
Auvi가 전화 통화를 자막으로 변환할 수 있나요?
iOS는 타사 앱이 전화 통화 오디오에 직접 접근하는 것을 허용하지 않습니다. 이는 모든 앱에 적용되는 시스템 차원의 제한입니다. 하지만 다음과 같은 방법으로 우회할 수 있습니다.
- 통화를 스피커폰으로 설정하고 기기를 가까이 두기
- 유선 전화에 연결하여 iPhone 마이크로 오디오를 전달하는 USB 전화 녹음기 사용하기
- 영상 통화(FaceTime, Zoom, Teams)의 경우 기기 스피커 사용하기
앱에는 최상의 결과를 얻기 위한 안내가 담긴 팁 섹션이 포함되어 있습니다. 권장 액세서리는 액세서리 페이지를 참고하세요.
모델 다운로드가 오래 걸려요
초기 다운로드는 약 700MB이므로 인터넷 연결에 따라 몇 분 정도 걸릴 수 있습니다. Wi-Fi 사용을 권장합니다. 다운로드가 중단되면 앱을 다시 열면 중단된 지점부터 재개됩니다.
참고: iOS 26 이상에서는 이 다운로드가 전혀 필요하지 않을 수 있습니다 – 필요한 모델이 이미 기기에 있을 수 있습니다.
자막 중에 화면이 계속 꺼져요
Auvi는 자막이 활성화되어 있는 동안 화면이 잠기지 않도록 자동으로 방지합니다. 화면이 여전히 꺼진다면 자막이 실제로 실행 중인지(청취 표시기가 보여야 합니다), 그리고 저전력 모드가 화면 잠금 방지를 무시하고 있지 않은지 확인하세요. 자막을 중지하면 정상적인 화면 잠금 동작이 다시 시작됩니다.
화면이 잠길 때 오디오가 몇 초간 손실돼요
화면이 잠기면 iOS가 음성 인식 엔진이 사용하는 GPU에 대한 접근을 잠시 제한합니다. Auvi는 이를 감지하고 오디오 버퍼링을 시작하지만, 시스템이 전환되는 동안 1–3초의 공백이 생길 수 있습니다. Auvi가 백그라운드 모드로 전환되면 자막은 정상적으로 재개됩니다.
팁: Auvi는 활성 자막 중에 화면을 켜진 상태로 유지하므로, 이 현상은 기기를 수동으로 잠글 때만 발생합니다. 대화 중이라면 끊김 없는 자막을 위해 화면을 켜 두세요.
AirPlay를 통해 TV나 외부 화면에 자막을 표시할 수 있나요?
iPhone에서 Apple TV로의 AirPlay는 화면 미러링을 사용합니다 – 자막을 포함한 iPhone 화면 전체가 TV에 표시됩니다. 모두가 실시간 자막을 보길 원하는 그룹 환경에서 잘 작동합니다.
자막 전용 보기(앱 인터페이스 없음)를 원하면 USB-C 또는 Lightning HDMI 어댑터로 iPhone을 연결하세요. 이렇게 하면 Auvi의 전용 외부 디스플레이 모드가 활성화되어 깔끔한 배경에 큰 형식의 자막을 표시합니다 – 회의, 교실, 행사에 이상적입니다.
iPad에서는 AirPlay의 “디스플레이 확장” 모드를 사용해 자막 전용 보기를 무선으로 얻을 수도 있습니다.
앱에서 벗어나면 AI 분석이 끝나지 않아요
AI 기반 분석(요약, 실행 항목, 결정 사항)은 상당한 처리 성능이 필요한 기기 내 언어 모델을 사용합니다. iOS는 배터리와 시스템 성능을 보존하기 위해 앱이 백그라운드에 있을 때 이 처리를 제한합니다.
최상의 결과를 위해: 대화를 저장한 후 “대화를 분석하는 중…” 스피너가 보이는 동안 15–30초간 Auvi를 포그라운드에 두세요. 분석이 완료되면 자유롭게 벗어날 수 있습니다.
분석이 중단된 경우 저장된 대화를 열고 AI로 분석을 탭하여 다시 처리할 수 있습니다.
PiP(Picture-in-Picture) 오버레이에서 앱으로 돌아가려면 두 번 탭해야 해요
이는 표준 iOS Picture-in-Picture 동작입니다. PiP 창을 탭하면 먼저 재생 컨트롤(확대 버튼 포함)이 표시되고, 확대 버튼을 탭하면 앱으로 돌아갑니다. iOS의 모든 PiP 창이 이렇게 작동합니다 – Apple은 앱이 이 상호작용을 맞춤 설정하는 것을 허용하지 않습니다.
접근성
Auvi에는 어떤 접근성 기능이 있나요?
Auvi는 접근성을 핵심으로 삼아 설계되었습니다.
- 다섯 가지 색상 구성: 시스템, 밝게, 어둡게, 고대비, 검정 바탕 노랑
- iOS 시스템 글꼴 크기와 별개로 16pt에서 48pt까지 조절 가능한 글꼴 크기
- 가장 큰 접근성 텍스트 크기를 포함한 iOS 동적 타입 완전 지원
- iOS 시스템 환경설정을 따르는 굵은 텍스트 지원
- 색맹 친화적 화자 팔레트 토글
- 모든 컨트롤의 VoiceOver 라벨
- 새 음성, 이름 언급, 소리 알림에 대한 햅틱 피드백
- 모든 애니메이션에 대한 동작 줄이기 지원
- 거꾸로 된 세로 모드를 포함한 모든 화면 방향
- 매우 큰 텍스트 크기에서도 작동하는 시각 전용 온보딩
Auvi는 VoiceOver와 함께 작동하나요?
네. 모든 컨트롤에는 VoiceOver 라벨과 설명이 있습니다. 새 자막 세그먼트는 나타나는 대로 안내되므로 화면 낭독기 사용자도 자막 세션을 따라갈 수 있습니다. 일부 사용자는 청각 손실과 시각 장애를 함께 가지고 있으며 접근성 도구가 서로 배타적이어서는 안 되기 때문에 이는 중요합니다.
어떤 색상 구성을 사용할 수 있나요?
- 시스템 – iOS의 밝게 또는 어둡게 모드 설정을 자동으로 따릅니다
- 밝게 – 시스템 설정과 관계없이 항상 밝게
- 어둡게 – 시스템 설정과 관계없이 항상 어둡게
- 고대비 – 저시력 사용자를 위해 대비를 최대화
- 검정 바탕 노랑 – 검정 위에 고가시성 노랑 텍스트
각 구성에는 화자 식별 색상에 맞게 조정된 색상 변형이 있습니다. 색맹 친화적 팔레트 토글은 모든 구성에서 작동합니다.