컴퓨터에서 나는 소리를
실시간 번역 자막으로
화상회의와 영상에서 흘러나오는 외국어를 그대로 받아 화면 위에 자막으로 띄웁니다.
가상 오디오 장치를 따로 설치하지 않아도 됩니다.
자막이 뜨는 모습을 그림으로 나타냈습니다. 말하는 사람이 바뀌면 색이 바뀌고, 번역문 아래에 원문이 함께 붙습니다.
자막이 없어서 놓치던 자리
해외 팀과의 화상회의
Zoom, Microsoft Teams, Google Meet에서 나오는 말을 곧바로 한국어 자막으로 봅니다. 회의 창을 가리지 않고 화면 위에 떠 있습니다.
자막 없는 영상과 강의
유튜브 영상, 온라인 강의, 팟캐스트처럼 자막이 없거나 자동 자막이 부정확한 소리를 번역해 줍니다.
눈앞에서 오가는 대화
입력을 마이크로 바꾸면 회의실이나 현장에서 오가는 외국어 대화도 자막으로 따라갈 수 있습니다.
세 단계면 자막이 뜹니다
API 키 넣기
Google AI Studio에서 받은 Gemini API 키를 설정 창에 붙여 넣습니다. 키는 운영체제의 자격 증명 저장소에 보관됩니다.
소리 잡을 곳 고르기
컴퓨터에서 나는 소리와 마이크 중에 고릅니다. 자동으로 두면 상황에 맞게 알아서 잡습니다.
시작 누르기
화면 위에 자막이 뜹니다. 글꼴과 위치, 표시할 모니터는 설정에서 언제든 바꿉니다.
실시간 자막 번역 프로그램에 필요한 것
시스템 소리를 바로 받습니다
macOS는 Core Audio Process Tap, Windows는 WASAPI 루프백을 씁니다. 가상 오디오 장치 설치나 화면 녹화 권한이 필요 없고, 기본 출력 장치도 그대로 둡니다.
영화 자막처럼 굴러갑니다
새 문장이 아래에서 올라오고 지난 문장이 위로 밀립니다. 항상 맨 앞에 뜨지만 마우스 클릭은 그대로 통과해 작업을 막지 않습니다.
말하는 사람이 바뀌면 색이 바뀝니다
말이 끊긴 구간과 질문에서 답변으로 넘어가는 흐름을 보고 화자 전환을 짚어, 두 가지 색으로 번갈아 보여줍니다.
원문도 함께 봅니다
번역문 아래에 원문을 짝지어 보여줍니다. 받아쓰기와 번역을 나란히 확인할 수 있고, 필요 없으면 끕니다.
번역된 말을 소리로 듣습니다
자막 대신 귀로 듣고 싶을 때 번역 음성을 재생합니다. 재생하는 동안 원래 소리는 자동으로 작아집니다.
자막을 파일로 남깁니다
확정된 자막을 [시각] 원문 → 번역문 형식의 텍스트 파일로 저장합니다. 회의록 초안으로 그대로 씁니다.
자막을 원하는 대로 꾸밉니다
글꼴, 크기, 굵기, 글자색, 외곽선, 배경, 정렬, 최대 줄 수를 바꿉니다. 여러 모니터 중 어디에 띄울지, 위아래 어디에 둘지도 고릅니다.
지금 얼마 썼는지 보입니다
이번 사용분과 누적 금액을 화면에 띄웁니다. 말이 없는 구간은 보내지 않아 조용한 시간의 요금이 붙지 않습니다.
설치할 게 앱 하나뿐입니다
시스템 소리를 받으려고 가상 오디오 장치를 깔고 출력 장치를 바꾸는 준비 과정이 없습니다.
| 항목 | 흔한 방식 | Cross-liveTranslate |
|---|---|---|
| 시스템 소리 캡처 | 가상 오디오 장치를 따로 설치 | 운영체제 기능으로 바로 받음 |
| 기본 출력 장치 | 가상 장치로 바꿔야 소리가 잡힘 | 쓰던 스피커·헤드폰 그대로 |
| 화면 녹화 권한 | 요구하는 경우 있음 | 필요 없음 |
| 지원 운영체제 | 한쪽만 지원하는 경우가 많음 | macOS와 Windows 모두 |
| 계정 | 회원가입·로그인 필요 | 계정 없음 |
앱은 무료, 번역은 본인 API 키
숨은 결제나 구독이 없습니다. 대신 번역에 쓰이는 Google Gemini API 요금이 직접 발급받은 키로 나갑니다.
요금 기준 — Gemini 3.5 Live Translate 모델은 오디오 입력 100만 토큰당 3.50달러, 오디오 출력 100만 토큰당 21.00달러입니다.
알아 두실 점 — 출력 오디오는 재생하지 않아도 만들어지고 요금이 붙습니다. 말이 없는 구간도 마찬가지여서, 말이 있는 구간만 보내는 기능이 기본으로 켜져 있습니다.
확인 방법 — 앱 화면에 이번 사용분과 누적 금액이 표시됩니다. 실제 청구 금액은 Google AI Studio에서도 확인할 수 있습니다.
무엇이 어디로 가는지 그대로 씁니다
- 1소리는 Google Gemini API로 전송됩니다. 번역을 위해 필요한 과정입니다. 이 앱은 자체 서버를 두지 않으며, 만든 사람에게 소리나 자막이 전달되지 않습니다.
- 2API 키는 운영체제 자격 증명 저장소에 보관됩니다. macOS는 키체인, Windows는 자격 증명 관리자를 씁니다. 설정 파일에 평문으로 남지 않습니다.
- 3자막 녹화 파일은 내 컴퓨터에만 남습니다. 지정한 폴더에 저장되고 어디로도 올라가지 않습니다.
- 4계정이 없습니다. 회원가입, 로그인, 사용 기록 수집이 없습니다.
설치 전에 확인하실 내용
맥과 윈도우에서 모두 쓸 수 있나요?
네. macOS 12 이상, Windows 10·11 64비트에서 같은 기능으로 동작합니다. 자막 오버레이, 번역 음성 재생, 자막 녹화, 자동 업데이트가 두 운영체제에 모두 들어 있습니다.
줌이나 팀즈 회의 소리도 자막으로 번역되나요?
네. 컴퓨터 스피커로 나오는 소리라면 프로그램을 가리지 않습니다. Zoom, Microsoft Teams, Google Meet, 유튜브, 온라인 강의 영상 모두 같은 방식으로 잡힙니다.
가상 오디오 장치를 따로 설치해야 하나요?
아니요. macOS에서는 Core Audio Process Tap, Windows에서는 WASAPI 루프백으로 시스템 소리를 바로 받습니다. 기본 출력 장치를 바꿀 필요도, 화면 녹화 권한을 줄 필요도 없습니다.
무료인가요? 번역 비용은 누가 내나요?
앱은 무료이고 회원가입도 없습니다. 다만 번역에 Google Gemini API를 쓰기 때문에, 직접 발급받은 API 키로 사용 요금이 나갑니다. 앱 화면에 이번 사용분과 누적 금액이 표시됩니다.
번역 요금은 얼마나 나오나요?
Gemini 3.5 Live Translate 기준으로 오디오 입력은 100만 토큰당 3.50달러, 오디오 출력은 100만 토큰당 21.00달러입니다. 출력 오디오는 재생하지 않아도 만들어지고 요금이 붙습니다. 말이 없는 구간은 보내지 않는 기능이 기본으로 켜져 있어 조용한 시간의 요금을 줄입니다.
인터넷 없이도 쓸 수 있나요?
쓸 수 없습니다. 번역이 Google Gemini API를 거치기 때문에 인터넷 연결이 필요합니다.
소리가 어디로 전송되나요? 저장되나요?
소리는 번역을 위해 Google Gemini API로 전송됩니다. 이 앱은 별도의 서버를 두지 않으며, 만든 사람에게 소리나 자막이 전달되지 않습니다. 자막 녹화를 켰을 때만 지정한 폴더에 텍스트 파일이 저장되고, 그 파일은 어디로도 올라가지 않습니다.
몇 개 언어를 지원하나요?
Gemini 3.5 Live Translate 모델이 70개가 넘는 언어를 자동으로 알아듣습니다. 번역해서 보여줄 언어는 설정에서 고르며 기본값은 한국어입니다.
마이크로 들어오는 대화도 번역되나요?
네. 입력을 마이크로 바꾸면 눈앞에서 오가는 대화도 자막으로 볼 수 있습니다. 자동으로 두면 상황에 맞는 입력을 골라 줍니다.
자막을 파일로 남길 수 있나요?
네. 녹화를 켜면 확정된 자막이 [시각] 원문 → 번역문 형식의 텍스트 파일로 저장됩니다. 저장 폴더는 설정에서 바꿉니다.
윈도우에서 설치 파일과 포터블 중 무엇을 받아야 하나요?
처음 쓴다면 설치 파일을 받으세요. 시작 메뉴 바로가기와 화면 표시에 필요한 런타임까지 함께 설치됩니다. 설치 없이 폴더에 두고 쓰려면 포터블 파일을 받으세요.
업데이트는 어떻게 하나요?
앱이 새 버전을 스스로 확인하고 알려 줍니다. 내려받은 파일은 서명을 검증한 뒤에만 설치되며, 설치가 끝나면 앱이 다시 실행됩니다.
지금 받아서 바로 써 보세요
설치하고 API 키만 넣으면 됩니다. 회원가입도 결제 정보 입력도 없습니다.