2채널 동시 녹음
시스템 오디오와 마이크를 동시에 수집하고 자동으로 믹싱합니다. 온라인 회의, 강의, 인터뷰, 대면 회의까지 어느 쪽 목소리도 놓치지 않습니다.
시스템 오디오와 마이크를 동시에 녹음하고, 말하는 순간 글이 됩니다. 13개 언어로 실시간 번역하며 AI 회의록도 클릭 한 번이면 완성됩니다. 핵심 기능은 모두 당신의 컴퓨터에서 실행됩니다 —— 로컬은 영구 무료, 오픈소스. 더 높은 품질이 필요할 때만 클라우드의 우수 모델을 골라 쓰면 됩니다.
신규 가입 시 100 크레딧 증정 (전체 회의 약 3시간)
한 번의 녹음으로 받아쓰기, 번역, 자막, 회의록까지. 게다가 모두 당신의 컴퓨터에서 끝납니다.
시스템 오디오와 마이크를 동시에 수집하고 자동으로 믹싱합니다. 온라인 회의, 강의, 인터뷰, 대면 회의까지 어느 쪽 목소리도 놓치지 않습니다.
X-ASR과 SenseVoice 두 로컬 엔진이 스트리밍으로 인식합니다. 말하는 동시에 글이 나오고, 전 과정이 오프라인입니다.
문장 단위 파이프라인으로 13개 언어를 번역합니다. 번역문이 원문 바로 아래에 붙어 회의하면서 바로 읽을 수 있습니다.
로컬 LLM이 주제·결론·할 일을 오프라인으로 정리합니다. 원하는 API를 연결할 수도 있습니다.
항상 위에 떠 있는 독립 자막 창. 드래그로 옮기고 줄 수와 글자 크기도 조절할 수 있습니다. 외국어 회의가 자막 있는 영상처럼 편해집니다.
원문과 번역문을 클릭 한 번으로 읽어 줍니다. 31개 언어를 지원하고 목소리도 고를 수 있습니다.
모든 회의는 로컬 SQLite에 저장됩니다. 전체 검색, 제목·문단 편집, 다른 모델로 재인식까지 지원합니다.
TXT / SRT / Markdown / 회의록을 클릭 한 번으로 내보내고, PDF로 인쇄해 그대로 보관할 수 있습니다.
클라우드 우수 모델을 앱에 연결하고, 자막을 데스크톱 위로 띄우고, 무료와 유료를 확실히 나눴습니다.
몇 GB의 모델을 기다릴 필요가 없습니다. 클라우드 대형 모델을 바로 호출해 더 강력한 다국어 인식, 더 정확한 실시간 번역, 더 큰 요약 모델을 쓸 수 있습니다. 같은 회의를 다른 모델로 다시 인식해 비교할 수도 있습니다.
항상 최상단에 표시되는 독립 자막 오버레이. 원하는 위치로 옮기고 줄 수와 글자 크기도 설정할 수 있습니다. 회의·방송·강의 위에 실시간 자막이 떠 있습니다.
로컬 모델은 영구 무료이며 시간 제한도 횟수 제한도 없습니다. 크레딧은 직접 클라우드 모델을 선택했을 때만 실제 사용량만큼 차감됩니다. 구독도, 월정액도, 자동 결제도 없습니다. 충전한 크레딧은 만료되지 않습니다.
하나의 앱, 두 개의 엔진. 일상 회의는 로컬로, 정확도나 다국어가 필요하면 클라우드로. 언제든 바꿀 수 있습니다.
| 로컬 모델 | 클라우드 모델 | |
|---|---|---|
| 비용 | 영구 무료, 시간·횟수 무제한 | 실제 사용량만큼 크레딧 차감 |
| 네트워크 | 모델 다운로드 후 완전 오프라인 | 연결 필요 (대부분 지역에서 직결) |
| 개인정보 | 오디오와 텍스트가 컴퓨터를 떠나지 않음 | 선택한 내용만 서버로 전송 |
| 준비 | 최초 0.5~2.5 GB 모델 다운로드 | 다운로드 없이 바로 사용 |
| 적합한 용도 | 일상 회의, 보안이 중요한 업무, 오프라인 환경 | 다국어 회의, 장시간 회의, 최고 정확도 |
크레딧은 클라우드 모델을 쓸 때만 차감됩니다 —— 음성 인식, 실시간 번역, 회의 요약, 음성 읽기가 하나의 잔액을 함께 사용합니다. 결제 후 코드가 자동 발급되며, 앱의 '계정 → 충전/교환'에서 붙여 넣으면 바로 반영됩니다.
클라우드 모델을 먼저 써보고 싶다면
장시간·다국어 회의에 유리
크레딧당 가장 저렴
전체 회의(인식 + 번역 + 요약) 약 3시간 분량입니다. 첫 출시 한정 수량이며, 증정 크레딧은 수령일로부터 90일간 유효합니다.
시간은 '1시간 회의 = 음성 인식 + 실시간 번역 + 회의 요약'이라는 일반적인 구성으로 추산한 값입니다. 실제 사용량은 선택한 모델에 따라 달라집니다.
명령줄도, 환경 설정도 필요 없습니다. 설치하고 안내를 따라가면 됩니다.
GitHub Releases에서 사용하는 플랫폼의 설치 파일(약 50 MB)을 받아 실행합니다. 첫 실행 시 보안 경고는 아래 자주 묻는 질문을 참고하세요.
첫 실행 마법사가 로컬 모델 다운로드 또는 가져오기를 안내합니다(중국 본토에서는 자동으로 미러로 전환). 클라우드 모델을 고르면 다운로드를 건너뛸 수 있습니다.
마이크와 시스템 오디오를 고르고 녹음을 누르면 끝. 글이 실시간으로 나오고, 번역·데스크톱 자막·음성 읽기도 언제든 켤 수 있습니다.
종료 후 클릭 한 번으로 AI 회의록을 생성합니다. 기록에서 전체 검색·편집·재인식이 가능하고 TXT / SRT / Markdown / PDF로 내보낼 수 있습니다.
핵심 기능은 완전히 무료이고 오픈소스(AGPL-3.0)입니다. 로컬 받아쓰기·번역·회의 요약·데스크톱 자막은 시간과 횟수 제한이 없고 계정 가입도 필요 없습니다.
크레딧은 직접 클라우드 모델을 선택했을 때만 실제 사용량만큼 차감되며, 구독·월정액·자동 결제는 없습니다. 신규 가입 시 100 크레딧을 드립니다.
로컬 모델을 쓰면 모델 다운로드가 끝난 뒤 완전히 오프라인으로 동작합니다. 오디오·받아쓰기·번역·요약이 모두 당신의 컴퓨터에서 처리되고 기기 밖으로 나가지 않습니다.
서버로 전송되는 것은 직접 클라우드 모델을 선택한 부분뿐이며, 로컬 기능에는 영향이 없습니다.
필요하지 않습니다. 모든 모델이 양자화 버전이라 CPU만으로 동작합니다(8스레드 이상 권장). 로컬 실시간 받아쓰기는 RTF ≈ 0.25, 로컬 실시간 번역은 문장당 약 2~4초입니다.
Windows 10 / 11과 macOS(Apple 실리콘)를 모두 정식 지원합니다(설치 파일 약 50 MB). Linux는 계획 중입니다. GitHub Issues에서 투표해 주시면 우선순위에 반영합니다.
특정 앱에 의존하지 않고 시스템 수준에서 오디오를 수집합니다. Zoom, Teams, Google Meet, Feishu, 웨비나, 강의, 방송, 팟캐스트 모두 가능하고, 회의실에 노트북을 들고 가서 대면 회의를 녹음할 수도 있습니다.
설치 파일에 아직 코드 서명이 없어서 시스템이 한 번 막는 것입니다 —— 소프트웨어에 문제가 있다는 뜻이 아닙니다. 소스는 완전히 공개되어 있고, README에 따라 직접 빌드할 수도 있습니다.
Windows: SmartScreen 파란 경고가 뜨면 '추가 정보 → 실행'을 누르세요.
macOS: "개발자를 확인할 수 없습니다"가 뜨면 앱을 우클릭해 "열기"를 선택하거나, 시스템 설정 → 개인정보 보호 및 보안에서 허용하세요.
Doubao(豆包), Qwen(千问), MiMo, Deepgram 등 여러 모델을 지원하며 30개 이상 언어를 커버합니다. 중국어는 Doubao, 영어·해외 환경은 Deepgram, 여러 언어가 섞인 회의는 Qwen이 유리합니다.
같은 회의를 다른 모델로 다시 인식해 결과를 비교하고 더 나은 쪽을 고를 수 있습니다.
'1시간 회의 = 인식 + 번역 + 요약' 기준으로 약 34 크레딧이므로 100 크레딧은 약 3시간 분량의 전체 회의에 해당합니다. 파일 받아쓰기만 한다면 훨씬 오래 쓸 수 있습니다.
실제 사용량은 선택한 모델에 따라 다르며, 앱 '계정'에서 날짜·모델별로 내역을 확인할 수 있습니다.
이 페이지에서 크레딧을 구매하면 결제 완료 후 교환 코드가 자동으로 표시됩니다. VoxMinutes를 열고 '계정 → 충전/교환'에 코드를 붙여 넣으면 즉시 반영됩니다.
잔액은 계정에 연결되어 있어 PC를 바꾸거나 재설치해도 사라지지 않습니다. 충전한 크레딧은 만료되지 않습니다.
무료 다운로드. 로컬 모델은 마법사가 받아 주고, 중국 본토에서는 자동으로 미러로 전환됩니다. 프록시가 필요 없습니다.
macOS에서 처음 실행할 때 "개발자를 확인할 수 없습니다"가 뜨면 앱을 우클릭해 "열기"를 선택하거나, 시스템 설정 → 개인정보 보호 및 보안에서 허용해 주세요.