Damwha

무료 · 오픈소스 · macOS

그때 누가 뭐라고 했더라?

대화를 녹음하면 담화가 누가·언제·무슨 말을 했는지 정리해 둬요. 검색하면 그 말을 한 순간의 원본 음성으로 바로 가요.

v0.4.1 · 앱 490 MB · Apple Silicon(M1 이상) · macOS 15 이상모델 8–40 GB는 처음 쓸 때 따로 받아요데모: 읽기 전용 · 가입 없이 바로
담화의 전사 화면: 회의 목록, 화자별 색으로 나뉜 발화, 인사이트 패널

대화는 쌓이는데, 그때 한 말을 찾기는 여전히 어려워요.

기억은 흐려지고, 긴 녹음에서 그 한마디를 다시 찾기는 쉽지 않아요. 담화는 목소리로 누가 말했는지 가려내고, 한 번 알아본 사람은 다른 대화에서도 같은 사람으로 이어 줘요. 모든 말은 발화 단위로 원문, 음성, 앞뒤 맥락과 함께 저장돼요.

발화 점프

모든 대화를 검색하고 Enter를 누르면 그 초로 바로 가요. 발화는 강조되고 음성은 그 자리에서 재생을 기다려요.

⌘K → 검색 → Enter: 재생 헤드와 타임라인이 그 말을 한 순간으로 이동해요.

그 밖에 하는 일

성문이 등록된 화자 관리 화면

누가 말했는지 알아요

목소리 기반 화자 식별. 한 번 등록한 화자는 이후 모든 대화에서 알아봐요.

두 대화에 걸친 명령 팔레트 검색 결과

어디서든 ⌘K 검색

뜻과 키워드를 함께 보는 하이브리드 검색으로, 어느 화면에서든 모든 발화와 대화를 찾아요.

여러 대화의 결정 사항을 모은 렌즈 화면

렌즈: 결정·할 일·약속

로컬 LLM이 대화마다 뽑아 주고 항목마다 근거 발화로 가는 링크가 있어요. 마음껏 고쳐도 다시 뽑을 때 손댄 것은 그대로 남아요.

이 Mac에 맞는 프리셋을 추천하는 처리 설정 화면

내 Mac에 맞춰서

칩과 메모리를 읽어 프리셋을 추천해요. 요약은 녹취 언어·한국어·영어 중에서 골라요 — 한국어 회의를 영어로 요약받을 수도 있어요.

처음부터 내 Mac 안에서

클라우드 ML이 없어요. 전사·화자 식별·검색·요약이 모두 내 Mac에서 돌고 성문은 디스크에만 남아요. 모델은 처음 쓸 때 한 번 받고 녹음은 이 Mac을 떠나지 않아요.

  1. 오디오
  2. 정규화
  3. 음성 구간
  4. 화자 분리
  5. 화자 식별
  6. Whisper 전사
  7. 검색 색인
  8. 렌즈 ∥ 요약

필요한 것

Mac
Apple Silicon(M1 이상), macOS 15 이상
모델 용량
가볍게 약 8 GB · 표준 약 20 GB · 정확하게 약 40 GB, 처음 쓸 때 받아요
Hugging Face 토큰
화자 분리에만 필요해요. Hugging Face에서 모델 약관에 동의한 토큰을 앱 안에서 넣으면 되고 없어도 앱은 열려요.
화면 언어
한국어·영어. 영어 화면은 차례로 번역 중이에요.
대화 언어
전사: 자동·한국어·영어·일본어·중국어. 요약: 녹취 언어·한국어·영어.
Mac용 다운로드
v0.4.1 · 앱 490 MB · Apple Silicon(M1 이상) · macOS 15 이상모델 8–40 GB는 처음 쓸 때 따로 받아요

자주 묻는 질문

무료인가요?

네. MIT 라이선스의 오픈소스예요.

인터넷이 필요한가요?

모델을 처음 받을 때와 업데이트를 확인할 때만요. 녹음·전사·검색은 오프라인에서도 돼요.

Intel Mac이나 Windows에서도 되나요?

아니요. 처리 파이프라인이 Apple Silicon 전용인 MLX 위에서 돌아요.

영어로도 쓸 수 있나요?

화면은 영어로 차례로 번역 중이에요. 지금은 설정과 앱 메뉴가 번역돼 있고 나머지 화면은 다음 판부터 옮겨요. 한국어·영어·일본어·중국어 대화를 전사하고 요약은 한국어나 영어로 받을 수 있어요.

실시간으로 녹음할 수 있나요?

네. 녹음하는 동안 전사 미리보기가 흐르고, 멈추면 전체 처리가 돌아요.

업데이트는 어떻게 하나요?

앱이 GitHub Releases를 확인해 새 버전을 알려 줘요. 새 DMG를 받아 앱을 바꾸면 되고 데이터는 그대로예요.

업데이트를 되돌릴 수 있나요?

네. 새 버전이 데이터베이스를 올리기 전에 스냅샷을 떠 두고 앱 메뉴에서 되돌릴 수 있어요.

데모의 목소리는 실제 사람인가요?

아니요. Google NotebookLM Audio Overview로 만든 AI 음성이고 진짜 파이프라인으로 처리한 결과예요.