녹음 파일과 전사한 글을 같은 자료함에서 관리하려고 만든 SpokenLog입니다. 글의 시간표시를 누르면 해당 구간을 다시 들을 수 있고, 내용을 수정한 뒤 TXT, SRT, VTT, JSON으로 내보낼 수 있습니다.
전사는 로컬 SenseVoice, Moonshine, Whisper 모델이나 직접 입력한 Groq/Cloudflare API 자격증명을 선택합니다. 로컬 입력은 WAV만 지원하며 모델은 따로 내려받습니다. 현재 앱 구독이나 로컬 서비스 시간제한은 없고, 클라우드 비용과 한도는 별도입니다.
Windows와 Android를 지원합니다. macOS와 iOS 빌드도 제공하지만 이번 Apple 버전은 기기에서 직접 테스트하지 못했습니다. 첨부 GIF는 합성 음성 샘플로 촬영한 실제 Windows 화면입니다. UI는 영어와 한국어이며 코드는 AGPL-3.0-only입니다.
Windows는 미서명, macOS는 미공증 상태이고 iOS는 직접 재서명해야 합니다.
토론 · 1