시스템 내부 오디오 실시간 자막, 고정밀 미디어 파일 텍스트 변환, 단어 단위 타임스탬프, 화자 분리 및 AI 교정 파이프라인.

크리에이터, 언어 학습자, 파워 유저를 위한 설계
초저지연 회의 실시간 자막부터 장시간 영상의 일괄 자막 생성까지 완벽 지원.
ScreenCaptureKit을 통해 시스템 내부 사운드 또는 마이크를 직접 캡처. 반투명 플로팅 윈도우, AEC 에코 캔슬레이션, 이중 언어 자막 지원.
로컬 오디오/비디오 파일을 드래그 앤 드롭하거나 웹 스트리밍 URL을 입력하여 GPU 고속 병렬 처리로 신속하게 변환.
밀리초 단위의 정밀한 단어 타임스탬프와 화자 분리(Speaker 0 / Speaker 1)로 인터뷰 및 회의록 작성에 최적화.
음성 인식(ASR), LLM 교정/번역/요약, TTS 음성 합성을 원클릭으로 실행 가능한 템플릿으로 연결.
Apple macOS 내장 온디바이스 음성 인식을 지원하여 인터넷 없이도 안전하게 작동. 로컬 Ollama/OneASR 연동 시 데이터는 100% 로컬에 보관.
OpenAI, Claude, DeepSeek, OneASR, 클라우드 API를 본인의 API 키로 직접 연결하여 중개 수수료 없이 이용.
시각적 파이프라인, 무한한 워크플로우 조합
DuRT는 복잡한 음성 처리와 LLM 기능을 6개의 표준 단계 모듈로 추상화합니다.
시스템 오디오, 마이크, 파일 또는 웹 URL
Apple 온디바이스 음성인식, OneASR 게이트웨이, OpenAI Whisper
문법 교정, 다국어 번역, 문장 분리, 요약
다양한 AI 음성 및 속도/피치 조절
SRT, WebVTT, JSON 타임스탬프, MP3 오디오
DuRT를 다운로드하고 Apple Silicon에 최적화된 강력한 AI 워크플로우를 경험해 보세요.