Zettelkasten
Search
⌘K
Graph
Tags
#
audio
6개
Whisper에 numpy 배열을 넘기면 리샘플 없이 16kHz로 간주한다
2,264자
whisper
faster-whisper
speech-to-text
audio
resampling
목표 비트레이트로 인코딩하면 샘플링 레이트를 낮춰도 파일이 작아지지 않는다
2,021자
opus
audio
codec
signal-processing
음성 AI 학습 입력은 인식·분석은 16kHz, 합성·대화는 24kHz 모노로 수렴한다
1,905자
speech-ai
audio
signal-processing
dataset
정답 전사가 없어도 변형 간 이탈 패턴으로 오디오 열화를 판별할 수 있다
2,633자
stt
whisper
audio
evaluation
통화 녹음의 고음 에너지는 성별보다 AAC 비트레이트 차이가 크게 좌우한다
1,596자
audio
codec
signal-processing
speech-ai
Opus VBR은 오디오 복잡도에 따라 bitrate를 실시간으로 조절한다
570자
opus
audio
codec
webrtc