AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#asr
#asr와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
Apple, 온라인 유사 라벨로 연방 ASR 학습 안정화… 정확도 최대 20.8% 향상
Apple ML
·
2026.09.24 09시
NVIDIA, Nemotron 3 Diarization 공개
HuggingFace Blog
·
2026.09.23 22시
ElevenLabs, Scribe v2 Medical 정식 출시… 임상 오디오 WER 18% 감소
ElevenLabs
·
2026.09.22 21시
ElevenLabs, 의료 특화 음성 인식 모델 'Scribe v2 Medical' 일반 공개
ElevenLabs
·
2026.09.22 21시
Wispr, 실시간 전사 특화 음성 모델 'Canto' 공개... GRPO 학습으로 경쟁 모델 대비 낮은 WER 달성
Hacker News
·
2026.09.18 03시
Parakeet 기반 ASR 모델 'Orukeet' 공개
Reddit
·
2026.09.12 00시
마이크로소프트, 초고속 음성 전사 모델 MAI-Transcribe-2 공개
PyTorchKR 읽을거리
·
1
·
2026.09.08 18시
추천
로컬 음성 클론·더빙·전사 지원 오픈소스 'VoiceStudio' 공개
GeekNews
·
2026.09.08 11시
Meta, 실시간 다국어 ASR 모델 'Muse Voice Transcribe' 공개… WER 3.1%로 벤치마크 1위
TLDR AI
·
2026.09.02 09시
HF, 힌디어 ASR 평가 도입
HuggingFace Blog
·
2026.08.28 09시
audio.cpp 0.7, 62개 모델 패밀리 지원
Reddit
·
2026.08.28 02시
ASR 모델, 벤치마크 답 외우기
HuggingFace Blog
·
1
·
2026.08.21 09시
Superwhisper S1-mini (8분 읽기)
TLDR AI
·
2026.08.20 09시
점진적 정제: 만다린-영어 코드스위칭 ASR를 위한 반복적 의사 라벨링 접근법
Apple ML
·
2026.08.20 09시
ChatGPT 오디오 전처리 경계 침범
Reddit
·
2026.08.17 17시
NVIDIA 음성 스택 로컬화
Reddit
·
2026.08.07 07시
의료용 음성 인식(Medical Speech To Text) 기술
ElevenLabs
·
2026.07.29 01시
Microsoft, VibeVoice-ASR-BitNet 공개
Reddit
·
1
·
2026.07.28 13시
audio.cpp 0.4, TTS 35개 모델 패밀리 지원
Reddit
·
2026.07.24 09시
단어 오류율(WER)의 이해
ElevenLabs
·
2026.07.21 22시
transcribe.cpp
Hacker News
·
2026.07.19 09시
아랍어 음성 인식
Cohere
·
2026.07.07 23시
전용 모델을 통한 ASR 오류 수정 방식의 재조명
Apple ML
·
2026.07.06 09시
C++ 기반 통합 오디오 추론 프레임워크 audio.cpp 공개
Reddit
·
1
·
2026.06.26 08시
이전
1
2
3
다음
이전
1
2
3
다음
#asr | AI Briefing