AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#speech-recognition
#speech-recognition와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
Apple, 온라인 유사 라벨로 연방 ASR 학습 안정화… 정확도 최대 20.8% 향상
Apple ML
·
2026.09.24 09시
Apple, 라텐트 공간 증류로 오디오 인코더 2.8배 압축 성공
Apple ML
·
2026.09.24 09시
NVIDIA Parakeet, 순수 Java로 구동 가능
Reddit
·
2026.09.23 23시
NVIDIA, Nemotron 3 Diarization 공개
HuggingFace Blog
·
2026.09.23 22시
Wispr, 실시간 전사 특화 음성 모델 'Canto' 공개... GRPO 학습으로 경쟁 모델 대비 낮은 WER 달성
Hacker News
·
2026.09.18 03시
Parakeet 기반 ASR 모델 'Orukeet' 공개
Reddit
·
2026.09.12 00시
IVR의 한계와 Conversational AI 기반 차세대 음성 응답 시스템
ElevenLabs
·
2026.09.09 21시
추천
CPU 전용 실시간 자막 도구 공개
PyTorchKR 읽을거리
·
1
·
2026.09.07 12시
MS, MAI-Transcribe-2 공개… 경쟁사 대비 72% 저렴하고 5~10배 빠른 음성 인식 모델
TLDR AI
·
2026.09.04 09시
Meta, 실시간 다국어 ASR 모델 'Muse Voice Transcribe' 공개… WER 3.1%로 벤치마크 1위
TLDR AI
·
2026.09.02 09시
HF, 힌디어 ASR 평가 도입
HuggingFace Blog
·
2026.08.28 09시
스피커 디아라이제이션이란
ElevenLabs
·
2026.08.25 23시
FireRedAudio, 9B 통합 오디오 LLM 공개
Reddit
·
2026.08.22 01시
ASR 모델, 벤치마크 답 외우기
HuggingFace Blog
·
1
·
2026.08.21 09시
점진적 정제: 만다린-영어 코드스위칭 ASR를 위한 반복적 의사 라벨링 접근법
Apple ML
·
2026.08.20 09시
Microsoft, 새 MAI Realtime 음성 모델 테스트
TLDR AI
·
2026.08.03 09시
Microsoft, VibeVoice-ASR-BitNet 공개
Reddit
·
1
·
2026.07.28 13시
음성 기반 AI의 무한한 발전을 위한 음성인식 데이터셋의 역할
LG AI Research
·
2026.07.16 09시
음성 인식 데이터셋의 역할과 중요성
LG AI Research
·
2026.07.16 09시
Hume AI, 음성 AI 품질 측정 벤치마크 공개
HuggingFace Blog
·
2026.07.15 09시
Whisper 및 이전 모델과 비교한 Apple의 새로운 SpeechAnalyzer API 벤치마크
Hacker News
·
2026.07.14 01시
MOSS-Transcribe-Diarize 모델 공개
Reddit
·
2026.07.10 00시
긴 오디오 인코딩을 위한 분절형 어텐션 디코딩
Apple ML
·
2026.07.06 09시
전용 모델을 통한 ASR 오류 수정 방식의 재조명
Apple ML
·
2026.07.06 09시
이전
1
2
3
다음
이전
1
2
3
다음
#speech-recognition | AI Briefing