AI Briefing
피드
안내
개발
검색
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
주간
주간·월간 인기
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#speech-recognition
피드
트렌딩
주간
태그
설정
Microsoft, 새 MAI Realtime 음성 모델 테스트
TLDR AI
·
2026.08.03 09시
Microsoft, VibeVoice-ASR-BitNet 공개
Reddit
·
1
·
2026.07.28 13시
음성 인식 데이터셋의 역할과 중요성
LG AI Research
·
2026.07.16 09시
음성 기반 AI의 무한한 발전을 위한 음성인식 데이터셋의 역할
LG AI Research
·
2026.07.16 09시
Hume AI, 음성 AI 품질 측정 벤치마크 공개
HuggingFace Blog
·
2026.07.15 09시
Whisper 및 이전 모델과 비교한 Apple의 새로운 SpeechAnalyzer API 벤치마크
Hacker News
·
2026.07.14 01시
MOSS-Transcribe-Diarize 모델 공개
Reddit
·
2026.07.10 00시
긴 오디오 인코딩을 위한 분절형 어텐션 디코딩
Apple ML
·
2026.07.06 09시
전용 모델을 통한 ASR 오류 수정 방식의 재조명
Apple ML
·
2026.07.06 09시
실세계 음성 인식 성능 측정하는 FFASR 벤치마크 공개
HuggingFace Blog
·
2026.06.24 09시
ServiceNow, 코드 스위칭 음성 ASR 벤치마크 공개
HuggingFace Blog
·
1
·
2026.06.10 04시
실시간 다국어 ASR 라우팅 방식 공개
Reddit
·
2026.06.02 00시
경량 실시간 다국어 ASR 라우터 공개
Reddit
·
1
·
2026.06.02 00시
ASR 테스트용 noisekit 공개
Reddit
·
2026.05.27 22시
Open ASR 리더보드에 비공개 데이터 추가
HuggingFace Blog
·
2026.05.06 09시
OpenAI Realtime API 기반 음성 제어 React 컴포넌트
GeekNews
·
2026.04.29 09시
Python으로 대화형 AI에 TTS 통합하기
ElevenLabs
·
2026.04.10 14시
비디오 번역이란 무엇인가
ElevenLabs
·
2026.04.10 14시
TTS(Text-to-Speech)와 STT(Speech-to-Text) 비교
ElevenLabs
·
2026.04.10 14시
Qwen3-ASR와 Qwen3-ForcedAligner 오픈소스 공개: 견고한 스트리밍 다국어 지원
Qwen
·
2026.01.29 01시
Open ASR 리더보드 최신 트렌드
HuggingFace Blog
·
2025.11.21 09시
Speak, AI를 통해 언어 학습을 개인화하다
OpenAI Blog
·
2025.04.22 19시
HuggingFace, 인도 다언어 데이터셋 Vaani 지원
HuggingFace Blog
·
2025.02.27 09시
Wav2Vec2-BERT로 저자원 ASR 구현하기
HuggingFace Blog
·
2024.01.19 09시
이전
1
2
다음
이전
1
2
다음