AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#llm-evaluation
#llm-evaluation와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#llm-evaluation 6페이지 | AI Briefing
의료용 LLM 성능 평가를 위한 Open Leaderboard 공개
HuggingFace Blog
·
2024.04.19 09시
Upstage, Open Ko-LLM Leaderboard 공개
HuggingFace Blog
·
2024.02.20 09시
LLM 추론 평가용 NPHardEval 리더보드 공개
HuggingFace Blog
·
2024.02.02 09시
실무 중심 LLM 평가 리더보드 출시
HuggingFace Blog
·
2024.01.31 09시
LLM 환각 측정 리더보드 공개
HuggingFace Blog
·
2024.01.29 09시
Hugging Face 리더보드 구축 가이드 공개
HuggingFace Blog
·
2024.01.12 09시
DROP 벤치마크 점수 오류 원인 규명
HuggingFace Blog
·
2023.12.01 09시
LangSmith 벤치마크 공유 기능 공개
LangChain Blog
·
2023.11.23 02시
테스트 실행 비교 기능
LangChain Blog
·
2023.10.18 00시
MMLU 벤치마크 점수 불일치 원인 분석
HuggingFace Blog
·
2023.06.23 09시
Hugging Face, LLM 평가 체계 확장
HuggingFace Blog
·
2023.06.12 09시
에이전트 코딩 평가에서의 인프라 노이즈 정량화
Anthropic Engineering
·
1
이전
2
3
4
5
6
다음
이전
1
2
3
4
5
6
다음