AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#benchmark
#benchmark와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#benchmark 16페이지 | AI Briefing
아랍어 LLM 평가용 AraGen 공개
HuggingFace Blog
·
2024.12.04 09시
SimpleQA 공개
OpenAI Blog
·
2024.10.30 19시
카카오, VMWare 인프라 최적 VM 집적도 테스트 결과 공개
카카오
·
2024.10.07 00시
BenCzechMark: 체코어 LLM 평가
HuggingFace Blog
·
2024.10.01 09시
Grok-2 베타 출시
xAI
·
2024.08.13 00시
코드 생성 벤치마크 BigCodeBench 공개
HuggingFace Blog
·
2024.06.18 09시
Qwen2를 소개합니다
Qwen
·
2024.06.07 01시
의료용 LLM 성능 평가를 위한 Open Leaderboard 공개
HuggingFace Blog
·
2024.04.19 09시
LiveCodeBench 리더보드 공개
HuggingFace Blog
·
2024.04.16 09시
멀티모달 추론 벤치마크 'ConTextual' 공개
HuggingFace Blog
·
2024.03.05 09시
LLM 레드팀 저항성 리더보드 공개
HuggingFace Blog
·
2024.02.23 09시
Upstage, Open Ko-LLM Leaderboard 공개
HuggingFace Blog
·
2024.02.20 09시
LLM 추론 평가용 NPHardEval 리더보드 공개
HuggingFace Blog
·
2024.02.02 09시
LLM 환각 측정 리더보드 공개
HuggingFace Blog
·
2024.01.29 09시
Spring 공화국에서 Ktor 사용하기
카카오페이
·
2024.01.11 09시
SageMaker Llama 2 배포 벤치마크
HuggingFace Blog
·
2023.09.26 09시
MMLU 벤치마크 점수 불일치 원인 분석
HuggingFace Blog
·
2023.06.23 09시
Gaudi2, Nvidia A100 대비 2배 빠른 성능
HuggingFace Blog
·
2022.12.14 09시
MTEB: 텍스트 임베딩 성능 평가 벤치마크 공개
HuggingFace Blog
·
2022.10.19 09시
J1 Grande 공개
AI21 Labs
·
2022.05.02 16시
일반 대화와 코딩 기능을 결합한 새 오픈소스 모델 DeepSeek-V2.5
DeepSeek
·
1
DeepSeek-R1-0528 출시
DeepSeek
DeepSeek-V3.2 출시
DeepSeek
·
2
이전
12
13
14
15
16
다음
이전
7
8
9
10
11
12
13
14
15
16
다음