AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#llm-benchmark
#llm-benchmark와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
#llm-benchmark 2페이지 | AI Briefing
DeepSWE, 코딩 모델 리더보드 오류 지적
Reddit
·
2026.06.02 12시
BenchBench 소개
TLDR AI
·
2026.05.26 06시
Qwen3.7 Max, 추론 및 코딩 성능 향상
Reddit
·
2026.05.22 19시
에이전트 실행 세금 개념 도입
Reddit
·
2026.05.22 00시
Antigravity 2.0, OpenSCAD 아키텍처 3D LLM 벤치마크 1위 차지
Hacker News
·
2026.05.21 09시
AI 안전성 벤치마크 DystopiaBench 공개
Reddit
·
2026.05.18 22시
GPT 5.5, ProgramBench 첫 해결
Reddit
·
2026.05.13 02시
Kimi K2.6가 코딩 챌린지에서 Claude, GPT-5.5, Gemini를 이김
GeekNews
·
2026.05.04 09시
Qwen 3.6 대승
Reddit
·
2026.04.18 05시
Claude Opus 4.7 텍스트 순위
Reddit
·
2026.04.18 02시
Sonnet만 흔들린다
Reddit
·
2026.04.15 23시
7/8 통과한 Gemma
Reddit
·
2026.04.15 07시
NeurIPS 2025 E2LM 경진대회 개최
HuggingFace Blog
·
2025.07.04 21시
이전
1
2
다음
이전
1
2
다음