AI Briefing
피드
안내
검색
EN
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#coding-benchmark
#coding-benchmark와 관련된 AI·개발 뉴스를 최신순으로 모았습니다. 원문 출처와 한국어 요약을 함께 확인할 수 있습니다.
피드
트렌딩
태그
설정
GLM-5.3 오픈 웨이트 공개
HuggingFace Blog
·
1
·
2026.08.29 04시
Z.ai, GLM-5.3-Flash 공개: 18B 활성 파라미터로 Claude Opus 4.8에 근접
TLDR AI
·
2026.08.27 09시
MirrorCode (8분 읽기)
TLDR AI
·
2026.08.04 09시
SlopCodeBench 벤치마크, Opus 5의 장기 코딩 성능 한계 지적
GeekNews
·
2026.07.28 22시
도구 사용 능력을 갖춘 LLM 에이전트의 취약점 측정
TLDR AI
·
2026.06.26 09시
Ramp SWE-Bench: 실제 프로덕션 환경에 기반한 프라이빗 코딩 벤치마크
TLDR AI
·
2026.06.15 09시
FrontierCode
TLDR AI
·
2026.06.09 07시
Apex-Testing 코딩 벤치마크 업데이트
Reddit
·
2026.05.23 22시
Qwen3.6-27B: 27B Dense 모델로 구현한 플래그십급 코딩 성능
TLDR AI
·
2026.04.23 09시
오푸스 4.7 반등
Reddit
·
2026.04.17 11시
Claude Opus 4.1 출시
Anthropic News
·
2025.08.15 01시
#coding-benchmark | AI Briefing