AI Briefing
피드
안내
개발
검색
로그인
전체
피드·트렌딩·게시판 통합
피드
최신 뉴스
주간
주간·월간 인기
트렌딩
오픈소스·릴리즈
게시판
블로그·홍보
태그
주제별 탐색
#llm-as-a-judge
피드
트렌딩
주간
태그
설정
LangSmith로 음성 에이전트를 평가하는 방법
LangChain Blog
·
2026.08.05 02시
[ACL 2024] LLM 연구의 최신 트렌드와 주요 인사이트 - LG AI Research BLOG
LG AI Research
·
2026.07.16 09시
9명의 판사, 실제로는 2명분: 상관관계가 있는 오류가 LLM 평가 패널을 저해한다
Apple ML
·
2026.06.23 09시
Align Evals 소개: LLM 애플리케이션 평가 프로세스 간소화
LangChain Blog
·
1
·
2026.06.16 02시
Agentic AI 기반 플랫폼 - Part 3: AgentCore Policy, Evaluation, Observability로 기업 운영 체계 구축하기
AWS Tech Blog (한국)
·
2026.05.15 15시
Amazon Bedrock, 고급 프롬프트 최적화·모델 전환 도구 공개
AWS Blog
·
2026.05.15 07시
CrabTrap: 프로덕션 환경의 에이전트를 보호하기 위한 LLM-as-a-judge HTTP 프록시
Hacker News
·
2026.04.22 00시
LLM as a Judge를 활용한 RAG 평가
Mistral AI
·
2025.04.09 09시
LLM as a Judge를 활용한 CodeBuddy 성능 평가
카카오
·
2025.03.07 00시
Judge Arena: LLM 평가 모델 벤치마킹
HuggingFace Blog
·
2024.11.19 09시
LLM-as-a-Judge 기반 RAG 평가 사례
HuggingFace Blog
·
2024.10.28 09시
LLM-as-a-Judge를 인간의 선호도에 맞게 정렬하기
LangChain Blog
·
2024.06.27 01시
LangSmith를 활용한 Pairwise Evaluation
LangChain Blog
·
2024.05.16 00시