TLDR AI 뉴스
TLDR AI에서 수집한 AI·개발 최신 뉴스와 한국어 요약입니다.
원문 사이트 방문 →전문가 재채점 결과, 물리 벤치마크 결함으로 프론티어 모델 성능 과소평가 확인
·2026.09.14 09시
Fable 5.1, GPT-6 Astra, Grok 4.6의 인터랙티브 램프 빌드 비교
·2026.09.14 09시
Sakana AI, 멀티 에이전트 오케스트레이션 기반 'Fugu Ultra v2' 공개
·2026.09.14 09시
LLM을 분류기가 아닌 피처 엔지니어링 도구로 활용, 아이러니 감지 성능 개선
·2026.09.13 16시
LLMTraceFX, 캐시 히트가 연산 생략을 증명하지 못함을 검증하는 독립 오디터 도입
·1·2026.09.13 15시
프론티어 AI 랩의 규제 제안, 안전 명분 뒤 숨겨진 '속도 조절'의 경제적 인센티브
·2026.09.13 09시
OpenAI CEO "2026년 상장 부적절"… AI 안전성·사회적 수용성 고려
·2026.09.13 05시
ARC Prize, 자율적 개방형 혁신 평가하는 ARC-AGI-4 벤치마크 공개
·2026.09.12 09시
Recurrent Looped Transformer 공개: 시퀀스 길이에 따라 깊이가 확장되는 아키텍처
·2026.09.12 09시
AI 연구자들, RSI의 누적 작업 성격과 지속 학습의 한계 논의
·2026.09.12 01시
OpenAI·Anthropic, 모델과 하네스를 함께 구축…관리형 에이전트 API 확산
·2026.09.11 09시
OpenAI, ChatGPT Sites 사용자 500만 돌파 및 협업·배포 기능 업데이트
·2026.09.11 09시
Meta, 실제 웨어러블 데이터 기반 건강 추론 벤치마크 'WearableQA' 공개
·2·2026.09.11 09시
Salesforce, 에이전트와 하네스의 공진화를 위한 더 나은 방법 발견 (9분 분량)
·2026.09.11 09시
Rhoda AI, 웹 비디오 사전학습 스케일링이 실제 로봇 작업 성능 향상 입증
·2026.09.11 09시
Google, AI 코딩 에이전트용 'Google Cloud Developer Plugin' 공개
·2026.09.11 09시
알리바바, 2년간 내부 검증 마친 AI 코드 리뷰 도구 'Open Code Review' 오픈소스 공개
·2026.09.11 09시
OpenAI, Astra 수요로 인해 Pro 구독 일시 중단
·2026.09.11 05시